{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/imitation-learning/papers/9","list_of":"/task/imitation-learning","task":"Imitation Learning","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":9,"pages_in_order":22,"rows_per_page":100,"rows":[801,900],"of":2122,"counts":{"archive_papers_tagged":2122,"with_a_code_link":691,"where_syntology_ran_a_sample":234,"not_listed_spam_title":0,"listed":2122,"listed_where_code_ran":234,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":191,"every_run_a_failure_of_syntologys_instrument":43,"listed_with_a_run_with_no_instrument_failure":191,"listed_every_run_a_failure_of_syntologys_instrument":43,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/imitation-learning","prev":"/task/imitation-learning/papers/8","next":"/task/imitation-learning/papers/10","papers":[{"url":null,"slug":"bridging-the-sim-to-real-gap-a-control","title":"Bridging the Sim-to-real Gap: A Control Framework for Imitation Learning of Model Predictive Control","date":"2025-03-25","arxiv_id":"2503.19228","repositories_listed":0,"syntology":null},{"url":null,"slug":"parental-guidance-efficient-lifelong-learning","title":"Parental Guidance: Efficient Lifelong Learning through Evolutionary Distillation","date":"2025-03-24","arxiv_id":"2503.18531","repositories_listed":0,"syntology":null},{"url":null,"slug":"beac-imitating-complex-exploration-and-task","title":"BEAC: Imitating Complex Exploration and Task-oriented Behaviors for Invisible Object Nonprehensile Manipulation","date":"2025-03-21","arxiv_id":"2503.16803","repositories_listed":0,"syntology":null},{"url":null,"slug":"tamedpuma-safe-and-stable-imitation-learning","title":"TamedPUMA: safe and stable imitation learning with geometric fabrics","date":"2025-03-21","arxiv_id":"2503.17432","repositories_listed":0,"syntology":null},{"url":null,"slug":"jarvis-vla-post-training-large-scale-vision","title":"JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse","date":"2025-03-20","arxiv_id":"2503.16365","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-3d-scene-analogies-with-neural","title":"Learning 3D Scene Analogies with Neural Contextual Scene Maps","date":"2025-03-20","arxiv_id":"2503.15897","repositories_listed":0,"syntology":null},{"url":null,"slug":"robofactory-exploring-embodied-agent","title":"RoboFactory: Exploring Embodied Agent Collaboration with Compositional Constraints","date":"2025-03-20","arxiv_id":"2503.16408","repositories_listed":0,"syntology":null},{"url":null,"slug":"ccdp-composition-of-conditional-diffusion","title":"CCDP: Composition of Conditional Diffusion Policies with Guided Sampling","date":"2025-03-19","arxiv_id":"2503.15386","repositories_listed":0,"syntology":null},{"url":null,"slug":"online-imitation-learning-for-manipulation","title":"Online Imitation Learning for Manipulation via Decaying Relative Correction through Teleoperation","date":"2025-03-19","arxiv_id":"2503.15368","repositories_listed":0,"syntology":null},{"url":null,"slug":"robotic-paper-wrapping-by-learning-force","title":"Robotic Paper Wrapping by Learning Force Control","date":"2025-03-19","arxiv_id":"2503.15685","repositories_listed":0,"syntology":null},{"url":null,"slug":"styleloco-generative-adversarial-distillation","title":"StyleLoco: Generative Adversarial Distillation for Natural Humanoid Robot Locomotion","date":"2025-03-19","arxiv_id":"2503.15082","repositories_listed":0,"syntology":null},{"url":null,"slug":"gr00t-n1-an-open-foundation-model-for","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","date":"2025-03-18","arxiv_id":"2503.14734","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-bimanual-manipulation-via-action","title":"Learning Bimanual Manipulation via Action Chunking and Inter-Arm Coordination with Transformers","date":"2025-03-18","arxiv_id":"2503.13916","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-imitation-under-misspecification","title":"Efficient Imitation under Misspecification","date":"2025-03-17","arxiv_id":"2503.13162","repositories_listed":0,"syntology":null},{"url":null,"slug":"flex-a-framework-for-learning-robot-agnostic","title":"FLEX: A Framework for Learning Robot-Agnostic Force-based Skills Involving Sustained Contact Object Manipulation","date":"2025-03-17","arxiv_id":"2503.13418","repositories_listed":0,"syntology":null},{"url":null,"slug":"hybridgen-vlm-guided-hybrid-planning-for","title":"HybridGen: VLM-Guided Hybrid Planning for Scalable Data Generation of Imitation Learning","date":"2025-03-17","arxiv_id":"2503.13171","repositories_listed":0,"syntology":null},{"url":null,"slug":"genosil-generalized-optimal-and-safe-robot","title":"GenOSIL: Generalized Optimal and Safe Robot Control using Parameter-Conditioned Imitation Learning","date":"2025-03-15","arxiv_id":"2503.12243","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-abstraction-to-reality-darpa-s-vision","title":"From Abstraction to Reality: DARPA's Vision for Robust Sim-to-Real Autonomy","date":"2025-03-14","arxiv_id":"2503.11007","repositories_listed":0,"syntology":null},{"url":null,"slug":"is-your-imitation-learning-policy-better-than","title":"Is Your Imitation Learning Policy Better than Mine? Policy Comparison with Near-Optimal Stopping","date":"2025-03-14","arxiv_id":"2503.10966","repositories_listed":0,"syntology":null},{"url":null,"slug":"residual-policy-gradient-a-reward-view-of-kl","title":"Residual Policy Gradient: A Reward View of KL-regularized Objective","date":"2025-03-14","arxiv_id":"2503.11019","repositories_listed":0,"syntology":null},{"url":null,"slug":"sketch-to-skill-bootstrapping-robot-learning","title":"Sketch-to-Skill: Bootstrapping Robot Learning with Human Drawn Trajectory Sketches","date":"2025-03-14","arxiv_id":"2503.11918","repositories_listed":0,"syntology":null},{"url":null,"slug":"taste-rob-advancing-video-generation-of-task","title":"TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation","date":"2025-03-14","arxiv_id":"2503.11423","repositories_listed":0,"syntology":null},{"url":null,"slug":"finetuning-generative-trajectory-model-with","title":"Finetuning Generative Trajectory Model with Reinforcement Learning from Human Feedback","date":"2025-03-13","arxiv_id":"2503.10434","repositories_listed":0,"syntology":null},{"url":null,"slug":"lumos-language-conditioned-imitation-learning","title":"LUMOS: Language-Conditioned Imitation Learning with World Models","date":"2025-03-13","arxiv_id":"2503.10370","repositories_listed":0,"syntology":null},{"url":null,"slug":"nil-no-data-imitation-learning-by-leveraging","title":"NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models","date":"2025-03-13","arxiv_id":"2503.10626","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatial-temporal-graph-diffusion-policy-with","title":"Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation","date":"2025-03-13","arxiv_id":"2503.10743","repositories_listed":0,"syntology":null},{"url":null,"slug":"feasibility-aware-imitation-learning-from","title":"Feasibility-aware Imitation Learning from Observations through a Hand-mounted Demonstration Interface","date":"2025-03-12","arxiv_id":"2503.09018","repositories_listed":0,"syntology":null},{"url":null,"slug":"se-3-equivariant-robot-learning-and-control-a","title":"SE(3)-Equivariant Robot Learning and Control: A Tutorial Survey","date":"2025-03-12","arxiv_id":"2503.09829","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-pitfalls-of-imitation-learning-when","title":"The Pitfalls of Imitation Learning when Actions are Continuous","date":"2025-03-12","arxiv_id":"2503.09722","repositories_listed":0,"syntology":null},{"url":null,"slug":"imitation-learning-of-correlated-policies-in","title":"Imitation Learning of Correlated Policies in Stackelberg Games","date":"2025-03-11","arxiv_id":"2503.08883","repositories_listed":0,"syntology":null},{"url":null,"slug":"tla-tactile-language-action-model-for-contact","title":"TLA: Tactile-Language-Action Model for Contact-Rich Manipulation","date":"2025-03-11","arxiv_id":"2503.08548","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-to-train-your-robots-the-impact-of","title":"How to Train Your Robots? The Impact of Demonstration Modality on Imitation Learning","date":"2025-03-10","arxiv_id":"2503.07017","repositories_listed":0,"syntology":null},{"url":null,"slug":"one-shot-dual-arm-imitation-learning","title":"One-Shot Dual-Arm Imitation Learning","date":"2025-03-10","arxiv_id":"2503.06831","repositories_listed":0,"syntology":null},{"url":null,"slug":"policy-regularization-on-globally-accessible","title":"Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning","date":"2025-03-10","arxiv_id":"2503.06893","repositories_listed":0,"syntology":null},{"url":null,"slug":"epr-gail-an-epr-enhanced-hierarchical","title":"EPR-GAIL: An EPR-Enhanced Hierarchical Imitation Learning Framework to Simulate Complex User Consumption Behaviors","date":"2025-03-09","arxiv_id":"2503.06392","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-drive-by-imitating-surrounding","title":"Learning to Drive by Imitating Surrounding Vehicles","date":"2025-03-08","arxiv_id":"2503.05997","repositories_listed":0,"syntology":null},{"url":null,"slug":"dart-vinci-egocentric-data-collection-for","title":"dARt Vinci: Egocentric Data Collection for Surgical Robot Learning at Scale","date":"2025-03-07","arxiv_id":"2503.05646","repositories_listed":0,"syntology":null},{"url":null,"slug":"kaiwu-a-multimodal-manipulation-dataset-and","title":"Kaiwu: A Multimodal Manipulation Dataset and Framework for Robot Learning and Human-Robot Interaction","date":"2025-03-07","arxiv_id":"2503.05231","repositories_listed":0,"syntology":null},{"url":null,"slug":"look-before-you-leap-using-serialized-state","title":"Look Before You Leap: Using Serialized State Machine for Language Conditioned Robotic Manipulation","date":"2025-03-07","arxiv_id":"2503.05114","repositories_listed":0,"syntology":null},{"url":null,"slug":"adapt3r-adaptive-3d-scene-representation-for","title":"Adapt3R: Adaptive 3D Scene Representation for Domain Transfer in Imitation Learning","date":"2025-03-06","arxiv_id":"2503.04877","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-efficient-learning-from-human","title":"Data-Efficient Learning from Human Interventions for Mobile Robots","date":"2025-03-06","arxiv_id":"2503.04969","repositories_listed":0,"syntology":null},{"url":null,"slug":"curating-demonstrations-using-online","title":"Curating Demonstrations using Online Experience","date":"2025-03-05","arxiv_id":"2503.03707","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-autonomous-driving-safety-with","title":"Enhancing Autonomous Driving Safety with Collision Scenario Integration","date":"2025-03-05","arxiv_id":"2503.03957","repositories_listed":0,"syntology":null},{"url":null,"slug":"a2perf-real-world-autonomous-agents-benchmark","title":"A2Perf: Real-World Autonomous Agents Benchmark","date":"2025-03-04","arxiv_id":"2503.03056","repositories_listed":0,"syntology":null},{"url":null,"slug":"articubot-learning-universal-articulated","title":"ArticuBot: Learning Universal Articulated Object Manipulation Policy via Large Scale Simulation","date":"2025-03-04","arxiv_id":"2503.03045","repositories_listed":0,"syntology":null},{"url":null,"slug":"2503-01676","title":"Perceptual Motor Learning with Active Inference Framework for Robust Lateral Control","date":"2025-03-03","arxiv_id":"2503.01676","repositories_listed":0,"syntology":null},{"url":null,"slug":"caps-context-aware-priority-sampling-for","title":"CAPS: Context-Aware Priority Sampling for Enhanced Imitation Learning in Autonomous Driving","date":"2025-03-03","arxiv_id":"2503.01650","repositories_listed":0,"syntology":null},{"url":null,"slug":"fabg-end-to-end-imitation-learning-for","title":"FABG : End-to-end Imitation Learning for Embodied Affective Human-Robot Interaction","date":"2025-03-03","arxiv_id":"2503.01363","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-retrospective-language-agents-via","title":"Improving Retrospective Language Agents via Joint Policy Gradient Optimization","date":"2025-03-03","arxiv_id":"2503.01490","repositories_listed":0,"syntology":null},{"url":null,"slug":"dexgraspvla-a-vision-language-action","title":"DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping","date":"2025-02-28","arxiv_id":"2502.20900","repositories_listed":0,"syntology":null},{"url":null,"slug":"il-soar-imitation-learning-with-soft","title":"IL-SOAR : Imitation Learning with Soft Optimistic Actor cRitic","date":"2025-02-27","arxiv_id":"2502.19859","repositories_listed":0,"syntology":null},{"url":null,"slug":"objectvla-end-to-end-open-world-object","title":"ObjectVLA: End-to-End Open-World Object Manipulation Without Demonstration","date":"2025-02-26","arxiv_id":"2502.19250","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-reusability-of-learned-skills-for","title":"Enhancing Reusability of Learned Skills for Robot Manipulation via Gaze and Bottleneck","date":"2025-02-25","arxiv_id":"2502.18121","repositories_listed":0,"syntology":null},{"url":null,"slug":"task-driven-semantic-quantization-and","title":"Task-Driven Semantic Quantization and Imitation Learning for Goal-Oriented Communications","date":"2025-02-25","arxiv_id":"2502.17842","repositories_listed":0,"syntology":null},{"url":null,"slug":"hierarchical-imitation-learning-of-team","title":"Hierarchical Imitation Learning of Team Behavior from Heterogeneous Demonstrations","date":"2025-02-24","arxiv_id":"2502.17618","repositories_listed":0,"syntology":null},{"url":null,"slug":"boss-benchmark-for-observation-space-shift-in","title":"BOSS: Benchmark for Observation Space Shift in Long-Horizon Task","date":"2025-02-21","arxiv_id":"2502.15679","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-a-reward-free-reinforcement-learning","title":"Towards a Reward-Free Reinforcement Learning Framework for Vehicle Control","date":"2025-02-21","arxiv_id":"2502.15262","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-training-free-framework-for-precise-mobile","title":"A Training-Free Framework for Precise Mobile Manipulation of Small Everyday Objects","date":"2025-02-19","arxiv_id":"2502.13964","repositories_listed":0,"syntology":null},{"url":null,"slug":"mile-model-based-intervention-learning","title":"MILE: Model-based Intervention Learning","date":"2025-02-19","arxiv_id":"2502.13519","repositories_listed":0,"syntology":null},{"url":null,"slug":"modskill-physical-character-skill","title":"ModSkill: Physical Character Skill Modularization","date":"2025-02-19","arxiv_id":"2502.14140","repositories_listed":0,"syntology":null},{"url":null,"slug":"optimistically-optimistic-exploration-for","title":"Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning","date":"2025-02-19","arxiv_id":"2502.13900","repositories_listed":0,"syntology":null},{"url":null,"slug":"computational-statistical-tradeoffs-at-the","title":"Computational-Statistical Tradeoffs at the Next-Token Prediction Barrier: Autoregressive and Imitation Learning under Misspecification","date":"2025-02-18","arxiv_id":"2502.12465","repositories_listed":0,"syntology":null},{"url":null,"slug":"homie-humanoid-loco-manipulation-with","title":"HOMIE: Humanoid Loco-Manipulation with Isomorphic Exoskeleton Cockpit","date":"2025-02-18","arxiv_id":"2502.13013","repositories_listed":0,"syntology":null},{"url":null,"slug":"rad-training-an-end-to-end-driving-policy-via","title":"RAD: Training an End-to-End Driving Policy via Large-Scale 3DGS-based Reinforcement Learning","date":"2025-02-18","arxiv_id":"2502.13144","repositories_listed":0,"syntology":null},{"url":null,"slug":"fitlight-federated-imitation-learning-for","title":"FitLight: Federated Imitation Learning for Plug-and-Play Autonomous Traffic Signal Control","date":"2025-02-17","arxiv_id":"2502.11937","repositories_listed":0,"syntology":null},{"url":null,"slug":"functo-function-centric-one-shot-imitation","title":"FUNCTO: Function-Centric One-Shot Imitation Learning for Tool Manipulation","date":"2025-02-17","arxiv_id":"2502.11744","repositories_listed":0,"syntology":null},{"url":null,"slug":"imle-policy-fast-and-sample-efficient","title":"IMLE Policy: Fast and Sample Efficient Visuomotor Policy Learning via Implicit Maximum Likelihood Estimation","date":"2025-02-17","arxiv_id":"2502.12371","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-fusing-point-cloud-and-visual","title":"Towards Fusing Point Cloud and Visual Representations for Imitation Learning","date":"2025-02-17","arxiv_id":"2502.12320","repositories_listed":0,"syntology":null},{"url":null,"slug":"adamanip-adaptive-articulated-object","title":"AdaManip: Adaptive Articulated Object Manipulation Environments and Policy Learning","date":"2025-02-16","arxiv_id":"2502.11124","repositories_listed":0,"syntology":null},{"url":null,"slug":"object-centric-latent-action-learning","title":"Object-Centric Latent Action Learning","date":"2025-02-13","arxiv_id":"2502.09680","repositories_listed":0,"syntology":null},{"url":null,"slug":"cordvip-correspondence-based-visuomotor","title":"CordViP: Correspondence-based Visuomotor Policy for Dexterous Manipulation in Real-World","date":"2025-02-12","arxiv_id":"2502.08449","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-unifying-framework-for-causal-imitation","title":"A Unifying Framework for Causal Imitation Learning with Hidden Confounders","date":"2025-02-11","arxiv_id":"2502.07656","repositories_listed":0,"syntology":null},{"url":null,"slug":"imit-diff-semantics-guided-diffusion","title":"Imit Diff: Semantics Guided Diffusion Transformer with Dual Resolution Fusion for Imitation Learning","date":"2025-02-11","arxiv_id":"2502.09649","repositories_listed":0,"syntology":null},{"url":null,"slug":"predictive-red-teaming-breaking-policies","title":"Predictive Red Teaming: Breaking Policies Without Breaking Robots","date":"2025-02-10","arxiv_id":"2502.06575","repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-physically-realistic-and","title":"Generating Physically Realistic and Directable Human Motions from Multi-Modal Inputs","date":"2025-02-08","arxiv_id":"2502.05641","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-free-reasoning-for-policy","title":"Action-Free Reasoning for Policy Generalization","date":"2025-02-06","arxiv_id":"2502.03729","repositories_listed":0,"syntology":null},{"url":null,"slug":"dexteritygen-foundation-controller-for","title":"DexterityGen: Foundation Controller for Unprecedented Dexterity","date":"2025-02-06","arxiv_id":"2502.04307","repositories_listed":0,"syntology":null},{"url":null,"slug":"omnirl-in-context-reinforcement-learning-by","title":"OmniRL: In-Context Reinforcement Learning by Large-Scale Meta-Training in Randomized Worlds","date":"2025-02-05","arxiv_id":"2502.02869","repositories_listed":0,"syntology":null},{"url":null,"slug":"rethinking-latent-representations-in-behavior","title":"Rethinking Latent Redundancy in Behavior Cloning: An Information Bottleneck Approach for Robot Manipulation","date":"2025-02-05","arxiv_id":"2502.02853","repositories_listed":0,"syntology":null},{"url":null,"slug":"robograsp-a-universal-grasping-policy-for","title":"RoboGrasp: A Universal Grasping Policy for Robust Robotic Control","date":"2025-02-05","arxiv_id":"2502.03072","repositories_listed":0,"syntology":null},{"url":null,"slug":"coarse-to-fine-3d-keyframe-transporter","title":"Coarse-to-Fine 3D Keyframe Transporter","date":"2025-02-03","arxiv_id":"2502.01773","repositories_listed":0,"syntology":null},{"url":null,"slug":"end-to-end-imitation-learning-for-optimal","title":"End-to-End Imitation Learning for Optimal Asteroid Proximity Operations","date":"2025-02-03","arxiv_id":"2502.01034","repositories_listed":0,"syntology":null},{"url":null,"slug":"egome-follow-me-via-egocentric-view-in-real","title":"EgoMe: A New Dataset and Challenge for Following Me via Egocentric View in Real World","date":"2025-01-31","arxiv_id":"2501.19061","repositories_listed":0,"syntology":null},{"url":null,"slug":"dial-distribution-informed-adaptive-learning","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","date":"2025-01-30","arxiv_id":"2501.18086","repositories_listed":0,"syntology":null},{"url":null,"slug":"act-jepa-joint-embedding-predictive","title":"ACT-JEPA: Joint-Embedding Predictive Architecture Improves Policy Representation Learning","date":"2025-01-24","arxiv_id":"2501.14622","repositories_listed":0,"syntology":null},{"url":null,"slug":"force-based-robotic-imitation-learning-a-two","title":"Force-Based Robotic Imitation Learning: A Two-Phase Approach for Construction Assembly Tasks","date":"2025-01-24","arxiv_id":"2501.14942","repositories_listed":0,"syntology":null},{"url":null,"slug":"noise-conditioned-energy-based-annealed","title":"Noise-conditioned Energy-based Annealed Rewards (NEAR): A Generative Framework for Imitation Learning from Observation","date":"2025-01-24","arxiv_id":"2501.14856","repositories_listed":0,"syntology":null},{"url":null,"slug":"skil-semantic-keypoint-imitation-learning-for","title":"SKIL: Semantic Keypoint Imitation Learning for Generalizable Data-efficient Manipulation","date":"2025-01-24","arxiv_id":"2501.14400","repositories_listed":0,"syntology":null},{"url":null,"slug":"you-only-teach-once-learn-one-shot-bimanual","title":"You Only Teach Once: Learn One-Shot Bimanual Robotic Manipulation from Video Demonstrations","date":"2025-01-24","arxiv_id":"2501.14208","repositories_listed":0,"syntology":null},{"url":null,"slug":"blockchain-assisted-demonstration-cloning-for","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","date":"2025-01-19","arxiv_id":"2501.10938","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-based-imitation-learning-for-social","title":"Diffusion-Based Imitation Learning for Social Pose Generation","date":"2025-01-18","arxiv_id":"2501.10869","repositories_listed":0,"syntology":null},{"url":null,"slug":"fdpp-fine-tune-diffusion-policy-with-human","title":"FDPP: Fine-tune Diffusion Policy with Human Preference","date":"2025-01-14","arxiv_id":"2501.08259","repositories_listed":0,"syntology":null},{"url":null,"slug":"motion-tracks-a-unified-representation-for","title":"Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning","date":"2025-01-13","arxiv_id":"2501.06994","repositories_listed":0,"syntology":null},{"url":null,"slug":"imitation-learning-of-mpc-with-neural","title":"Imitation Learning of MPC with Neural Networks: Error Guarantees and Sparsification","date":"2025-01-07","arxiv_id":"2501.03671","repositories_listed":0,"syntology":null},{"url":null,"slug":"sr-reward-taking-the-path-more-traveled","title":"SR-Reward: Taking The Path More Traveled","date":"2025-01-04","arxiv_id":"2501.02330","repositories_listed":0,"syntology":null},{"url":null,"slug":"drivegpt4-v2-harnessing-large-language-model","title":"DriveGPT4-V2: Harnessing Large Language Model Capabilities for Enhanced Closed-Loop Autonomous Driving","date":"2025-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-cross-view-correspondence","title":"Self-Supervised Cross-View Correspondence with Predictive Cycle Consistency","date":"2025-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"human-like-bots-for-tactical-shooters-using","title":"Human-like Bots for Tactical Shooters Using Compute-Efficient Sensors","date":"2024-12-30","arxiv_id":"2501.00078","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-intrinsic-motivation-of-reinforcement-and","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","date":"2024-12-29","arxiv_id":"2412.20573","repositories_listed":0,"syntology":null},{"url":null,"slug":"mimicking-bench-a-benchmark-for-generalizable","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","date":"2024-12-23","arxiv_id":"2412.17730","repositories_listed":0,"syntology":null}],"record_sha256":"70b5494c368e021545f8d3dcd3dba6c4b34fbf3438ae24925e7bfa27a6f5fdd1","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}