Browse State-of-the-Art › MuJoCo › Papers, page 4
MuJoCo
Papers archive 2025-07-28
archive papers tagged: 677 · with a code link: 293 · where Syntology ran a sample: 115 (103 with a run with no instrument failure, 12 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (115 of 677 tagged: 103 with a run with no instrument failure, 12 where every run was a failure of Syntology's instrument)
Page 4 of 7: papers 301 to 400 of 677, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
16 Jun 2025 0 repositories listed Syntology 3 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified (of 4 harvested samples) · 4 pointer-only (licence)
-
Wasserstein Barycenter Soft Actor-Critic11 Jun 2025 0 repositories listed
-
Modular Recurrence in Contextual MDPs for Universal Morphology Control10 Jun 2025 0 repositories listed
-
Accelerating Diffusion Models in Offline RL via Reward-Aware Consistency Trajectory Distillation9 Jun 2025 0 repositories listed
-
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning29 May 2025 0 repositories listed
-
Enhanced DACER Algorithm with High Diffusion Efficiency29 May 2025 0 repositories listed
-
Measure gradients, not activations! Enhancing neuronal activity in deep reinforcement learning29 May 2025 0 repositories listed
-
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control28 May 2025 0 repositories listed
-
Collision- and Reachability-Aware Multi-Robot Control with Grounded LLM Planners26 May 2025 0 repositories listed
-
Surrogate-Assisted Evolutionary Reinforcement Learning Based on Autoencoder and Hyperbolic Neural Network26 May 2025 0 repositories listed
-
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models21 May 2025 0 repositories listed
-
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning19 May 2025 0 repositories listed
-
Cache-Efficient Posterior Sampling for Reinforcement Learning with LLM-Derived Priors Across Discrete and Continuous Domains12 May 2025 0 repositories listed
-
Offline Multi-agent Reinforcement Learning via Score Decomposition9 May 2025 0 repositories listed
-
Variational OOD State Correction for Offline Reinforcement Learning1 May 2025 0 repositories listed
-
Text-to-Decision Agent: Learning Generalist Policies from Natural Language Supervision21 Apr 2025 0 repositories listed
-
Learning Transferable Friction Models and LuGre Identification via Physics Informed Neural Networks16 Apr 2025 0 repositories listed
-
Adapting World Models with Latent-State Dynamics Residuals3 Apr 2025 0 repositories listed
-
Beyond Non-Expert Demonstrations: Outcome-Driven Action Constraint for Offline Reinforcement Learning2 Apr 2025 0 repositories listed
-
Adventurer: Exploration with BiGAN for Deep Reinforcement Learning24 Mar 2025 0 repositories listed
-
CAE: Repurposing the Critic as an Explorer in Deep Reinforcement Learning23 Mar 2025 0 repositories listed
-
Likelihood Reward Redistribution20 Mar 2025 0 repositories listed
-
Residual Policy Gradient: A Reward View of KL-regularized Objective14 Mar 2025 0 repositories listed
-
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning3 Mar 2025 0 repositories listed
-
AVG-DICE: Stationary Distribution Correction by Regression3 Mar 2025 0 repositories listed
-
IL-SOAR : Imitation Learning with Soft Optimistic Actor cRitic27 Feb 2025 0 repositories listed
-
Yes, Q-learning Helps Offline In-Context RL24 Feb 2025 0 repositories listed
-
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning17 Feb 2025 0 repositories listed
-
A Unifying Framework for Causal Imitation Learning with Hidden Confounders11 Feb 2025 0 repositories listed
-
Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning8 Feb 2025 0 repositories listed
-
Behavioral Entropy-Guided Dataset Generation for Offline Reinforcement Learning6 Feb 2025 0 repositories listed
-
IRIS: An Immersive Robot Interaction System5 Feb 2025 0 repositories listed
-
TIMRL: A Novel Meta-Reinforcement Learning Framework for Non-Stationary and Multi-Task Environments13 Jan 2025 0 repositories listed
-
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks7 Jan 2025 0 repositories listed
-
Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning19 Dec 2024 0 repositories listed
-
Active Reinforcement Learning Strategies for Offline Policy Improvement17 Dec 2024 0 repositories listed
-
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors14 Dec 2024 0 repositories listed
-
Inverse Delayed Reinforcement Learning4 Dec 2024 0 repositories listed
-
Hierarchical Prompt Decision Transformer: Improving Few-Shot Policy Generalization with Global and Adaptive Guidance1 Dec 2024 0 repositories listed
-
Fast Convergence of Softmax Policy Mirror Ascent18 Nov 2024 0 repositories listed
-
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration11 Nov 2024 0 repositories listed
-
Multi-Objective Algorithms for Learning Open-Ended Robotic Problems11 Nov 2024 0 repositories listed
-
Learning Loss Landscapes in Preference Optimization10 Nov 2024 0 repositories listed
-
Solving Minimum-Cost Reach Avoid using Reinforcement Learning29 Oct 2024 0 repositories listed
-
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning27 Oct 2024 0 repositories listed
-
Neuroplastic Expansion in Deep Reinforcement Learning10 Oct 2024 0 repositories listed
-
Quality Diversity Imitation Learning8 Oct 2024 0 repositories listed
-
Efficient Model-Based Reinforcement Learning Through Optimistic Thompson Sampling7 Oct 2024 0 repositories listed
-
Model-Based Reward Shaping for Adversarial Inverse Reinforcement Learning in Stochastic Environments4 Oct 2024 0 repositories listed
-
ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization2 Oct 2024 0 repositories listed
-
Learning to enhance multi-legged robot on rugged landscapes14 Sep 2024 0 repositories listed
-
Latent Space Energy-based Neural ODEs5 Sep 2024 0 repositories listed
-
Simultaneous Training of First- and Second-Order Optimizers in Population-Based Reinforcement Learning27 Aug 2024 0 repositories listed
-
The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective19 Aug 2024 0 repositories listed
-
Markov Balance Satisfaction Improves Performance in Strictly Batch Offline Imitation Learning17 Aug 2024 0 repositories listed
-
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization8 Aug 2024 0 repositories listed
-
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning4 Aug 2024 0 repositories listed
-
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation25 Jul 2024 0 repositories listed
-
Learning Constraint Network from Demonstrations via Positive-Unlabeled Learning with Memory Replay23 Jul 2024 0 repositories listed
-
Temporal Abstraction in Reinforcement Learning with Offline Data21 Jul 2024 0 repositories listed
-
A Review of Nine Physics Engines for Reinforcement Learning Research11 Jul 2024 0 repositories listed
-
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents18 Jun 2024 0 repositories listed
-
Learning Reward and Policy Jointly from Demonstration and Preference Improves Alignment11 Jun 2024 0 repositories listed
-
DEER: A Delay-Resilient Framework for Reinforcement Learning with Variable Delays5 Jun 2024 0 repositories listed
-
Value Improved Actor Critic Algorithms3 Jun 2024 0 repositories listed
-
A Pontryagin Perspective on Reinforcement Learning28 May 2024 0 repositories listed
-
Learning rigid-body simulators over implicit shapes for large-scale scenes and vision22 May 2024 0 repositories listed
-
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner21 May 2024 0 repositories listed
-
Off-OAB: Off-Policy Policy Gradient Method with Optimal Action-Dependent Baseline4 May 2024 0 repositories listed
-
Markov flow policy -- deep MC1 May 2024 0 repositories listed
-
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure1 May 2024 0 repositories listed
-
Closed Loop Interactive Embodied Reasoning for Robot Manipulation23 Apr 2024 0 repositories listed
-
Asynchronous Federated Reinforcement Learning with Policy Gradient Updates: Algorithm Design and Convergence Analysis9 Apr 2024 0 repositories listed
-
DIDA: Denoised Imitation Learning based on Domain Adaptation4 Apr 2024 0 repositories listed
-
Active Learning of Dynamics Using Prior Domain Knowledge in the Sampling Process25 Mar 2024 0 repositories listed
-
Robust Model Based Reinforcement Learning Using ℒ₁ Adaptive Control21 Mar 2024 0 repositories listed
-
A Simple Mixture Policy Parameterization for Improving Sample Efficiency of CVaR Optimization17 Mar 2024 0 repositories listed
-
Phasic Diversity Optimization for Population-Based Reinforcement Learning17 Mar 2024 0 repositories listed
-
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning12 Mar 2024 0 repositories listed
-
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning11 Mar 2024 0 repositories listed
-
Conservative DDPG -- Pessimistic RL without Ensemble8 Mar 2024 0 repositories listed
-
Iterated Q-Network: Beyond One-Step Bellman Updates in Deep Reinforcement Learning4 Mar 2024 0 repositories listed
-
Continuous Mean-Zero Disagreement-Regularized Imitation Learning (CMZ-DRIL)2 Mar 2024 0 repositories listed
-
C-GAIL: Stabilizing Generative Adversarial Imitation Learning with Control Theory26 Feb 2024 0 repositories listed
-
Learn to Teach: Sample-Efficient Privileged Learning for Humanoid Locomotion over Diverse Terrains9 Feb 2024 0 repositories listed
-
ALOHA 2: An Enhanced Low-Cost Hardware for Bimanual Teleoperation7 Feb 2024 0 repositories listed
-
Compressing Deep Reinforcement Learning Networks with a Dynamic Structured Pruning Method for Autonomous Driving7 Feb 2024 0 repositories listed
-
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping4 Feb 2024 0 repositories listed
-
MinMaxMin Q-learning3 Feb 2024 0 repositories listed
-
SQT -- std Q-target3 Feb 2024 0 repositories listed
-
A Reinforcement Learning Based Controller to Minimize Forces on the Crutches of a Lower-Limb Exoskeleton31 Jan 2024 0 repositories listed
-
Extrinsicaly Rewarded Soft Q Imitation Learning with Discriminator30 Jan 2024 0 repositories listed
-
Episodic Reinforcement Learning with Expanded State-reward Space19 Jan 2024 0 repositories listed
-
AgentMixer: Multi-Agent Correlated Policy Factorization16 Jan 2024 0 repositories listed
-
Neural Population Learning beyond Symmetric Zero-sum Games10 Jan 2024 0 repositories listed
-
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction2 Jan 2024 0 repositories listed
-
DexDLO: Learning Goal-Conditioned Dexterous Policy for Dynamic Manipulation of Deformable Linear Objects23 Dec 2023 0 repositories listed
-
OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments19 Dec 2023 0 repositories listed
-
Small Dataset, Big Gains: Enhancing Reinforcement Learning by Offline Pre-Training with Model Based Augmentation15 Dec 2023 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.