Browse State-of-the-Art › MuJoCo › Papers, page 5
MuJoCo
Papers archive 2025-07-28
archive papers tagged: 677 · with a code link: 293 · where Syntology ran a sample: 115 (103 with a run with no instrument failure, 12 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (115 of 677 tagged: 103 with a run with no instrument failure, 12 where every run was a failure of Syntology's instrument)
Page 5 of 7: papers 401 to 500 of 677, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A dynamical clipping approach with task feedback for Proximal Policy Optimization12 Dec 2023 0 repositories listed
-
Similarity-based Knowledge Transfer for Cross-Domain Reinforcement Learning5 Dec 2023 0 repositories listed
-
Supported Trust Region Optimization for Offline Reinforcement Learning15 Nov 2023 0 repositories listed
-
On-Policy Policy Gradient Reinforcement Learning Without On-Policy Sampling14 Nov 2023 0 repositories listed
-
An Intelligent Social Learning-based Optimization Strategy for Black-box Robotic Control with Reinforcement Learning11 Nov 2023 0 repositories listed
-
Robust Adversarial Reinforcement Learning via Bounded Rationality Curricula3 Nov 2023 0 repositories listed
-
A Tractable Inference Perspective of Offline RL31 Oct 2023 0 repositories listed
-
Good Better Best: Self-Motivated Imitation Learning for noisy Demonstrations24 Oct 2023 0 repositories listed
-
Policy Gradient with Kernel Quadrature23 Oct 2023 0 repositories listed
-
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL23 Oct 2023 0 repositories listed
-
One is More: Diverse Perspectives within a Single Network for Efficient DRL21 Oct 2023 0 repositories listed
-
Benchmarking the Sim-to-Real Gap in Cloth Manipulation14 Oct 2023 0 repositories listed
-
Improved Communication Efficiency in Federated Natural Policy Gradient via ADMM-based Gradient Updates9 Oct 2023 0 repositories listed
-
FP3O: Enabling Proximal Policy Optimization in Multi-Agent Cooperation with Parameter-Sharing Versatility8 Oct 2023 0 repositories listed
-
On Representation Complexity of Model-based and Model-free Reinforcement Learning3 Oct 2023 0 repositories listed
-
CasIL: Cognizing and Imitating Skills via a Dual Cognition-Action Architecture28 Sep 2023 0 repositories listed
-
Adapting Double Q-Learning for Continuous Reinforcement Learning25 Sep 2023 0 repositories listed
-
Iterative Reachability Estimation for Safe Reinforcement Learning24 Sep 2023 0 repositories listed
-
Distributionally Robust Statistical Verification with Imprecise Neural Networks28 Aug 2023 0 repositories listed
-
Careful at Estimation and Bold at Exploration22 Aug 2023 0 repositories listed
-
DMFC-GraspNet: Differentiable Multi-Fingered Robotic Grasp Generation in Cluttered Scenes1 Aug 2023 0 repositories listed
-
Theoretically Guaranteed Policy Improvement Distilled from Model-Based Planning24 Jul 2023 0 repositories listed
-
Scalable Multi-agent Covering Option Discovery based on Kronecker Graphs21 Jul 2023 0 repositories listed
-
Beyond Conservatism: Diffusion Policies in Offline Multi-agent Reinforcement Learning4 Jul 2023 0 repositories listed
-
CEIL: Generalized Contextual Imitation Learning26 Jun 2023 0 repositories listed
-
Adaptive Ensemble Q-learning: Minimizing Estimation Bias via Error Feedback20 Jun 2023 0 repositories listed
-
Evolutionary Strategy Guided Reinforcement Learning via MultiBuffer Communication20 Jun 2023 0 repositories listed
-
Surfer: Progressive Reasoning with World Models for Robotic Manipulation20 Jun 2023 0 repositories listed
-
Language to Rewards for Robotic Skill Synthesis14 Jun 2023 0 repositories listed
-
Robust Reinforcement Learning through Efficient Adversarial Herding12 Jun 2023 0 repositories listed
-
MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL31 May 2023 0 repositories listed
-
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem26 May 2023 0 repositories listed
-
Inverse Reinforcement Learning with the Average Reward Criterion24 May 2023 0 repositories listed
-
OER: Offline Experience Replay for Continual Offline Reinforcement Learning23 May 2023 0 repositories listed
-
TOM: Learning Policy-Aware Models for Model-Based Reinforcement Learning via Transition Occupancy Matching22 May 2023 0 repositories listed
-
Unsupervised Discovery of Continuous Skills on a Sphere21 May 2023 0 repositories listed
-
Bayesian Reparameterization of Reward-Conditioned Reinforcement Learning with Energy-based Models18 May 2023 0 repositories listed
-
Coagent Networks: Generalized and Scaled16 May 2023 0 repositories listed
-
Delay-Adapted Policy Optimization and Improved Regret for Adversarial MDP with Delayed Bandit Feedback13 May 2023 0 repositories listed
-
DEFENDER: DTW-Based Episode Filtering Using Demonstrations for Enhancing RL Safety8 May 2023 0 repositories listed
-
Meta-Reinforcement Learning Based on Self-Supervised Task Representation Learning29 Apr 2023 0 repositories listed
-
Learning Complicated Manipulation Skills via Deterministic Policy with Limited Demonstrations29 Mar 2023 0 repositories listed
-
Sample-efficient Adversarial Imitation Learning14 Mar 2023 0 repositories listed
-
Soft Actor-Critic Algorithm with Truly-satisfied Inequality Constraint8 Mar 2023 0 repositories listed
-
A Strategy-Oriented Bayesian Soft Actor-Critic Model7 Mar 2023 0 repositories listed
-
Wasserstein Actor-Critic: Directed Exploration via Optimism for Continuous-Actions Control4 Mar 2023 0 repositories listed
-
The Ladder in Chaos: A Simple and Effective Improvement to General DRL Algorithms by Policy Path Trimming and Boosting2 Mar 2023 0 repositories listed
-
Meta-Reinforcement Learning via Exploratory Task Clustering15 Feb 2023 0 repositories listed
-
CLARE: Conservative Model-Based Reward Learning for Offline Inverse Reinforcement Learning9 Feb 2023 0 repositories listed
-
Bridging Physics-Informed Neural Networks with Reinforcement Learning: Hamilton-Jacobi-Bellman Proximal Policy Optimization (HJBPPO)1 Feb 2023 0 repositories listed
-
Neural Episodic Control with State Abstraction27 Jan 2023 0 repositories listed
-
Certifiably Robust Reinforcement Learning through Model-Based Abstract Interpretation26 Jan 2023 0 repositories listed
-
Actor-Director-Critic: A Novel Deep Reinforcement Learning Framework10 Jan 2023 0 repositories listed
-
Contextual Conservative Q-Learning for Offline Reinforcement Learning3 Jan 2023 0 repositories listed
-
Genetic Imitation Learning by Reward Extrapolation3 Jan 2023 0 repositories listed
-
On the Geometry of Reinforcement Learning in Continuous State and Action Spaces29 Dec 2022 0 repositories listed
-
Offline Robot Reinforcement Learning with Uncertainty-Guided Human Expert Sampling16 Dec 2022 0 repositories listed
-
Off-Policy Deep Reinforcement Learning Algorithms for Handling Various Robotic Manipulator Tasks11 Dec 2022 0 repositories listed
-
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble7 Dec 2022 0 repositories listed
-
First Go, then Post-Explore: the Benefits of Post-Exploration in Intrinsic Motivation6 Dec 2022 0 repositories listed
-
Time-Efficient Reward Learning via Visually Assisted Cluster Ranking30 Nov 2022 0 repositories listed
-
Continuous Neural Algorithmic Planners29 Nov 2022 0 repositories listed
-
Learning from Good Trajectories in Offline Multi-Agent Reinforcement Learning28 Nov 2022 0 repositories listed
-
Contextual Transformer for Offline Meta Reinforcement Learning15 Nov 2022 0 repositories listed
-
Control Transformer: Robot Navigation in Unknown Environments through PRM-Guided Return-Conditioned Sequence Modeling11 Nov 2022 0 repositories listed
-
Imitating Opponent to Win: Adversarial Policy Imitation Learning in Two-player Competitive Games30 Oct 2022 0 repositories listed
-
Reward Shaping Using Convolutional Neural Network30 Oct 2022 0 repositories listed
-
Group Distributionally Robust Reinforcement Learning with Hierarchical Latent Variables21 Oct 2022 0 repositories listed
-
Simple Emergent Action Representations from Multi-Task Policy Training18 Oct 2022 0 repositories listed
-
Policy Gradient With Serial Markov Chain Reasoning13 Oct 2022 0 repositories listed
-
Mind's Eye: Grounded Language Model Reasoning through Simulation11 Oct 2022 0 repositories listed
-
Maximum-Likelihood Inverse Reinforcement Learning with Finite-Time Guarantees4 Oct 2022 0 repositories listed
-
Structural Estimation of Markov Decision Processes in High-Dimensional State Space with Finite-Time Guarantees4 Oct 2022 0 repositories listed
-
Boosting Exploration in Actor-Critic Algorithms by Incentivizing Plausible Novel States1 Oct 2022 0 repositories listed
-
On the Convergence Theory of Meta Reinforcement Learning with Personalized Policies21 Sep 2022 0 repositories listed
-
A Computational Model of Learning Flexible Navigation in a Maze by Layout-Conforming Replay of Place Cells18 Sep 2022 0 repositories listed
-
Masked Imitation Learning: Discovering Environment-Invariant Modalities in Multimodal Demonstrations16 Sep 2022 0 repositories listed
-
Value Summation: A Novel Scoring Function for MPC-based Model-based Reinforcement Learning16 Sep 2022 0 repositories listed
-
Taming Multi-Agent Reinforcement Learning with Estimator Variance Reduction2 Sep 2022 0 repositories listed
-
Dynamics-Adaptive Continual Reinforcement Learning via Progressive Contextualization1 Sep 2022 0 repositories listed
-
Improving Sample Efficiency in Evolutionary RL Using Off-Policy Ranking22 Aug 2022 0 repositories listed
-
Entropy Augmented Reinforcement Learning19 Aug 2022 0 repositories listed
-
Unified Policy Optimization for Continuous-action Reinforcement Learning in Non-stationary Tasks and Games19 Aug 2022 0 repositories listed
-
A Game-Theoretic Perspective of Generalization in Reinforcement Learning7 Aug 2022 0 repositories listed
-
Backward Imitation and Forward Reinforcement Learning via Bi-directional Model Rollouts4 Aug 2022 0 repositories listed
-
Heterogeneous-Agent Mirror Learning: A Continuum of Solutions to Cooperative MARL2 Aug 2022 0 repositories listed
-
Resolving Copycat Problems in Visual Imitation Learning via Residual Action Prediction20 Jul 2022 0 repositories listed
-
Feasible Adversarial Robust Reinforcement Learning for Underspecified Environments19 Jul 2022 0 repositories listed
-
Prompting Decision Transformer for Few-Shot Policy Generalization27 Jun 2022 0 repositories listed
-
Fighting Fire with Fire: Avoiding DNN Shortcuts through Priming22 Jun 2022 0 repositories listed
-
Beyond Rewards: a Hierarchical Perspective on Offline Multiagent Behavioral Analysis17 Jun 2022 0 repositories listed
-
Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning15 Jun 2022 0 repositories listed
-
Relative Policy-Transition Optimization for Fast Policy Transfer13 Jun 2022 0 repositories listed
-
Dealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policies12 Jun 2022 0 repositories listed
-
Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning4 Jun 2022 0 repositories listed
-
Multi-Object Grasping in the Plane1 Jun 2022 0 repositories listed
-
Transferable Reward Learning by Dynamics-Agnostic Discriminator Ensemble1 Jun 2022 0 repositories listed
-
SEREN: Knowing When to Explore and When to Exploit30 May 2022 0 repositories listed
-
Data Valuation for Offline Reinforcement Learning19 May 2022 0 repositories listed
-
A Computational Theory of Learning Flexible Reward-Seeking Behavior with Place Cells22 Apr 2022 0 repositories listed