Browse State-of-the-Art › Continuous Control › Papers, page 10
Continuous Control
Papers archive 2025-07-28
archive papers tagged: 1,161 · with a code link: 494 · where Syntology ran a sample: 193 (161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (193 of 1,161 tagged: 161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument)
Page 10 of 12: papers 901 to 1,000 of 1,161, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Genetic Soft Updates for Policy Evolution in Deep Reinforcement Learning1 Jan 2021 0 repositories listed
-
Learning Efficient Planning-based Rewards for Imitation Learning1 Jan 2021 0 repositories listed
-
Learning Latent Landmarks for Generalizable Planning1 Jan 2021 0 repositories listed
-
Learning Subgoal Representations with Slow Dynamics1 Jan 2021 0 repositories listed
-
Offline Policy Optimization with Variance Regularization1 Jan 2021 0 repositories listed
-
Robust Offline Reinforcement Learning from Low-Quality Data1 Jan 2021 0 repositories listed
-
Sample efficient Quality Diversity for neural continuous control1 Jan 2021 0 repositories listed
-
Self-Supervised Continuous Control without Policy Gradient1 Jan 2021 0 repositories listed
-
Unbiased learning with State-Conditioned Rewards in Adversarial Imitation Learning1 Jan 2021 0 repositories listed
-
What Matters for On-Policy Deep Actor-Critic Methods? A Large-Scale Study1 Jan 2021 0 repositories listed
-
Policy Manifold Search for Improving Diversity-based Neuroevolution15 Dec 2020 0 repositories listed
-
Policy Optimization as Online Learning with Mediator Feedback15 Dec 2020 0 repositories listed
-
OPAC: Opportunistic Actor-Critic11 Dec 2020 0 repositories listed
-
Robust Domain Randomised Reinforcement Learning through Peer-to-Peer Distillation9 Dec 2020 0 repositories listed
-
Proximal Policy Optimization Smoothed Algorithm4 Dec 2020 0 repositories listed
-
On the Stability and Convergence of Robust Adversarial Reinforcement Learning: A Case Study on Linear Quadratic Systems1 Dec 2020 0 repositories listed
-
Promoting Stochasticity for Expressive Policies via a Simple and Efficient Regularization Method1 Dec 2020 0 repositories listed
-
Reinforcement Learning for Control with Multiple Frequencies1 Dec 2020 0 repositories listed
-
Offline Learning from Demonstrations and Unlabeled Experience27 Nov 2020 0 repositories listed
-
Consolidation via Policy Information Regularization in Deep RL for Multi-Agent Games23 Nov 2020 0 repositories listed
-
Nested Mixture of Experts: Cooperative and Competitive Learning of Hybrid Dynamical System20 Nov 2020 0 repositories listed
-
Critic PI2: Master Continuous Planning via Policy Improvement with Path Integrals and Deep Actor-Critic Reinforcement Learning13 Nov 2020 0 repositories listed
-
Reinforcement Learning Control of Constrained Dynamic Systems with Uniformly Ultimate Boundedness Stability Guarantee13 Nov 2020 0 repositories listed
-
Proximal Policy Optimization via Enhanced Exploration Efficiency11 Nov 2020 0 repositories listed
-
Cooperative Heterogeneous Deep Reinforcement Learning2 Nov 2020 0 repositories listed
-
Sample-efficient reinforcement learning using deep Gaussian processes2 Nov 2020 0 repositories listed
-
Behavior Priors for Efficient Reinforcement Learning27 Oct 2020 0 repositories listed
-
Can Reinforcement Learning for Continuous Control Generalize Across Physics Engines?27 Oct 2020 0 repositories listed
-
Planning with Exploration: Addressing Dynamics Bottleneck in Model-based Reinforcement Learning24 Oct 2020 0 repositories listed
-
Robust Constrained Reinforcement Learning for Continuous Control with Model Misspecification20 Oct 2020 0 repositories listed
-
Local Search for Policy Iteration in Continuous Control12 Oct 2020 0 repositories listed
-
Trust the Model When It Is Confident: Masked Model-based Actor-Critic10 Oct 2020 0 repositories listed
-
Deep RL With Information Constrained Policies: Generalization in Continuous Control9 Oct 2020 0 repositories listed
-
Learning Value Functions in Deep Policy Gradients using Residual Variance9 Oct 2020 0 repositories listed
-
Learning the Linear Quadratic Regulator from Nonlinear Observations8 Oct 2020 0 repositories listed
-
Reinforcement Learning for Many-Body Ground-State Preparation Inspired by Counterdiabatic Driving7 Oct 2020 0 repositories listed
-
Heteroscedastic Bayesian Optimisation for Stochastic Model Predictive Control1 Oct 2020 0 repositories listed
-
Bridging the gap between Markowitz planning and deep reinforcement learning30 Sep 2020 0 repositories listed
-
Adaptive Discretization for Continuous Control using Particle Filtering Policy Network28 Sep 2020 0 repositories listed
-
Neural Lyapunov Model Predictive Control28 Sep 2020 0 repositories listed
-
What About Taking Policy as Input of Value Function: Policy-extended Value Function Approximator28 Sep 2020 0 repositories listed
-
Autonomous Learning of Features for Control: Experiments with Embodied and Situated Agents15 Sep 2020 0 repositories listed
-
Multi-Agent Reinforcement Learning in Cournot Games14 Sep 2020 0 repositories listed
-
Visualizing the Loss Landscape of Actor Critic Methods with Applications in Inventory Optimization4 Sep 2020 0 repositories listed
-
ReLMoGen: Leveraging Motion Generation in Reinforcement Learning for Mobile Manipulation18 Aug 2020 0 repositories listed
-
Overcoming Model Bias for Robust Offline Deep Reinforcement Learning12 Aug 2020 0 repositories listed
-
Proximal Deterministic Policy Gradient3 Aug 2020 0 repositories listed
-
Learning Compositional Neural Programs for Continuous Control27 Jul 2020 0 repositories listed
-
Statistical Bootstrapping for Uncertainty Estimation in Off-Policy Evaluation27 Jul 2020 0 repositories listed
-
Control as Hybrid Inference11 Jul 2020 0 repositories listed
-
DDPG++: Striving for Simplicity in Continuous-control Off-Policy Reinforcement Learning26 Jun 2020 0 repositories listed
-
Towards Tractable Optimism in Model-Based Reinforcement Learning21 Jun 2020 0 repositories listed
-
WD3: Taming the Estimation Bias in Deep Reinforcement Learning18 Jun 2020 0 repositories listed
-
Reparameterized Variational Divergence Minimization for Stable Imitation18 Jun 2020 0 repositories listed
-
COLREG-Compliant Collision Avoidance for Unmanned Surface Vehicle using Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Data Driven Control with Learned Dynamics: Model-Based versus Model-Free Approach16 Jun 2020 0 repositories listed
-
Provably Efficient Model-based Policy Adaptation14 Jun 2020 0 repositories listed
-
Online Hyper-parameter Tuning in Off-policy Learning via Evolutionary Strategies13 Jun 2020 0 repositories listed
-
Continuous Control for Searching and Planning with a Learned Model12 Jun 2020 0 repositories listed
-
Decorrelated Double Q-learning12 Jun 2020 0 repositories listed
-
Lifelong Learning of Factored Policies via Policy Gradients12 Jun 2020 0 repositories listed
-
12 Jun 2020 0 repositories listed Syntology 16 ran (of which 4 constructed an object rather than computing a result; 13 with no instrument failure: 0 honoured, 2 violated, 11 with no contract checked; 3 where Syntology's instrument failed) · 4 unverified (of 20 harvested samples) · 11 pointer-only (licence)
-
Skill Discovery for Exploration and Planning using Deep Skill Graphs12 Jun 2020 0 repositories listed
-
Robustness to Adversarial Attacks in Learning-Enabled Controllers11 Jun 2020 0 repositories listed
-
Zeroth-Order Supervised Policy Improvement11 Jun 2020 0 repositories listed
-
Variational Model-based Policy Optimization9 Jun 2020 0 repositories listed
-
Meta-Model-Based Meta-Policy Optimization4 Jun 2020 0 repositories listed
-
Refined Continuous Control of DDPG Actors via Parametrised Activation4 Jun 2020 0 repositories listed
-
Gradient Monitored Reinforcement Learning25 May 2020 0 repositories listed
-
Language Conditioned Imitation Learning over Unstructured Data15 May 2020 0 repositories listed
-
Unbiased Deep Reinforcement Learning: A General Training Framework for Existing and Future Algorithms12 May 2020 0 repositories listed
-
Keep Doing What Worked: Behavior Modelling Priors for Offline Reinforcement Learning1 May 2020 0 repositories listed
-
Toward Evaluating Robustness of Deep Reinforcement Learning with Continuous Control1 May 2020 0 repositories listed
-
DSAC: Distributional Soft Actor Critic for Risk-Sensitive Reinforcement Learning30 Apr 2020 0 repositories listed
-
Conservation Voltage Reduction (CVR) via Two-Timescale Control in Unbalanced Power Distribution Systems24 Apr 2020 0 repositories listed
-
PBCS : Efficient Exploration and Exploitation Using a Synergy between Reinforcement Learning and Motion Planning24 Apr 2020 0 repositories listed
-
Divide-and-Conquer Monte Carlo Tree Search For Goal-Directed Planning23 Apr 2020 0 repositories listed
-
Intrinsic Exploration as Multi-Objective RL6 Apr 2020 0 repositories listed
-
Uniform State Abstraction For Reinforcement Learning6 Apr 2020 0 repositories listed
-
Weakly-Supervised Reinforcement Learning for Controllable Behavior6 Apr 2020 0 repositories listed
-
ABC-LMPC: Safe Sample-Based Learning MPC for Stochastic Nonlinear Dynamical Systems with Adjustable Boundary Conditions3 Mar 2020 0 repositories listed
-
PlaNet of the Bayesians: Reconsidering and Improving Deep Planning Network by Incorporating Bayesian Inference1 Mar 2020 0 repositories listed
-
Neural Lyapunov Model Predictive Control: Learning Safe Global Controllers from Sub-optimal Examples21 Feb 2020 0 repositories listed
-
oIRL: Robust Adversarial Inverse Reinforcement Learning with Temporally Extended Actions20 Feb 2020 0 repositories listed
-
Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning19 Feb 2020 0 repositories listed
-
KoGuN: Accelerating Deep Reinforcement Learning via Integrating Human Suboptimal Knowledge18 Feb 2020 0 repositories listed
-
Multi-Issue Bargaining With Deep Reinforcement Learning18 Feb 2020 0 repositories listed
-
Adaptive Experience Selection for Policy Gradient17 Feb 2020 0 repositories listed
-
Learning Functionally Decomposed Hierarchies for Continuous Control Tasks with Path Planning14 Feb 2020 0 repositories listed
-
Reward Tweaking: Maximizing the Total Reward While Planning for Short Horizons9 Feb 2020 0 repositories listed
-
Off-policy Maximum Entropy Reinforcement Learning : Soft Actor-Critic with Advantage Weighted Mixture Policy(SAC-AWMP)7 Feb 2020 0 repositories listed
-
Ready Policy One: World Building Through Active Learning7 Feb 2020 0 repositories listed
-
Deep Radial-Basis Value Functions for Continuous Control5 Feb 2020 0 repositories listed
-
Domain-Adversarial and Conditional State Space Model for Imitation Learning31 Jan 2020 0 repositories listed
-
Q-Learning in enormous action spaces via amortized approximate maximization22 Jan 2020 0 repositories listed
-
SEERL: Sample Efficient Ensemble Reinforcement Learning15 Jan 2020 0 repositories listed
-
Reinforcement Learning Tracking Control for Robotic Manipulator With Kernel-Based Dynamic Model9 Jan 2020 0 repositories listed
-
A Game Theoretic Perspective on Model-Based Reinforcement Learning1 Jan 2020 0 repositories listed
-
Batch Reinforcement Learning with Hyperparameter Gradients1 Jan 2020 0 repositories listed
-
CoMic: Co-Training and Mimicry for Reusable Skills1 Jan 2020 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.