Browse State-of-the-Art › Continuous Control › Papers, page 8
Continuous Control
Papers archive 2025-07-28
archive papers tagged: 1,161 · with a code link: 494 · where Syntology ran a sample: 193 (161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (193 of 1,161 tagged: 161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument)
Page 8 of 12: papers 701 to 800 of 1,161, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Variational Quantum Soft Actor-Critic for Robotic Arm Control20 Dec 2022 0 repositories listed
-
Managing Temporal Resolution in Continuous Value Estimation: A Fundamental Trade-off17 Dec 2022 0 repositories listed
-
PPO-UE: Proximal Policy Optimization via Uncertainty-Aware Exploration13 Dec 2022 0 repositories listed
-
On the Sensitivity of Reward Inference to Misspecified Human Models9 Dec 2022 0 repositories listed
-
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble7 Dec 2022 0 repositories listed
-
First Go, then Post-Explore: the Benefits of Post-Exploration in Intrinsic Motivation6 Dec 2022 0 repositories listed
-
Quadratic Programming for Continuous Control of Safety-Critical Multi-Agent Systems Under Uncertainty30 Nov 2022 0 repositories listed
-
Continuous Neural Algorithmic Planners29 Nov 2022 0 repositories listed
-
CIM: Constrained Intrinsic Motivation for Sparse-Reward Continuous Control28 Nov 2022 0 repositories listed
-
Continuous Episodic Control28 Nov 2022 0 repositories listed
-
Hypernetworks for Zero-shot Transfer in Reinforcement Learning28 Nov 2022 0 repositories listed
-
Learning from Good Trajectories in Offline Multi-Agent Reinforcement Learning28 Nov 2022 0 repositories listed
-
Safe Reinforcement Learning using Data-Driven Predictive Control20 Nov 2022 0 repositories listed
-
CACTO: Continuous Actor-Critic with Trajectory Optimization -- Towards global optimality12 Nov 2022 0 repositories listed
-
On the importance of data collection for training general goal-reaching policies7 Nov 2022 0 repositories listed
-
On learning history based policies for controlling Markov decision processes6 Nov 2022 0 repositories listed
-
Contrastive Value Learning: Implicit Models for Simple Offline RL3 Nov 2022 0 repositories listed
-
Learning Control by Iterative Inversion3 Nov 2022 0 repositories listed
-
Attitude Control of Highly Maneuverable Aircraft Using an Improved Q-learning22 Oct 2022 0 repositories listed
-
Sample Efficient Robot Learning with Structured World Models21 Oct 2022 0 repositories listed
-
Global Convergence of Direct Policy Search for State-Feedback ℋ_∞ Robust Control: A Revisit of Nonsmooth Synthesis with Goldstein Subdifferential20 Oct 2022 0 repositories listed
-
20 Oct 2022 0 repositories listed Syntology 0 ran · 1 unverified (of 1 harvested sample) · 1 pointer-only (licence)
-
Predicting Dense and Context-aware Cost Maps for Semantic Robot Navigation17 Oct 2022 0 repositories listed
-
You Only Live Once: Single-Life Reinforcement Learning17 Oct 2022 0 repositories listed
-
Monte Carlo Augmented Actor-Critic for Sparse Reward Deep Reinforcement Learning from Suboptimal Demonstrations14 Oct 2022 0 repositories listed
-
Long N-step Surrogate Stage Reward to Reduce Variances of Deep Reinforcement Learning in Complex Problems10 Oct 2022 0 repositories listed
-
Towards a Theoretical Foundation of Policy Optimization for Learning Control Policies10 Oct 2022 0 repositories listed
-
Visual Backtracking Teleoperation: A Data Collection Protocol for Offline Image-Based Reinforcement Learning5 Oct 2022 0 repositories listed
-
Time-Varying Propensity Score to Bridge the Gap between the Past and Present4 Oct 2022 0 repositories listed
-
Learning Minimally-Violating Continuous Control for Infeasible Linear Temporal Logic Specifications3 Oct 2022 0 repositories listed
-
Boosting Exploration in Actor-Critic Algorithms by Incentivizing Plausible Novel States1 Oct 2022 0 repositories listed
-
Disentangling Transfer in Continual Reinforcement Learning28 Sep 2022 0 repositories listed
-
Guiding Safe Exploration with Weakest Preconditions28 Sep 2022 0 repositories listed
-
Regularized Soft Actor-Critic for Behavior Transfer Learning27 Sep 2022 0 repositories listed
-
Switched-Actuator Systems with Setup Times: Efficient Modeling, MPC, and Application to Hyperthermia Therapy27 Sep 2022 0 repositories listed
-
Fast Lifelong Adaptive Inverse Reinforcement Learning from Demonstrations24 Sep 2022 0 repositories listed
-
On the Convergence Theory of Meta Reinforcement Learning with Personalized Policies21 Sep 2022 0 repositories listed
-
Locally Constrained Representations in Reinforcement Learning20 Sep 2022 0 repositories listed
-
Evolutionary Deep Reinforcement Learning Using Elite Buffer: A Novel Approach Towards DRL Combined with EA in Continuous Control Tasks18 Sep 2022 0 repositories listed
-
Learning Policies for Continuous Control via Transition Models16 Sep 2022 0 repositories listed
-
MO2: Model-Based Offline Options5 Sep 2022 0 repositories listed
-
Normality-Guided Distributional Reinforcement Learning for Continuous Control28 Aug 2022 0 repositories listed
-
Improvement of Sliding Mode Control Strategy Founded on Cascaded Doubly Fed Induction Generator Powered by a Matrix Converter20 Aug 2022 0 repositories listed
-
Cooperative guidance of multiple missiles: a hybrid co-evolutionary approach15 Aug 2022 0 repositories listed
-
DDX7: Differentiable FM Synthesis of Musical Instrument Sounds12 Aug 2022 0 repositories listed
-
Meta Reinforcement Learning with Successor Feature Based Context29 Jul 2022 0 repositories listed
-
Distributional Actor-Critic Ensemble for Uncertainty-Aware Continuous Control27 Jul 2022 0 repositories listed
-
Learn Continuously, Act Discretely: Hybrid Action-Space Reinforcement Learning For Optimal Execution22 Jul 2022 0 repositories listed
-
Minimum Description Length Control17 Jul 2022 0 repositories listed
-
Compactly Restrictable Metric Policy Optimization Problems12 Jul 2022 0 repositories listed
-
Learning Temporally Extended Skills in Continuous Domains as Symbolic Actions for Planning11 Jul 2022 0 repositories listed
-
Depth-CUPRL: Depth-Imaged Contrastive Unsupervised Prioritized Representations in Reinforcement Learning for Mapless Navigation of Unmanned Aerial Vehicles30 Jun 2022 0 repositories listed
-
Walk the Random Walk: Learning to Discover and Reach Goals Without Supervision23 Jun 2022 0 repositories listed
-
Fighting Fire with Fire: Avoiding DNN Shortcuts through Priming22 Jun 2022 0 repositories listed
-
Generalised Policy Improvement with Geometric Policy Composition17 Jun 2022 0 repositories listed
-
Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning15 Jun 2022 0 repositories listed
-
Relative Policy-Transition Optimization for Fast Policy Transfer13 Jun 2022 0 repositories listed
-
Dealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policies12 Jun 2022 0 repositories listed
-
Model-based Offline Imitation Learning with Non-expert Data11 Jun 2022 0 repositories listed
-
Overcoming the Spectral Bias of Neural Value Approximation9 Jun 2022 0 repositories listed
-
Action Noise in Off-Policy Deep Reinforcement Learning: Impact on Exploration and Performance8 Jun 2022 0 repositories listed
-
ARC -- Actor Residual Critic for Adversarial Imitation Learning5 Jun 2022 0 repositories listed
-
Posterior Coreset Construction with Kernelized Stein Discrepancy for Model-Based Reinforcement Learning2 Jun 2022 0 repositories listed
-
Frustratingly Easy Regularization on Representation Can Boost Deep Reinforcement Learning29 May 2022 0 repositories listed
-
Multi-Source Transfer Learning for Deep Model-Based Reinforcement Learning28 May 2022 0 repositories listed
-
SFP: State-free Priors for Exploration in Off-Policy Reinforcement Learning26 May 2022 0 repositories listed
-
Efficient Reinforcement Learning from Demonstration Using Local Ensemble and Reparameterization with Split and Merge of Expert Policies23 May 2022 0 repositories listed
-
IL-flOw: Imitation Learning from Observation using Normalizing Flows19 May 2022 0 repositories listed
-
A cGAN Ensemble-based Uncertainty-aware Surrogate Model for Offline Model-based Optimization in Industrial Control Problems15 May 2022 0 repositories listed
-
Skill-based Meta-Reinforcement Learning25 Apr 2022 0 repositories listed
-
SAAC: Safe Reinforcement Learning as an Adversarial Game of Actor-Critics20 Apr 2022 0 repositories listed
-
Evolving Pareto-Optimal Actor-Critic Algorithms for Generalizability and Stability8 Apr 2022 0 repositories listed
-
Continuously Discovering Novel Strategies via Reward-Switching Policy Optimization4 Apr 2022 0 repositories listed
-
Remember and Forget Experience Replay for Multi-Agent Reinforcement Learning24 Mar 2022 0 repositories listed
-
Multitask Neuroevolution for Reinforcement Learning with Long and Short Episodes21 Mar 2022 0 repositories listed
-
Temporal Abstractions-Augmented Temporally Contrastive Learning: An Alternative to the Laplacian in RL21 Mar 2022 0 repositories listed
-
Multiscale Sensor Fusion and Continuous Control with Neural CDEs16 Mar 2022 0 repositories listed
-
Provably Efficient Convergence of Primal-Dual Actor-Critic with Nonlinear Function Approximation28 Feb 2022 0 repositories listed
-
Policy Learning and Evaluation with Randomized Quasi-Monte Carlo16 Feb 2022 0 repositories listed
-
Strategy Discovery and Mixture in Lifelong Learning from Heterogeneous Demonstration14 Feb 2022 0 repositories listed
-
Uncertainty Aware System Identification with Universal Policies11 Feb 2022 0 repositories listed
-
Exploration with Multi-Sample Target Values for Distributional Reinforcement Learning6 Feb 2022 0 repositories listed
-
Adversarial Imitation Learning from Video using a State Observer1 Feb 2022 0 repositories listed
-
You May Not Need Ratio Clipping in PPO31 Jan 2022 0 repositories listed
-
Robust Imitation Learning from Corrupted Demonstrations29 Jan 2022 0 repositories listed
-
Overcoming Exploration: Deep Reinforcement Learning for Continuous Control in Cluttered Environments from Temporal Logic Specifications28 Jan 2022 0 repositories listed
-
State-Conditioned Adversarial Subgoal Generation24 Jan 2022 0 repositories listed
-
Recursive Least Squares Advantage Actor-Critic Algorithms15 Jan 2022 0 repositories listed
-
Evolutionary Action Selection for Gradient-based Policy Learning12 Jan 2022 0 repositories listed
-
A Surrogate-Assisted Controller for Expensive Evolutionary Reinforcement Learning1 Jan 2022 0 repositories listed
-
Single-Shot Pruning for Offline Reinforcement Learning31 Dec 2021 0 repositories listed
-
Multiagent Model-based Credit Assignment for Continuous Control27 Dec 2021 0 repositories listed
-
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles18 Dec 2021 0 repositories listed
-
Dynamic Exploitation Gaussian Bare-Bones Bat Algorithm for Optimal Reactive Power Dispatch to Improve the Safety and Stability of Power System13 Dec 2021 0 repositories listed
-
More Control for Free! Image Synthesis with Semantic Diffusion Guidance10 Dec 2021 0 repositories listed
-
Zero-Shot Uncertainty-Aware Deployment of Simulation Trained Policies on Real-World Robots10 Dec 2021 0 repositories listed
-
CoMPS: Continual Meta Policy Search8 Dec 2021 0 repositories listed
-
MESA: Offline Meta-RL for Safe Adaptation and Fault Tolerance7 Dec 2021 0 repositories listed
-
Curriculum Offline Imitating Learning1 Dec 2021 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.