Browse State-of-the-Art › Continuous Control › Papers, page 6
Continuous Control
Papers archive 2025-07-28
archive papers tagged: 1,161 · with a code link: 494 · where Syntology ran a sample: 193 (161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (193 of 1,161 tagged: 161 with a run with no instrument failure, 32 where every run was a failure of Syntology's instrument)
Page 6 of 12: papers 501 to 600 of 1,161, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
BEAST: Efficient Tokenization of B-Splines Encoded Action Sequences for Imitation Learning6 Jun 2025 0 repositories listed
-
AutoQD: Automatic Discovery of Diverse Behaviors with Quality-Diversity Optimization5 Jun 2025 0 repositories listed
-
Safe Planning and Policy Optimization via World Model Learning5 Jun 2025 0 repositories listed
-
Self-Composing Policies for Scalable Continual Reinforcement Learning4 Jun 2025 0 repositories listed
-
Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning4 Jun 2025 0 repositories listed
-
Proxy Target: Bridging the Gap Between Discrete Spiking Neural Networks and Continuous Control30 May 2025 0 repositories listed
-
DATD3: Depthwise Attention Twin Delayed Deep Deterministic Policy Gradient For Model Free Reinforcement Learning Under Output Feedback Control29 May 2025 0 repositories listed
-
Equivalence of stochastic and deterministic policy gradients29 May 2025 0 repositories listed
-
Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better29 May 2025 0 repositories listed
-
AM-PPO: (Advantage) Alpha-Modulation with Proximal Policy Optimization21 May 2025 0 repositories listed
-
World Models as Reference Trajectories for Rapid Motor Adaptation21 May 2025 0 repositories listed
-
KIPPO: Koopman-Inspired Proximal Policy Optimization20 May 2025 0 repositories listed
-
Bi-Level Policy Optimization with Nyström Hypergradients16 May 2025 0 repositories listed
-
Adaptive Diffusion Policy Optimization for Robotic Manipulation13 May 2025 0 repositories listed
-
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control13 May 2025 0 repositories listed
-
Cache-Efficient Posterior Sampling for Reinforcement Learning with LLM-Derived Priors Across Discrete and Continuous Domains12 May 2025 0 repositories listed
-
Offline Multi-agent Reinforcement Learning via Score Decomposition9 May 2025 0 repositories listed
-
CLAM: Continuous Latent Action Models for Robot Learning from Unlabeled Demonstrations8 May 2025 0 repositories listed
-
Policy-labeled Preference Learning: Is Preference Enough for RLHF?6 May 2025 0 repositories listed
-
Surrogate Fitness Metrics for Interpretable Reinforcement Learning20 Apr 2025 0 repositories listed
-
TraCeS: Trajectory Based Credit Assignment From Sparse Safety Feedback17 Apr 2025 0 repositories listed
-
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning2 Apr 2025 0 repositories listed
-
Ensuring Safe and Smooth Control in Safety-Critical Systems via Filtered Control Barrier Functions30 Mar 2025 0 repositories listed
-
KEA: Keeping Exploration Alive by Proactively Coordinating Exploration Strategies23 Mar 2025 0 repositories listed
-
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences18 Mar 2025 0 repositories listed
-
ConsisLoRA: Enhancing Content and Style Consistency for LoRA-based Style Transfer13 Mar 2025 0 repositories listed
-
Adaptive Anomaly Recovery for Telemanipulation: A Diffusion Model Approach to Vision-Based Tracking11 Mar 2025 0 repositories listed
-
Closing the Intent-to-Behavior Gap via Fulfillment Priority Logic4 Mar 2025 0 repositories listed
-
Improving Plasticity in Non-stationary Reinforcement Learning with Evidential Proximal Policy Optimization3 Mar 2025 0 repositories listed
-
Continuous Wrist Control on the Hannes Prosthesis: a Vision-based Shared Autonomy Framework24 Feb 2025 0 repositories listed
-
Automating Curriculum Learning for Reinforcement Learning using a Skill-Based Bayesian Network21 Feb 2025 0 repositories listed
-
Enhancing PPO with Trajectory-Aware Hybrid Policies21 Feb 2025 0 repositories listed
-
SpikeRL: A Scalable and Energy-efficient Framework for Deep Spiking Reinforcement Learning21 Feb 2025 0 repositories listed
-
Massively Scaling Explicit Policy-conditioned Value Functions17 Feb 2025 0 repositories listed
-
Causal Information Prioritization for Efficient Reinforcement Learning14 Feb 2025 0 repositories listed
-
Scaling Off-Policy Reinforcement Learning with Batch and Weight Normalization11 Feb 2025 0 repositories listed
-
Select before Act: Spatially Decoupled Action Repetition for Continuous Control10 Feb 2025 0 repositories listed
-
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning7 Feb 2025 0 repositories listed
-
TD-M(PC)²: Improving Temporal Difference MPC Through Policy Constraint5 Feb 2025 0 repositories listed
-
Compositional Concept-Based Neuron-Level Interpretability for Deep Reinforcement Learning2 Feb 2025 0 repositories listed
-
Learning from Suboptimal Data in Continuous Control via Auto-Regressive Soft Q-Network1 Feb 2025 0 repositories listed
-
Reward Prediction Error Prioritisation in Experience Replay: The RPE-PER Method30 Jan 2025 0 repositories listed
-
Boosting MCTS with Free Energy Minimization22 Jan 2025 0 repositories listed
-
Logarithmic Regret for Nonlinear Control17 Jan 2025 0 repositories listed
-
SPEQ: Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning15 Jan 2025 0 repositories listed
-
Dragin3D: Image Editing by Dragging in 3D Space1 Jan 2025 0 repositories listed
-
Active Reinforcement Learning Strategies for Offline Policy Improvement17 Dec 2024 0 repositories listed
-
Equivariant Action Sampling for Reinforcement Learning and Planning16 Dec 2024 0 repositories listed
-
Edge Delayed Deep Deterministic Policy Gradient: efficient continuous control for edge scenarios9 Dec 2024 0 repositories listed
-
Robust Output Tracking for an Uncertain and Nonlinear 3D PDE-ODE System: Preventing Induced Seismicity in Underground Reservoirs9 Dec 2024 0 repositories listed
-
Dense Dynamics-Aware Reward Synthesis: Integrating Prior Experience with Demonstrations2 Dec 2024 0 repositories listed
-
Joint Combinatorial Node Selection and Resource Allocations in the Lightning Network using Attention-based Reinforcement Learning26 Nov 2024 0 repositories listed
-
Broad Critic Deep Actor Reinforcement Learning for Continuous Control24 Nov 2024 0 repositories listed
-
Adversarial Multi-Agent Reinforcement Learning for Proactive False Data Injection Detection19 Nov 2024 0 repositories listed
-
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks19 Nov 2024 0 repositories listed
-
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration11 Nov 2024 0 repositories listed
-
Approximate Equivariance in Reinforcement Learning6 Nov 2024 0 repositories listed
-
KPCA for Thrust Vectoring Systems Exhibiting Singular Points4 Nov 2024 0 repositories listed
-
Benchmarking Smoothness and Reducing High-Frequency Oscillations in Continuous Control Policies22 Oct 2024 0 repositories listed
-
Corrected Soft Actor Critic for Continuous Control22 Oct 2024 0 repositories listed
-
Rethinking Optimal Transport in Offline Reinforcement Learning17 Oct 2024 0 repositories listed
-
Enhancing Robustness in Deep Reinforcement Learning: A Lyapunov Exponent Approach14 Oct 2024 0 repositories listed
-
Masked Generative Priors Improve World Models Sequence Modelling Capabilities10 Oct 2024 0 repositories listed
-
Quality Diversity Imitation Learning8 Oct 2024 0 repositories listed
-
Diffusion Imitation from Observation7 Oct 2024 0 repositories listed
-
Efficient Model-Based Reinforcement Learning Through Optimistic Thompson Sampling7 Oct 2024 0 repositories listed
-
ETGL-DDPG: A Deep Deterministic Policy Gradient Algorithm for Sparse Reward Continuous Control7 Oct 2024 0 repositories listed
-
Absolute State-wise Constrained Policy Optimization: High-Probability State-wise Constraints Satisfaction2 Oct 2024 0 repositories listed
-
Sampling from Energy-based Policies using Diffusion2 Oct 2024 0 repositories listed
-
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning28 Sep 2024 0 repositories listed
-
Analyzing the Impact of Class Transitions on the Design of Pattern Recognition-based Myoelectric Control Schemes21 Sep 2024 0 repositories listed
-
Quasimetric Value Functions with Dense Rewards13 Sep 2024 0 repositories listed
-
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning6 Sep 2024 0 repositories listed
-
Research Advances and New Paradigms for Biology-inspired Spiking Neural Networks26 Aug 2024 0 repositories listed
-
Deterministic Policy Gradient Primal-Dual Methods for Continuous-Space Constrained MDPs19 Aug 2024 0 repositories listed
-
An Efficient Continuous Control Perspective for Reinforcement-Learning-based Sequential Recommendation15 Aug 2024 0 repositories listed
-
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning6 Aug 2024 0 repositories listed
-
Image-Based Deep Reinforcement Learning with Intrinsically Motivated Stimuli: On the Execution of Complex Robotic Tasks31 Jul 2024 0 repositories listed
-
QT-TDM: Planning With Transformer Dynamics Model and Autoregressive Q-Learning26 Jul 2024 0 repositories listed
-
The Cross-environment Hyperparameter Setting Benchmark for Reinforcement Learning26 Jul 2024 0 repositories listed
-
PreciseControl: Enhancing Text-To-Image Diffusion Models with Fine-Grained Attribute Control24 Jul 2024 0 repositories listed
-
Continuous Control with Coarse-to-fine Reinforcement Learning10 Jul 2024 0 repositories listed
-
A Novel Bifurcation Method for Observation Perturbation Attacks on Reinforcement Learning Agents: Load Altering Attacks on a Cyber Physical Power System6 Jul 2024 0 repositories listed
-
PWM: Policy Learning with Multi-Task World Models2 Jul 2024 0 repositories listed
-
Optimizing Energy-Efficient Braking Trajectories with Anticipatory Road Data for Automated Vehicles25 Jun 2024 0 repositories listed
-
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents18 Jun 2024 0 repositories listed
-
Dynamic Modeling and Control for an Offshore Semisubmersible Floating Wind Turbine17 Jun 2024 0 repositories listed
-
Solving Vision Tasks with Simple Photoreceptors Instead of Cameras17 Jun 2024 0 repositories listed
-
CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms13 Jun 2024 0 repositories listed
-
Time-Constrained Robust MDPs12 Jun 2024 0 repositories listed
-
Exploring Pessimism and Optimism Dynamics in Deep Reinforcement Learning6 Jun 2024 0 repositories listed
-
iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning4 Jun 2024 0 repositories listed
-
Do's and Don'ts: Learning Desirable Skills with Instruction Videos1 Jun 2024 0 repositories listed
-
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees29 May 2024 0 repositories listed
-
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation28 May 2024 0 repositories listed
-
Mollification Effects of Policy Gradient Methods28 May 2024 0 repositories listed
-
Investigating the Impact of Choice on Deep Reinforcement Learning for Space Controls20 May 2024 0 repositories listed
-
Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning20 May 2024 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.