Browse State-of-the-Art › Reinforcement Learning › Papers, page 51
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 51 of 132: papers 5,001 to 5,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization2 Oct 2024 0 repositories listed
-
Finding path and cycle counting formulae in graphs with Deep Reinforcement Learning2 Oct 2024 0 repositories listed
-
Generative Reward Models2 Oct 2024 0 repositories listed
-
Hidden in Plain Text: Emergence & Mitigation of Steganographic Collusion in LLMs2 Oct 2024 0 repositories listed
-
LLM-Augmented Symbolic Reinforcement Learning with Landmark-Based Task Decomposition2 Oct 2024 0 repositories listed
-
Sable: a Performant, Efficient and Scalable Sequence Model for MARL2 Oct 2024 0 repositories listed
-
PreND: Enhancing Intrinsic Motivation in Reinforcement Learning through Pre-trained Network Distillation2 Oct 2024 0 repositories listed
-
Realizable Continuous-Space Shields for Safe Reinforcement Learning2 Oct 2024 0 repositories listed
-
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning2 Oct 2024 0 repositories listed
-
Scalable Reinforcement Learning-based Neural Architecture Search2 Oct 2024 0 repositories listed
-
Contrastive Abstraction for Reinforcement Learning1 Oct 2024 0 repositories listed
-
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing28 Sep 2024 0 repositories listed
-
Refutation of Spectral Graph Theory Conjectures with Search Algorithms)27 Sep 2024 0 repositories listed
-
Robust Deep Reinforcement Learning for Volt-VAR Optimization in Active Distribution System under Uncertainty27 Sep 2024 0 repositories listed
-
State-free Reinforcement Learning27 Sep 2024 0 repositories listed
-
A Survey on Neural Architecture Search Based on Reinforcement Learning26 Sep 2024 0 repositories listed
-
Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple Rewards26 Sep 2024 0 repositories listed
-
Criticality and Safety Margins for Reinforcement Learning26 Sep 2024 0 repositories listed
-
Inverse Reinforcement Learning with Multiple Planning Horizons26 Sep 2024 0 repositories listed
-
Model-Free versus Model-Based Reinforcement Learning for Fixed-Wing UAV Attitude Control Under Varying Wind Conditions26 Sep 2024 0 repositories listed
-
Navigation in a simplified Urban Flow through Deep Reinforcement Learning26 Sep 2024 0 repositories listed
-
A random measure approach to reinforcement learning in continuous time25 Sep 2024 0 repositories listed
-
A Survey for Deep Reinforcement Learning Based Network Intrusion Detection25 Sep 2024 0 repositories listed
-
Learning Bipedal Walking for Humanoid Robots in Challenging Environments with Obstacle Avoidance25 Sep 2024 0 repositories listed
-
Offline and Distributional Reinforcement Learning for Radio Resource Management25 Sep 2024 0 repositories listed
-
OffRIPP: Offline RL-based Informative Path Planning25 Sep 2024 0 repositories listed
-
Reinforcement Learning for Finite Space Mean-Field Type Games25 Sep 2024 0 repositories listed
-
Revisiting Space Mission Planning: A Reinforcement Learning-Guided Approach for Multi-Debris Rendezvous25 Sep 2024 0 repositories listed
-
Symbolic State Partitioning for Reinforcement Learning25 Sep 2024 0 repositories listed
-
Topological Foundations of Reinforcement Learning25 Sep 2024 0 repositories listed
-
Uncertainty Representations in State-Space Layers for Deep Reinforcement Learning under Partial Observability25 Sep 2024 0 repositories listed
-
A Critical Review of Safe Reinforcement Learning Techniques in Smart Grid Applications24 Sep 2024 0 repositories listed
-
CLSP: High-Fidelity Contrastive Language-State Pre-training for Agent State Representation24 Sep 2024 0 repositories listed
-
The Dark Side of Rich Rewards: Understanding and Mitigating Noise in VLM Rewards24 Sep 2024 0 repositories listed
-
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning24 Sep 2024 0 repositories listed
-
SurgIRL: Towards Life-Long Learning for Surgical Automation by Incremental Reinforcement Learning24 Sep 2024 0 repositories listed
-
Acting for the Right Reasons: Creating Reason-Sensitive Artificial Moral Agents23 Sep 2024 0 repositories listed
-
CANDERE-COACH: Reinforcement Learning from Noisy Feedback23 Sep 2024 0 repositories listed
-
Deep Reinforcement Learning-based Obstacle Avoidance for Robot Movement in Warehouse Environments23 Sep 2024 0 repositories listed
-
Intelligent Routing Algorithm over SDN: Reusable Reinforcement Learning Approach23 Sep 2024 0 repositories listed
-
COSBO: Conservative Offline Simulation-Based Policy Optimization22 Sep 2024 0 repositories listed
-
Scalable Multi-agent Reinforcement Learning for Factory-wide Dynamic Scheduling20 Sep 2024 0 repositories listed
-
SoloParkour: Constrained Reinforcement Learning for Visual Locomotion from Privileged Experience20 Sep 2024 0 repositories listed
-
TACO-RL: Task Aware Prompt Compression Optimization with Reinforcement Learning19 Sep 2024 0 repositories listed
-
The Central Role of the Loss Function in Reinforcement Learning19 Sep 2024 0 repositories listed
-
HARP: Human-Assisted Regrouping with Permutation Invariant Critic for Multi-Agent Reinforcement Learning18 Sep 2024 0 repositories listed
-
Reinforcement Learning with Lie Group Orientations for Robotics18 Sep 2024 0 repositories listed
-
A Reinforcement Learning Environment for Automatic Code Optimization in the MLIR Compiler17 Sep 2024 0 repositories listed
-
Attacking Slicing Network via Side-channel Reinforcement Learning Attack17 Sep 2024 0 repositories listed
-
Linear Jamming Bandits: Learning to Jam 5G-based Coded Communications Systems17 Sep 2024 0 repositories listed
-
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration17 Sep 2024 0 repositories listed
-
A Model-Free Optimal Control Method With Fixed Terminal States and Delay16 Sep 2024 0 repositories listed
-
Disentangling Uncertainty for Safe Social Navigation using Deep Reinforcement Learning16 Sep 2024 0 repositories listed
-
Reinforcement learning-based statistical search strategy for an axion model from flavor16 Sep 2024 0 repositories listed
-
Reinforcement Learning with Quasi-Hyperbolic Discounting16 Sep 2024 0 repositories listed
-
Safety-Oriented Pruning and Interpretation of Reinforcement Learning Policies16 Sep 2024 0 repositories listed
-
SHIRE: Enhancing Sample Efficiency using Human Intuition in REinforcement Learning16 Sep 2024 0 repositories listed
-
Critic as Lyapunov function (CALF): a model-free, stability-ensuring agent15 Sep 2024 0 repositories listed
-
KAN v.s. MLP for Offline Reinforcement Learning15 Sep 2024 0 repositories listed
-
Mitigating Dimensionality in 2D Rectangle Packing Problem under Reinforcement Learning Schema15 Sep 2024 0 repositories listed
-
Planning Transformer: Long-Horizon Offline Reinforcement Learning with Planning Tokens14 Sep 2024 0 repositories listed
-
Curricula for Learning Robust Policies over Factored State Representations in Changing Environments13 Sep 2024 0 repositories listed
-
Quantum-inspired Reinforcement Learning for Synthesizable Drug Design13 Sep 2024 0 repositories listed
-
The unknotting number, hard unknot diagrams, and reinforcement learning13 Sep 2024 0 repositories listed
-
Learning Causally Invariant Reward Functions from Diverse Demonstrations12 Sep 2024 0 repositories listed
-
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning12 Sep 2024 0 repositories listed
-
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning12 Sep 2024 0 repositories listed
-
Stochastic Reinforcement Learning with Stability Guarantees for Control of Unknown Nonlinear Systems12 Sep 2024 0 repositories listed
-
Tidal MerzA: Combining affective modelling and autonomous code generation through Reinforcement Learning12 Sep 2024 0 repositories listed
-
Hierarchical Reinforcement Learning for Temporal Abstraction of Listwise Recommendation11 Sep 2024 0 repositories listed
-
Learning Efficient Recursive Numeral Systems via Reinforcement Learning11 Sep 2024 0 repositories listed
-
An Introduction to Quantum Reinforcement Learning (QRL)9 Sep 2024 0 repositories listed
-
BetterBodies: Reinforcement Learning guided Diffusion for Antibody Sequence Design9 Sep 2024 0 repositories listed
-
Reinforcement Learning for Variational Quantum Circuits Design9 Sep 2024 0 repositories listed
-
State-Novelty Guided Action Persistence in Deep Reinforcement Learning9 Sep 2024 0 repositories listed
-
Towards Fast Rates for Federated and Multi-Task Reinforcement Learning9 Sep 2024 0 repositories listed
-
Causality-Driven Reinforcement Learning for Joint Communication and Sensing7 Sep 2024 0 repositories listed
-
Reinforcement Learning-Based Adaptive Load Balancing for Dynamic Cloud Environments7 Sep 2024 0 repositories listed
-
Reinforcement Learning for Rate Maximization in IRS-aided OWC Networks7 Sep 2024 0 repositories listed
-
Prompt-based Personality Profiling: Reinforcement Learning for Relevance Filtering6 Sep 2024 0 repositories listed
-
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning6 Sep 2024 0 repositories listed
-
Asynchronous Stochastic Approximation and Average-Reward Reinforcement Learning5 Sep 2024 0 repositories listed
-
CHIRPs: Change-Induced Regret Proxy metrics for Lifelong Reinforcement Learning5 Sep 2024 0 repositories listed
-
Robust synchronization and policy adaptation for networked heterogeneous agents5 Sep 2024 0 repositories listed
-
Emergent Language: A Survey and Taxonomy4 Sep 2024 0 repositories listed
-
Multi-Agent Reinforcement Learning for Joint Police Patrol and Dispatch3 Sep 2024 0 repositories listed
-
State and Action Factorization in Power Grids3 Sep 2024 0 repositories listed
-
Imitating Language via Scalable Inverse Reinforcement Learning2 Sep 2024 0 repositories listed
-
Revisiting Safe Exploration in Safe Reinforcement learning2 Sep 2024 0 repositories listed
-
Reward Augmentation in Reinforcement Learning for Testing Distributed Systems2 Sep 2024 0 repositories listed
-
Cooperative Path Planning with Asynchronous Multiagent Reinforcement Learning1 Sep 2024 0 repositories listed
-
Foundations of Multivariate Distributional Reinforcement Learning31 Aug 2024 0 repositories listed
-
Robust off-policy Reinforcement Learning via Soft Constrained Adversary31 Aug 2024 0 repositories listed
-
Using Quantum Solved Deep Boltzmann Machines to Increase the Data Efficiency of RL Agents30 Aug 2024 0 repositories listed
-
Phase Optimization and Relay Selection for Joint Relay and IRS-Assisted Communication29 Aug 2024 0 repositories listed
-
Reinforcement Learning without Human Feedback for Last Mile Fine-Tuning of Large Language Models29 Aug 2024 0 repositories listed
-
Skills Regularized Task Decomposition for Multi-task Offline Reinforcement Learning28 Aug 2024 0 repositories listed
-
Structural Optimization of Lightweight Bipedal Robot via SERL28 Aug 2024 0 repositories listed
-
Exploiting Approximate Symmetry for Efficient Multi-Agent Reinforcement Learning27 Aug 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.