Browse State-of-the-Art › Reinforcement Learning › Papers, page 49
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 49 of 132: papers 4,801 to 4,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Explore Reinforced: Equilibrium Approximation with Reinforcement Learning2 Dec 2024 0 repositories listed
-
Task Adaptation of Reinforcement Learning-based NAS Agents through Transfer Learning2 Dec 2024 0 repositories listed
-
Towards Type Agnostic Cyber Defense Agents2 Dec 2024 0 repositories listed
-
Bilinear Convolution Decomposition for Causal RL Interpretability1 Dec 2024 0 repositories listed
-
Mean-Field Sampling for Cooperative Multi-Agent Reinforcement Learning1 Dec 2024 0 repositories listed
-
Online Poisoning Attack Against Reinforcement Learning under Black-box Environments1 Dec 2024 0 repositories listed
-
Provable Partially Observable Reinforcement Learning with Privileged Information1 Dec 2024 0 repositories listed
-
Improving generalization of robot locomotion policies via Sharpness-Aware Reinforcement Learning29 Nov 2024 0 repositories listed
-
Proto Successor Measure: Representing the Space of All Possible Solutions of Reinforcement Learning29 Nov 2024 0 repositories listed
-
A Comprehensive Survey of Reinforcement Learning: From Algorithms to Practical Challenges28 Nov 2024 0 repositories listed
-
Application of Soft Actor-Critic Algorithms in Optimizing Wastewater Treatment with Time Delays Integration27 Nov 2024 0 repositories listed
-
Dependency-Aware CAV Task Scheduling via Diffusion-Based Reinforcement Learning27 Nov 2024 0 repositories listed
-
Dynamic Non-Prehensile Object Transport via Model-Predictive Reinforcement Learning27 Nov 2024 0 repositories listed
-
ELEMENTAL: Interactive Learning from Demonstrations and Vision-Language Models for Reward Design in Robotics27 Nov 2024 0 repositories listed
-
BPP-Search: Enhancing Tree of Thought Reasoning for Mathematical Modeling Problem Solving26 Nov 2024 0 repositories listed
-
CRASH: Challenging Reinforcement-Learning Based Adversarial Scenarios For Safety Hardening26 Nov 2024 0 repositories listed
-
Ensuring Safety in Target Pursuit Control: A CBF-Safe Reinforcement Learning Approach26 Nov 2024 0 repositories listed
-
Broad Critic Deep Actor Reinforcement Learning for Continuous Control24 Nov 2024 0 repositories listed
-
Partial Identifiability and Misspecification in Inverse Reinforcement Learning24 Nov 2024 0 repositories listed
-
Reinforcement learning-enhanced genetic algorithm for wind farm layout optimization24 Nov 2024 0 repositories listed
-
Enhancing Molecular Design through Graph-based Topological Reinforcement Learning22 Nov 2024 0 repositories listed
-
On Multi-Agent Inverse Reinforcement Learning22 Nov 2024 0 repositories listed
-
Enhancing Prediction Models with Reinforcement Learning21 Nov 2024 0 repositories listed
-
Provably Efficient Action-Manipulation Attack Against Continuous Reinforcement Learning20 Nov 2024 0 repositories listed
-
Reinforcement Learning, Collusion, and the Folk Theorem19 Nov 2024 0 repositories listed
-
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Robot Learning19 Nov 2024 0 repositories listed
-
Design And Optimization Of Multi-rendezvous Manoeuvres Based On Reinforcement Learning And Convex Optimization18 Nov 2024 0 repositories listed
-
No-regret Exploration in Shuffle Private Reinforcement Learning18 Nov 2024 0 repositories listed
-
Preserving Expert-Level Privacy in Offline Reinforcement Learning18 Nov 2024 0 repositories listed
-
Regret-Free Reinforcement Learning for LTL Specifications18 Nov 2024 0 repositories listed
-
Robust Reinforcement Learning under Diffusion Models for Data with Jumps18 Nov 2024 0 repositories listed
-
Theoretical Corrections and the Leveraging of Reinforcement Learning to Enhance Triangle Attack18 Nov 2024 0 repositories listed
-
Upside-Down Reinforcement Learning for More Interpretable Optimal Control18 Nov 2024 0 repositories listed
-
Financial News-Driven LLM Reinforcement Learning for Portfolio Management17 Nov 2024 0 repositories listed
-
Mitigating Relative Over-Generalization in Multi-Agent Reinforcement Learning17 Nov 2024 0 repositories listed
-
Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs16 Nov 2024 0 repositories listed
-
Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay16 Nov 2024 0 repositories listed
-
A Risk Sensitive Contract-unified Reinforcement Learning Approach for Option Hedging14 Nov 2024 0 repositories listed
-
Enhancing reinforcement learning for population setpoint tracking in co-cultures14 Nov 2024 0 repositories listed
-
Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search14 Nov 2024 0 repositories listed
-
Innate-Values-driven Reinforcement Learning based Cognitive Modeling14 Nov 2024 0 repositories listed
-
Reinforced Disentanglers on Random Unitary Circuits14 Nov 2024 0 repositories listed
-
BAMAX: Backtrack Assisted Multi-Agent Exploration using Reinforcement Learning13 Nov 2024 0 repositories listed
-
Code-mixed LLM: Improve Large Language Models' Capability to Handle Code-Mixing through Reinforcement Learning from AI Feedback13 Nov 2024 0 repositories listed
-
Liner Shipping Network Design with Reinforcement Learning13 Nov 2024 0 repositories listed
-
R3HF: Reward Redistribution for Enhancing Reinforcement Learning from Human Feedback13 Nov 2024 0 repositories listed
-
RLInspect: An Interactive Visual Approach to Assess Reinforcement Learning Algorithm13 Nov 2024 0 repositories listed
-
Exploring Multi-Agent Reinforcement Learning for Unrelated Parallel Machine Scheduling12 Nov 2024 0 repositories listed
-
Reinforcement Learning Framework for Quantitative Trading12 Nov 2024 0 repositories listed
-
Robust Offline Reinforcement Learning for Non-Markovian Decision Processes12 Nov 2024 0 repositories listed
-
Identifying Differential Patient Care Through Inverse Intent Inference11 Nov 2024 0 repositories listed
-
Multi-hop Upstream Anticipatory Traffic Signal Control with Deep Reinforcement Learning10 Nov 2024 0 repositories listed
-
OffLight: An Offline Multi-Agent Reinforcement Learning Framework for Traffic Signal Control10 Nov 2024 0 repositories listed
-
Optimal Execution with Reinforcement Learning10 Nov 2024 0 repositories listed
-
Deep Reinforcement Learning for Digital Twin-Oriented Complex Networked Systems9 Nov 2024 0 repositories listed
-
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey8 Nov 2024 0 repositories listed
-
Real-World Offline Reinforcement Learning from Vision Language Model Feedback8 Nov 2024 0 repositories listed
-
Reinforcement Learning for Adaptive Resource Scheduling in Complex System Environments8 Nov 2024 0 repositories listed
-
Towards Active Flow Control Strategies Through Deep Reinforcement Learning8 Nov 2024 0 repositories listed
-
Tract-RLFormer: A Tract-Specific RL policy based Decoder-only Transformer Network8 Nov 2024 0 repositories listed
-
Evaluating Robustness of Reinforcement Learning Algorithms for Autonomous Shipping7 Nov 2024 0 repositories listed
-
Harnessing the Power of Gradient-Based Simulations for Multi-Objective Optimization in Particle Accelerators7 Nov 2024 0 repositories listed
-
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations7 Nov 2024 0 repositories listed
-
Performative Reinforcement Learning with Linear Markov Decision Process7 Nov 2024 0 repositories listed
-
Plasticity Loss in Deep Reinforcement Learning: A Survey7 Nov 2024 0 repositories listed
-
Approximate Equivariance in Reinforcement Learning6 Nov 2024 0 repositories listed
-
From Novice to Expert: LLM Agent Policy Optimization via Step-wise Reinforcement Learning6 Nov 2024 0 repositories listed
-
Non-Stationary Learning of Neural Networks with Automatic Soft Parameter Reset6 Nov 2024 0 repositories listed
-
Opportunities of Reinforcement Learning in South Africa's Just Transition6 Nov 2024 0 repositories listed
-
Accelerating Task Generalisation with Multi-Level Skill Hierarchies5 Nov 2024 0 repositories listed
-
Autonomous Decision Making for UAV Cooperative Pursuit-Evasion Game with Reinforcement Learning5 Nov 2024 0 repositories listed
-
When to Localize? A Risk-Constrained Reinforcement Learning Approach5 Nov 2024 0 repositories listed
-
Learning Hidden Subgoals under Temporal Ordering Constraints in Reinforcement Learning3 Nov 2024 0 repositories listed
-
Teaching Models to Improve on Tape3 Nov 2024 0 repositories listed
-
A Review of Reinforcement Learning in Financial Applications1 Nov 2024 0 repositories listed
-
Effective ML Model Versioning in Edge Networks1 Nov 2024 0 repositories listed
-
Enhancing Adaptive Mixed-Criticality Scheduling with Deep Reinforcement Learning1 Nov 2024 0 repositories listed
-
Safe Imitation Learning-based Optimal Energy Storage Systems Dispatch in Distribution Networks1 Nov 2024 0 repositories listed
-
Statistical Guarantees for Lifelong Reinforcement Learning using PAC-Bayes Theory1 Nov 2024 0 repositories listed
-
Anytime-Constrained Equilibria in Polynomial Time31 Oct 2024 0 repositories listed
-
Compositional Automata Embeddings for Goal-Conditioned Reinforcement Learning31 Oct 2024 0 repositories listed
-
Maximum Entropy Hindsight Experience Replay31 Oct 2024 0 repositories listed
-
Progressive Safeguards for Safe and Model-Agnostic Reinforcement Learning31 Oct 2024 0 repositories listed
-
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner31 Oct 2024 0 repositories listed
-
Grounding by Trying: LLMs with Reinforcement Learning-Enhanced Retrieval30 Oct 2024 0 repositories listed
-
Resource Governance in Networked Systems via Integrated Variational Autoencoders and Reinforcement Learning30 Oct 2024 0 repositories listed
-
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning30 Oct 2024 0 repositories listed
-
Self-Driving Car Racing: Application of Deep Reinforcement Learning30 Oct 2024 0 repositories listed
-
Stepping Out of the Shadows: Reinforcement Learning in Shadow Mode30 Oct 2024 0 repositories listed
-
Hindsight Experience Replay Accelerates Proximal Policy Optimization29 Oct 2024 0 repositories listed
-
PrefPaint: Aligning Image Inpainting Diffusion Model with Human Preference29 Oct 2024 0 repositories listed
-
Solving Minimum-Cost Reach Avoid using Reinforcement Learning29 Oct 2024 0 repositories listed
-
A Multi-Agent Reinforcement Learning Testbed for Cognitive Radio Applications28 Oct 2024 0 repositories listed
-
Active Legibility in Multiagent Reinforcement Learning28 Oct 2024 0 repositories listed
-
Adversarial Constrained Policy Optimization: Improving Constrained Reinforcement Learning by Adapting Budgets28 Oct 2024 0 repositories listed
-
Dual-Agent Deep Reinforcement Learning for Dynamic Pricing and Replenishment28 Oct 2024 0 repositories listed
-
Exploring reinforcement learning for incident response in autonomous military vehicles28 Oct 2024 0 repositories listed
-
Offline Reinforcement Learning With Combinatorial Action Spaces28 Oct 2024 0 repositories listed
-
Quantum Reinforcement Learning-Based Two-Stage Unit Commitment Framework for Enhanced Power Systems Robustness28 Oct 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.