Browse State-of-the-Art › Reinforcement Learning › Papers, page 52
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 52 of 132: papers 5,101 to 5,200 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data27 Aug 2024 0 repositories listed
-
On Stateful Value Factorization in Multi-Agent Reinforcement Learning27 Aug 2024 0 repositories listed
-
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning27 Aug 2024 0 repositories listed
-
Unsupervised-to-Online Reinforcement Learning27 Aug 2024 0 repositories listed
-
A Survey on Reinforcement Learning Applications in SLAM26 Aug 2024 0 repositories listed
-
Bridging the gap between Learning-to-plan, Motion Primitives and Safe Reinforcement Learning26 Aug 2024 0 repositories listed
-
Equivariant Reinforcement Learning under Partial Observability26 Aug 2024 0 repositories listed
-
Model-Based Reinforcement Learning for Control of Strongly-Disturbed Unsteady Aerodynamic Flows26 Aug 2024 0 repositories listed
-
ReLExS: Reinforcement Learning Explanations for Stackelberg No-Regret Learners26 Aug 2024 0 repositories listed
-
Reinforcement Learning for Causal Discovery without Acyclicity Constraints24 Aug 2024 0 repositories listed
-
Rethinking State Disentanglement in Causal Reinforcement Learning24 Aug 2024 0 repositories listed
-
Thresholded Lexicographic Ordered Multiobjective Reinforcement Learning24 Aug 2024 0 repositories listed
-
Diffusion-based Episodes Augmentation for Offline Multi-Agent Reinforcement Learning23 Aug 2024 0 repositories listed
-
In-Context Learning with Reinforcement Learning for Incomplete Utterance Rewriting23 Aug 2024 0 repositories listed
-
Mastering the Digital Art of War: Developing Intelligent Combat Simulation Agents for Wargaming Using Hierarchical Reinforcement Learning23 Aug 2024 0 repositories listed
-
Reduce, Reuse, Recycle: Categories for Compositional Reinforcement Learning23 Aug 2024 0 repositories listed
-
SAMBO-RL: Shifts-aware Model-based Offline Reinforcement Learning23 Aug 2024 0 repositories listed
-
A Safe and Efficient Self-evolving Algorithm for Decision-making and Control of Autonomous Driving Systems22 Aug 2024 0 repositories listed
-
Domain Adaptation for Offline Reinforcement Learning with Limited Samples22 Aug 2024 0 repositories listed
-
Pareto Inverse Reinforcement Learning for Diverse Expert Policy Generation22 Aug 2024 0 repositories listed
-
PCGRL+: Scaling, Control and Generalization in Reinforcement Learning Level Generators22 Aug 2024 0 repositories listed
-
Advances in Preference-based Reinforcement Learning: A Review21 Aug 2024 0 repositories listed
-
Efficient Exploration and Discriminative World Model Learning with an Object-Centric Abstraction21 Aug 2024 0 repositories listed
-
Using Part-based Representations for Explainable Deep Reinforcement Learning21 Aug 2024 0 repositories listed
-
Offline Model-Based Reinforcement Learning with Anti-Exploration20 Aug 2024 0 repositories listed
-
The Evolution of Reinforcement Learning in Quantitative Finance: A Survey20 Aug 2024 0 repositories listed
-
Demystifying Reinforcement Learning in Production Scheduling via Explainable AI19 Aug 2024 0 repositories listed
-
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm19 Aug 2024 0 repositories listed
-
Efficient Reinforcement Learning in Probabilistic Reward Machines19 Aug 2024 0 repositories listed
-
Enhancing Reinforcement Learning Through Guided Search19 Aug 2024 0 repositories listed
-
GARLIC: GPT-Augmented Reinforcement Learning with Intelligent Control for Vehicle Dispatching19 Aug 2024 0 repositories listed
-
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning19 Aug 2024 0 repositories listed
-
World Models Increase Autonomy in Reinforcement Learning19 Aug 2024 0 repositories listed
-
Ancestral Reinforcement Learning: Unifying Zeroth-Order Optimization and Genetic Algorithms for Reinforcement Learning18 Aug 2024 0 repositories listed
-
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning18 Aug 2024 0 repositories listed
-
Directed Exploration in Reinforcement Learning from Linear Temporal Logic18 Aug 2024 0 repositories listed
-
Exploratory Optimal Stopping: A Singular Control Formulation18 Aug 2024 0 repositories listed
-
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning18 Aug 2024 0 repositories listed
-
QEDCartographer: Automating Formal Verification Using Reward-Free Reinforcement Learning17 Aug 2024 0 repositories listed
-
Training Verifiably Robust Agents Using Set-Based Reinforcement Learning17 Aug 2024 0 repositories listed
-
CAT: Caution Aware Transfer in Reinforcement Learning via Distributional Risk16 Aug 2024 0 repositories listed
-
Deep multi-intentional inverse reinforcement learning for cognitive multi-function radar inverse cognition16 Aug 2024 0 repositories listed
-
Efficient Multi-Policy Evaluation for Reinforcement Learning16 Aug 2024 0 repositories listed
-
D5RL: Diverse Datasets for Data-Driven Deep Reinforcement Learning15 Aug 2024 0 repositories listed
-
Lifelong Reinforcement Learning via Neuromodulation15 Aug 2024 0 repositories listed
-
A Nested Graph Reinforcement Learning-based Decision-making Strategy for Eco-platooning14 Aug 2024 0 repositories listed
-
Adaptive Behavioral AI: Reinforcement Learning to Enhance Pharmacy Services14 Aug 2024 0 repositories listed
-
Off-Policy Reinforcement Learning with High Dimensional Reward14 Aug 2024 0 repositories listed
-
Residual Deep Reinforcement Learning for Inverter-based Volt-Var Control13 Aug 2024 0 repositories listed
-
Retrieval-Augmented Hierarchical in-Context Reinforcement Learning and Hindsight Modular Reflections for Task Planning with LLMs12 Aug 2024 0 repositories listed
-
Online Optimization of Curriculum Learning Schedules using Evolutionary Optimization12 Aug 2024 0 repositories listed
-
CURLing the Dream: Contrastive Representations for World Modeling in Reinforcement Learning11 Aug 2024 0 repositories listed
-
Root Cause Attribution of Delivery Risks via Causal Discovery with Reinforcement Learning11 Aug 2024 0 repositories listed
-
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization8 Aug 2024 0 repositories listed
-
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs8 Aug 2024 0 repositories listed
-
KnowPC: Knowledge-Driven Programmatic Reinforcement Learning for Zero-shot Coordination8 Aug 2024 0 repositories listed
-
AI-Driven approach for sustainable extraction of earth's subsurface renewable energy while minimizing seismic activity7 Aug 2024 0 repositories listed
-
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning6 Aug 2024 0 repositories listed
-
Research on Autonomous Driving Decision-making Strategies based Deep Reinforcement Learning6 Aug 2024 0 repositories listed
-
QADQN: Quantum Attention Deep Q-Network for Financial Market Prediction6 Aug 2024 0 repositories listed
-
CADRL: Category-aware Dual-agent Reinforcement Learning for Explainable Recommendations over Knowledge Graphs6 Aug 2024 0 repositories listed
-
Active Sensing of Knee Osteoarthritis Progression with Reinforcement Learning5 Aug 2024 0 repositories listed
-
Scenario-based Thermal Management Parametrization Through Deep Reinforcement Learning4 Aug 2024 0 repositories listed
-
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning4 Aug 2024 0 repositories listed
-
A Survey on Self-play Methods in Reinforcement Learning2 Aug 2024 0 repositories listed
-
Optimizing Variational Quantum Circuits Using Metaheuristic Strategies in Reinforcement Learning2 Aug 2024 0 repositories listed
-
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems2 Aug 2024 0 repositories listed
-
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation31 Jul 2024 0 repositories listed
-
Architectural Influence on Variational Quantum Circuits in Multi-Agent Reinforcement Learning: Evolutionary Strategies for Optimization30 Jul 2024 0 repositories listed
-
How to Choose a Reinforcement-Learning Algorithm30 Jul 2024 0 repositories listed
-
Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive Representations30 Jul 2024 0 repositories listed
-
A Method for Fast Autonomy Transfer in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Anomalous State Sequence Modeling to Enhance Safety in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning29 Jul 2024 0 repositories listed
-
Quantum Machine Learning Architecture Search via Deep Reinforcement Learning29 Jul 2024 0 repositories listed
-
Empowering Clinicians with Medical Decision Transformers: A Framework for Sepsis Treatment28 Jul 2024 0 repositories listed
-
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited28 Jul 2024 0 repositories listed
-
On the benefits of pixel-based hierarchical policies for task generalization27 Jul 2024 0 repositories listed
-
Reinforcement Learning for Sustainable Energy: A Survey26 Jul 2024 0 repositories listed
-
The Cross-environment Hyperparameter Setting Benchmark for Reinforcement Learning26 Jul 2024 0 repositories listed
-
Differentiable Quantum Architecture Search in Asynchronous Quantum Reinforcement Learning25 Jul 2024 0 repositories listed
-
Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts25 Jul 2024 0 repositories listed
-
MoveLight: Enhancing Traffic Signal Control through Movement-Centric Deep Reinforcement Learning24 Jul 2024 0 repositories listed
-
Pretrained Visual Representations in Reinforcement Learning24 Jul 2024 0 repositories listed
-
SoNIC: Safe Social Navigation with Adaptive Conformal Inference and Constrained Reinforcement Learning24 Jul 2024 0 repositories listed
-
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning24 Jul 2024 0 repositories listed
-
ODGR: Online Dynamic Goal Recognition23 Jul 2024 0 repositories listed
-
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications22 Jul 2024 0 repositories listed
-
Efficient Replay Memory Architectures in Multi-Agent Reinforcement Learning for Traffic Congestion Control22 Jul 2024 0 repositories listed
-
Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms21 Jul 2024 0 repositories listed
-
Mitigating Deep Reinforcement Learning Backdoors in the Neural Activation Space21 Jul 2024 0 repositories listed
-
Rocket Landing Control with Random Annealing Jump Start Reinforcement Learning21 Jul 2024 0 repositories listed
-
Temporal Abstraction in Reinforcement Learning with Offline Data21 Jul 2024 0 repositories listed
-
Adapt2Reward: Adapting Video-Language Models to Generalizable Robotic Rewards via Failure Prompts20 Jul 2024 0 repositories listed
-
Phase Re-service in Reinforcement Learning Traffic Signal Control20 Jul 2024 0 repositories listed
-
Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning19 Jul 2024 0 repositories listed
-
On Policy Evaluation Algorithms in Distributional Reinforcement Learning19 Jul 2024 0 repositories listed
-
An Agile Adaptation Method for Multi-mode Vehicle Communication Networks18 Jul 2024 0 repositories listed
-
A reinforcement learning strategy to automate and accelerate h/p-multigrid solvers18 Jul 2024 0 repositories listed
-
Analyzing and Bridging the Gap between Maximizing Total Reward and Discounted Reward in Deep Reinforcement Learning18 Jul 2024 0 repositories listed