Browse State-of-the-Art › reinforcement-learning › Papers, page 51
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 51 of 135: papers 5,001 to 5,100 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
The unknotting number, hard unknot diagrams, and reinforcement learning13 Sep 2024 0 repositories listed
-
Learning Causally Invariant Reward Functions from Diverse Demonstrations12 Sep 2024 0 repositories listed
-
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning12 Sep 2024 0 repositories listed
-
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning12 Sep 2024 0 repositories listed
-
Stochastic Reinforcement Learning with Stability Guarantees for Control of Unknown Nonlinear Systems12 Sep 2024 0 repositories listed
-
Tidal MerzA: Combining affective modelling and autonomous code generation through Reinforcement Learning12 Sep 2024 0 repositories listed
-
Hierarchical Reinforcement Learning for Temporal Abstraction of Listwise Recommendation11 Sep 2024 0 repositories listed
-
Learning Efficient Recursive Numeral Systems via Reinforcement Learning11 Sep 2024 0 repositories listed
-
An Introduction to Quantum Reinforcement Learning (QRL)9 Sep 2024 0 repositories listed
-
BetterBodies: Reinforcement Learning guided Diffusion for Antibody Sequence Design9 Sep 2024 0 repositories listed
-
Reinforcement Learning for Variational Quantum Circuits Design9 Sep 2024 0 repositories listed
-
State-Novelty Guided Action Persistence in Deep Reinforcement Learning9 Sep 2024 0 repositories listed
-
Towards Fast Rates for Federated and Multi-Task Reinforcement Learning9 Sep 2024 0 repositories listed
-
Causality-Driven Reinforcement Learning for Joint Communication and Sensing7 Sep 2024 0 repositories listed
-
Reinforcement Learning-Based Adaptive Load Balancing for Dynamic Cloud Environments7 Sep 2024 0 repositories listed
-
Reinforcement Learning for Rate Maximization in IRS-aided OWC Networks7 Sep 2024 0 repositories listed
-
Prompt-based Personality Profiling: Reinforcement Learning for Relevance Filtering6 Sep 2024 0 repositories listed
-
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning6 Sep 2024 0 repositories listed
-
Asynchronous Stochastic Approximation and Average-Reward Reinforcement Learning5 Sep 2024 0 repositories listed
-
CHIRPs: Change-Induced Regret Proxy metrics for Lifelong Reinforcement Learning5 Sep 2024 0 repositories listed
-
Robust synchronization and policy adaptation for networked heterogeneous agents5 Sep 2024 0 repositories listed
-
Emergent Language: A Survey and Taxonomy4 Sep 2024 0 repositories listed
-
Multi-Agent Reinforcement Learning for Joint Police Patrol and Dispatch3 Sep 2024 0 repositories listed
-
State and Action Factorization in Power Grids3 Sep 2024 0 repositories listed
-
Imitating Language via Scalable Inverse Reinforcement Learning2 Sep 2024 0 repositories listed
-
Revisiting Safe Exploration in Safe Reinforcement learning2 Sep 2024 0 repositories listed
-
Reward Augmentation in Reinforcement Learning for Testing Distributed Systems2 Sep 2024 0 repositories listed
-
Cooperative Path Planning with Asynchronous Multiagent Reinforcement Learning1 Sep 2024 0 repositories listed
-
Foundations of Multivariate Distributional Reinforcement Learning31 Aug 2024 0 repositories listed
-
Robust off-policy Reinforcement Learning via Soft Constrained Adversary31 Aug 2024 0 repositories listed
-
Using Quantum Solved Deep Boltzmann Machines to Increase the Data Efficiency of RL Agents30 Aug 2024 0 repositories listed
-
Phase Optimization and Relay Selection for Joint Relay and IRS-Assisted Communication29 Aug 2024 0 repositories listed
-
Reinforcement Learning without Human Feedback for Last Mile Fine-Tuning of Large Language Models29 Aug 2024 0 repositories listed
-
Reinforcement Learning for Adaptive Traffic Signal Control: Turn-Based and Time-Based Approaches to Reduce Congestion28 Aug 2024 0 repositories listed
-
Skills Regularized Task Decomposition for Multi-task Offline Reinforcement Learning28 Aug 2024 0 repositories listed
-
Structural Optimization of Lightweight Bipedal Robot via SERL28 Aug 2024 0 repositories listed
-
Exploiting Approximate Symmetry for Efficient Multi-Agent Reinforcement Learning27 Aug 2024 0 repositories listed
-
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data27 Aug 2024 0 repositories listed
-
On Stateful Value Factorization in Multi-Agent Reinforcement Learning27 Aug 2024 0 repositories listed
-
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning27 Aug 2024 0 repositories listed
-
Unsupervised-to-Online Reinforcement Learning27 Aug 2024 0 repositories listed
-
A Survey on Reinforcement Learning Applications in SLAM26 Aug 2024 0 repositories listed
-
Bridging the gap between Learning-to-plan, Motion Primitives and Safe Reinforcement Learning26 Aug 2024 0 repositories listed
-
Equivariant Reinforcement Learning under Partial Observability26 Aug 2024 0 repositories listed
-
Model-Based Reinforcement Learning for Control of Strongly-Disturbed Unsteady Aerodynamic Flows26 Aug 2024 0 repositories listed
-
ReLExS: Reinforcement Learning Explanations for Stackelberg No-Regret Learners26 Aug 2024 0 repositories listed
-
Reinforcement Learning for Causal Discovery without Acyclicity Constraints24 Aug 2024 0 repositories listed
-
Rethinking State Disentanglement in Causal Reinforcement Learning24 Aug 2024 0 repositories listed
-
Thresholded Lexicographic Ordered Multiobjective Reinforcement Learning24 Aug 2024 0 repositories listed
-
Diffusion-based Episodes Augmentation for Offline Multi-Agent Reinforcement Learning23 Aug 2024 0 repositories listed
-
In-Context Learning with Reinforcement Learning for Incomplete Utterance Rewriting23 Aug 2024 0 repositories listed
-
Mastering the Digital Art of War: Developing Intelligent Combat Simulation Agents for Wargaming Using Hierarchical Reinforcement Learning23 Aug 2024 0 repositories listed
-
Reduce, Reuse, Recycle: Categories for Compositional Reinforcement Learning23 Aug 2024 0 repositories listed
-
SAMBO-RL: Shifts-aware Model-based Offline Reinforcement Learning23 Aug 2024 0 repositories listed
-
A Safe and Efficient Self-evolving Algorithm for Decision-making and Control of Autonomous Driving Systems22 Aug 2024 0 repositories listed
-
Domain Adaptation for Offline Reinforcement Learning with Limited Samples22 Aug 2024 0 repositories listed
-
Pareto Inverse Reinforcement Learning for Diverse Expert Policy Generation22 Aug 2024 0 repositories listed
-
PCGRL+: Scaling, Control and Generalization in Reinforcement Learning Level Generators22 Aug 2024 0 repositories listed
-
Advances in Preference-based Reinforcement Learning: A Review21 Aug 2024 0 repositories listed
-
Efficient Exploration and Discriminative World Model Learning with an Object-Centric Abstraction21 Aug 2024 0 repositories listed
-
Fast State Stabilization using Deep Reinforcement Learning for Measurement-based Quantum Feedback Control21 Aug 2024 0 repositories listed
-
Using Part-based Representations for Explainable Deep Reinforcement Learning21 Aug 2024 0 repositories listed
-
Offline Model-Based Reinforcement Learning with Anti-Exploration20 Aug 2024 0 repositories listed
-
The Evolution of Reinforcement Learning in Quantitative Finance: A Survey20 Aug 2024 0 repositories listed
-
Demystifying Reinforcement Learning in Production Scheduling via Explainable AI19 Aug 2024 0 repositories listed
-
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm19 Aug 2024 0 repositories listed
-
Efficient Reinforcement Learning in Probabilistic Reward Machines19 Aug 2024 0 repositories listed
-
Enhancing Reinforcement Learning Through Guided Search19 Aug 2024 0 repositories listed
-
GARLIC: GPT-Augmented Reinforcement Learning with Intelligent Control for Vehicle Dispatching19 Aug 2024 0 repositories listed
-
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning19 Aug 2024 0 repositories listed
-
World Models Increase Autonomy in Reinforcement Learning19 Aug 2024 0 repositories listed
-
Ancestral Reinforcement Learning: Unifying Zeroth-Order Optimization and Genetic Algorithms for Reinforcement Learning18 Aug 2024 0 repositories listed
-
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning18 Aug 2024 0 repositories listed
-
Directed Exploration in Reinforcement Learning from Linear Temporal Logic18 Aug 2024 0 repositories listed
-
Exploratory Optimal Stopping: A Singular Control Formulation18 Aug 2024 0 repositories listed
-
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning18 Aug 2024 0 repositories listed
-
QEDCartographer: Automating Formal Verification Using Reward-Free Reinforcement Learning17 Aug 2024 0 repositories listed
-
Reinforcement learning-based adaptive speed controllers in mixed autonomy condition17 Aug 2024 0 repositories listed
-
Training Verifiably Robust Agents Using Set-Based Reinforcement Learning17 Aug 2024 0 repositories listed
-
CAT: Caution Aware Transfer in Reinforcement Learning via Distributional Risk16 Aug 2024 0 repositories listed
-
Deep multi-intentional inverse reinforcement learning for cognitive multi-function radar inverse cognition16 Aug 2024 0 repositories listed
-
Efficient Multi-Policy Evaluation for Reinforcement Learning16 Aug 2024 0 repositories listed
-
D5RL: Diverse Datasets for Data-Driven Deep Reinforcement Learning15 Aug 2024 0 repositories listed
-
Lifelong Reinforcement Learning via Neuromodulation15 Aug 2024 0 repositories listed
-
A Nested Graph Reinforcement Learning-based Decision-making Strategy for Eco-platooning14 Aug 2024 0 repositories listed
-
Adaptive Behavioral AI: Reinforcement Learning to Enhance Pharmacy Services14 Aug 2024 0 repositories listed
-
Off-Policy Reinforcement Learning with High Dimensional Reward14 Aug 2024 0 repositories listed
-
Residual Deep Reinforcement Learning for Inverter-based Volt-Var Control13 Aug 2024 0 repositories listed
-
Retrieval-Augmented Hierarchical in-Context Reinforcement Learning and Hindsight Modular Reflections for Task Planning with LLMs12 Aug 2024 0 repositories listed
-
Online Optimization of Curriculum Learning Schedules using Evolutionary Optimization12 Aug 2024 0 repositories listed
-
CURLing the Dream: Contrastive Representations for World Modeling in Reinforcement Learning11 Aug 2024 0 repositories listed
-
Root Cause Attribution of Delivery Risks via Causal Discovery with Reinforcement Learning11 Aug 2024 0 repositories listed
-
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization8 Aug 2024 0 repositories listed
-
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs8 Aug 2024 0 repositories listed
-
KnowPC: Knowledge-Driven Programmatic Reinforcement Learning for Zero-shot Coordination8 Aug 2024 0 repositories listed
-
AI-Driven approach for sustainable extraction of earth's subsurface renewable energy while minimizing seismic activity7 Aug 2024 0 repositories listed
-
PLANRL: A Motion Planning and Imitation Learning Framework to Bootstrap Reinforcement Learning7 Aug 2024 0 repositories listed
-
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning6 Aug 2024 0 repositories listed
-
Research on Autonomous Driving Decision-making Strategies based Deep Reinforcement Learning6 Aug 2024 0 repositories listed
-
QADQN: Quantum Attention Deep Q-Network for Financial Market Prediction6 Aug 2024 0 repositories listed