Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 60
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 60 of 152: papers 5,901 to 6,000 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Benchmarking Reinforcement Learning Methods for Dexterous Robotic Manipulation with a Three-Fingered Gripper27 Aug 2024 0 repositories listed
-
Evaluating the Impact of Multiple DER Aggregators on Wholesale Energy Markets: A Hybrid Mean Field Approach27 Aug 2024 0 repositories listed
-
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning27 Aug 2024 0 repositories listed
-
Simultaneous Training of First- and Second-Order Optimizers in Population-Based Reinforcement Learning27 Aug 2024 0 repositories listed
-
Unsupervised-to-Online Reinforcement Learning27 Aug 2024 0 repositories listed
-
DynamicRouteGPT: A Real-Time Multi-Vehicle Dynamic Navigation Framework Based on Large Language Models26 Aug 2024 0 repositories listed
-
Model-Based Reinforcement Learning for Control of Strongly-Disturbed Unsteady Aerodynamic Flows26 Aug 2024 0 repositories listed
-
Multi-Agent Target Assignment and Path Finding for Intelligent Warehouse: A Cooperative Multi-Agent Deep Reinforcement Learning Perspective25 Aug 2024 0 repositories listed
-
Data Augmentation for Continual RL via Adversarial Gradient Episodic Memory24 Aug 2024 0 repositories listed
-
Reinforcement Learning for Causal Discovery without Acyclicity Constraints24 Aug 2024 0 repositories listed
-
Rethinking State Disentanglement in Causal Reinforcement Learning24 Aug 2024 0 repositories listed
-
Localized Observation Abstraction Using Piecewise Linear Spatial Decay for Reinforcement Learning in Combat Simulations23 Aug 2024 0 repositories listed
-
Mastering the Digital Art of War: Developing Intelligent Combat Simulation Agents for Wargaming Using Hierarchical Reinforcement Learning23 Aug 2024 0 repositories listed
-
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning23 Aug 2024 0 repositories listed
-
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards22 Aug 2024 0 repositories listed
-
Domain Adaptation for Offline Reinforcement Learning with Limited Samples22 Aug 2024 0 repositories listed
-
Query-Efficient Video Adversarial Attack with Stylized Logo22 Aug 2024 0 repositories listed
-
Advances in Preference-based Reinforcement Learning: A Review21 Aug 2024 0 repositories listed
-
Using Part-based Representations for Explainable Deep Reinforcement Learning21 Aug 2024 0 repositories listed
-
Integrating Multi-Modal Input Token Mixer Into Mamba-Based Decision Models: Decision MetaMamba20 Aug 2024 0 repositories listed
-
Offline Model-Based Reinforcement Learning with Anti-Exploration20 Aug 2024 0 repositories listed
-
The Evolution of Reinforcement Learning in Quantitative Finance: A Survey20 Aug 2024 0 repositories listed
-
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm19 Aug 2024 0 repositories listed
-
Enhancing Reinforcement Learning Through Guided Search19 Aug 2024 0 repositories listed
-
MalLight: Influence-Aware Coordinated Traffic Signal Control for Traffic Signal Malfunctions19 Aug 2024 0 repositories listed
-
World Models Increase Autonomy in Reinforcement Learning19 Aug 2024 0 repositories listed
-
Ancestral Reinforcement Learning: Unifying Zeroth-Order Optimization and Genetic Algorithms for Reinforcement Learning18 Aug 2024 0 repositories listed
-
Reinforcement learning-based adaptive speed controllers in mixed autonomy condition17 Aug 2024 0 repositories listed
-
CAT: Caution Aware Transfer in Reinforcement Learning via Distributional Risk16 Aug 2024 0 repositories listed
-
Model-based RL as a Minimalist Approach to Horizon-Free and Second-Order Bounds16 Aug 2024 0 repositories listed
-
Adaptive User Journeys in Pharma E-Commerce with Reinforcement Learning: Insights from SwipeRx15 Aug 2024 0 repositories listed
-
BCR-DRL: Behavior- and Context-aware Reward for Deep Reinforcement Learning in Human-AI Coordination15 Aug 2024 0 repositories listed
-
Online Behavior Modification for Expressive User Control of RL-Trained Robots15 Aug 2024 0 repositories listed
-
Large Language Models Prompting With Episodic Memory14 Aug 2024 0 repositories listed
-
Off-Policy Reinforcement Learning with High Dimensional Reward14 Aug 2024 0 repositories listed
-
Value of Information and Reward Specification in Active Inference and POMDPs13 Aug 2024 0 repositories listed
-
Online Optimization of Curriculum Learning Schedules using Evolutionary Optimization12 Aug 2024 0 repositories listed
-
The Bandit Whisperer: Communication Learning for Restless Bandits11 Aug 2024 0 repositories listed
-
Optimizing Portfolio with Two-Sided Transactions and Lending: A Reinforcement Learning Framework9 Aug 2024 0 repositories listed
-
Deep Reinforcement Learning for the Design of Metamaterial Mechanisms with Functional Compliance Control8 Aug 2024 0 repositories listed
-
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs8 Aug 2024 0 repositories listed
-
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes7 Aug 2024 0 repositories listed
-
PLANRL: A Motion Planning and Imitation Learning Framework to Bootstrap Reinforcement Learning7 Aug 2024 0 repositories listed
-
Integrating Controllable Motion Skills from Demonstrations6 Aug 2024 0 repositories listed
-
CADRL: Category-aware Dual-agent Reinforcement Learning for Explainable Recommendations over Knowledge Graphs6 Aug 2024 0 repositories listed
-
Model-free optimal controller for discrete-time Markovian jump linear systems: A Q-learning approach6 Aug 2024 0 repositories listed
-
Active Sensing of Knee Osteoarthritis Progression with Reinforcement Learning5 Aug 2024 0 repositories listed
-
Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise5 Aug 2024 0 repositories listed
-
Reinforcement Learning for an Efficient and Effective Malware Investigation during Cyber Incident Response4 Aug 2024 0 repositories listed
-
A Survey on Self-play Methods in Reinforcement Learning2 Aug 2024 0 repositories listed
-
TCR-GPT: Integrating Autoregressive Model and Reinforcement Learning for T-Cell Receptor Repertoires Generation2 Aug 2024 0 repositories listed
-
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems2 Aug 2024 0 repositories listed
-
ProSpec RL: Plan Ahead, then Execute31 Jul 2024 0 repositories listed
-
Adaptive Transit Signal Priority based on Deep Reinforcement Learning and Connected Vehicles in a Traffic Microsimulation Environment31 Jul 2024 0 repositories listed
-
Image-Based Deep Reinforcement Learning with Intrinsically Motivated Stimuli: On the Execution of Complex Robotic Tasks31 Jul 2024 0 repositories listed
-
Multi-agent Assessment with QoS Enhancement for HD Map Updates in a Vehicular Network31 Jul 2024 0 repositories listed
-
Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive Representations30 Jul 2024 0 repositories listed
-
A Method for Fast Autonomy Transfer in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Anomalous State Sequence Modeling to Enhance Safety in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Appraisal-Guided Proximal Policy Optimization: Modeling Psychological Disorders in Dynamic Grid World29 Jul 2024 0 repositories listed
-
Evolution of cooperation in the public goods game with Q-learning29 Jul 2024 0 repositories listed
-
Learning to Provably Satisfy High Relative Degree Constraints for Black-Box Systems29 Jul 2024 0 repositories listed
-
QT-TDM: Planning With Transformer Dynamics Model and Autoregressive Q-Learning26 Jul 2024 0 repositories listed
-
Reinforcement learning for anisotropic p-adaptation and error estimation in high-order solvers26 Jul 2024 0 repositories listed
-
Differentiable Quantum Architecture Search in Asynchronous Quantum Reinforcement Learning25 Jul 2024 0 repositories listed
-
Path Following and Stabilisation of a Bicycle Model using a Reinforcement Learning Approach24 Jul 2024 0 repositories listed
-
Pretrained Visual Representations in Reinforcement Learning24 Jul 2024 0 repositories listed
-
SoNIC: Safe Social Navigation with Adaptive Conformal Inference and Constrained Reinforcement Learning24 Jul 2024 0 repositories listed
-
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems24 Jul 2024 0 repositories listed
-
Automatic Environment Shaping is the Next Frontier in RL23 Jul 2024 0 repositories listed
-
From Imitation to Refinement -- Residual RL for Precise Assembly23 Jul 2024 0 repositories listed
-
ODGR: Online Dynamic Goal Recognition23 Jul 2024 0 repositories listed
-
SECRM-2D: RL-Based Efficient and Comfortable Route-Following Autonomous Driving with Analytic Safety Guarantees23 Jul 2024 0 repositories listed
-
Artificial Intelligence-based Decision Support Systems for Precision and Digital Health22 Jul 2024 0 repositories listed
-
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications22 Jul 2024 0 repositories listed
-
Concept-Based Interpretable Reinforcement Learning with Limited to No Human Labels22 Jul 2024 0 repositories listed
-
Importance Sampling-Guided Meta-Training for Intelligent Agents in Highly Interactive Environments22 Jul 2024 0 repositories listed
-
Offline Imitation Learning Through Graph Search and Retrieval22 Jul 2024 0 repositories listed
-
Should we use model-free or model-based control? A case study of battery management systems22 Jul 2024 0 repositories listed
-
Rocket Landing Control with Random Annealing Jump Start Reinforcement Learning21 Jul 2024 0 repositories listed
-
Optimality theory of stigmergic collective information processing by chemotactic cells21 Jul 2024 0 repositories listed
-
Phase Re-service in Reinforcement Learning Traffic Signal Control20 Jul 2024 0 repositories listed
-
FuzzTheREST: An Intelligent Automated Black-box RESTful API Fuzzer19 Jul 2024 0 repositories listed
-
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing19 Jul 2024 0 repositories listed
-
Geometric Active Exploration in Markov Decision Processes: the Benefit of Abstraction18 Jul 2024 0 repositories listed
-
Random Latent Exploration for Deep Reinforcement Learning18 Jul 2024 0 repositories listed
-
Reinforcement Learning: Tutorial and Survey18 Jul 2024 0 repositories listed
-
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning17 Jul 2024 0 repositories listed
-
A Graph-based Adversarial Imitation Learning Framework for Reliable & Realtime Fleet Scheduling in Urban Air Mobility16 Jul 2024 0 repositories listed
-
Deflated Dynamics Value Iteration15 Jul 2024 0 repositories listed
-
SuperPADL: Scaling Language-Directed Physics-Based Control with Progressive Supervised Distillation15 Jul 2024 0 repositories listed
-
Affordance-Guided Reinforcement Learning via Visual Prompting14 Jul 2024 0 repositories listed
-
Deep reinforcement learning with symmetric data augmentation applied for aircraft lateral attitude tracking control13 Jul 2024 0 repositories listed
-
Global Reinforcement Learning: Beyond Linear and Convex Rewards via Submodular Semi-gradient Methods13 Jul 2024 0 repositories listed
-
Communication-Aware Reinforcement Learning for Cooperative Adaptive Cruise Control12 Jul 2024 0 repositories listed
-
A Review of Nine Physics Engines for Reinforcement Learning Research11 Jul 2024 0 repositories listed
-
Enhancing Performance and User Engagement in Everyday Stress Monitoring: A Context-Aware Active Reinforcement Learning Approach11 Jul 2024 0 repositories listed
-
PID Accelerated Temporal Difference Algorithms11 Jul 2024 0 repositories listed
-
Continuous Control with Coarse-to-fine Reinforcement Learning10 Jul 2024 0 repositories listed
-
Learning In-Hand Translation Using Tactile Skin With Shear and Normal Force Sensing10 Jul 2024 0 repositories listed