Browse State-of-the-Art › reinforcement-learning › Papers, page 52
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 52 of 135: papers 5,101 to 5,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
CADRL: Category-aware Dual-agent Reinforcement Learning for Explainable Recommendations over Knowledge Graphs6 Aug 2024 0 repositories listed
-
Active Sensing of Knee Osteoarthritis Progression with Reinforcement Learning5 Aug 2024 0 repositories listed
-
Scenario-based Thermal Management Parametrization Through Deep Reinforcement Learning4 Aug 2024 0 repositories listed
-
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning4 Aug 2024 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Order Picking in Warehouse Operations3 Aug 2024 0 repositories listed
-
A Survey on Self-play Methods in Reinforcement Learning2 Aug 2024 0 repositories listed
-
Optimizing Variational Quantum Circuits Using Metaheuristic Strategies in Reinforcement Learning2 Aug 2024 0 repositories listed
-
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems2 Aug 2024 0 repositories listed
-
Enabling High Data Throughput Reinforcement Learning on GPUs: A Domain Agnostic Framework for Data-Driven Scientific Research1 Aug 2024 0 repositories listed
-
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation31 Jul 2024 0 repositories listed
-
Architectural Influence on Variational Quantum Circuits in Multi-Agent Reinforcement Learning: Evolutionary Strategies for Optimization30 Jul 2024 0 repositories listed
-
How to Choose a Reinforcement-Learning Algorithm30 Jul 2024 0 repositories listed
-
Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive Representations30 Jul 2024 0 repositories listed
-
A Method for Fast Autonomy Transfer in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Anomalous State Sequence Modeling to Enhance Safety in Reinforcement Learning29 Jul 2024 0 repositories listed
-
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning29 Jul 2024 0 repositories listed
-
Quantum Machine Learning Architecture Search via Deep Reinforcement Learning29 Jul 2024 0 repositories listed
-
Empowering Clinicians with Medical Decision Transformers: A Framework for Sepsis Treatment28 Jul 2024 0 repositories listed
-
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited28 Jul 2024 0 repositories listed
-
On the benefits of pixel-based hierarchical policies for task generalization27 Jul 2024 0 repositories listed
-
Reinforcement Learning for Sustainable Energy: A Survey26 Jul 2024 0 repositories listed
-
The Cross-environment Hyperparameter Setting Benchmark for Reinforcement Learning26 Jul 2024 0 repositories listed
-
Differentiable Quantum Architecture Search in Asynchronous Quantum Reinforcement Learning25 Jul 2024 0 repositories listed
-
Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts25 Jul 2024 0 repositories listed
-
MoveLight: Enhancing Traffic Signal Control through Movement-Centric Deep Reinforcement Learning24 Jul 2024 0 repositories listed
-
Pretrained Visual Representations in Reinforcement Learning24 Jul 2024 0 repositories listed
-
SoNIC: Safe Social Navigation with Adaptive Conformal Inference and Constrained Reinforcement Learning24 Jul 2024 0 repositories listed
-
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning24 Jul 2024 0 repositories listed
-
ODGR: Online Dynamic Goal Recognition23 Jul 2024 0 repositories listed
-
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications22 Jul 2024 0 repositories listed
-
Efficient Replay Memory Architectures in Multi-Agent Reinforcement Learning for Traffic Congestion Control22 Jul 2024 0 repositories listed
-
Exploring and Addressing Reward Confusion in Offline Preference Learning22 Jul 2024 0 repositories listed
-
Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms21 Jul 2024 0 repositories listed
-
Mitigating Deep Reinforcement Learning Backdoors in the Neural Activation Space21 Jul 2024 0 repositories listed
-
Rocket Landing Control with Random Annealing Jump Start Reinforcement Learning21 Jul 2024 0 repositories listed
-
Temporal Abstraction in Reinforcement Learning with Offline Data21 Jul 2024 0 repositories listed
-
Adapt2Reward: Adapting Video-Language Models to Generalizable Robotic Rewards via Failure Prompts20 Jul 2024 0 repositories listed
-
Phase Re-service in Reinforcement Learning Traffic Signal Control20 Jul 2024 0 repositories listed
-
Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning19 Jul 2024 0 repositories listed
-
On Policy Evaluation Algorithms in Distributional Reinforcement Learning19 Jul 2024 0 repositories listed
-
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing19 Jul 2024 0 repositories listed
-
An Agile Adaptation Method for Multi-mode Vehicle Communication Networks18 Jul 2024 0 repositories listed
-
A reinforcement learning strategy to automate and accelerate h/p-multigrid solvers18 Jul 2024 0 repositories listed
-
Analyzing and Bridging the Gap between Maximizing Total Reward and Discounted Reward in Deep Reinforcement Learning18 Jul 2024 0 repositories listed
-
Deep Reinforcement Learning for Multi-Objective Optimization: Enhancing Wind Turbine Energy Generation while Mitigating Noise Emissions18 Jul 2024 0 repositories listed
-
LIMT: Language-Informed Multi-Task Visual World Models18 Jul 2024 0 repositories listed
-
Model-based Policy Optimization using Symbolic World Model18 Jul 2024 0 repositories listed
-
Optimistic Q-learning for average reward and episodic reinforcement learning18 Jul 2024 0 repositories listed
-
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods18 Jul 2024 0 repositories listed
-
Random Latent Exploration for Deep Reinforcement Learning18 Jul 2024 0 repositories listed
-
Reinforcement Learning: Tutorial and Survey18 Jul 2024 0 repositories listed
-
Estimating Reaction Barriers with Deep Reinforcement Learning17 Jul 2024 0 repositories listed
-
Maintenance Strategies for Sewer Pipes with Multi-State Degradation and Deep Reinforcement Learning17 Jul 2024 0 repositories listed
-
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning17 Jul 2024 0 repositories listed
-
Subequivariant Reinforcement Learning in 3D Multi-Entity Physical Environments17 Jul 2024 0 repositories listed
-
Bellman Diffusion Models16 Jul 2024 0 repositories listed
-
Satisficing Exploration for Deep Reinforcement Learning16 Jul 2024 0 repositories listed
-
Why long model-based rollouts are no reason for bad Q-value estimates16 Jul 2024 0 repositories listed
-
Deep Learning-Based Operators for Evolutionary Algorithms15 Jul 2024 0 repositories listed
-
Exploration in Knowledge Transfer Utilizing Reinforcement Learning15 Jul 2024 0 repositories listed
-
Offline Reinforcement Learning with Imputed Rewards15 Jul 2024 0 repositories listed
-
Three Dogmas of Reinforcement Learning15 Jul 2024 0 repositories listed
-
Walking the Values in Bayesian Inverse Reinforcement Learning15 Jul 2024 0 repositories listed
-
Affordance-Guided Reinforcement Learning via Visual Prompting14 Jul 2024 0 repositories listed
-
Ontology-driven Reinforcement Learning for Personalized Student Support14 Jul 2024 0 repositories listed
-
Towards Adapting Reinforcement Learning Agents to New Tasks: Insights from Q-Values14 Jul 2024 0 repositories listed
-
Communication-Aware Reinforcement Learning for Cooperative Adaptive Cruise Control12 Jul 2024 0 repositories listed
-
Decentralized multi-agent reinforcement learning algorithm using a cluster-synchronized laser network12 Jul 2024 0 repositories listed
-
Hamilton-Jacobi Reachability in Reinforcement Learning: A Survey12 Jul 2024 0 repositories listed
-
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning11 Jul 2024 0 repositories listed
-
A Review of Nine Physics Engines for Reinforcement Learning Research11 Jul 2024 0 repositories listed
-
Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks11 Jul 2024 0 repositories listed
-
Continuous Control with Coarse-to-fine Reinforcement Learning10 Jul 2024 0 repositories listed
-
Leveraging LLMs to explain DRL decisions for transparent 6G network slicing10 Jul 2024 0 repositories listed
-
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning10 Jul 2024 0 repositories listed
-
Real-time system optimal traffic routing under uncertainties -- Can physics models boost reinforcement learning?10 Jul 2024 0 repositories listed
-
Reinforcement Learning of Adaptive Acquisition Policies for Inverse Problems10 Jul 2024 0 repositories listed
-
Frequency and Generalisation of Periodic Activation Functions in Reinforcement Learning9 Jul 2024 0 repositories listed
-
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes9 Jul 2024 0 repositories listed
-
Intercepting Unauthorized Aerial Robots in Controlled Airspace Using Reinforcement Learning9 Jul 2024 0 repositories listed
-
An open source Multi-Agent Deep Reinforcement Learning Routing Simulator for satellite networks8 Jul 2024 0 repositories listed
-
Graph Anomaly Detection with Noisy Labels by Reinforcement Learning8 Jul 2024 0 repositories listed
-
E²CFD: Towards Effective and Efficient Cost Function Design for Safe Reinforcement Learning via Large Language Model8 Jul 2024 0 repositories listed
-
Multi-agent Reinforcement Learning-based Network Intrusion Detection System8 Jul 2024 0 repositories listed
-
System stabilization with policy optimization on unstable latent manifolds8 Jul 2024 0 repositories listed
-
A Reinforcement Learning Approach for Wildfire Tracking with UAV Swarms7 Jul 2024 0 repositories listed
-
Discounted Pseudocosts in MILP7 Jul 2024 0 repositories listed
-
Multi-agent Off-policy Actor-Critic Reinforcement Learning for Partially Observable Environments6 Jul 2024 0 repositories listed
-
Augmented Bayesian Policy Search5 Jul 2024 0 repositories listed
-
Graph Reinforcement Learning for Power Grids: A Comprehensive Survey5 Jul 2024 0 repositories listed
-
Question Answering with Texts and Tables through Deep Reinforcement Learning5 Jul 2024 0 repositories listed
-
Unsupervised Video Summarization via Reinforcement Learning and a Trained Evaluator5 Jul 2024 0 repositories listed
-
Deep Pareto Reinforcement Learning for Multi-Objective Recommender Systems4 Jul 2024 0 repositories listed
-
Reinforcement Learning for Sequence Design Leveraging Protein Language Models3 Jul 2024 0 repositories listed
-
Beyond Numeric Awards: In-Context Dueling Bandits with LLM Agents2 Jul 2024 0 repositories listed
-
Reinforcement Learning and Machine ethics:a systematic review2 Jul 2024 0 repositories listed
-
Reinforcement Learning from Human Feedback: Whose Culture, Whose Values, Whose Perspectives?2 Jul 2024 0 repositories listed
-
Research on Autonomous Robots Navigation based on Reinforcement Learning2 Jul 2024 0 repositories listed
-
Text-Aware Diffusion for Policy Learning2 Jul 2024 0 repositories listed
-
A Deep Reinforcement Learning Approach to Battery Management in Dairy Farming via Proximal Policy Optimization1 Jul 2024 0 repositories listed