Browse State-of-the-Art › Reinforcement Learning › Papers, page 55
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 55 of 132: papers 5,401 to 5,500 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
State-Constrained Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Almost sure convergence rates of stochastic gradient methods under gradient domination22 May 2024 0 repositories listed
-
ConcertoRL: An Innovative Time-Interleaved Reinforcement Learning Approach for Enhanced Control in Direct-Drive Tandem-Wing Vehicles22 May 2024 0 repositories listed
-
Dynamic Model Predictive Shielding for Provably Safe Reinforcement Learning22 May 2024 0 repositories listed
-
Traffic control using intelligent timing of traffic lights with reinforcement learning technique and real-time processing of surveillance camera images22 May 2024 0 repositories listed
-
Transformers Learn Temporal Difference Methods for In-Context Reinforcement Learning22 May 2024 0 repositories listed
-
Deep Reinforcement Learning for Time-Critical Wilderness Search And Rescue Using Drones21 May 2024 0 repositories listed
-
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback20 May 2024 0 repositories listed
-
Continual Deep Reinforcement Learning for Decentralized Satellite Routing20 May 2024 0 repositories listed
-
Reward-Punishment Reinforcement Learning with Maximum Entropy20 May 2024 0 repositories listed
-
Comparisons Are All You Need for Optimizing Smooth Functions19 May 2024 0 repositories listed
-
Deep Dive into Model-free Reinforcement Learning for Biological and Robotic Systems: Theory and Practice19 May 2024 0 repositories listed
-
Do No Harm: A Counterfactual Approach to Safe Reinforcement Learning19 May 2024 0 repositories listed
-
Enhancing Vehicle Aerodynamics with Deep Reinforcement Learning in Voxelised Models19 May 2024 0 repositories listed
-
Exploiting Distributional Value Functions for Financial Market Valuation, Enhanced Feature Creation and Improvement of Trading Algorithms19 May 2024 0 repositories listed
-
Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities17 May 2024 0 repositories listed
-
LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions17 May 2024 0 repositories listed
-
Sample-Efficient Constrained Reinforcement Learning with General Parameterization17 May 2024 0 repositories listed
-
Time-Varying Constraint-Aware Reinforcement Learning for Energy Storage Control17 May 2024 0 repositories listed
-
Chaos-based reinforcement learning with TD315 May 2024 0 repositories listed
-
Detecting Continuous Integration Skip : A Reinforcement Learning-based Approach15 May 2024 0 repositories listed
-
Fully Distributed Fog Load Balancing with Multi-Agent Reinforcement Learning15 May 2024 0 repositories listed
-
Hierarchical Resource Partitioning on Modern GPUs: A Reinforcement Learning Approach14 May 2024 0 repositories listed
-
I-CTRL: Imitation to Control Humanoid Robots Through Constrained Reinforcement Learning14 May 2024 0 repositories listed
-
Optimizing Deep Reinforcement Learning for American Put Option Hedging14 May 2024 0 repositories listed
-
Python-Based Reinforcement Learning on Simulink Models14 May 2024 0 repositories listed
-
Safety Constrained Multi-Agent Reinforcement Learning for Active Voltage Control14 May 2024 0 repositories listed
-
Stable Inverse Reinforcement Learning: Policies from Control Lyapunov Landscapes14 May 2024 0 repositories listed
-
Hamiltonian-based Quantum Reinforcement Learning for Neural Combinatorial Optimization13 May 2024 0 repositories listed
-
Neural Network Compression for Reinforcement Learning Tasks13 May 2024 0 repositories listed
-
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning13 May 2024 0 repositories listed
-
Reducing Risk for Assistive Reinforcement Learning Policies with Diffusion Models13 May 2024 0 repositories listed
-
Structured Reinforcement Learning for Incentivized Stochastic Covert Optimization13 May 2024 0 repositories listed
-
On-Demand Model and Client Deployment in Federated Learning with Deep Reinforcement Learning12 May 2024 0 repositories listed
-
Auditing an Automatic Grading Model with deep Reinforcement Learning11 May 2024 0 repositories listed
-
Fairness in Reinforcement Learning: A Survey11 May 2024 0 repositories listed
-
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning10 May 2024 0 repositories listed
-
Hedging American Put Options with Deep Reinforcement Learning10 May 2024 0 repositories listed
-
An Overview of Machine Learning-Enabled Optimization for Reconfigurable Intelligent Surfaces-Aided 6G Networks: From Reinforcement Learning to Large Language Models9 May 2024 0 repositories listed
-
Conversational Topic Recommendation in Counseling and Psychotherapy with Decision Transformer and Large Language Models8 May 2024 0 repositories listed
-
Fast Stochastic Policy Gradient: Negative Momentum for Reinforcement Learning8 May 2024 0 repositories listed
-
Markowitz Meets Bellman: Knowledge-distilled Reinforcement Learning for Portfolio Management8 May 2024 0 repositories listed
-
Model-Free Robust φ-Divergence Reinforcement Learning Using Both Offline and Online Data8 May 2024 0 repositories listed
-
Improving Offline Reinforcement Learning with Inaccurate Simulators7 May 2024 0 repositories listed
-
RACER: Epistemic Risk-Sensitive RL Enables Fast Driving with Fewer Crashes7 May 2024 0 repositories listed
-
TorchDriveEnv: A Reinforcement Learning Benchmark for Autonomous Driving with Reactive, Realistic, and Diverse Non-Playable Characters7 May 2024 0 repositories listed
-
Federated Reinforcement Learning with Constraint Heterogeneity6 May 2024 0 repositories listed
-
Finite-Time Convergence and Sample Complexity of Actor-Critic Multi-Objective Reinforcement Learning5 May 2024 0 repositories listed
-
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints5 May 2024 0 repositories listed
-
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning4 May 2024 0 repositories listed
-
UDUC: An Uncertainty-driven Approach for Learning-based Robust Control4 May 2024 0 repositories listed
-
Learning Robot Soccer from Egocentric Vision with Deep Reinforcement Learning3 May 2024 0 repositories listed
-
Model-based reinforcement learning for protein backbone design3 May 2024 0 repositories listed
-
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning3 May 2024 0 repositories listed
-
Zero-Sum Positional Differential Games as a Framework for Robust Reinforcement Learning: Deep Q-Learning Approach3 May 2024 0 repositories listed
-
Behavior Imitation for Manipulator Control and Grasping with Deep Reinforcement Learning2 May 2024 0 repositories listed
-
CityLearn v2: Energy-flexible, resilient, occupant-centric, and carbon-aware management of grid-interactive communities2 May 2024 0 repositories listed
-
Constrained Reinforcement Learning Under Model Mismatch2 May 2024 0 repositories listed
-
Goal-conditioned reinforcement learning for ultrasound navigation guidance2 May 2024 0 repositories listed
-
Intelligent Hybrid Resource Allocation in MEC-assisted RAN Slicing Network2 May 2024 0 repositories listed
-
Reinforcement Learning-Guided Semi-Supervised Learning2 May 2024 0 repositories listed
-
Robust Risk-Sensitive Reinforcement Learning with Conditional Value-at-Risk2 May 2024 0 repositories listed
-
Tabular and Deep Reinforcement Learning for Gittins Index2 May 2024 0 repositories listed
-
Towards Interpretable Reinforcement Learning with Constrained Normalizing Flow Policies2 May 2024 0 repositories listed
-
Employing Federated Learning for Training Autonomous HVAC Systems1 May 2024 0 repositories listed
-
MF-OML: Online Mean-Field Reinforcement Learning with Occupation Measures for Large Population Games1 May 2024 0 repositories listed
-
Portfolio Management using Deep Reinforcement Learning1 May 2024 0 repositories listed
-
Queue-based Eco-Driving at Roundabouts with Reinforcement Learning1 May 2024 0 repositories listed
-
AI, Pluralism, and (Social) Compensation30 Apr 2024 0 repositories listed
-
Reinforcement Learning Problem Solving with Large Language Models29 Apr 2024 0 repositories listed
-
Self-training superconducting neuromorphic circuits using reinforcement learning rules29 Apr 2024 0 repositories listed
-
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning27 Apr 2024 0 repositories listed
-
Knowledge Transfer for Cross-Domain Reinforcement Learning: A Systematic Review26 Apr 2024 0 repositories listed
-
Offline Reinforcement Learning with Behavioral Supervisor Tuning25 Apr 2024 0 repositories listed
-
24 Apr 2024 0 repositories listed Syntology 1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result (of 1 harvested sample)
-
GRSN: Gated Recurrent Spiking Neurons for POMDPs and MARL24 Apr 2024 0 repositories listed
-
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems23 Apr 2024 0 repositories listed
-
Enhancing High-Speed Cruising Performance of Autonomous Vehicles through Integrated Deep Reinforcement Learning Framework23 Apr 2024 0 repositories listed
-
Evolutionary Reinforcement Learning via Cooperative Coevolution23 Apr 2024 0 repositories listed
-
MultiSTOP: Solving Functional Equations with Reinforcement Learning23 Apr 2024 0 repositories listed
-
The Power of Resets in Online Reinforcement Learning23 Apr 2024 0 repositories listed
-
Using deep reinforcement learning to promote sustainable human behaviour on a common pool resource problem23 Apr 2024 0 repositories listed
-
Learning Control Barrier Functions and their application in Reinforcement Learning: A Survey22 Apr 2024 0 repositories listed
-
On the stability of Lipschitz continuous control problems and its application to reinforcement learning20 Apr 2024 0 repositories listed
-
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty19 Apr 2024 0 repositories listed
-
MM-PhyRLHF: Reinforcement Learning Framework for Multimodal Physics Question-Answering19 Apr 2024 0 repositories listed
-
Reinforcement Learning Approach for Integrating Compressed Contexts into Knowledge Graphs19 Apr 2024 0 repositories listed
-
Data-Incremental Continual Offline Reinforcement Learning19 Apr 2024 0 repositories listed
-
Zero-Shot Stitching in Reinforcement Learning using Relative Representations19 Apr 2024 0 repositories listed
-
Actor-Critic Reinforcement Learning with Phased Actor18 Apr 2024 0 repositories listed
-
LTL-Constrained Policy Optimization with Cycle Experience Replay17 Apr 2024 0 repositories listed
-
Automatic re-calibration of quantum devices by reinforcement learning16 Apr 2024 0 repositories listed
-
Continuous Control Reinforcement Learning: Distributed Distributional DrQ Algorithms16 Apr 2024 0 repositories listed
-
Offline Trajectory Generalization for Offline Reinforcement Learning16 Apr 2024 0 repositories listed
-
Simplex Decomposition for Portfolio Allocation Constraints in Reinforcement Learning16 Apr 2024 0 repositories listed
-
Towards a Research Community in Interpretable Reinforcement Learning: the InterpPol Workshop16 Apr 2024 0 repositories listed
-
Reinforcement Learning from Multi-role Debates as Feedback for Bias Mitigation in LLMs15 Apr 2024 0 repositories listed
-
Effective Reinforcement Learning Based on Structural Information Principles15 Apr 2024 0 repositories listed
-
EyeFormer: Predicting Personalized Scanpaths with Transformer-Guided Reinforcement Learning15 Apr 2024 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.