Browse State-of-the-Art › Reinforcement Learning › Papers, page 59
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 59 of 132: papers 5,801 to 5,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Scaling Is All You Need: Autonomous Driving with JAX-Accelerated Reinforcement Learning23 Dec 2023 0 repositories listed
-
A Note on Stability in Asynchronous Stochastic Approximation without Communication Delays22 Dec 2023 0 repositories listed
-
A Survey of Reinforcement Learning from Human Feedback22 Dec 2023 0 repositories listed
-
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost22 Dec 2023 0 repositories listed
-
Automatic Curriculum Learning with Gradient Reward Signals21 Dec 2023 0 repositories listed
-
CVA Hedging by Risk-Averse Stochastic-Horizon Reinforcement Learning21 Dec 2023 0 repositories listed
-
Optimal coordination of resources: A solution from reinforcement learning20 Dec 2023 0 repositories listed
-
PGN: A perturbation generation network against deep reinforcement learning20 Dec 2023 0 repositories listed
-
Sparse Mean Field Load Balancing in Large Localized Queueing Systems20 Dec 2023 0 repositories listed
-
Curriculum Learning for Cooperation in Multi-Agent Reinforcement Learning19 Dec 2023 0 repositories listed
-
Neural Network Approximation for Pessimistic Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Active search and coverage using point-cloud reinforcement learning18 Dec 2023 0 repositories listed
-
Contextual Reinforcement Learning for Offshore Wind Farm Bidding18 Dec 2023 0 repositories listed
-
Advancing RAN Slicing with Offline Reinforcement Learning16 Dec 2023 0 repositories listed
-
Fractional Deep Reinforcement Learning for Age-Minimal Mobile Edge Computing16 Dec 2023 0 repositories listed
-
Robust Communicative Multi-Agent Reinforcement Learning with Active Defense16 Dec 2023 0 repositories listed
-
Assume-Guarantee Reinforcement Learning15 Dec 2023 0 repositories listed
-
15 Dec 2023 0 repositories listed
-
Multi-agent Reinforcement Learning: A Comprehensive Survey15 Dec 2023 0 repositories listed
-
Situation-Dependent Causal Influence-Based Cooperative Multi-agent Reinforcement Learning15 Dec 2023 0 repositories listed
-
Small Dataset, Big Gains: Enhancing Reinforcement Learning by Offline Pre-Training with Model Based Augmentation15 Dec 2023 0 repositories listed
-
Toward Computationally Efficient Inverse Reinforcement Learning via Reward Shaping15 Dec 2023 0 repositories listed
-
Adaptive parameter sharing for multi-agent reinforcement learning14 Dec 2023 0 repositories listed
-
Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft14 Dec 2023 0 repositories listed
-
Improve Robustness of Reinforcement Learning against Observation Perturbations via l_∞ Lipschitz Policy Networks14 Dec 2023 0 repositories listed
-
LiFT: Unsupervised Reinforcement Learning with Foundation Models as Teachers14 Dec 2023 0 repositories listed
-
Personalized Path Recourse for Reinforcement Learning Agents14 Dec 2023 0 repositories listed
-
Vision-Language Models as a Source of Rewards14 Dec 2023 0 repositories listed
-
An Invitation to Deep Reinforcement Learning13 Dec 2023 0 repositories listed
-
Enhancing Robotic Navigation: An Evaluation of Single and Multi-Objective Reinforcement Learning Strategies13 Dec 2023 0 repositories listed
-
Leveraging User Simulation to Develop and Evaluate Conversational Information Access Agents13 Dec 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: Training Backup Control Barrier Functions with Zero Training Time Safety Violations13 Dec 2023 0 repositories listed
-
Noise Distribution Decomposition based Multi-Agent Distributional Reinforcement Learning12 Dec 2023 0 repositories listed
-
Real-time Network Intrusion Detection via Decision Transformers12 Dec 2023 0 repositories listed
-
Scalable Decentralized Cooperative Platoon using Multi-Agent Deep Reinforcement Learning11 Dec 2023 0 repositories listed
-
Spreeze: High-Throughput Parallel Reinforcement Learning Framework11 Dec 2023 0 repositories listed
-
DCIR: Dynamic Consistency Intrinsic Reward for Multi-Agent Reinforcement Learning10 Dec 2023 0 repositories listed
-
Language-Conditioned Semantic Search-Based Policy for Robotic Manipulation Tasks10 Dec 2023 0 repositories listed
-
PerfRL: A Small Language Model Framework for Efficient Code Optimization9 Dec 2023 0 repositories listed
-
Position control of an acoustic cavitation bubble by reinforcement learning9 Dec 2023 0 repositories listed
-
Privacy Preserving Multi-Agent Reinforcement Learning in Supply Chains9 Dec 2023 0 repositories listed
-
Canaries and Whistles: Resilient Drone Communication Networks with (or without) Deep Reinforcement Learning8 Dec 2023 0 repositories listed
-
DARLEI: Deep Accelerated Reinforcement Learning with Evolutionary Intelligence8 Dec 2023 0 repositories listed
-
Modeling Risk in Reinforcement Learning: A Literature Mapping8 Dec 2023 0 repositories listed
-
Pruning Convolutional Filters via Reinforcement Learning with Entropy Minimization8 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Static Feature Settings6 Dec 2023 0 repositories listed
-
MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment6 Dec 2023 0 repositories listed
-
A Q-learning approach to the continuous control problem of robot inverted pendulum balancing5 Dec 2023 0 repositories listed
-
Similarity-based Knowledge Transfer for Cross-Domain Reinforcement Learning5 Dec 2023 0 repositories listed
-
Integrated Drill Boom Hole-Seeking Control via Reinforcement Learning4 Dec 2023 0 repositories listed
-
Training Reinforcement Learning Agents and Humans With Difficulty-Conditioned Generators4 Dec 2023 0 repositories listed
-
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?4 Dec 2023 0 repositories listed
-
Distributed Reinforcement Learning for Molecular Design: Antioxidant case3 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Time-varying Feature Settings3 Dec 2023 0 repositories listed
-
3 Dec 2023 0 repositories listed Syntology 9 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 0 where Syntology's instrument failed) · 7 unverified (of 16 harvested samples) · 16 pointer-only (licence)
-
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning2 Dec 2023 0 repositories listed
-
RLHF and IIA: Perverse Incentives2 Dec 2023 0 repositories listed
-
Safe Reinforcement Learning in Tensor Reproducing Kernel Hilbert Space1 Dec 2023 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Vehicle Trajectory Control30 Nov 2023 0 repositories listed
-
Efficient Model-Based Concave Utility Reinforcement Learning through Greedy Mirror Descent30 Nov 2023 0 repositories listed
-
Handling Cost and Constraints with Off-Policy Deep Reinforcement Learning30 Nov 2023 0 repositories listed
-
Bias Resilient Multi-Step Off-Policy Goal-Conditioned Reinforcement Learning29 Nov 2023 0 repositories listed
-
Deep Reinforcement Learning Graphs: Feedback Motion Planning via Neural Lyapunov Verification29 Nov 2023 0 repositories listed
-
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective29 Nov 2023 0 repositories listed
-
LanGWM: Language Grounded World Model29 Nov 2023 0 repositories listed
-
Maximum Entropy Model Correction in Reinforcement Learning29 Nov 2023 0 repositories listed
-
Stable Online and Offline Reinforcement Learning for Antibody CDRH3 Design29 Nov 2023 0 repositories listed
-
Two-Step Reinforcement Learning for Multistage Strategy Card Game29 Nov 2023 0 repositories listed
-
Digital Twin-Enhanced Deep Reinforcement Learning for Resource Management in Networks Slicing28 Nov 2023 0 repositories listed
-
Goal-conditioned Offline Planning from Curious Exploration28 Nov 2023 0 repositories listed
-
Safe Reinforcement Learning in a Simulated Robotic Arm28 Nov 2023 0 repositories listed
-
Optimal Observer Design Using Reinforcement Learning and Quadratic Neural Networks27 Nov 2023 0 repositories listed
-
Reinforcement Learning from Diffusion Feedback: Q* for Image Search27 Nov 2023 0 repositories listed
-
Value-Based Reinforcement Learning for Digital Twins in Cloud Computing27 Nov 2023 0 repositories listed
-
FRAC-Q-Learning: A Reinforcement Learning with Boredom Avoidance Processes for Social Robots26 Nov 2023 0 repositories listed
-
Approximation of Convex Envelope Using Reinforcement Learning24 Nov 2023 0 repositories listed
-
Directly Attention Loss Adjusted Prioritized Experience Replay24 Nov 2023 0 repositories listed
-
Efficient Open-world Reinforcement Learning via Knowledge Distillation and Autonomous Rule Discovery24 Nov 2023 0 repositories listed
-
How to ensure a safe control strategy? Towards a SRL for urban transit autonomous operation24 Nov 2023 0 repositories listed
-
Multi-modal Instance Refinement for Cross-domain Action Recognition24 Nov 2023 0 repositories listed
-
Reinforcement Learning from Statistical Feedback: the Journey from AB Testing to ANT Testing24 Nov 2023 0 repositories listed
-
Probabilistic Inference in Reinforcement Learning Done Right22 Nov 2023 0 repositories listed
-
RLIF: Interactive Imitation Learning as Reinforcement Learning21 Nov 2023 0 repositories listed
-
ADAPTER-RL: Adaptation of Any Agent using Reinforcement Learning20 Nov 2023 0 repositories listed
-
Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning20 Nov 2023 0 repositories listed
-
Offline Reinforcement Learning for Wireless Network Optimization with Mixture Datasets19 Nov 2023 0 repositories listed
-
Tactile Active Inference Reinforcement Learning for Efficient Robotic Manipulation Skill Acquisition19 Nov 2023 0 repositories listed
-
Benchmarking Feature Extractors for Reinforcement Learning-Based Semiconductor Defect Localization18 Nov 2023 0 repositories listed
-
Autonomous Port Navigation With Ranging Sensors Using Model-Based Reinforcement Learning17 Nov 2023 0 repositories listed
-
Towards a Standardized Reinforcement Learning Framework for AAM Contingency Management17 Nov 2023 0 repositories listed
-
Augmenting Unsupervised Reinforcement Learning with Self-Reference16 Nov 2023 0 repositories listed
-
Data-Driven LQR using Reinforcement Learning and Quadratic Neural Networks16 Nov 2023 0 repositories listed
-
Runtime Verification of Learning Properties for Reinforcement Learning Algorithms16 Nov 2023 0 repositories listed
-
Safety Aware Autonomous Path Planning Using Model Predictive Reinforcement Learning for Inland Waterways16 Nov 2023 0 repositories listed
-
Adversarial Attacks to Reward Machine-based Reinforcement Learning15 Nov 2023 0 repositories listed
-
An MRL-Based Design Solution for RIS-Assisted MU-MIMO Wireless System under Time-Varying Channels15 Nov 2023 0 repositories listed
-
Assessing the Robustness of Intelligence-Driven Reinforcement Learning15 Nov 2023 0 repositories listed
-
On the Foundation of Distributionally Robust Reinforcement Learning15 Nov 2023 0 repositories listed
-
Self-Supervised Curriculum Generation for Autonomous Reinforcement Learning without Task-Specific Knowledge15 Nov 2023 0 repositories listed
-
Supported Trust Region Optimization for Offline Reinforcement Learning15 Nov 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.