Browse State-of-the-Art › reinforcement-learning › Papers, page 60
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 60 of 135: papers 5,901 to 6,000 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Similarity-based Knowledge Transfer for Cross-Domain Reinforcement Learning5 Dec 2023 0 repositories listed
-
Foundations for Transfer in Reinforcement Learning: A Taxonomy of Knowledge Modalities4 Dec 2023 0 repositories listed
-
Integrated Drill Boom Hole-Seeking Control via Reinforcement Learning4 Dec 2023 0 repositories listed
-
Training Reinforcement Learning Agents and Humans With Difficulty-Conditioned Generators4 Dec 2023 0 repositories listed
-
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?4 Dec 2023 0 repositories listed
-
Distributed Reinforcement Learning for Molecular Design: Antioxidant case3 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Time-varying Feature Settings3 Dec 2023 0 repositories listed
-
3 Dec 2023 0 repositories listed Syntology 9 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 0 where Syntology's instrument failed) · 7 unverified (of 16 harvested samples) · 16 pointer-only (licence)
-
A Multifidelity Sim-to-Real Pipeline for Verifiable and Compositional Reinforcement Learning2 Dec 2023 0 repositories listed
-
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning2 Dec 2023 0 repositories listed
-
RLHF and IIA: Perverse Incentives2 Dec 2023 0 repositories listed
-
A safe exploration approach to constrained Markov decision processes1 Dec 2023 0 repositories listed
-
Safe Reinforcement Learning in Tensor Reproducing Kernel Hilbert Space1 Dec 2023 0 repositories listed
-
TRC: Trust Region Conditional Value at Risk for Safe Reinforcement Learning1 Dec 2023 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Vehicle Trajectory Control30 Nov 2023 0 repositories listed
-
Efficient Model-Based Concave Utility Reinforcement Learning through Greedy Mirror Descent30 Nov 2023 0 repositories listed
-
Handling Cost and Constraints with Off-Policy Deep Reinforcement Learning30 Nov 2023 0 repositories listed
-
Bias Resilient Multi-Step Off-Policy Goal-Conditioned Reinforcement Learning29 Nov 2023 0 repositories listed
-
Deep Reinforcement Learning Graphs: Feedback Motion Planning via Neural Lyapunov Verification29 Nov 2023 0 repositories listed
-
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective29 Nov 2023 0 repositories listed
-
LanGWM: Language Grounded World Model29 Nov 2023 0 repositories listed
-
Maximum Entropy Model Correction in Reinforcement Learning29 Nov 2023 0 repositories listed
-
Q-learning Based Optimal False Data Injection Attack on Probabilistic Boolean Control Networks29 Nov 2023 0 repositories listed
-
Stable Online and Offline Reinforcement Learning for Antibody CDRH3 Design29 Nov 2023 0 repositories listed
-
Two-Step Reinforcement Learning for Multistage Strategy Card Game29 Nov 2023 0 repositories listed
-
Digital Twin-Enhanced Deep Reinforcement Learning for Resource Management in Networks Slicing28 Nov 2023 0 repositories listed
-
Goal-conditioned Offline Planning from Curious Exploration28 Nov 2023 0 repositories listed
-
Safe Reinforcement Learning in a Simulated Robotic Arm28 Nov 2023 0 repositories listed
-
Optimal Observer Design Using Reinforcement Learning and Quadratic Neural Networks27 Nov 2023 0 repositories listed
-
Reinforcement Learning from Diffusion Feedback: Q* for Image Search27 Nov 2023 0 repositories listed
-
Value-Based Reinforcement Learning for Digital Twins in Cloud Computing27 Nov 2023 0 repositories listed
-
FRAC-Q-Learning: A Reinforcement Learning with Boredom Avoidance Processes for Social Robots26 Nov 2023 0 repositories listed
-
Where2Start: Leveraging initial States for Robust and Sample-Efficient Reinforcement Learning25 Nov 2023 0 repositories listed
-
Approximation of Convex Envelope Using Reinforcement Learning24 Nov 2023 0 repositories listed
-
Directly Attention Loss Adjusted Prioritized Experience Replay24 Nov 2023 0 repositories listed
-
Efficient Open-world Reinforcement Learning via Knowledge Distillation and Autonomous Rule Discovery24 Nov 2023 0 repositories listed
-
How to ensure a safe control strategy? Towards a SRL for urban transit autonomous operation24 Nov 2023 0 repositories listed
-
Multi-modal Instance Refinement for Cross-domain Action Recognition24 Nov 2023 0 repositories listed
-
Reinforcement Learning from Statistical Feedback: the Journey from AB Testing to ANT Testing24 Nov 2023 0 repositories listed
-
Guided Flows for Generative Modeling and Decision Making22 Nov 2023 0 repositories listed
-
Probabilistic Inference in Reinforcement Learning Done Right22 Nov 2023 0 repositories listed
-
Analyzing Behaviors of Mixed Traffic via Reinforcement Learning at Unsignalized Intersections21 Nov 2023 0 repositories listed
-
RLIF: Interactive Imitation Learning as Reinforcement Learning21 Nov 2023 0 repositories listed
-
ADAPTER-RL: Adaptation of Any Agent using Reinforcement Learning20 Nov 2023 0 repositories listed
-
Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning20 Nov 2023 0 repositories listed
-
Reinforcement Learning and Deep Stochastic Optimal Control for Final Quadratic Hedging20 Nov 2023 0 repositories listed
-
Multi-Timescale Control and Communications with Deep Reinforcement Learning -- Part II: Control-Aware Radio Resource Allocation19 Nov 2023 0 repositories listed
-
Offline Reinforcement Learning for Wireless Network Optimization with Mixture Datasets19 Nov 2023 0 repositories listed
-
Tactile Active Inference Reinforcement Learning for Efficient Robotic Manipulation Skill Acquisition19 Nov 2023 0 repositories listed
-
Benchmarking Feature Extractors for Reinforcement Learning-Based Semiconductor Defect Localization18 Nov 2023 0 repositories listed
-
Autonomous Port Navigation With Ranging Sensors Using Model-Based Reinforcement Learning17 Nov 2023 0 repositories listed
-
Towards a Standardized Reinforcement Learning Framework for AAM Contingency Management17 Nov 2023 0 repositories listed
-
Augmenting Unsupervised Reinforcement Learning with Self-Reference16 Nov 2023 0 repositories listed
-
Data-Driven LQR using Reinforcement Learning and Quadratic Neural Networks16 Nov 2023 0 repositories listed
-
Runtime Verification of Learning Properties for Reinforcement Learning Algorithms16 Nov 2023 0 repositories listed
-
Safety Aware Autonomous Path Planning Using Model Predictive Reinforcement Learning for Inland Waterways16 Nov 2023 0 repositories listed
-
Adversarial Attacks to Reward Machine-based Reinforcement Learning15 Nov 2023 0 repositories listed
-
An MRL-Based Design Solution for RIS-Assisted MU-MIMO Wireless System under Time-Varying Channels15 Nov 2023 0 repositories listed
-
Assessing the Robustness of Intelligence-Driven Reinforcement Learning15 Nov 2023 0 repositories listed
-
On the Foundation of Distributionally Robust Reinforcement Learning15 Nov 2023 0 repositories listed
-
Self-Supervised Curriculum Generation for Autonomous Reinforcement Learning without Task-Specific Knowledge15 Nov 2023 0 repositories listed
-
Supported Trust Region Optimization for Offline Reinforcement Learning15 Nov 2023 0 repositories listed
-
A Central Motor System Inspired Pre-training Reinforcement Learning for Robotic Control14 Nov 2023 0 repositories listed
-
Adversarial Imitation Learning On Aggregated Data14 Nov 2023 0 repositories listed
-
On-Policy Policy Gradient Reinforcement Learning Without On-Policy Sampling14 Nov 2023 0 repositories listed
-
When Mining Electric Locomotives Meet Reinforcement Learning14 Nov 2023 0 repositories listed
-
A Large Deviations Perspective on Policy Gradient Algorithms13 Nov 2023 0 repositories listed
-
An introduction to reinforcement learning for neuroscience13 Nov 2023 0 repositories listed
-
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning13 Nov 2023 0 repositories listed
-
TIAGo RL: Simulated Reinforcement Learning Environments with Tactile Data for Mobile Robots13 Nov 2023 0 repositories listed
-
Towards Continual Reinforcement Learning for Quadruped Robots12 Nov 2023 0 repositories listed
-
Out-of-Distribution-Aware Electric Vehicle Charging10 Nov 2023 0 repositories listed
-
Causal Inference on Investment Constraints and Non-stationarity in Dynamic Portfolio Optimization through Reinforcement Learning8 Nov 2023 0 repositories listed
-
Real-Time Recurrent Reinforcement Learning8 Nov 2023 0 repositories listed
-
Reinforcement Learning Generalization for Nonlinear Systems Through Dual-Scale Homogeneity Transformations8 Nov 2023 0 repositories listed
-
A Method to Improve the Performance of Reinforcement Learning Based on the Y Operator for a Class of Stochastic Differential Equation-Based Child-Mother Systems7 Nov 2023 0 repositories listed
-
A Novel Variational Lower Bound for Inverse Reinforcement Learning7 Nov 2023 0 repositories listed
-
Deep Bayesian Reinforcement Learning for Spacecraft Proximity Maneuvers and Docking7 Nov 2023 0 repositories listed
-
Estimator-Coupled Reinforcement Learning for Robust Purely Tactile In-Hand Manipulation7 Nov 2023 0 repositories listed
-
Hypothesis Network Planned Exploration for Rapid Meta-Reinforcement Learning Adaptation7 Nov 2023 0 repositories listed
-
Learning Decentralized Traffic Signal Controllers with Multi-Agent Graph Reinforcement Learning7 Nov 2023 0 repositories listed
-
Reinforcement Twinning: from digital twins to model-based reinforcement learning7 Nov 2023 0 repositories listed
-
Stable Modular Control via Contraction Theory for Reinforcement Learning7 Nov 2023 0 repositories listed
-
Time-Efficient Reinforcement Learning with Stochastic Stateful Policies7 Nov 2023 0 repositories listed
-
Environmental-Impact Based Multi-Agent Reinforcement Learning6 Nov 2023 0 repositories listed
-
Kindness in Multi-Agent Reinforcement Learning6 Nov 2023 0 repositories listed
-
CIRCLE: Multi-Turn Query Clarifications with Reinforcement Learning5 Nov 2023 0 repositories listed
-
Multi-objective Reinforcement Learning with Nonlinear Preferences: Provable Approximation for Maximizing Expected Scalarized Return5 Nov 2023 0 repositories listed
-
Staged Reinforcement Learning for Complex Tasks through Decomposed Environments5 Nov 2023 0 repositories listed
-
Accelerating Reinforcement Learning of Robotic Manipulations via Feedback from Large Language Models4 Nov 2023 0 repositories listed
-
DeliverAI: Reinforcement Learning Based Distributed Path-Sharing Network for Food Deliveries3 Nov 2023 0 repositories listed
-
Epidemic Decision-making System Based Federated Reinforcement Learning3 Nov 2023 0 repositories listed
-
Imitation Bootstrapped Reinforcement Learning3 Nov 2023 0 repositories listed
-
LLMs-augmented Contextual Bandit3 Nov 2023 0 repositories listed
-
Robust Adversarial Reinforcement Learning via Bounded Rationality Curricula3 Nov 2023 0 repositories listed
-
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning3 Nov 2023 0 repositories listed
-
Toward Reinforcement Learning-based Rectilinear Macro Placement Under Human Constraints3 Nov 2023 0 repositories listed
-
Anytime-Competitive Reinforcement Learning with Policy Prior2 Nov 2023 0 repositories listed
-
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing2 Nov 2023 0 repositories listed
-
Dynamic Fair Federated Learning Based on Reinforcement Learning2 Nov 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.