Browse State-of-the-Art › reinforcement-learning › Papers, page 54
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 54 of 135: papers 5,301 to 5,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Generative AI for Deep Reinforcement Learning: Framework, Analysis, and Use Cases31 May 2024 0 repositories listed
-
Reinforcement Learning for Sociohydrology31 May 2024 0 repositories listed
-
Bilevel reinforcement learning via the development of hyper-gradient without lower-level convexity30 May 2024 0 repositories listed
-
Dynamic feature selection in medical predictive monitoring by reinforcement learning30 May 2024 0 repositories listed
-
Efficient Stimuli Generation using Reinforcement Learning in Design Verification30 May 2024 0 repositories listed
-
Hybrid Reinforcement Learning Framework for Mixed-Variable Problems30 May 2024 0 repositories listed
-
Learning from Random Demonstrations: Offline Reinforcement Learning with Importance-Sampled Diffusion Models30 May 2024 0 repositories listed
-
MetaCURL: Non-stationary Concave Utility Reinforcement Learning30 May 2024 0 repositories listed
-
Q-learning as a monotone scheme30 May 2024 0 repositories listed
-
Randomized Exploration for Reinforcement Learning with Multinomial Logistic Function Approximation30 May 2024 0 repositories listed
-
Safe Multi-agent Reinforcement Learning with Natural Language Constraints30 May 2024 0 repositories listed
-
SleeperNets: Universal Backdoor Poisoning Attacks Against Reinforcement Learning Agents30 May 2024 0 repositories listed
-
Policy Zooming: Adaptive Discretization-based Infinite-Horizon Average-Reward Reinforcement Learning29 May 2024 0 repositories listed
-
Advancing Household Robotics: Deep Interactive Reinforcement Learning for Efficient Training and Enhanced Performance29 May 2024 0 repositories listed
-
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation29 May 2024 0 repositories listed
-
Inverse Concave-Utility Reinforcement Learning is Inverse Game Theory29 May 2024 0 repositories listed
-
Offline Regularised Reinforcement Learning for Large Language Models Alignment29 May 2024 0 repositories listed
-
Optimizing Vehicular Networks with Variational Quantum Circuits-based Reinforcement Learning29 May 2024 0 repositories listed
-
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning29 May 2024 0 repositories listed
-
Rich-Observation Reinforcement Learning with Continuous Latent Dynamics29 May 2024 0 repositories listed
-
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees29 May 2024 0 repositories listed
-
Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF29 May 2024 0 repositories listed
-
Why Reinforcement Learning in Energy Systems Needs Explanations29 May 2024 0 repositories listed
-
A Pontryagin Perspective on Reinforcement Learning28 May 2024 0 repositories listed
-
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation28 May 2024 0 repositories listed
-
Highway Reinforcement Learning28 May 2024 0 repositories listed
-
Mutation-Bias Learning in Games28 May 2024 0 repositories listed
-
Biological Neurons Compete with Deep Reinforcement Learning in Sample Efficiency in a Simulated Gameworld27 May 2024 0 repositories listed
-
Opinion-Guided Reinforcement Learning27 May 2024 0 repositories listed
-
Oracle-Efficient Reinforcement Learning for Max Value Ensembles27 May 2024 0 repositories listed
-
Partial Models for Building Adaptive Model-Based Reinforcement Learning Agents27 May 2024 0 repositories listed
-
Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation27 May 2024 0 repositories listed
-
Reinforcement Learning Based Escape Route Generation in Low Visibility Environments27 May 2024 0 repositories listed
-
A CMDP-within-online framework for Meta-Safe Reinforcement Learning26 May 2024 0 repositories listed
-
Amortized Active Causal Induction with Deep Reinforcement Learning26 May 2024 0 repositories listed
-
Make Safe Decisions in Power System: Safe Reinforcement Learning Based Pre-decision Making for Voltage Stability Emergency Control26 May 2024 0 repositories listed
-
Fast TRAC: A Parameter-Free Optimizer for Lifelong Reinforcement Learning26 May 2024 0 repositories listed
-
Reinforcement Learning for Jump-Diffusions, with Financial Applications26 May 2024 0 repositories listed
-
RLSF: Reinforcement Learning via Symbolic Feedback26 May 2024 0 repositories listed
-
Dynamic Inhomogeneous Quantum Resource Scheduling with Reinforcement Learning25 May 2024 0 repositories listed
-
Theoretical Study of Conflict-Avoidant Multi-Objective Reinforcement Learning25 May 2024 0 repositories listed
-
Cooperative Backdoor Attack in Decentralized Reinforcement Learning with Theoretical Guarantee24 May 2024 0 repositories listed
-
Counterexample-Guided Repair of Reinforcement Learning Systems Using Safety Critics24 May 2024 0 repositories listed
-
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning24 May 2024 0 repositories listed
-
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning24 May 2024 0 repositories listed
-
Learning Generalizable Human Motion Generator with Reinforcement Learning24 May 2024 0 repositories listed
-
Momentum-Based Federated Reinforcement Learning with Interaction and Communication Efficiency24 May 2024 0 repositories listed
-
TrojanForge: Generating Adversarial Hardware Trojan Examples Using Reinforcement Learning24 May 2024 0 repositories listed
-
A finite time analysis of distributed Q-learning23 May 2024 0 repositories listed
-
Deep Reinforcement Learning for 5*5 Multiplayer Go23 May 2024 0 repositories listed
-
Deterministic Policies for Constrained Reinforcement Learning in Polynomial Time23 May 2024 0 repositories listed
-
Direct Preference Optimization With Unobserved Preference Heterogeneity23 May 2024 0 repositories listed
-
Exclusively Penalized Q-learning for Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Privileged Sensing Scaffolds Reinforcement Learning23 May 2024 0 repositories listed
-
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models23 May 2024 0 repositories listed
-
State-Constrained Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Almost sure convergence rates of stochastic gradient methods under gradient domination22 May 2024 0 repositories listed
-
ConcertoRL: An Innovative Time-Interleaved Reinforcement Learning Approach for Enhanced Control in Direct-Drive Tandem-Wing Vehicles22 May 2024 0 repositories listed
-
Dynamic Model Predictive Shielding for Provably Safe Reinforcement Learning22 May 2024 0 repositories listed
-
Optimizing Search Advertising Strategies: Integrating Reinforcement Learning with Generalized Second-Price Auctions for Enhanced Ad Ranking and Bidding22 May 2024 0 repositories listed
-
Traffic control using intelligent timing of traffic lights with reinforcement learning technique and real-time processing of surveillance camera images22 May 2024 0 repositories listed
-
Transformers Learn Temporal Difference Methods for In-Context Reinforcement Learning22 May 2024 0 repositories listed
-
Deep Reinforcement Learning for Time-Critical Wilderness Search And Rescue Using Drones21 May 2024 0 repositories listed
-
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback20 May 2024 0 repositories listed
-
Continual Deep Reinforcement Learning for Decentralized Satellite Routing20 May 2024 0 repositories listed
-
Reward-Punishment Reinforcement Learning with Maximum Entropy20 May 2024 0 repositories listed
-
Comparisons Are All You Need for Optimizing Smooth Functions19 May 2024 0 repositories listed
-
Deep Dive into Model-free Reinforcement Learning for Biological and Robotic Systems: Theory and Practice19 May 2024 0 repositories listed
-
Do No Harm: A Counterfactual Approach to Safe Reinforcement Learning19 May 2024 0 repositories listed
-
Enhancing Vehicle Aerodynamics with Deep Reinforcement Learning in Voxelised Models19 May 2024 0 repositories listed
-
Exploiting Distributional Value Functions for Financial Market Valuation, Enhanced Feature Creation and Improvement of Trading Algorithms19 May 2024 0 repositories listed
-
Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities17 May 2024 0 repositories listed
-
LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions17 May 2024 0 repositories listed
-
Sample-Efficient Constrained Reinforcement Learning with General Parameterization17 May 2024 0 repositories listed
-
Time-Varying Constraint-Aware Reinforcement Learning for Energy Storage Control17 May 2024 0 repositories listed
-
Chaos-based reinforcement learning with TD315 May 2024 0 repositories listed
-
Detecting Continuous Integration Skip : A Reinforcement Learning-based Approach15 May 2024 0 repositories listed
-
Fully Distributed Fog Load Balancing with Multi-Agent Reinforcement Learning15 May 2024 0 repositories listed
-
Hierarchical Resource Partitioning on Modern GPUs: A Reinforcement Learning Approach14 May 2024 0 repositories listed
-
I-CTRL: Imitation to Control Humanoid Robots Through Constrained Reinforcement Learning14 May 2024 0 repositories listed
-
Optimizing Deep Reinforcement Learning for American Put Option Hedging14 May 2024 0 repositories listed
-
Python-Based Reinforcement Learning on Simulink Models14 May 2024 0 repositories listed
-
Safety Constrained Multi-Agent Reinforcement Learning for Active Voltage Control14 May 2024 0 repositories listed
-
Stable Inverse Reinforcement Learning: Policies from Control Lyapunov Landscapes14 May 2024 0 repositories listed
-
Hamiltonian-based Quantum Reinforcement Learning for Neural Combinatorial Optimization13 May 2024 0 repositories listed
-
Neural Network Compression for Reinforcement Learning Tasks13 May 2024 0 repositories listed
-
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning13 May 2024 0 repositories listed
-
Reducing Risk for Assistive Reinforcement Learning Policies with Diffusion Models13 May 2024 0 repositories listed
-
Structured Reinforcement Learning for Incentivized Stochastic Covert Optimization13 May 2024 0 repositories listed
-
On-Demand Model and Client Deployment in Federated Learning with Deep Reinforcement Learning12 May 2024 0 repositories listed
-
Auditing an Automatic Grading Model with deep Reinforcement Learning11 May 2024 0 repositories listed
-
Fairness in Reinforcement Learning: A Survey11 May 2024 0 repositories listed
-
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning10 May 2024 0 repositories listed
-
Hedging American Put Options with Deep Reinforcement Learning10 May 2024 0 repositories listed
-
An Overview of Machine Learning-Enabled Optimization for Reconfigurable Intelligent Surfaces-Aided 6G Networks: From Reinforcement Learning to Large Language Models9 May 2024 0 repositories listed
-
Conversational Topic Recommendation in Counseling and Psychotherapy with Decision Transformer and Large Language Models8 May 2024 0 repositories listed
-
Fast Stochastic Policy Gradient: Negative Momentum for Reinforcement Learning8 May 2024 0 repositories listed
-
Markowitz Meets Bellman: Knowledge-distilled Reinforcement Learning for Portfolio Management8 May 2024 0 repositories listed
-
Model-Free Robust φ-Divergence Reinforcement Learning Using Both Offline and Online Data8 May 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.