Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 64
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 64 of 152: papers 6,301 to 6,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Uncertainty-aware Distributional Offline Reinforcement Learning26 Mar 2024 0 repositories listed
-
Outcome-Constrained Large Language Models for Countering Hate Speech25 Mar 2024 0 repositories listed
-
Policy Optimization finds Nash Equilibrium in Regularized General-Sum LQ Games25 Mar 2024 0 repositories listed
-
Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling25 Mar 2024 0 repositories listed
-
Semantic-Aware Remote Estimation of Multiple Markov Sources Under Constraints25 Mar 2024 0 repositories listed
-
Planning with a Learned Policy Basis to Optimally Solve Complex Tasks22 Mar 2024 0 repositories listed
-
Constrained Reinforcement Learning with Smoothed Log Barrier Function21 Mar 2024 0 repositories listed
-
Distilling Reinforcement Learning Policies for Interpretable Robot Locomotion: Gradient Boosting Machines and Symbolic Regression21 Mar 2024 0 repositories listed
-
Heuristic Algorithm-based Action Masking Reinforcement Learning (HAAM-RL) with Ensemble Inference Method21 Mar 2024 0 repositories listed
-
Task-optimal data-driven surrogate models for eNMPC via differentiable simulation and optimization21 Mar 2024 0 repositories listed
-
Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning20 Mar 2024 0 repositories listed
-
Reinforcement Learning for Online Testing of Autonomous Driving Systems: a Replication and Extension Study20 Mar 2024 0 repositories listed
-
Safety-Aware Reinforcement Learning for Electric Vehicle Charging Station Management in Distribution Network20 Mar 2024 0 repositories listed
-
Fast Value Tracking for Deep Reinforcement Learning19 Mar 2024 0 repositories listed
-
Sample Complexity of Offline Distributionally Robust Linear Markov Decision Processes19 Mar 2024 0 repositories listed
-
Bootstrapping Reinforcement Learning with Imitation for Vision-Based Agile Flight18 Mar 2024 0 repositories listed
-
Distill2Explain: Differentiable decision trees for explainable reinforcement learning in energy application controllers18 Mar 2024 0 repositories listed
-
EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents18 Mar 2024 0 repositories listed
-
Offline Multitask Representation Learning for Reinforcement Learning18 Mar 2024 0 repositories listed
-
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data18 Mar 2024 0 repositories listed
-
Reinforcement Learning with Generalizable Gaussian Splatting18 Mar 2024 0 repositories listed
-
State-Separated SARSA: A Practical Sequential Decision-Making Algorithm with Recovering Rewards18 Mar 2024 0 repositories listed
-
The Value of Reward Lookahead in Reinforcement Learning18 Mar 2024 0 repositories listed
-
Causality from Bottom to Top: A Survey17 Mar 2024 0 repositories listed
-
Independent RL for Cooperative-Competitive Agents: A Mean-Field Perspective17 Mar 2024 0 repositories listed
-
Prior-dependent analysis of posterior sampling reinforcement learning with function approximation17 Mar 2024 0 repositories listed
-
Distributed Multi-Objective Dynamic Offloading Scheduling for Air-Ground Cooperative MEC16 Mar 2024 0 repositories listed
-
Neural-Kernel Conditional Mean Embeddings16 Mar 2024 0 repositories listed
-
The Fallacy of Minimizing Cumulative Regret in the Sequential Task Setting16 Mar 2024 0 repositories listed
-
ViSaRL: Visual Reinforcement Learning Guided by Human Saliency16 Mar 2024 0 repositories listed
-
Horizon-Free Regret for Linear Markov Decision Processes15 Mar 2024 0 repositories listed
-
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning14 Mar 2024 0 repositories listed
-
HRLAIF: Improvements in Helpfulness and Harmlessness in Open-domain Reinforcement Learning From AI Feedback13 Mar 2024 0 repositories listed
-
Meta-operators for Enabling Parallel Planning Using Deep Reinforcement Learning13 Mar 2024 0 repositories listed
-
Multi-Objective Optimization Using Adaptive Distributed Reinforcement Learning13 Mar 2024 0 repositories listed
-
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis13 Mar 2024 0 repositories listed
-
Acquiring Diverse Skills using Curriculum Reinforcement Learning with Mixture of Experts11 Mar 2024 0 repositories listed
-
Advancing Text-Driven Chest X-Ray Generation with Policy-Based Reinforcement Learning11 Mar 2024 0 repositories listed
-
CoRAL: Collaborative Retrieval-Augmented Large Language Models Improve Long-tail Recommendation11 Mar 2024 0 repositories listed
-
ε-Neural Thompson Sampling of Deep Brain Stimulation for Parkinson Disease Treatment11 Mar 2024 0 repositories listed
-
In-context Exploration-Exploitation for Reinforcement Learning11 Mar 2024 0 repositories listed
-
(N,K)-Puzzle: A Cost-Efficient Testbed for Benchmarking Reinforcement Learning Algorithms in Generative Language Model11 Mar 2024 0 repositories listed
-
RLingua: Improving Reinforcement Learning Sample Efficiency in Robotic Manipulations With Large Language Models11 Mar 2024 0 repositories listed
-
Unveiling the Significance of Toddler-Inspired Reward Transition in Goal-Oriented Reinforcement Learning11 Mar 2024 0 repositories listed
-
Distributional Successor Features Enable Zero-Shot Policy Optimization10 Mar 2024 0 repositories listed
-
Enhancing Classification Performance via Reinforcement Learning for Feature Selection9 Mar 2024 0 repositories listed
-
Enhancing Multi-Hop Knowledge Graph Reasoning through Reward Shaping Techniques9 Mar 2024 0 repositories listed
-
PEaRL: Personalized Privacy of Human-Centric Systems using Early-Exit Reinforcement Learning9 Mar 2024 0 repositories listed
-
Towards Optimizing Human-Centric Objectives in AI-Assisted Decision-Making With Offline Reinforcement Learning9 Mar 2024 0 repositories listed
-
Inverse Design of Photonic Crystal Surface Emitting Lasers is a Sequence Modeling Problem8 Mar 2024 0 repositories listed
-
Simulating Battery-Powered TinyML Systems Optimised using Reinforcement Learning in Image-Based Anomaly Detection8 Mar 2024 0 repositories listed
-
Switching the Loss Reduces the Cost in Batch Reinforcement Learning8 Mar 2024 0 repositories listed
-
A Natural Extension To Online Algorithms For Hybrid RL With Limited Coverage7 Mar 2024 0 repositories listed
-
Learning Human-to-Humanoid Real-Time Whole-Body Teleoperation7 Mar 2024 0 repositories listed
-
Noisy Spiking Actor Network for Exploration7 Mar 2024 0 repositories listed
-
Proxy-RLHF: Decoupling Generation and Alignment in Large Language Model with Proxy7 Mar 2024 0 repositories listed
-
RL-CFR: Improving Action Abstraction for Imperfect Information Extensive-Form Games with Reinforcement Learning7 Mar 2024 0 repositories listed
-
Why Online Reinforcement Learning is Causal7 Mar 2024 0 repositories listed
-
Dexterous Legged Locomotion in Confined 3D Spaces with Reinforcement Learning6 Mar 2024 0 repositories listed
-
Stop Regressing: Training Value Functions via Classification for Scalable Deep RL6 Mar 2024 0 repositories listed
-
Language Guided Exploration for RL Agents in Text Environments5 Mar 2024 0 repositories listed
-
Iterated Q-Network: Beyond One-Step Bellman Updates in Deep Reinforcement Learning4 Mar 2024 0 repositories listed
-
Koopman-Assisted Reinforcement Learning4 Mar 2024 0 repositories listed
-
Twisting Lids Off with Two Hands4 Mar 2024 0 repositories listed
-
Sample Efficient Myopic Exploration Through Multitask Reinforcement Learning with Diverse Tasks3 Mar 2024 0 repositories listed
-
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey2 Mar 2024 0 repositories listed
-
Overestimation, Overfitting, and Plasticity in Actor-Critic: the Bitter Lesson of Reinforcement Learning1 Mar 2024 0 repositories listed
-
Robust Policy Learning via Offline Skill Diffusion1 Mar 2024 0 repositories listed
-
Robustifying a Policy in Multi-Agent RL with Diverse Cooperative Behaviors and Adversarial Style Sampling for Assistive Tasks1 Mar 2024 0 repositories listed
-
Conflict-Averse Gradient Aggregation for Constrained Multi-Objective Reinforcement Learning1 Mar 2024 0 repositories listed
-
Investigating Gender Fairness in Machine Learning-driven Personalized Care for Chronic Pain29 Feb 2024 0 repositories listed
-
Offline Fictitious Self-Play for Competitive Games29 Feb 2024 0 repositories listed
-
RL-GPT: Integrating Reinforcement Learning and Code-as-policy29 Feb 2024 0 repositories listed
-
Provable Risk-Sensitive Distributional Reinforcement Learning with General Function Approximation28 Feb 2024 0 repositories listed
-
Reinforcement Learning and Graph Neural Networks for Probabilistic Risk Assessment28 Feb 2024 0 repositories listed
-
Learning to Program Variational Quantum Circuits with Fast Weights27 Feb 2024 0 repositories listed
-
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning27 Feb 2024 0 repositories listed
-
C-GAIL: Stabilizing Generative Adversarial Imitation Learning with Control Theory26 Feb 2024 0 repositories listed
-
Monitoring Fidelity of Online Reinforcement Learning Algorithms in Clinical Trials26 Feb 2024 0 repositories listed
-
QF-tuner: Breaking Tradition in Reinforcement Learning26 Feb 2024 0 repositories listed
-
Reinforcement Learning Based Oscillation Dampening: Scaling up Single-Agent RL algorithms to a 100 AV highway field operational test26 Feb 2024 0 repositories listed
-
Concurrent Learning of Policy and Unknown Safety Constraints in Reinforcement Learning24 Feb 2024 0 repositories listed
-
AltGraph: Redesigning Quantum Circuits Using Generative Graph Models for Efficient Optimization23 Feb 2024 0 repositories listed
-
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning23 Feb 2024 0 repositories listed
-
Trajectory-wise Iterative Reinforcement Learning Framework for Auto-bidding23 Feb 2024 0 repositories listed
-
Automated Design and Optimization of Distributed Filtering Circuits via Reinforcement Learning22 Feb 2024 0 repositories listed
-
Reinforcement Learning with Elastic Time Steps22 Feb 2024 0 repositories listed
-
AttackGNN: Red-Teaming GNNs in Hardware Security Using Reinforcement Learning21 Feb 2024 0 repositories listed
-
Improving a Proportional Integral Controller with Reinforcement Learning on a Throttle Valve Benchmark21 Feb 2024 0 repositories listed
-
Learning Dual-arm Object Rearrangement for Cartesian Robots21 Feb 2024 0 repositories listed
-
Reinforcement learning-assisted quantum architecture search for variational quantum algorithms21 Feb 2024 0 repositories listed
-
Uniform Last-Iterate Guarantee for Bandits and Reinforcement Learning20 Feb 2024 0 repositories listed
-
Align Your Intents: Offline Imitation Learning via Optimal Transport20 Feb 2024 0 repositories listed
-
Antifragile Perimeter Control: Anticipating and Gaining from Disruptions with Reinforcement Learning20 Feb 2024 0 repositories listed
-
Deep Hedging with Market Impact20 Feb 2024 0 repositories listed
-
Offline Multi-task Transfer RL with Representational Penalization19 Feb 2024 0 repositories listed
-
Self-evolving Autoencoder Embedded Q-Network18 Feb 2024 0 repositories listed
-
Programmatic Reinforcement Learning: Navigating Gridworlds18 Feb 2024 0 repositories listed
-
SINR-Aware Deep Reinforcement Learning for Distributed Dynamic Channel Allocation in Cognitive Interference Networks17 Feb 2024 0 repositories listed
-
Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation15 Feb 2024 0 repositories listed