Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 59
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 59 of 152: papers 5,801 to 5,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Sampling from Energy-based Policies using Diffusion2 Oct 2024 0 repositories listed
-
Scalable Reinforcement Learning-based Neural Architecture Search2 Oct 2024 0 repositories listed
-
Sparse Autoencoders Reveal Temporal Difference Learning in Large Language Models2 Oct 2024 0 repositories listed
-
Personalisation via Dynamic Policy Fusion30 Sep 2024 0 repositories listed
-
Upper and Lower Bounds for Distributionally Robust Off-Dynamics Reinforcement Learning30 Sep 2024 0 repositories listed
-
Analysis on Riemann Hypothesis with Cross Entropy Optimization and Reasoning29 Sep 2024 0 repositories listed
-
Focus On What Matters: Separated Models For Visual-Based RL Generalization29 Sep 2024 0 repositories listed
-
Grounded Curriculum Learning29 Sep 2024 0 repositories listed
-
Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization28 Sep 2024 0 repositories listed
-
Learning to Bridge the Gap: Efficient Novelty Recovery with Planning and Reinforcement Learning28 Sep 2024 0 repositories listed
-
Strongly-polynomial time and validation analysis of policy gradient methods28 Sep 2024 0 repositories listed
-
Cost-Aware Dynamic Cloud Workflow Scheduling using Self-Attention and Evolutionary Reinforcement Learning27 Sep 2024 0 repositories listed
-
Enhancing Spectrum Efficiency in 6G Satellite Networks: A GAIL-Powered Policy Learning via Asynchronous Federated Inverse Reinforcement Learning27 Sep 2024 0 repositories listed
-
TemporalPaD: a reinforcement-learning framework for temporal feature representation and dimension reduction27 Sep 2024 0 repositories listed
-
Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple Rewards26 Sep 2024 0 repositories listed
-
LoopSR: Looping Sim-and-Real for Lifelong Policy Adaptation of Legged Robots26 Sep 2024 0 repositories listed
-
Optimizing Downlink C-NOMA Transmission with Movable Antennas: A DDPG-based Approach26 Sep 2024 0 repositories listed
-
A random measure approach to reinforcement learning in continuous time25 Sep 2024 0 repositories listed
-
Asynchronous Fractional Multi-Agent Deep Reinforcement Learning for Age-Minimal Mobile Edge Computing25 Sep 2024 0 repositories listed
-
Learning with Dynamics: Autonomous Regulation of UAV Based Communication Networks with Dynamic UAV Crew25 Sep 2024 0 repositories listed
-
Offline and Distributional Reinforcement Learning for Radio Resource Management25 Sep 2024 0 repositories listed
-
OffRIPP: Offline RL-based Informative Path Planning25 Sep 2024 0 repositories listed
-
On-orbit Servicing for Spacecraft Collision Avoidance With Autonomous Decision Making25 Sep 2024 0 repositories listed
-
Revisiting Space Mission Planning: A Reinforcement Learning-Guided Approach for Multi-Debris Rendezvous25 Sep 2024 0 repositories listed
-
From Goal-Conditioned to Language-Conditioned Agents via Vision-Language Models24 Sep 2024 0 repositories listed
-
Development and Validation of Heparin Dosing Policies Using an Offline Reinforcement Learning Algorithm24 Sep 2024 0 repositories listed
-
Reinforcement Leaning for Infinite-Dimensional Systems24 Sep 2024 0 repositories listed
-
Whole-body End-Effector Pose Tracking24 Sep 2024 0 repositories listed
-
A novel agent with formal goal-reaching guarantees: an experimental study with a mobile robot23 Sep 2024 0 repositories listed
-
CANDERE-COACH: Reinforcement Learning from Noisy Feedback23 Sep 2024 0 repositories listed
-
Energy Saving in 6G O-RAN Using DQN-based xApp23 Sep 2024 0 repositories listed
-
Intelligent Routing Algorithm over SDN: Reusable Reinforcement Learning Approach23 Sep 2024 0 repositories listed
-
Physics Enhanced Residual Policy Learning (PERPL) for safety cruising in mixed traffic platooning under actuator and communication delay23 Sep 2024 0 repositories listed
-
A Distribution-Aware Flow-Matching for Generating Unstructured Data for Few-Shot Reinforcement Learning21 Sep 2024 0 repositories listed
-
MAGICS: Adversarial RL with Minimax Actors Guided by Implicit Critic Stackelberg for Convergent Neural Synthesis of Robot Safety20 Sep 2024 0 repositories listed
-
OMG-RL:Offline Model-based Guided Reward Learning for Heparin Treatment20 Sep 2024 0 repositories listed
-
Scalable Multi-agent Reinforcement Learning for Factory-wide Dynamic Scheduling20 Sep 2024 0 repositories listed
-
SoloParkour: Constrained Reinforcement Learning for Visual Locomotion from Privileged Experience20 Sep 2024 0 repositories listed
-
Assessing the Zero-Shot Capabilities of LLMs for Action Evaluation in RL19 Sep 2024 0 repositories listed
-
Disentangling Recognition and Decision Regrets in Image-Based Reinforcement Learning19 Sep 2024 0 repositories listed
-
TACO-RL: Task Aware Prompt Compression Optimization with Reinforcement Learning19 Sep 2024 0 repositories listed
-
The Central Role of the Loss Function in Reinforcement Learning19 Sep 2024 0 repositories listed
-
An Enhanced-State Reinforcement Learning Algorithm for Multi-Task Fusion in Large-Scale Recommender Systems18 Sep 2024 0 repositories listed
-
Data-Efficient Quadratic Q-Learning Using LMIs18 Sep 2024 0 repositories listed
-
IMRL: Integrating Visual, Physical, Temporal, and Geometric Representations for Enhanced Food Acquisition18 Sep 2024 0 repositories listed
-
Reinforcement Learning as an Improvement Heuristic for Real-World Production Scheduling18 Sep 2024 0 repositories listed
-
A Reinforcement Learning Environment for Automatic Code Optimization in the MLIR Compiler17 Sep 2024 0 repositories listed
-
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration17 Sep 2024 0 repositories listed
-
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning16 Sep 2024 0 repositories listed
-
Instigating Cooperation among LLM Agents Using Adaptive Information Modulation16 Sep 2024 0 repositories listed
-
Logic Synthesis Optimization with Predictive Self-Supervision via Causal Transformers16 Sep 2024 0 repositories listed
-
Mitigating Partial Observability in Adaptive Traffic Signal Control with Transformers16 Sep 2024 0 repositories listed
-
Safety-Oriented Pruning and Interpretation of Reinforcement Learning Policies16 Sep 2024 0 repositories listed
-
KAN v.s. MLP for Offline Reinforcement Learning15 Sep 2024 0 repositories listed
-
Mitigating Dimensionality in 2D Rectangle Packing Problem under Reinforcement Learning Schema15 Sep 2024 0 repositories listed
-
PIP-Loco: A Proprioceptive Infinite Horizon Planning Framework for Quadrupedal Robot Locomotion14 Sep 2024 0 repositories listed
-
Average-Reward Maximum Entropy Reinforcement Learning for Underactuated Double Pendulum Tasks13 Sep 2024 0 repositories listed
-
Batch Ensemble for Variance Dependent Regret in Stochastic Bandits13 Sep 2024 0 repositories listed
-
CPL: Critical Plan Step Learning Boosts LLM Generalization in Reasoning Tasks13 Sep 2024 0 repositories listed
-
Quasimetric Value Functions with Dense Rewards13 Sep 2024 0 repositories listed
-
Digital Twin for Autonomous Guided Vehicles based on Integrated Sensing and Communications12 Sep 2024 0 repositories listed
-
Hand-Object Interaction Pretraining from Videos12 Sep 2024 0 repositories listed
-
Optimal Management of Grid-Interactive Efficient Buildings via Safe Reinforcement Learning12 Sep 2024 0 repositories listed
-
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning12 Sep 2024 0 repositories listed
-
Learning Efficient Recursive Numeral Systems via Reinforcement Learning11 Sep 2024 0 repositories listed
-
Online Decision MetaMorphFormer: A Casual Transformer-Based Reinforcement Learning Framework of Universal Embodied Intelligence11 Sep 2024 0 repositories listed
-
Automated Data Augmentation for Few-Shot Time Series Forecasting: A Reinforcement Learning Approach Guided by a Model Zoo10 Sep 2024 0 repositories listed
-
Superior Computer Chess with Model Predictive Control, Reinforcement Learning, and Rollout10 Sep 2024 0 repositories listed
-
An Introduction to Quantum Reinforcement Learning (QRL)9 Sep 2024 0 repositories listed
-
BAMDP Shaping: a Unified Theoretical Framework for Intrinsic Motivation and Reward Shaping9 Sep 2024 0 repositories listed
-
BetterBodies: Reinforcement Learning guided Diffusion for Antibody Sequence Design9 Sep 2024 0 repositories listed
-
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies9 Sep 2024 0 repositories listed
-
Markov Chain Variance Estimation: A Stochastic Approximation Approach9 Sep 2024 0 repositories listed
-
Causality-Driven Reinforcement Learning for Joint Communication and Sensing7 Sep 2024 0 repositories listed
-
Reward Guidance for Reinforcement Learning Tasks Based on Large Language Models: The LMGT Framework7 Sep 2024 0 repositories listed
-
Reinforcement Learning-Based Adaptive Load Balancing for Dynamic Cloud Environments7 Sep 2024 0 repositories listed
-
Reinforcement Learning for Rate Maximization in IRS-aided OWC Networks7 Sep 2024 0 repositories listed
-
Reward-Directed Score-Based Diffusion Models via q-Learning7 Sep 2024 0 repositories listed
-
Sample and Oracle Efficient Reinforcement Learning for MDPs with Linearly-Realizable Value Functions7 Sep 2024 0 repositories listed
-
Gaussian-Mixture-Model Q-Functions for Reinforcement Learning by Riemannian Optimization6 Sep 2024 0 repositories listed
-
CHIRPs: Change-Induced Regret Proxy metrics for Lifelong Reinforcement Learning5 Sep 2024 0 repositories listed
-
Differentiable Discrete Event Simulation for Queuing Network Control5 Sep 2024 0 repositories listed
-
InfraLib: Enabling Reinforcement Learning and Decision-Making for Large-Scale Infrastructure Management5 Sep 2024 0 repositories listed
-
Reinforcement Learning Approach to Optimizing Profilometric Sensor Trajectories for Surface Inspection5 Sep 2024 0 repositories listed
-
Robust synchronization and policy adaptation for networked heterogeneous agents5 Sep 2024 0 repositories listed
-
Enhancing Information Freshness: An AoI Optimized Markov Decision Process Dedicated In the Underwater Task4 Sep 2024 0 repositories listed
-
Large Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement Learning4 Sep 2024 0 repositories listed
-
Tractable Offline Learning of Regular Decision Processes4 Sep 2024 0 repositories listed
-
Reinforcement Learning-enabled Satellite Constellation Reconfiguration and Retasking for Mission-Critical Applications3 Sep 2024 0 repositories listed
-
State and Action Factorization in Power Grids3 Sep 2024 0 repositories listed
-
Grounding Language Models in Autonomous Loco-manipulation Tasks2 Sep 2024 0 repositories listed
-
Foundations of Multivariate Distributional Reinforcement Learning31 Aug 2024 0 repositories listed
-
Robust off-policy Reinforcement Learning via Soft Constrained Adversary31 Aug 2024 0 repositories listed
-
Discovery of False Data Injection Schemes on Frequency Controllers with Reinforcement Learning30 Aug 2024 0 repositories listed
-
AdapShare: An RL-Based Dynamic Spectrum Sharing Solution for O-RAN29 Aug 2024 0 repositories listed
-
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes29 Aug 2024 0 repositories listed
-
Reinforcement Learning for Adaptive Traffic Signal Control: Turn-Based and Time-Based Approaches to Reduce Congestion28 Aug 2024 0 repositories listed
-
Atari-GPT: Benchmarking Multimodal Large Language Models as Low-Level Policies in Atari Games28 Aug 2024 0 repositories listed
-
Skills Regularized Task Decomposition for Multi-task Offline Reinforcement Learning28 Aug 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.