Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 56
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 56 of 152: papers 5,501 to 5,600 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Dynamic Optimization of Storage Systems Using Reinforcement Learning Techniques29 Dec 2024 0 repositories listed
-
Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey29 Dec 2024 0 repositories listed
-
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning29 Dec 2024 0 repositories listed
-
Election of Collaborators via Reinforcement Learning for Federated Brain Tumor Segmentation28 Dec 2024 0 repositories listed
-
Graph-attention-based Casual Discovery with Trust Region-navigated Clipping Policy Optimization27 Dec 2024 0 repositories listed
-
A Reinforcement Learning-Based Task Mapping Method to Improve the Reliability of Clustered Manycores26 Dec 2024 0 repositories listed
-
Minimal Batch Adaptive Learning Policy Engine for Real-Time Mid-Price Forecasting in High-Frequency Trading26 Dec 2024 0 repositories listed
-
Optimizing Fantasy Sports Team Selection with Deep Reinforcement Learning26 Dec 2024 0 repositories listed
-
Preventive Energy Management for Distribution Systems Under Uncertain Events: A Deep Reinforcement Learning Approach26 Dec 2024 0 repositories listed
-
Provably Efficient Exploration in Reward Machines with Low Regret26 Dec 2024 0 repositories listed
-
Improving Multi-Step Reasoning Abilities of Large Language Models with Direct Advantage Policy Optimization24 Dec 2024 0 repositories listed
-
Quantum framework for Reinforcement Learning: Integrating Markov decision process, quantum arithmetic, and trajectory search24 Dec 2024 0 repositories listed
-
Multimodal Deep Reinforcement Learning for Portfolio Optimization23 Dec 2024 0 repositories listed
-
Optimizing Prompt Strategies for SAM: Advancing lesion Segmentation Across Diverse Medical Imaging Modalities23 Dec 2024 0 repositories listed
-
Reinforcement Learning for Motor Control: A Comprehensive Review23 Dec 2024 0 repositories listed
-
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning22 Dec 2024 0 repositories listed
-
Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps22 Dec 2024 0 repositories listed
-
Environment Descriptions for Usability and Generalisation in Reinforcement Learning22 Dec 2024 0 repositories listed
-
Mathematics and Machine Creativity: A Survey on Bridging Mathematics with AI21 Dec 2024 0 repositories listed
-
On Enhancing Network Throughput using Reinforcement Learning in Sliced Testbeds21 Dec 2024 0 repositories listed
-
Subgoal Discovery Using a Free Energy Paradigm and State Aggregations21 Dec 2024 0 repositories listed
-
From General to Specific: Tailoring Large Language Models for Personalized Healthcare20 Dec 2024 0 repositories listed
-
Optimizing Low-Speed Autonomous Driving: A Reinforcement Learning Approach to Route Stability and Maximum Speed20 Dec 2024 0 repositories listed
-
VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving20 Dec 2024 0 repositories listed
-
AdaCred: Adaptive Causal Decision Transformers with Feature Crediting19 Dec 2024 0 repositories listed
-
Learning to Generate Research Idea with Dynamic Control19 Dec 2024 0 repositories listed
-
Simulation-Free Hierarchical Latent Policy Planning for Proactive Dialogues19 Dec 2024 0 repositories listed
-
Single-Loop Federated Actor-Critic across Heterogeneous Environments19 Dec 2024 0 repositories listed
-
Bayesian Critique-Tune-Based Reinforcement Learning with Adaptive Pressure for Multi-Intersection Traffic Signal Control18 Dec 2024 0 repositories listed
-
Harvesting energy from turbulent winds with Reinforcement Learning18 Dec 2024 0 repositories listed
-
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models18 Dec 2024 0 repositories listed
-
CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning17 Dec 2024 0 repositories listed
-
Design of Restricted Normalizing Flow towards Arbitrary Stochastic Policy with Computational Efficiency17 Dec 2024 0 repositories listed
-
Learning Visuotactile Estimation and Control for Non-prehensile Manipulation under Occlusions17 Dec 2024 0 repositories listed
-
Multi-Task Reinforcement Learning for Quadrotors17 Dec 2024 0 repositories listed
-
ParMod: A Parallel and Modular Framework for Learning Non-Markovian Tasks17 Dec 2024 0 repositories listed
-
16 Dec 2024 0 repositories listed Syntology 1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result (of 1 harvested sample) · 1 pointer-only (licence)
-
Equivariant Action Sampling for Reinforcement Learning and Planning16 Dec 2024 0 repositories listed
-
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization16 Dec 2024 0 repositories listed
-
MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning16 Dec 2024 0 repositories listed
-
Stabilizing Reinforcement Learning in Differentiable Multiphysics Simulation16 Dec 2024 0 repositories listed
-
Automated Driving with Evolution Capability: A Reinforcement Learning Method with Monotonic Performance Enhancement14 Dec 2024 0 repositories listed
-
Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach14 Dec 2024 0 repositories listed
-
Deep Reinforcement Learning for Scalable Multiagent Spacecraft Inspection13 Dec 2024 0 repositories listed
-
Physics Instrument Design with Reinforcement Learning13 Dec 2024 0 repositories listed
-
Reward Machine Inference for Robotic Manipulation13 Dec 2024 0 repositories listed
-
From Text to Trajectory: Exploring Complex Constraint Representation and Decomposition in Safe Reinforcement Learning12 Dec 2024 0 repositories listed
-
PickLLM: Context-Aware RL-Assisted Large Language Model Routing12 Dec 2024 0 repositories listed
-
Quantum-Train-Based Distributed Multi-Agent Reinforcement Learning12 Dec 2024 0 repositories listed
-
Radiology Report Generation via Multi-objective Preference Optimization12 Dec 2024 0 repositories listed
-
Reinforcement Learning Within the Classical Robotics Stack: A Case Study in Robot Soccer12 Dec 2024 0 repositories listed
-
Ask1: Development and Reinforcement Learning-Based Control of a Custom Quadruped Robot11 Dec 2024 0 repositories listed
-
Coarse-to-Fine: A Dual-Phase Channel-Adaptive Method for Wireless Image Transmission11 Dec 2024 0 repositories listed
-
Mobile-TeleVision: Predictive Motion Priors for Humanoid Whole-Body Control10 Dec 2024 0 repositories listed
-
Optimizing Sensor Redundancy in Sequential Decision-Making Problems10 Dec 2024 0 repositories listed
-
Preference Adaptive and Sequential Text-to-Image Generation10 Dec 2024 0 repositories listed
-
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning10 Dec 2024 0 repositories listed
-
Swarm Behavior Cloning10 Dec 2024 0 repositories listed
-
Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone9 Dec 2024 0 repositories listed
-
Skill-Enhanced Reinforcement Learning Acceleration from Demonstrations9 Dec 2024 0 repositories listed
-
Unraveling the Complexity of Memory in RL Agents: an Approach for Classification and Evaluation9 Dec 2024 0 repositories listed
-
Mean--Variance Portfolio Selection by Continuous-Time Reinforcement Learning: Algorithms, Regret Analysis, and Empirical Study8 Dec 2024 0 repositories listed
-
Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application8 Dec 2024 0 repositories listed
-
AI Planning: A Primer and Survey (Preliminary Report)7 Dec 2024 0 repositories listed
-
Learning Soft Driving Constraints from Vectorized Scene Embeddings while Imitating Expert Trajectories7 Dec 2024 0 repositories listed
-
RLZero: Direct Policy Inference from Language Without In-Domain Supervision7 Dec 2024 0 repositories listed
-
ELEMENT: Episodic and Lifelong Exploration via Maximum Entropy5 Dec 2024 0 repositories listed
-
Finer Behavioral Foundation Models via Auto-Regressive Features and Advantage Weighting5 Dec 2024 0 repositories listed
-
Traffic Co-Simulation Framework Empowered by Infrastructure Camera Sensing and Reinforcement Learning5 Dec 2024 0 repositories listed
-
Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning4 Dec 2024 0 repositories listed
-
Learning Whole-Body Loco-Manipulation for Omni-Directional Task Space Pose Tracking with a Wheeled-Quadrupedal-Manipulator4 Dec 2024 0 repositories listed
-
Using Deep Reinforcement Learning to Enhance Channel Sampling Patterns in Integrated Sensing and Communication4 Dec 2024 0 repositories listed
-
AI-Driven Resource Allocation Framework for Microservices in Hybrid Cloud Platforms3 Dec 2024 0 repositories listed
-
Generating Critical Scenarios for Testing Automated Driving Systems3 Dec 2024 0 repositories listed
-
Out-of-Distribution Detection for Neurosymbolic Autonomous Cyber Agents3 Dec 2024 0 repositories listed
-
Selective Reviews of Bandit Problems in AI via a Statistical View3 Dec 2024 0 repositories listed
-
Technical Report on Reinforcement Learning Control on the Lucas-Nülle Inverted Pendulum3 Dec 2024 0 repositories listed
-
A Memory-Based Reinforcement Learning Approach to Integrated Sensing and Communication2 Dec 2024 0 repositories listed
-
Dense Dynamics-Aware Reward Synthesis: Integrating Prior Experience with Demonstrations2 Dec 2024 0 repositories listed
-
Explore Reinforced: Equilibrium Approximation with Reinforcement Learning2 Dec 2024 0 repositories listed
-
RL2: Reinforce Large Language Model to Assist Safe Reinforcement Learning for Energy Management of Active Distribution Networks2 Dec 2024 0 repositories listed
-
Bilinear Convolution Decomposition for Causal RL Interpretability1 Dec 2024 0 repositories listed
-
Provable Partially Observable Reinforcement Learning with Privileged Information1 Dec 2024 0 repositories listed
-
30 Nov 2024 0 repositories listed Syntology 3 ran (of which 2 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 1 where Syntology's instrument failed) · 6 unverified (of 9 harvested samples) · 9 pointer-only (licence)
-
HVAC-DPT: A Decision Pretrained Transformer for HVAC Control29 Nov 2024 0 repositories listed
-
RL-MILP Solver: A Reinforcement Learning Approach for Solving Mixed-Integer Linear Programs with Graph Neural Networks29 Nov 2024 0 repositories listed
-
Solving Rubik's Cube Without Tricky Sampling29 Nov 2024 0 repositories listed
-
A Comprehensive Survey of Reinforcement Learning: From Algorithms to Practical Challenges28 Nov 2024 0 repositories listed
-
Convex Regularization and Convergence of Policy Gradient Flows under Safety Constraints28 Nov 2024 0 repositories listed
-
TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning28 Nov 2024 0 repositories listed
-
Dynamic Non-Prehensile Object Transport via Model-Predictive Reinforcement Learning27 Nov 2024 0 repositories listed
-
Dynamic Retail Pricing via Q-Learning -- A Reinforcement Learning Framework for Enhanced Revenue Management27 Nov 2024 0 repositories listed
-
ELEMENTAL: Interactive Learning from Demonstrations and Vision-Language Models for Reward Design in Robotics27 Nov 2024 0 repositories listed
-
NeoHebbian Synapses to Accelerate Online Training of Neuromorphic Hardware27 Nov 2024 0 repositories listed
-
ScaleViz: Scaling Visualization Recommendation Models on Large Data27 Nov 2024 0 repositories listed
-
Accelerating Proximal Policy Optimization Learning Using Task Prediction for Solving Environments with Delayed Rewards26 Nov 2024 0 repositories listed
-
Free²Guide: Gradient-Free Path Integral Control for Enhancing Text-to-Video Generation with Large Vision-Language Models26 Nov 2024 0 repositories listed
-
LLM-Based Offline Learning for Embodied Agents via Consistency-Guided Reward Ensemble26 Nov 2024 0 repositories listed
-
PROGRESSOR: A Perceptually Guided Reward Estimator with Self-Supervised Online Refinement26 Nov 2024 0 repositories listed
-
M3: Mamba-assisted Multi-Circuit Optimization via MBRL with Effective Scheduling25 Nov 2024 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.