Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 53
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 53 of 152: papers 5,201 to 5,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
The Crucial Role of Problem Formulation in Real-World Reinforcement Learning26 Mar 2025 0 repositories listed
-
Think Twice: Enhancing LLM Reasoning by Scaling Multi-round Test-time Thinking25 Mar 2025 0 repositories listed
-
AED: Automatic Discovery of Effective and Diverse Vulnerabilities for Autonomous Driving Policy with Large Language Models24 Mar 2025 0 repositories listed
-
Evolutionary Policy Optimization24 Mar 2025 0 repositories listed
-
Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning24 Mar 2025 0 repositories listed
-
Parental Guidance: Efficient Lifelong Learning through Evolutionary Distillation24 Mar 2025 0 repositories listed
-
RLCAD: Reinforcement Learning Training Gym for Revolution Involved CAD Command Sequence Generation24 Mar 2025 0 repositories listed
-
Sample-Efficient Reinforcement Learning of Koopman eNMPC24 Mar 2025 0 repositories listed
-
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning24 Mar 2025 0 repositories listed
-
Adaptive Multi-Fidelity Reinforcement Learning for Variance Reduction in Engineering Design Optimization23 Mar 2025 0 repositories listed
-
Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization23 Mar 2025 0 repositories listed
-
Optimizing Navigation And Chemical Application in Precision Agriculture With Deep Reinforcement Learning And Conditional Action Tree23 Mar 2025 0 repositories listed
-
ViVa: Video-Trained Value Functions for Guiding Online RL from Diverse Data23 Mar 2025 0 repositories listed
-
A Roadmap Towards Improving Multi-Agent Reinforcement Learning With Causal Discovery And Inference22 Mar 2025 0 repositories listed
-
ComfyGPT: A Self-Optimizing Multi-Agent System for Comprehensive ComfyUI Workflow Generation22 Mar 2025 0 repositories listed
-
Transferable Latent-to-Latent Locomotion Policy for Efficient and Versatile Motion Control of Diverse Legged Robots22 Mar 2025 0 repositories listed
-
Autonomous Radiotherapy Treatment Planning Using DOLA: A Privacy-Preserving, LLM-Based Optimization Agent21 Mar 2025 0 repositories listed
-
Grammar and Gameplay-aligned RL for Game Description Generation with LLMs20 Mar 2025 0 repositories listed
-
OThink-MR1: Stimulating multimodal generalized reasoning capabilities via dynamic reinforcement learning20 Mar 2025 0 repositories listed
-
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models20 Mar 2025 0 repositories listed
-
Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models20 Mar 2025 0 repositories listed
-
UAS Visual Navigation in Large and Unseen Environments via a Meta Agent20 Mar 2025 0 repositories listed
-
1000 Layer Networks for Self-Supervised RL: Scaling Depth Can Enable New Goal-Reaching Capabilities19 Mar 2025 0 repositories listed
-
Behaviour Discovery and Attribution for Explainable Reinforcement Learning19 Mar 2025 0 repositories listed
-
Comprehensive Review of Reinforcement Learning for Medical Ultrasound Imaging19 Mar 2025 0 repositories listed
-
DeepMesh: Auto-Regressive Artist-mesh Creation with Reinforcement Learning19 Mar 2025 0 repositories listed
-
Empowering Medical Multi-Agents with Clinical Consultation Flow for Dynamic Diagnosis19 Mar 2025 0 repositories listed
-
Good Actions Succeed, Bad Actions Generalize: A Case Study on Why RL Generalizes Better19 Mar 2025 0 repositories listed
-
LogLLaMA: Transformer-based log anomaly detection with LLaMA19 Mar 2025 0 repositories listed
-
Reinforcement Learning Environment with LLM-Controlled Adversary in D&D 5th Edition Combat19 Mar 2025 0 repositories listed
-
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning19 Mar 2025 0 repositories listed
-
CTSAC: Curriculum-Based Transformer Soft Actor-Critic for Goal-Oriented Robot Exploration18 Mar 2025 0 repositories listed
-
Pauli Network Circuit Synthesis with Reinforcement Learning18 Mar 2025 0 repositories listed
-
Revealing higher-order neural representations of uncertainty with the Noise Estimation through Reinforcement-based Diffusion (NERD) model18 Mar 2025 0 repositories listed
-
A Reinforcement Learning-Driven Transformer GAN for Molecular Generation17 Mar 2025 0 repositories listed
-
APF+: Boosting adaptive-potential function reinforcement learning methods with a W-shaped network for high-dimensional games17 Mar 2025 0 repositories listed
-
FLEX: A Framework for Learning Robot-Agnostic Force-based Skills Involving Sustained Contact Object Manipulation17 Mar 2025 0 repositories listed
-
Synchronous vs Asynchronous Reinforcement Learning in a Real World Robot17 Mar 2025 0 repositories listed
-
Dynamic Angle Selection in X-Ray CT: A Reinforcement Learning Approach to Optimal Stopping16 Mar 2025 0 repositories listed
-
Evaluation-Time Policy Switching for Offline Reinforcement Learning15 Mar 2025 0 repositories listed
-
Adaptive Torque Control of Exoskeletons under Spasticity Conditions via Reinforcement Learning14 Mar 2025 0 repositories listed
-
Dynamic Obstacle Avoidance with Bounded Rationality Adversarial Reinforcement Learning14 Mar 2025 0 repositories listed
-
Exploring Competitive and Collusive Behaviors in Algorithmic Pricing with Deep Reinforcement Learning14 Mar 2025 0 repositories listed
-
Reinforcement Learning-Based Controlled Switching Approach for Inrush Current Minimization in Power Transformers14 Mar 2025 0 repositories listed
-
Sketch-to-Skill: Bootstrapping Robot Learning with Human Drawn Trajectory Sketches14 Mar 2025 0 repositories listed
-
DeepSeek-Inspired Exploration of RL-based LLMs and Synergy with Wireless Networks: A Survey13 Mar 2025 0 repositories listed
-
H2-MARL: Multi-Agent Reinforcement Learning for Pareto Optimality in Hospital Capacity Strain and Human Mobility during Epidemic13 Mar 2025 0 repositories listed
-
NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models13 Mar 2025 0 repositories listed
-
Representation-based Reward Modeling for Efficient Safety Alignment of Large Language Model13 Mar 2025 0 repositories listed
-
Safe Continual Domain Adaptation after Sim2Real Transfer of Reinforcement Learning Policies in Robotics13 Mar 2025 0 repositories listed
-
SortingEnv: An Extendable RL-Environment for an Industrial Sorting Process13 Mar 2025 0 repositories listed
-
SySLLM: Generating Synthesized Policy Summaries for Reinforcement Learning Agents Using Large Language Models13 Mar 2025 0 repositories listed
-
Edge AI-Powered Real-Time Decision-Making for Autonomous Vehicles in Adverse Weather Conditions12 Mar 2025 0 repositories listed
-
Evaluating Reinforcement Learning Safety and Trustworthiness in Cyber-Physical Systems12 Mar 2025 0 repositories listed
-
Large-scale Regional Traffic Signal Control Based on Single-Agent Reinforcement Learning12 Mar 2025 0 repositories listed
-
Local Look-Ahead Guidance via Verifier-in-the-Loop for Automated Theorem Proving12 Mar 2025 0 repositories listed
-
MarineGym: A High-Performance Reinforcement Learning Platform for Underwater Robotics12 Mar 2025 0 repositories listed
-
Optimisation of the Accelerator Control by Reinforcement Learning: A Simulation-Based Approach12 Mar 2025 0 repositories listed
-
Solving Bayesian inverse problems with diffusion priors and off-policy RL12 Mar 2025 0 repositories listed
-
Unified Locomotion Transformer with Simultaneous Sim-to-Real Transfer for Quadrupeds12 Mar 2025 0 repositories listed
-
A Cascading Cooperative Multi-agent Framework for On-ramp Merging Control Integrating Large Language Models11 Mar 2025 0 repositories listed
-
Balancing SoC in Battery Cells using Safe Action Perturbations11 Mar 2025 0 repositories listed
-
Disentangled World Models: Learning to Transfer Semantic Knowledge from Distracting Videos for Reinforcement Learning11 Mar 2025 0 repositories listed
-
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents11 Mar 2025 0 repositories listed
-
In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents11 Mar 2025 0 repositories listed
-
MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models11 Mar 2025 0 repositories listed
-
Near-Optimal Sample Complexity for Iterated CVaR Reinforcement Learning with a Generative Model11 Mar 2025 0 repositories listed
-
Zero-Shot Action Generalization with Limited Observations11 Mar 2025 0 repositories listed
-
Adaptive routing protocols for determining optimal paths in AI multi-agent systems: a priority- and learning-enhanced approach10 Mar 2025 0 repositories listed
-
Efficient Neural Clause-Selection Reinforcement10 Mar 2025 0 repositories listed
-
Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning10 Mar 2025 0 repositories listed
-
A Novel Multi-Objective Reinforcement Learning Algorithm for Pursuit-Evasion Game9 Mar 2025 0 repositories listed
-
Dynamic Load Balancing for EV Charging Stations Using Reinforcement Learning and Demand Prediction9 Mar 2025 0 repositories listed
-
GFlowVLM: Enhancing Multi-step Reasoning in Vision-Language Models with Generative Flow Networks9 Mar 2025 0 repositories listed
-
Probabilistic Shielding for Safe Reinforcement Learning9 Mar 2025 0 repositories listed
-
UAV-Assisted Coverage Hole Detection Using Reinforcement Learning in Urban Cellular Networks9 Mar 2025 0 repositories listed
-
Synergizing AI and Digital Twins for Next-Generation Network Optimization, Forecasting, and Security8 Mar 2025 0 repositories listed
-
ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning8 Mar 2025 0 repositories listed
-
Vairiational Stochastic Games8 Mar 2025 0 repositories listed
-
Generative Multi-Agent Q-Learning for Policy Optimization: Decentralized Wireless Networks7 Mar 2025 0 repositories listed
-
Guaranteeing Out-Of-Distribution Detection in Deep RL via Transition Estimation7 Mar 2025 0 repositories listed
-
Multi-Fidelity Policy Gradient Algorithms7 Mar 2025 0 repositories listed
-
Multi-Robot Collaboration through Reinforcement Learning and Abstract Simulation7 Mar 2025 0 repositories listed
-
Tractable Representations for Convergent Approximation of Distributional HJB Equations7 Mar 2025 0 repositories listed
-
Can We Optimize Deep RL Policy Weights as Trajectory Modeling?6 Mar 2025 0 repositories listed
-
Data-Efficient Learning from Human Interventions for Mobile Robots6 Mar 2025 0 repositories listed
-
Energy-Weighted Flow Matching for Offline Reinforcement Learning6 Mar 2025 0 repositories listed
-
Provably Correct Automata Embeddings for Optimal Automata-Conditioned Reinforcement Learning6 Mar 2025 0 repositories listed
-
Towards Autonomous Reinforcement Learning for Real-World Robotic Manipulation with Large Language Models6 Mar 2025 0 repositories listed
-
Rebalanced Multimodal Learning with Data-aware Unimodal Sampling5 Mar 2025 0 repositories listed
-
DreamerV3 for Traffic Signal Control: Hyperparameter Tuning and Performance4 Mar 2025 0 repositories listed
-
Quantitative Resilience Modeling for Autonomous Cyber Defense4 Mar 2025 0 repositories listed
-
Rewarding Doubt: A Reinforcement Learning Approach to Confidence Calibration of Large Language Models4 Mar 2025 0 repositories listed
-
Adversarial Agents: Black-Box Evasion Attacks with Reinforcement Learning3 Mar 2025 0 repositories listed
-
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation3 Mar 2025 0 repositories listed
-
Active Alignments of Lens Systems with Reinforcement Learning3 Mar 2025 0 repositories listed
-
All Roads Lead to Likelihood: The Value of Reinforcement Learning in Fine-Tuning3 Mar 2025 0 repositories listed
-
What's Behind PPO's Collapse in Long-CoT? Value Optimization Holds the Secret3 Mar 2025 0 repositories listed
-
Minimax Optimal Reinforcement Learning with Quasi-Optimism2 Mar 2025 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.