Browse State-of-the-Art › Reinforcement Learning › Papers, page 45
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 45 of 132: papers 4,401 to 4,500 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
AI Recommendation Systems for Lane-Changing Using Adherence-Aware Reinforcement Learning28 Apr 2025 0 repositories listed
-
Hierarchical Reinforcement Learning in Multi-Goal Spatial Navigation with Autonomous Mobile Robots26 Apr 2025 0 repositories listed
-
Foundations of Safe Online Reinforcement Learning in the Linear Quadratic Regulator: √(T)-Regret25 Apr 2025 0 repositories listed
-
Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning25 Apr 2025 0 repositories listed
-
High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures24 Apr 2025 0 repositories listed
-
Training Large Language Models to Reason via EM Policy Gradient24 Apr 2025 0 repositories listed
-
Anytime Safe Reinforcement Learning23 Apr 2025 0 repositories listed
-
Reinforcement learning framework for the mechanical design of microelectronic components under multiphysics constraints23 Apr 2025 0 repositories listed
-
Sparks of Tabular Reasoning via Text2SQL Reinforcement Learning23 Apr 2025 0 repositories listed
-
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning22 Apr 2025 0 repositories listed
-
SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning22 Apr 2025 0 repositories listed
-
SLiM-Gym: Reinforcement Learning for Population Genetics22 Apr 2025 0 repositories listed
-
LAPP: Large Language Model Feedback for Preference-Driven Reinforcement Learning21 Apr 2025 0 repositories listed
-
OTC: Optimal Tool Calls via Reinforcement Learning21 Apr 2025 0 repositories listed
-
Exposing the Copycat Problem of Imitation-based Planner: A Novel Closed-Loop Simulator, Causal Benchmark and Joint IL-RL Baseline20 Apr 2025 0 repositories listed
-
Reinforcement Learning from Multi-level and Episodic Human Feedback20 Apr 2025 0 repositories listed
-
Surrogate Fitness Metrics for Interpretable Reinforcement Learning20 Apr 2025 0 repositories listed
-
Optimal Lattice Boltzmann Closures through Multi-Agent Reinforcement Learning19 Apr 2025 0 repositories listed
-
Quantum-Enhanced Reinforcement Learning for Power Grid Security Assessment19 Apr 2025 0 repositories listed
-
Personalizing Exposure Therapy via Reinforcement Learning18 Apr 2025 0 repositories listed
-
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning17 Apr 2025 0 repositories listed
-
InstructRAG: Leveraging Retrieval-Augmented Generation on Instruction Graphs for LLM-Based Task Planning17 Apr 2025 0 repositories listed
-
Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis17 Apr 2025 0 repositories listed
-
Recursive Deep Inverse Reinforcement Learning17 Apr 2025 0 repositories listed
-
16 Apr 2025 0 repositories listed Syntology 10 ran (of which 9 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 1 where Syntology's instrument failed) · 4 unverified (of 14 harvested samples) · 14 pointer-only (licence)
-
Multi-Agent Reinforcement Learning for Greenhouse Gas Offset Credit Markets15 Apr 2025 0 repositories listed
-
Vision based driving agent for race car simulation environments14 Apr 2025 0 repositories listed
-
Efficient Implementation of Reinforcement Learning over Homomorphic Encryption12 Apr 2025 0 repositories listed
-
Towards More Efficient, Robust, Instance-adaptive, and Generalizable Sequential Decision making12 Apr 2025 0 repositories listed
-
Belief States for Cooperative Multi-Agent Reinforcement Learning under Partial Observability11 Apr 2025 0 repositories listed
-
Near-Driven Autonomous Rover Navigation in Complex Environments: Extensions to Urban Search-and-Rescue and Industrial Inspection11 Apr 2025 0 repositories listed
-
Reinforcement Learning-Driven Plant-Wide Refinery Planning Using Model Decomposition11 Apr 2025 0 repositories listed
-
A Framework of decision-relevant observability: Reinforcement Learning converges under relative ignorability10 Apr 2025 0 repositories listed
-
Rethinking the Foundations for Continual Reinforcement Learning10 Apr 2025 0 repositories listed
-
Seed1.5-Thinking: Advancing Superb Reasoning Models with Reinforcement Learning10 Apr 2025 0 repositories listed
-
Better Decisions through the Right Causal World Model9 Apr 2025 0 repositories listed
-
Regret Bounds for Robust Online Decision Making9 Apr 2025 0 repositories listed
-
Accelerating Vehicle Routing via AI-Initialized Genetic Algorithms8 Apr 2025 0 repositories listed
-
Smart Exploration in Reinforcement Learning using Bounded Uncertainty Models8 Apr 2025 0 repositories listed
-
TW-CRL: Time-Weighted Contrastive Reward Learning for Efficient Inverse Reinforcement Learning8 Apr 2025 0 repositories listed
-
Algorithm Discovery With LLMs: Evolutionary Search Meets Reinforcement Learning7 Apr 2025 0 repositories listed
-
Attention-Augmented Inverse Reinforcement Learning with Graph Convolutions for Multi-Agent Task Allocation7 Apr 2025 0 repositories listed
-
Ensuring Safety in an Uncertain Environment: Constrained MDPs via Stochastic Thresholds7 Apr 2025 0 repositories listed
-
Federated Hierarchical Reinforcement Learning for Adaptive Traffic Signal Control7 Apr 2025 0 repositories listed
-
HypRL: Reinforcement Learning of Control Policies for Hyperproperties7 Apr 2025 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Multiple Anesthetics Collaborative Control7 Apr 2025 0 repositories listed
-
Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use7 Apr 2025 0 repositories listed
-
The Role of Environment Access in Agnostic Reinforcement Learning7 Apr 2025 0 repositories listed
-
OrbitZoo: Multi-Agent Reinforcement Learning Environment for Orbital Dynamics5 Apr 2025 0 repositories listed
-
Enhanced Penalty-based Bidirectional Reinforcement Learning Algorithms4 Apr 2025 0 repositories listed
-
Improving Mixed-Criticality Scheduling with Reinforcement Learning4 Apr 2025 0 repositories listed
-
Learning Dual-Arm Coordination for Grasping Large Flat Objects4 Apr 2025 0 repositories listed
-
MORAL: A Multimodal Reinforcement Learning Framework for Decision Making in Autonomous Laboratories4 Apr 2025 0 repositories listed
-
Offline and Distributional Reinforcement Learning for Wireless Communications4 Apr 2025 0 repositories listed
-
Online Difficulty Filtering for Reasoning Oriented Reinforcement Learning4 Apr 2025 0 repositories listed
-
Optimizing Quantum Circuits via ZX Diagrams using Reinforcement Learning and Graph Neural Networks4 Apr 2025 0 repositories listed
-
LearNAT: Learning NL2SQL with AST-guided Task Decomposition for Large Language Models3 Apr 2025 0 repositories listed
-
SymDQN: Symbolic Knowledge and Reasoning in Neural Network-based Reinforcement Learning3 Apr 2025 0 repositories listed
-
Deep Graph Reinforcement Learning for UAV-Enabled Multi-User Secure Communications2 Apr 2025 0 repositories listed
-
Interpreting Emergent Planning in Model-Free Reinforcement Learning2 Apr 2025 0 repositories listed
-
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning2 Apr 2025 0 repositories listed
-
Reinforcement learning for robust dynamic metabolic control1 Apr 2025 0 repositories listed
-
Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains31 Mar 2025 0 repositories listed
-
Nuclear Microreactor Control with Deep Reinforcement Learning31 Mar 2025 0 repositories listed
-
Reinforcement Learning for Active Matter30 Mar 2025 0 repositories listed
-
Predictive Traffic Rule Compliance using Reinforcement Learning29 Mar 2025 0 repositories listed
-
RL2Grid: Benchmarking Reinforcement Learning in Power Grid Operations29 Mar 2025 0 repositories listed
-
CRLLK: Constrained Reinforcement Learning for Lane Keeping in Autonomous Driving28 Mar 2025 0 repositories listed
-
Entropy-guided sequence weighting for efficient exploration in RL-based LLM fine-tuning28 Mar 2025 0 repositories listed
-
Reinforcement learning for efficient and robust multi-setpoint and multi-trajectory tracking in bioprocesses28 Mar 2025 0 repositories listed
-
Reinforcement Learning for Machine Learning Model Deployment: Evaluating Multi-Armed Bandits in ML Ops Environments28 Mar 2025 0 repositories listed
-
RLDBF: Enhancing LLMs Via Reinforcement Learning With DataBase FeedBack28 Mar 2025 0 repositories listed
-
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation26 Mar 2025 0 repositories listed
-
Offline Reinforcement Learning with Discrete Diffusion Skills26 Mar 2025 0 repositories listed
-
Reasoning Beyond Limits: Advances and Open Problems for LLMs26 Mar 2025 0 repositories listed
-
State-Aware Perturbation Optimization for Robust Deep Reinforcement Learning26 Mar 2025 0 repositories listed
-
Synthesizing world models for bilevel planning26 Mar 2025 0 repositories listed
-
Abstracting Geo-specific Terrains to Scale Up Reinforcement Learning25 Mar 2025 0 repositories listed
-
Learning to chain-of-thought with Jensen's evidence lower bound25 Mar 2025 0 repositories listed
-
One Framework to Rule Them All: Unifying RL-Based and RL-Free Methods in RLHF25 Mar 2025 0 repositories listed
-
Adventurer: Exploration with BiGAN for Deep Reinforcement Learning24 Mar 2025 0 repositories listed
-
Finite-Time Bounds for Two-Time-Scale Stochastic Approximation with Arbitrary Norm Contractions and Markovian Noise24 Mar 2025 0 repositories listed
-
Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning24 Mar 2025 0 repositories listed
-
Sample-Efficient Reinforcement Learning of Koopman eNMPC24 Mar 2025 0 repositories listed
-
Iterative Multi-Agent Reinforcement Learning: A Novel Approach Toward Real-World Multi-Echelon Inventory Optimization23 Mar 2025 0 repositories listed
-
On The Sample Complexity Bounds In Bilevel Reinforcement Learning22 Mar 2025 0 repositories listed
-
Grammar and Gameplay-aligned RL for Game Description Generation with LLMs20 Mar 2025 0 repositories listed
-
Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models20 Mar 2025 0 repositories listed
-
UAS Visual Navigation in Large and Unseen Environments via a Meta Agent20 Mar 2025 0 repositories listed
-
Behaviour Discovery and Attribution for Explainable Reinforcement Learning19 Mar 2025 0 repositories listed
-
Comprehensive Review of Reinforcement Learning for Medical Ultrasound Imaging19 Mar 2025 0 repositories listed
-
DeepMesh: Auto-Regressive Artist-mesh Creation with Reinforcement Learning19 Mar 2025 0 repositories listed
-
Partially Observable Reinforcement Learning with Memory Traces19 Mar 2025 0 repositories listed
-
Reachable Sets-based Trajectory Planning Combining Reinforcement Learning and iLQR19 Mar 2025 0 repositories listed
-
StyleLoco: Generative Adversarial Distillation for Natural Humanoid Robot Locomotion19 Mar 2025 0 repositories listed
-
COLSON: Controllable Learning-Based Social Navigation via Diffusion-Based Reinforcement Learning18 Mar 2025 0 repositories listed
-
CTSAC: Curriculum-Based Transformer Soft Actor-Critic for Goal-Oriented Robot Exploration18 Mar 2025 0 repositories listed
-
Pauli Network Circuit Synthesis with Reinforcement Learning18 Mar 2025 0 repositories listed
-
A Reinforcement Learning-Driven Transformer GAN for Molecular Generation17 Mar 2025 0 repositories listed
-
Lifelong Reinforcement Learning with Similarity-Driven Weighting by Large Models17 Mar 2025 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.