Browse State-of-the-Art › reinforcement-learning › Papers, page 44
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 44 of 135: papers 4,301 to 4,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Explainable Reinforcement Learning Agents Using World Models12 May 2025 0 repositories listed
-
INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning12 May 2025 0 repositories listed
-
Multi-Objective Reinforcement Learning for Energy-Efficient Industrial Control12 May 2025 0 repositories listed
-
Multi-source Plume Tracing via Multi-Agent Reinforcement Learning12 May 2025 0 repositories listed
-
Online Episodic Convex Reinforcement Learning12 May 2025 0 repositories listed
-
S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models12 May 2025 0 repositories listed
-
Self Rewarding Self Improving12 May 2025 0 repositories listed
-
SEM: Reinforcement Learning for Search-Efficient Large Language Models12 May 2025 0 repositories listed
-
What Matters for Batch Online Reinforcement Learning in Robotics?12 May 2025 0 repositories listed
-
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach10 May 2025 0 repositories listed
-
Offline Multi-agent Reinforcement Learning via Score Decomposition9 May 2025 0 repositories listed
-
Morphologically Symmetric Reinforcement Learning for Ambidextrous Bimanual Manipulation8 May 2025 0 repositories listed
-
Multi-Objective Reinforcement Learning for Adaptive Personalized Autonomous Driving8 May 2025 0 repositories listed
-
On Corruption-Robustness in Performative Reinforcement Learning8 May 2025 0 repositories listed
-
Reasoning Models Don't Always Say What They Think8 May 2025 0 repositories listed
-
Reinforcement Learning for Game-Theoretic Resource Allocation on Graphs8 May 2025 0 repositories listed
-
Is there Value in Reinforcement Learning?7 May 2025 0 repositories listed
-
Optimization of Infectious Disease Intervention Measures Based on Reinforcement Learning - Empirical analysis based on UK COVID-19 epidemic data7 May 2025 0 repositories listed
-
Risk-sensitive Reinforcement Learning Based on Convex Scoring Functions7 May 2025 0 repositories listed
-
Trajectory Entropy Reinforcement Learning for Predictable and Robust Control7 May 2025 0 repositories listed
-
DYSTIL: Dynamic Strategy Induction with Large Language Models for Reinforcement Learning6 May 2025 0 repositories listed
-
Interpretable Learning Dynamics in Unsupervised Reinforcement Learning6 May 2025 0 repositories listed
-
Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning6 May 2025 0 repositories listed
-
Policy-labeled Preference Learning: Is Preference Enough for RLHF?6 May 2025 0 repositories listed
-
A Goal-Oriented Reinforcement Learning-Based Path Planning Algorithm for Modular Self-Reconfigurable Satellites4 May 2025 0 repositories listed
-
A Synergistic Framework of Nonlinear Acoustic Computing and Reinforcement Learning for Real-World Human-Robot Interaction4 May 2025 0 repositories listed
-
Training Environment for High Performance Reinforcement Learning4 May 2025 0 repositories listed
-
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning3 May 2025 0 repositories listed
-
Modeling Behavioral Preferences of Cyber Adversaries Using Inverse Reinforcement Learning2 May 2025 0 repositories listed
-
Skill-based Safe Reinforcement Learning with Risk Planning2 May 2025 0 repositories listed
-
Emergence of Roles in Robotic Teams with Model Sharing and Limited Communication1 May 2025 0 repositories listed
-
Intelligent Task Scheduling for Microservices via A3C-Based Reinforcement Learning1 May 2025 0 repositories listed
-
Reinforcement Learning with Continuous Actions Under Unmeasured Confounding1 May 2025 0 repositories listed
-
Variational OOD State Correction for Offline Reinforcement Learning1 May 2025 0 repositories listed
-
Intelligent Task Offloading in VANETs: A Hybrid AI-Driven Approach for Low-Latency and Energy Efficiency29 Apr 2025 0 repositories listed
-
Quantum-Enhanced Hybrid Reinforcement Learning Framework for Dynamic Path Planning in Autonomous Systems29 Apr 2025 0 repositories listed
-
AI Recommendation Systems for Lane-Changing Using Adherence-Aware Reinforcement Learning28 Apr 2025 0 repositories listed
-
Hierarchical Reinforcement Learning in Multi-Goal Spatial Navigation with Autonomous Mobile Robots26 Apr 2025 0 repositories listed
-
Foundations of Safe Online Reinforcement Learning in the Linear Quadratic Regulator: √(T)-Regret25 Apr 2025 0 repositories listed
-
Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning25 Apr 2025 0 repositories listed
-
High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures24 Apr 2025 0 repositories listed
-
Training Large Language Models to Reason via EM Policy Gradient24 Apr 2025 0 repositories listed
-
Anytime Safe Reinforcement Learning23 Apr 2025 0 repositories listed
-
Reinforcement learning framework for the mechanical design of microelectronic components under multiphysics constraints23 Apr 2025 0 repositories listed
-
Sparks of Tabular Reasoning via Text2SQL Reinforcement Learning23 Apr 2025 0 repositories listed
-
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning22 Apr 2025 0 repositories listed
-
SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning22 Apr 2025 0 repositories listed
-
SLiM-Gym: Reinforcement Learning for Population Genetics22 Apr 2025 0 repositories listed
-
LAPP: Large Language Model Feedback for Preference-Driven Reinforcement Learning21 Apr 2025 0 repositories listed
-
OTC: Optimal Tool Calls via Reinforcement Learning21 Apr 2025 0 repositories listed
-
Exposing the Copycat Problem of Imitation-based Planner: A Novel Closed-Loop Simulator, Causal Benchmark and Joint IL-RL Baseline20 Apr 2025 0 repositories listed
-
Reinforcement Learning from Multi-level and Episodic Human Feedback20 Apr 2025 0 repositories listed
-
Surrogate Fitness Metrics for Interpretable Reinforcement Learning20 Apr 2025 0 repositories listed
-
Optimal Lattice Boltzmann Closures through Multi-Agent Reinforcement Learning19 Apr 2025 0 repositories listed
-
Quantum-Enhanced Reinforcement Learning for Power Grid Security Assessment19 Apr 2025 0 repositories listed
-
Personalizing Exposure Therapy via Reinforcement Learning18 Apr 2025 0 repositories listed
-
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning17 Apr 2025 0 repositories listed
-
InstructRAG: Leveraging Retrieval-Augmented Generation on Instruction Graphs for LLM-Based Task Planning17 Apr 2025 0 repositories listed
-
Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis17 Apr 2025 0 repositories listed
-
Recursive Deep Inverse Reinforcement Learning17 Apr 2025 0 repositories listed
-
16 Apr 2025 0 repositories listed Syntology 10 ran (of which 9 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 1 where Syntology's instrument failed) · 4 unverified (of 14 harvested samples) · 14 pointer-only (licence)
-
Multi-Agent Reinforcement Learning for Greenhouse Gas Offset Credit Markets15 Apr 2025 0 repositories listed
-
Vision based driving agent for race car simulation environments14 Apr 2025 0 repositories listed
-
Efficient Implementation of Reinforcement Learning over Homomorphic Encryption12 Apr 2025 0 repositories listed
-
Towards More Efficient, Robust, Instance-adaptive, and Generalizable Sequential Decision making12 Apr 2025 0 repositories listed
-
Belief States for Cooperative Multi-Agent Reinforcement Learning under Partial Observability11 Apr 2025 0 repositories listed
-
Near-Driven Autonomous Rover Navigation in Complex Environments: Extensions to Urban Search-and-Rescue and Industrial Inspection11 Apr 2025 0 repositories listed
-
Reinforcement Learning-Driven Plant-Wide Refinery Planning Using Model Decomposition11 Apr 2025 0 repositories listed
-
A Framework of decision-relevant observability: Reinforcement Learning converges under relative ignorability10 Apr 2025 0 repositories listed
-
Rethinking the Foundations for Continual Reinforcement Learning10 Apr 2025 0 repositories listed
-
Seed1.5-Thinking: Advancing Superb Reasoning Models with Reinforcement Learning10 Apr 2025 0 repositories listed
-
Better Decisions through the Right Causal World Model9 Apr 2025 0 repositories listed
-
Regret Bounds for Robust Online Decision Making9 Apr 2025 0 repositories listed
-
Accelerating Vehicle Routing via AI-Initialized Genetic Algorithms8 Apr 2025 0 repositories listed
-
Smart Exploration in Reinforcement Learning using Bounded Uncertainty Models8 Apr 2025 0 repositories listed
-
TW-CRL: Time-Weighted Contrastive Reward Learning for Efficient Inverse Reinforcement Learning8 Apr 2025 0 repositories listed
-
Algorithm Discovery With LLMs: Evolutionary Search Meets Reinforcement Learning7 Apr 2025 0 repositories listed
-
Attention-Augmented Inverse Reinforcement Learning with Graph Convolutions for Multi-Agent Task Allocation7 Apr 2025 0 repositories listed
-
Ensuring Safety in an Uncertain Environment: Constrained MDPs via Stochastic Thresholds7 Apr 2025 0 repositories listed
-
Federated Hierarchical Reinforcement Learning for Adaptive Traffic Signal Control7 Apr 2025 0 repositories listed
-
HypRL: Reinforcement Learning of Control Policies for Hyperproperties7 Apr 2025 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Multiple Anesthetics Collaborative Control7 Apr 2025 0 repositories listed
-
Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use7 Apr 2025 0 repositories listed
-
The Role of Environment Access in Agnostic Reinforcement Learning7 Apr 2025 0 repositories listed
-
OrbitZoo: Multi-Agent Reinforcement Learning Environment for Orbital Dynamics5 Apr 2025 0 repositories listed
-
Enhanced Penalty-based Bidirectional Reinforcement Learning Algorithms4 Apr 2025 0 repositories listed
-
Improving Mixed-Criticality Scheduling with Reinforcement Learning4 Apr 2025 0 repositories listed
-
Learning Dual-Arm Coordination for Grasping Large Flat Objects4 Apr 2025 0 repositories listed
-
MORAL: A Multimodal Reinforcement Learning Framework for Decision Making in Autonomous Laboratories4 Apr 2025 0 repositories listed
-
Offline and Distributional Reinforcement Learning for Wireless Communications4 Apr 2025 0 repositories listed
-
Online Difficulty Filtering for Reasoning Oriented Reinforcement Learning4 Apr 2025 0 repositories listed
-
Optimizing Quantum Circuits via ZX Diagrams using Reinforcement Learning and Graph Neural Networks4 Apr 2025 0 repositories listed
-
LearNAT: Learning NL2SQL with AST-guided Task Decomposition for Large Language Models3 Apr 2025 0 repositories listed
-
SymDQN: Symbolic Knowledge and Reasoning in Neural Network-based Reinforcement Learning3 Apr 2025 0 repositories listed
-
Deep Graph Reinforcement Learning for UAV-Enabled Multi-User Secure Communications2 Apr 2025 0 repositories listed
-
Interpreting Emergent Planning in Model-Free Reinforcement Learning2 Apr 2025 0 repositories listed
-
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning2 Apr 2025 0 repositories listed
-
Reinforcement learning for robust dynamic metabolic control1 Apr 2025 0 repositories listed
-
Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains31 Mar 2025 0 repositories listed
-
Nuclear Microreactor Control with Deep Reinforcement Learning31 Mar 2025 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.