Browse State-of-the-Art › reinforcement-learning › Papers, page 64
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 64 of 135: papers 6,301 to 6,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reinforced Self-Training (ReST) for Language Modeling17 Aug 2023 0 repositories listed
-
Reinforcement Learning for Battery Management in Dairy Farming17 Aug 2023 0 repositories listed
-
ReProHRL: Towards Multi-Goal Navigation in the Real World using Hierarchical Agents17 Aug 2023 0 repositories listed
-
Eliciting Risk Aversion with Inverse Reinforcement Learning via Interactive Questioning16 Aug 2023 0 repositories listed
-
Integrating Renewable Energy in Agriculture: A Deep Reinforcement Learning-based Approach16 Aug 2023 0 repositories listed
-
Partially Observable Multi-Agent Reinforcement Learning with Information Sharing16 Aug 2023 0 repositories listed
-
Deep reinforcement learning for process design: Review and perspective15 Aug 2023 0 repositories listed
-
Distilling Knowledge from Resource Management Algorithms to Neural Networks: A Unified Training Assistance Approach15 Aug 2023 0 repositories listed
-
Generating Personas for Games with Multimodal Adversarial Imitation Learning15 Aug 2023 0 repositories listed
-
Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World15 Aug 2023 0 repositories listed
-
On-demand Cold Start Frequency Reduction with Off-Policy Reinforcement Learning in Serverless Computing15 Aug 2023 0 repositories listed
-
Insurance pricing on price comparison websites via reinforcement learning14 Aug 2023 0 repositories listed
-
InTune: Reinforcement Learning-based Data Pipeline Optimization for Deep Recommendation Models13 Aug 2023 0 repositories listed
-
A new solution and concrete implementation steps for Artificial General Intelligence12 Aug 2023 0 repositories listed
-
CyberForce: A Federated Reinforcement Learning Framework for Malware Mitigation11 Aug 2023 0 repositories listed
-
Learning Control Policies for Variable Objectives from Offline Data11 Aug 2023 0 repositories listed
-
Safeguarding Learning-based Control for Smart Energy Systems with Sampling Specifications11 Aug 2023 0 repositories listed
-
A Comparison of Classical and Deep Reinforcement Learning Methods for HVAC Control10 Aug 2023 0 repositories listed
-
Adversarial Deep Reinforcement Learning for Cyber Security in Software Defined Networks9 Aug 2023 0 repositories listed
-
Improving Autonomous Separation Assurance through Distributed Reinforcement Learning with Attention Networks9 Aug 2023 0 repositories listed
-
Characterization of Human Balance through a Reinforcement Learning-based Muscle Controller8 Aug 2023 0 repositories listed
-
Heterogeneous 360 Degree Videos in Metaverse: Differentiated Reinforcement Learning Approaches8 Aug 2023 0 repositories listed
-
Scope Loss for Imbalanced Classification and RL Exploration8 Aug 2023 0 repositories listed
-
Deep Q-Network for Stochastic Process Environments7 Aug 2023 0 repositories listed
-
Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations7 Aug 2023 0 repositories listed
-
Surrogate Empowered Sim2Real Transfer of Deep Reinforcement Learning for ORC Superheat Control5 Aug 2023 0 repositories listed
-
Learning Optimal Admission Control in Partially Observable Queueing Networks4 Aug 2023 0 repositories listed
-
Nonprehensile Planar Manipulation through Reinforcement Learning with Multimodal Categorical Exploration4 Aug 2023 0 repositories listed
-
Vehicles Control: Collision Avoidance using Federated Deep Reinforcement Learning4 Aug 2023 0 repositories listed
-
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback3 Aug 2023 0 repositories listed
-
Avoidance Navigation Based on Offline Pre-Training Reinforcement Learning3 Aug 2023 0 repositories listed
-
End-to-End Reinforcement Learning of Koopman Models for Economic Nonlinear Model Predictive Control3 Aug 2023 0 repositories listed
-
Investigating Reinforcement Learning for Communication Strategies in a Task-Initiative Setting3 Aug 2023 0 repositories listed
-
MARLIM: Multi-Agent Reinforcement Learning for Inventory Management3 Aug 2023 0 repositories listed
-
Quantum Multi-Agent Reinforcement Learning for Autonomous Mobility Cooperation3 Aug 2023 0 repositories listed
-
Controlling the Solo12 Quadruped Robot with Deep Reinforcement Learning2 Aug 2023 0 repositories listed
-
Revisiting a Design Choice in Gradient Temporal Difference Learning2 Aug 2023 0 repositories listed
-
Follow the Soldiers with Optimized Single-Shot Multibox Detection and Reinforcement Learning2 Aug 2023 0 repositories listed
-
Improving Generalization in Visual Reinforcement Learning via Conflict-aware Gradient Agreement Augmentation2 Aug 2023 0 repositories listed
-
Wasserstein Diversity-Enriched Regularizer for Hierarchical Reinforcement Learning2 Aug 2023 0 repositories listed
-
Pixel to policy: DQN Encoders for within & cross-game reinforcement learning1 Aug 2023 0 repositories listed
-
Target Search and Navigation in Heterogeneous Robot Systems with Deep Reinforcement Learning1 Aug 2023 0 repositories listed
-
Modulation-Enhanced Excitation for Continuous-Time Reinforcement Learning via Symmetric Kronecker Products31 Jul 2023 0 repositories listed
-
ESP: Exploiting Symmetry Prior for Multi-Agent Reinforcement Learning30 Jul 2023 0 repositories listed
-
Rating-based Reinforcement Learning30 Jul 2023 0 repositories listed
-
Robust Electric Vehicle Balancing of Autonomous Mobility-On-Demand System: A Multi-Agent Reinforcement Learning Approach30 Jul 2023 0 repositories listed
-
Dynamic deep-reinforcement-learning algorithm in Partially Observed Markov Decision Processes29 Jul 2023 0 repositories listed
-
Reinforcement Learning Under Probabilistic Spatio-Temporal Constraints with Time Windows29 Jul 2023 0 repositories listed
-
Dialogue Shaping: Empowering Agents through NPC Interaction28 Jul 2023 0 repositories listed
-
Primitive Skill-based Robot Learning from Human Evaluative Feedback28 Jul 2023 0 repositories listed
-
TrackAgent: 6D Object Tracking via Reinforcement Learning28 Jul 2023 0 repositories listed
-
An Ensemble Method of Deep Reinforcement Learning for Automated Cryptocurrency Trading27 Jul 2023 0 repositories listed
-
Evaluation of Safety Constraints in Autonomous Navigation with Deep Reinforcement Learning27 Jul 2023 0 repositories listed
-
Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback27 Jul 2023 0 repositories listed
-
Reinforcement learning guided fuzz testing for a browser's HTML rendering engine27 Jul 2023 0 repositories listed
-
Improving International Climate Policy via Mutually Conditional Binding Commitments26 Jul 2023 0 repositories listed
-
Integrating Offline Reinforcement Learning with Transformers for Sequential Recommendation26 Jul 2023 0 repositories listed
-
Reinforcement Learning by Guided Safe Exploration26 Jul 2023 0 repositories listed
-
Communication-Efficient Orchestrations for URLLC Service via Hierarchical Reinforcement Learning25 Jul 2023 0 repositories listed
-
Deep Reinforcement Learning for Robust Goal-Based Wealth Management25 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with On-Policy Q-Function Regularization25 Jul 2023 0 repositories listed
-
Safety Margins for Reinforcement Learning25 Jul 2023 0 repositories listed
-
Settling the Sample Complexity of Online Reinforcement Learning25 Jul 2023 0 repositories listed
-
Boosting Punctuation Restoration with Data Generation and Reinforcement Learning24 Jul 2023 0 repositories listed
-
Pilot Performance modeling via observer-based inverse reinforcement learning24 Jul 2023 0 repositories listed
-
Adversarial Agents For Attacking Inaudible Voice Activated Devices23 Jul 2023 0 repositories listed
-
Active Control of Flow over Rotating Cylinder by Multiple Jets using Deep Reinforcement Learning22 Jul 2023 0 repositories listed
-
DIP-RL: Demonstration-Inferred Preference Learning in Minecraft22 Jul 2023 0 repositories listed
-
Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations22 Jul 2023 0 repositories listed
-
On-Robot Bayesian Reinforcement Learning for POMDPs22 Jul 2023 0 repositories listed
-
Using Reinforcement Learning for the Three-Dimensional Loading Capacitated Vehicle Routing Problem22 Jul 2023 0 repositories listed
-
An Analysis of Multi-Agent Reinforcement Learning for Decentralized Inventory Control Systems21 Jul 2023 0 repositories listed
-
Deep Reinforcement Learning Based System for Intraoperative Hyperspectral Video Autofocusing21 Jul 2023 0 repositories listed
-
Towards practical reinforcement learning for tokamak magnetic control21 Jul 2023 0 repositories listed
-
A Definition of Continual Reinforcement Learning20 Jul 2023 0 repositories listed
-
An Adaptive Dual-level Reinforcement Learning Approach for Optimal Trade Execution20 Jul 2023 0 repositories listed
-
Goal-Conditioned Reinforcement Learning with Disentanglement-based Reachability Planning20 Jul 2023 0 repositories listed
-
On the Convergence of Bounded Agents20 Jul 2023 0 repositories listed
-
Reinforcement Learning for Credit Index Option Hedging19 Jul 2023 0 repositories listed
-
Robust Driving Policy Learning with Guided Meta Reinforcement Learning19 Jul 2023 0 repositories listed
-
Technical Challenges of Deploying Reinforcement Learning Agents for Game Testing in AAA Games19 Jul 2023 0 repositories listed
-
Continuous-Time Reinforcement Learning: New Design Algorithms with Theoretical Insights and Performance Guarantees18 Jul 2023 0 repositories listed
-
Control of Small Spacecraft by Optimal Output Regulation: A Reinforcement Learning Approach18 Jul 2023 0 repositories listed
-
Data Cross-Segmentation for Improved Generalization in Reinforcement Learning Based Algorithmic Trading18 Jul 2023 0 repositories listed
-
QMNet: Importance-Aware Message Exchange for Decentralized Multi-Agent Reinforcement Learning18 Jul 2023 0 repositories listed
-
A Multiobjective Reinforcement Learning Framework for Microgrid Energy Management17 Jul 2023 0 repositories listed
-
Can Euclidean Symmetry be Leveraged in Reinforcement Learning and Planning?17 Jul 2023 0 repositories listed
-
Non-Stationary Policy Learning for Multi-Timescale Multi-Agent Reinforcement Learning17 Jul 2023 0 repositories listed
-
Accelerating Cutting-Plane Algorithms via Reinforcement Learning Surrogates17 Jul 2023 0 repositories listed
-
Discovering User Types: Mapping User Traits by Task-Specific Behaviors in Reinforcement Learning16 Jul 2023 0 repositories listed
-
Magnetic Field-Based Reward Shaping for Goal-Conditioned Reinforcement Learning16 Jul 2023 0 repositories listed
-
AIOptimizer - Software performance optimisation prototype for cost minimisation15 Jul 2023 0 repositories listed
-
Combining model-predictive control and predictive reinforcement learning for stable quadrupedal robot locomotion15 Jul 2023 0 repositories listed
-
Efficient Action Robust Reinforcement Learning with Probabilistic Policy Execution Uncertainty15 Jul 2023 0 repositories listed
-
Efficient Adversarial Attacks on Online Multi-agent Reinforcement Learning15 Jul 2023 0 repositories listed
-
Seeing is not Believing: Robust Reinforcement Learning against Spurious Correlation15 Jul 2023 0 repositories listed
-
Hybrid Control Policy for Artificial Pancreas via Ensemble Deep Reinforcement Learning13 Jul 2023 0 repositories listed
-
Image Transformation Sequence Retrieval with General Reinforcement Learning13 Jul 2023 0 repositories listed
-
On the Effective Horizon of Inverse Reinforcement Learning13 Jul 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.