Browse State-of-the-Art › Reinforcement Learning › Papers, page 65
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 65 of 132: papers 6,401 to 6,500 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Multi-Agent Reinforcement Learning for Network Routing in Integrated Access Backhaul Networks12 May 2023 0 repositories listed
-
12 May 2023 0 repositories listed Syntology 1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result (of 1 harvested sample) · 1 pointer-only (licence)
-
Deep Reinforcement Learning for Interference Management in UAV-based 3D Networks: Potentials and Challenges11 May 2023 0 repositories listed
-
Optimizing Memory Mapping Using Deep Reinforcement Learning11 May 2023 0 repositories listed
-
Towards Theoretical Understanding of Data-Driven Policy Refinement11 May 2023 0 repositories listed
-
A proof of convergence of inverse reinforcement learning for multi-objective optimization10 May 2023 0 repositories listed
-
An Option-Dependent Analysis of Regret Minimization Algorithms in Finite-Horizon Semi-Markov Decision Processes10 May 2023 0 repositories listed
-
Discovery of Optimal Quantum Error Correcting Codes via Reinforcement Learning10 May 2023 0 repositories listed
-
Mixture of personality improved Spiking actor network for efficient multi-agent cooperation10 May 2023 0 repositories listed
-
Supplementing Gradient-Based Reinforcement Learning with Simple Evolutionary Ideas10 May 2023 0 repositories listed
-
Fine-tuning Language Models with Generative Adversarial Reward Modelling9 May 2023 0 repositories listed
-
RLocator: Reinforcement Learning for Bug Localization9 May 2023 0 repositories listed
-
Goal-oriented inference of environment from redundant observations8 May 2023 0 repositories listed
-
Truncating Trajectories in Monte Carlo Reinforcement Learning7 May 2023 0 repositories listed
-
A Survey on Offline Model-Based Reinforcement Learning5 May 2023 0 repositories listed
-
Bayesian Reinforcement Learning with Limited Cognitive Load5 May 2023 0 repositories listed
-
Reinforcement Learning for Control of Evolutionary and Ecological Processes5 May 2023 0 repositories listed
-
Improving Real-Time Bidding in Online Advertising Using Markov Decision Processes and Machine Learning Techniques5 May 2023 0 repositories listed
-
Maximum Causal Entropy Inverse Constrained Reinforcement Learning4 May 2023 0 repositories listed
-
Reinforcement Learning with Delayed, Composite, and Partially Anonymous Reward4 May 2023 0 repositories listed
-
Rethinking Population-assisted Off-policy Reinforcement Learning4 May 2023 0 repositories listed
-
Gym-preCICE: Reinforcement Learning Environments for Active Flow Control3 May 2023 0 repositories listed
-
Human Machine Co-adaption Interface via Cooperation Markov Decision Process System3 May 2023 0 repositories listed
-
A Transfer Learning Approach to Minimize Reinforcement Learning Risks in Energy Optimization for Smart Buildings30 Apr 2023 0 repositories listed
-
SRL-Assisted AFM: Generating Planar Unstructured Quadrilateral Meshes with Supervised and Reinforcement Learning-Assisted Advancing Front Method30 Apr 2023 0 repositories listed
-
Meta-Reinforcement Learning Based on Self-Supervised Task Representation Learning29 Apr 2023 0 repositories listed
-
Systematic Review on Reinforcement Learning in the Field of Fintech29 Apr 2023 0 repositories listed
-
A Federated Reinforcement Learning Framework for Link Activation in Multi-link Wi-Fi Networks28 Apr 2023 0 repositories listed
-
Active Reinforcement Learning for Personalized Stress Monitoring in Everyday Settings28 Apr 2023 0 repositories listed
-
Adversarial Policy Optimization in Deep Reinforcement Learning27 Apr 2023 0 repositories listed
-
Exploring the flavor structure of quarks and leptons with reinforcement learning27 Apr 2023 0 repositories listed
-
One-Step Distributional Reinforcement Learning27 Apr 2023 0 repositories listed
-
Multi-criteria Hardware Trojan Detection: A Reinforcement Learning Approach26 Apr 2023 0 repositories listed
-
Reinforcement Learning with Partial Parametric Model Knowledge26 Apr 2023 0 repositories listed
-
Fulfilling Formal Specifications ASAP by Model-free Reinforcement Learning25 Apr 2023 0 repositories listed
-
Loss- and Reward-Weighting for Efficient Distributed Reinforcement Learning25 Apr 2023 0 repositories listed
-
Model Extraction Attacks Against Reinforcement Learning Based Controllers25 Apr 2023 0 repositories listed
-
SEA: A Spatially Explicit Architecture for Multi-Agent Reinforcement Learning25 Apr 2023 0 repositories listed
-
Towards Theoretical Understanding of Inverse Reinforcement Learning25 Apr 2023 0 repositories listed
-
Efficient Halftoning via Deep Reinforcement Learning24 Apr 2023 0 repositories listed
-
Instance-Optimality in Interactive Decision Making: Toward a Non-Asymptotic Theory24 Apr 2023 0 repositories listed
-
Parallel bootstrap-based on-policy deep reinforcement learning for continuous flow control applications24 Apr 2023 0 repositories listed
-
Policy Resilience to Environment Poisoning Attacks on Reinforcement Learning24 Apr 2023 0 repositories listed
-
Reinforcement Learning with Knowledge Representation and Reasoning: A Brief Survey24 Apr 2023 0 repositories listed
-
Reinforcement Learning with an Abrupt Model Change22 Apr 2023 0 repositories listed
-
A Cubic-regularized Policy Newton Algorithm for Reinforcement Learning21 Apr 2023 0 repositories listed
-
Learning Robust, Agile, Natural Legged Locomotion Skills in the Wild21 Apr 2023 0 repositories listed
-
Aiding reinforcement learning for set point control20 Apr 2023 0 repositories listed
-
Interpretability for Conditional Coordinated Behavior in Multi-Agent Reinforcement Learning20 Apr 2023 0 repositories listed
-
Observer-Feedback-Feedforward Controller Structures in Reinforcement Learning20 Apr 2023 0 repositories listed
-
Robust nonlinear set-point control with reinforcement learning20 Apr 2023 0 repositories listed
-
Topological Guided Actor-Critic Modular Learning of Continuous Systems with Temporal Objectives20 Apr 2023 0 repositories listed
-
Two-Memory Reinforcement Learning20 Apr 2023 0 repositories listed
-
Long-Term Fairness with Unknown Dynamics19 Apr 2023 0 repositories listed
-
Model Based Reinforcement Learning for Personalized Heparin Dosing19 Apr 2023 0 repositories listed
-
Quantum deep Q learning with distributed prioritized experience replay19 Apr 2023 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning for Inventory Management18 Apr 2023 0 repositories listed
-
Feasible Policy Iteration for Safe Reinforcement Learning18 Apr 2023 0 repositories listed
-
Finite-Sample Bounds for Adaptive Inverse Reinforcement Learning using Passive Langevin Dynamics18 Apr 2023 0 repositories listed
-
Provably Feedback-Efficient Reinforcement Learning via Active Reward Learning18 Apr 2023 0 repositories listed
-
Searching for ribbons with machine learning18 Apr 2023 0 repositories listed
-
A study on a Q-Learning algorithm application to a manufacturing assembly problem17 Apr 2023 0 repositories listed
-
Alzheimers Disease Diagnosis using Machine Learning: A Review17 Apr 2023 0 repositories listed
-
Causal Decision Transformer for Recommender Systems via Offline Reinforcement Learning17 Apr 2023 0 repositories listed
-
Deep Explainable Relational Reinforcement Learning: A Neuro-Symbolic Approach17 Apr 2023 0 repositories listed
-
Integration of Reinforcement Learning Based Behavior Planning With Sampling Based Motion Planning for Automated Driving17 Apr 2023 0 repositories listed
-
Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations17 Apr 2023 0 repositories listed
-
Car-Following Models: A Multidisciplinary Review14 Apr 2023 0 repositories listed
-
Minimax-Optimal Reward-Agnostic Exploration in Reinforcement Learning14 Apr 2023 0 repositories listed
-
Deep reinforcement learning applied to an assembly sequence planning problem with user preferences13 Apr 2023 0 repositories listed
-
Model-based Dynamic Shielding for Safe and Efficient Multi-Agent Reinforcement Learning13 Apr 2023 0 repositories listed
-
Exploiting Symmetry and Heuristic Demonstrations in Off-policy Reinforcement Learning for Robotic Manipulation12 Apr 2023 0 repositories listed
-
A Tale of Sampling and Estimation in Discounted Reinforcement Learning11 Apr 2023 0 repositories listed
-
Reinforcement Learning Tutor Better Supported Lower Performers in a Math Task11 Apr 2023 0 repositories listed
-
DREAM: Adaptive Reinforcement Learning based on Attention Mechanism for Temporal Knowledge Graph Reasoning8 Apr 2023 0 repositories listed
-
A modular framework for stabilizing deep reinforcement learning control7 Apr 2023 0 repositories listed
-
CRISP: Curriculum Inducing Primitive Informed Subgoal Prediction for Hierarchical Reinforcement Learning7 Apr 2023 0 repositories listed
-
Deep Reinforcement Learning Based Optimal Infinite-Horizon Control of Probabilistic Boolean Control Networks7 Apr 2023 0 repositories listed
-
Full Gradient Deep Reinforcement Learning for Average-Reward Criterion7 Apr 2023 0 repositories listed
-
Decision-Focused Model-based Reinforcement Learning for Reward Transfer6 Apr 2023 0 repositories listed
-
Constrained Exploration in Reinforcement Learning with Optimality Preservation5 Apr 2023 0 repositories listed
-
Off-Policy Action Anticipation in Multi-Agent Reinforcement Learning4 Apr 2023 0 repositories listed
-
Optimizing Irrigation Efficiency using Deep Reinforcement Learning in the Field4 Apr 2023 0 repositories listed
-
Regularization of the policy updates for stabilizing Mean Field Games4 Apr 2023 0 repositories listed
-
Risk-Aware Distributed Multi-Agent Reinforcement Learning4 Apr 2023 0 repositories listed
-
A Tutorial Introduction to Reinforcement Learning3 Apr 2023 0 repositories listed
-
Action Pick-up in Dynamic Action Space Reinforcement Learning3 Apr 2023 0 repositories listed
-
Empirical Design in Reinforcement Learning3 Apr 2023 0 repositories listed
-
Quantitative Trading using Deep Q Learning3 Apr 2023 0 repositories listed
-
Risk-Sensitive and Robust Model-Based Reinforcement Learning and Planning2 Apr 2023 0 repositories listed
-
Mastering Pair Trading with Risk-Aware Recurrent Reinforcement Learning1 Apr 2023 0 repositories listed
-
Multi-Microgrid Collaborative Optimization Scheduling Using an Improved Multi-Agent Soft Actor-Critic Algorithm1 Apr 2023 0 repositories listed
-
Selective Reincarnation: Offline-to-Online Multi-Agent Reinforcement Learning31 Mar 2023 0 repositories listed
-
Learning Complicated Manipulation Skills via Deterministic Policy with Limited Demonstrations29 Mar 2023 0 repositories listed
-
Physical Deep Reinforcement Learning Towards Safety Guarantee29 Mar 2023 0 repositories listed
-
Quantum Deep Hedging29 Mar 2023 0 repositories listed
-
BC-IRL: Learning Generalizable Reward Functions from Demonstrations28 Mar 2023 0 repositories listed
-
Bi-Manual Block Assembly via Sim-to-Real Reinforcement Learning27 Mar 2023 0 repositories listed
-
Exploring Novel Quality Diversity Methods For Generalization in Reinforcement Learning26 Mar 2023 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.