Browse State-of-the-Art › reinforcement-learning › Papers, page 68
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 68 of 135: papers 6,701 to 6,800 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Federated Deep Reinforcement Learning for THz-Beam Search with Limited CSI25 Apr 2023 0 repositories listed
-
Fulfilling Formal Specifications ASAP by Model-free Reinforcement Learning25 Apr 2023 0 repositories listed
-
Loss- and Reward-Weighting for Efficient Distributed Reinforcement Learning25 Apr 2023 0 repositories listed
-
Model Extraction Attacks Against Reinforcement Learning Based Controllers25 Apr 2023 0 repositories listed
-
SEA: A Spatially Explicit Architecture for Multi-Agent Reinforcement Learning25 Apr 2023 0 repositories listed
-
Towards Theoretical Understanding of Inverse Reinforcement Learning25 Apr 2023 0 repositories listed
-
Efficient Halftoning via Deep Reinforcement Learning24 Apr 2023 0 repositories listed
-
Instance-Optimality in Interactive Decision Making: Toward a Non-Asymptotic Theory24 Apr 2023 0 repositories listed
-
Parallel bootstrap-based on-policy deep reinforcement learning for continuous flow control applications24 Apr 2023 0 repositories listed
-
Policy Resilience to Environment Poisoning Attacks on Reinforcement Learning24 Apr 2023 0 repositories listed
-
Reinforcement Learning with Knowledge Representation and Reasoning: A Brief Survey24 Apr 2023 0 repositories listed
-
Bridging Declarative, Procedural, and Conditional Metacognitive Knowledge Gap Using Deep Reinforcement Learning23 Apr 2023 0 repositories listed
-
Reinforcement Learning with an Abrupt Model Change22 Apr 2023 0 repositories listed
-
A Cubic-regularized Policy Newton Algorithm for Reinforcement Learning21 Apr 2023 0 repositories listed
-
Learning Robust, Agile, Natural Legged Locomotion Skills in the Wild21 Apr 2023 0 repositories listed
-
Aiding reinforcement learning for set point control20 Apr 2023 0 repositories listed
-
Interpretability for Conditional Coordinated Behavior in Multi-Agent Reinforcement Learning20 Apr 2023 0 repositories listed
-
Mastering Asymmetrical Multiplayer Game with Multi-Agent Asymmetric-Evolution Reinforcement Learning20 Apr 2023 0 repositories listed
-
Observer-Feedback-Feedforward Controller Structures in Reinforcement Learning20 Apr 2023 0 repositories listed
-
Reinforcement Learning for Picking Cluttered General Objects with Dense Object Descriptors20 Apr 2023 0 repositories listed
-
Robust nonlinear set-point control with reinforcement learning20 Apr 2023 0 repositories listed
-
Topological Guided Actor-Critic Modular Learning of Continuous Systems with Temporal Objectives20 Apr 2023 0 repositories listed
-
Two-Memory Reinforcement Learning20 Apr 2023 0 repositories listed
-
Autonomous Agent for Beyond Visual Range Air Combat: A Deep Reinforcement Learning Approach19 Apr 2023 0 repositories listed
-
End-to-End Policy Gradient Method for POMDPs and Explainable Agents19 Apr 2023 0 repositories listed
-
Long-Term Fairness with Unknown Dynamics19 Apr 2023 0 repositories listed
-
Model Based Reinforcement Learning for Personalized Heparin Dosing19 Apr 2023 0 repositories listed
-
Quantum deep Q learning with distributed prioritized experience replay19 Apr 2023 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning for Inventory Management18 Apr 2023 0 repositories listed
-
Feasible Policy Iteration for Safe Reinforcement Learning18 Apr 2023 0 repositories listed
-
Finite-Sample Bounds for Adaptive Inverse Reinforcement Learning using Passive Langevin Dynamics18 Apr 2023 0 repositories listed
-
Provably Feedback-Efficient Reinforcement Learning via Active Reward Learning18 Apr 2023 0 repositories listed
-
Searching for ribbons with machine learning18 Apr 2023 0 repositories listed
-
A study on a Q-Learning algorithm application to a manufacturing assembly problem17 Apr 2023 0 repositories listed
-
Alzheimers Disease Diagnosis using Machine Learning: A Review17 Apr 2023 0 repositories listed
-
Causal Decision Transformer for Recommender Systems via Offline Reinforcement Learning17 Apr 2023 0 repositories listed
-
Deep Explainable Relational Reinforcement Learning: A Neuro-Symbolic Approach17 Apr 2023 0 repositories listed
-
Integration of Reinforcement Learning Based Behavior Planning With Sampling Based Motion Planning for Automated Driving17 Apr 2023 0 repositories listed
-
Leveraging Deep Reinforcement Learning for Metacognitive Interventions across Intelligent Tutoring Systems17 Apr 2023 0 repositories listed
-
MDDL: A Framework for Reinforcement Learning-based Position Allocation in Multi-Channel Feed17 Apr 2023 0 repositories listed
-
Reclaimer: A Reinforcement Learning Approach to Dynamic Resource Allocation for Cloud Microservices17 Apr 2023 0 repositories listed
-
Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations17 Apr 2023 0 repositories listed
-
Car-Following Models: A Multidisciplinary Review14 Apr 2023 0 repositories listed
-
Bandit-Based Policy Invariant Explicit Shaping for Incorporating External Advice in Reinforcement Learning14 Apr 2023 0 repositories listed
-
Minimax-Optimal Reward-Agnostic Exploration in Reinforcement Learning14 Apr 2023 0 repositories listed
-
Deep reinforcement learning applied to an assembly sequence planning problem with user preferences13 Apr 2023 0 repositories listed
-
Model-based Dynamic Shielding for Safe and Efficient Multi-Agent Reinforcement Learning13 Apr 2023 0 repositories listed
-
MABL: Bi-Level Latent-Variable World Model for Sample-Efficient Multi-Agent Reinforcement Learning12 Apr 2023 0 repositories listed
-
Exploiting Symmetry and Heuristic Demonstrations in Off-policy Reinforcement Learning for Robotic Manipulation12 Apr 2023 0 repositories listed
-
A Tale of Sampling and Estimation in Discounted Reinforcement Learning11 Apr 2023 0 repositories listed
-
Active RIS-aided EH-NOMA Networks: A Deep Reinforcement Learning Approach11 Apr 2023 0 repositories listed
-
Optimal Interpretability-Performance Trade-off of Classification Trees with Black-Box Reinforcement Learning11 Apr 2023 0 repositories listed
-
Reinforcement Learning Tutor Better Supported Lower Performers in a Math Task11 Apr 2023 0 repositories listed
-
A Reinforcement Learning-assisted Genetic Programming Algorithm for Team Formation Problem Considering Person-Job Matching8 Apr 2023 0 repositories listed
-
DREAM: Adaptive Reinforcement Learning based on Attention Mechanism for Temporal Knowledge Graph Reasoning8 Apr 2023 0 repositories listed
-
A modular framework for stabilizing deep reinforcement learning control7 Apr 2023 0 repositories listed
-
CRISP: Curriculum Inducing Primitive Informed Subgoal Prediction for Hierarchical Reinforcement Learning7 Apr 2023 0 repositories listed
-
Deep Reinforcement Learning Based Optimal Infinite-Horizon Control of Probabilistic Boolean Control Networks7 Apr 2023 0 repositories listed
-
Full Gradient Deep Reinforcement Learning for Average-Reward Criterion7 Apr 2023 0 repositories listed
-
Decision-Focused Model-based Reinforcement Learning for Reward Transfer6 Apr 2023 0 repositories listed
-
Constrained Exploration in Reinforcement Learning with Optimality Preservation5 Apr 2023 0 repositories listed
-
Off-Policy Action Anticipation in Multi-Agent Reinforcement Learning4 Apr 2023 0 repositories listed
-
Optimizing Irrigation Efficiency using Deep Reinforcement Learning in the Field4 Apr 2023 0 repositories listed
-
Regularization of the policy updates for stabilizing Mean Field Games4 Apr 2023 0 repositories listed
-
Risk-Aware Distributed Multi-Agent Reinforcement Learning4 Apr 2023 0 repositories listed
-
State and Parameter Estimation for Affine Nonlinear Systems4 Apr 2023 0 repositories listed
-
A Tutorial Introduction to Reinforcement Learning3 Apr 2023 0 repositories listed
-
Action Pick-up in Dynamic Action Space Reinforcement Learning3 Apr 2023 0 repositories listed
-
DribbleBot: Dynamic Legged Manipulation in the Wild3 Apr 2023 0 repositories listed
-
Empirical Design in Reinforcement Learning3 Apr 2023 0 repositories listed
-
Quantitative Trading using Deep Q Learning3 Apr 2023 0 repositories listed
-
Experimentation Platforms Meet Reinforcement Learning: Bayesian Sequential Decision-Making for Continuous Monitoring2 Apr 2023 0 repositories listed
-
Risk-Sensitive and Robust Model-Based Reinforcement Learning and Planning2 Apr 2023 0 repositories listed
-
Mastering Pair Trading with Risk-Aware Recurrent Reinforcement Learning1 Apr 2023 0 repositories listed
-
Multi-Microgrid Collaborative Optimization Scheduling Using an Improved Multi-Agent Soft Actor-Critic Algorithm1 Apr 2023 0 repositories listed
-
An Efficient Off-Policy Reinforcement Learning Algorithm for the Continuous-Time LQR Problem31 Mar 2023 0 repositories listed
-
Online Reinforcement Learning in Markov Decision Process Using Linear Programming31 Mar 2023 0 repositories listed
-
Selective Reincarnation: Offline-to-Online Multi-Agent Reinforcement Learning31 Mar 2023 0 repositories listed
-
e-Uber: A Crowdsourcing Platform for Electric Vehicle-based Ride- and Energy-sharing31 Mar 2023 0 repositories listed
-
Finetuning from Offline Reinforcement Learning: Challenges, Trade-offs and Practical Solutions30 Mar 2023 0 repositories listed
-
Does Sparsity Help in Learning Misspecified Linear Bandits?29 Mar 2023 0 repositories listed
-
Learning Complicated Manipulation Skills via Deterministic Policy with Limited Demonstrations29 Mar 2023 0 repositories listed
-
Physical Deep Reinforcement Learning Towards Safety Guarantee29 Mar 2023 0 repositories listed
-
Skill Reinforcement Learning and Planning for Open-World Long-Horizon Tasks29 Mar 2023 0 repositories listed
-
Policy Gradient Methods for Discrete Time Linear Quadratic Regulator With Random Parameters29 Mar 2023 0 repositories listed
-
Quantum Deep Hedging29 Mar 2023 0 repositories listed
-
Adaptive Background Music for a Fighting Game: A Multi-Instrument Volume Modulation Approach28 Mar 2023 0 repositories listed
-
BC-IRL: Learning Generalizable Reward Functions from Demonstrations28 Mar 2023 0 repositories listed
-
On-line reinforcement learning for optimization of real-life energy trading strategy28 Mar 2023 0 repositories listed
-
Bi-Manual Block Assembly via Sim-to-Real Reinforcement Learning27 Mar 2023 0 repositories listed
-
Exploring Novel Quality Diversity Methods For Generalization in Reinforcement Learning26 Mar 2023 0 repositories listed
-
Learning Generative Models with Goal-conditioned Reinforcement Learning26 Mar 2023 0 repositories listed
-
Robotic Packaging Optimization with Reinforcement Learning26 Mar 2023 0 repositories listed
-
Causality Detection for Efficient Multi-Agent Reinforcement Learning24 Mar 2023 0 repositories listed
-
Robust Path Following on Rivers Using Bootstrapped Reinforcement Learning24 Mar 2023 0 repositories listed
-
Sequential Knockoffs for Variable Selection in Reinforcement Learning24 Mar 2023 0 repositories listed
-
Boosting Reinforcement Learning and Planning with Demonstrations: A Survey23 Mar 2023 0 repositories listed
-
Connected Superlevel Set in (Deep) Reinforcement Learning and its Application to Minimax Theorems23 Mar 2023 0 repositories listed
-
Adaptive Road Configurations for Improved Autonomous Vehicle-Pedestrian Interactions using Reinforcement Learning22 Mar 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.