Browse State-of-the-Art › reinforcement-learning › Papers, page 81
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 81 of 135: papers 8,001 to 8,100 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
q-Munchausen Reinforcement Learning16 May 2022 0 repositories listed
-
Qualitative Differences Between Evolutionary Strategies and Reinforcement Learning Methods for Control of Autonomous Agents16 May 2022 0 repositories listed
-
Rethinking Reinforcement Learning based Logic Synthesis16 May 2022 0 repositories listed
-
Taming Continuous Posteriors for Latent Variational Dialogue Policies16 May 2022 0 repositories listed
-
Towards on-sky adaptive optics control using reinforcement learning16 May 2022 0 repositories listed
-
Policy Gradient Method For Robust Reinforcement Learning15 May 2022 0 repositories listed
-
RoMFAC: A robust mean-field actor-critic reinforcement learning against adversarial perturbations on states15 May 2022 0 repositories listed
-
14 May 2022 0 repositories listed Syntology 2 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 1 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 2 unverified (of 4 harvested samples) · 1 pointer-only (licence)
-
PrefixRL: Optimization of Parallel Prefix Circuits using Deep Reinforcement Learning14 May 2022 0 repositories listed
-
Efficient Off-Policy Reinforcement Learning via Brain-Inspired Computing14 May 2022 0 repositories listed
-
Deep Reinforcement Learning in mmW-NOMA: Joint Power Allocation and Hybrid Beamforming13 May 2022 0 repositories listed
-
Emergent Bartering Behaviour in Multi-Agent Reinforcement Learning13 May 2022 0 repositories listed
-
Provably Safe Reinforcement Learning: Conceptual Analysis, Survey, and Benchmarking13 May 2022 0 repositories listed
-
Contingency-constrained economic dispatch with safe reinforcement learning12 May 2022 0 repositories listed
-
Controlling chaotic itinerancy in laser dynamics for reinforcement learning12 May 2022 0 repositories listed
-
Economical Precise Manipulation and Auto Eye-Hand Coordination with Binocular Visual Reinforcement Learning12 May 2022 0 repositories listed
-
Feature and Instance Joint Selection: A Reinforcement Learning Perspective12 May 2022 0 repositories listed
-
Provably Safe Deep Reinforcement Learning for Robotic Manipulation in Human Environments12 May 2022 0 repositories listed
-
Bridging Model-based Safety and Model-free Reinforcement Learning through System Identification of Low Dimensional Linear Models11 May 2022 0 repositories listed
-
Delayed Reinforcement Learning by Imitation11 May 2022 0 repositories listed
-
Developing cooperative policies for multi-stage reinforcement learning tasks11 May 2022 0 repositories listed
-
Efficient Distributed Framework for Collaborative Multi-Agent Reinforcement Learning11 May 2022 0 repositories listed
-
Final Iteration Convergence Bound of Q-Learning: Switching System Approach11 May 2022 0 repositories listed
-
Learning to Guide Multiple Heterogeneous Actors from a Single Human Demonstration via Automatic Curriculum Learning in StarCraft II11 May 2022 0 repositories listed
-
Hybrid Reinforcement Learning for STAR-RISs: A Coupled Phase-Shift Model Based Beamformer10 May 2022 0 repositories listed
-
Accelerated Reinforcement Learning for Temporal Logic Control Objectives9 May 2022 0 repositories listed
-
Applications of Reinforcement Learning in Deregulated Power Market: A Comprehensive Review7 May 2022 0 repositories listed
-
Deep Reinforcement Learning-Based Adaptive IRS Control with Limited Feedback Codebooks7 May 2022 0 repositories listed
-
Search-Based Testing of Reinforcement Learning7 May 2022 0 repositories listed
-
Dynamically writing coupled memories using a reinforcement learning agent, meeting physical bounds6 May 2022 0 repositories listed
-
Goal-Oriented Next Best Activity Recommendation using Reinforcement Learning6 May 2022 0 repositories listed
-
JUNO: Jump-Start Reinforcement Learning-based Node Selection for UWB Indoor Localization6 May 2022 0 repositories listed
-
Reinforcement Learning Approach to Estimation in Linear Systems6 May 2022 0 repositories listed
-
A Deep Reinforcement Learning Framework for Rapid Diagnosis of Whole Slide Pathological Images5 May 2022 0 repositories listed
-
A Temporal-Pattern Backdoor Attack to Deep Reinforcement Learning5 May 2022 0 repositories listed
-
General sum stochastic games with networked information flows5 May 2022 0 repositories listed
-
Generative methods for sampling transition paths in molecular dynamics5 May 2022 0 repositories listed
-
LDSA: Learning Dynamic Subtask Assignment in Cooperative Multi-Agent Reinforcement Learning5 May 2022 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning in Vehicular OCC5 May 2022 0 repositories listed
-
Pessimism meets VCG: Learning Dynamic Mechanism Design via Offline Reinforcement Learning5 May 2022 0 repositories listed
-
Rapid Locomotion via Reinforcement Learning5 May 2022 0 repositories listed
-
Multi-subgoal Robot Navigation in Crowds with History Information and Interactions4 May 2022 0 repositories listed
-
State Representation Learning for Goal-Conditioned Reinforcement Learning4 May 2022 0 repositories listed
-
Using Deep Reinforcement Learning to solve Optimal Power Flow problem with generator failures4 May 2022 0 repositories listed
-
Meta-Cognition. An Inverse-Inverse Reinforcement Learning Approach for Cognitive Radars3 May 2022 0 repositories listed
-
Deep-Attack over the Deep Reinforcement Learning2 May 2022 0 repositories listed
-
Exploration in Deep Reinforcement Learning: A Survey2 May 2022 0 repositories listed
-
Integrating Question Rewrites in Conversational Question Answering: A Reinforcement Learning Approach1 May 2022 0 repositories listed
-
Learning user-defined sub-goals using memory editing in reinforcement learning1 May 2022 0 repositories listed
-
Processing Network Controls via Deep Reinforcement Learning1 May 2022 0 repositories listed
-
Stable Reinforcement Learning for Optimal Frequency Control: A Distributed Averaging-Based Integral Approach1 May 2022 0 repositories listed
-
Unsupervised Reinforcement Learning for Transferable Manipulation Skill Discovery29 Apr 2022 0 repositories listed
-
RISCLESS: A Reinforcement Learning Strategy to Exploit Unused Cloud Resources28 Apr 2022 0 repositories listed
-
Toward Compositional Generalization in Object-Oriented World Modeling28 Apr 2022 0 repositories listed
-
Bisimulation Makes Analogies in Goal-Conditioned Reinforcement Learning27 Apr 2022 0 repositories listed
-
Relational Abstractions for Generalized Reinforcement Learning on Symbolic Problems27 Apr 2022 0 repositories listed
-
An Efficient Dynamic Sampling Policy For Monte Carlo Tree Search26 Apr 2022 0 repositories listed
-
BATS: Best Action Trajectory Stitching26 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning for Online Routing of Unmanned Aerial Vehicles with Wireless Power Transfer25 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning for Orienteering Problems Based on Decomposition25 Apr 2022 0 repositories listed
-
Skill-based Meta-Reinforcement Learning25 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning-based Radio Resource Allocation and Beam Management under Location Uncertainty in 5G mmWave Networks23 Apr 2022 0 repositories listed
-
Graph Neural Network based Agent in Google Research Football23 Apr 2022 0 repositories listed
-
Learning how to Interact with a Complex Interface using Hierarchical Reinforcement Learning21 Apr 2022 0 repositories listed
-
Optimizing Nitrogen Management with Deep Reinforcement Learning and Crop Simulations21 Apr 2022 0 repositories listed
-
A Hierarchical Bayesian Approach to Inverse Reinforcement Learning with Symbolic Reward Machines20 Apr 2022 0 repositories listed
-
Federated Learning for Distributed Energy-Efficient Resource Allocation20 Apr 2022 0 repositories listed
-
Joint Learning of Reward Machines and Policies in Environments with Partially Known Semantics20 Apr 2022 0 repositories listed
-
Mingling Foresight with Imagination: Model-Based Cooperative Multi-Agent Reinforcement Learning20 Apr 2022 0 repositories listed
-
Reinforcement Learning with Intrinsic Affinity for Personalized Prosperity Management20 Apr 2022 0 repositories listed
-
SAAC: Safe Reinforcement Learning as an Adversarial Game of Actor-Critics20 Apr 2022 0 repositories listed
-
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency20 Apr 2022 0 repositories listed
-
Understanding and Preventing Capacity Loss in Reinforcement Learning20 Apr 2022 0 repositories listed
-
Network Topology Optimization via Deep Reinforcement Learning19 Apr 2022 0 repositories listed
-
When Is Partially Observable Reinforcement Learning Not Scary?19 Apr 2022 0 repositories listed
-
Optimizing Tensor Network Contraction Using Reinforcement Learning18 Apr 2022 0 repositories listed
-
Training and Evaluation of Deep Policies using Reinforcement Learning and Generative Models18 Apr 2022 0 repositories listed
-
Learning to Transfer Role Assignment Across Team Sizes17 Apr 2022 0 repositories listed
-
Probabilistic Charging Power Forecast of EVCS: Reinforcement Learning Assisted Deep Learning Approach17 Apr 2022 0 repositories listed
-
Towards Comprehensive Testing on the Robustness of Cooperative Multi-agent Reinforcement Learning17 Apr 2022 0 repositories listed
-
Efficient Bayesian Policy Reuse with a Scalable Observation Model in Deep Reinforcement Learning16 Apr 2022 0 repositories listed
-
Efficient Reinforcement Learning for Unsupervised Controlled Text Generation16 Apr 2022 0 repositories listed
-
CryoRL: Reinforcement Learning Enables Efficient Cryo-EM Data Collection15 Apr 2022 0 repositories listed
-
The Importance of Credo in Multiagent Learning15 Apr 2022 0 repositories listed
-
D3PG: Dirichlet DDPG for Task Partitioning and Offloading With Constrained Hybrid Action Space in Mobile-Edge Computing14 Apr 2022 0 repositories listed
-
Efficient and practical quantum compiler towards multi-qubit systems with deep reinforcement learning14 Apr 2022 0 repositories listed
-
Methodical Advice Collection and Reuse in Deep Reinforcement Learning14 Apr 2022 0 repositories listed
-
Reinforcement Learning Policy Recommendation for Interbank Network Stability14 Apr 2022 0 repositories listed
-
Flexible Multiple-Objective Reinforcement Learning for Chip Placement13 Apr 2022 0 repositories listed
-
Improving generalization to new environments and removing catastrophic forgetting in Reinforcement Learning by using an eco-system of agents13 Apr 2022 0 repositories listed
-
Local Feature Swapping for Generalization in Reinforcement Learning13 Apr 2022 0 repositories listed
-
Modularity benefits reinforcement learning agents with competing homeostatic drives13 Apr 2022 0 repositories listed
-
An Analysis of Discretization Methods for Communication Learning with Multi-Agent Reinforcement Learning12 Apr 2022 0 repositories listed
-
Dynamic Dialogue Policy for Continual Reinforcement Learning12 Apr 2022 0 repositories listed
-
RL-CoSeg : A Novel Image Co-Segmentation Algorithm with Deep Reinforcement Learning12 Apr 2022 0 repositories listed
-
Smart Interference Management xApp using Deep Reinforcement Learning12 Apr 2022 0 repositories listed
-
When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?12 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning Based Semi-Autonomous Control for Robotic Surgery11 Apr 2022 0 repositories listed
-
Evaluating Vision Transformer Methods for Deep Reinforcement Learning from Pixels11 Apr 2022 0 repositories listed
-
Exploring the Pareto front of multi-objective COVID-19 mitigation policies using reinforcement learning11 Apr 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.