Browse State-of-the-Art › Reinforcement Learning › Papers, page 74
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 74 of 132: papers 7,301 to 7,400 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
GALOIS: Boosting Deep Reinforcement Learning via Generalizable Logic Synthesis27 May 2022 0 repositories listed
-
Non-Markovian policies occupancy measures27 May 2022 0 repositories listed
-
Off-Beat Multi-Agent Reinforcement Learning27 May 2022 0 repositories listed
-
A Fair Federated Learning Framework With Reinforcement Learning26 May 2022 0 repositories listed
-
Constrained Reinforcement Learning for Short Video Recommendation26 May 2022 0 repositories listed
-
Physics-Guided Hierarchical Reward Mechanism for Learning-Based Robotic Grasping26 May 2022 0 repositories listed
-
SFP: State-free Priors for Exploration in Off-Policy Reinforcement Learning26 May 2022 0 repositories listed
-
An Experimental Comparison Between Temporal Difference and Residual Gradient with Neural Network Approximation25 May 2022 0 repositories listed
-
Fast Inference and Transfer of Compositional Task Structures for Few-shot Task Generalization25 May 2022 0 repositories listed
-
MAVIPER: Learning Decision Tree Policies for Interpretable Multi-Agent Reinforcement Learning25 May 2022 0 repositories listed
-
Near-Optimal Goal-Oriented Reinforcement Learning in Non-Stationary Environments25 May 2022 0 repositories listed
-
Robust Reinforcement Learning on Graphs for Logistics optimization25 May 2022 0 repositories listed
-
Trust-based Consensus in Multi-Agent Reinforcement Learning Systems25 May 2022 0 repositories listed
-
Distributional Hamilton-Jacobi-Bellman Equations for Continuous-Time Reinforcement Learning24 May 2022 0 repositories listed
-
Graph Convolutional Reinforcement Learning for Collaborative Queuing Agents24 May 2022 0 repositories listed
-
Learning to Drive Using Sparse Imitation Reinforcement Learning24 May 2022 0 repositories listed
-
Penalized Proximal Policy Optimization for Safe Reinforcement Learning24 May 2022 0 repositories listed
-
Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs23 May 2022 0 repositories listed
-
Cooperative Reinforcement Learning on Traffic Signal Control23 May 2022 0 repositories listed
-
Logarithmic regret bounds for continuous-time average-reward Markov decision processes23 May 2022 0 repositories listed
-
Multiple Domain Cyberspace Attack and Defense Game Based on Reward Randomization Reinforcement Learning23 May 2022 0 repositories listed
-
POLTER: Policy Trajectory Ensemble Regularization for Unsupervised Reinforcement Learning23 May 2022 0 repositories listed
-
Spreading Factor assisted LoRa Localization with Deep Reinforcement Learning23 May 2022 0 repositories listed
-
Power and accountability in reinforcement learning applications to environmental policy22 May 2022 0 repositories listed
-
Reinforced Pedestrian Attribute Recognition with Group Optimization Reward21 May 2022 0 repositories listed
-
Adversarial joint attacks on legged robots20 May 2022 0 repositories listed
-
Survey on Fair Reinforcement Learning: Theory and Practice20 May 2022 0 repositories listed
-
Data Valuation for Offline Reinforcement Learning19 May 2022 0 repositories listed
-
IL-flOw: Imitation Learning from Observation using Normalizing Flows19 May 2022 0 repositories listed
-
Parallel bandit architecture based on laser chaos for reinforcement learning19 May 2022 0 repositories listed
-
Routing and Placement of Macros using Deep Reinforcement Learning19 May 2022 0 repositories listed
-
Sparse Adversarial Attack in Multi-agent Reinforcement Learning19 May 2022 0 repositories listed
-
Generating Explanations from Deep Reinforcement Learning Using Episodic Memory18 May 2022 0 repositories listed
-
Market Making via Reinforcement Learning in China Commodity Market18 May 2022 0 repositories listed
-
Slowly Changing Adversarial Bandit Algorithms are Efficient for Discounted MDPs18 May 2022 0 repositories listed
-
World Value Functions: Knowledge Representation for Multitask Reinforcement Learning18 May 2022 0 repositories listed
-
Moral reinforcement learning using actual causation17 May 2022 0 repositories listed
-
Multibit Tries Packet Classification with Deep Reinforcement Learning17 May 2022 0 repositories listed
-
A Deep Reinforcement Learning Blind AI in DareFightingICE16 May 2022 0 repositories listed
-
Attacking and Defending Deep Reinforcement Learning Policies16 May 2022 0 repositories listed
-
Deep Apprenticeship Learning for Playing Games16 May 2022 0 repositories listed
-
KGRGRL: A User's Permission Reasoning Method Based on Knowledge Graph Reward Guidance Reinforcement Learning16 May 2022 0 repositories listed
-
Many Field Packet Classification with Decomposition and Reinforcement Learning16 May 2022 0 repositories listed
-
q-Munchausen Reinforcement Learning16 May 2022 0 repositories listed
-
Qualitative Differences Between Evolutionary Strategies and Reinforcement Learning Methods for Control of Autonomous Agents16 May 2022 0 repositories listed
-
Rethinking Reinforcement Learning based Logic Synthesis16 May 2022 0 repositories listed
-
Towards on-sky adaptive optics control using reinforcement learning16 May 2022 0 repositories listed
-
Policy Gradient Method For Robust Reinforcement Learning15 May 2022 0 repositories listed
-
RoMFAC: A robust mean-field actor-critic reinforcement learning against adversarial perturbations on states15 May 2022 0 repositories listed
-
14 May 2022 0 repositories listed Syntology 2 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 1 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 2 unverified (of 4 harvested samples) · 1 pointer-only (licence)
-
PrefixRL: Optimization of Parallel Prefix Circuits using Deep Reinforcement Learning14 May 2022 0 repositories listed
-
Efficient Off-Policy Reinforcement Learning via Brain-Inspired Computing14 May 2022 0 repositories listed
-
Emergent Bartering Behaviour in Multi-Agent Reinforcement Learning13 May 2022 0 repositories listed
-
Provably Safe Reinforcement Learning: Conceptual Analysis, Survey, and Benchmarking13 May 2022 0 repositories listed
-
Contingency-constrained economic dispatch with safe reinforcement learning12 May 2022 0 repositories listed
-
Controlling chaotic itinerancy in laser dynamics for reinforcement learning12 May 2022 0 repositories listed
-
Feature and Instance Joint Selection: A Reinforcement Learning Perspective12 May 2022 0 repositories listed
-
Delayed Reinforcement Learning by Imitation11 May 2022 0 repositories listed
-
Developing cooperative policies for multi-stage reinforcement learning tasks11 May 2022 0 repositories listed
-
Efficient Distributed Framework for Collaborative Multi-Agent Reinforcement Learning11 May 2022 0 repositories listed
-
Learning to Guide Multiple Heterogeneous Actors from a Single Human Demonstration via Automatic Curriculum Learning in StarCraft II11 May 2022 0 repositories listed
-
Accelerated Reinforcement Learning for Temporal Logic Control Objectives9 May 2022 0 repositories listed
-
Search-Based Testing of Reinforcement Learning7 May 2022 0 repositories listed
-
Goal-Oriented Next Best Activity Recommendation using Reinforcement Learning6 May 2022 0 repositories listed
-
Reinforcement Learning Approach to Estimation in Linear Systems6 May 2022 0 repositories listed
-
A Temporal-Pattern Backdoor Attack to Deep Reinforcement Learning5 May 2022 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning in Vehicular OCC5 May 2022 0 repositories listed
-
Rapid Locomotion via Reinforcement Learning5 May 2022 0 repositories listed
-
Multi-subgoal Robot Navigation in Crowds with History Information and Interactions4 May 2022 0 repositories listed
-
State Representation Learning for Goal-Conditioned Reinforcement Learning4 May 2022 0 repositories listed
-
Deep-Attack over the Deep Reinforcement Learning2 May 2022 0 repositories listed
-
Exploration in Deep Reinforcement Learning: A Survey2 May 2022 0 repositories listed
-
Processing Network Controls via Deep Reinforcement Learning1 May 2022 0 repositories listed
-
Unsupervised Reinforcement Learning for Transferable Manipulation Skill Discovery29 Apr 2022 0 repositories listed
-
RISCLESS: A Reinforcement Learning Strategy to Exploit Unused Cloud Resources28 Apr 2022 0 repositories listed
-
Bisimulation Makes Analogies in Goal-Conditioned Reinforcement Learning27 Apr 2022 0 repositories listed
-
Relational Abstractions for Generalized Reinforcement Learning on Symbolic Problems27 Apr 2022 0 repositories listed
-
An Efficient Dynamic Sampling Policy For Monte Carlo Tree Search26 Apr 2022 0 repositories listed
-
BATS: Best Action Trajectory Stitching26 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning for Online Routing of Unmanned Aerial Vehicles with Wireless Power Transfer25 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning for Orienteering Problems Based on Decomposition25 Apr 2022 0 repositories listed
-
Skill-based Meta-Reinforcement Learning25 Apr 2022 0 repositories listed
-
Deep Reinforcement Learning-based Radio Resource Allocation and Beam Management under Location Uncertainty in 5G mmWave Networks23 Apr 2022 0 repositories listed
-
Graph Neural Network based Agent in Google Research Football23 Apr 2022 0 repositories listed
-
Learning how to Interact with a Complex Interface using Hierarchical Reinforcement Learning21 Apr 2022 0 repositories listed
-
Optimizing Nitrogen Management with Deep Reinforcement Learning and Crop Simulations21 Apr 2022 0 repositories listed
-
A Hierarchical Bayesian Approach to Inverse Reinforcement Learning with Symbolic Reward Machines20 Apr 2022 0 repositories listed
-
Federated Learning for Distributed Energy-Efficient Resource Allocation20 Apr 2022 0 repositories listed
-
Reinforcement Learning with Intrinsic Affinity for Personalized Prosperity Management20 Apr 2022 0 repositories listed
-
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency20 Apr 2022 0 repositories listed
-
Understanding and Preventing Capacity Loss in Reinforcement Learning20 Apr 2022 0 repositories listed
-
Network Topology Optimization via Deep Reinforcement Learning19 Apr 2022 0 repositories listed
-
When Is Partially Observable Reinforcement Learning Not Scary?19 Apr 2022 0 repositories listed
-
Optimizing Tensor Network Contraction Using Reinforcement Learning18 Apr 2022 0 repositories listed
-
Learning to Transfer Role Assignment Across Team Sizes17 Apr 2022 0 repositories listed
-
Probabilistic Charging Power Forecast of EVCS: Reinforcement Learning Assisted Deep Learning Approach17 Apr 2022 0 repositories listed
-
Efficient Reinforcement Learning for Unsupervised Controlled Text Generation16 Apr 2022 0 repositories listed
-
CryoRL: Reinforcement Learning Enables Efficient Cryo-EM Data Collection15 Apr 2022 0 repositories listed
-
D3PG: Dirichlet DDPG for Task Partitioning and Offloading With Constrained Hybrid Action Space in Mobile-Edge Computing14 Apr 2022 0 repositories listed
-
Methodical Advice Collection and Reuse in Deep Reinforcement Learning14 Apr 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.