Browse State-of-the-Art › Reinforcement Learning › Papers, page 99
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 99 of 132: papers 9,801 to 9,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Graph Ordering: Towards the Optimal by Learning18 Jan 2020 0 repositories listed
-
Multi-agent Motion Planning for Dense and Dynamic Environments via Deep Reinforcement Learning18 Jan 2020 0 repositories listed
-
A Derivative-Free Method for Solving Elliptic Partial Differential Equations with Deep Neural Networks17 Jan 2020 0 repositories listed
-
Algorithms in Multi-Agent Systems: A Holistic Perspective from Reinforcement Learning and Game Theory17 Jan 2020 0 repositories listed
-
MIME: Mutual Information Minimisation Exploration16 Jan 2020 0 repositories listed
-
Reward Shaping for Reinforcement Learning with Omega-Regular Objectives16 Jan 2020 0 repositories listed
-
AvgOut: A Simple Output-Probability Measure to Eliminate Dull Responses15 Jan 2020 0 repositories listed
-
Inducing Cooperative behaviour in Sequential-Social dilemmas through Multi-Agent Reinforcement Learning using Status-Quo Loss15 Jan 2020 0 repositories listed
-
Model-based Multi-Agent Reinforcement Learning with Cooperative Prioritized Sweeping15 Jan 2020 0 repositories listed
-
Robotic Grasp Manipulation Using Evolutionary Computing and Deep Reinforcement Learning15 Jan 2020 0 repositories listed
-
SEERL: Sample Efficient Ensemble Reinforcement Learning15 Jan 2020 0 repositories listed
-
Reinforcement Learning of Control Policy for Linear Temporal Logic Specifications Using Limit-Deterministic Generalized Büchi Automata14 Jan 2020 0 repositories listed
-
Exploiting Language Instructions for Interpretable and Compositional Reinforcement Learning13 Jan 2020 0 repositories listed
-
Learning to Locomote with Deep Neural-Network and CPG-based Control in a Soft Snake Robot13 Jan 2020 0 repositories listed
-
Multi-Robot Formation Control Using Reinforcement Learning13 Jan 2020 0 repositories listed
-
Deep Reinforcement Learning for Complex Manipulation Tasks with Sparse Feedback12 Jan 2020 0 repositories listed
-
Functional Error Correction for Robust Neural Networks12 Jan 2020 0 repositories listed
-
Weakly Supervised Video Summarization by Hierarchical Reinforcement Learning12 Jan 2020 0 repositories listed
-
A storage expansion planning framework using reinforcement learning and simulation-based optimization10 Jan 2020 0 repositories listed
-
Deep Interactive Reinforcement Learning for Path Following of Autonomous Underwater Vehicle10 Jan 2020 0 repositories listed
-
Debate Dynamics for Human-comprehensible Fact-checking on Knowledge Graphs9 Jan 2020 0 repositories listed
-
Identifying Distinct, Effective Treatments for Acute Hypotension with SODA-RL: Safely Optimized Diverse Accurate Reinforcement Learning9 Jan 2020 0 repositories listed
-
On Computation and Generalization of Generative Adversarial Imitation Learning9 Jan 2020 0 repositories listed
-
Reinforcement Learning Tracking Control for Robotic Manipulator With Kernel-Based Dynamic Model9 Jan 2020 0 repositories listed
-
EEG-based Drowsiness Estimation for Driving Safety using Deep Q-Learning8 Jan 2020 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Cooperative Connected Vehicles8 Jan 2020 0 repositories listed
-
On Thompson Sampling for Smoother-than-Lipschitz Bandits8 Jan 2020 0 repositories listed
-
Perception and Navigation in Autonomous Systems in the Era of Learning: A Survey8 Jan 2020 0 repositories listed
-
Sample-based Distributional Policy Gradient8 Jan 2020 0 repositories listed
-
What can robotics research learn from computer vision research?8 Jan 2020 0 repositories listed
-
Reanalysis of Variance Reduced Temporal Difference Learning7 Jan 2020 0 repositories listed
-
Experimental Analysis of Reinforcement Learning Techniques for Spectrum Sharing Radar6 Jan 2020 0 repositories listed
-
High-speed Autonomous Drifting with Deep Reinforcement Learning6 Jan 2020 0 repositories listed
-
Generalizing Emergent Communication6 Jan 2020 0 repositories listed
-
Learning Reusable Options for Multi-Task Reinforcement Learning6 Jan 2020 0 repositories listed
-
Optimal Options for Multi-Task Reinforcement Learning Under Time Constraints6 Jan 2020 0 repositories listed
-
Learning fine-grained search space pruning and heuristics for combinatorial optimization5 Jan 2020 0 repositories listed
-
Universal Successor Features for Transfer Reinforcement Learning5 Jan 2020 0 repositories listed
-
Hierarchical Reinforcement Learning as a Model of Human Task Interleaving4 Jan 2020 0 repositories listed
-
Intelligent Roundabout Insertion using Deep Reinforcement Learning3 Jan 2020 0 repositories listed
-
Optimizing Wireless Systems Using Unsupervised and Reinforced-Unsupervised Deep Learning3 Jan 2020 0 repositories listed
-
Continuous-Discrete Reinforcement Learning for Hybrid Control in Robotics2 Jan 2020 0 repositories listed
-
Joint Goal and Strategy Inference across Heterogeneous Demonstrators via Reward Network Distillation2 Jan 2020 0 repositories listed
-
Zero-Shot Reinforcement Learning with Deep Attention Convolutional Neural Networks2 Jan 2020 0 repositories listed
-
A Game Theoretic Perspective on Model-Based Reinforcement Learning1 Jan 2020 0 repositories listed
-
Batch Reinforcement Learning with Hyperparameter Gradients1 Jan 2020 0 repositories listed
-
Deep Randomized Least Squares Value Iteration1 Jan 2020 0 repositories listed
-
Deep Reinforcement Learning with Implicit Human Feedback1 Jan 2020 0 repositories listed
-
Deep Reinforcement Learning with Smooth Policy1 Jan 2020 0 repositories listed
-
Designing Optimal Dynamic Treatment Regimes: A Causal Reinforcement Learning Approach1 Jan 2020 0 repositories listed
-
Discovering Motor Programs by Recomposing Demonstrations1 Jan 2020 0 repositories listed
-
Double Reinforcement Learning for Efficient and Robust Off-Policy Evaluation1 Jan 2020 0 repositories listed
-
Enhancing Language Emergence through Empathy1 Jan 2020 0 repositories listed
-
Improving the Generalization of Visual Navigation Policies using Invariance Regularization1 Jan 2020 0 repositories listed
-
Insights on Visual Representations for Embodied Navigation Tasks1 Jan 2020 0 repositories listed
-
Learning General-Purpose Controllers via Locally Communicating Sensorimotor Modules1 Jan 2020 0 repositories listed
-
Learning Representations in Reinforcement Learning: an Information Bottleneck Approach1 Jan 2020 0 repositories listed
-
On Bonus Based Exploration Methods In The Arcade Learning Environment1 Jan 2020 0 repositories listed
-
Optimizing Multiagent Cooperation via Policy Evolution and Shared Experiences1 Jan 2020 0 repositories listed
-
Reinforcement Learning with Differential Privacy1 Jan 2020 0 repositories listed
-
Reinforcement Learning with Goal-Distance Gradient1 Jan 2020 0 repositories listed
-
Responsive Safety in Reinforcement Learning1 Jan 2020 0 repositories listed
-
SVQN: Sequential Variational Soft Q-Learning Networks1 Jan 2020 0 repositories listed
-
Way Off-Policy Batch Deep Reinforcement Learning of Human Preferences in Dialog1 Jan 2020 0 repositories listed
-
Information Theoretic Model Predictive Q-Learning31 Dec 2019 0 repositories listed
-
On the Role of Weight Sharing During Deep Option Learning31 Dec 2019 0 repositories listed
-
Stochastic Recursive Variance Reduction for Efficient Smooth Non-Convex Compositional Optimization31 Dec 2019 0 repositories listed
-
The Gambler's Problem and Beyond31 Dec 2019 0 repositories listed
-
Uncertainty-Based Out-of-Distribution Classification in Deep Reinforcement Learning31 Dec 2019 0 repositories listed
-
A New Framework for Query Efficient Active Imitation Learning30 Dec 2019 0 repositories listed
-
Deep Reinforced Self-Attention Masks for Abstractive Summarization (DR.SAS)30 Dec 2019 0 repositories listed
-
World Programs for Model-Based Learning and Planning in Compositional State and Action Spaces30 Dec 2019 0 repositories listed
-
Augmented Replay Memory in Reinforcement Learning With Continuous Control29 Dec 2019 0 repositories listed
-
Computational model discovery with reinforcement learning29 Dec 2019 0 repositories listed
-
Individual specialization in multi-task environments with multiagent reinforcement learners29 Dec 2019 0 repositories listed
-
Loss aversion fosters coordination among independent reinforcement learners29 Dec 2019 0 repositories listed
-
Real-time Policy Distillation in Deep Reinforcement Learning29 Dec 2019 0 repositories listed
-
Speeding up reinforcement learning by combining attention and agency features29 Dec 2019 0 repositories listed
-
Crowdfunding Dynamics Tracking: A Reinforcement Learning Approach27 Dec 2019 0 repositories listed
-
Deep reinforcement learning for complex evaluation of one-loop diagrams in quantum field theory27 Dec 2019 0 repositories listed
-
Evolution Strategies Converges to Finite Differences27 Dec 2019 0 repositories listed
-
Quantum Logic Gate Synthesis as a Markov Decision Process27 Dec 2019 0 repositories listed
-
Convergence and sample complexity of gradient methods for the model-free linear quadratic regulator problem26 Dec 2019 0 repositories listed
-
Quasi-Newton Trust Region Policy Optimization26 Dec 2019 0 repositories listed
-
Learning to Combat Compounding-Error in Model-Based Reinforcement Learning24 Dec 2019 0 repositories listed
-
A Survey of Deep Reinforcement Learning in Video Games23 Dec 2019 0 repositories listed
-
Direct and indirect reinforcement learning23 Dec 2019 0 repositories listed
-
Finite-Time Analysis and Restarting Scheme for Linear Two-Time-Scale Stochastic Approximation23 Dec 2019 0 repositories listed
-
Hamilton-Jacobi-Bellman Equations for Q-Learning in Continuous Time23 Dec 2019 0 repositories listed
-
Monte-Carlo Tree Search for Policy Optimization23 Dec 2019 0 repositories listed
-
Energy-Aware Multi-Server Mobile Edge Computing: A Deep Reinforcement Learning Approach22 Dec 2019 0 repositories listed
-
Online Reinforcement Learning of Optimal Threshold Policies for Markov Decision Processes21 Dec 2019 0 repositories listed
-
Predictive Coding for Boosting Deep Reinforcement Learning with Sparse Rewards21 Dec 2019 0 repositories listed
-
Dependable Neural Networks for Safety Critical Tasks20 Dec 2019 0 repositories listed
-
Exploiting the potential of deep reinforcement learning for classification tasks in high-dimensional and unstructured data20 Dec 2019 0 repositories listed
-
Mastering Complex Control in MOBA Games with Deep Reinforcement Learning20 Dec 2019 0 repositories listed
-
Optimizing Collision Avoidance in Dense Airspace using Deep Reinforcement Learning20 Dec 2019 0 repositories listed
-
Teaching robots to perceive time -- A reinforcement learning approach (Extended version)20 Dec 2019 0 repositories listed
-
Deep Reinforcement Learning Designed Shinnar-Le Roux RF Pulse using Root-Flipping: DeepRF_SLR19 Dec 2019 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.