Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 128
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 128 of 152: papers 12,701 to 12,800 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
MANGA: Method Agnostic Neural-policy Generalization and Adaptation19 Nov 2019 0 repositories listed
-
Placement Optimization of Aerial Base Stations with Deep Reinforcement Learning19 Nov 2019 0 repositories listed
-
Variance Reduced Advantage Estimation with δ Hindsight Credit Assignment19 Nov 2019 0 repositories listed
-
Comments on the Du-Kakade-Wang-Yang Lower Bounds18 Nov 2019 0 repositories listed
-
Efficient Exploration through Intrinsic Motivation Learning for Unsupervised Subgoal Discovery in Model-Free Hierarchical Reinforcement Learning18 Nov 2019 0 repositories listed
-
Inducing Cooperation via Team Regret Minimization based Multi-Agent Deep Reinforcement Learning18 Nov 2019 0 repositories listed
-
Unsupervised Reinforcement Learning of Transferable Meta-Skills for Embodied Navigation18 Nov 2019 0 repositories listed
-
Hebbian Synaptic Modifications in Spiking Neurons that Learn17 Nov 2019 0 repositories listed
-
Generalized Maximum Causal Entropy for Inverse Reinforcement Learning16 Nov 2019 0 repositories listed
-
Inverse Reinforcement Learning with Missing Data16 Nov 2019 0 repositories listed
-
Off-Policy Policy Gradient Algorithms by Constraining the State Distribution Shift16 Nov 2019 0 repositories listed
-
Reinforcement Learning from Imperfect Demonstrations under Soft Expert Guidance16 Nov 2019 0 repositories listed
-
Data-efficient Co-Adaptation of Morphology and Behaviour with Deep Reinforcement Learning15 Nov 2019 0 repositories listed
-
Improved Exploration through Latent Trajectory Optimization in Deep Deterministic Policy Gradient15 Nov 2019 0 repositories listed
-
A Reduction from Reinforcement Learning to No-Regret Online Learning14 Nov 2019 0 repositories listed
-
Gamifying the Vehicle Routing Problem with Stochastic Requests14 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Traffic Signal Control14 Nov 2019 0 repositories listed
-
Asymptotics of Reinforcement Learning with Neural Networks13 Nov 2019 0 repositories listed
-
Buffer-aware Wireless Scheduling based on Deep Reinforcement Learning13 Nov 2019 0 repositories listed
-
Kinematic State Abstraction and Provably Efficient Rich-Observation Reinforcement Learning13 Nov 2019 0 repositories listed
-
Learning to Communicate in Multi-Agent Reinforcement Learning : A Review13 Nov 2019 0 repositories listed
-
Reinforcement Learning-Driven Test Generation for Android GUI Applications using Formal Specifications13 Nov 2019 0 repositories listed
-
Accelerating Training in Pommerman with Imitation and Reinforcement Learning12 Nov 2019 0 repositories listed
-
Efficient Planning under Partial Observability with Unnormalized Q Functions and Spectral Learning12 Nov 2019 0 repositories listed
-
MSDF: A Deep Reinforcement Learning Framework for Service Function Chain Migration12 Nov 2019 0 repositories listed
-
One-shot learning and behavioral eligibility traces in sequential decision making12 Nov 2019 0 repositories listed
-
Schedule Earth Observation satellites with Deep Reinforcement Learning12 Nov 2019 0 repositories listed
-
Context-aware Active Multi-Step Reinforcement Learning11 Nov 2019 0 repositories listed
-
Learning to Order Sub-questions for Complex Question Answering11 Nov 2019 0 repositories listed
-
Reinforcement-Learning-Based Variational Quantum Circuits Optimization for Combinatorial Problems11 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning Based Dynamic Trajectory Control for UAV-assisted Mobile Edge Computing10 Nov 2019 0 repositories listed
-
Minimalistic Attacks: How Little it Takes to Fool a Deep Reinforcement Learning Policy10 Nov 2019 0 repositories listed
-
Value-Added Chemical Discovery Using Reinforcement Learning10 Nov 2019 0 repositories listed
-
Hierarchical Reinforcement Learning Method for Autonomous Vehicle Behavior Planning9 Nov 2019 0 repositories listed
-
Worst Cases Policy Gradients9 Nov 2019 0 repositories listed
-
Fully Bayesian Recurrent Neural Networks for Safe Reinforcement Learning8 Nov 2019 0 repositories listed
-
Option Compatible Reward Inverse Reinforcement Learning7 Nov 2019 0 repositories listed
-
Distributional Reward Decomposition for Reinforcement Learning6 Nov 2019 0 repositories listed
-
Experience Sharing Between Cooperative Reinforcement Learning Agents6 Nov 2019 0 repositories listed
-
MBCAL: Sample Efficient and Variance Reduced Reinforcement Learning for Recommender Systems6 Nov 2019 0 repositories listed
-
Optimizing the Factual Correctness of a Summary: A Study of Summarizing Radiology Reports6 Nov 2019 0 repositories listed
-
DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning5 Nov 2019 0 repositories listed
-
Quinoa: a Q-function You Infer Normalized Over Actions5 Nov 2019 0 repositories listed
-
Robo-advising: Learning Investors' Risk Preferences via Portfolio Choices5 Nov 2019 0 repositories listed
-
An End-to-End Deep RL Framework for Task Arrangement in Crowdsourcing Platforms4 Nov 2019 0 repositories listed
-
Robotic Tracking Control with Kernel Trick-based Reinforcement Learning4 Nov 2019 0 repositories listed
-
Maximum Entropy Diverse Exploration: Disentangling Maximum Entropy Reinforcement Learning3 Nov 2019 0 repositories listed
-
Non-Cooperative Inverse Reinforcement Learning3 Nov 2019 0 repositories listed
-
Online Robustness Training for Deep Reinforcement Learning3 Nov 2019 0 repositories listed
-
Problem Dependent Reinforcement Learning Bounds Which Can Identify Bandit Structure in MDPs3 Nov 2019 0 repositories listed
-
A2: Extracting Cyclic Switchings from DOB-nets for Rejecting Excessive Disturbances1 Nov 2019 0 repositories listed
-
Answer-Supervised Question Reformulation for Enhancing Conversational Machine Comprehension1 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning-based Text Anonymization against Private-Attribute Inference1 Nov 2019 0 repositories listed
-
DIVINE: A Generative Adversarial Imitation Learning Framework for Knowledge Graph Reasoning1 Nov 2019 0 repositories listed
-
Exploring Diverse Expressions for Paraphrase Generation1 Nov 2019 0 repositories listed
-
Generating Formality-Tuned Summaries Using Input-Dependent Rewards1 Nov 2019 0 repositories listed
-
Incorporating Graph Attention Mechanism into Knowledge Graph Reasoning Based on Deep Reinforcement Learning1 Nov 2019 0 repositories listed
-
Learning the Extraction Order of Multiple Relational Facts in a Sentence with Reinforcement Learning1 Nov 2019 0 repositories listed
-
Neural Topic Model with Reinforcement Learning1 Nov 2019 0 repositories listed
-
Situated GAIL: Multitask imitation using task-conditioned adversarial inverse reinforcement learning1 Nov 2019 0 repositories listed
-
DeepLine: AutoML Tool for Pipelines Generation using Deep Reinforcement Learning and Hierarchical Actions Filtering31 Oct 2019 0 repositories listed
-
Hierarchical Expert Networks for Meta-Learning31 Oct 2019 0 repositories listed
-
RLINK: Deep Reinforcement Learning for User Identity Linkage31 Oct 2019 0 repositories listed
-
VASE: Variational Assorted Surprise Exploration for Reinforcement Learning31 Oct 2019 0 repositories listed
-
A Distributed Model-Free Algorithm for Multi-hop Ride-sharing using Deep Reinforcement Learning30 Oct 2019 0 repositories listed
-
DADI: Dynamic Discovery of Fair Information with Adversarial Reinforcement Learning30 Oct 2019 0 repositories listed
-
Learning Algorithmic Solutions to Symbolic Planning Tasks with a Neural Computer Architecture30 Oct 2019 0 repositories listed
-
RBED: Reward Based Epsilon Decay30 Oct 2019 0 repositories listed
-
Deep Decentralized Reinforcement Learning for Cooperative Control29 Oct 2019 0 repositories listed
-
Overcoming Catastrophic Interference in Online Reinforcement Learning with Dynamic Self-Organizing Maps29 Oct 2019 0 repositories listed
-
Feedback Linearization for Unknown Systems via Reinforcement Learning29 Oct 2019 0 repositories listed
-
Constrained Reinforcement Learning Has Zero Duality Gap29 Oct 2019 0 repositories listed
-
Robust Model-free Reinforcement Learning with Multi-objective Bayesian Optimization29 Oct 2019 0 repositories listed
-
Adaptive Sampling Quasi-Newton Methods for Derivative-Free Stochastic Optimization29 Oct 2019 0 repositories listed
-
Deep Reinforcement Learning for Distributed Uncoordinated Cognitive Radios Resource Allocation29 Oct 2019 0 repositories listed
-
Deep reinforcement learning for market making in corporate bonds: beating the curse of dimensionality29 Oct 2019 0 repositories listed
-
Biomimetic Ultra-Broadband Perfect Absorbers Optimised with Reinforcement Learning28 Oct 2019 0 repositories listed
-
Certified Adversarial Robustness for Deep Reinforcement Learning28 Oct 2019 0 repositories listed
-
Minimax Weight and Q-Function Learning for Off-Policy Evaluation28 Oct 2019 0 repositories listed
-
Model-Free Mean-Field Reinforcement Learning: Mean-Field MDP and Mean-Field Q-Learning28 Oct 2019 0 repositories listed
-
Neural Architecture Evolution in Deep Reinforcement Learning for Continuous Control28 Oct 2019 0 repositories listed
-
Reinforcement Learning-Enabled Reliable Wireless Sensor Networks in Dynamic Underground Environments26 Oct 2019 0 repositories listed
-
MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding25 Oct 2019 0 repositories listed
-
On the convergence of projective-simulation-based reinforcement learning in Markov decision processes25 Oct 2019 0 repositories listed
-
Case Study: Verifying the Safety of an Autonomous Racing Car with a Neural Network Controller24 Oct 2019 0 repositories listed
-
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition24 Oct 2019 0 repositories listed
-
Robust Model Predictive Shielding for Safe Reinforcement Learning with Stochastic Dynamics24 Oct 2019 0 repositories listed
-
Optimizing Percentile Criterion Using Robust MDPs23 Oct 2019 0 repositories listed
-
Partially Detected Intelligent Traffic Signal Control: Environmental Adaptation23 Oct 2019 0 repositories listed
-
Sample Complexity of Reinforcement Learning using Linearly Combined Model Ensembles23 Oct 2019 0 repositories listed
-
Faster and Safer Training by Embedding High-Level Knowledge into Deep Reinforcement Learning22 Oct 2019 0 repositories listed
-
State2vec: Off-Policy Successor Features Approximators22 Oct 2019 0 repositories listed
-
Application of Reinforcement Learning for 5G Scheduling Parameter Optimization21 Oct 2019 0 repositories listed
-
Combining Benefits from Trajectory Optimization and Deep Reinforcement Learning21 Oct 2019 0 repositories listed
-
Good, Better, Best: Textual Distractors Generation for Multiple-Choice Visual Question Answering via Reinforcement Learning21 Oct 2019 0 repositories listed
-
Human-Like Decision Making: Document-level Aspect Sentiment Classification via Hierarchical Reinforcement Learning21 Oct 2019 0 repositories listed
-
IPO: Interior-point Policy Optimization under Constraints21 Oct 2019 0 repositories listed
-
Modelling Generalized Forces with Reinforcement Learning for Sim-to-Real Transfer21 Oct 2019 0 repositories listed
-
Momentum in Reinforcement Learning21 Oct 2019 0 repositories listed
-
Multi-agent Hierarchical Reinforcement Learning with Dynamic Termination21 Oct 2019 0 repositories listed