Browse State-of-the-Art › Reinforcement Learning › Papers, page 102
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 102 of 132: papers 10,101 to 10,200 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Context-aware Active Multi-Step Reinforcement Learning11 Nov 2019 0 repositories listed
-
Learning to Order Sub-questions for Complex Question Answering11 Nov 2019 0 repositories listed
-
MAME : Model-Agnostic Meta-Exploration11 Nov 2019 0 repositories listed
-
Multi-Path Policy Optimization11 Nov 2019 0 repositories listed
-
Reinforcement-Learning-Based Variational Quantum Circuits Optimization for Combinatorial Problems11 Nov 2019 0 repositories listed
-
Transfer Value Iteration Networks11 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning Based Dynamic Trajectory Control for UAV-assisted Mobile Edge Computing10 Nov 2019 0 repositories listed
-
Minimalistic Attacks: How Little it Takes to Fool a Deep Reinforcement Learning Policy10 Nov 2019 0 repositories listed
-
Modelling Bahdanau Attention using Election methods aided by Q-Learning10 Nov 2019 0 repositories listed
-
Value-Added Chemical Discovery Using Reinforcement Learning10 Nov 2019 0 repositories listed
-
Hierarchical Reinforcement Learning Method for Autonomous Vehicle Behavior Planning9 Nov 2019 0 repositories listed
-
Robo-PlaNet: Learning to Poke in a Day9 Nov 2019 0 repositories listed
-
Worst Cases Policy Gradients9 Nov 2019 0 repositories listed
-
Ask to Learn: A Study on Curiosity-driven Question Generation8 Nov 2019 0 repositories listed
-
Fully Bayesian Recurrent Neural Networks for Safe Reinforcement Learning8 Nov 2019 0 repositories listed
-
Language Grounding through Social Interactions and Curiosity-Driven Multi-Goal Learning8 Nov 2019 0 repositories listed
-
Option Compatible Reward Inverse Reinforcement Learning7 Nov 2019 0 repositories listed
-
Distributional Reward Decomposition for Reinforcement Learning6 Nov 2019 0 repositories listed
-
Experience Sharing Between Cooperative Reinforcement Learning Agents6 Nov 2019 0 repositories listed
-
MBCAL: Sample Efficient and Variance Reduced Reinforcement Learning for Recommender Systems6 Nov 2019 0 repositories listed
-
Optimizing the Factual Correctness of a Summary: A Study of Summarizing Radiology Reports6 Nov 2019 0 repositories listed
-
Resilient Load Restoration in Microgrids Considering Mobile Energy Storage Fleets: A Deep Reinforcement Learning Approach6 Nov 2019 0 repositories listed
-
Being Optimistic to Be Conservative: Quickly Learning a CVaR Policy5 Nov 2019 0 repositories listed
-
DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning5 Nov 2019 0 repositories listed
-
Efficient Multi-robot Exploration via Multi-head Attention-based Cooperation Strategy5 Nov 2019 0 repositories listed
-
Quinoa: a Q-function You Infer Normalized Over Actions5 Nov 2019 0 repositories listed
-
Robo-advising: Learning Investors' Risk Preferences via Portfolio Choices5 Nov 2019 0 repositories listed
-
An End-to-End Deep RL Framework for Task Arrangement in Crowdsourcing Platforms4 Nov 2019 0 repositories listed
-
Robotic Tracking Control with Kernel Trick-based Reinforcement Learning4 Nov 2019 0 repositories listed
-
Tustin neural networks: a class of recurrent nets for adaptive MPC of mechanical systems4 Nov 2019 0 repositories listed
-
Finite-Sample Analysis of Decentralized Temporal-Difference Learning with Linear Function Approximation3 Nov 2019 0 repositories listed
-
Maximum Entropy Diverse Exploration: Disentangling Maximum Entropy Reinforcement Learning3 Nov 2019 0 repositories listed
-
Non-Cooperative Inverse Reinforcement Learning3 Nov 2019 0 repositories listed
-
Online Robustness Training for Deep Reinforcement Learning3 Nov 2019 0 repositories listed
-
Problem Dependent Reinforcement Learning Bounds Which Can Identify Bandit Structure in MDPs3 Nov 2019 0 repositories listed
-
A2: Extracting Cyclic Switchings from DOB-nets for Rejecting Excessive Disturbances1 Nov 2019 0 repositories listed
-
Answer-guided and Semantic Coherent Question Generation in Open-domain Conversation1 Nov 2019 0 repositories listed
-
Answer-Supervised Question Reformulation for Enhancing Conversational Machine Comprehension1 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning-based Text Anonymization against Private-Attribute Inference1 Nov 2019 0 repositories listed
-
DIVINE: A Generative Adversarial Imitation Learning Framework for Knowledge Graph Reasoning1 Nov 2019 0 repositories listed
-
Experienced Deep Reinforcement Learning with Generative Adversarial Networks (GANs) for Model-Free Ultra Reliable Low Latency Communication1 Nov 2019 0 repositories listed
-
Exploring Diverse Expressions for Paraphrase Generation1 Nov 2019 0 repositories listed
-
Generating Formality-Tuned Summaries Using Input-Dependent Rewards1 Nov 2019 0 repositories listed
-
Incorporating Graph Attention Mechanism into Knowledge Graph Reasoning Based on Deep Reinforcement Learning1 Nov 2019 0 repositories listed
-
Learning the Extraction Order of Multiple Relational Facts in a Sentence with Reinforcement Learning1 Nov 2019 0 repositories listed
-
Learning to Ask for Conversational Machine Learning1 Nov 2019 0 repositories listed
-
LexicalAT: Lexical-Based Adversarial Reinforcement Training for Robust Sentiment Classification1 Nov 2019 0 repositories listed
-
Neural Topic Model with Reinforcement Learning1 Nov 2019 0 repositories listed
-
Reinforcement-based denoising of distantly supervised NER with partial annotation1 Nov 2019 0 repositories listed
-
Seeded self-play for language learning1 Nov 2019 0 repositories listed
-
Situated GAIL: Multitask imitation using task-conditioned adversarial inverse reinforcement learning1 Nov 2019 0 repositories listed
-
Unsupervised Neural Machine Translation with Future Rewarding1 Nov 2019 0 repositories listed
-
A Narration-based Reward Shaping Approach using Grounded Natural Language Commands31 Oct 2019 0 repositories listed
-
DeepLine: AutoML Tool for Pipelines Generation using Deep Reinforcement Learning and Hierarchical Actions Filtering31 Oct 2019 0 repositories listed
-
Hierarchical Expert Networks for Meta-Learning31 Oct 2019 0 repositories listed
-
RLINK: Deep Reinforcement Learning for User Identity Linkage31 Oct 2019 0 repositories listed
-
VASE: Variational Assorted Surprise Exploration for Reinforcement Learning31 Oct 2019 0 repositories listed
-
A Distributed Model-Free Algorithm for Multi-hop Ride-sharing using Deep Reinforcement Learning30 Oct 2019 0 repositories listed
-
Automatic Testing With Reusable Adversarial Agents30 Oct 2019 0 repositories listed
-
DADI: Dynamic Discovery of Fair Information with Adversarial Reinforcement Learning30 Oct 2019 0 repositories listed
-
Learning Algorithmic Solutions to Symbolic Planning Tasks with a Neural Computer Architecture30 Oct 2019 0 repositories listed
-
RBED: Reward Based Epsilon Decay30 Oct 2019 0 repositories listed
-
Deep Decentralized Reinforcement Learning for Cooperative Control29 Oct 2019 0 repositories listed
-
Overcoming Catastrophic Interference in Online Reinforcement Learning with Dynamic Self-Organizing Maps29 Oct 2019 0 repositories listed
-
Feedback Linearization for Unknown Systems via Reinforcement Learning29 Oct 2019 0 repositories listed
-
Constrained Reinforcement Learning Has Zero Duality Gap29 Oct 2019 0 repositories listed
-
Robust Model-free Reinforcement Learning with Multi-objective Bayesian Optimization29 Oct 2019 0 repositories listed
-
Adaptive Sampling Quasi-Newton Methods for Derivative-Free Stochastic Optimization29 Oct 2019 0 repositories listed
-
Deep Reinforcement Learning for Distributed Uncoordinated Cognitive Radios Resource Allocation29 Oct 2019 0 repositories listed
-
Better Exploration with Optimistic Actor-Critic28 Oct 2019 0 repositories listed
-
Biomimetic Ultra-Broadband Perfect Absorbers Optimised with Reinforcement Learning28 Oct 2019 0 repositories listed
-
Certified Adversarial Robustness for Deep Reinforcement Learning28 Oct 2019 0 repositories listed
-
Learning Transferable Graph Exploration28 Oct 2019 0 repositories listed
-
Minimax Weight and Q-Function Learning for Off-Policy Evaluation28 Oct 2019 0 repositories listed
-
Model-Free Mean-Field Reinforcement Learning: Mean-Field MDP and Mean-Field Q-Learning28 Oct 2019 0 repositories listed
-
Neural Architecture Evolution in Deep Reinforcement Learning for Continuous Control28 Oct 2019 0 repositories listed
-
MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding25 Oct 2019 0 repositories listed
-
On the convergence of projective-simulation-based reinforcement learning in Markov decision processes25 Oct 2019 0 repositories listed
-
Case Study: Verifying the Safety of an Autonomous Racing Car with a Neural Network Controller24 Oct 2019 0 repositories listed
-
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition24 Oct 2019 0 repositories listed
-
Robust Model Predictive Shielding for Safe Reinforcement Learning with Stochastic Dynamics24 Oct 2019 0 repositories listed
-
BanditRank: Learning to Rank Using Contextual Bandits23 Oct 2019 0 repositories listed
-
Optimizing Percentile Criterion Using Robust MDPs23 Oct 2019 0 repositories listed
-
Partially Detected Intelligent Traffic Signal Control: Environmental Adaptation23 Oct 2019 0 repositories listed
-
Sample Complexity of Reinforcement Learning using Linearly Combined Model Ensembles23 Oct 2019 0 repositories listed
-
Faster and Safer Training by Embedding High-Level Knowledge into Deep Reinforcement Learning22 Oct 2019 0 repositories listed
-
Learning Resilient Behaviors for Navigation Under Uncertainty22 Oct 2019 0 repositories listed
-
State2vec: Off-Policy Successor Features Approximators22 Oct 2019 0 repositories listed
-
Towards an Intelligent Microscope: adaptively learned illumination for optimal sample classification22 Oct 2019 0 repositories listed
-
A New Framework for Multi-Agent Reinforcement Learning -- Centralized Training and Exploration with Decentralized Execution via Policy Distillation21 Oct 2019 0 repositories listed
-
Application of Reinforcement Learning for 5G Scheduling Parameter Optimization21 Oct 2019 0 repositories listed
-
Learning to Recommend from Sparse Data via Generative User Feedback21 Oct 2019 0 repositories listed
-
Combining Benefits from Trajectory Optimization and Deep Reinforcement Learning21 Oct 2019 0 repositories listed
-
Enforcing Reasoning in Visual Commonsense Reasoning21 Oct 2019 0 repositories listed
-
History-Gradient Aided Batch Size Adaptation for Variance Reduced Algorithms21 Oct 2019 0 repositories listed
-
Good, Better, Best: Textual Distractors Generation for Multiple-Choice Visual Question Answering via Reinforcement Learning21 Oct 2019 0 repositories listed
-
Human-Like Decision Making: Document-level Aspect Sentiment Classification via Hierarchical Reinforcement Learning21 Oct 2019 0 repositories listed
-
IPO: Interior-point Policy Optimization under Constraints21 Oct 2019 0 repositories listed
-
Modelling Generalized Forces with Reinforcement Learning for Sim-to-Real Transfer21 Oct 2019 0 repositories listed
-
Momentum in Reinforcement Learning21 Oct 2019 0 repositories listed