Browse State-of-the-Art › reinforcement-learning › Papers, page 126
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 126 of 135: papers 12,501 to 12,600 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Variational Bayesian Reinforcement Learning with Regret Bounds25 Jul 2018 0 repositories listed
-
Contrastive Explanations for Reinforcement Learning in terms of Expected Consequences23 Jul 2018 0 repositories listed
-
Learning to Play Pong using Policy Gradient Learning23 Jul 2018 0 repositories listed
-
Accelerated Structure-Aware Reinforcement Learning for Delay-Sensitive Energy Harvesting Wireless Sensors22 Jul 2018 0 repositories listed
-
Asynchronous Advantage Actor-Critic Agent for Starcraft II22 Jul 2018 0 repositories listed
-
NAVREN-RL: Learning to fly in real environment via end-to-end deep reinforcement learning using monocular images22 Jul 2018 0 repositories listed
-
FuzzerGym: A Competitive Framework for Fuzzing and Learning19 Jul 2018 0 repositories listed
-
Self-Organizing Maps as a Storage and Transfer Mechanism in Reinforcement Learning19 Jul 2018 0 repositories listed
-
Towards Explainable and Controllable Open Domain Dialogue Generation with Dialogue Acts19 Jul 2018 0 repositories listed
-
Foundations for Restraining Bolts: Reinforcement Learning with LTLf/LDLf restraining specifications17 Jul 2018 0 repositories listed
-
Discrete linear-complexity reinforcement learning in continuous action spaces for Q-learning algorithms16 Jul 2018 0 repositories listed
-
Online Robust Policy Learning in the Presence of Unknown Adversaries16 Jul 2018 0 repositories listed
-
Safe Reinforcement Learning via Probabilistic Shields16 Jul 2018 0 repositories listed
-
Toward Interpretable Deep Reinforcement Learning with Linear Model U-Trees16 Jul 2018 0 repositories listed
-
Exploring Hierarchy-Aware Inverse Reinforcement Learning13 Jul 2018 0 repositories listed
-
An Affective Robot Companion for Assisting the Elderly in a Cognitive Game Scenario12 Jul 2018 0 repositories listed
-
The Bottleneck Simulator: A Model-based Deep Reinforcement Learning Approach12 Jul 2018 0 repositories listed
-
Will it Blend? Composing Value Functions in Reinforcement Learning12 Jul 2018 0 repositories listed
-
CIRL: Controllable Imitative Reinforcement Learning for Vision-based Self-driving10 Jul 2018 0 repositories listed
-
Partial Policy-based Reinforcement Learning for Anatomical Landmark Localization in 3D Medical Images9 Jul 2018 0 repositories listed
-
Video Summarisation by Classification with Deep Reinforcement Learning9 Jul 2018 0 repositories listed
-
Auto Deep Compression by Reinforcement Learning Based Actor-Critic Structure8 Jul 2018 0 repositories listed
-
End-to-End Race Driving with Deep Reinforcement Learning6 Jul 2018 0 repositories listed
-
Variance Reduction for Reinforcement Learning in Input-Driven Environments6 Jul 2018 0 repositories listed
-
Arcades: A deep model for adaptive decision making in voice controlled smart-home5 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for Doom using Unsupervised Auxiliary Tasks5 Jul 2018 0 repositories listed
-
Goal-oriented Trajectories for Efficient Exploration5 Jul 2018 0 repositories listed
-
Using Reinforcement Learning with Partial Vehicle Detection for Intelligent Traffic Signal Control4 Jul 2018 0 repositories listed
-
Region Growing Curriculum Generation for Reinforcement Learning4 Jul 2018 0 repositories listed
-
Supervised Reinforcement Learning with Recurrent Neural Network for Dynamic Treatment Recommendation4 Jul 2018 0 repositories listed
-
Transfer with Model Features in Reinforcement Learning4 Jul 2018 0 repositories listed
-
1 Jul 2018 0 repositories listed
-
A Reinforcement Learning Neural Network for Robotic Manipulator Control1 Jul 2018 0 repositories listed
-
Beyond the One-Step Greedy Approach in Reinforcement Learning1 Jul 2018 0 repositories listed
-
Beyond Winning and Losing: Modeling Human Motivations and Behaviors Using Inverse Reinforcement Learning1 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for NLP1 Jul 2018 0 repositories listed
-
Feudal Dialogue Management with Jointly Learned Feature Extractors1 Jul 2018 0 repositories listed
-
Learning Hierarchical Structures On-The-Fly with a Recurrent-Recursive Model for Sequences1 Jul 2018 0 repositories listed
-
Learning to Act in Decentralized Partially Observable MDPs1 Jul 2018 0 repositories listed
-
Learning to Explore via Meta-Policy Gradient1 Jul 2018 0 repositories listed
-
Mix & Match - Agent Curricula for Reinforcement Learning1 Jul 2018 0 repositories listed
-
Policy and Value Transfer in Lifelong Reinforcement Learning1 Jul 2018 0 repositories listed
-
Spotlight: Optimizing Device Placement for Training Deep Neural Networks1 Jul 2018 0 repositories listed
-
State Abstractions for Lifelong Reinforcement Learning1 Jul 2018 0 repositories listed
-
Towards Mixed Optimization for Reinforcement Learning with Program Synthesis1 Jul 2018 0 repositories listed
-
Understanding and Simplifying One-Shot Architecture Search1 Jul 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Abductive Planning28 Jun 2018 0 repositories listed
-
MONAS: Multi-Objective Neural Architecture Search using Reinforcement Learning27 Jun 2018 0 repositories listed
-
Multi-agent Inverse Reinforcement Learning for Certain General-sum Stochastic Games26 Jun 2018 0 repositories listed
-
Deep Reinforcement Learning: An Overview23 Jun 2018 0 repositories listed
-
Human-Interactive Subgoal Supervision for Efficient Inverse Reinforcement Learning22 Jun 2018 0 repositories listed
-
Many-Goals Reinforcement Learning22 Jun 2018 0 repositories listed
-
A New Approach for Resource Scheduling with Deep Reinforcement Learning21 Jun 2018 0 repositories listed
-
A Dissection of Overfitting and Generalization in Continuous Reinforcement Learning20 Jun 2018 0 repositories listed
-
Reinforcement Learning using Augmented Neural Networks20 Jun 2018 0 repositories listed
-
Skilled Experience Catalogue: A Skill-Balancing Mechanism for Non-Player Characters using Reinforcement Learning20 Jun 2018 0 repositories listed
-
A Survey of Inverse Reinforcement Learning: Challenges, Methods and Progress18 Jun 2018 0 repositories listed
-
A unified strategy for implementing curiosity and empowerment driven reinforcement learning18 Jun 2018 0 repositories listed
-
Learning from Outside the Viability Kernel: Why we Should Build Robots that can Fall with Grace18 Jun 2018 0 repositories listed
-
Learning Policy Representations in Multiagent Systems17 Jun 2018 0 repositories listed
-
Handling Cold-Start Collaborative Filtering with Reinforcement Learning16 Jun 2018 0 repositories listed
-
Improving width-based planning with compact policies15 Jun 2018 0 repositories listed
-
Multi-Level Policy and Reward Reinforcement Learning for Image Captioning15 Jun 2018 0 repositories listed
-
Adaptive Shooting for Bots in First Person Shooter Games Using Reinforcement Learning14 Jun 2018 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Urban Transportation Problems14 Jun 2018 0 repositories listed
-
Qualitative Measurements of Policy Discrepancy for Return-Based Deep Q-Network14 Jun 2018 0 repositories listed
-
Reinforcement Learning with Function-Valued Action Spaces for Partial Differential Equation Control13 Jun 2018 0 repositories listed
-
Meta-Learning Transferable Active Learning Policies by Deep Reinforcement Learning12 Jun 2018 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning with Human Strategies12 Jun 2018 0 repositories listed
-
Unsupervised Meta-Learning for Reinforcement Learning12 Jun 2018 0 repositories listed
-
An Efficient, Generalized Bellman Update For Cooperative Inverse Reinforcement Learning11 Jun 2018 0 repositories listed
-
Implicit Policy for Reinforcement Learning10 Jun 2018 0 repositories listed
-
Automatic View Planning with Multi-scale Deep Reinforcement Learning Agents8 Jun 2018 0 repositories listed
-
Program Synthesis Through Reinforcement Learning Guided Tree Search8 Jun 2018 0 repositories listed
-
Self-Consistent Trajectory Autoencoder: Hierarchical Reinforcement Learning with Trajectory Embeddings7 Jun 2018 0 repositories listed
-
Discovering and Removing Exogenous State Variables and Rewards for Reinforcement Learning5 Jun 2018 0 repositories listed
-
Mix&Match - Agent Curricula for Reinforcement Learning5 Jun 2018 0 repositories listed
-
Adversarial Reinforcement Learning Framework for Benchmarking Collision Avoidance Mechanisms in Autonomous Vehicles4 Jun 2018 0 repositories listed
-
Mitigation of Policy Manipulation Attacks on Deep Q-Networks with Parameter-Space Noise4 Jun 2018 0 repositories listed
-
Exploration in Structured Reinforcement Learning3 Jun 2018 0 repositories listed
-
Multi-Agent Reinforcement Learning via Double Averaging Primal-Dual Optimization3 Jun 2018 0 repositories listed
-
DAQN: Deep Auto-encoder and Q-Network2 Jun 2018 0 repositories listed
-
Deep Pepper: Expert Iteration based Chess agent in the Reinforcement Learning Setting2 Jun 2018 0 repositories listed
-
Efficient Entropy for Policy Gradient with Multidimensional Action Space2 Jun 2018 0 repositories listed
-
Internal Model from Observations for Reward Shaping2 Jun 2018 0 repositories listed
-
A Reinforcement Learning Approach to Age of Information in Multi-User Networks1 Jun 2018 0 repositories listed
-
1 Jun 2018 0 repositories listed
-
Environment Upgrade Reinforcement Learning for Non-Differentiable Multi-Stage Pipelines1 Jun 2018 0 repositories listed
-
Equivalence Between Wasserstein and Value-Aware Loss for Model-based Reinforcement Learning1 Jun 2018 0 repositories listed
-
Fast Exploration with Simplified Models and Approximately Optimistic Planning in Model Based Reinforcement Learning1 Jun 2018 0 repositories listed
-
GraphBit: Bitwise Interaction Mining via Deep Reinforcement Learning1 Jun 2018 0 repositories listed
-
Improved Sample Complexity for Stochastic Compositional Variance Reduced Gradient1 Jun 2018 0 repositories listed
-
Inference Aided Reinforcement Learning for Incentive Mechanism Design in Crowdsourcing1 Jun 2018 0 repositories listed
-
Integrating Episodic Memory into a Reinforcement Learning Agent using Reservoir Sampling1 Jun 2018 0 repositories listed
-
Mining Evidences for Concept Stock Recommendation1 Jun 2018 0 repositories listed
-
Quality Signals in Generated Stories1 Jun 2018 0 repositories listed
-
SeedNet: Automatic Seed Generation With Deep Reinforcement Learning for Robust Interactive Segmentation1 Jun 2018 0 repositories listed
-
Evaluating Reinforcement Learning Algorithms in Observational Health Settings31 May 2018 0 repositories listed
-
Learning a Prior over Intent via Meta-Inverse Reinforcement Learning31 May 2018 0 repositories listed
-
Depth and nonlinearity induce implicit exploration for RL29 May 2018 0 repositories listed