Browse State-of-the-Art › reinforcement-learning › Papers, page 132
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 132 of 135: papers 13,101 to 13,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Hierarchy through Composition with Linearly Solvable Markov Decision Processes8 Dec 2016 0 repositories listed
-
Stochastic Primal-Dual Methods and Sample Complexity of Reinforcement Learning8 Dec 2016 0 repositories listed
-
Towards Information-Seeking Agents8 Dec 2016 0 repositories listed
-
Deep Learning of Robotic Tasks without a Simulator using Strong and Weak Human Supervision4 Dec 2016 0 repositories listed
-
Learning to superoptimize programs - Workshop Version4 Dec 2016 0 repositories listed
-
Adaptive optimal training of animal behavior1 Dec 2016 0 repositories listed
-
Generalizing Skills with Semi-Supervised Reinforcement Learning1 Dec 2016 0 repositories listed
-
Linear Feature Encoding for Reinforcement Learning1 Dec 2016 0 repositories listed
-
Showing versus doing: Teaching by demonstration1 Dec 2016 0 repositories listed
-
Exploration for Multi-task Reinforcement Learning with Deep Generative Models29 Nov 2016 0 repositories listed
-
Learning to Compose Words into Sentences with Reinforcement Learning28 Nov 2016 0 repositories listed
-
Nonparametric General Reinforcement Learning28 Nov 2016 0 repositories listed
-
Multiscale Inverse Reinforcement Learning using Diffusion Wavelets24 Nov 2016 0 repositories listed
-
Recurrent Attention Models for Depth-Based Person Identification22 Nov 2016 0 repositories listed
-
A Deep Learning Approach for Joint Video Frame and Reward Prediction in Atari Games21 Nov 2016 0 repositories listed
-
Memory Lens: How Much Memory Does an Agent Use?21 Nov 2016 0 repositories listed
-
Options Discovery with Budgeted Reinforcement Learning21 Nov 2016 0 repositories listed
-
Reinforcement Learning in Rich-Observation MDPs using Spectral Methods11 Nov 2016 0 repositories listed
-
Fairness in Reinforcement Learning9 Nov 2016 0 repositories listed
-
Averaged-DQN: Variance Reduction and Stabilization for Deep Reinforcement Learning7 Nov 2016 0 repositories listed
-
Reinforcement Learning Approach for Parallelization in Filters Aggregation Based Feature Selection Algorithms7 Nov 2016 0 repositories listed
-
Learning to Perform Physics Experiments via Deep Reinforcement Learning6 Nov 2016 0 repositories listed
-
Multi-task learning with deep model based reinforcement learning4 Nov 2016 0 repositories listed
-
Combating Reinforcement Learning's Sisyphean Curse with Intrinsic Fear3 Nov 2016 0 repositories listed
-
Learning Locomotion Skills Using DeepRL: Does the Choice of Action Space Matter?3 Nov 2016 0 repositories listed
-
Quantile Reinforcement Learning3 Nov 2016 0 repositories listed
-
Using a Deep Reinforcement Learning Agent for Traffic Signal Control3 Nov 2016 0 repositories listed
-
Learning Runtime Parameters in Computer Systems with Delayed Experience Injection31 Oct 2016 0 repositories listed
-
Contextual Decision Processes with Low Bellman Rank are PAC-Learnable29 Oct 2016 0 repositories listed
-
Quantum-enhanced machine learning26 Oct 2016 0 repositories listed
-
Reinforcement Learning in Conflicting Environments for Autonomous Vehicles22 Oct 2016 0 repositories listed
-
Utilization of Deep Reinforcement Learning for saccadic-based object visual search20 Oct 2016 0 repositories listed
-
A Reinforcement Learning Approach to the View Planning Problem19 Oct 2016 0 repositories listed
-
Particle Swarm Optimization for Generating Interpretable Fuzzy Reinforcement Learning Policies19 Oct 2016 0 repositories listed
-
Online Contrastive Divergence with Generative Replay: Experience Replay without Storing Data18 Oct 2016 0 repositories listed
-
The End of Optimism? An Asymptotic Analysis of Finite-Armed Linear Bandits14 Oct 2016 0 repositories listed
-
Sim-to-Real Robot Learning from Pixels with Progressive Nets13 Oct 2016 0 repositories listed
-
Introduction to the "Industrial Benchmark"12 Oct 2016 0 repositories listed
-
Navigational Instruction Generation as Inverse Reinforcement Learning with Neural Machine Translation11 Oct 2016 0 repositories listed
-
Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving11 Oct 2016 0 repositories listed
-
Personalizing a Dialogue System with Transfer Reinforcement Learning10 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning From Raw Pixels in Doom7 Oct 2016 0 repositories listed
-
Towards Cognitive Exploration through Deep Reinforcement Learning for Mobile Robots6 Oct 2016 0 repositories listed
-
Reset-Free Guided Policy Search: Efficient Deep Reinforcement Learning with Stochastic Initial States4 Oct 2016 0 repositories listed
-
Collective Robot Reinforcement Learning with Distributed Asynchronous Guided Policy Search3 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning for Robotic Manipulation with Asynchronous Off-Policy Updates3 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning for Tensegrity Robot Locomotion28 Sep 2016 0 repositories listed
-
Regulating Reward Training by Means of Certainty Prediction in a Neural Network-Implemented Pong Game23 Sep 2016 0 repositories listed
-
Learning Modular Neural Network Policies for Multi-Task and Multi-Robot Transfer22 Sep 2016 0 repositories listed
-
Modelling Stock-market Investors as Reinforcement Learning Agents [Correction]20 Sep 2016 0 repositories listed
-
Towards Deep Symbolic Reinforcement Learning18 Sep 2016 0 repositories listed
-
Exploration Potential16 Sep 2016 0 repositories listed
-
Interactive Spoken Content Retrieval by Deep Reinforcement Learning16 Sep 2016 0 repositories listed
-
Bayesian Reinforcement Learning: A Survey14 Sep 2016 0 repositories listed
-
Stochastic evolution in populations of ideas14 Sep 2016 0 repositories listed
-
A centralized reinforcement learning method for multi-agent job scheduling in Grid11 Sep 2016 0 repositories listed
-
Episodic Exploration for Deep Deterministic Policies: An Application to StarCraft Micromanagement Tasks10 Sep 2016 0 repositories listed
-
Dialogue manager domain adaptation using Gaussian process reinforcement learning9 Sep 2016 0 repositories listed
-
Unifying task specification in reinforcement learning7 Sep 2016 0 repositories listed
-
Reward Function and Initial Values: Better Choices for Accelerated Goal-Directed Reinforcement Learning1 Sep 2016 0 repositories listed
-
Single photon in hierarchical architecture for physical reinforcement learning: Photon intelligence1 Sep 2016 0 repositories listed
-
Modeling Human Reading with Neural Attention19 Aug 2016 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems17 Aug 2016 0 repositories listed
-
Reinforcement Learning algorithms for regret minimization in structured Markov Decision Processes17 Aug 2016 0 repositories listed
-
Perceptual Reward Functions12 Aug 2016 0 repositories listed
-
Neuroevolution-Based Inverse Reinforcement Learning9 Aug 2016 0 repositories listed
-
On Lower Bounds for Regret in Reinforcement Learning9 Aug 2016 0 repositories listed
-
Online Adaptation of Deep Architectures with Reinforcement Learning8 Aug 2016 0 repositories listed
-
Discovering Latent States for Model Learning: Applying Sensorimotor Contingencies Theory and Predictive Processing to Model Context1 Aug 2016 0 repositories listed
-
A Sensorimotor Reinforcement Learning Framework for Physical Human-Robot Interaction27 Jul 2016 0 repositories listed
-
Accelerating Stochastic Composition Optimization25 Jul 2016 0 repositories listed
-
Sequential Cost-Sensitive Feature Acquisition13 Jul 2016 0 repositories listed
-
Automatic Bridge Bidding Using Deep Reinforcement Learning12 Jul 2016 0 repositories listed
-
Why is Posterior Sampling Better than Optimism for Reinforcement Learning?1 Jul 2016 0 repositories listed
-
Is the Bellman residual a bad proxy?24 Jun 2016 0 repositories listed
-
Unsupervised preprocessing for Tactile Data23 Jun 2016 0 repositories listed
-
Simultaneous Control and Human Feedback in the Training of a Robotic Agent with Actor-Critic Reinforcement Learning22 Jun 2016 0 repositories listed
-
A Hierarchical Reinforcement Learning Method for Persistent Time-Sensitive Tasks20 Jun 2016 0 repositories listed
-
On Reward Function for Survival18 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning Discovers Internal Models16 Jun 2016 0 repositories listed
-
Successor Features for Transfer in Reinforcement Learning16 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning With Macro-Actions15 Jun 2016 0 repositories listed
-
Natural Language Generation as Planning under Uncertainty Using Reinforcement Learning15 Jun 2016 0 repositories listed
-
Face valuing: Training user interfaces with facial expressions and reinforcement learning9 Jun 2016 0 repositories listed
-
Continuously Learning Neural Dialogue Management8 Jun 2016 0 repositories listed
-
Adapting Sampling Interval of Sensor Networks Using On-Line Reinforcement Learning7 Jun 2016 0 repositories listed
-
Learning to Optimize6 Jun 2016 0 repositories listed
-
Difference of Convex Functions Programming Applied to Control with Expert Data3 Jun 2016 0 repositories listed
-
Reinforcement Learning for Semantic Segmentation in Indoor Scenes3 Jun 2016 0 repositories listed
-
Reinforcement Learning for Visual Object Detection1 Jun 2016 0 repositories listed
-
Information Theoretically Aided Reinforcement Learning for Embodied Agents31 May 2016 0 repositories listed
-
Control of Memory, Active Perception, and Action in Minecraft30 May 2016 0 repositories listed
-
Model-Free Imitation Learning with Policy Optimization26 May 2016 0 repositories listed
-
A PAC RL Algorithm for Episodic POMDPs25 May 2016 0 repositories listed
-
Localizing by Describing: Attribute-Guided Attention Localization for Fine-Grained Recognition20 May 2016 0 repositories listed
-
Option Discovery in Hierarchical Reinforcement Learning using Spatio-Temporal Clustering17 May 2016 0 repositories listed
-
A Reinforcement Learning System to Encourage Physical Activity in Diabetes Patients13 May 2016 0 repositories listed
-
Optimizing human-interpretable dialog management policy using Genetic Algorithm12 May 2016 0 repositories listed
-
Avoiding Wireheading with Value Reinforcement Learning10 May 2016 0 repositories listed
-
Classifying Options for Deep Reinforcement Learning27 Apr 2016 0 repositories listed