Browse State-of-the-Art › Reinforcement Learning › Papers, page 128
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 128 of 132: papers 12,701 to 12,800 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reinforcement Learning With Temporal Logic Rewards11 Dec 2016 0 repositories listed
-
Towards deep learning with spiking neurons in energy based models with contrastive Hebbian plasticity9 Dec 2016 0 repositories listed
-
Hierarchy through Composition with Linearly Solvable Markov Decision Processes8 Dec 2016 0 repositories listed
-
Stochastic Primal-Dual Methods and Sample Complexity of Reinforcement Learning8 Dec 2016 0 repositories listed
-
Towards Information-Seeking Agents8 Dec 2016 0 repositories listed
-
Transition-based versus State-based Reward Functions for MDPs with Value-at-Risk7 Dec 2016 0 repositories listed
-
Deep Learning of Robotic Tasks without a Simulator using Strong and Weak Human Supervision4 Dec 2016 0 repositories listed
-
Learning to superoptimize programs - Workshop Version4 Dec 2016 0 repositories listed
-
Success Probability of Exploration: a Concrete Analysis of Learning Efficiency2 Dec 2016 0 repositories listed
-
Adaptive optimal training of animal behavior1 Dec 2016 0 repositories listed
-
Bootstrapping incremental dialogue systems: using linguistic knowledge to learn from minimal data1 Dec 2016 0 repositories listed
-
Generalizing Skills with Semi-Supervised Reinforcement Learning1 Dec 2016 0 repositories listed
-
Guided Policy Search via Approximate Mirror Descent1 Dec 2016 0 repositories listed
-
Linear Feature Encoding for Reinforcement Learning1 Dec 2016 0 repositories listed
-
Showing versus doing: Teaching by demonstration1 Dec 2016 0 repositories listed
-
Exploration for Multi-task Reinforcement Learning with Deep Generative Models29 Nov 2016 0 repositories listed
-
Improving Policy Gradient by Exploring Under-appreciated Rewards28 Nov 2016 0 repositories listed
-
Learning to Compose Words into Sentences with Reinforcement Learning28 Nov 2016 0 repositories listed
-
Nonparametric General Reinforcement Learning28 Nov 2016 0 repositories listed
-
Handwriting Profiling using Generative Adversarial Networks27 Nov 2016 0 repositories listed
-
Multiscale Inverse Reinforcement Learning using Diffusion Wavelets24 Nov 2016 0 repositories listed
-
Can Co-robots Learn to Teach?22 Nov 2016 0 repositories listed
-
Recurrent Attention Models for Depth-Based Person Identification22 Nov 2016 0 repositories listed
-
A Deep Learning Approach for Joint Video Frame and Reward Prediction in Atari Games21 Nov 2016 0 repositories listed
-
Memory Lens: How Much Memory Does an Agent Use?21 Nov 2016 0 repositories listed
-
Options Discovery with Budgeted Reinforcement Learning21 Nov 2016 0 repositories listed
-
Reinforcement Learning in Rich-Observation MDPs using Spectral Methods11 Nov 2016 0 repositories listed
-
Estimating Dynamic Treatment Regimes in Mobile Health Using V-learning10 Nov 2016 0 repositories listed
-
Fairness in Reinforcement Learning9 Nov 2016 0 repositories listed
-
Sequence Tutor: Conservative Fine-Tuning of Sequence Generation Models with KL-control9 Nov 2016 0 repositories listed
-
Averaged-DQN: Variance Reduction and Stabilization for Deep Reinforcement Learning7 Nov 2016 0 repositories listed
-
Reinforcement Learning Approach for Parallelization in Filters Aggregation Based Feature Selection Algorithms7 Nov 2016 0 repositories listed
-
Hierarchical Question Answering for Long Documents6 Nov 2016 0 repositories listed
-
Learning to Perform Physics Experiments via Deep Reinforcement Learning6 Nov 2016 0 repositories listed
-
A Differentiable Physics Engine for Deep Learning in Robotics5 Nov 2016 0 repositories listed
-
Combining policy gradient and Q-learning5 Nov 2016 0 repositories listed
-
Multi-task learning with deep model based reinforcement learning4 Nov 2016 0 repositories listed
-
Combating Reinforcement Learning's Sisyphean Curse with Intrinsic Fear3 Nov 2016 0 repositories listed
-
Learning Locomotion Skills Using DeepRL: Does the Choice of Action Space Matter?3 Nov 2016 0 repositories listed
-
Quantile Reinforcement Learning3 Nov 2016 0 repositories listed
-
Using a Deep Reinforcement Learning Agent for Traffic Signal Control3 Nov 2016 0 repositories listed
-
Learning Runtime Parameters in Computer Systems with Delayed Experience Injection31 Oct 2016 0 repositories listed
-
Contextual Decision Processes with Low Bellman Rank are PAC-Learnable29 Oct 2016 0 repositories listed
-
Quantum-enhanced machine learning26 Oct 2016 0 repositories listed
-
Reinforcement Learning in Conflicting Environments for Autonomous Vehicles22 Oct 2016 0 repositories listed
-
Modular Deep Q Networks for Sim-to-real Transfer of Visuo-motor Policies21 Oct 2016 0 repositories listed
-
Utilization of Deep Reinforcement Learning for saccadic-based object visual search20 Oct 2016 0 repositories listed
-
A Reinforcement Learning Approach to the View Planning Problem19 Oct 2016 0 repositories listed
-
Particle Swarm Optimization for Generating Interpretable Fuzzy Reinforcement Learning Policies19 Oct 2016 0 repositories listed
-
Online Contrastive Divergence with Generative Replay: Experience Replay without Storing Data18 Oct 2016 0 repositories listed
-
Recurrent 3D Attentional Networks for End-to-End Active Object Recognition14 Oct 2016 0 repositories listed
-
The End of Optimism? An Asymptotic Analysis of Finite-Armed Linear Bandits14 Oct 2016 0 repositories listed
-
Sim-to-Real Robot Learning from Pixels with Progressive Nets13 Oct 2016 0 repositories listed
-
Introduction to the "Industrial Benchmark"12 Oct 2016 0 repositories listed
-
Navigational Instruction Generation as Inverse Reinforcement Learning with Neural Machine Translation11 Oct 2016 0 repositories listed
-
Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving11 Oct 2016 0 repositories listed
-
Transfer from Simulation to Real World through Learning Deep Inverse Dynamics Model11 Oct 2016 0 repositories listed
-
Personalizing a Dialogue System with Transfer Reinforcement Learning10 Oct 2016 0 repositories listed
-
Situational Awareness by Risk-Conscious Skills10 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning From Raw Pixels in Doom7 Oct 2016 0 repositories listed
-
Connecting Generative Adversarial Networks and Actor-Critic Methods6 Oct 2016 0 repositories listed
-
Towards Cognitive Exploration through Deep Reinforcement Learning for Mobile Robots6 Oct 2016 0 repositories listed
-
EPOpt: Learning Robust Neural Network Policies Using Model Ensembles5 Oct 2016 0 repositories listed
-
Reset-Free Guided Policy Search: Efficient Deep Reinforcement Learning with Stochastic Initial States4 Oct 2016 0 repositories listed
-
Collective Robot Reinforcement Learning with Distributed Asynchronous Guided Policy Search3 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning for Robotic Manipulation with Asynchronous Off-Policy Updates3 Oct 2016 0 repositories listed
-
Deep Reinforcement Learning for Tensegrity Robot Locomotion28 Sep 2016 0 repositories listed
-
UbuntuWorld 1.0 LTS - A Platform for Automated Problem Solving & Troubleshooting in the Ubuntu OS27 Sep 2016 0 repositories listed
-
Regulating Reward Training by Means of Certainty Prediction in a Neural Network-Implemented Pong Game23 Sep 2016 0 repositories listed
-
Exact Sampling from Determinantal Point Processes22 Sep 2016 0 repositories listed
-
Learning Modular Neural Network Policies for Multi-Task and Multi-Robot Transfer22 Sep 2016 0 repositories listed
-
Modelling Stock-market Investors as Reinforcement Learning Agents [Correction]20 Sep 2016 0 repositories listed
-
Towards Deep Symbolic Reinforcement Learning18 Sep 2016 0 repositories listed
-
17 Sep 2016 0 repositories listed
-
Exploration Potential16 Sep 2016 0 repositories listed
-
Interactive Spoken Content Retrieval by Deep Reinforcement Learning16 Sep 2016 0 repositories listed
-
Bayesian Reinforcement Learning: A Survey14 Sep 2016 0 repositories listed
-
3D Simulation for Robot Arm Control with Deep Q-Learning13 Sep 2016 0 repositories listed
-
A centralized reinforcement learning method for multi-agent job scheduling in Grid11 Sep 2016 0 repositories listed
-
Episodic Exploration for Deep Deterministic Policies: An Application to StarCraft Micromanagement Tasks10 Sep 2016 0 repositories listed
-
Dialogue manager domain adaptation using Gaussian process reinforcement learning9 Sep 2016 0 repositories listed
-
Unifying task specification in reinforcement learning7 Sep 2016 0 repositories listed
-
Single photon in hierarchical architecture for physical reinforcement learning: Photon intelligence1 Sep 2016 0 repositories listed
-
Adaptive Probabilistic Trajectory Optimization via Efficient Approximate Inference22 Aug 2016 0 repositories listed
-
Modeling Human Reading with Neural Attention19 Aug 2016 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems17 Aug 2016 0 repositories listed
-
Open Problem: Approximate Planning of POMDPs in the class of Memoryless Policies17 Aug 2016 0 repositories listed
-
Reinforcement Learning algorithms for regret minimization in structured Markov Decision Processes17 Aug 2016 0 repositories listed
-
Density Matching Reward Learning12 Aug 2016 0 repositories listed
-
Perceptual Reward Functions12 Aug 2016 0 repositories listed
-
Neuroevolution-Based Inverse Reinforcement Learning9 Aug 2016 0 repositories listed
-
On Lower Bounds for Regret in Reinforcement Learning9 Aug 2016 0 repositories listed
-
Online Adaptation of Deep Architectures with Reinforcement Learning8 Aug 2016 0 repositories listed
-
Discovering Latent States for Model Learning: Applying Sensorimotor Contingencies Theory and Predictive Processing to Model Context1 Aug 2016 0 repositories listed
-
A Sensorimotor Reinforcement Learning Framework for Physical Human-Robot Interaction27 Jul 2016 0 repositories listed
-
Accelerating Stochastic Composition Optimization25 Jul 2016 0 repositories listed
-
Learning from Conditional Distributions via Dual Embeddings15 Jul 2016 0 repositories listed
-
Sequential Cost-Sensitive Feature Acquisition13 Jul 2016 0 repositories listed
-
Automatic Bridge Bidding Using Deep Reinforcement Learning12 Jul 2016 0 repositories listed
-
Why is Posterior Sampling Better than Optimism for Reinforcement Learning?1 Jul 2016 0 repositories listed