Browse State-of-the-Art › Reinforcement Learning › Papers, page 129
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 129 of 132: papers 12,801 to 12,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Is the Bellman residual a bad proxy?24 Jun 2016 0 repositories listed
-
Multi-Stage Temporal Difference Learning for 2048-like Games23 Jun 2016 0 repositories listed
-
Unsupervised preprocessing for Tactile Data23 Jun 2016 0 repositories listed
-
Simultaneous Control and Human Feedback in the Training of a Robotic Agent with Actor-Critic Reinforcement Learning22 Jun 2016 0 repositories listed
-
Visualizing Dynamics: from t-SNE to SEMI-MDPs22 Jun 2016 0 repositories listed
-
A Hierarchical Reinforcement Learning Method for Persistent Time-Sensitive Tasks20 Jun 2016 0 repositories listed
-
On Reward Function for Survival18 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning Discovers Internal Models16 Jun 2016 0 repositories listed
-
Successor Features for Transfer in Reinforcement Learning16 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning With Macro-Actions15 Jun 2016 0 repositories listed
-
Natural Language Generation as Planning under Uncertainty Using Reinforcement Learning15 Jun 2016 0 repositories listed
-
Strategic Attentive Writer for Learning Macro-Actions15 Jun 2016 0 repositories listed
-
Policy Networks with Two-Stage Training for Dialogue Systems10 Jun 2016 0 repositories listed
-
Face valuing: Training user interfaces with facial expressions and reinforcement learning9 Jun 2016 0 repositories listed
-
Continuously Learning Neural Dialogue Management8 Jun 2016 0 repositories listed
-
Adapting Sampling Interval of Sensor Networks Using On-Line Reinforcement Learning7 Jun 2016 0 repositories listed
-
Learning to Optimize6 Jun 2016 0 repositories listed
-
Deep Q-Networks for Accelerating the Training of Deep Neural Networks5 Jun 2016 0 repositories listed
-
Difference of Convex Functions Programming Applied to Control with Expert Data3 Jun 2016 0 repositories listed
-
End-to-end LSTM-based dialog control optimized with supervised and reinforcement learning3 Jun 2016 0 repositories listed
-
Reinforcement Learning for Semantic Segmentation in Indoor Scenes3 Jun 2016 0 repositories listed
-
Death and Suicide in Universal Artificial Intelligence2 Jun 2016 0 repositories listed
-
Reinforcement Learning for Visual Object Detection1 Jun 2016 0 repositories listed
-
Information Theoretically Aided Reinforcement Learning for Embodied Agents31 May 2016 0 repositories listed
-
Kernel Mean Embedding of Distributions: A Review and Beyond31 May 2016 0 repositories listed
-
Control of Memory, Active Perception, and Action in Minecraft30 May 2016 0 repositories listed
-
Model-Free Imitation Learning with Policy Optimization26 May 2016 0 repositories listed
-
A PAC RL Algorithm for Episodic POMDPs25 May 2016 0 repositories listed
-
Learning Purposeful Behaviour in the Absence of Rewards25 May 2016 0 repositories listed
-
Alternating Optimisation and Quadrature for Robust Control24 May 2016 0 repositories listed
-
Hierarchical Memory Networks24 May 2016 0 repositories listed
-
On-line Active Reward Learning for Policy Optimisation in Spoken Dialogue Systems24 May 2016 0 repositories listed
-
Localizing by Describing: Attribute-Guided Attention Localization for Fine-Grained Recognition20 May 2016 0 repositories listed
-
Dynamic Frame skip Deep Q Network17 May 2016 0 repositories listed
-
Option Discovery in Hierarchical Reinforcement Learning using Spatio-Temporal Clustering17 May 2016 0 repositories listed
-
A Reinforcement Learning System to Encourage Physical Activity in Diabetes Patients13 May 2016 0 repositories listed
-
Optimizing human-interpretable dialog management policy using Genetic Algorithm12 May 2016 0 repositories listed
-
Avoiding Wireheading with Value Reinforcement Learning10 May 2016 0 repositories listed
-
Self-Modification of Policy and Utility Function in Rational Agents10 May 2016 0 repositories listed
-
A Self-Taught Artificial Agent for Multi-Physics Computational Model Personalization1 May 2016 0 repositories listed
-
Classifying Options for Deep Reinforcement Learning27 Apr 2016 0 repositories listed
-
Tournament selection in zeroth-level classifier systems based on average reward reinforcement learning26 Apr 2016 0 repositories listed
-
A Deep Hierarchical Approach to Lifelong Learning in Minecraft25 Apr 2016 0 repositories listed
-
Neurohex: A Deep Q-learning Hex Agent24 Apr 2016 0 repositories listed
-
Using Reinforcement Learning to Validate Empirical Game-Theoretic Analysis: A Continuous Double Auction Study22 Apr 2016 0 repositories listed
-
Closed loop interactions between spiking neural network and robotic simulators based on MUSIC and ROS16 Apr 2016 0 repositories listed
-
Learning to Generate Genotypes with Neural Networks14 Apr 2016 0 repositories listed
-
Inverse Reinforcement Learning with Simultaneous Estimation of Rewards and Dynamics13 Apr 2016 0 repositories listed
-
Theoretically-Grounded Policy Advice from Multiple Teachers in Reinforcement Learning Settings with Applications to Negative Transfer13 Apr 2016 0 repositories listed
-
A statistical learning strategy for closed-loop control of fluid flows11 Apr 2016 0 repositories listed
-
Reinforcement learning based local search for grouping problems: A case study on graph coloring1 Apr 2016 0 repositories listed
-
Optimal Recommendation to Users that React: Online Learning for a Class of POMDPs30 Mar 2016 0 repositories listed
-
Algorithms for Batch Hierarchical Reinforcement Learning29 Mar 2016 0 repositories listed
-
Generating Visual Explanations28 Mar 2016 0 repositories listed
-
Negative Learning Rates and P-Learning27 Mar 2016 0 repositories listed
-
Adaptive Parameter Selection in Evolutionary Algorithms by Reinforcement Learning with Dynamic Discretization of Parameter Range22 Mar 2016 0 repositories listed
-
Fully Convolutional Attention Networks for Fine-Grained Recognition22 Mar 2016 0 repositories listed
-
Learning Dexterous Manipulation for a Soft Robotic Hand from Human Demonstration21 Mar 2016 0 repositories listed
-
Feature Selection as a Multiagent Coordination Problem16 Mar 2016 0 repositories listed
-
A Signaling Game Approach to Databases Querying and Interaction13 Mar 2016 0 repositories listed
-
Hierarchical Linearly-Solvable Markov Decision Problems10 Mar 2016 0 repositories listed
-
Variational Autoencoders for Semi-supervised Text Classification8 Mar 2016 0 repositories listed
-
Differentially Private Policy Evaluation7 Mar 2016 0 repositories listed
-
Learning Shared Representations in Multi-task Reinforcement Learning7 Mar 2016 0 repositories listed
-
Hierarchical Decision Making In Electricity Grid Management6 Mar 2016 0 repositories listed
-
Object Manipulation Learning by Imitation3 Mar 2016 0 repositories listed
-
Multi-Information Source Optimization1 Mar 2016 0 repositories listed
-
Easy Monotonic Policy Iteration29 Feb 2016 0 repositories listed
-
Meta-learning within Projective Simulation25 Feb 2016 0 repositories listed
-
Reinforcement Learning of POMDPs using Spectral Methods25 Feb 2016 0 repositories listed
-
Thompson Sampling is Asymptotically Optimal in General Environments25 Feb 2016 0 repositories listed
-
24 Feb 2016 0 repositories listed
-
Policy Error Bounds for Model-Based Reinforcement Learning with Factored Linear Models19 Feb 2016 0 repositories listed
-
Inverse Reinforcement Learning in Swarm Systems17 Feb 2016 0 repositories listed
-
POMDP-lite for Robust Robot Planning under Uncertainty16 Feb 2016 0 repositories listed
-
Reinforcement Learning approach for Real Time Strategy Games Battle city and S316 Feb 2016 0 repositories listed
-
Training of spiking neural networks based on information theoretic costs15 Feb 2016 0 repositories listed
-
Using Deep Q-Learning to Control Optimization Hyperparameters12 Feb 2016 0 repositories listed
-
Data-Efficient Reinforcement Learning in Continuous-State POMDPs8 Feb 2016 0 repositories listed
-
Graying the black box: Understanding DQNs8 Feb 2016 0 repositories listed
-
Learning to Communicate to Solve Riddles with Deep Distributed Recurrent Q-Networks8 Feb 2016 0 repositories listed
-
PAC Reinforcement Learning with Rich Observations8 Feb 2016 0 repositories listed
-
Active Information Acquisition5 Feb 2016 0 repositories listed
-
Quantum machine learning with glow for episodic tasks and decision games27 Jan 2016 0 repositories listed
-
Towards Resolving Unidentifiability in Inverse Reinforcement Learning25 Jan 2016 0 repositories listed
-
Inverse Reinforcement Learning via Deep Gaussian Process26 Dec 2015 0 repositories listed
-
Information-Theoretic Bounded Rationality21 Dec 2015 0 repositories listed
-
An Empirical Comparison of Neural Architectures for Reinforcement Learning in Partially Observable Environments17 Dec 2015 0 repositories listed
-
Deep Active Object Recognition by Joint Label and Action Prediction17 Dec 2015 0 repositories listed
-
How to Discount Deep Reinforcement Learning: Towards New Dynamic Strategies7 Dec 2015 0 repositories listed
-
Risk-Constrained Reinforcement Learning with Percentile Risk Criteria5 Dec 2015 0 repositories listed
-
Q-Networks for Binary Vector Actions4 Dec 2015 0 repositories listed
-
Reuse of Neural Modules for General Video Game Playing4 Dec 2015 0 repositories listed
-
Deep Reinforcement Learning with Attention for Slate Markov Decision Processes with High-Dimensional States and Actions3 Dec 2015 0 repositories listed
-
Inverse Reinforcement Learning with Locally Consistent Reward Functions1 Dec 2015 0 repositories listed
-
1 Dec 2015 0 repositories listed
-
Multi-Class Multi-Annotator Active Learning With Robust Gaussian Process for Visual Recognition1 Dec 2015 0 repositories listed
-
On Learning to Think: Algorithmic Information Theory for Novel Combinations of Reinforcement Learning Controllers and Recurrent Neural World Models30 Nov 2015 0 repositories listed
-
Reinforcement Learning Applied to an Electric Water Heater: From Theory to Practice29 Nov 2015 0 repositories listed
-
Robotic Search & Rescue via Online Multi-task Reinforcement Learning29 Nov 2015 0 repositories listed