Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 149
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 149 of 152: papers 14,801 to 14,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Regulating Reward Training by Means of Certainty Prediction in a Neural Network-Implemented Pong Game23 Sep 2016 0 repositories listed
-
Learning Modular Neural Network Policies for Multi-Task and Multi-Robot Transfer22 Sep 2016 0 repositories listed
-
Modelling Stock-market Investors as Reinforcement Learning Agents [Correction]20 Sep 2016 0 repositories listed
-
Towards Deep Symbolic Reinforcement Learning18 Sep 2016 0 repositories listed
-
Exploration Potential16 Sep 2016 0 repositories listed
-
Interactive Spoken Content Retrieval by Deep Reinforcement Learning16 Sep 2016 0 repositories listed
-
Bayesian Reinforcement Learning: A Survey14 Sep 2016 0 repositories listed
-
Stochastic evolution in populations of ideas14 Sep 2016 0 repositories listed
-
A centralized reinforcement learning method for multi-agent job scheduling in Grid11 Sep 2016 0 repositories listed
-
Episodic Exploration for Deep Deterministic Policies: An Application to StarCraft Micromanagement Tasks10 Sep 2016 0 repositories listed
-
Dialogue manager domain adaptation using Gaussian process reinforcement learning9 Sep 2016 0 repositories listed
-
Unifying task specification in reinforcement learning7 Sep 2016 0 repositories listed
-
Reward Function and Initial Values: Better Choices for Accelerated Goal-Directed Reinforcement Learning1 Sep 2016 0 repositories listed
-
Single photon in hierarchical architecture for physical reinforcement learning: Photon intelligence1 Sep 2016 0 repositories listed
-
Adaptive Probabilistic Trajectory Optimization via Efficient Approximate Inference22 Aug 2016 0 repositories listed
-
Modeling Human Reading with Neural Attention19 Aug 2016 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems17 Aug 2016 0 repositories listed
-
Open Problem: Approximate Planning of POMDPs in the class of Memoryless Policies17 Aug 2016 0 repositories listed
-
Reinforcement Learning algorithms for regret minimization in structured Markov Decision Processes17 Aug 2016 0 repositories listed
-
Perceptual Reward Functions12 Aug 2016 0 repositories listed
-
Neuroevolution-Based Inverse Reinforcement Learning9 Aug 2016 0 repositories listed
-
On Lower Bounds for Regret in Reinforcement Learning9 Aug 2016 0 repositories listed
-
Online Adaptation of Deep Architectures with Reinforcement Learning8 Aug 2016 0 repositories listed
-
Discovering Latent States for Model Learning: Applying Sensorimotor Contingencies Theory and Predictive Processing to Model Context1 Aug 2016 0 repositories listed
-
Self-organization in a distributed coordination game through heuristic rules31 Jul 2016 0 repositories listed
-
A Sensorimotor Reinforcement Learning Framework for Physical Human-Robot Interaction27 Jul 2016 0 repositories listed
-
Accelerating Stochastic Composition Optimization25 Jul 2016 0 repositories listed
-
Sequential Cost-Sensitive Feature Acquisition13 Jul 2016 0 repositories listed
-
Automatic Bridge Bidding Using Deep Reinforcement Learning12 Jul 2016 0 repositories listed
-
Why is Posterior Sampling Better than Optimism for Reinforcement Learning?1 Jul 2016 0 repositories listed
-
Is the Bellman residual a bad proxy?24 Jun 2016 0 repositories listed
-
Unsupervised preprocessing for Tactile Data23 Jun 2016 0 repositories listed
-
Simultaneous Control and Human Feedback in the Training of a Robotic Agent with Actor-Critic Reinforcement Learning22 Jun 2016 0 repositories listed
-
A Hierarchical Reinforcement Learning Method for Persistent Time-Sensitive Tasks20 Jun 2016 0 repositories listed
-
On Reward Function for Survival18 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning Discovers Internal Models16 Jun 2016 0 repositories listed
-
Successor Features for Transfer in Reinforcement Learning16 Jun 2016 0 repositories listed
-
Deep Reinforcement Learning With Macro-Actions15 Jun 2016 0 repositories listed
-
Natural Language Generation as Planning under Uncertainty Using Reinforcement Learning15 Jun 2016 0 repositories listed
-
Policy Networks with Two-Stage Training for Dialogue Systems10 Jun 2016 0 repositories listed
-
Face valuing: Training user interfaces with facial expressions and reinforcement learning9 Jun 2016 0 repositories listed
-
Continuously Learning Neural Dialogue Management8 Jun 2016 0 repositories listed
-
Adapting Sampling Interval of Sensor Networks Using On-Line Reinforcement Learning7 Jun 2016 0 repositories listed
-
Learning to Optimize6 Jun 2016 0 repositories listed
-
Deep Q-Networks for Accelerating the Training of Deep Neural Networks5 Jun 2016 0 repositories listed
-
Difference of Convex Functions Programming Applied to Control with Expert Data3 Jun 2016 0 repositories listed
-
End-to-end LSTM-based dialog control optimized with supervised and reinforcement learning3 Jun 2016 0 repositories listed
-
Reinforcement Learning for Semantic Segmentation in Indoor Scenes3 Jun 2016 0 repositories listed
-
Death and Suicide in Universal Artificial Intelligence2 Jun 2016 0 repositories listed
-
Reinforcement Learning for Visual Object Detection1 Jun 2016 0 repositories listed
-
Information Theoretically Aided Reinforcement Learning for Embodied Agents31 May 2016 0 repositories listed
-
Control of Memory, Active Perception, and Action in Minecraft30 May 2016 0 repositories listed
-
Model-Free Imitation Learning with Policy Optimization26 May 2016 0 repositories listed
-
A PAC RL Algorithm for Episodic POMDPs25 May 2016 0 repositories listed
-
Localizing by Describing: Attribute-Guided Attention Localization for Fine-Grained Recognition20 May 2016 0 repositories listed
-
Option Discovery in Hierarchical Reinforcement Learning using Spatio-Temporal Clustering17 May 2016 0 repositories listed
-
A Reinforcement Learning System to Encourage Physical Activity in Diabetes Patients13 May 2016 0 repositories listed
-
Optimizing human-interpretable dialog management policy using Genetic Algorithm12 May 2016 0 repositories listed
-
Avoiding Wireheading with Value Reinforcement Learning10 May 2016 0 repositories listed
-
Classifying Options for Deep Reinforcement Learning27 Apr 2016 0 repositories listed
-
Tournament selection in zeroth-level classifier systems based on average reward reinforcement learning26 Apr 2016 0 repositories listed
-
Using Reinforcement Learning to Validate Empirical Game-Theoretic Analysis: A Continuous Double Auction Study22 Apr 2016 0 repositories listed
-
Inverse Reinforcement Learning with Simultaneous Estimation of Rewards and Dynamics13 Apr 2016 0 repositories listed
-
Theoretically-Grounded Policy Advice from Multiple Teachers in Reinforcement Learning Settings with Applications to Negative Transfer13 Apr 2016 0 repositories listed
-
A statistical learning strategy for closed-loop control of fluid flows11 Apr 2016 0 repositories listed
-
Reinforcement learning based local search for grouping problems: A case study on graph coloring1 Apr 2016 0 repositories listed
-
Algorithms for Batch Hierarchical Reinforcement Learning29 Mar 2016 0 repositories listed
-
Negative Learning Rates and P-Learning27 Mar 2016 0 repositories listed
-
Adaptive Parameter Selection in Evolutionary Algorithms by Reinforcement Learning with Dynamic Discretization of Parameter Range22 Mar 2016 0 repositories listed
-
Fully Convolutional Attention Networks for Fine-Grained Recognition22 Mar 2016 0 repositories listed
-
Feature Selection as a Multiagent Coordination Problem16 Mar 2016 0 repositories listed
-
A Signaling Game Approach to Databases Querying and Interaction13 Mar 2016 0 repositories listed
-
Hierarchical Linearly-Solvable Markov Decision Problems10 Mar 2016 0 repositories listed
-
Differentially Private Policy Evaluation7 Mar 2016 0 repositories listed
-
Learning Shared Representations in Multi-task Reinforcement Learning7 Mar 2016 0 repositories listed
-
Hierarchical Decision Making In Electricity Grid Management6 Mar 2016 0 repositories listed
-
Meta-learning within Projective Simulation25 Feb 2016 0 repositories listed
-
Reinforcement Learning of POMDPs using Spectral Methods25 Feb 2016 0 repositories listed
-
Thompson Sampling is Asymptotically Optimal in General Environments25 Feb 2016 0 repositories listed
-
24 Feb 2016 0 repositories listed
-
Policy Error Bounds for Model-Based Reinforcement Learning with Factored Linear Models19 Feb 2016 0 repositories listed
-
Inverse Reinforcement Learning in Swarm Systems17 Feb 2016 0 repositories listed
-
POMDP-lite for Robust Robot Planning under Uncertainty16 Feb 2016 0 repositories listed
-
Reinforcement Learning approach for Real Time Strategy Games Battle city and S316 Feb 2016 0 repositories listed
-
Data-Efficient Reinforcement Learning in Continuous-State POMDPs8 Feb 2016 0 repositories listed
-
Graying the black box: Understanding DQNs8 Feb 2016 0 repositories listed
-
Learning to Communicate to Solve Riddles with Deep Distributed Recurrent Q-Networks8 Feb 2016 0 repositories listed
-
PAC Reinforcement Learning with Rich Observations8 Feb 2016 0 repositories listed
-
Active Information Acquisition5 Feb 2016 0 repositories listed
-
Quantum machine learning with glow for episodic tasks and decision games27 Jan 2016 0 repositories listed
-
Towards Resolving Unidentifiability in Inverse Reinforcement Learning25 Jan 2016 0 repositories listed
-
Inverse Reinforcement Learning via Deep Gaussian Process26 Dec 2015 0 repositories listed
-
An Empirical Comparison of Neural Architectures for Reinforcement Learning in Partially Observable Environments17 Dec 2015 0 repositories listed
-
How to Discount Deep Reinforcement Learning: Towards New Dynamic Strategies7 Dec 2015 0 repositories listed
-
Risk-Constrained Reinforcement Learning with Percentile Risk Criteria5 Dec 2015 0 repositories listed
-
Q-Networks for Binary Vector Actions4 Dec 2015 0 repositories listed
-
Inverse Reinforcement Learning with Locally Consistent Reward Functions1 Dec 2015 0 repositories listed
-
Multi-Class Multi-Annotator Active Learning With Robust Gaussian Process for Visual Recognition1 Dec 2015 0 repositories listed
-
On Learning to Think: Algorithmic Information Theory for Novel Combinations of Reinforcement Learning Controllers and Recurrent Neural World Models30 Nov 2015 0 repositories listed
-
Reinforcement Learning Applied to an Electric Water Heater: From Theory to Practice29 Nov 2015 0 repositories listed