Browse State-of-the-Art › Reinforcement Learning › Papers, page 130
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 130 of 132: papers 12,901 to 13,000 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
On the convergence of cycle detection for navigational reinforcement learning27 Nov 2015 0 repositories listed
-
Incremental Truncated LSTD26 Nov 2015 0 repositories listed
-
Towards Vision-Based Deep Reinforcement Learning for Robotic Motion Control12 Nov 2015 0 repositories listed
-
Learning Unfair Trading: a Market Manipulation Analysis From the Reinforcement Learning Perspective2 Nov 2015 0 repositories listed
-
Generating Text with Deep Reinforcement Learning30 Oct 2015 0 repositories listed
-
Sample Complexity of Episodic Fixed-Horizon Reinforcement Learning29 Oct 2015 0 repositories listed
-
On the Computability of AIXI19 Oct 2015 0 repositories listed
-
Dual Control for Approximate Bayesian Reinforcement Learning13 Oct 2015 0 repositories listed
-
Data-Efficient Learning of Feedback Policies from Image Pixels using Deep Dynamical Models8 Oct 2015 0 repositories listed
-
Efficient Empowerment28 Sep 2015 0 repositories listed
-
Model-based Reinforcement Learning with Parametrized Physical Models and Optimism-Driven Exploration23 Sep 2015 0 repositories listed
-
One-Shot Learning of Manipulation Skills with Online Dynamics Adaptation and Neural Network Priors23 Sep 2015 0 repositories listed
-
Learning Deep Control Policies for Autonomous Aerial Vehicles with MPC-Guided Policy Search22 Sep 2015 0 repositories listed
-
Benchmarking for Bayesian Reinforcement Learning14 Sep 2015 0 repositories listed
-
Optimization of anemia treatment in hemodialysis patients via reinforcement learning14 Sep 2015 0 repositories listed
-
Compatible Value Gradients for Reinforcement Learning of Continuous Deep Policies10 Sep 2015 0 repositories listed
-
Recurrent Reinforcement Learning: A Hybrid Approach10 Sep 2015 0 repositories listed
-
Hyper-parameter Optimisation of Gaussian Process Reinforcement Learning for Statistical Dialogue Management1 Sep 2015 0 repositories listed
-
Optimising Turn-Taking Strategies With Reinforcement Learning1 Sep 2015 0 repositories listed
-
Reinforcement Learning in Multi-Party Trading Dialog1 Sep 2015 0 repositories listed
-
Reinforcement Learning of Multi-Issue Negotiation Dialogue Policies1 Sep 2015 0 repositories listed
-
A Cognitive Architecture Based on a Learning Classifier System with Spiking Classifiers31 Aug 2015 0 repositories listed
-
Learning Efficient Representations for Reinforcement Learning28 Aug 2015 0 repositories listed
-
Multi-agent Reinforcement Learning with Sparse Interactions by Negotiation and Knowledge Transfer21 Aug 2015 0 repositories listed
-
Learning to Predict Independent of Span19 Aug 2015 0 repositories listed
-
Distributed Deep Q-Learning18 Aug 2015 0 repositories listed
-
Reward Shaping with Recurrent Neural Networks for Speeding up On-Line Policy Learning in Spoken Dialogue Systems14 Aug 2015 0 repositories listed
-
Learning from Real Users: Rating Dialogue Success with Neural Networks for Reinforcement Learning in Spoken Dialogue Systems13 Aug 2015 0 repositories listed
-
Episodic Multi-armed Bandits4 Aug 2015 0 repositories listed
-
A Reinforcement Learning Approach to Online Learning of Decision Trees24 Jul 2015 0 repositories listed
-
Reinforcement Learning for the Unit Commitment Problem19 Jul 2015 0 repositories listed
-
On the Computability of Solomonoff Induction and Knowledge-Seeking15 Jul 2015 0 repositories listed
-
Experimental analysis of data-driven control for a building heating system13 Jul 2015 0 repositories listed
-
Online Transfer Learning in Reinforcement Learning Domains2 Jul 2015 0 repositories listed
-
An Empirical Evaluation of True Online TD(λ)1 Jul 2015 0 repositories listed
-
Bootstrapped Thompson Sampling and Deep Exploration1 Jul 2015 0 repositories listed
-
Online Learning to Sample30 Jun 2015 0 repositories listed
-
Bootstrapping Skills11 Jun 2015 0 repositories listed
-
The Online Coupon-Collector Problem and Its Application to Lifelong Reinforcement Learning10 Jun 2015 0 repositories listed
-
Cumulative Prospect Theory Meets Reinforcement Learning: Prediction and Control8 Jun 2015 0 repositories listed
-
A Framework for Constrained and Adaptive Behavior-Based Agents7 Jun 2015 0 repositories listed
-
Local Nonstationarity for Efficient Bayesian Optimization5 Jun 2015 0 repositories listed
-
Safe Policy Search for Lifelong Reinforcement Learning with Sublinear Regret21 May 2015 0 repositories listed
-
A Definition of Happiness for Reinforcement Learning Agents18 May 2015 0 repositories listed
-
Reinforcement Learning applied to Single Neuron15 May 2015 0 repositories listed
-
Context-Aware Mobility Management in HetNets: A Reinforcement Learning Approach7 May 2015 0 repositories listed
-
Optimal Neuron Selection: NK Echo State Networks for Reinforcement Learning7 May 2015 0 repositories listed
-
Reinforced Decision Trees5 May 2015 0 repositories listed
-
Using PCA to Efficiently Represent State Spaces2 May 2015 0 repositories listed
-
Stability of Stochastic Approximations with `Controlled Markov' Noise and Temporal Difference Learning23 Apr 2015 0 repositories listed
-
Optimal Nudging: Solving Average-Reward Semi-Markov Decision Processes as a Minimal Sequence of Cumulative Tasks20 Apr 2015 0 repositories listed
-
Projective simulation with generalization9 Apr 2015 0 repositories listed
-
Autonomous CRM Control via CLV Approximation with Deep Reinforcement Learning in Discrete and Continuous Action Space8 Apr 2015 0 repositories listed
-
Residential Demand Response Applications Using Batch Reinforcement Learning8 Apr 2015 0 repositories listed
-
End-to-End Training of Deep Visuomotor Policies2 Apr 2015 0 repositories listed
-
Universal Psychometrics Tasks: difficulty, composition and decomposition26 Mar 2015 0 repositories listed
-
Correct-by-synthesis reinforcement learning with temporal logic constraints5 Mar 2015 0 repositories listed
-
Reinforcement Learning in a Neurally Controlled Robot Using Dopamine Modulated STDP21 Feb 2015 0 repositories listed
-
Towards Biologically Plausible Deep Learning14 Feb 2015 0 repositories listed
-
Policy Gradient for Coherent Risk Measures13 Feb 2015 0 repositories listed
-
Off-Policy Reward Shaping with Ensembles11 Feb 2015 0 repositories listed
-
Efficient model-based reinforcement learning for approximate online optimal9 Feb 2015 0 repositories listed
-
From Pixels to Torques: Policy Learning with Deep Dynamical Models8 Feb 2015 0 repositories listed
-
Implicit Temporal Differences21 Dec 2014 0 repositories listed
-
Grounding Hierarchical Reinforcement Learning Models for Knowledge Transfer19 Dec 2014 0 repositories listed
-
Regression with Linear Factored Functions19 Dec 2014 0 repositories listed
-
Reinforcement Learning and Nonparametric Detection of Game-Theoretic Equilibrium Play in Social Networks11 Dec 2014 0 repositories listed
-
Deep Learning for Real-Time Atari Game Play Using Offline Monte-Carlo Tree Search Planning1 Dec 2014 0 repositories listed
-
Design Principles of the Hippocampal Cognitive Map1 Dec 2014 0 repositories listed
-
Difference of Convex Functions Programming for Reinforcement Learning1 Dec 2014 0 repositories listed
-
Game-theoretical control with continuous action sets1 Dec 2014 0 repositories listed
-
How hard is my MDP?" The distribution-norm to the rescue"1 Dec 2014 0 repositories listed
-
RAAM: The Benefits of Robustness in Approximating Aggregated MDPs in Reinforcement Learning1 Dec 2014 0 repositories listed
-
Sparse Multi-Task Reinforcement Learning1 Dec 2014 0 repositories listed
-
Weighted importance sampling for off-policy learning with linear function approximation1 Dec 2014 0 repositories listed
-
Multiple Instance Reinforcement Learning for Efficient Weakly-Supervised Detection in Images29 Nov 2014 0 repositories listed
-
Compress and Control19 Nov 2014 0 repositories listed
-
Jamming Bandits13 Nov 2014 0 repositories listed
-
Approachability in Stackelberg Stochastic Games with Vector Costs3 Nov 2014 0 repositories listed
-
A Comparison of learning algorithms on the Arcade Learning Environment31 Oct 2014 0 repositories listed
-
Do Artificial Reinforcement-Learning Agents Matter Morally?30 Oct 2014 0 repositories listed
-
Where do goals come from? A Generic Approach to Autonomous Goal-System Development21 Oct 2014 0 repositories listed
-
Domain-Independent Optimistic Initialization for Reinforcement Learning16 Oct 2014 0 repositories listed
-
Q-learning for Optimal Control of Continuous-time Systems11 Oct 2014 0 repositories listed
-
Deep Sequential Neural Network2 Oct 2014 0 repositories listed
-
Don't Until the Final Verb Wait: Reinforcement Learning for Simultaneous Machine Translation1 Oct 2014 0 repositories listed
-
Fear the REAPER: A System for Automatic Multi-Document Summarization with Reinforcement Learning1 Oct 2014 0 repositories listed
-
An agent-driven semantical identifier using radial basis neural networks and reinforcement learning30 Sep 2014 0 repositories listed
-
The Advantage of Cross Entropy over Entropy in Iterative Information Gathering26 Sep 2014 0 repositories listed
-
Inverse Reinforcement Learning with Multi-Relational Chains for Robot-Centered Smart Home16 Aug 2014 0 repositories listed
-
R-UCB: a Contextual Bandit Algorithm for Risk-Aware Recommender Systems10 Aug 2014 0 repositories listed
-
Probabilistic inverse reinforcement learning in unknown environments9 Aug 2014 0 repositories listed
-
Learning to Cooperate via Policy Search7 Aug 2014 0 repositories listed
-
Reinforcement Learning of Cooperative Persuasive Dialogue Policies using Framing1 Aug 2014 0 repositories listed
-
MONEYBaRL: Exploiting pitcher decision-making using Reinforcement Learning31 Jul 2014 0 repositories listed
-
Learning in games via reinforcement and regularization23 Jul 2014 0 repositories listed
-
Practical Kernel-Based Reinforcement Learning21 Jul 2014 0 repositories listed
-
Extreme State Aggregation Beyond MDPs12 Jul 2014 0 repositories listed
-
Reinforcement Learning Based Algorithm for the Maximization of EV Charging Station Revenue4 Jul 2014 0 repositories listed
-
Classification-based Approximate Policy Iteration: Experiments and Extended Discussions2 Jul 2014 0 repositories listed