Browse State-of-the-Art › Reinforcement Learning › Papers, page 131
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 131 of 132: papers 13,001 to 13,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Thompson Sampling for Learning Parameterized Markov Decision Processes29 Jun 2014 0 repositories listed
-
Reinforcement and Imitation Learning via Interactive No-Regret Learning23 Jun 2014 0 repositories listed
-
Personalized Medical Treatments Using Novel Reinforcement Learning Algorithms16 Jun 2014 0 repositories listed
-
Multi-objective Reinforcement Learning with Continuous Pareto Frontier Approximation Supplementary Material13 Jun 2014 0 repositories listed
-
Model-based Reinforcement Learning and the Eluder Dimension7 Jun 2014 0 repositories listed
-
Comparing Multi-label Classification with Reinforcement Learning for Summarisation of Time-series Data1 Jun 2014 0 repositories listed
-
Single-Agent vs. Multi-Agent Techniques for Concurrent Reinforcement Learning of Negotiation Dialogue Policies1 Jun 2014 0 repositories listed
-
Proximal Reinforcement Learning: A New Theory of Sequential Decision Making in Primal-Dual Spaces26 May 2014 0 repositories listed
-
Efficient Model Learning for Human-Robot Collaborative Tasks24 May 2014 0 repositories listed
-
Off-Policy Shaping Ensembles in Reinforcement Learning21 May 2014 0 repositories listed
-
Projective simulation applied to the grid-world and the mountain-car problem21 May 2014 0 repositories listed
-
Selecting Near-Optimal Approximate State Representations in Reinforcement Learning12 May 2014 0 repositories listed
-
Structural Return Maximization for Reinforcement Learning12 May 2014 0 repositories listed
-
DINASTI: Dialogues with a Negotiating Appointment Setting Interface1 May 2014 0 repositories listed
-
Optimistic Risk Perception in the Temporal Difference error Explains the Relation between Risk-taking, Gambling, Sensation-seeking and Low Fear8 Apr 2014 0 repositories listed
-
Undirected Machine Translation with Discriminative Reinforcement Learning1 Apr 2014 0 repositories listed
-
Optimal Cooperative Cognitive Relaying and Spectrum Access for an Energy Harvesting Cognitive Radio: Reinforcement Learning Approach30 Mar 2014 0 repositories listed
-
Comparison of Multi-agent and Single-agent Inverse Learning on a Simulated Soccer Example26 Mar 2014 0 repositories listed
-
Multi-agent Inverse Reinforcement Learning for Two-person Zero-sum Games25 Mar 2014 0 repositories listed
-
Adaptive MCMC-Based Inference in Probabilistic Logic Programs24 Mar 2014 0 repositories listed
-
Simultaneous Perturbation Algorithms for Batch Off-Policy Search18 Mar 2014 0 repositories listed
-
Near-optimal Reinforcement Learning in Factored MDPs15 Mar 2014 0 repositories listed
-
Intrinsically Motivated Learning of Visual Motion Perception and Smooth Pursuit14 Feb 2014 0 repositories listed
-
Better Optimism By Bayes: Adaptive Planning with Rich Models9 Feb 2014 0 repositories listed
-
Frequency-Based Patrolling with Heterogeneous Agents and Limited Communication7 Feb 2014 0 repositories listed
-
Online Stochastic Optimization under Correlated Bandit Feedback4 Feb 2014 0 repositories listed
-
Safe Exploration of State and Action Spaces in Reinforcement Learning4 Feb 2014 0 repositories listed
-
Kalman Temporal Differences16 Jan 2014 0 repositories listed
-
Non-Deterministic Policies in Markovian Decision Processes16 Jan 2014 0 repositories listed
-
A Multiagent Reinforcement Learning Algorithm with Non-linear Dynamics15 Jan 2014 0 repositories listed
-
Learning Partially Observable Deterministic Action Models15 Jan 2014 0 repositories listed
-
Exploiting generalisation symmetries in accuracy-based learning classifier systems: An initial study10 Jan 2014 0 repositories listed
-
DJ-MC: A Reinforcement-Learning Agent for Music Playlist Recommendation9 Jan 2014 0 repositories listed
-
Optimal Demand Response Using Device Based Reinforcement Learning8 Jan 2014 0 repositories listed
-
Distributed Policy Evaluation Under Multiple Behavior Strategies30 Dec 2013 0 repositories listed
-
Avoiding Confusion between Predictors and Inhibitors in Value Function Approximation19 Dec 2013 0 repositories listed
-
Adaptive Step-Size for Policy Gradient Methods1 Dec 2013 0 repositories listed
-
Bellman Error Based Feature Generation using Random Projections on Sparse Spaces1 Dec 2013 0 repositories listed
-
Efficient Exploration and Value Function Generalization in Deterministic Systems1 Dec 2013 0 repositories listed
-
Efficient Learning and Planning with Compressed Predictive States1 Dec 2013 0 repositories listed
-
Optimistic policy iteration and natural actor-critic: A unifying view and a non-optimality result1 Dec 2013 0 repositories listed
-
Policy Shaping: Integrating Human Feedback with Reinforcement Learning1 Dec 2013 0 repositories listed
-
Projected Natural Actor-Critic1 Dec 2013 0 repositories listed
-
Reinforcement Learning in Robust Markov Decision Processes1 Dec 2013 0 repositories listed
-
Off-policy reinforcement learning for H_∞ control design24 Nov 2013 0 repositories listed
-
On the definition of a general learning system with user-defined operators18 Nov 2013 0 repositories listed
-
Clustering Markov Decision Processes For Continual Transfer15 Nov 2013 0 repositories listed
-
Risk-sensitive Reinforcement Learning8 Nov 2013 0 repositories listed
-
Exploring Deep and Recurrent Architectures for Optimal Control7 Nov 2013 0 repositories listed
-
Exploration in Interactive Personalized Music Recommendation: A Reinforcement Learning Approach6 Nov 2013 0 repositories listed
-
Data-based approximate policy iteration for nonlinear continuous-time optimal control design2 Nov 2013 0 repositories listed
-
Reinforcement Learning for Matrix Computations: PageRank as an Example1 Nov 2013 0 repositories listed
-
Reinforcement Learning Framework for Opportunistic Routing in WSNs31 Oct 2013 0 repositories listed
-
Distributed Reinforcement Learning via Gossip28 Oct 2013 0 repositories listed
-
Sample Complexity of Multi-task Reinforcement Learning26 Sep 2013 0 repositories listed
-
Temporal-Difference Learning to Assist Human Decision Making during the Control of an Artificial Limb18 Sep 2013 0 repositories listed
-
The Sample-Complexity of General Reinforcement Learning22 Aug 2013 0 repositories listed
-
Coevolutionary networks of reinforcement-learning agents5 Aug 2013 0 repositories listed
-
Evaluating State Representations for Reinforcement Learning of Turn-Taking Policies in Tutorial Dialogue1 Aug 2013 0 repositories listed
-
Generating Student Feedback from Time-Series Data Using Reinforcement Learning1 Aug 2013 0 repositories listed
-
Reinforcement Learning of Two-Issue Negotiation Dialogue Policies1 Aug 2013 0 repositories listed
-
Sequential Transfer in Multi-armed Bandit with Finite Set of Models25 Jul 2013 0 repositories listed
-
Model-Based Policy Gradients with Parameter-Based Exploration by Least-Squares Conditional Density Estimation19 Jul 2013 0 repositories listed
-
Efficient Reinforcement Learning in Deterministic Systems with Value Function Generalization18 Jul 2013 0 repositories listed
-
Probabilistic inverse reinforcement learning in unknown environments14 Jul 2013 0 repositories listed
-
Multi-Task Policy Search2 Jul 2013 0 repositories listed
-
Scaling Up Robust MDPs by Reinforcement Learning26 Jun 2013 0 repositories listed
-
Reinforcement learning with restrictions on the action set12 Jun 2013 0 repositories listed
-
The association problem in wireless networks: a Policy Gradient Reinforcement Learning approach11 Jun 2013 0 repositories listed
-
Direct Uncertainty Estimation in Reinforcement Learning6 Jun 2013 0 repositories listed
-
Policy Search: Any Local Optimum Enjoys a Global Performance Guarantee6 Jun 2013 0 repositories listed
-
(More) Efficient Reinforcement Learning via Posterior Sampling4 Jun 2013 0 repositories listed
-
Real-world Transfer of Evolved Artificial Immune System Behaviours between Small and Large Scale Robotic Platforms31 May 2013 0 repositories listed
-
Reinforcement Learning for the Soccer Dribbling Task28 May 2013 0 repositories listed
-
Estimating or Propagating Gradients Through Stochastic Neurons14 May 2013 0 repositories listed
-
Geiringer Theorems: From Population Genetics to Computational Intelligence, Memory Evolutive Systems and Hebbian Learning11 May 2013 0 repositories listed
-
Cover Tree Bayesian Reinforcement Learning8 May 2013 0 repositories listed
-
Projective simulation for classical learning agents: a comprehensive investigation7 May 2013 0 repositories listed
-
Regret Bounds for Reinforcement Learning with Policy Advice5 May 2013 0 repositories listed
-
Non Deterministic Logic Programs26 Apr 2013 0 repositories listed
-
A General Framework for Interacting Bayes-Optimally with Self-Interested Agents using Arbitrary Parametric Model and Model Prior7 Apr 2013 0 repositories listed
-
Model-based Bayesian Reinforcement Learning for Dialogue Management5 Apr 2013 0 repositories listed
-
Design for a Darwinian Brain: Part 2. Cognitive Architecture28 Mar 2013 0 repositories listed
-
ABC Reinforcement Learning27 Mar 2013 0 repositories listed
-
Efficient Reinforcement Learning for High Dimensional Linear Quadratic Systems24 Mar 2013 0 repositories listed
-
A Greedy Approximation of Bayesian Reinforcement Learning with Probably Optimistic Transition Model13 Mar 2013 0 repositories listed
-
Toggling a Genetic Switch Using Reinforcement Learning12 Mar 2013 0 repositories listed
-
Hybrid Q-Learning Applied to Ubiquitous recommender system10 Mar 2013 0 repositories listed
-
Online Regret Bounds for Undiscounted Continuous Reinforcement Learning11 Feb 2013 0 repositories listed
-
The Optimal Reward Baseline for Gradient-Based Reinforcement Learning10 Jan 2013 0 repositories listed
-
Reinforcement learning for port-Hamiltonian systems21 Dec 2012 0 repositories listed
-
Algorithms for Learning Markov Field Policies1 Dec 2012 0 repositories listed
-
Bayesian Hierarchical Reinforcement Learning1 Dec 2012 0 repositories listed
-
Cost-Sensitive Exploration in Bayesian Reinforcement Learning1 Dec 2012 0 repositories listed
-
Exploration in Model-based Reinforcement Learning by Empirically Estimating Learning Progress1 Dec 2012 0 repositories listed
-
Hierarchical Optimistic Region Selection driven by Curiosity1 Dec 2012 0 repositories listed
-
Inverse Reinforcement Learning through Structured Classification1 Dec 2012 0 repositories listed
-
Learned Prioritization for Trading Off Accuracy and Speed1 Dec 2012 0 repositories listed
-
Neurally Plausible Reinforcement Learning of Working Memory Tasks1 Dec 2012 0 repositories listed
-
Nonparametric Bayesian Inverse Reinforcement Learning for Multiple Reward Functions1 Dec 2012 0 repositories listed