Browse State-of-the-Art › reinforcement-learning › Papers, page 134
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 134 of 135: papers 13,301 to 13,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Practical Kernel-Based Reinforcement Learning21 Jul 2014 0 repositories listed
-
Extreme State Aggregation Beyond MDPs12 Jul 2014 0 repositories listed
-
Reinforcement Learning Based Algorithm for the Maximization of EV Charging Station Revenue4 Jul 2014 0 repositories listed
-
Thompson Sampling for Learning Parameterized Markov Decision Processes29 Jun 2014 0 repositories listed
-
Reinforcement and Imitation Learning via Interactive No-Regret Learning23 Jun 2014 0 repositories listed
-
Personalized Medical Treatments Using Novel Reinforcement Learning Algorithms16 Jun 2014 0 repositories listed
-
Multi-objective Reinforcement Learning with Continuous Pareto Frontier Approximation Supplementary Material13 Jun 2014 0 repositories listed
-
Model-based Reinforcement Learning and the Eluder Dimension7 Jun 2014 0 repositories listed
-
Comparing Multi-label Classification with Reinforcement Learning for Summarisation of Time-series Data1 Jun 2014 0 repositories listed
-
Proximal Reinforcement Learning: A New Theory of Sequential Decision Making in Primal-Dual Spaces26 May 2014 0 repositories listed
-
Off-Policy Shaping Ensembles in Reinforcement Learning21 May 2014 0 repositories listed
-
Projective simulation applied to the grid-world and the mountain-car problem21 May 2014 0 repositories listed
-
Selecting Near-Optimal Approximate State Representations in Reinforcement Learning12 May 2014 0 repositories listed
-
Structural Return Maximization for Reinforcement Learning12 May 2014 0 repositories listed
-
DINASTI: Dialogues with a Negotiating Appointment Setting Interface1 May 2014 0 repositories listed
-
Undirected Machine Translation with Discriminative Reinforcement Learning1 Apr 2014 0 repositories listed
-
Comparison of Multi-agent and Single-agent Inverse Learning on a Simulated Soccer Example26 Mar 2014 0 repositories listed
-
Multi-agent Inverse Reinforcement Learning for Two-person Zero-sum Games25 Mar 2014 0 repositories listed
-
Near-optimal Reinforcement Learning in Factored MDPs15 Mar 2014 0 repositories listed
-
Safe Exploration of State and Action Spaces in Reinforcement Learning4 Feb 2014 0 repositories listed
-
Kalman Temporal Differences16 Jan 2014 0 repositories listed
-
Non-Deterministic Policies in Markovian Decision Processes16 Jan 2014 0 repositories listed
-
A Multiagent Reinforcement Learning Algorithm with Non-linear Dynamics15 Jan 2014 0 repositories listed
-
Learning Partially Observable Deterministic Action Models15 Jan 2014 0 repositories listed
-
Exploiting generalisation symmetries in accuracy-based learning classifier systems: An initial study10 Jan 2014 0 repositories listed
-
DJ-MC: A Reinforcement-Learning Agent for Music Playlist Recommendation9 Jan 2014 0 repositories listed
-
Optimal Demand Response Using Device Based Reinforcement Learning8 Jan 2014 0 repositories listed
-
Bellman Error Based Feature Generation using Random Projections on Sparse Spaces1 Dec 2013 0 repositories listed
-
Efficient Exploration and Value Function Generalization in Deterministic Systems1 Dec 2013 0 repositories listed
-
Policy Shaping: Integrating Human Feedback with Reinforcement Learning1 Dec 2013 0 repositories listed
-
Projected Natural Actor-Critic1 Dec 2013 0 repositories listed
-
Reinforcement Learning in Robust Markov Decision Processes1 Dec 2013 0 repositories listed
-
Off-policy reinforcement learning for H_∞ control design24 Nov 2013 0 repositories listed
-
Risk-sensitive Reinforcement Learning8 Nov 2013 0 repositories listed
-
Exploration in Interactive Personalized Music Recommendation: A Reinforcement Learning Approach6 Nov 2013 0 repositories listed
-
Reinforcement Learning for Matrix Computations: PageRank as an Example1 Nov 2013 0 repositories listed
-
Reinforcement Learning Framework for Opportunistic Routing in WSNs31 Oct 2013 0 repositories listed
-
Distributed Reinforcement Learning via Gossip28 Oct 2013 0 repositories listed
-
Sample Complexity of Multi-task Reinforcement Learning26 Sep 2013 0 repositories listed
-
The Sample-Complexity of General Reinforcement Learning22 Aug 2013 0 repositories listed
-
Coevolutionary networks of reinforcement-learning agents5 Aug 2013 0 repositories listed
-
Generating Student Feedback from Time-Series Data Using Reinforcement Learning1 Aug 2013 0 repositories listed
-
Reinforcement Learning of Two-Issue Negotiation Dialogue Policies1 Aug 2013 0 repositories listed
-
Sequential Transfer in Multi-armed Bandit with Finite Set of Models25 Jul 2013 0 repositories listed
-
Efficient Reinforcement Learning in Deterministic Systems with Value Function Generalization18 Jul 2013 0 repositories listed
-
Probabilistic inverse reinforcement learning in unknown environments14 Jul 2013 0 repositories listed
-
Multi-Task Policy Search2 Jul 2013 0 repositories listed
-
Scaling Up Robust MDPs by Reinforcement Learning26 Jun 2013 0 repositories listed
-
Reinforcement learning with restrictions on the action set12 Jun 2013 0 repositories listed
-
The association problem in wireless networks: a Policy Gradient Reinforcement Learning approach11 Jun 2013 0 repositories listed
-
Direct Uncertainty Estimation in Reinforcement Learning6 Jun 2013 0 repositories listed
-
(More) Efficient Reinforcement Learning via Posterior Sampling4 Jun 2013 0 repositories listed
-
Reinforcement Learning for the Soccer Dribbling Task28 May 2013 0 repositories listed
-
Cover Tree Bayesian Reinforcement Learning8 May 2013 0 repositories listed
-
Regret Bounds for Reinforcement Learning with Policy Advice5 May 2013 0 repositories listed
-
Non Deterministic Logic Programs26 Apr 2013 0 repositories listed
-
A General Framework for Interacting Bayes-Optimally with Self-Interested Agents using Arbitrary Parametric Model and Model Prior7 Apr 2013 0 repositories listed
-
Model-based Bayesian Reinforcement Learning for Dialogue Management5 Apr 2013 0 repositories listed
-
ABC Reinforcement Learning27 Mar 2013 0 repositories listed
-
Efficient Reinforcement Learning for High Dimensional Linear Quadratic Systems24 Mar 2013 0 repositories listed
-
A Greedy Approximation of Bayesian Reinforcement Learning with Probably Optimistic Transition Model13 Mar 2013 0 repositories listed
-
Toggling a Genetic Switch Using Reinforcement Learning12 Mar 2013 0 repositories listed
-
Online Regret Bounds for Undiscounted Continuous Reinforcement Learning11 Feb 2013 0 repositories listed
-
The Optimal Reward Baseline for Gradient-Based Reinforcement Learning10 Jan 2013 0 repositories listed
-
Reinforcement learning for port-Hamiltonian systems21 Dec 2012 0 repositories listed
-
Algorithms for Learning Markov Field Policies1 Dec 2012 0 repositories listed
-
Bayesian Hierarchical Reinforcement Learning1 Dec 2012 0 repositories listed
-
Cost-Sensitive Exploration in Bayesian Reinforcement Learning1 Dec 2012 0 repositories listed
-
Exploration in Model-based Reinforcement Learning by Empirically Estimating Learning Progress1 Dec 2012 0 repositories listed
-
Inverse Reinforcement Learning through Structured Classification1 Dec 2012 0 repositories listed
-
Neurally Plausible Reinforcement Learning of Working Memory Tasks1 Dec 2012 0 repositories listed
-
Nonparametric Bayesian Inverse Reinforcement Learning for Multiple Reward Functions1 Dec 2012 0 repositories listed
-
On-line Reinforcement Learning Using Incremental Kernel-Based Stochastic Factorization1 Dec 2012 0 repositories listed
-
Sketch-Based Linear Value Function Approximation1 Dec 2012 0 repositories listed
-
Transferring Expectations in Model-based Reinforcement Learning1 Dec 2012 0 repositories listed
-
Weighted Likelihood Policy Search with Model Selection1 Dec 2012 0 repositories listed
-
TACT: A Transfer Actor-Critic Learning Framework for Energy Saving in Cellular Radio Access Networks28 Nov 2012 0 repositories listed
-
Autonomous Reinforcement of Behavioral Sequences in Neural Dynamics12 Oct 2012 0 repositories listed
-
APRIL: Active Preference-learning based Reinforcement Learning5 Aug 2012 0 repositories listed
-
Framework of Automatic Text Summarization Using Reinforcement Learning1 Jul 2012 0 repositories listed
-
Reinforcement Learning of Question-Answering Dialogue Policies for Virtual Museum Guides1 Jul 2012 0 repositories listed
-
Monte Carlo Bayesian Reinforcement Learning27 Jun 2012 0 repositories listed
-
Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods20 Jun 2012 0 repositories listed
-
Efficient Bayes-Adaptive Reinforcement Learning using Sample-Based Search14 May 2012 0 repositories listed
-
A Comparative Study of Reinforcement Learning Techniques on Dialogue Management1 Apr 2012 0 repositories listed
-
PAC-Bayesian Policy Evaluation for Reinforcement Learning14 Feb 2012 0 repositories listed
-
Multi-timescale Nexting in a Reinforcement Learning Robot6 Dec 2011 0 repositories listed
-
A Reinforcement Learning Theory for Homeostatic Regulation1 Dec 2011 0 repositories listed
-
Action-Gap Phenomenon in Reinforcement Learning1 Dec 2011 0 repositories listed
-
Analysis and Improvement of Policy Gradient Estimation1 Dec 2011 0 repositories listed
-
Blending Autonomous Exploration and Apprenticeship Learning1 Dec 2011 0 repositories listed
-
MAP Inference for Bayesian Inverse Reinforcement Learning1 Dec 2011 0 repositories listed
-
Optimal Reinforcement Learning for Gaussian Systems1 Dec 2011 0 repositories listed
-
Policy Gradient Coagent Networks1 Dec 2011 0 repositories listed
-
Reinforcement Learning using Kernel-Based Stochastic Factorization1 Dec 2011 0 repositories listed
-
Selecting the State-Representation in Reinforcement Learning1 Dec 2011 0 repositories listed
-
Transfer from Multiple MDPs1 Dec 2011 0 repositories listed
-
Risk-Sensitive Reinforcement Learning Applied to Control under Constraints9 Sep 2011 0 repositories listed
-
Constructing Skill Trees for Reinforcement Learning Agents from Demonstration Trajectories1 Dec 2010 0 repositories listed
-
1 Dec 2010 0 repositories listed