Browse State-of-the-Art › Reinforcement Learning › Papers, page 132
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 132 of 132: papers 13,101 to 13,178 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
On-line Reinforcement Learning Using Incremental Kernel-Based Stochastic Factorization1 Dec 2012 0 repositories listed
-
Sketch-Based Linear Value Function Approximation1 Dec 2012 0 repositories listed
-
Timely Object Recognition1 Dec 2012 0 repositories listed
-
Transferring Expectations in Model-based Reinforcement Learning1 Dec 2012 0 repositories listed
-
Value Pursuit Iteration1 Dec 2012 0 repositories listed
-
Weighted Likelihood Policy Search with Model Selection1 Dec 2012 0 repositories listed
-
TACT: A Transfer Actor-Critic Learning Framework for Energy Saving in Cellular Radio Access Networks28 Nov 2012 0 repositories listed
-
Autonomous Reinforcement of Behavioral Sequences in Neural Dynamics12 Oct 2012 0 repositories listed
-
APRIL: Active Preference-learning based Reinforcement Learning5 Aug 2012 0 repositories listed
-
Framework of Automatic Text Summarization Using Reinforcement Learning1 Jul 2012 0 repositories listed
-
Reinforcement Learning of Question-Answering Dialogue Policies for Virtual Museum Guides1 Jul 2012 0 repositories listed
-
Monte Carlo Bayesian Reinforcement Learning27 Jun 2012 0 repositories listed
-
Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods20 Jun 2012 0 repositories listed
-
Path Integral Policy Improvement with Covariance Matrix Adaptation18 Jun 2012 0 repositories listed
-
Efficient Bayes-Adaptive Reinforcement Learning using Sample-Based Search14 May 2012 0 repositories listed
-
A Comparative Study of Reinforcement Learning Techniques on Dialogue Management1 Apr 2012 0 repositories listed
-
PAC-Bayesian Policy Evaluation for Reinforcement Learning14 Feb 2012 0 repositories listed
-
Multi-timescale Nexting in a Reinforcement Learning Robot6 Dec 2011 0 repositories listed
-
A Reinforcement Learning Theory for Homeostatic Regulation1 Dec 2011 0 repositories listed
-
A reinterpretation of the policy oscillation phenomenon in approximate policy iteration1 Dec 2011 0 repositories listed
-
Action-Gap Phenomenon in Reinforcement Learning1 Dec 2011 0 repositories listed
-
Analysis and Improvement of Policy Gradient Estimation1 Dec 2011 0 repositories listed
-
Blending Autonomous Exploration and Apprenticeship Learning1 Dec 2011 0 repositories listed
-
Clustering via Dirichlet Process Mixture Models for Portable Skill Discovery1 Dec 2011 0 repositories listed
-
Learning to Agglomerate Superpixel Hierarchies1 Dec 2011 0 repositories listed
-
MAP Inference for Bayesian Inverse Reinforcement Learning1 Dec 2011 0 repositories listed
-
Optimal Reinforcement Learning for Gaussian Systems1 Dec 2011 0 repositories listed
-
Policy Gradient Coagent Networks1 Dec 2011 0 repositories listed
-
Reinforcement Learning using Kernel-Based Stochastic Factorization1 Dec 2011 0 repositories listed
-
Selecting the State-Representation in Reinforcement Learning1 Dec 2011 0 repositories listed
-
The Fixed Points of Off-Policy TD1 Dec 2011 0 repositories listed
-
Transfer from Multiple MDPs1 Dec 2011 0 repositories listed
-
Risk-Sensitive Reinforcement Learning Applied to Control under Constraints9 Sep 2011 0 repositories listed
-
Infinite-Horizon Policy-Gradient Estimation3 Jun 2011 0 repositories listed
-
A Reduction from Apprenticeship Learning to Classification1 Dec 2010 0 repositories listed
-
Bootstrapping Apprenticeship Learning1 Dec 2010 0 repositories listed
-
Constructing Skill Trees for Reinforcement Learning Agents from Demonstration Trajectories1 Dec 2010 0 repositories listed
-
1 Dec 2010 0 repositories listed
-
Feature Construction for Inverse Reinforcement Learning1 Dec 2010 0 repositories listed
-
Interval Estimation for Reinforcement-Learning Algorithms in Continuous-State Domains1 Dec 2010 0 repositories listed
-
Linear Complementarity for Regularized Policy Evaluation and Improvement1 Dec 2010 0 repositories listed
-
LSTD with Random Projections1 Dec 2010 0 repositories listed
-
Nonparametric Bayesian Policy Priors for Reinforcement Learning1 Dec 2010 0 repositories listed
-
On a Connection between Importance Sampling and the Likelihood Ratio Policy Gradient1 Dec 2010 0 repositories listed
-
PAC-Bayesian Model Selection for Reinforcement Learning1 Dec 2010 0 repositories listed
-
Predictive State Temporal Difference Learning1 Dec 2010 0 repositories listed
-
Fast Reinforcement Learning for Energy-Efficient Wireless Communications29 Sep 2010 0 repositories listed
-
Reinforcement Learning via AIXI Approximation13 Jul 2010 0 repositories listed
-
Computational Model of Music Sight Reading: A Reinforcement Learning Approach4 Jul 2010 0 repositories listed
-
Feature Selection as a One-Player Game17 May 2010 0 repositories listed
-
A Generalized Natural Actor-Critic Algorithm1 Dec 2009 0 repositories listed
-
Code-specific policy gradient rules for spiking neurons1 Dec 2009 0 repositories listed
-
Discrete MDL Predicts in Total Variation1 Dec 2009 0 repositories listed
-
Learning to Explore and Exploit in POMDPs1 Dec 2009 0 repositories listed
-
Manifold Embeddings for Model-Based Reinforcement Learning under Partial Observability1 Dec 2009 0 repositories listed
-
Skill Discovery in Continuous Reinforcement Learning Domains using Skill Chaining1 Dec 2009 0 repositories listed
-
Solving Stochastic Games1 Dec 2009 0 repositories listed
-
The Infinite Partially Observable Markov Decision Process1 Dec 2009 0 repositories listed
-
Training Factor Graphs with Reinforcement Learning for Efficient MAP Inference1 Dec 2009 0 repositories listed
-
A computational model of hippocampal function in trace conditioning1 Dec 2008 0 repositories listed
-
Bayesian Kernel Shaping for Learning Control1 Dec 2008 0 repositories listed
-
Hebbian Learning of Bayes Optimal Decisions1 Dec 2008 0 repositories listed
-
Multi-resolution Exploration in Continuous Spaces1 Dec 2008 0 repositories listed
-
Near-optimal Regret Bounds for Reinforcement Learning1 Dec 2008 0 repositories listed
-
Optimization on a Budget: A Reinforcement Learning Approach1 Dec 2008 0 repositories listed
-
Policy Search for Motor Primitives in Robotics1 Dec 2008 0 repositories listed
-
Regularized Policy Iteration1 Dec 2008 0 repositories listed
-
Signal-to-Noise Ratio Analysis of Policy Gradient Algorithms1 Dec 2008 0 repositories listed
-
Structure Learning in Human Sequential Decision-Making1 Dec 2008 0 repositories listed
-
Temporal Difference Based Actor Critic Learning - Convergence and Neural Implementation1 Dec 2008 0 repositories listed
-
Temporal Dynamics of Cognitive Control1 Dec 2008 0 repositories listed
-
Fitted Q-iteration in continuous action-space MDPs1 Dec 2007 0 repositories listed
-
Online Linear Regression and Its Application to Model-Based Reinforcement Learning1 Dec 2007 0 repositories listed
-
Receding Horizon Differential Dynamic Programming1 Dec 2007 0 repositories listed
-
Scan Strategies for Meteorological Radars1 Dec 2007 0 repositories listed
-
Reinforcement Learning: A Survey1 May 1996 0 repositories listed
-
Accidental exploration through value predictors0 repositories listed
-
FROM DEEP LEARNING TO DEEP DEDUCING: AUTOMATICALLY TRACKING DOWN NASH EQUILIBRIUM THROUGH AUTONOMOUS NEURAL AGENT, A POSSIBLE MISSING STEP TOWARD GENERAL A.I.0 repositories listed