Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 150
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 150 of 152: papers 14,901 to 15,000 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Robotic Search & Rescue via Online Multi-task Reinforcement Learning29 Nov 2015 0 repositories listed
-
On the convergence of cycle detection for navigational reinforcement learning27 Nov 2015 0 repositories listed
-
Towards Vision-Based Deep Reinforcement Learning for Robotic Motion Control12 Nov 2015 0 repositories listed
-
Learning Unfair Trading: a Market Manipulation Analysis From the Reinforcement Learning Perspective2 Nov 2015 0 repositories listed
-
Generating Text with Deep Reinforcement Learning30 Oct 2015 0 repositories listed
-
Sample Complexity of Episodic Fixed-Horizon Reinforcement Learning29 Oct 2015 0 repositories listed
-
On the Computability of AIXI19 Oct 2015 0 repositories listed
-
Dual Control for Approximate Bayesian Reinforcement Learning13 Oct 2015 0 repositories listed
-
Data-Efficient Learning of Feedback Policies from Image Pixels using Deep Dynamical Models8 Oct 2015 0 repositories listed
-
Model-based Reinforcement Learning with Parametrized Physical Models and Optimism-Driven Exploration23 Sep 2015 0 repositories listed
-
One-Shot Learning of Manipulation Skills with Online Dynamics Adaptation and Neural Network Priors23 Sep 2015 0 repositories listed
-
Learning Deep Control Policies for Autonomous Aerial Vehicles with MPC-Guided Policy Search22 Sep 2015 0 repositories listed
-
Benchmarking for Bayesian Reinforcement Learning14 Sep 2015 0 repositories listed
-
Optimization of anemia treatment in hemodialysis patients via reinforcement learning14 Sep 2015 0 repositories listed
-
Compatible Value Gradients for Reinforcement Learning of Continuous Deep Policies10 Sep 2015 0 repositories listed
-
Recurrent Reinforcement Learning: A Hybrid Approach10 Sep 2015 0 repositories listed
-
Hyper-parameter Optimisation of Gaussian Process Reinforcement Learning for Statistical Dialogue Management1 Sep 2015 0 repositories listed
-
Optimising Turn-Taking Strategies With Reinforcement Learning1 Sep 2015 0 repositories listed
-
Reinforcement Learning in Multi-Party Trading Dialog1 Sep 2015 0 repositories listed
-
Reinforcement Learning of Multi-Issue Negotiation Dialogue Policies1 Sep 2015 0 repositories listed
-
A Cognitive Architecture Based on a Learning Classifier System with Spiking Classifiers31 Aug 2015 0 repositories listed
-
Learning Efficient Representations for Reinforcement Learning28 Aug 2015 0 repositories listed
-
Multi-agent Reinforcement Learning with Sparse Interactions by Negotiation and Knowledge Transfer21 Aug 2015 0 repositories listed
-
Distributed Deep Q-Learning18 Aug 2015 0 repositories listed
-
A Reinforcement Learning Approach to Online Learning of Decision Trees24 Jul 2015 0 repositories listed
-
Reinforcement Learning for the Unit Commitment Problem19 Jul 2015 0 repositories listed
-
On the Computability of Solomonoff Induction and Knowledge-Seeking15 Jul 2015 0 repositories listed
-
Experimental analysis of data-driven control for a building heating system13 Jul 2015 0 repositories listed
-
Online Transfer Learning in Reinforcement Learning Domains2 Jul 2015 0 repositories listed
-
Bootstrapped Thompson Sampling and Deep Exploration1 Jul 2015 0 repositories listed
-
Bootstrapping Skills11 Jun 2015 0 repositories listed
-
The Online Coupon-Collector Problem and Its Application to Lifelong Reinforcement Learning10 Jun 2015 0 repositories listed
-
Cumulative Prospect Theory Meets Reinforcement Learning: Prediction and Control8 Jun 2015 0 repositories listed
-
A Framework for Constrained and Adaptive Behavior-Based Agents7 Jun 2015 0 repositories listed
-
Local Nonstationarity for Efficient Bayesian Optimization5 Jun 2015 0 repositories listed
-
Safe Policy Search for Lifelong Reinforcement Learning with Sublinear Regret21 May 2015 0 repositories listed
-
A Definition of Happiness for Reinforcement Learning Agents18 May 2015 0 repositories listed
-
Reinforcement Learning applied to Single Neuron15 May 2015 0 repositories listed
-
Context-Aware Mobility Management in HetNets: A Reinforcement Learning Approach7 May 2015 0 repositories listed
-
Optimal Neuron Selection: NK Echo State Networks for Reinforcement Learning7 May 2015 0 repositories listed
-
Stability of Stochastic Approximations with `Controlled Markov' Noise and Temporal Difference Learning23 Apr 2015 0 repositories listed
-
Residential Demand Response Applications Using Batch Reinforcement Learning8 Apr 2015 0 repositories listed
-
Correct-by-synthesis reinforcement learning with temporal logic constraints5 Mar 2015 0 repositories listed
-
Reinforcement Learning in a Neurally Controlled Robot Using Dopamine Modulated STDP21 Feb 2015 0 repositories listed
-
Efficient model-based reinforcement learning for approximate online optimal9 Feb 2015 0 repositories listed
-
From Pixels to Torques: Policy Learning with Deep Dynamical Models8 Feb 2015 0 repositories listed
-
Grounding Hierarchical Reinforcement Learning Models for Knowledge Transfer19 Dec 2014 0 repositories listed
-
Regression with Linear Factored Functions19 Dec 2014 0 repositories listed
-
Reinforcement Learning and Nonparametric Detection of Game-Theoretic Equilibrium Play in Social Networks11 Dec 2014 0 repositories listed
-
Deep Learning for Real-Time Atari Game Play Using Offline Monte-Carlo Tree Search Planning1 Dec 2014 0 repositories listed
-
Design Principles of the Hippocampal Cognitive Map1 Dec 2014 0 repositories listed
-
Difference of Convex Functions Programming for Reinforcement Learning1 Dec 2014 0 repositories listed
-
How hard is my MDP?" The distribution-norm to the rescue"1 Dec 2014 0 repositories listed
-
RAAM: The Benefits of Robustness in Approximating Aggregated MDPs in Reinforcement Learning1 Dec 2014 0 repositories listed
-
Sparse Multi-Task Reinforcement Learning1 Dec 2014 0 repositories listed
-
Multiple Instance Reinforcement Learning for Efficient Weakly-Supervised Detection in Images29 Nov 2014 0 repositories listed
-
Compress and Control19 Nov 2014 0 repositories listed
-
A Comparison of learning algorithms on the Arcade Learning Environment31 Oct 2014 0 repositories listed
-
Do Artificial Reinforcement-Learning Agents Matter Morally?30 Oct 2014 0 repositories listed
-
Domain-Independent Optimistic Initialization for Reinforcement Learning16 Oct 2014 0 repositories listed
-
Don't Until the Final Verb Wait: Reinforcement Learning for Simultaneous Machine Translation1 Oct 2014 0 repositories listed
-
Fear the REAPER: A System for Automatic Multi-Document Summarization with Reinforcement Learning1 Oct 2014 0 repositories listed
-
An agent-driven semantical identifier using radial basis neural networks and reinforcement learning30 Sep 2014 0 repositories listed
-
RESEARCH ARTICLE A Reinforcement Learning Model of Joy, Distress, Hope and Fear8 Sep 2014 0 repositories listed
-
Inverse Reinforcement Learning with Multi-Relational Chains for Robot-Centered Smart Home16 Aug 2014 0 repositories listed
-
Probabilistic inverse reinforcement learning in unknown environments9 Aug 2014 0 repositories listed
-
Learning to Cooperate via Policy Search7 Aug 2014 0 repositories listed
-
Reinforcement Learning of Cooperative Persuasive Dialogue Policies using Framing1 Aug 2014 0 repositories listed
-
MONEYBaRL: Exploiting pitcher decision-making using Reinforcement Learning31 Jul 2014 0 repositories listed
-
Learning in games via reinforcement and regularization23 Jul 2014 0 repositories listed
-
Practical Kernel-Based Reinforcement Learning21 Jul 2014 0 repositories listed
-
Extreme State Aggregation Beyond MDPs12 Jul 2014 0 repositories listed
-
Reinforcement Learning Based Algorithm for the Maximization of EV Charging Station Revenue4 Jul 2014 0 repositories listed
-
Thompson Sampling for Learning Parameterized Markov Decision Processes29 Jun 2014 0 repositories listed
-
Reinforcement and Imitation Learning via Interactive No-Regret Learning23 Jun 2014 0 repositories listed
-
Personalized Medical Treatments Using Novel Reinforcement Learning Algorithms16 Jun 2014 0 repositories listed
-
Multi-objective Reinforcement Learning with Continuous Pareto Frontier Approximation Supplementary Material13 Jun 2014 0 repositories listed
-
Model-based Reinforcement Learning and the Eluder Dimension7 Jun 2014 0 repositories listed
-
Comparing Multi-label Classification with Reinforcement Learning for Summarisation of Time-series Data1 Jun 2014 0 repositories listed
-
Single-Agent vs. Multi-Agent Techniques for Concurrent Reinforcement Learning of Negotiation Dialogue Policies1 Jun 2014 0 repositories listed
-
Proximal Reinforcement Learning: A New Theory of Sequential Decision Making in Primal-Dual Spaces26 May 2014 0 repositories listed
-
Off-Policy Shaping Ensembles in Reinforcement Learning21 May 2014 0 repositories listed
-
Projective simulation applied to the grid-world and the mountain-car problem21 May 2014 0 repositories listed
-
Selecting Near-Optimal Approximate State Representations in Reinforcement Learning12 May 2014 0 repositories listed
-
Structural Return Maximization for Reinforcement Learning12 May 2014 0 repositories listed
-
DINASTI: Dialogues with a Negotiating Appointment Setting Interface1 May 2014 0 repositories listed
-
Undirected Machine Translation with Discriminative Reinforcement Learning1 Apr 2014 0 repositories listed
-
Comparison of Multi-agent and Single-agent Inverse Learning on a Simulated Soccer Example26 Mar 2014 0 repositories listed
-
Multi-agent Inverse Reinforcement Learning for Two-person Zero-sum Games25 Mar 2014 0 repositories listed
-
Simultaneous Perturbation Algorithms for Batch Off-Policy Search18 Mar 2014 0 repositories listed
-
Near-optimal Reinforcement Learning in Factored MDPs15 Mar 2014 0 repositories listed
-
Intrinsically Motivated Learning of Visual Motion Perception and Smooth Pursuit14 Feb 2014 0 repositories listed
-
Better Optimism By Bayes: Adaptive Planning with Rich Models9 Feb 2014 0 repositories listed
-
Safe Exploration of State and Action Spaces in Reinforcement Learning4 Feb 2014 0 repositories listed
-
Kalman Temporal Differences16 Jan 2014 0 repositories listed
-
Non-Deterministic Policies in Markovian Decision Processes16 Jan 2014 0 repositories listed
-
A Multiagent Reinforcement Learning Algorithm with Non-linear Dynamics15 Jan 2014 0 repositories listed
-
Learning Partially Observable Deterministic Action Models15 Jan 2014 0 repositories listed
-
Exploiting generalisation symmetries in accuracy-based learning classifier systems: An initial study10 Jan 2014 0 repositories listed
-
DJ-MC: A Reinforcement-Learning Agent for Music Playlist Recommendation9 Jan 2014 0 repositories listed