Browse State-of-the-Art › Reinforcement Learning › Papers, page 127
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 127 of 132: papers 12,601 to 12,700 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Inverse Risk-Sensitive Reinforcement Learning29 Mar 2017 0 repositories listed
-
Inverse Reinforcement Learning from Summary Data28 Mar 2017 0 repositories listed
-
Thompson Sampling for Linear-Quadratic Control Problems27 Mar 2017 0 repositories listed
-
Cohesion-based Online Actor-Critic Reinforcement Learning for mHealth Intervention25 Mar 2017 0 repositories listed
-
Exploration--Exploitation in MDPs with Options25 Mar 2017 0 repositories listed
-
Multi-Level Discovery of Deep Options24 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning23 Mar 2017 0 repositories listed
-
An End-to-End Approach to Natural Language Object Retrieval via Context-Aware Deep Reinforcement Learning22 Mar 2017 0 repositories listed
-
Deep Exploration via Randomized Value Functions22 Mar 2017 0 repositories listed
-
Fake News Mitigation via Point Process Based Intervention22 Mar 2017 0 repositories listed
-
Information-theoretic Model Identification and Policy Search using Physics Engines with Application to Robotic Manipulation22 Mar 2017 0 repositories listed
-
Investigation of Language Understanding Impact for Reinforcement Learning Based Dialogue Systems21 Mar 2017 0 repositories listed
-
Pseudorehearsal in value function approximation21 Mar 2017 0 repositories listed
-
Multi-Timescale, Gradient Descent, Temporal Difference Learning with Linear Options19 Mar 2017 0 repositories listed
-
Deep Decentralized Multi-task Multi-Agent Reinforcement Learning under Partial Observability17 Mar 2017 0 repositories listed
-
Online Learning for Offloading and Autoscaling in Energy Harvesting Mobile Edge Computing17 Mar 2017 0 repositories listed
-
Particle Value Functions16 Mar 2017 0 repositories listed
-
Using Reinforcement Learning for Demand Response of Domestic Hot Water Buffers: a Real-Life Demonstration16 Mar 2017 0 repositories listed
-
Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning15 Mar 2017 0 repositories listed
-
A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Reinforcement Learning for Transition-Based Mention Detection13 Mar 2017 0 repositories listed
-
Sensor Fusion for Robot Control through Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Toward a Formal Model of Cognitive Synergy13 Mar 2017 0 repositories listed
-
Micro-Objective Learning : Accelerating Deep Reinforcement Learning through the Discovery of Continuous Subgoals11 Mar 2017 0 repositories listed
-
Communications that Emerge through Reinforcement Learning Using a (Recurrent) Neural Network10 Mar 2017 0 repositories listed
-
Sample Efficient Feature Selection for Factored MDPs9 Mar 2017 0 repositories listed
-
What can you do with a rock? Affordance extraction via word embeddings9 Mar 2017 0 repositories listed
-
Learning Invariant Feature Spaces to Transfer Skills with Reinforcement Learning8 Mar 2017 0 repositories listed
-
Tactics of Adversarial Attack on Deep Reinforcement Learning Agents8 Mar 2017 0 repositories listed
-
Tree-Structured Reinforcement Learning for Sequential Object Localization8 Mar 2017 0 repositories listed
-
Functions that Emerge through End-to-End Reinforcement Learning - The Direction for Artificial General Intelligence -7 Mar 2017 0 repositories listed
-
Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning6 Mar 2017 0 repositories listed
-
Actor-Critic Reinforcement Learning with Simultaneous Human Control and Feedback3 Mar 2017 0 repositories listed
-
Deeply AggreVaTeD: Differentiable Imitation Learning for Sequential Prediction3 Mar 2017 0 repositories listed
-
Multi-step Reinforcement Learning: A Unifying Algorithm3 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning3 Mar 2017 0 repositories listed
-
Virtual vs. Real: Trading Off Simulations and Physical Experiments in Reinforcement Learning with Bayesian Optimization3 Mar 2017 0 repositories listed
-
Learning Conversational Systems that Interleave Task and Non-Task Content1 Mar 2017 0 repositories listed
-
Learning to Optimize Neural Nets1 Mar 2017 0 repositories listed
-
Analysing Congestion Problems in Multi-agent Reinforcement Learning28 Feb 2017 0 repositories listed
-
Analysis of Agent Expertise in Ms. Pac-Man using Value-of-Information-based Policies28 Feb 2017 0 repositories listed
-
Learning What Data to Learn28 Feb 2017 0 repositories listed
-
Scaffolding Networks: Incremental Learning and Teaching Through Questioning28 Feb 2017 0 repositories listed
-
Show, Attend and Interact: Perceivable Human-Robot Social Interaction through Neural Attention Q-Network28 Feb 2017 0 repositories listed
-
27 Feb 2017 0 repositories listed
-
Learning Control for Air Hockey Striking using Deep Reinforcement Learning26 Feb 2017 0 repositories listed
-
Stochastic Variance Reduction Methods for Policy Evaluation25 Feb 2017 0 repositories listed
-
Changing Model Behavior at Test-Time Using Reinforcement Learning24 Feb 2017 0 repositories listed
-
Control of Gene Regulatory Networks with Noisy Measurements and Uncertain Inputs24 Feb 2017 0 repositories listed
-
Online Meta-learning by Parallel Algorithm Competition24 Feb 2017 0 repositories listed
-
Robot gains Social Intelligence through Multimodal Deep Reinforcement Learning24 Feb 2017 0 repositories listed
-
A Goal-Based Movement Model for Continuous Multi-Agent Tasks23 Feb 2017 0 repositories listed
-
Automatic Representation for Lifetime Value Recommender Systems23 Feb 2017 0 repositories listed
-
Data Distillation for Controlling Specificity in Dialogue Generation22 Feb 2017 0 repositories listed
-
Reinforcement Learning Based Argument Component Detection21 Feb 2017 0 repositories listed
-
Learning to Repeat: Fine Grained Action Repetition for Deep Reinforcement Learning20 Feb 2017 0 repositories listed
-
Collaborative Deep Reinforcement Learning for Joint Object Search18 Feb 2017 0 repositories listed
-
Enabling Robots to Communicate their Objectives11 Feb 2017 0 repositories listed
-
Batch Policy Gradient Methods for Improving Neural Conversation Models10 Feb 2017 0 repositories listed
-
10 Feb 2017 0 repositories listed
-
Semi-Supervised QA with Generative Domain-Adaptive Nets7 Feb 2017 0 repositories listed
-
Attentional Network for Visual Object Detection6 Feb 2017 0 repositories listed
-
Uncertainty-Aware Reinforcement Learning for Collision Avoidance3 Feb 2017 0 repositories listed
-
Deep Reinforcement Learning for Robotic Manipulation-The state of the art31 Jan 2017 0 repositories listed
-
Deep Reinforcement Learning for Visual Object Tracking in Videos31 Jan 2017 0 repositories listed
-
Expert Level control of Ramp Metering based on Multi-task Deep Reinforcement Learning30 Jan 2017 0 repositories listed
-
Flow Navigation by Smart Microswimmers via Reinforcement Learning30 Jan 2017 0 repositories listed
-
Reinforcement Learning Algorithm Selection30 Jan 2017 0 repositories listed
-
Model-Free Control of Thermostatically Controlled Loads Connected to a District Heating Network27 Jan 2017 0 repositories listed
-
FPGA Architecture for Deep Learning and its application to Planetary Robotics26 Jan 2017 0 repositories listed
-
Artificial Intelligence Approaches To UCAV Autonomy24 Jan 2017 0 repositories listed
-
Learning an attention model in an artificial visual system24 Jan 2017 0 repositories listed
-
Learning what to look in chest X-rays with a recurrent visual attention model23 Jan 2017 0 repositories listed
-
Binary Matrix Guessing Problem22 Jan 2017 0 repositories listed
-
Basic protocols in quantum reinforcement learning with superconducting circuits18 Jan 2017 0 repositories listed
-
Unknowable Manipulators: Social Network Curator Algorithms17 Jan 2017 0 repositories listed
-
Agent-Agnostic Human-in-the-Loop Reinforcement Learning15 Jan 2017 0 repositories listed
-
Scalable and Incremental Learning of Gaussian Mixture Models14 Jan 2017 0 repositories listed
-
Reinforcement Learning based Embodied Agents Modelling Human Users Through Interaction and Multi-Sensory Perception9 Jan 2017 0 repositories listed
-
A Review of Neural Network Based Machine Learning Approaches for Rotor Angle Stability Control5 Jan 2017 0 repositories listed
-
Toward negotiable reinforcement learning: shifting priorities in Pareto optimal sequential decision-making5 Jan 2017 0 repositories listed
-
Dynamic Deep Neural Networks: Optimizing Accuracy-Efficiency Trade-offs by Selective Execution2 Jan 2017 0 repositories listed
-
Adaptive Lambda Least-Squares Temporal Difference Learning30 Dec 2016 0 repositories listed
-
Understanding Neural Networks through Representation Erasure24 Dec 2016 0 repositories listed
-
First-Person Activity Forecasting with Online Inverse Reinforcement Learning22 Dec 2016 0 repositories listed
-
Non-Deterministic Policy Improvement Stabilizes Approximated Reinforcement Learning22 Dec 2016 0 repositories listed
-
On the function approximation error for risk-sensitive reinforcement learning22 Dec 2016 0 repositories listed
-
Loss is its own Reward: Self-Supervision for Reinforcement Learning21 Dec 2016 0 repositories listed
-
Unsupervised Perceptual Rewards for Imitation Learning20 Dec 2016 0 repositories listed
-
Sample-efficient Deep Reinforcement Learning for Dialog Control18 Dec 2016 0 repositories listed
-
Learning to predict where to look in interactive environments using deep recurrent q-learning17 Dec 2016 0 repositories listed
-
Reinforcement Learning Using Quantum Boltzmann Machines17 Dec 2016 0 repositories listed
-
Deep Reinforcement Learning with Successor Features for Navigation across Similar Environments16 Dec 2016 0 repositories listed
-
Separation of Concerns in Reinforcement Learning15 Dec 2016 0 repositories listed
-
End-to-End Deep Reinforcement Learning for Lane Keeping Assist13 Dec 2016 0 repositories listed
-
Incorporating Human Domain Knowledge into Large Scale Cost Function Learning13 Dec 2016 0 repositories listed
-
An Attention-Driven Approach of No-Reference Image Quality Assessment12 Dec 2016 0 repositories listed
-
Learning to Drive using Inverse Reinforcement Learning and Deep Q-Networks12 Dec 2016 0 repositories listed
-
Online Reinforcement Learning for Real-Time Exploration in Continuous State and Action Markov Decision Processes12 Dec 2016 0 repositories listed
-
PoseAgent: Budget-Constrained 6D Object Pose Estimation via Reinforcement Learning12 Dec 2016 0 repositories listed