Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 147
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 147 of 152: papers 14,601 to 14,700 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Sub-domain Modelling for Dialogue Management with Hierarchical Reinforcement Learning19 Jun 2017 0 repositories listed
-
Reinforcement Learning under Model Mismatch15 Jun 2017 0 repositories listed
-
Reinforcement Learning with Budget-Constrained Nonparametric Function Approximation for Opportunistic Spectrum Access14 Jun 2017 0 repositories listed
-
On Optimistic versus Randomized Exploration in Reinforcement Learning13 Jun 2017 0 repositories listed
-
ACCNet: Actor-Coordinator-Critic Net for "Learning-to-Communicate" with Deep Multi-agent Reinforcement Learning10 Jun 2017 0 repositories listed
-
Symmetry Learning for Function Approximation in Reinforcement Learning9 Jun 2017 0 repositories listed
-
Unlocking the Potential of Simulators: Design with RL in Mind8 Jun 2017 0 repositories listed
-
Efficient Reinforcement Learning via Initial Pure Exploration7 Jun 2017 0 repositories listed
-
A method for the online construction of the set of states of a Markov Decision Process using Answer Set Programming5 Jun 2017 0 repositories listed
-
Towards Synthesizing Complex Programs from Input-Output Examples5 Jun 2017 0 repositories listed
-
UCB Exploration via Q-Ensembles5 Jun 2017 0 repositories listed
-
Actor-Critic for Linearly-Solvable Continuous MDP with Partially Known Dynamics4 Jun 2017 0 repositories listed
-
Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning1 Jun 2017 0 repositories listed
-
Reinforcement Learning for Learning Rate Control31 May 2017 0 repositories listed
-
Sequential Dynamic Decision Making with Deep Neural Nets on a Test-Time Budget31 May 2017 0 repositories listed
-
End-to-end Active Object Tracking via Reinforcement Learning30 May 2017 0 repositories listed
-
Experience Replay Using Transition Sequences30 May 2017 0 repositories listed
-
Fine-grained acceleration control for autonomous intersection management using deep reinforcement learning30 May 2017 0 repositories listed
-
Boltzmann Exploration Done Right29 May 2017 0 repositories listed
-
Role Playing Learning for Socially Concomitant Mobile Robot Navigation29 May 2017 0 repositories listed
-
Cross-Domain Perceptual Reward Functions25 May 2017 0 repositories listed
-
First-spike based visual categorization using reward-modulated STDP25 May 2017 0 repositories listed
-
State Space Decomposition and Subgoal Creation for Transfer in Deep Reinforcement Learning24 May 2017 0 repositories listed
-
Continuous State-Space Models for Optimal Sepsis Treatment - a Deep Reinforcement Learning Approach23 May 2017 0 repositories listed
-
Enhanced Experience Replay Generation for Efficient Reinforcement Learning23 May 2017 0 repositories listed
-
Visual Semantic Planning using Deep Successor Representations23 May 2017 0 repositories listed
-
A unified view of entropy-regularized Markov decision processes22 May 2017 0 repositories listed
-
Experience enrichment based task independent reward model21 May 2017 0 repositories listed
-
Learning to Mix n-Step Returns: Generalizing lambda-Returns for Deep Reinforcement Learning21 May 2017 0 repositories listed
-
Shallow Updates for Deep Reinforcement Learning21 May 2017 0 repositories listed
-
Batch Reinforcement Learning on the Industrial Benchmark: First Experiences20 May 2017 0 repositories listed
-
Learning to Factor Policies and Action-Value Functions: Factored Action Space Representations for Deep Reinforcement learning20 May 2017 0 repositories listed
-
A Comparison of Reinforcement Learning Techniques for Fuzzy Cloud Auto-Scaling19 May 2017 0 repositories listed
-
Atari games and Intel processors19 May 2017 0 repositories listed
-
Posterior sampling for reinforcement learning: worst-case regret bounds19 May 2017 0 repositories listed
-
Delving into adversarial attacks on deep policies18 May 2017 0 repositories listed
-
New Reinforcement Learning Using a Chaotic Neural Network for Emergence of "Thinking" - "Exploration" Grows into "Thinking" through Learning -16 May 2017 0 repositories listed
-
Emotion in Reinforcement Learning Agents and Robots: A Survey15 May 2017 0 repositories listed
-
Repeated Inverse Reinforcement Learning15 May 2017 0 repositories listed
-
Deep Episodic Value Iteration for Model-based Meta-Reinforcement Learning9 May 2017 0 repositories listed
-
Experimental results : Reinforcement Learning of POMDPs using Spectral Methods7 May 2017 0 repositories listed
-
Answer Set Programming for Non-Stationary Markov Decision Processes3 May 2017 0 repositories listed
-
Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning2 May 2017 0 repositories listed
-
Traffic Light Control Using Deep Policy-Gradient and Value-Function Based Reinforcement Learning28 Apr 2017 0 repositories listed
-
Reinforcement Learning-based Thermal Comfort Control for Vehicle Cabins25 Apr 2017 0 repositories listed
-
Stochastic Constraint Programming as Reinforcement Learning24 Apr 2017 0 repositories listed
-
Equivalence Between Policy Gradients and Soft Q-Learning21 Apr 2017 0 repositories listed
-
A Reinforcement Learning Approach to Weaning of Mechanical Ventilation in Intensive Care Units20 Apr 2017 0 repositories listed
-
Reinforcement Learning with External Knowledge and Two-Stage Q-functions for Predicting Popular Reddit Threads20 Apr 2017 0 repositories listed
-
Investigating Recurrence and Eligibility Traces in Deep Q-Networks18 Apr 2017 0 repositories listed
-
Effective Warm Start for the Online Actor-Critic Reinforcement Learning based mHealth Intervention17 Apr 2017 0 repositories listed
-
Pseudorehearsal in actor-critic agents17 Apr 2017 0 repositories listed
-
15 Apr 2017 0 repositories listed
-
Environment-Independent Task Specifications via GLTL14 Apr 2017 0 repositories listed
-
Ultrafast photonic reinforcement learning based on laser chaos14 Apr 2017 0 repositories listed
-
Deep Reinforcement Learning-based Image Captioning with Embedding Reward12 Apr 2017 0 repositories listed
-
Composite Task-Completion Dialogue Policy Learning via Hierarchical Deep Reinforcement Learning10 Apr 2017 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Dexterous Manipulation10 Apr 2017 0 repositories listed
-
Dynamic Safe Interruptibility for Decentralized Multi-Agent Reinforcement Learning10 Apr 2017 0 repositories listed
-
Stein Variational Policy Gradient7 Apr 2017 0 repositories listed
-
Finite Sample Analyses for TD(0) with Function Approximation4 Apr 2017 0 repositories listed
-
Multi-Advisor Reinforcement Learning3 Apr 2017 0 repositories listed
-
On the Properties of the Softmax Function with Application in Game Theory and Reinforcement Learning3 Apr 2017 0 repositories listed
-
Evaluating Persuasion Strategies and Deep Reinforcement Learning methods for Negotiation Dialogue agents1 Apr 2017 0 repositories listed
-
Integrated Learning of Dialog Strategies and Semantic Parsing1 Apr 2017 0 repositories listed
-
Enter the Matrix: Safely Interruptible Autonomous Systems via Virtualization30 Mar 2017 0 repositories listed
-
Inverse Risk-Sensitive Reinforcement Learning29 Mar 2017 0 repositories listed
-
Inverse Reinforcement Learning from Summary Data28 Mar 2017 0 repositories listed
-
Cohesion-based Online Actor-Critic Reinforcement Learning for mHealth Intervention25 Mar 2017 0 repositories listed
-
Exploration--Exploitation in MDPs with Options25 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning23 Mar 2017 0 repositories listed
-
Deep Exploration via Randomized Value Functions22 Mar 2017 0 repositories listed
-
Fake News Mitigation via Point Process Based Intervention22 Mar 2017 0 repositories listed
-
Investigation of Language Understanding Impact for Reinforcement Learning Based Dialogue Systems21 Mar 2017 0 repositories listed
-
Pseudorehearsal in value function approximation21 Mar 2017 0 repositories listed
-
Multi-Timescale, Gradient Descent, Temporal Difference Learning with Linear Options19 Mar 2017 0 repositories listed
-
Deep Decentralized Multi-task Multi-Agent Reinforcement Learning under Partial Observability17 Mar 2017 0 repositories listed
-
Online Learning for Offloading and Autoscaling in Energy Harvesting Mobile Edge Computing17 Mar 2017 0 repositories listed
-
Particle Value Functions16 Mar 2017 0 repositories listed
-
Using Reinforcement Learning for Demand Response of Domestic Hot Water Buffers: a Real-Life Demonstration16 Mar 2017 0 repositories listed
-
Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning15 Mar 2017 0 repositories listed
-
A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Reinforcement Learning for Transition-Based Mention Detection13 Mar 2017 0 repositories listed
-
Sensor Fusion for Robot Control through Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Micro-Objective Learning : Accelerating Deep Reinforcement Learning through the Discovery of Continuous Subgoals11 Mar 2017 0 repositories listed
-
Communications that Emerge through Reinforcement Learning Using a (Recurrent) Neural Network10 Mar 2017 0 repositories listed
-
Sample Efficient Feature Selection for Factored MDPs9 Mar 2017 0 repositories listed
-
What can you do with a rock? Affordance extraction via word embeddings9 Mar 2017 0 repositories listed
-
Learning Invariant Feature Spaces to Transfer Skills with Reinforcement Learning8 Mar 2017 0 repositories listed
-
Tactics of Adversarial Attack on Deep Reinforcement Learning Agents8 Mar 2017 0 repositories listed
-
Tree-Structured Reinforcement Learning for Sequential Object Localization8 Mar 2017 0 repositories listed
-
Functions that Emerge through End-to-End Reinforcement Learning - The Direction for Artificial General Intelligence -7 Mar 2017 0 repositories listed
-
Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning6 Mar 2017 0 repositories listed
-
Actor-Critic Reinforcement Learning with Simultaneous Human Control and Feedback3 Mar 2017 0 repositories listed
-
Deeply AggreVaTeD: Differentiable Imitation Learning for Sequential Prediction3 Mar 2017 0 repositories listed
-
Multi-step Reinforcement Learning: A Unifying Algorithm3 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning3 Mar 2017 0 repositories listed
-
Learning to Optimize Neural Nets1 Mar 2017 0 repositories listed
-
Analysing Congestion Problems in Multi-agent Reinforcement Learning28 Feb 2017 0 repositories listed
-
Analysis of Agent Expertise in Ms. Pac-Man using Value-of-Information-based Policies28 Feb 2017 0 repositories listed