Browse State-of-the-Art › Reinforcement Learning › Papers, page 126
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 126 of 132: papers 12,501 to 12,600 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
The Complex Negotiation Dialogue Game5 Jul 2017 0 repositories listed
-
OPEB: Open Physical Environment Benchmark for Artificial Intelligence4 Jul 2017 0 repositories listed
-
Hashing over Predicted Future Frames for Informed Exploration of Deep Reinforcement Learning3 Jul 2017 0 repositories listed
-
Grammatical Error Correction with Neural Reinforcement Learning2 Jul 2017 0 repositories listed
-
Budget-Aware Deep Semantic Video Segmentation1 Jul 2017 0 repositories listed
-
1 Jul 2017 0 repositories listed
-
Interactive Learning of Grounded Verb Semantics towards Human-Robot Communication1 Jul 2017 0 repositories listed
-
Sample-efficient Actor-Critic Reinforcement Learning with Supervised Data for Dialogue Management1 Jul 2017 0 repositories listed
-
Actor-Critic Sequence Training for Image Captioning29 Jun 2017 0 repositories listed
-
Interpretability via Model Extraction29 Jun 2017 0 repositories listed
-
Learning to Learn: Meta-Critic Networks for Sample Efficient Learning29 Jun 2017 0 repositories listed
-
Path Integral Networks: End-to-End Differentiable Optimal Control29 Jun 2017 0 repositories listed
-
Uncertainty Decomposition in Bayesian Neural Networks with Latent Variables26 Jun 2017 0 repositories listed
-
Temporal-related Convolutional-Restricted-Boltzmann-Machine capable of learning relational order via reinforcement learning procedure?24 Jun 2017 0 repositories listed
-
Structure Learning in Motor Control:A Deep Reinforcement Learning Model21 Jun 2017 0 repositories listed
-
Observational Learning by Reinforcement Learning20 Jun 2017 0 repositories listed
-
Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines20 Jun 2017 0 repositories listed
-
Statistical Mechanics of Node-perturbation Learning with Noisy Baseline20 Jun 2017 0 repositories listed
-
Toward Real-Time Decentralized Reinforcement Learning using Finite Support Basis Functions20 Jun 2017 0 repositories listed
-
Pedestrian Prediction by Planning using Deep Neural Networks19 Jun 2017 0 repositories listed
-
Sub-domain Modelling for Dialogue Management with Hierarchical Reinforcement Learning19 Jun 2017 0 repositories listed
-
Expected Policy Gradients15 Jun 2017 0 repositories listed
-
Reinforcement Learning under Model Mismatch15 Jun 2017 0 repositories listed
-
Reinforcement Learning with Budget-Constrained Nonparametric Function Approximation for Opportunistic Spectrum Access14 Jun 2017 0 repositories listed
-
On Optimistic versus Randomized Exploration in Reinforcement Learning13 Jun 2017 0 repositories listed
-
Meta learning Framework for Automated Driving11 Jun 2017 0 repositories listed
-
ACCNet: Actor-Coordinator-Critic Net for "Learning-to-Communicate" with Deep Multi-agent Reinforcement Learning10 Jun 2017 0 repositories listed
-
Decoupling Learning Rules from Representations9 Jun 2017 0 repositories listed
-
Learning to Learn from Noisy Web Videos9 Jun 2017 0 repositories listed
-
Symmetry Learning for Function Approximation in Reinforcement Learning9 Jun 2017 0 repositories listed
-
Sympathy Begins with a Smile, Intelligence Begins with a Word: Use of Multimodal Features in Spoken Human-Robot Interaction8 Jun 2017 0 repositories listed
-
Unlocking the Potential of Simulators: Design with RL in Mind8 Jun 2017 0 repositories listed
-
Efficient Reinforcement Learning via Initial Pure Exploration7 Jun 2017 0 repositories listed
-
A method for the online construction of the set of states of a Markov Decision Process using Answer Set Programming5 Jun 2017 0 repositories listed
-
Towards Synthesizing Complex Programs from Input-Output Examples5 Jun 2017 0 repositories listed
-
UCB Exploration via Q-Ensembles5 Jun 2017 0 repositories listed
-
Actor-Critic for Linearly-Solvable Continuous MDP with Partially Known Dynamics4 Jun 2017 0 repositories listed
-
Modeling Latent Attention Within Neural Networks2 Jun 2017 0 repositories listed
-
Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning1 Jun 2017 0 repositories listed
-
Emergence of Language with Multi-agent Games: Learning to Communicate with Sequences of Symbols31 May 2017 0 repositories listed
-
Non-Markovian Control with Gated End-to-End Memory Policy Networks31 May 2017 0 repositories listed
-
Reinforcement Learning for Learning Rate Control31 May 2017 0 repositories listed
-
Sequential Dynamic Decision Making with Deep Neural Nets on a Test-Time Budget31 May 2017 0 repositories listed
-
End-to-end Active Object Tracking via Reinforcement Learning30 May 2017 0 repositories listed
-
Experience Replay Using Transition Sequences30 May 2017 0 repositories listed
-
Fine-grained acceleration control for autonomous intersection management using deep reinforcement learning30 May 2017 0 repositories listed
-
Boltzmann Exploration Done Right29 May 2017 0 repositories listed
-
Role Playing Learning for Socially Concomitant Mobile Robot Navigation29 May 2017 0 repositories listed
-
Reinforced Temporal Attention and Split-Rate Transfer for Depth-Based Person Re-Identification28 May 2017 0 repositories listed
-
Convergent Tree Backup and Retrace with Function Approximation25 May 2017 0 repositories listed
-
Cross-Domain Perceptual Reward Functions25 May 2017 0 repositories listed
-
First-spike based visual categorization using reward-modulated STDP25 May 2017 0 repositories listed
-
State Space Decomposition and Subgoal Creation for Transfer in Deep Reinforcement Learning24 May 2017 0 repositories listed
-
Continuous State-Space Models for Optimal Sepsis Treatment - a Deep Reinforcement Learning Approach23 May 2017 0 repositories listed
-
Enhanced Experience Replay Generation for Efficient Reinforcement Learning23 May 2017 0 repositories listed
-
Visual Semantic Planning using Deep Successor Representations23 May 2017 0 repositories listed
-
A unified view of entropy-regularized Markov decision processes22 May 2017 0 repositories listed
-
Experience enrichment based task independent reward model21 May 2017 0 repositories listed
-
Learning to Mix n-Step Returns: Generalizing lambda-Returns for Deep Reinforcement Learning21 May 2017 0 repositories listed
-
Shallow Updates for Deep Reinforcement Learning21 May 2017 0 repositories listed
-
Batch Reinforcement Learning on the Industrial Benchmark: First Experiences20 May 2017 0 repositories listed
-
Learning to Factor Policies and Action-Value Functions: Factored Action Space Representations for Deep Reinforcement learning20 May 2017 0 repositories listed
-
A Comparison of Reinforcement Learning Techniques for Fuzzy Cloud Auto-Scaling19 May 2017 0 repositories listed
-
Atari games and Intel processors19 May 2017 0 repositories listed
-
Posterior sampling for reinforcement learning: worst-case regret bounds19 May 2017 0 repositories listed
-
Delving into adversarial attacks on deep policies18 May 2017 0 repositories listed
-
New Reinforcement Learning Using a Chaotic Neural Network for Emergence of "Thinking" - "Exploration" Grows into "Thinking" through Learning -16 May 2017 0 repositories listed
-
Emotion in Reinforcement Learning Agents and Robots: A Survey15 May 2017 0 repositories listed
-
Repeated Inverse Reinforcement Learning15 May 2017 0 repositories listed
-
Deep Episodic Value Iteration for Model-based Meta-Reinforcement Learning9 May 2017 0 repositories listed
-
Experimental results : Reinforcement Learning of POMDPs using Spectral Methods7 May 2017 0 repositories listed
-
Answer Set Programming for Non-Stationary Markov Decision Processes3 May 2017 0 repositories listed
-
Analyzing Knowledge Transfer in Deep Q-Networks for Autonomously Handling Multiple Intersections2 May 2017 0 repositories listed
-
Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning2 May 2017 0 repositories listed
-
Traffic Light Control Using Deep Policy-Gradient and Value-Function Based Reinforcement Learning28 Apr 2017 0 repositories listed
-
Reinforcement Learning-based Thermal Comfort Control for Vehicle Cabins25 Apr 2017 0 repositories listed
-
Reinforcement Learning Based Dynamic Selection of Auxiliary Objectives with Preserving of the Best Found Solution24 Apr 2017 0 repositories listed
-
Stochastic Constraint Programming as Reinforcement Learning24 Apr 2017 0 repositories listed
-
Equivalence Between Policy Gradients and Soft Q-Learning21 Apr 2017 0 repositories listed
-
A Reinforcement Learning Approach to Weaning of Mechanical Ventilation in Intensive Care Units20 Apr 2017 0 repositories listed
-
Reinforcement Learning with External Knowledge and Two-Stage Q-functions for Predicting Popular Reddit Threads20 Apr 2017 0 repositories listed
-
Investigating Recurrence and Eligibility Traces in Deep Q-Networks18 Apr 2017 0 repositories listed
-
Understanding Negations in Information Processing: Learning from Replicating Human Behavior18 Apr 2017 0 repositories listed
-
Effective Warm Start for the Online Actor-Critic Reinforcement Learning based mHealth Intervention17 Apr 2017 0 repositories listed
-
Pseudorehearsal in actor-critic agents17 Apr 2017 0 repositories listed
-
15 Apr 2017 0 repositories listed
-
Environment-Independent Task Specifications via GLTL14 Apr 2017 0 repositories listed
-
Ultrafast photonic reinforcement learning based on laser chaos14 Apr 2017 0 repositories listed
-
A dynamic connectome supports the emergence of stable computational function of neural circuits through reward-based learning13 Apr 2017 0 repositories listed
-
Deep Reinforcement Learning-based Image Captioning with Embedding Reward12 Apr 2017 0 repositories listed
-
Composite Task-Completion Dialogue Policy Learning via Hierarchical Deep Reinforcement Learning10 Apr 2017 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Dexterous Manipulation10 Apr 2017 0 repositories listed
-
Dynamic Safe Interruptibility for Decentralized Multi-Agent Reinforcement Learning10 Apr 2017 0 repositories listed
-
Stein Variational Policy Gradient7 Apr 2017 0 repositories listed
-
Finite Sample Analyses for TD(0) with Function Approximation4 Apr 2017 0 repositories listed
-
Multi-Advisor Reinforcement Learning3 Apr 2017 0 repositories listed
-
On the Properties of the Softmax Function with Application in Game Theory and Reinforcement Learning3 Apr 2017 0 repositories listed
-
Evaluating Persuasion Strategies and Deep Reinforcement Learning methods for Negotiation Dialogue agents1 Apr 2017 0 repositories listed
-
Integrated Learning of Dialog Strategies and Semantic Parsing1 Apr 2017 0 repositories listed
-
Enter the Matrix: Safely Interruptible Autonomous Systems via Virtualization30 Mar 2017 0 repositories listed