Browse State-of-the-Art › reinforcement-learning › Papers, page 131
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 131 of 135: papers 13,001 to 13,100 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Delving into adversarial attacks on deep policies18 May 2017 0 repositories listed
-
New Reinforcement Learning Using a Chaotic Neural Network for Emergence of "Thinking" - "Exploration" Grows into "Thinking" through Learning -16 May 2017 0 repositories listed
-
Emotion in Reinforcement Learning Agents and Robots: A Survey15 May 2017 0 repositories listed
-
Repeated Inverse Reinforcement Learning15 May 2017 0 repositories listed
-
Deep Episodic Value Iteration for Model-based Meta-Reinforcement Learning9 May 2017 0 repositories listed
-
Experimental results : Reinforcement Learning of POMDPs using Spectral Methods7 May 2017 0 repositories listed
-
Answer Set Programming for Non-Stationary Markov Decision Processes3 May 2017 0 repositories listed
-
Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning2 May 2017 0 repositories listed
-
Traffic Light Control Using Deep Policy-Gradient and Value-Function Based Reinforcement Learning28 Apr 2017 0 repositories listed
-
Reinforcement Learning-based Thermal Comfort Control for Vehicle Cabins25 Apr 2017 0 repositories listed
-
Stochastic Constraint Programming as Reinforcement Learning24 Apr 2017 0 repositories listed
-
Equivalence Between Policy Gradients and Soft Q-Learning21 Apr 2017 0 repositories listed
-
A Reinforcement Learning Approach to Weaning of Mechanical Ventilation in Intensive Care Units20 Apr 2017 0 repositories listed
-
Reinforcement Learning with External Knowledge and Two-Stage Q-functions for Predicting Popular Reddit Threads20 Apr 2017 0 repositories listed
-
Investigating Recurrence and Eligibility Traces in Deep Q-Networks18 Apr 2017 0 repositories listed
-
Effective Warm Start for the Online Actor-Critic Reinforcement Learning based mHealth Intervention17 Apr 2017 0 repositories listed
-
Pseudorehearsal in actor-critic agents17 Apr 2017 0 repositories listed
-
Environment-Independent Task Specifications via GLTL14 Apr 2017 0 repositories listed
-
Ultrafast photonic reinforcement learning based on laser chaos14 Apr 2017 0 repositories listed
-
Deep Reinforcement Learning-based Image Captioning with Embedding Reward12 Apr 2017 0 repositories listed
-
Composite Task-Completion Dialogue Policy Learning via Hierarchical Deep Reinforcement Learning10 Apr 2017 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Dexterous Manipulation10 Apr 2017 0 repositories listed
-
Dynamic Safe Interruptibility for Decentralized Multi-Agent Reinforcement Learning10 Apr 2017 0 repositories listed
-
Stein Variational Policy Gradient7 Apr 2017 0 repositories listed
-
Finite Sample Analyses for TD(0) with Function Approximation4 Apr 2017 0 repositories listed
-
Multi-Advisor Reinforcement Learning3 Apr 2017 0 repositories listed
-
On the Properties of the Softmax Function with Application in Game Theory and Reinforcement Learning3 Apr 2017 0 repositories listed
-
Evaluating Persuasion Strategies and Deep Reinforcement Learning methods for Negotiation Dialogue agents1 Apr 2017 0 repositories listed
-
Integrated Learning of Dialog Strategies and Semantic Parsing1 Apr 2017 0 repositories listed
-
Enter the Matrix: Safely Interruptible Autonomous Systems via Virtualization30 Mar 2017 0 repositories listed
-
Inverse Risk-Sensitive Reinforcement Learning29 Mar 2017 0 repositories listed
-
Inverse Reinforcement Learning from Summary Data28 Mar 2017 0 repositories listed
-
Cohesion-based Online Actor-Critic Reinforcement Learning for mHealth Intervention25 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning23 Mar 2017 0 repositories listed
-
Deep Exploration via Randomized Value Functions22 Mar 2017 0 repositories listed
-
Fake News Mitigation via Point Process Based Intervention22 Mar 2017 0 repositories listed
-
Investigation of Language Understanding Impact for Reinforcement Learning Based Dialogue Systems21 Mar 2017 0 repositories listed
-
Pseudorehearsal in value function approximation21 Mar 2017 0 repositories listed
-
Deep Decentralized Multi-task Multi-Agent Reinforcement Learning under Partial Observability17 Mar 2017 0 repositories listed
-
Online Learning for Offloading and Autoscaling in Energy Harvesting Mobile Edge Computing17 Mar 2017 0 repositories listed
-
Particle Value Functions16 Mar 2017 0 repositories listed
-
Using Reinforcement Learning for Demand Response of Domestic Hot Water Buffers: a Real-Life Demonstration16 Mar 2017 0 repositories listed
-
Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning15 Mar 2017 0 repositories listed
-
A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Reinforcement Learning for Transition-Based Mention Detection13 Mar 2017 0 repositories listed
-
Sensor Fusion for Robot Control through Deep Reinforcement Learning13 Mar 2017 0 repositories listed
-
Micro-Objective Learning : Accelerating Deep Reinforcement Learning through the Discovery of Continuous Subgoals11 Mar 2017 0 repositories listed
-
Communications that Emerge through Reinforcement Learning Using a (Recurrent) Neural Network10 Mar 2017 0 repositories listed
-
Sample Efficient Feature Selection for Factored MDPs9 Mar 2017 0 repositories listed
-
Learning Invariant Feature Spaces to Transfer Skills with Reinforcement Learning8 Mar 2017 0 repositories listed
-
Tactics of Adversarial Attack on Deep Reinforcement Learning Agents8 Mar 2017 0 repositories listed
-
Tree-Structured Reinforcement Learning for Sequential Object Localization8 Mar 2017 0 repositories listed
-
Functions that Emerge through End-to-End Reinforcement Learning - The Direction for Artificial General Intelligence -7 Mar 2017 0 repositories listed
-
Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning6 Mar 2017 0 repositories listed
-
Actor-Critic Reinforcement Learning with Simultaneous Human Control and Feedback3 Mar 2017 0 repositories listed
-
Multi-step Reinforcement Learning: A Unifying Algorithm3 Mar 2017 0 repositories listed
-
Unsupervised Basis Function Adaptation for Reinforcement Learning3 Mar 2017 0 repositories listed
-
Learning to Optimize Neural Nets1 Mar 2017 0 repositories listed
-
Analysing Congestion Problems in Multi-agent Reinforcement Learning28 Feb 2017 0 repositories listed
-
Analysis of Agent Expertise in Ms. Pac-Man using Value-of-Information-based Policies28 Feb 2017 0 repositories listed
-
Show, Attend and Interact: Perceivable Human-Robot Social Interaction through Neural Attention Q-Network28 Feb 2017 0 repositories listed
-
27 Feb 2017 0 repositories listed
-
Learning Control for Air Hockey Striking using Deep Reinforcement Learning26 Feb 2017 0 repositories listed
-
Changing Model Behavior at Test-Time Using Reinforcement Learning24 Feb 2017 0 repositories listed
-
Control of Gene Regulatory Networks with Noisy Measurements and Uncertain Inputs24 Feb 2017 0 repositories listed
-
Online Meta-learning by Parallel Algorithm Competition24 Feb 2017 0 repositories listed
-
Robot gains Social Intelligence through Multimodal Deep Reinforcement Learning24 Feb 2017 0 repositories listed
-
Data Distillation for Controlling Specificity in Dialogue Generation22 Feb 2017 0 repositories listed
-
Reinforcement Learning Based Argument Component Detection21 Feb 2017 0 repositories listed
-
Learning to Repeat: Fine Grained Action Repetition for Deep Reinforcement Learning20 Feb 2017 0 repositories listed
-
Collaborative Deep Reinforcement Learning for Joint Object Search18 Feb 2017 0 repositories listed
-
Batch Policy Gradient Methods for Improving Neural Conversation Models10 Feb 2017 0 repositories listed
-
10 Feb 2017 0 repositories listed
-
Semi-Supervised QA with Generative Domain-Adaptive Nets7 Feb 2017 0 repositories listed
-
Uncertainty-Aware Reinforcement Learning for Collision Avoidance3 Feb 2017 0 repositories listed
-
Deep Reinforcement Learning for Robotic Manipulation-The state of the art31 Jan 2017 0 repositories listed
-
Deep Reinforcement Learning for Visual Object Tracking in Videos31 Jan 2017 0 repositories listed
-
Expert Level control of Ramp Metering based on Multi-task Deep Reinforcement Learning30 Jan 2017 0 repositories listed
-
Flow Navigation by Smart Microswimmers via Reinforcement Learning30 Jan 2017 0 repositories listed
-
Reinforcement Learning Algorithm Selection30 Jan 2017 0 repositories listed
-
Artificial Intelligence Approaches To UCAV Autonomy24 Jan 2017 0 repositories listed
-
Binary Matrix Guessing Problem22 Jan 2017 0 repositories listed
-
Basic protocols in quantum reinforcement learning with superconducting circuits18 Jan 2017 0 repositories listed
-
Agent-Agnostic Human-in-the-Loop Reinforcement Learning15 Jan 2017 0 repositories listed
-
Scalable and Incremental Learning of Gaussian Mixture Models14 Jan 2017 0 repositories listed
-
Toward negotiable reinforcement learning: shifting priorities in Pareto optimal sequential decision-making5 Jan 2017 0 repositories listed
-
First-Person Activity Forecasting with Online Inverse Reinforcement Learning22 Dec 2016 0 repositories listed
-
Non-Deterministic Policy Improvement Stabilizes Approximated Reinforcement Learning22 Dec 2016 0 repositories listed
-
On the function approximation error for risk-sensitive reinforcement learning22 Dec 2016 0 repositories listed
-
Loss is its own Reward: Self-Supervision for Reinforcement Learning21 Dec 2016 0 repositories listed
-
Sample-efficient Deep Reinforcement Learning for Dialog Control18 Dec 2016 0 repositories listed
-
Learning to predict where to look in interactive environments using deep recurrent q-learning17 Dec 2016 0 repositories listed
-
Reinforcement Learning Using Quantum Boltzmann Machines17 Dec 2016 0 repositories listed
-
Deep Reinforcement Learning with Successor Features for Navigation across Similar Environments16 Dec 2016 0 repositories listed
-
Separation of Concerns in Reinforcement Learning15 Dec 2016 0 repositories listed
-
End-to-End Deep Reinforcement Learning for Lane Keeping Assist13 Dec 2016 0 repositories listed
-
Incorporating Human Domain Knowledge into Large Scale Cost Function Learning13 Dec 2016 0 repositories listed
-
Learning to Drive using Inverse Reinforcement Learning and Deep Q-Networks12 Dec 2016 0 repositories listed
-
PoseAgent: Budget-Constrained 6D Object Pose Estimation via Reinforcement Learning12 Dec 2016 0 repositories listed
-
Reinforcement Learning With Temporal Logic Rewards11 Dec 2016 0 repositories listed