Browse State-of-the-Art › Reinforcement Learning › Papers, page 124
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 124 of 132: papers 12,301 to 12,400 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Automating Vehicles by Deep Reinforcement Learning using Task Separation with Hill Climbing29 Nov 2017 0 repositories listed
-
Curriculum Q-Learning for Visual Vocabulary Acquisition29 Nov 2017 0 repositories listed
-
Efficient exploration with Double Uncertain Value Networks29 Nov 2017 0 repositories listed
-
End-to-End Optimization of Task-Oriented Dialogue Model with Deep Reinforcement Learning29 Nov 2017 0 repositories listed
-
29 Nov 2017 0 repositories listed
-
Reinforcement Learning To Adapt Speech Enhancement to Instantaneous Input Signal Quality29 Nov 2017 0 repositories listed
-
Video Captioning via Hierarchical Reinforcement Learning29 Nov 2017 0 repositories listed
-
A reinforcement learning algorithm for building collaboration in multi-agent systems28 Nov 2017 0 repositories listed
-
Hierarchical Policy Search via Return-Weighted Density Estimation28 Nov 2017 0 repositories listed
-
Learning from Longitudinal Face Demonstration - Where Tractable Deep Modeling Meets Inverse Reinforcement Learning28 Nov 2017 0 repositories listed
-
Malaria Likelihood Prediction By Effectively Surveying Households Using Deep Reinforcement Learning25 Nov 2017 0 repositories listed
-
A Compression-Inspired Framework for Macro Discovery24 Nov 2017 0 repositories listed
-
Cascade Attribute Learning Network24 Nov 2017 0 repositories listed
-
21 Nov 2017 0 repositories listed
-
Asking the Difficult Questions: Goal-Oriented Visual Question Generation via Intermediate Rewards21 Nov 2017 0 repositories listed
-
Posterior Sampling for Large Scale Reinforcement Learning21 Nov 2017 0 repositories listed
-
Transferring Agent Behaviors from Videos via Motion GANs21 Nov 2017 0 repositories listed
-
Deep Reinforcement Learning for Multi-Resource Multi-Machine Job Scheduling20 Nov 2017 0 repositories listed
-
Modular Continual Learning in a Unified Visual Environment20 Nov 2017 0 repositories listed
-
Situationally Aware Options20 Nov 2017 0 repositories listed
-
Neural Network Based Reinforcement Learning for Audio-Visual Gaze Control in Human-Robot Interaction18 Nov 2017 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems15 Nov 2017 0 repositories listed
-
Costate-focused models for reinforcement learning15 Nov 2017 0 repositories listed
-
Finding Efficient Swimming Strategies in a Three Dimensional Chaotic Flow by Reinforcement Learning15 Nov 2017 0 repositories listed
-
Markov Decision Processes with Continuous Side Information15 Nov 2017 0 repositories listed
-
Variational Adaptive-Newton Method for Explorative Learning15 Nov 2017 0 repositories listed
-
A unified decision making framework for supply and demand management in microgrid networks14 Nov 2017 0 repositories listed
-
Dynamic Fusion Networks for Machine Reading Comprehension14 Nov 2017 0 repositories listed
-
Dynamic Zoom-in Network for Fast Object Detection in Large Images14 Nov 2017 0 repositories listed
-
Loss Functions for Multiset Prediction14 Nov 2017 0 repositories listed
-
Reinforcement Learning in a large scale photonic Recurrent Neural Network14 Nov 2017 0 repositories listed
-
Saliency-based Sequential Image Attention with Multiset Prediction14 Nov 2017 0 repositories listed
-
ACtuAL: Actor-Critic Under Adversarial Learning13 Nov 2017 0 repositories listed
-
Variance Reduced methods for Non-convex Composition Optimization13 Nov 2017 0 repositories listed
-
Fine Grained Knowledge Transfer for Personalized Task-oriented Dialogue Systems11 Nov 2017 0 repositories listed
-
Accelerated Method for Stochastic Composition Optimization with Nonsmooth Regularization10 Nov 2017 0 repositories listed
-
Applications of Deep Learning and Reinforcement Learning to Biological Data10 Nov 2017 0 repositories listed
-
Integrating User and Agent Models: A Deep Task-Oriented Dialogue System10 Nov 2017 0 repositories listed
-
Reinforcement Learning of Speech Recognition System Based on Policy Gradient and Hypothesis Selection10 Nov 2017 0 repositories listed
-
An Empirical Analysis of Multiple-Turn Reasoning Strategies in Reading Comprehension Tasks9 Nov 2017 0 repositories listed
-
Worm-level Control through Search-based Reinforcement Learning9 Nov 2017 0 repositories listed
-
Energy Storage Arbitrage in Real-Time Markets via Reinforcement Learning8 Nov 2017 0 repositories listed
-
Intriguing Properties of Adversarial Examples8 Nov 2017 0 repositories listed
-
Learning Deep Mean Field Games for Modeling Large Population Behavior8 Nov 2017 0 repositories listed
-
Double Q(σ) and Q(σ, λ): Unifying Reinforcement Learning Control Algorithms5 Nov 2017 0 repositories listed
-
Composing Meta-Policies for Autonomous Driving Using Hierarchical Deep Reinforcement Learning4 Nov 2017 0 repositories listed
-
Policy Optimization by Genetic Distillation3 Nov 2017 0 repositories listed
-
Routing Networks: Adaptive Selection of Non-linear Functions for Multi-Task Learning3 Nov 2017 0 repositories listed
-
Acquiring Target Stacking Skills by Goal-Parameterized Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automatic Text Summarization Using Reinforcement Learning with Embedding Features1 Nov 2017 0 repositories listed
-
Intelligent Parameter Tuning in Optimization-based Iterative CT Reconstruction via Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Learning to Diagnose: Assimilating Clinical Narratives using Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Paraphrase Generation with Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automata-Guided Hierarchical Reinforcement Learning for Skill Composition31 Oct 2017 0 repositories listed
-
Artificial Intelligence as Structural Estimation: Economic Interpretations of Deep Blue, Bonanza, and AlphaGo30 Oct 2017 0 repositories listed
-
Exponential improvements for quantum-accessible reinforcement learning30 Oct 2017 0 repositories listed
-
Sequence-to-Sequence ASR Optimization via Reinforcement Learning30 Oct 2017 0 repositories listed
-
Transfer Learning to Learn with Multitask Neural Model Search30 Oct 2017 0 repositories listed
-
Unifying Value Iteration, Advantage Learning, and Dynamic Policy Programming30 Oct 2017 0 repositories listed
-
Diff-DAC: Distributed Actor-Critic for Average Multitask Deep Reinforcement Learning28 Oct 2017 0 repositories listed
-
Inverse Reinforcement Learning Under Noisy Observations27 Oct 2017 0 repositories listed
-
Duality-free Methods for Stochastic Composition Optimization26 Oct 2017 0 repositories listed
-
Fast Model Identification via Physics Engines for Data-Efficient Policy Search24 Oct 2017 0 repositories listed
-
Accelerated Reinforcement Learning23 Oct 2017 0 repositories listed
-
Exploiting generalization in the subspaces for faster model-based learning22 Oct 2017 0 repositories listed
-
Insulin Regimen ML-based control for T2DM patients21 Oct 2017 0 repositories listed
-
Consequentialist conditional cooperation in social dilemmas with imperfect information19 Oct 2017 0 repositories listed
-
Online Monotone Games19 Oct 2017 0 repositories listed
-
Asymmetric Actor Critic for Image-Based Robot Learning18 Oct 2017 0 repositories listed
-
Map-based Multi-Policy Reinforcement Learning: Enhancing Adaptability of Robots by Deep Reinforcement Learning17 Oct 2017 0 repositories listed
-
Primal-Dual π Learning: Sample Complexity and Sublinear Run Time for Ergodic Markov Decision Problems17 Oct 2017 0 repositories listed
-
Stochastic Variance Reduction for Policy Gradient Estimation17 Oct 2017 0 repositories listed
-
Manifold Regularization for Kernelized LSTD15 Oct 2017 0 repositories listed
-
Is Epicurus the father of Reinforcement Learning?12 Oct 2017 0 repositories listed
-
PRM-RL: Long-range Robotic Navigation Tasks by Combining Reinforcement Learning and Sampling-based Planning11 Oct 2017 0 repositories listed
-
Deep Reinforcement Learning: Framework, Applications, and Embedded Implementations10 Oct 2017 0 repositories listed
-
On- and Off-Policy Monotonic Policy Improvement10 Oct 2017 0 repositories listed
-
Meta Inverse Reinforcement Learning via Maximum Reward Sharing for Human Motion Analysis7 Oct 2017 0 repositories listed
-
Efficient K-Shot Learning with Regularized Deep Networks6 Oct 2017 0 repositories listed
-
Exploration in Feature Space for Reinforcement Learning5 Oct 2017 0 repositories listed
-
Event Identification as a Decision Process with Non-linear Representation of Text3 Oct 2017 0 repositories listed
-
Deep Abstract Q-Networks2 Oct 2017 0 repositories listed
-
Attention-Aware Deep Reinforcement Learning for Video Face Recognition1 Oct 2017 0 repositories listed
-
Parameter Sharing Deep Deterministic Policy Gradient for Cooperative Multi-agent Reinforcement Learning1 Oct 2017 0 repositories listed
-
Learning how to learn: an adaptive dialogue agent for incrementally learning visually grounded word meanings29 Sep 2017 0 repositories listed
-
Neural and Synaptic Array Transceiver: A Brain-Inspired Computing Framework for Embedded Learning29 Sep 2017 0 repositories listed
-
The BURCHAK corpus: a Challenge Data Set for Interactive Learning of Visually Grounded Word Meanings29 Sep 2017 0 repositories listed
-
A Policy Search Method For Temporal Logic Specified Reinforcement Learning Tasks27 Sep 2017 0 repositories listed
-
A Simple Reinforcement Learning Mechanism for Resource Allocation in LTE-A Networks with Markov Decision Process and Q-Learning27 Sep 2017 0 repositories listed
-
The detour problem in a stochastic environment: Tolman revisited27 Sep 2017 0 repositories listed
-
Object-oriented Neural Programming (OONP) for Document Understanding26 Sep 2017 0 repositories listed
-
Predictive-State Decoders: Encoding the Future into Recurrent Networks25 Sep 2017 0 repositories listed
-
Towards continuous control of flippers for a multi-terrain robot using deep reinforcement learning25 Sep 2017 0 repositories listed
-
An Optimal Online Method of Selecting Source Policies for Reinforcement Learning24 Sep 2017 0 repositories listed
-
Learning Unmanned Aerial Vehicle Control for Autonomous Target Following24 Sep 2017 0 repositories listed
-
Bootstrapping incremental dialogue systems from minimal data: the generalisation power of dialogue grammars22 Sep 2017 0 repositories listed
-
Inverse Reinforcement Learning with Conditional Choice Probabilities22 Sep 2017 0 repositories listed
-
Multiqubit and multilevel quantum reinforcement learning with quantum technologies22 Sep 2017 0 repositories listed
-
On overfitting and asymptotic bias in batch reinforcement learning with partial observability22 Sep 2017 0 repositories listed
-
OptLayer - Practical Constrained Optimization for Deep Reinforcement Learning in the Real World22 Sep 2017 0 repositories listed