Browse State-of-the-Art › Reinforcement Learning › Papers, page 118
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 118 of 132: papers 11,701 to 11,800 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
How to Combine Tree-Search Methods in Reinforcement Learning6 Sep 2018 0 repositories listed
-
Learn What Not to Learn: Action Elimination with Deep Reinforcement Learning6 Sep 2018 0 repositories listed
-
Model-Based Regularization for Deep Reinforcement Learning with Transcoder Networks6 Sep 2018 0 repositories listed
-
Recurrent World Models Facilitate Policy Evolution4 Sep 2018 0 repositories listed
-
Transferring Deep Reinforcement Learning with Adversarial Objective and Augmentation4 Sep 2018 0 repositories listed
-
Flatland: a Lightweight First-Person 2-D Environment for Reinforcement Learning3 Sep 2018 0 repositories listed
-
Effective Exploration for Deep Reinforcement Learning via Bootstrapped Q-Ensembles under Tsallis Entropy Regularization2 Sep 2018 0 repositories listed
-
Natural Language Person Search Using Deep Reinforcement Learning2 Sep 2018 0 repositories listed
-
A Contextual-bandit-based Approach for Informed Decision-making in Clinical Trials1 Sep 2018 0 repositories listed
-
Collaborative Deep Reinforcement Learning for Multi-Object Tracking1 Sep 2018 0 repositories listed
-
Deep Reinforcement Learning with Iterative Shift for Visual Tracking1 Sep 2018 0 repositories listed
-
Dual-Agent Deep Reinforcement Learning for Deformable Face Tracking1 Sep 2018 0 repositories listed
-
Goal-Oriented Visual Question Generation via Intermediate Rewards1 Sep 2018 0 repositories listed
-
Part-Activated Deep Reinforcement Learning for Action Prediction1 Sep 2018 0 repositories listed
-
Real-time 'Actor-Critic' Tracking1 Sep 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas1 Sep 2018 0 repositories listed
-
Directed Exploration in PAC Model-Free Reinforcement Learning31 Aug 2018 0 repositories listed
-
Ensemble Sequence Level Training for Multimodal MT: OSU-Baidu WMT18 Multimodal Machine Translation System Report31 Aug 2018 0 repositories listed
-
A Reinforcement Learning-driven Translation Model for Search-Oriented Conversational Systems29 Aug 2018 0 repositories listed
-
Approximate Exploration through State Abstraction29 Aug 2018 0 repositories listed
-
Learning a Policy for Opportunistic Active Learning29 Aug 2018 0 repositories listed
-
High-confidence error estimates for learned value functions28 Aug 2018 0 repositories listed
-
MARL-FWC: Optimal Coordination of Freeway Traffic Control Measures27 Aug 2018 0 repositories listed
-
25 Aug 2018 0 repositories listed
-
Proximal Policy Optimization and its Dynamic Version for Sequence Generation24 Aug 2018 0 repositories listed
-
Exploring Shared Structures and Hierarchies for Multiple NLP Tasks23 Aug 2018 0 repositories listed
-
Playing 20 Question Game with Policy-Based Reinforcement Learning23 Aug 2018 0 repositories listed
-
Catastrophic Importance of Catastrophic Forgetting20 Aug 2018 0 repositories listed
-
Goal-oriented Dialogue Policy Learning from Failures20 Aug 2018 0 repositories listed
-
Source-Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language19 Aug 2018 0 repositories listed
-
Data Poisoning Attacks in Contextual Bandits17 Aug 2018 0 repositories listed
-
Importance mixing: Improving sample reuse in evolutionary policy search methods17 Aug 2018 0 repositories listed
-
Reinforcement Learning for Autonomous Defence in Software-Defined Networking17 Aug 2018 0 repositories listed
-
Incorporating Consistency Verification into Neural Data-to-Document Generation15 Aug 2018 0 repositories listed
-
An Optimal Policy for Patient Laboratory Tests in Intensive Care Units14 Aug 2018 0 repositories listed
-
Directed Policy Gradient for Safe Reinforcement Learning with Human Advice13 Aug 2018 0 repositories listed
-
Visual Sensor Network Reconfiguration with Deep Reinforcement Learning13 Aug 2018 0 repositories listed
-
End-to-end Active Object Tracking and Its Real-world Deployment via Reinforcement Learning10 Aug 2018 0 repositories listed
-
Policy Optimization as Wasserstein Gradient Flows9 Aug 2018 0 repositories listed
-
Segmental Audio Word2Vec: Representing Utterances as Sequences of Vectors with Applications in Spoken Term Detection7 Aug 2018 0 repositories listed
-
Distributional Multivariate Policy Evaluation and Exploration with the Bellman GAN6 Aug 2018 0 repositories listed
-
On Optimizing Deep Convolutional Neural Networks by Evolutionary Computing6 Aug 2018 0 repositories listed
-
Regret Bounds for Reinforcement Learning via Markov Chain Concentration6 Aug 2018 0 repositories listed
-
GeneSys: Enabling Continuous Learning through Neural Network Evolution in Hardware3 Aug 2018 0 repositories listed
-
Learning Actionable Representations from Visual Observations2 Aug 2018 0 repositories listed
-
A New Concept of Deep Reinforcement Learning based Augmented General Tagging System1 Aug 2018 0 repositories listed
-
A Reinforcement Learning Framework for Natural Question Generation using Bi-discriminators1 Aug 2018 0 repositories listed
-
Interpretable Rationale Augmented Charge Prediction System1 Aug 2018 0 repositories listed
-
Learning Dexterous In-Hand Manipulation1 Aug 2018 0 repositories listed
-
Neural Math Word Problem Solver with Reinforcement Learning1 Aug 2018 0 repositories listed
-
Source Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language1 Aug 2018 0 repositories listed
-
Structured Dialogue Policy with Graph Neural Networks1 Aug 2018 0 repositories listed
-
Learning Stabilizable Dynamical Systems via Control Contraction Metrics31 Jul 2018 0 repositories listed
-
Active Object Perceiver: Recognition-guided Policy Learning for Object Searching on Mobile Robots30 Jul 2018 0 repositories listed
-
Improving Spatiotemporal Self-Supervision by Deep Reinforcement Learning30 Jul 2018 0 repositories listed
-
Learning to Interrupt: A Hierarchical Deep Reinforcement Learning Framework for Efficient Exploration30 Jul 2018 0 repositories listed
-
Leveraging Motion Priors in Videos for Improving Human Segmentation30 Jul 2018 0 repositories listed
-
Optimal Tap Setting of Voltage Regulation Transformers Using Batch Reinforcement Learning29 Jul 2018 0 repositories listed
-
Deep PDF: Probabilistic Surface Optimization and Density Estimation27 Jul 2018 0 repositories listed
-
A Reinforcement Learning Approach to Target Tracking in a Camera Network26 Jul 2018 0 repositories listed
-
Multi-modal Feedback for Affordance-driven Interactive Reinforcement Learning26 Jul 2018 0 repositories listed
-
Variational Bayesian Reinforcement Learning with Regret Bounds25 Jul 2018 0 repositories listed
-
25 Jul 2018 0 repositories listed
-
A Temporal Difference Reinforcement Learning Theory of Emotion: unifying emotion, cognition and adaptive behavior24 Jul 2018 0 repositories listed
-
Contrastive Explanations for Reinforcement Learning in terms of Expected Consequences23 Jul 2018 0 repositories listed
-
Learning to Play Pong using Policy Gradient Learning23 Jul 2018 0 repositories listed
-
Accelerated Structure-Aware Reinforcement Learning for Delay-Sensitive Energy Harvesting Wireless Sensors22 Jul 2018 0 repositories listed
-
Asynchronous Advantage Actor-Critic Agent for Starcraft II22 Jul 2018 0 repositories listed
-
NAVREN-RL: Learning to fly in real environment via end-to-end deep reinforcement learning using monocular images22 Jul 2018 0 repositories listed
-
Automatically Designing CNN Architectures for Medical Image Segmentation19 Jul 2018 0 repositories listed
-
FuzzerGym: A Competitive Framework for Fuzzing and Learning19 Jul 2018 0 repositories listed
-
Self-Organizing Maps as a Storage and Transfer Mechanism in Reinforcement Learning19 Jul 2018 0 repositories listed
-
Towards Explainable and Controllable Open Domain Dialogue Generation with Dialogue Acts19 Jul 2018 0 repositories listed
-
News-based trading strategies18 Jul 2018 0 repositories listed
-
Representational efficiency outweighs action efficiency in human program induction18 Jul 2018 0 repositories listed
-
Foundations for Restraining Bolts: Reinforcement Learning with LTLf/LDLf restraining specifications17 Jul 2018 0 repositories listed
-
Discrete linear-complexity reinforcement learning in continuous action spaces for Q-learning algorithms16 Jul 2018 0 repositories listed
-
Online Robust Policy Learning in the Presence of Unknown Adversaries16 Jul 2018 0 repositories listed
-
Safe Reinforcement Learning via Probabilistic Shields16 Jul 2018 0 repositories listed
-
Toward Interpretable Deep Reinforcement Learning with Linear Model U-Trees16 Jul 2018 0 repositories listed
-
Exploring Hierarchy-Aware Inverse Reinforcement Learning13 Jul 2018 0 repositories listed
-
A Constrained Randomized Shortest-Paths Framework for Optimal Exploration12 Jul 2018 0 repositories listed
-
The Bottleneck Simulator: A Model-based Deep Reinforcement Learning Approach12 Jul 2018 0 repositories listed
-
Will it Blend? Composing Value Functions in Reinforcement Learning12 Jul 2018 0 repositories listed
-
A Hierarchical Bayesian Linear Regression Model with Local Features for Stochastic Dynamics Approximation11 Jul 2018 0 repositories listed
-
How Local is the Local Diversity? Reinforcing Sequential Determinantal Point Processes with Dynamic Ground Sets for Supervised Video Summarization11 Jul 2018 0 repositories listed
-
CIRL: Controllable Imitative Reinforcement Learning for Vision-based Self-driving10 Jul 2018 0 repositories listed
-
Deterministic Policy Gradients With General State Transitions10 Jul 2018 0 repositories listed
-
Partial Policy-based Reinforcement Learning for Anatomical Landmark Localization in 3D Medical Images9 Jul 2018 0 repositories listed
-
Video Summarisation by Classification with Deep Reinforcement Learning9 Jul 2018 0 repositories listed
-
Auto Deep Compression by Reinforcement Learning Based Actor-Critic Structure8 Jul 2018 0 repositories listed
-
A survey on policy search algorithms for learning robot controllers in a handful of trials6 Jul 2018 0 repositories listed
-
End-to-End Race Driving with Deep Reinforcement Learning6 Jul 2018 0 repositories listed
-
JUMPER: Learning When to Make Classification Decisions in Reading6 Jul 2018 0 repositories listed
-
Variance Reduction for Reinforcement Learning in Input-Driven Environments6 Jul 2018 0 repositories listed
-
Arcades: A deep model for adaptive decision making in voice controlled smart-home5 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for Doom using Unsupervised Auxiliary Tasks5 Jul 2018 0 repositories listed
-
Encoding Motion Primitives for Autonomous Vehicles using Virtual Velocity Constraints and Neural Network Scheduling5 Jul 2018 0 repositories listed
-
Goal-oriented Trajectories for Efficient Exploration5 Jul 2018 0 repositories listed
-
Per-decision Multi-step Temporal Difference Learning with Control Variates5 Jul 2018 0 repositories listed