Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 141
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 141 of 152: papers 14,001 to 14,100 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Collaborative Deep Reinforcement Learning for Multi-Object Tracking1 Sep 2018 0 repositories listed
-
Deep Reinforcement Learning with Iterative Shift for Visual Tracking1 Sep 2018 0 repositories listed
-
Dual-Agent Deep Reinforcement Learning for Deformable Face Tracking1 Sep 2018 0 repositories listed
-
Goal-Oriented Visual Question Generation via Intermediate Rewards1 Sep 2018 0 repositories listed
-
Part-Activated Deep Reinforcement Learning for Action Prediction1 Sep 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas1 Sep 2018 0 repositories listed
-
Directed Exploration in PAC Model-Free Reinforcement Learning31 Aug 2018 0 repositories listed
-
Ensemble Sequence Level Training for Multimodal MT: OSU-Baidu WMT18 Multimodal Machine Translation System Report31 Aug 2018 0 repositories listed
-
A Reinforcement Learning-driven Translation Model for Search-Oriented Conversational Systems29 Aug 2018 0 repositories listed
-
Learning a Policy for Opportunistic Active Learning29 Aug 2018 0 repositories listed
-
High-confidence error estimates for learned value functions28 Aug 2018 0 repositories listed
-
Optimal control of eye-movements during visual search28 Aug 2018 0 repositories listed
-
25 Aug 2018 0 repositories listed
-
Proximal Policy Optimization and its Dynamic Version for Sequence Generation24 Aug 2018 0 repositories listed
-
Exploring Shared Structures and Hierarchies for Multiple NLP Tasks23 Aug 2018 0 repositories listed
-
Playing 20 Question Game with Policy-Based Reinforcement Learning23 Aug 2018 0 repositories listed
-
Catastrophic Importance of Catastrophic Forgetting20 Aug 2018 0 repositories listed
-
Goal-oriented Dialogue Policy Learning from Failures20 Aug 2018 0 repositories listed
-
Source-Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language19 Aug 2018 0 repositories listed
-
Data Poisoning Attacks in Contextual Bandits17 Aug 2018 0 repositories listed
-
Importance mixing: Improving sample reuse in evolutionary policy search methods17 Aug 2018 0 repositories listed
-
Reinforcement Learning for Autonomous Defence in Software-Defined Networking17 Aug 2018 0 repositories listed
-
Incorporating Consistency Verification into Neural Data-to-Document Generation15 Aug 2018 0 repositories listed
-
Directed Policy Gradient for Safe Reinforcement Learning with Human Advice13 Aug 2018 0 repositories listed
-
Visual Sensor Network Reconfiguration with Deep Reinforcement Learning13 Aug 2018 0 repositories listed
-
End-to-end Active Object Tracking and Its Real-world Deployment via Reinforcement Learning10 Aug 2018 0 repositories listed
-
Policy Optimization as Wasserstein Gradient Flows9 Aug 2018 0 repositories listed
-
Regret Bounds for Reinforcement Learning via Markov Chain Concentration6 Aug 2018 0 repositories listed
-
A New Concept of Deep Reinforcement Learning based Augmented General Tagging System1 Aug 2018 0 repositories listed
-
A Reinforcement Learning Framework for Natural Question Generation using Bi-discriminators1 Aug 2018 0 repositories listed
-
Interpretable Rationale Augmented Charge Prediction System1 Aug 2018 0 repositories listed
-
Learning Dexterous In-Hand Manipulation1 Aug 2018 0 repositories listed
-
Neural Math Word Problem Solver with Reinforcement Learning1 Aug 2018 0 repositories listed
-
Source Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language1 Aug 2018 0 repositories listed
-
Structured Dialogue Policy with Graph Neural Networks1 Aug 2018 0 repositories listed
-
Improving Spatiotemporal Self-Supervision by Deep Reinforcement Learning30 Jul 2018 0 repositories listed
-
Learning to Interrupt: A Hierarchical Deep Reinforcement Learning Framework for Efficient Exploration30 Jul 2018 0 repositories listed
-
Optimal Tap Setting of Voltage Regulation Transformers Using Batch Reinforcement Learning29 Jul 2018 0 repositories listed
-
A Reinforcement Learning Approach to Target Tracking in a Camera Network26 Jul 2018 0 repositories listed
-
Multi-modal Feedback for Affordance-driven Interactive Reinforcement Learning26 Jul 2018 0 repositories listed
-
Variational Bayesian Reinforcement Learning with Regret Bounds25 Jul 2018 0 repositories listed
-
A Temporal Difference Reinforcement Learning Theory of Emotion: unifying emotion, cognition and adaptive behavior24 Jul 2018 0 repositories listed
-
Contrastive Explanations for Reinforcement Learning in terms of Expected Consequences23 Jul 2018 0 repositories listed
-
Learning to Play Pong using Policy Gradient Learning23 Jul 2018 0 repositories listed
-
Accelerated Structure-Aware Reinforcement Learning for Delay-Sensitive Energy Harvesting Wireless Sensors22 Jul 2018 0 repositories listed
-
Asynchronous Advantage Actor-Critic Agent for Starcraft II22 Jul 2018 0 repositories listed
-
NAVREN-RL: Learning to fly in real environment via end-to-end deep reinforcement learning using monocular images22 Jul 2018 0 repositories listed
-
FuzzerGym: A Competitive Framework for Fuzzing and Learning19 Jul 2018 0 repositories listed
-
Self-Organizing Maps as a Storage and Transfer Mechanism in Reinforcement Learning19 Jul 2018 0 repositories listed
-
Towards Explainable and Controllable Open Domain Dialogue Generation with Dialogue Acts19 Jul 2018 0 repositories listed
-
News-based trading strategies18 Jul 2018 0 repositories listed
-
Representational efficiency outweighs action efficiency in human program induction18 Jul 2018 0 repositories listed
-
Foundations for Restraining Bolts: Reinforcement Learning with LTLf/LDLf restraining specifications17 Jul 2018 0 repositories listed
-
Discrete linear-complexity reinforcement learning in continuous action spaces for Q-learning algorithms16 Jul 2018 0 repositories listed
-
Online Robust Policy Learning in the Presence of Unknown Adversaries16 Jul 2018 0 repositories listed
-
Safe Reinforcement Learning via Probabilistic Shields16 Jul 2018 0 repositories listed
-
Toward Interpretable Deep Reinforcement Learning with Linear Model U-Trees16 Jul 2018 0 repositories listed
-
Exploring Hierarchy-Aware Inverse Reinforcement Learning13 Jul 2018 0 repositories listed
-
An Affective Robot Companion for Assisting the Elderly in a Cognitive Game Scenario12 Jul 2018 0 repositories listed
-
The Bottleneck Simulator: A Model-based Deep Reinforcement Learning Approach12 Jul 2018 0 repositories listed
-
Will it Blend? Composing Value Functions in Reinforcement Learning12 Jul 2018 0 repositories listed
-
CIRL: Controllable Imitative Reinforcement Learning for Vision-based Self-driving10 Jul 2018 0 repositories listed
-
Partial Policy-based Reinforcement Learning for Anatomical Landmark Localization in 3D Medical Images9 Jul 2018 0 repositories listed
-
Video Summarisation by Classification with Deep Reinforcement Learning9 Jul 2018 0 repositories listed
-
Auto Deep Compression by Reinforcement Learning Based Actor-Critic Structure8 Jul 2018 0 repositories listed
-
End-to-End Race Driving with Deep Reinforcement Learning6 Jul 2018 0 repositories listed
-
Variance Reduction for Reinforcement Learning in Input-Driven Environments6 Jul 2018 0 repositories listed
-
Arcades: A deep model for adaptive decision making in voice controlled smart-home5 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for Doom using Unsupervised Auxiliary Tasks5 Jul 2018 0 repositories listed
-
Goal-oriented Trajectories for Efficient Exploration5 Jul 2018 0 repositories listed
-
Using Reinforcement Learning with Partial Vehicle Detection for Intelligent Traffic Signal Control4 Jul 2018 0 repositories listed
-
Region Growing Curriculum Generation for Reinforcement Learning4 Jul 2018 0 repositories listed
-
Supervised Reinforcement Learning with Recurrent Neural Network for Dynamic Treatment Recommendation4 Jul 2018 0 repositories listed
-
Transfer with Model Features in Reinforcement Learning4 Jul 2018 0 repositories listed
-
Human-level performance in first-person multiplayer games with population-based deep reinforcement learning3 Jul 2018 0 repositories listed
-
1 Jul 2018 0 repositories listed
-
A Reinforcement Learning Neural Network for Robotic Manipulator Control1 Jul 2018 0 repositories listed
-
Beyond the One-Step Greedy Approach in Reinforcement Learning1 Jul 2018 0 repositories listed
-
Beyond Winning and Losing: Modeling Human Motivations and Behaviors Using Inverse Reinforcement Learning1 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for NLP1 Jul 2018 0 repositories listed
-
Feudal Dialogue Management with Jointly Learned Feature Extractors1 Jul 2018 0 repositories listed
-
Learning Hierarchical Structures On-The-Fly with a Recurrent-Recursive Model for Sequences1 Jul 2018 0 repositories listed
-
Learning to Act in Decentralized Partially Observable MDPs1 Jul 2018 0 repositories listed
-
Learning to Explore via Meta-Policy Gradient1 Jul 2018 0 repositories listed
-
Mix & Match - Agent Curricula for Reinforcement Learning1 Jul 2018 0 repositories listed
-
Policy and Value Transfer in Lifelong Reinforcement Learning1 Jul 2018 0 repositories listed
-
Policy Optimization with Demonstrations1 Jul 2018 0 repositories listed
-
Spotlight: Optimizing Device Placement for Training Deep Neural Networks1 Jul 2018 0 repositories listed
-
State Abstractions for Lifelong Reinforcement Learning1 Jul 2018 0 repositories listed
-
Towards Mixed Optimization for Reinforcement Learning with Program Synthesis1 Jul 2018 0 repositories listed
-
Understanding and Simplifying One-Shot Architecture Search1 Jul 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Abductive Planning28 Jun 2018 0 repositories listed
-
MONAS: Multi-Objective Neural Architecture Search using Reinforcement Learning27 Jun 2018 0 repositories listed
-
Deep Generative Models with Learnable Knowledge Constraints26 Jun 2018 0 repositories listed
-
Multi-agent Inverse Reinforcement Learning for Certain General-sum Stochastic Games26 Jun 2018 0 repositories listed
-
Deep Reinforcement Learning: An Overview23 Jun 2018 0 repositories listed
-
Human-Interactive Subgoal Supervision for Efficient Inverse Reinforcement Learning22 Jun 2018 0 repositories listed
-
Many-Goals Reinforcement Learning22 Jun 2018 0 repositories listed
-
A New Approach for Resource Scheduling with Deep Reinforcement Learning21 Jun 2018 0 repositories listed
-
A Dissection of Overfitting and Generalization in Continuous Reinforcement Learning20 Jun 2018 0 repositories listed