Browse State-of-the-Art › reinforcement-learning › Papers, page 125
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 125 of 135: papers 12,401 to 12,500 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Exploiting Environmental Variation to Improve Policy Robustness in Reinforcement Learning27 Sep 2018 0 repositories listed
-
Expressiveness in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Guided Exploration in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Hybrid Policies Using Inverse Rewards for Reinforcement Learning27 Sep 2018 0 repositories listed
-
Incremental Hierarchical Reinforcement Learning with Multitask LMDPs27 Sep 2018 0 repositories listed
-
Interactive Parallel Exploration for Reinforcement Learning in Continuous Action Spaces27 Sep 2018 0 repositories listed
-
Learning to Coordinate Multiple Reinforcement Learning Agents for Diverse Query Reformulation27 Sep 2018 0 repositories listed
-
Mimicking actions is a good strategy for beginners: Fast Reinforcement Learning with Expert Action Sequences27 Sep 2018 0 repositories listed
-
Policy Generalization In Capacity-Limited Reinforcement Learning27 Sep 2018 0 repositories listed
-
Shrinkage-based Bias-Variance Trade-off for Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Successor Options : An Option Discovery Algorithm for Reinforcement Learning27 Sep 2018 0 repositories listed
-
The wisdom of the crowd: reliable deep reinforcement learning through ensembles of Q-functions27 Sep 2018 0 repositories listed
-
Unsupervised Exploration with Deep Model-Based Reinforcement Learning27 Sep 2018 0 repositories listed
-
What Would pi* Do?: Imitation Learning via Off-Policy Reinforcement Learning27 Sep 2018 0 repositories listed
-
Where Off-Policy Deep Reinforcement Learning Fails27 Sep 2018 0 repositories listed
-
AlphaSeq: Sequence Discovery with Deep Reinforcement Learning26 Sep 2018 0 repositories listed
-
Learning Navigation Behaviors End-to-End with AutoRL26 Sep 2018 0 repositories listed
-
Learning through Probing: a decentralized reinforcement learning architecture for social dilemmas26 Sep 2018 0 repositories listed
-
Omega-Regular Objectives in Model-Free Reinforcement Learning26 Sep 2018 0 repositories listed
-
Anderson Acceleration for Reinforcement Learning25 Sep 2018 0 repositories listed
-
Floyd-Warshall Reinforcement Learning: Learning from Past Experiences to Reach New Goals25 Sep 2018 0 repositories listed
-
Hierarchical Deep Multiagent Reinforcement Learning with Temporal Abstraction25 Sep 2018 0 repositories listed
-
Low Precision Policy Distillation with Application to Low-Power, Real-time Sensation-Cognition-Action Loop with Neuromorphic Computing25 Sep 2018 0 repositories listed
-
Resilient Computing with Reinforcement Learning on a Dynamical System: Case Study in Sorting25 Sep 2018 0 repositories listed
-
EpiRL: A Reinforcement Learning Agent to Facilitate Epistasis Detection24 Sep 2018 0 repositories listed
-
SDN Flow Entry Management Using Reinforcement Learning24 Sep 2018 0 repositories listed
-
A Learning Framework for High Precision Industrial Assembly23 Sep 2018 0 repositories listed
-
On Reinforcement Learning for Full-length Game of StarCraft23 Sep 2018 0 repositories listed
-
Geometric Multi-Model Fitting by Deep Reinforcement Learning22 Sep 2018 0 repositories listed
-
Finite Sample Analysis of the GTD Policy Evaluation Algorithms in Markov Setting21 Sep 2018 0 repositories listed
-
Interpretable Multi-Objective Reinforcement Learning through Policy Orchestration21 Sep 2018 0 repositories listed
-
IntelligentCrowd: Mobile Crowdsensing via Multi-Agent Reinforcement Learning20 Sep 2018 0 repositories listed
-
Interpretable Reinforcement Learning with Ensemble Methods19 Sep 2018 0 repositories listed
-
Prosocial or Selfish? Agents with different behaviors for Contract Negotiation using Reinforcement Learning19 Sep 2018 0 repositories listed
-
Multiobjective Reinforcement Learning for Reconfigurable Adaptive Optimal Control of Manufacturing Processes18 Sep 2018 0 repositories listed
-
SCC-rFMQ Learning in Cooperative Markov Games with Continuous Actions18 Sep 2018 0 repositories listed
-
Switching Isotropic and Directional Exploration with Parameter Space Noise in Deep Reinforcement Learning18 Sep 2018 0 repositories listed
-
Adversarial Imitation via Variational Inverse Reinforcement Learning17 Sep 2018 0 repositories listed
-
Automata Guided Reinforcement Learning With Demonstrations17 Sep 2018 0 repositories listed
-
Curriculum goal masking for continuous deep reinforcement learning17 Sep 2018 0 repositories listed
-
Learning to Collaborate: Multi-Scenario Ranking via Multi-Agent Reinforcement Learning17 Sep 2018 0 repositories listed
-
Object-sensitive Deep Reinforcement Learning17 Sep 2018 0 repositories listed
-
Improvements on Hindsight Learning16 Sep 2018 0 repositories listed
-
Adversarial Reinforcement Learning for Observer Design in Autonomous Systems under Cyber Attacks15 Sep 2018 0 repositories listed
-
Auto-tuning Distributed Stream Processing Systems using Reinforcement Learning14 Sep 2018 0 repositories listed
-
Macquarie University at BioASQ 6b: Deep learning and deep reinforcement learning for query-based multi-document summarisation14 Sep 2018 0 repositories listed
-
Visual Diagnostics for Deep Reinforcement Learning Policy Development14 Sep 2018 0 repositories listed
-
Coordination-driven learning in multi-agent problem spaces13 Sep 2018 0 repositories listed
-
Image Captioning based on Deep Reinforcement Learning13 Sep 2018 0 repositories listed
-
Automatic, Personalized, and Flexible Playlist Generation using Reinforcement Learning12 Sep 2018 0 repositories listed
-
A Multi-Agent Reinforcement Learning Method for Impression Allocation in Online Display Advertising10 Sep 2018 0 repositories listed
-
Learning to Generate Structured Queries from Natural Language with Indirect Supervision10 Sep 2018 0 repositories listed
-
VPE: Variational Policy Embedding for Transfer Reinforcement Learning10 Sep 2018 0 repositories listed
-
Probabilistic Prediction of Interactive Driving Behavior via Hierarchical Inverse Reinforcement Learning9 Sep 2018 0 repositories listed
-
ANS: Adaptive Network Scaling for Deep Rectifier Reinforcement Learning Models6 Sep 2018 0 repositories listed
-
How to Combine Tree-Search Methods in Reinforcement Learning6 Sep 2018 0 repositories listed
-
Learn What Not to Learn: Action Elimination with Deep Reinforcement Learning6 Sep 2018 0 repositories listed
-
Model-Based Regularization for Deep Reinforcement Learning with Transcoder Networks6 Sep 2018 0 repositories listed
-
Recurrent World Models Facilitate Policy Evolution4 Sep 2018 0 repositories listed
-
Transferring Deep Reinforcement Learning with Adversarial Objective and Augmentation4 Sep 2018 0 repositories listed
-
Flatland: a Lightweight First-Person 2-D Environment for Reinforcement Learning3 Sep 2018 0 repositories listed
-
Natural Language Person Search Using Deep Reinforcement Learning2 Sep 2018 0 repositories listed
-
A Contextual-bandit-based Approach for Informed Decision-making in Clinical Trials1 Sep 2018 0 repositories listed
-
Collaborative Deep Reinforcement Learning for Multi-Object Tracking1 Sep 2018 0 repositories listed
-
Deep Reinforcement Learning with Iterative Shift for Visual Tracking1 Sep 2018 0 repositories listed
-
Dual-Agent Deep Reinforcement Learning for Deformable Face Tracking1 Sep 2018 0 repositories listed
-
Part-Activated Deep Reinforcement Learning for Action Prediction1 Sep 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas1 Sep 2018 0 repositories listed
-
Directed Exploration in PAC Model-Free Reinforcement Learning31 Aug 2018 0 repositories listed
-
Ensemble Sequence Level Training for Multimodal MT: OSU-Baidu WMT18 Multimodal Machine Translation System Report31 Aug 2018 0 repositories listed
-
A Reinforcement Learning-driven Translation Model for Search-Oriented Conversational Systems29 Aug 2018 0 repositories listed
-
Learning a Policy for Opportunistic Active Learning29 Aug 2018 0 repositories listed
-
High-confidence error estimates for learned value functions28 Aug 2018 0 repositories listed
-
Optimal control of eye-movements during visual search28 Aug 2018 0 repositories listed
-
25 Aug 2018 0 repositories listed
-
Proximal Policy Optimization and its Dynamic Version for Sequence Generation24 Aug 2018 0 repositories listed
-
Exploring Shared Structures and Hierarchies for Multiple NLP Tasks23 Aug 2018 0 repositories listed
-
Playing 20 Question Game with Policy-Based Reinforcement Learning23 Aug 2018 0 repositories listed
-
Catastrophic Importance of Catastrophic Forgetting20 Aug 2018 0 repositories listed
-
Goal-oriented Dialogue Policy Learning from Failures20 Aug 2018 0 repositories listed
-
Source-Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language19 Aug 2018 0 repositories listed
-
Data Poisoning Attacks in Contextual Bandits17 Aug 2018 0 repositories listed
-
Importance mixing: Improving sample reuse in evolutionary policy search methods17 Aug 2018 0 repositories listed
-
Reinforcement Learning for Autonomous Defence in Software-Defined Networking17 Aug 2018 0 repositories listed
-
Incorporating Consistency Verification into Neural Data-to-Document Generation15 Aug 2018 0 repositories listed
-
Directed Policy Gradient for Safe Reinforcement Learning with Human Advice13 Aug 2018 0 repositories listed
-
Visual Sensor Network Reconfiguration with Deep Reinforcement Learning13 Aug 2018 0 repositories listed
-
Regret Bounds for Reinforcement Learning via Markov Chain Concentration6 Aug 2018 0 repositories listed
-
A New Concept of Deep Reinforcement Learning based Augmented General Tagging System1 Aug 2018 0 repositories listed
-
A Reinforcement Learning Framework for Natural Question Generation using Bi-discriminators1 Aug 2018 0 repositories listed
-
Interpretable Rationale Augmented Charge Prediction System1 Aug 2018 0 repositories listed
-
Learning Dexterous In-Hand Manipulation1 Aug 2018 0 repositories listed
-
Neural Math Word Problem Solver with Reinforcement Learning1 Aug 2018 0 repositories listed
-
Source Critical Reinforcement Learning for Transferring Spoken Language Understanding to a New Language1 Aug 2018 0 repositories listed
-
Structured Dialogue Policy with Graph Neural Networks1 Aug 2018 0 repositories listed
-
Improving Spatiotemporal Self-Supervision by Deep Reinforcement Learning30 Jul 2018 0 repositories listed
-
Learning to Interrupt: A Hierarchical Deep Reinforcement Learning Framework for Efficient Exploration30 Jul 2018 0 repositories listed
-
Optimal Tap Setting of Voltage Regulation Transformers Using Batch Reinforcement Learning29 Jul 2018 0 repositories listed
-
A Reinforcement Learning Approach to Target Tracking in a Camera Network26 Jul 2018 0 repositories listed
-
Multi-modal Feedback for Affordance-driven Interactive Reinforcement Learning26 Jul 2018 0 repositories listed