Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 140
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 140 of 152: papers 13,901 to 14,000 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Adaptive Multi-pass Decoder for Neural Machine Translation1 Oct 2018 0 repositories listed
-
Automatic Essay Scoring Incorporating Rating Schema via Reinforcement Learning1 Oct 2018 0 repositories listed
-
Automatic Poetry Generation with Mutual Reinforcement Learning1 Oct 2018 0 repositories listed
-
Autonomous Sub-domain Modeling for Dialogue Policy with Hierarchical Deep Reinforcement Learning1 Oct 2018 0 repositories listed
-
Curriculum Learning Based on Reward Sparseness for Deep Reinforcement Learning of Task Completion Dialogue Management1 Oct 2018 0 repositories listed
-
Logician and Orator: Learning from the Duality between Language and Knowledge in Open Domain1 Oct 2018 0 repositories listed
-
Prediction Improves Simultaneous Neural Machine Translation1 Oct 2018 0 repositories listed
-
SmartChoices: Hybridizing Programming and Machine Learning1 Oct 2018 0 repositories listed
-
Bayesian Transfer Reinforcement Learning with Prior Knowledge Rules30 Sep 2018 0 repositories listed
-
Few-Shot Goal Inference for Visuomotor Learning and Planning30 Sep 2018 0 repositories listed
-
Reinforcement Learning in R29 Sep 2018 0 repositories listed
-
Direct optimization of F-measure for retrieval-based personal question answering28 Sep 2018 0 repositories listed
-
Robot Representation and Reasoning with Knowledge from Reinforcement Learning28 Sep 2018 0 repositories listed
-
A Better Baseline for Second Order Gradient Estimation in Stochastic Computation Graphs27 Sep 2018 0 repositories listed
-
A Convergent Variant of the Boltzmann Softmax Operator in Reinforcement Learning27 Sep 2018 0 repositories listed
-
Accelerated Value Iteration via Anderson Mixing27 Sep 2018 0 repositories listed
-
COLLABORATIVE MULTIAGENT REINFORCEMENT LEARNING IN HOMOGENEOUS SWARMS27 Sep 2018 0 repositories listed
-
Constraining Action Sequences with Formal Languages for Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Convergent Reinforcement Learning with Function Approximation: A Bilevel Optimization Perspective27 Sep 2018 0 repositories listed
-
Countering Language Drift via Grounding27 Sep 2018 0 repositories listed
-
DEEP ADVERSARIAL FORWARD MODEL27 Sep 2018 0 repositories listed
-
Deep Reinforcement Learning of Universal Policies with Diverse Environment Summaries27 Sep 2018 0 repositories listed
-
Definition and evaluation of model-free coordination of electrical vehicle charging with reinforcement learning27 Sep 2018 0 repositories listed
-
Distilled Agent DQN for Provable Adversarial Robustness27 Sep 2018 0 repositories listed
-
DOMAIN ADAPTATION VIA DISTRIBUTION AND REPRESENTATION MATCHING: A CASE STUDY ON TRAINING DATA SELECTION VIA REINFORCEMENT LEARNING27 Sep 2018 0 repositories listed
-
Dynamic Pricing on E-commerce Platform with Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Exploiting Environmental Variation to Improve Policy Robustness in Reinforcement Learning27 Sep 2018 0 repositories listed
-
Exploration by Uncertainty in Reward Space27 Sep 2018 0 repositories listed
-
Expressiveness in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Guided Exploration in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Hybrid Policies Using Inverse Rewards for Reinforcement Learning27 Sep 2018 0 repositories listed
-
Incremental Hierarchical Reinforcement Learning with Multitask LMDPs27 Sep 2018 0 repositories listed
-
Interactive Parallel Exploration for Reinforcement Learning in Continuous Action Spaces27 Sep 2018 0 repositories listed
-
Learning Physics Priors for Deep Reinforcement Learing27 Sep 2018 0 repositories listed
-
Learning to Coordinate Multiple Reinforcement Learning Agents for Diverse Query Reformulation27 Sep 2018 0 repositories listed
-
Mimicking actions is a good strategy for beginners: Fast Reinforcement Learning with Expert Action Sequences27 Sep 2018 0 repositories listed
-
Policy Generalization In Capacity-Limited Reinforcement Learning27 Sep 2018 0 repositories listed
-
Shrinkage-based Bias-Variance Trade-off for Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Successor Options : An Option Discovery Algorithm for Reinforcement Learning27 Sep 2018 0 repositories listed
-
The wisdom of the crowd: reliable deep reinforcement learning through ensembles of Q-functions27 Sep 2018 0 repositories listed
-
Towards More Theoretically-Grounded Particle Optimization Sampling for Deep Learning27 Sep 2018 0 repositories listed
-
Transfer Value or Policy? A Value-centric Framework Towards Transferrable Continuous Reinforcement Learning27 Sep 2018 0 repositories listed
-
Unsupervised Exploration with Deep Model-Based Reinforcement Learning27 Sep 2018 0 repositories listed
-
What Would pi* Do?: Imitation Learning via Off-Policy Reinforcement Learning27 Sep 2018 0 repositories listed
-
Where Off-Policy Deep Reinforcement Learning Fails27 Sep 2018 0 repositories listed
-
AlphaSeq: Sequence Discovery with Deep Reinforcement Learning26 Sep 2018 0 repositories listed
-
Learning Navigation Behaviors End-to-End with AutoRL26 Sep 2018 0 repositories listed
-
Learning through Probing: a decentralized reinforcement learning architecture for social dilemmas26 Sep 2018 0 repositories listed
-
Omega-Regular Objectives in Model-Free Reinforcement Learning26 Sep 2018 0 repositories listed
-
Anderson Acceleration for Reinforcement Learning25 Sep 2018 0 repositories listed
-
Floyd-Warshall Reinforcement Learning: Learning from Past Experiences to Reach New Goals25 Sep 2018 0 repositories listed
-
Hierarchical Deep Multiagent Reinforcement Learning with Temporal Abstraction25 Sep 2018 0 repositories listed
-
Low Precision Policy Distillation with Application to Low-Power, Real-time Sensation-Cognition-Action Loop with Neuromorphic Computing25 Sep 2018 0 repositories listed
-
Resilient Computing with Reinforcement Learning on a Dynamical System: Case Study in Sorting25 Sep 2018 0 repositories listed
-
EpiRL: A Reinforcement Learning Agent to Facilitate Epistasis Detection24 Sep 2018 0 repositories listed
-
Personalized Education at Scale24 Sep 2018 0 repositories listed
-
SDN Flow Entry Management Using Reinforcement Learning24 Sep 2018 0 repositories listed
-
A Learning Framework for High Precision Industrial Assembly23 Sep 2018 0 repositories listed
-
On Reinforcement Learning for Full-length Game of StarCraft23 Sep 2018 0 repositories listed
-
Geometric Multi-Model Fitting by Deep Reinforcement Learning22 Sep 2018 0 repositories listed
-
Finite Sample Analysis of the GTD Policy Evaluation Algorithms in Markov Setting21 Sep 2018 0 repositories listed
-
Interpretable Multi-Objective Reinforcement Learning through Policy Orchestration21 Sep 2018 0 repositories listed
-
Target Transfer Q-Learning and Its Convergence Analysis21 Sep 2018 0 repositories listed
-
IntelligentCrowd: Mobile Crowdsensing via Multi-Agent Reinforcement Learning20 Sep 2018 0 repositories listed
-
Sim-to-Real Transfer of Robot Learning with Variable Length Inputs20 Sep 2018 0 repositories listed
-
Interpretable Reinforcement Learning with Ensemble Methods19 Sep 2018 0 repositories listed
-
Prosocial or Selfish? Agents with different behaviors for Contract Negotiation using Reinforcement Learning19 Sep 2018 0 repositories listed
-
Multiobjective Reinforcement Learning for Reconfigurable Adaptive Optimal Control of Manufacturing Processes18 Sep 2018 0 repositories listed
-
SCC-rFMQ Learning in Cooperative Markov Games with Continuous Actions18 Sep 2018 0 repositories listed
-
Switching Isotropic and Directional Exploration with Parameter Space Noise in Deep Reinforcement Learning18 Sep 2018 0 repositories listed
-
Adversarial Imitation via Variational Inverse Reinforcement Learning17 Sep 2018 0 repositories listed
-
Automata Guided Reinforcement Learning With Demonstrations17 Sep 2018 0 repositories listed
-
Curriculum goal masking for continuous deep reinforcement learning17 Sep 2018 0 repositories listed
-
Learning to Collaborate: Multi-Scenario Ranking via Multi-Agent Reinforcement Learning17 Sep 2018 0 repositories listed
-
Object-sensitive Deep Reinforcement Learning17 Sep 2018 0 repositories listed
-
Improvements on Hindsight Learning16 Sep 2018 0 repositories listed
-
Adversarial Reinforcement Learning for Observer Design in Autonomous Systems under Cyber Attacks15 Sep 2018 0 repositories listed
-
Auto-tuning Distributed Stream Processing Systems using Reinforcement Learning14 Sep 2018 0 repositories listed
-
Macquarie University at BioASQ 6b: Deep learning and deep reinforcement learning for query-based multi-document summarisation14 Sep 2018 0 repositories listed
-
Visual Diagnostics for Deep Reinforcement Learning Policy Development14 Sep 2018 0 repositories listed
-
Coordination-driven learning in multi-agent problem spaces13 Sep 2018 0 repositories listed
-
Image Captioning based on Deep Reinforcement Learning13 Sep 2018 0 repositories listed
-
Automatic, Personalized, and Flexible Playlist Generation using Reinforcement Learning12 Sep 2018 0 repositories listed
-
Reinforcement Learning in Topology-based Representation for Human Body Movement with Whole Arm Manipulation12 Sep 2018 0 repositories listed
-
A Multi-Agent Reinforcement Learning Method for Impression Allocation in Online Display Advertising10 Sep 2018 0 repositories listed
-
Adaptive Behavior Generation for Autonomous Driving using Deep Reinforcement Learning with Compact Semantic States10 Sep 2018 0 repositories listed
-
Learning to Generate Structured Queries from Natural Language with Indirect Supervision10 Sep 2018 0 repositories listed
-
Towards one-shot learning for rare-word translation with external experts10 Sep 2018 0 repositories listed
-
VPE: Variational Policy Embedding for Transfer Reinforcement Learning10 Sep 2018 0 repositories listed
-
Probabilistic Prediction of Interactive Driving Behavior via Hierarchical Inverse Reinforcement Learning9 Sep 2018 0 repositories listed
-
ANS: Adaptive Network Scaling for Deep Rectifier Reinforcement Learning Models6 Sep 2018 0 repositories listed
-
How to Combine Tree-Search Methods in Reinforcement Learning6 Sep 2018 0 repositories listed
-
Learn What Not to Learn: Action Elimination with Deep Reinforcement Learning6 Sep 2018 0 repositories listed
-
Model-Based Regularization for Deep Reinforcement Learning with Transcoder Networks6 Sep 2018 0 repositories listed
-
Recurrent World Models Facilitate Policy Evolution4 Sep 2018 0 repositories listed
-
Transferring Deep Reinforcement Learning with Adversarial Objective and Augmentation4 Sep 2018 0 repositories listed
-
Flatland: a Lightweight First-Person 2-D Environment for Reinforcement Learning3 Sep 2018 0 repositories listed
-
Effective Exploration for Deep Reinforcement Learning via Bootstrapped Q-Ensembles under Tsallis Entropy Regularization2 Sep 2018 0 repositories listed
-
Natural Language Person Search Using Deep Reinforcement Learning2 Sep 2018 0 repositories listed
-
A Contextual-bandit-based Approach for Informed Decision-making in Clinical Trials1 Sep 2018 0 repositories listed