Browse State-of-the-Art › Reinforcement Learning › Papers, page 117
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 117 of 132: papers 11,601 to 11,700 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Adaptive Multi-pass Decoder for Neural Machine Translation1 Oct 2018 0 repositories listed
-
Automatic Essay Scoring Incorporating Rating Schema via Reinforcement Learning1 Oct 2018 0 repositories listed
-
Automatic Poetry Generation with Mutual Reinforcement Learning1 Oct 2018 0 repositories listed
-
Autonomous Sub-domain Modeling for Dialogue Policy with Hierarchical Deep Reinforcement Learning1 Oct 2018 0 repositories listed
-
Curriculum Learning Based on Reward Sparseness for Deep Reinforcement Learning of Task Completion Dialogue Management1 Oct 2018 0 repositories listed
-
Interactive Agent Modeling by Learning to Probe1 Oct 2018 0 repositories listed
-
Joint On-line Learning of a Zero-shot Spoken Semantic Parser and a Reinforcement Learning Dialogue Manager1 Oct 2018 0 repositories listed
-
Logician and Orator: Learning from the Duality between Language and Knowledge in Open Domain1 Oct 2018 0 repositories listed
-
Prediction Improves Simultaneous Neural Machine Translation1 Oct 2018 0 repositories listed
-
SmartChoices: Hybridizing Programming and Machine Learning1 Oct 2018 0 repositories listed
-
Thread Popularity Prediction and Tracking with a Permutation-invariant Model1 Oct 2018 0 repositories listed
-
Visual Curiosity: Learning to Ask Questions to Learn Visual Recognition1 Oct 2018 0 repositories listed
-
Bayesian Transfer Reinforcement Learning with Prior Knowledge Rules30 Sep 2018 0 repositories listed
-
Few-Shot Goal Inference for Visuomotor Learning and Planning30 Sep 2018 0 repositories listed
-
Reinforcement Learning in R29 Sep 2018 0 repositories listed
-
Learning and Planning with a Semantic Model28 Sep 2018 0 repositories listed
-
Robot Representation and Reasoning with Knowledge from Reinforcement Learning28 Sep 2018 0 repositories listed
-
A Better Baseline for Second Order Gradient Estimation in Stochastic Computation Graphs27 Sep 2018 0 repositories listed
-
A Convergent Variant of the Boltzmann Softmax Operator in Reinforcement Learning27 Sep 2018 0 repositories listed
-
COLLABORATIVE MULTIAGENT REINFORCEMENT LEARNING IN HOMOGENEOUS SWARMS27 Sep 2018 0 repositories listed
-
Constraining Action Sequences with Formal Languages for Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Convergent Reinforcement Learning with Function Approximation: A Bilevel Optimization Perspective27 Sep 2018 0 repositories listed
-
Deep Reinforcement Learning of Universal Policies with Diverse Environment Summaries27 Sep 2018 0 repositories listed
-
Definition and evaluation of model-free coordination of electrical vehicle charging with reinforcement learning27 Sep 2018 0 repositories listed
-
Dynamic Pricing on E-commerce Platform with Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Exploiting Environmental Variation to Improve Policy Robustness in Reinforcement Learning27 Sep 2018 0 repositories listed
-
Expressiveness in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Guided Exploration in Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Hybrid Policies Using Inverse Rewards for Reinforcement Learning27 Sep 2018 0 repositories listed
-
Incremental Hierarchical Reinforcement Learning with Multitask LMDPs27 Sep 2018 0 repositories listed
-
Interactive Parallel Exploration for Reinforcement Learning in Continuous Action Spaces27 Sep 2018 0 repositories listed
-
Learning to Coordinate Multiple Reinforcement Learning Agents for Diverse Query Reformulation27 Sep 2018 0 repositories listed
-
Mimicking actions is a good strategy for beginners: Fast Reinforcement Learning with Expert Action Sequences27 Sep 2018 0 repositories listed
-
Policy Generalization In Capacity-Limited Reinforcement Learning27 Sep 2018 0 repositories listed
-
Shrinkage-based Bias-Variance Trade-off for Deep Reinforcement Learning27 Sep 2018 0 repositories listed
-
Successor Options : An Option Discovery Algorithm for Reinforcement Learning27 Sep 2018 0 repositories listed
-
The wisdom of the crowd: reliable deep reinforcement learning through ensembles of Q-functions27 Sep 2018 0 repositories listed
-
Unsupervised Exploration with Deep Model-Based Reinforcement Learning27 Sep 2018 0 repositories listed
-
Where Off-Policy Deep Reinforcement Learning Fails27 Sep 2018 0 repositories listed
-
Adding Neural Network Controllers to Behavior Trees without Destroying Performance Guarantees26 Sep 2018 0 repositories listed
-
AlphaSeq: Sequence Discovery with Deep Reinforcement Learning26 Sep 2018 0 repositories listed
-
Learning Navigation Behaviors End-to-End with AutoRL26 Sep 2018 0 repositories listed
-
Learning through Probing: a decentralized reinforcement learning architecture for social dilemmas26 Sep 2018 0 repositories listed
-
Omega-Regular Objectives in Model-Free Reinforcement Learning26 Sep 2018 0 repositories listed
-
Anderson Acceleration for Reinforcement Learning25 Sep 2018 0 repositories listed
-
Floyd-Warshall Reinforcement Learning: Learning from Past Experiences to Reach New Goals25 Sep 2018 0 repositories listed
-
Hierarchical Deep Multiagent Reinforcement Learning with Temporal Abstraction25 Sep 2018 0 repositories listed
-
Low Precision Policy Distillation with Application to Low-Power, Real-time Sensation-Cognition-Action Loop with Neuromorphic Computing25 Sep 2018 0 repositories listed
-
Resilient Computing with Reinforcement Learning on a Dynamical System: Case Study in Sorting25 Sep 2018 0 repositories listed
-
EpiRL: A Reinforcement Learning Agent to Facilitate Epistasis Detection24 Sep 2018 0 repositories listed
-
Personalized Education at Scale24 Sep 2018 0 repositories listed
-
SDN Flow Entry Management Using Reinforcement Learning24 Sep 2018 0 repositories listed
-
A Learning Framework for High Precision Industrial Assembly23 Sep 2018 0 repositories listed
-
Neural Arithmetic Expression Calculator23 Sep 2018 0 repositories listed
-
On Reinforcement Learning for Full-length Game of StarCraft23 Sep 2018 0 repositories listed
-
Geometric Multi-Model Fitting by Deep Reinforcement Learning22 Sep 2018 0 repositories listed
-
Finite Sample Analysis of the GTD Policy Evaluation Algorithms in Markov Setting21 Sep 2018 0 repositories listed
-
Interpretable Multi-Objective Reinforcement Learning through Policy Orchestration21 Sep 2018 0 repositories listed
-
Target Transfer Q-Learning and Its Convergence Analysis21 Sep 2018 0 repositories listed
-
IntelligentCrowd: Mobile Crowdsensing via Multi-Agent Reinforcement Learning20 Sep 2018 0 repositories listed
-
Predicting Periodicity with Temporal Difference Learning20 Sep 2018 0 repositories listed
-
Sim-to-Real Transfer of Robot Learning with Variable Length Inputs20 Sep 2018 0 repositories listed
-
In-Edge AI: Intelligentizing Mobile Edge Computing, Caching and Communication by Federated Learning19 Sep 2018 0 repositories listed
-
Interpretable Reinforcement Learning with Ensemble Methods19 Sep 2018 0 repositories listed
-
Prosocial or Selfish? Agents with different behaviors for Contract Negotiation using Reinforcement Learning19 Sep 2018 0 repositories listed
-
Multiobjective Reinforcement Learning for Reconfigurable Adaptive Optimal Control of Manufacturing Processes18 Sep 2018 0 repositories listed
-
SCC-rFMQ Learning in Cooperative Markov Games with Continuous Actions18 Sep 2018 0 repositories listed
-
Switching Isotropic and Directional Exploration with Parameter Space Noise in Deep Reinforcement Learning18 Sep 2018 0 repositories listed
-
Adversarial Imitation via Variational Inverse Reinforcement Learning17 Sep 2018 0 repositories listed
-
Automata Guided Reinforcement Learning With Demonstrations17 Sep 2018 0 repositories listed
-
Curriculum goal masking for continuous deep reinforcement learning17 Sep 2018 0 repositories listed
-
Learning to Collaborate: Multi-Scenario Ranking via Multi-Agent Reinforcement Learning17 Sep 2018 0 repositories listed
-
Object-sensitive Deep Reinforcement Learning17 Sep 2018 0 repositories listed
-
Optimal Matrix Momentum Stochastic Approximation and Applications to Q-learning17 Sep 2018 0 repositories listed
-
Improvements on Hindsight Learning16 Sep 2018 0 repositories listed
-
Inspiration Learning through Preferences16 Sep 2018 0 repositories listed
-
Adversarial Reinforcement Learning for Observer Design in Autonomous Systems under Cyber Attacks15 Sep 2018 0 repositories listed
-
Auto-tuning Distributed Stream Processing Systems using Reinforcement Learning14 Sep 2018 0 repositories listed
-
Macquarie University at BioASQ 6b: Deep learning and deep reinforcement learning for query-based multi-document summarisation14 Sep 2018 0 repositories listed
-
Visual Diagnostics for Deep Reinforcement Learning Policy Development14 Sep 2018 0 repositories listed
-
Coordination-driven learning in multi-agent problem spaces13 Sep 2018 0 repositories listed
-
Image Captioning based on Deep Reinforcement Learning13 Sep 2018 0 repositories listed
-
Sequential Coordination of Deep Models for Learning Visual Arithmetic13 Sep 2018 0 repositories listed
-
Sim-to-Real Transfer Learning using Robustified Controllers in Robotic Tasks involving Complex Dynamics13 Sep 2018 0 repositories listed
-
Automatic, Personalized, and Flexible Playlist Generation using Reinforcement Learning12 Sep 2018 0 repositories listed
-
Reinforcement Learning in Topology-based Representation for Human Body Movement with Whole Arm Manipulation12 Sep 2018 0 repositories listed
-
Safe Exploration in Markov Decision Processes with Time-Variant Safety using Spatio-Temporal Gaussian Process12 Sep 2018 0 repositories listed
-
A Deep Reinforced Sequence-to-Set Model for Multi-Label Text Classification10 Sep 2018 0 repositories listed
-
A Multi-Agent Reinforcement Learning Method for Impression Allocation in Online Display Advertising10 Sep 2018 0 repositories listed
-
Adaptive Behavior Generation for Autonomous Driving using Deep Reinforcement Learning with Compact Semantic States10 Sep 2018 0 repositories listed
-
Learning Adaptive Display Exposure for Real-Time Advertising10 Sep 2018 0 repositories listed
-
Learning to Generate Structured Queries from Natural Language with Indirect Supervision10 Sep 2018 0 repositories listed
-
Towards a Fatality-Aware Benchmark of Probabilistic Reaction Prediction in Highly Interactive Driving Scenarios10 Sep 2018 0 repositories listed
-
Towards one-shot learning for rare-word translation with external experts10 Sep 2018 0 repositories listed
-
VPE: Variational Policy Embedding for Transfer Reinforcement Learning10 Sep 2018 0 repositories listed
-
Probabilistic Prediction of Interactive Driving Behavior via Hierarchical Inverse Reinforcement Learning9 Sep 2018 0 repositories listed
-
Variance Reduction in Monte Carlo Counterfactual Regret Minimization (VR-MCCFR) for Extensive Form Games using Baselines9 Sep 2018 0 repositories listed
-
Optimal and Low-Complexity Dynamic Spectrum Access for RF-Powered Ambient Backscatter System with Online Reinforcement Learning8 Sep 2018 0 repositories listed
-
Improving On-policy Learning with Statistical Reward Accumulation7 Sep 2018 0 repositories listed
-
ANS: Adaptive Network Scaling for Deep Rectifier Reinforcement Learning Models6 Sep 2018 0 repositories listed