Browse State-of-the-Art › Reinforcement Learning › Papers, page 120
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 120 of 132: papers 11,901 to 12,000 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Improved Sample Complexity for Stochastic Compositional Variance Reduced Gradient1 Jun 2018 0 repositories listed
-
Inference Aided Reinforcement Learning for Incentive Mechanism Design in Crowdsourcing1 Jun 2018 0 repositories listed
-
Integrating Episodic Memory into a Reinforcement Learning Agent using Reservoir Sampling1 Jun 2018 0 repositories listed
-
Learning Sentence Representations over Tree Structures for Target-Dependent Classification1 Jun 2018 0 repositories listed
-
Mining Evidences for Concept Stock Recommendation1 Jun 2018 0 repositories listed
-
Neural Control Variates for Variance Reduction1 Jun 2018 0 repositories listed
-
Quality Signals in Generated Stories1 Jun 2018 0 repositories listed
-
Reinforcement Cutting-Agent Learning for Video Object Segmentation1 Jun 2018 0 repositories listed
-
Scalable Construction and Reasoning of Massive Knowledge Bases1 Jun 2018 0 repositories listed
-
SeedNet: Automatic Seed Generation With Deep Reinforcement Learning for Robust Interactive Segmentation1 Jun 2018 0 repositories listed
-
Sim2Real Viewpoint Invariant Visual Servoing by Recurrent Control1 Jun 2018 0 repositories listed
-
SINT++: Robust Visual Tracking via Adversarial Positive Instance Generation1 Jun 2018 0 repositories listed
-
TAPAS: Train-less Accuracy Predictor for Architecture Search1 Jun 2018 0 repositories listed
-
Evaluating Reinforcement Learning Algorithms in Observational Health Settings31 May 2018 0 repositories listed
-
Learning a Prior over Intent via Meta-Inverse Reinforcement Learning31 May 2018 0 repositories listed
-
Sequential Attacks on Agents for Long-Term Adversarial Goals31 May 2018 0 repositories listed
-
Adversarial Learning of Task-Oriented Neural Dialog Models30 May 2018 0 repositories listed
-
Depth and nonlinearity induce implicit exploration for RL29 May 2018 0 repositories listed
-
Learning to Transcribe by Ear29 May 2018 0 repositories listed
-
Observe and Look Further: Achieving Consistent Performance on Atari29 May 2018 0 repositories listed
-
The Actor Search Tree Critic (ASTC) for Off-Policy POMDP Learning in Medical Decision Making29 May 2018 0 repositories listed
-
Truncated Horizon Policy Search: Combining Reinforcement Learning & Imitation Learning29 May 2018 0 repositories listed
-
Variational Inverse Control with Events: A General Framework for Data-Driven Reward Definition29 May 2018 0 repositories listed
-
Virtuously Safe Reinforcement Learning29 May 2018 0 repositories listed
-
Hierarchical clustering with deep Q-learning28 May 2018 0 repositories listed
-
Importance Weighted Transfer of Samples in Reinforcement Learning28 May 2018 0 repositories listed
-
Value Propagation Networks28 May 2018 0 repositories listed
-
Fingerprint Policy Optimisation for Robust Reinforcement Learning27 May 2018 0 repositories listed
-
Deep Reinforcement Learning in Ice Hockey for Context-Aware Player Evaluation26 May 2018 0 repositories listed
-
Fast Policy Learning through Imitation and Reinforcement26 May 2018 0 repositories listed
-
A Sliding-Window Algorithm for Markov Decision Processes with Arbitrarily Changing Rewards and Transitions25 May 2018 0 repositories listed
-
Detecting Deceptive Reviews using Generative Adversarial Networks25 May 2018 0 repositories listed
-
Finite Sample Analysis of LSTD with Random Projections and Eligibility Traces25 May 2018 0 repositories listed
-
Learning Self-Imitating Diverse Policies25 May 2018 0 repositories listed
-
Reinforced Extractive Summarization with Question-Focused Rewards25 May 2018 0 repositories listed
-
Resource Allocation for a Wireless Coexistence Management System Based on Reinforcement Learning24 May 2018 0 repositories listed
-
Discovering Blind Spots in Reinforcement Learning23 May 2018 0 repositories listed
-
Dyna Planning using a Feature Based Generative Model23 May 2018 0 repositories listed
-
Reinforcement Learning for Heterogeneous Teams with PALO Bounds23 May 2018 0 repositories listed
-
When Simple Exploration is Sample Efficient: Identifying Sufficient Conditions for Random Exploration to Yield PAC RL Algorithms23 May 2018 0 repositories listed
-
Learning to Optimize via Wasserstein Deep Inverse Optimal Control22 May 2018 0 repositories listed
-
Scalable Centralized Deep Multi-Agent Reinforcement Learning via Policy Gradients22 May 2018 0 repositories listed
-
A Framework and Method for Online Inverse Reinforcement Learning21 May 2018 0 repositories listed
-
A General Family of Robust Stochastic Operators for Reinforcement Learning21 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Hindsight21 May 2018 0 repositories listed
-
21 May 2018 0 repositories listed
-
Hybrid Retrieval-Generation Reinforced Agent for Medical Image Report Generation21 May 2018 0 repositories listed
-
Learning Safe Policies with Expert Guidance21 May 2018 0 repositories listed
-
Multiple-Step Greedy Policies in Online and Approximate Reinforcement Learning21 May 2018 0 repositories listed
-
Learning Real-World Robot Policies by Dreaming20 May 2018 0 repositories listed
-
Learning to Teach in Cooperative Multiagent Reinforcement Learning20 May 2018 0 repositories listed
-
Nonlinear Distributional Gradient Temporal-Difference Learning20 May 2018 0 repositories listed
-
Task-Agnostic Meta-Learning for Few-shot Learning20 May 2018 0 repositories listed
-
Episodic Memory Deep Q-Networks19 May 2018 0 repositories listed
-
Reinforcement Learning of Theorem Proving19 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Deep Nested Agents18 May 2018 0 repositories listed
-
Two geometric input transformation methods for fast online reinforcement learning with neural nets18 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Resource Management in Network Slicing17 May 2018 0 repositories listed
-
Evolutionary RL for Container Loading17 May 2018 0 repositories listed
-
Language Expansion In Text-Based Games17 May 2018 0 repositories listed
-
Neural User Simulation for Corpus-based Policy Optimisation for Spoken Dialogue Systems17 May 2018 0 repositories listed
-
Fast Retinomorphic Event Stream for Video Recognition and Reinforcement Learning16 May 2018 0 repositories listed
-
Joint Training of Candidate Extraction and Answer Selection for Reading Comprehension16 May 2018 0 repositories listed
-
Optimized Computation Offloading Performance in Virtual Edge Computing Systems via Deep Reinforcement Learning16 May 2018 0 repositories listed
-
Feedback-Based Tree Search for Reinforcement Learning15 May 2018 0 repositories listed
-
Graph Signal Sampling via Reinforcement Learning15 May 2018 0 repositories listed
-
Leveraging human knowledge in tabular reinforcement learning: A study of human subjects15 May 2018 0 repositories listed
-
The Hierarchical Adaptive Forgetting Variational Filter15 May 2018 0 repositories listed
-
Low-pass Recurrent Neural Networks - A memory architecture for longer-term correlation discovery13 May 2018 0 repositories listed
-
Generating Rescheduling Knowledge using Reinforcement Learning in a Cognitive Architecture12 May 2018 0 repositories listed
-
Task Transfer by Preference-Based Cost Learning12 May 2018 0 repositories listed
-
Towards Autonomous Reinforcement Learning: Automatic Setting of Hyper-parameters using Bayesian Optimization12 May 2018 0 repositories listed
-
Deep Hierarchical Reinforcement Learning Algorithm in Partially Observable Markov Decision Processes11 May 2018 0 repositories listed
-
Interactive Reinforcement Learning with Dynamic Reuse of Prior Knowledge from Human/Agent's Demonstration11 May 2018 0 repositories listed
-
Leveraging Grammar and Reinforcement Learning for Neural Program Synthesis11 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Optimal Control of Space Heating10 May 2018 0 repositories listed
-
Discourse-Aware Neural Rewards for Coherent Text Generation10 May 2018 0 repositories listed
-
Metatrace Actor-Critic: Online Step-size Tuning by Meta-gradient Descent for Reinforcement Learning Control10 May 2018 0 repositories listed
-
Learning to Teach9 May 2018 0 repositories listed
-
Image Retrieval with Mixed Initiative and Multimodal Feedback8 May 2018 0 repositories listed
-
Multimodal Hierarchical Reinforcement Learning Policy for Task-Oriented Visual Dialog8 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Page-wise Recommendations7 May 2018 0 repositories listed
-
Multimodal Machine Translation with Reinforcement Learning7 May 2018 0 repositories listed
-
Planning and Learning with Stochastic Action Sets7 May 2018 0 repositories listed
-
Developing parsimonious ensembles using ensemble diversity within a reinforcement learning framework5 May 2018 0 repositories listed
-
Dynamic Control Flow in Large-Scale Machine Learning4 May 2018 0 repositories listed
-
Exploration by Distributional Reinforcement Learning4 May 2018 0 repositories listed
-
Approximate Temporal Difference Learning is a Gradient Descent for Reversible Policies2 May 2018 0 repositories listed
-
Robust Deep Reinforcement Learning for Security and Safety in Autonomous Vehicle Systems2 May 2018 0 repositories listed
-
Falsification of Cyber-Physical Systems Using Deep Reinforcement Learning1 May 2018 0 repositories listed
-
Robust Log-Optimal Strategy with Reinforcement Learning1 May 2018 0 repositories listed
-
How Robust are Deep Neural Networks?30 Apr 2018 0 repositories listed
-
Generating Interpretable Fuzzy Controllers using Particle Swarm Optimization and Genetic Programming29 Apr 2018 0 repositories listed
-
Towards Experienced Anomaly Detector through Reinforcement Learning29 Apr 2018 0 repositories listed
-
Sentiment Adaptive End-to-End Dialog Systems28 Apr 2018 0 repositories listed
-
Deep Reinforcement Learning to Acquire Navigation Skills for Wheel-Legged Robots in Complex Environments27 Apr 2018 0 repositories listed
-
Scalable Bilinear π Learning Using State and Action Features27 Apr 2018 0 repositories listed
-
Sim-to-Real: Learning Agile Locomotion For Quadruped Robots27 Apr 2018 0 repositories listed
-
Action Categorization for Computationally Improved Task Learning and Planning26 Apr 2018 0 repositories listed
-
Generative Temporal Models with Spatial Memory for Partially Observed Environments25 Apr 2018 0 repositories listed