Browse State-of-the-Art › Reinforcement Learning › Papers, page 107
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 107 of 132: papers 10,601 to 10,700 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Maximum Causal Entropy Specification Inference from Demonstrations26 Jul 2019 0 repositories listed
-
On Hard Exploration for Reinforcement Learning: a Case Study in Pommerman26 Jul 2019 0 repositories listed
-
Action Guidance with MCTS for Deep Reinforcement Learning25 Jul 2019 0 repositories listed
-
Dynamic Input for Deep Reinforcement Learning in Autonomous Driving25 Jul 2019 0 repositories listed
-
Finite-Time Performance of Distributed Temporal Difference Learning with Linear Function Approximation25 Jul 2019 0 repositories listed
-
Interactive Lungs Auscultation with Reinforcement Learning Agent25 Jul 2019 0 repositories listed
-
AlphaStock: A Buying-Winners-and-Selling-Losers Investment Strategy using Interpretable Deep Reinforcement Attention Networks24 Jul 2019 0 repositories listed
-
Memory Based Trajectory-conditioned Policies for Learning from Sparse Rewards24 Jul 2019 0 repositories listed
-
Fairness in Reinforcement Learning24 Jul 2019 0 repositories listed
-
Learning Goal-Oriented Visual Dialog Agents: Imitating and Surpassing Analytic Experts24 Jul 2019 0 repositories listed
-
Terminal Prediction as an Auxiliary Task for Deep Reinforcement Learning24 Jul 2019 0 repositories listed
-
Agent Modeling as Auxiliary Task for Deep Reinforcement Learning22 Jul 2019 0 repositories listed
-
Automatic Calibration of Artificial Neural Networks for Zebrafish Collective Behaviours using a Quality Diversity Algorithm22 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Autonomous Internet of Things: Model, Applications and Challenges22 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Clinical Decision Support: A Brief Survey22 Jul 2019 0 repositories listed
-
Efficient Policy Learning for Non-Stationary MDPs under Adversarial Manipulation22 Jul 2019 0 repositories listed
-
Surrogate Models for Enhancing the Efficiency of Neuroevolution in Reinforcement Learning22 Jul 2019 0 repositories listed
-
Rapid trial-and-error learning with simulation supports flexible tool use and physical reasoning22 Jul 2019 0 repositories listed
-
VRLS: A Unified Reinforcement Learning Scheduler for Vehicle-to-Vehicle Communications22 Jul 2019 0 repositories listed
-
A Learning-Based Two-Stage Spectrum Sharing Strategy with Multiple Primary Transmit Power Levels21 Jul 2019 0 repositories listed
-
Techniques for Automated Machine Learning21 Jul 2019 0 repositories listed
-
Potential-Based Advice for Stochastic Policy Learning20 Jul 2019 0 repositories listed
-
An Actor-Critic-Attention Mechanism for Deep Reinforcement Learning in Multi-view Environments19 Jul 2019 0 repositories listed
-
Delegative Reinforcement Learning: learning to avoid traps with a little help19 Jul 2019 0 repositories listed
-
Combinatorial Keyword Recommendations for Sponsored Search with Deep Reinforcement Learning18 Jul 2019 0 repositories listed
-
Dynamical Distance Learning for Semi-Supervised and Unsupervised Skill Discovery18 Jul 2019 0 repositories listed
-
Learning High-Level Planning Symbols from Intrinsically Motivated Experience18 Jul 2019 0 repositories listed
-
Prioritized Guidance for Efficient Multi-Agent Reinforcement Learning Exploration18 Jul 2019 0 repositories listed
-
Transfer Learning Across Simulated Robots With Different Sensors18 Jul 2019 0 repositories listed
-
CADS: Core-Aware Dynamic Scheduler for Multicore Memory Controllers17 Jul 2019 0 repositories listed
-
Learning Variable Impedance Control for Contact Sensitive Tasks17 Jul 2019 0 repositories listed
-
Photonic architecture for reinforcement learning17 Jul 2019 0 repositories listed
-
Zermelo's problem: Optimal point-to-point navigation in 2D turbulent flows using Reinforcement Learning17 Jul 2019 0 repositories listed
-
An Inductive Synthesis Framework for Verifiable Reinforcement Learning16 Jul 2019 0 repositories listed
-
Efficient Autonomy Validation in Simulation with Adaptive Stress Testing16 Jul 2019 0 repositories listed
-
Improved Reinforcement Learning through Imitation Learning Pretraining Towards Image-based Autonomous Driving16 Jul 2019 0 repositories listed
-
Model-free Control of Chaos with Continuous Deep Q-learning16 Jul 2019 0 repositories listed
-
A Dual Memory Structure for Efficient Use of Replay Memory in Deep Reinforcement Learning15 Jul 2019 0 repositories listed
-
Federated Reinforcement Distillation with Proxy Experience Memory15 Jul 2019 0 repositories listed
-
Mutual Reinforcement Learning15 Jul 2019 0 repositories listed
-
Ranking sentences from product description & bullets for better search15 Jul 2019 0 repositories listed
-
On the Global Convergence of Actor-Critic: A Case for Linear Quadratic Regulator with Ergodic Cost14 Jul 2019 0 repositories listed
-
Environment Reconstruction with Hidden Confounders for Reinforcement Learning based Recommendation12 Jul 2019 0 repositories listed
-
A Model-based Approach for Sample-efficient Multi-task Reinforcement Learning11 Jul 2019 0 repositories listed
-
A Systematic Mapping Study on Testing of Machine Learning Programs11 Jul 2019 0 repositories listed
-
DisCoRL: Continual Reinforcement Learning via Policy Distillation11 Jul 2019 0 repositories listed
-
Imitation-Projected Programmatic Reinforcement Learning11 Jul 2019 0 repositories listed
-
Deep Reinforcement-Learning-based Driving Policy for Autonomous Road Vehicles10 Jul 2019 0 repositories listed
-
An Intrinsically-Motivated Approach for Learning Highly Exploring and Fast Mixing Policies10 Jul 2019 0 repositories listed
-
Assessing Transferability from Simulation to Reality for Reinforcement Learning10 Jul 2019 0 repositories listed
-
DOB-Net: Actively Rejecting Unknown Excessive Time-Varying Disturbances10 Jul 2019 0 repositories listed
-
Interpretable Dynamics Models for Data-Efficient Reinforcement Learning10 Jul 2019 0 repositories listed
-
Neural Input Search for Large Scale Recommendation Models10 Jul 2019 0 repositories listed
-
Reinforcement Learning with Chromatic Networks for Compact Architecture Search10 Jul 2019 0 repositories listed
-
RL-RRT: Kinodynamic Motion Planning via Learning Reachability Estimators from RL Policies10 Jul 2019 0 repositories listed
-
Capturing Financial markets to apply Deep Reinforcement Learning9 Jul 2019 0 repositories listed
-
Dreaming machine learning: Lipschitz extensions for reinforcement learning on financial markets9 Jul 2019 0 repositories listed
-
Estimating Mass Distribution of Articulated Objects using Non-prehensile Manipulation9 Jul 2019 0 repositories listed
-
Variance-Based Risk Estimations in Markov Processes via Transformation with State Lumping9 Jul 2019 0 repositories listed
-
Data Efficient Reinforcement Learning for Legged Robots8 Jul 2019 0 repositories listed
-
On-Policy Robot Imitation Learning from a Converging Supervisor8 Jul 2019 0 repositories listed
-
Policy-Gradient Algorithms Have No Guarantees of Convergence in Linear Quadratic Games8 Jul 2019 0 repositories listed
-
ShrinkML: End-to-End ASR Model Compression Using Reinforcement Learning8 Jul 2019 0 repositories listed
-
Variational Inference MPC for Bayesian Model-based Reinforcement Learning8 Jul 2019 0 repositories listed
-
Deep Learning based Wireless Resource Allocation with Application to Vehicular Networks7 Jul 2019 0 repositories listed
-
A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning6 Jul 2019 0 repositories listed
-
AutoCompress: An Automatic DNN Structured Pruning Framework for Ultra-High Compression Rates6 Jul 2019 0 repositories listed
-
Entropic Regularization of Markov Decision Processes6 Jul 2019 0 repositories listed
-
Intrinsic Motivation Driven Intuitive Physics Learning using Deep Reinforcement Learning with Intrinsic Reward Normalization6 Jul 2019 0 repositories listed
-
Playing Flappy Bird via Asynchronous Advantage Actor Critic Algorithm6 Jul 2019 0 repositories listed
-
Learning in Volatile Environments with the Bayes Factor Surprise5 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning For Modeling Chit-Chat Dialog With Discrete Attributes5 Jul 2019 0 repositories listed
-
Dependency-aware Attention Control for Unconstrained Face Recognition with Image Sets5 Jul 2019 0 repositories listed
-
Incrementally Learning Functions of the Return5 Jul 2019 0 repositories listed
-
Learning a Behavioral Repertoire from Demonstrations5 Jul 2019 0 repositories listed
-
On Inductive Biases in Deep Reinforcement Learning5 Jul 2019 0 repositories listed
-
Self-supervised Learning of Distance Functions for Goal-Conditioned Reinforcement Learning5 Jul 2019 0 repositories listed
-
On the Convergence of Model Free Learning in Mean Field Games4 Jul 2019 0 repositories listed
-
Integration of Imitation Learning using GAIL and Reinforcement Learning using Task-achievement Rewards via Probabilistic Graphical Model3 Jul 2019 0 repositories listed
-
On the Weaknesses of Reinforcement Learning for Neural Machine Translation3 Jul 2019 0 repositories listed
-
Perspective Taking in Deep Reinforcement Learning Agents3 Jul 2019 0 repositories listed
-
Safe Approximate Dynamic Programming Via Kernelized Lipschitz Estimation3 Jul 2019 0 repositories listed
-
A Reinforcement Learning Approach for the Multichannel Rendezvous Problem2 Jul 2019 0 repositories listed
-
Dynamic Face Video Segmentation via Reinforcement Learning2 Jul 2019 0 repositories listed
-
Generalizing from a few environments in safety-critical reinforcement learning2 Jul 2019 0 repositories listed
-
Modified Actor-Critics2 Jul 2019 0 repositories listed
-
Playing Go without Game Tree Search Using Convolutional Neural Networks2 Jul 2019 0 repositories listed
-
Voting-Based Multi-Agent Reinforcement Learning for Intelligent IoT2 Jul 2019 0 repositories listed
-
Designing Deep Reinforcement Learning for Human Parameter Exploration1 Jul 2019 0 repositories listed
-
1 Jul 2019 0 repositories listed
-
FiDi-RL: Incorporating Deep Reinforcement Learning with Finite-Difference Policy Search for Efficient Learning of Continuous Control1 Jul 2019 0 repositories listed
-
Historical Text Normalization with Delayed Rewards1 Jul 2019 0 repositories listed
-
Inferential Machine Comprehension: Answering Questions by Recursively Deducing the Evidence Chain from Text1 Jul 2019 0 repositories listed
-
Latent Structure Models for Natural Language Processing1 Jul 2019 0 repositories listed
-
Learning World Graphs to Accelerate Hierarchical Reinforcement Learning1 Jul 2019 0 repositories listed
-
Look Harder: A Neural Machine Translation Model with Hard Attention1 Jul 2019 0 repositories listed
-
On mechanisms for transfer using landmark value functions in multi-task lifelong reinforcement learning1 Jul 2019 0 repositories listed
-
Sentence Mover's Similarity: Automatic Evaluation for Multi-Sentence Texts1 Jul 2019 0 repositories listed
-
Towards Comprehensive Description Generation from Factual Attribute-value Tables1 Jul 2019 0 repositories listed
-
Using Semantic Similarity as Reward for Reinforcement Learning in Sentence Generation1 Jul 2019 0 repositories listed