Browse State-of-the-Art › Reinforcement Learning › Papers, page 115
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 115 of 132: papers 11,401 to 11,500 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Montezuma's Revenge from a Single Demonstration8 Dec 2018 0 repositories listed
-
A Survey on Artificial Intelligence Trends in Spacecraft Guidance Dynamics and Control7 Dec 2018 0 repositories listed
-
Communication-Efficient Policy Gradient Methods for Distributed Reinforcement Learning7 Dec 2018 0 repositories listed
-
Measuring and Characterizing Generalization in Deep Reinforcement Learning7 Dec 2018 0 repositories listed
-
Residual Reinforcement Learning for Robot Control7 Dec 2018 0 repositories listed
-
Zero-shot Deep Reinforcement Learning Driving Policy Transfer for Autonomous Vehicles based on Robust Control7 Dec 2018 0 repositories listed
-
Active Deep Q-learning with Demonstration6 Dec 2018 0 repositories listed
-
Deep Reinforcement Learning and the Deadly Triad6 Dec 2018 0 repositories listed
-
Finite-Sample Analysis For Decentralized Batch Multi-Agent Reinforcement Learning With Networked Agents6 Dec 2018 0 repositories listed
-
Composing Entropic Policies using Divergence Correction5 Dec 2018 0 repositories listed
-
Learning to Design Circuits5 Dec 2018 0 repositories listed
-
The effects of negative adaptation in Model-Agnostic Meta-Learning5 Dec 2018 0 repositories listed
-
Exploration versus exploitation in reinforcement learning: a stochastic control approach4 Dec 2018 0 repositories listed
-
Hyperbolic Embeddings for Learning Options in Hierarchical Reinforcement Learning4 Dec 2018 0 repositories listed
-
Learning Vine Copula Models For Synthetic Data Generation4 Dec 2018 0 repositories listed
-
Natural Option Critic4 Dec 2018 0 repositories listed
-
Rigorous Agent Evaluation: An Adversarial Approach to Uncover Catastrophic Failures4 Dec 2018 0 repositories listed
-
Bach2Bach: Generating Music Using A Deep Reinforcement Learning Approach3 Dec 2018 0 repositories listed
-
Deep Reinforcement Learning for Intelligent Transportation Systems3 Dec 2018 0 repositories listed
-
Distilling Information from a Flood: A Possibility for the Use of Meta-Analysis and Systematic Review in Machine Learning Research3 Dec 2018 0 repositories listed
-
FoldingZero: Protein Folding from Scratch in Hydrophobic-Polar Model3 Dec 2018 0 repositories listed
-
Generating Diverse Programs with Instruction Conditioned Reinforced Adversarial Learning3 Dec 2018 0 repositories listed
-
Generative Adversarial Self-Imitation Learning3 Dec 2018 0 repositories listed
-
Mitigating Planner Overfitting in Model-Based Reinforcement Learning3 Dec 2018 0 repositories listed
-
Multi-agent Deep Reinforcement Learning with Extremely Noisy Observations3 Dec 2018 0 repositories listed
-
Resource Constrained Deep Reinforcement Learning3 Dec 2018 0 repositories listed
-
Active Matting1 Dec 2018 0 repositories listed
-
Bayesian Control of Large MDPs with Unknown Dynamics in Data-Poor Environments1 Dec 2018 0 repositories listed
-
Constrained Cross-Entropy Method for Safe Reinforcement Learning1 Dec 2018 0 repositories listed
-
DeepExposure: Learning to Expose Photos with Asynchronously Reinforced Adversarial Learning1 Dec 2018 0 repositories listed
-
Distributed Multitask Reinforcement Learning with Quadratic Convergence1 Dec 2018 0 repositories listed
-
Dynamic Measurement Scheduling for Adverse Event Forecasting using Deep RL1 Dec 2018 0 repositories listed
-
Fighting Boredom in Recommender Systems with Linear Reinforcement Learning1 Dec 2018 0 repositories listed
-
Genetic-Gated Networks for Deep Reinforcement Learning1 Dec 2018 0 repositories listed
-
Geometrically Coupled Monte Carlo Sampling1 Dec 2018 0 repositories listed
-
Iterative Value-Aware Model Learning1 Dec 2018 0 repositories listed
-
Multiple-Step Greedy Policies in Approximate and Online Reinforcement Learning1 Dec 2018 0 repositories listed
-
Negotiable Reinforcement Learning for Pareto Optimal Sequential Decision-Making1 Dec 2018 0 repositories listed
-
Post: Device Placement with Cross-Entropy Minimization and Proximal Policy Optimization1 Dec 2018 0 repositories listed
-
REFUEL: Exploring Sparse Features in Deep Reinforcement Learning for Fast Disease Diagnosis1 Dec 2018 0 repositories listed
-
Reinforcement Learning with Multiple Experts: A Bayesian Model Combination Approach1 Dec 2018 0 repositories listed
-
Synthesize Policies for Transfer and Adaptation across Tasks and Environments1 Dec 2018 0 repositories listed
-
The Importance of Sampling inMeta-Reinforcement Learning1 Dec 2018 0 repositories listed
-
Transfer of Value Functions via Variational Methods1 Dec 2018 0 repositories listed
-
Why so gloomy? A Bayesian explanation of human pessimism bias in the multi-armed bandit task1 Dec 2018 0 repositories listed
-
Zero-Shot Transfer with Deictic Object-Oriented Representation in Reinforcement Learning1 Dec 2018 0 repositories listed
-
BlockPuzzle - A Challenge in Physical Reasoning and Generalization for Robot Learning30 Nov 2018 0 repositories listed
-
How to Organize your Deep Reinforcement Learning Agents: The Importance of Communication Topology30 Nov 2018 0 repositories listed
-
Modulated Policy Hierarchies30 Nov 2018 0 repositories listed
-
Using Monte Carlo Tree Search as a Demonstrator within Asynchronous Deep RL30 Nov 2018 0 repositories listed
-
Flow Shape Design for Microfluidic Devices Using Deep Reinforcement Learning29 Nov 2018 0 repositories listed
-
A Structure-aware Online Learning Algorithm for Markov Decision Processes28 Nov 2018 0 repositories listed
-
Deep Reinforcement Learning for Time Optimal Velocity Control using Prior Knowledge28 Nov 2018 0 repositories listed
-
Experience Replay for Continual Learning28 Nov 2018 0 repositories listed
-
Trajectory-based Learning for Ball-in-Maze Games28 Nov 2018 0 repositories listed
-
Unsupervised Control Through Non-Parametric Discriminative Rewards28 Nov 2018 0 repositories listed
-
Automatic Face Aging in Videos via Deep Reinforcement Learning27 Nov 2018 0 repositories listed
-
Distributed traffic light control at uncoupled intersections with real-world topology by deep reinforcement learning27 Nov 2018 0 repositories listed
-
Learning State Representations in Complex Systems with Multimodal Data27 Nov 2018 0 repositories listed
-
Exploring Restart Distributions27 Nov 2018 0 repositories listed
-
Quality-Aware Multimodal Saliency Detection via Deep Reinforcement Learning27 Nov 2018 0 repositories listed
-
Scaling Configuration of Energy Harvesting Sensors with Reinforcement Learning27 Nov 2018 0 repositories listed
-
What is Interpretable? Using Machine Learning to Design Interpretable Decision-Support Systems27 Nov 2018 0 repositories listed
-
PNS: Population-Guided Novelty Search for Reinforcement Learning in Hard Exploration Environments26 Nov 2018 0 repositories listed
-
Genetic-Gated Networks for Deep Reinforcement26 Nov 2018 0 repositories listed
-
Optimization of Information-Seeking Dialogue Strategy for Argumentation-Based Dialogue System26 Nov 2018 0 repositories listed
-
A Model-Based Reinforcement Learning Approach for a Rare Disease Diagnostic Task25 Nov 2018 0 repositories listed
-
25 Nov 2018 0 repositories listed
-
Connecting the Dots Between MLE and RL for Sequence Prediction24 Nov 2018 0 repositories listed
-
Evolutionary-Neural Hybrid Agents for Architecture Search24 Nov 2018 0 repositories listed
-
Learning to Activate Relay Nodes: Deep Reinforcement Learning Approach24 Nov 2018 0 repositories listed
-
Learning to attend in a brain-inspired deep neural network23 Nov 2018 0 repositories listed
-
Model-Based Reinforcement Learning for Sepsis Treatment23 Nov 2018 0 repositories listed
-
An Off-policy Policy Gradient Theorem Using Emphatic Weightings22 Nov 2018 0 repositories listed
-
High-Level Strategy Selection under Partial Observability in StarCraft: Brood War21 Nov 2018 0 repositories listed
-
Integrating Reinforcement Learning to Self Training for Pulmonary Nodule Segmentation in Chest X-rays21 Nov 2018 0 repositories listed
-
Integrating Task-Motion Planning with Reinforcement Learning for Robust Decision Making in Mobile Robots21 Nov 2018 0 repositories listed
-
Model-based RL in Contextual Decision Processes: PAC bounds and Exponential Improvements over Model-free Approaches21 Nov 2018 0 repositories listed
-
21 Nov 2018 0 repositories listed
-
Representation Learning of Pedestrian Trajectories Using Actor-Critic Sequence-to-Sequence Autoencoder20 Nov 2018 0 repositories listed
-
Chat More If You Like: Dynamic Cue Words Planning to Flow Longer Conversations19 Nov 2018 0 repositories listed
-
Energy Efficiency in Reinforcement Learning for Wireless Sensor Networks19 Nov 2018 0 repositories listed
-
Measurement-based adaptation protocol with quantum reinforcement learning in a Rigetti quantum computer19 Nov 2018 0 repositories listed
-
Reinforcement Learning and Inverse Reinforcement Learning with System 1 and System 219 Nov 2018 0 repositories listed
-
Simulated Autonomous Driving in a Realistic Driving Environment using Deep Reinforcement Learning and a Deterministic Finite State Machine19 Nov 2018 0 repositories listed
-
Learning to infer: RL-based search for DNN primitive selection on Heterogeneous Embedded Systems18 Nov 2018 0 repositories listed
-
Policy Optimization with Model-based Explorations18 Nov 2018 0 repositories listed
-
Self-Organizing Maps for Storage and Transfer of Knowledge in Reinforcement Learning18 Nov 2018 0 repositories listed
-
Autonomous Extraction of a Hierarchical Structure of Tasks in Reinforcement Learning, A Sequential Associate Rule Mining Approach17 Nov 2018 0 repositories listed
-
Emergence of linguistic conventions in multi-agent reinforcement learning17 Nov 2018 0 repositories listed
-
Parameter Sharing Reinforcement Learning Architecture for Multi Agent Driving Behaviors17 Nov 2018 0 repositories listed
-
Recursive Sparse Pseudo-input Gaussian Process SARSA17 Nov 2018 0 repositories listed
-
The Impatient May Use Limited Optimism to Minimize Regret17 Nov 2018 0 repositories listed
-
An Algorithmic Perspective on Imitation Learning16 Nov 2018 0 repositories listed
-
Cost-Aware Fine-Grained Recognition for IoTs Based on Sequential Fixations16 Nov 2018 0 repositories listed
-
Asynchronous Stochastic Composition Optimization with Variance Reduction15 Nov 2018 0 repositories listed
-
Concept Learning through Deep Reinforcement Learning with Memory-Augmented Neural Networks15 Nov 2018 0 repositories listed
-
Context-Dependent Upper-Confidence Bounds for Directed Exploration15 Nov 2018 0 repositories listed
-
Intervention Aided Reinforcement Learning for Safe and Practical Policy Optimization in Navigation15 Nov 2018 0 repositories listed
-
Orthogonal Policy Gradient and Autonomous Driving Application15 Nov 2018 0 repositories listed