Browse State-of-the-Art › Reinforcement Learning › Papers, page 112
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 112 of 132: papers 11,101 to 11,200 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Centerline Depth World Reinforcement Learning-based Left Atrial Appendage Orifice Localization2 Apr 2019 0 repositories listed
-
Finding and Visualizing Weaknesses of Deep Reinforcement Learning Agents2 Apr 2019 0 repositories listed
-
Personalized Cancer Chemotherapy Schedule: a numerical comparison of performance and robustness in model-based and model-free scheduling methodologies2 Apr 2019 0 repositories listed
-
Planning with Expectation Models2 Apr 2019 0 repositories listed
-
Distributed Power Control for Large Energy Harvesting Networks: A Multi-Agent Deep Reinforcement Learning Approach1 Apr 2019 0 repositories listed
-
Guided Meta-Policy Search1 Apr 2019 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning Framework for Scalping Trading31 Mar 2019 0 repositories listed
-
Power Control for Wireless VBR Video Streaming: From Optimization to Reinforcement Learning31 Mar 2019 0 repositories listed
-
Risk Averse Robust Adversarial Reinforcement Learning31 Mar 2019 0 repositories listed
-
Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints30 Mar 2019 0 repositories listed
-
Autonomous Highway Driving using Deep Reinforcement Learning29 Mar 2019 0 repositories listed
-
Improved Reinforcement Learning with Curriculum29 Mar 2019 0 repositories listed
-
Learning Good Representation via Continuous Attention29 Mar 2019 0 repositories listed
-
Robust Data Detection for MIMO Systems with One-Bit ADCs: A Reinforcement Learning Approach29 Mar 2019 0 repositories listed
-
Towards Brain-inspired System: Deep Recurrent Reinforcement Learning for Simulated Self-driving Agent29 Mar 2019 0 repositories listed
-
Meta-Learning surrogate models for sequential decision making28 Mar 2019 0 repositories listed
-
Regularizing Trajectory Optimization with Denoising Autoencoders28 Mar 2019 0 repositories listed
-
Wasserstein Dependency Measure for Representation Learning28 Mar 2019 0 repositories listed
-
Dynamic Control of Stochastic Evolution: A Deep Reinforcement Learning Approach to Adaptively Targeting Emergent Drug Resistance27 Mar 2019 0 repositories listed
-
Energy Storage Management via Deep Q-Networks26 Mar 2019 0 repositories listed
-
Failure-Scenario Maker for Rule-Based Agent using Multi-agent Adversarial Reinforcement Learning and its Application to Autonomous Driving26 Mar 2019 0 repositories listed
-
Learning Where to See: A Novel Attention Model for Automated Immunohistochemical Scoring26 Mar 2019 0 repositories listed
-
Reinforcement Learning Based Text Style Transfer without Parallel Training Corpus26 Mar 2019 0 repositories listed
-
On the use of Deep Autoencoders for Efficient Embedded Reinforcement Learning25 Mar 2019 0 repositories listed
-
Q-Learning for Continuous Actions with Cross-Entropy Guided Policies25 Mar 2019 0 repositories listed
-
Winning Isn't Everything: Enhancing Game Development with Intelligent Agents25 Mar 2019 0 repositories listed
-
Sub-Task Discovery with Limited Supervision: A Constrained Clustering Approach24 Mar 2019 0 repositories listed
-
Temporal Logic Guided Safe Reinforcement Learning Using Control Barrier Functions23 Mar 2019 0 repositories listed
-
Deep Hierarchical Reinforcement Learning Based Recommendations via Multi-goals Abstraction22 Mar 2019 0 repositories listed
-
DQN with model-based exploration: efficient learning on environments with sparse rewards22 Mar 2019 0 repositories listed
-
Explaining Reinforcement Learning to Mere Mortals: An Empirical Study22 Mar 2019 0 repositories listed
-
Improving Safety in Reinforcement Learning Using Model-Based Architectures and Human Intervention22 Mar 2019 0 repositories listed
-
Macro Action Reinforcement Learning with Sequence Disentanglement using Variational Autoencoder22 Mar 2019 0 repositories listed
-
Symbolic Regression Methods for Reinforcement Learning22 Mar 2019 0 repositories listed
-
Distributed off-Policy Actor-Critic Reinforcement Learning with Policy Consensus21 Mar 2019 0 repositories listed
-
Towards automatic construction of multi-network models for heterogeneous multi-task learning21 Mar 2019 0 repositories listed
-
Towards Characterizing Divergence in Deep Q-Learning21 Mar 2019 0 repositories listed
-
Augmented Memory Networks for Streaming-Based Active One-Shot Learning20 Mar 2019 0 repositories listed
-
Single-step Options for Adversary Driving20 Mar 2019 0 repositories listed
-
Diversity-Promoting Deep Reinforcement Learning for Interactive Recommendation19 Mar 2019 0 repositories listed
-
Hindsight Generative Adversarial Imitation Learning19 Mar 2019 0 repositories listed
-
Learning Reciprocity in Complex Sequential Social Dilemmas19 Mar 2019 0 repositories listed
-
A Comparison of Prediction Algorithms and Nexting for Short Term Weather Forecasts18 Mar 2019 0 repositories listed
-
Deep Reinforcement Learning with Decorrelation18 Mar 2019 0 repositories listed
-
Exploiting Hierarchy for Learning and Transfer in KL-regularized RL18 Mar 2019 0 repositories listed
-
Scheduled Intrinsic Drive: A Hierarchical Take on Intrinsically Motivated Exploration18 Mar 2019 0 repositories listed
-
Adaptive Genomic Evolution of Neural Network Topologies (AGENT) for State-to-Action Mapping in Autonomous Agents17 Mar 2019 0 repositories listed
-
Learning proposals for sequential importance samplers using reinforced variational inference16 Mar 2019 0 repositories listed
-
Multi-agent query reformulation: Challenges and the role of diversity16 Mar 2019 0 repositories listed
-
Robust Reinforcement Learning for Autonomous Driving16 Mar 2019 0 repositories listed
-
Online Antenna Tuning in Heterogeneous Cellular Networks with Deep Reinforcement Learning15 Mar 2019 0 repositories listed
-
Policy Distillation and Value Matching in Multiagent Reinforcement Learning15 Mar 2019 0 repositories listed
-
Can User-Centered Reinforcement Learning Allow a Robot to Attract Passersby without Causing Discomfort?14 Mar 2019 0 repositories listed
-
No-regret Exploration in Contextual Reinforcement Learning14 Mar 2019 0 repositories listed
-
On Applications of Bootstrap in Continuous Space Reinforcement Learning14 Mar 2019 0 repositories listed
-
Effective reinforcement learning based local search for the maximum k-plex problem13 Mar 2019 0 repositories listed
-
Resource Abstraction for Reinforcement Learning in Multiagent Congestion Problems13 Mar 2019 0 repositories listed
-
Task-oriented Design through Deep Reinforcement Learning13 Mar 2019 0 repositories listed
-
Trajectory Optimization for Unknown Constrained Systems using Reinforcement Learning13 Mar 2019 0 repositories listed
-
A Review of Reinforcement Learning for Autonomous Building Energy Management12 Mar 2019 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning with Discrete-Continuous Hybrid Action Spaces12 Mar 2019 0 repositories listed
-
Accelerating Minibatch Stochastic Gradient Descent using Typicality Sampling11 Mar 2019 0 repositories listed
-
Deep learning for molecular design - a review of the state of the art11 Mar 2019 0 repositories listed
-
Deep Reinforcement Learning of Volume-guided Progressive View Inpainting for 3D Point Scene Completion from a Single Depth Image10 Mar 2019 0 repositories listed
-
DeepPool: Distributed Model-free Algorithm for Ride-sharing using Deep Reinforcement Learning9 Mar 2019 0 repositories listed
-
Orthogonal Estimation of Wasserstein Distances9 Mar 2019 0 repositories listed
-
Scene Memory Transformer for Embodied Agents in Long-Horizon Tasks9 Mar 2019 0 repositories listed
-
Successive Over Relaxation Q-Learning9 Mar 2019 0 repositories listed
-
A cooperative game for automated learning of elasto-plasticity knowledge graphs and models with AI-guided experimentation8 Mar 2019 0 repositories listed
-
Improved Robustness and Safety for Autonomous Vehicle Control with Adversarial Reinforcement Learning8 Mar 2019 0 repositories listed
-
Improving Skin Condition Classification with a Visual Symptom Checker Trained using Reinforcement Learning8 Mar 2019 0 repositories listed
-
Learning Self-Game-Play Agents for Combinatorial Optimization Problems8 Mar 2019 0 repositories listed
-
Pixel-Attentive Policy Gradient for Multi-Fingered Grasping in Cluttered Scenes8 Mar 2019 0 repositories listed
-
Can Sophisticated Dispatching Strategy Acquired by Reinforcement Learning? - A Case Study in Dynamic Courier Dispatching System7 Mar 2019 0 repositories listed
-
RLOC: Neurobiologically Inspired Hierarchical Reinforcement Learning Algorithm for Continuous Control of Nonlinear Dynamical Systems7 Mar 2019 0 repositories listed
-
Provably Robust Blackbox Optimization for Reinforcement Learning7 Mar 2019 0 repositories listed
-
Minigo: A Case Study in Reproducing Reinforcement Learning Research6 Mar 2019 0 repositories listed
-
Safety-Guided Deep Reinforcement Learning via Online Gaussian Process Estimation6 Mar 2019 0 repositories listed
-
Synthesizing Chemical Plant Operation Procedures using Knowledge, Dynamic Simulation and Deep Reinforcement Learning6 Mar 2019 0 repositories listed
-
Training in Task Space to Speed Up and Guide Reinforcement Learning6 Mar 2019 0 repositories listed
-
Understanding the Artificial Intelligence Clinician and optimal treatment strategies for sepsis in intensive care6 Mar 2019 0 repositories listed
-
Continual Learning Using World Models for Pseudo-Rehearsal6 Mar 2019 0 repositories listed
-
Learning Dynamics Model in Reinforcement Learning by Incorporating the Long Term Future5 Mar 2019 0 repositories listed
-
Online Data Poisoning Attack5 Mar 2019 0 repositories listed
-
Towards Understanding Chinese Checkers with Heuristics, Monte Carlo Tree Search, and Deep Reinforcement Learning5 Mar 2019 0 repositories listed
-
Microscopic Traffic Simulation by Cooperative Multi-agent Deep Reinforcement Learning4 Mar 2019 0 repositories listed
-
A Strongly Asymptotically Optimal Agent in General Environments4 Mar 2019 0 repositories listed
-
Hacking Google reCAPTCHA v3 using Reinforcement Learning3 Mar 2019 0 repositories listed
-
A Regularized Approach to Sparse Optimal Policy in Reinforcement Learning2 Mar 2019 0 repositories listed
-
Automating Predictive Modeling Process using Reinforcement Learning2 Mar 2019 0 repositories listed
-
Discovering Options for Exploration by Minimizing Cover Time2 Mar 2019 0 repositories listed
-
OmniDRL: Robust Pedestrian Detection using Deep Reinforcement Learning on Omnidirectional Cameras2 Mar 2019 0 repositories listed
-
Straight to the point: reinforcement learning for user guidance in ultrasound2 Mar 2019 0 repositories listed
-
Reinforcement Learning based Curriculum Optimization for Neural Machine Translation28 Feb 2019 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Caching in Hierarchical Content Delivery Networks27 Feb 2019 0 repositories listed
-
Atomistic structure learning27 Feb 2019 0 repositories listed
-
Distributed Edge Caching via Reinforcement Learning in Fog Radio Access Networks27 Feb 2019 0 repositories listed
-
Domain-Constrained Advertising Keyword Generation27 Feb 2019 0 repositories listed
-
Introspection Learning27 Feb 2019 0 repositories listed
-
Neural Packet Classification27 Feb 2019 0 repositories listed