Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 136
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 136 of 152: papers 13,501 to 13,600 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Short Survey On Memory Based Reinforcement Learning14 Apr 2019 0 repositories listed
-
Dot-to-Dot: Explainable Hierarchical Reinforcement Learning for Robotic Manipulation14 Apr 2019 0 repositories listed
-
Effective Scheduling Function Design in SDN through Deep Reinforcement Learning12 Apr 2019 0 repositories listed
-
Similarities between policy gradient methods (PGM) in Reinforcement learning (RL) and supervised learning (SL)12 Apr 2019 0 repositories listed
-
Knowledge Flow: Improve Upon Your Teachers11 Apr 2019 0 repositories listed
-
Model-Free Reinforcement Learning for Financial Portfolios: A Brief Survey10 Apr 2019 0 repositories listed
-
Safer Deep RL with Shallow MCTS: A Case Study in Pommerman10 Apr 2019 0 repositories listed
-
RL-Based User Association and Resource Allocation for Multi-UAV enabled MEC8 Apr 2019 0 repositories listed
-
Creating Pro-Level AI for a Real-Time Fighting Game Using Deep Reinforcement Learning8 Apr 2019 0 repositories listed
-
"Jam Me If You Can'': Defeating Jammer with Deep Dueling Neural Network Architecture and Ambient Backscattering Augmented Communications8 Apr 2019 0 repositories listed
-
Teaching GANs to Sketch in Vector Format7 Apr 2019 0 repositories listed
-
Reinforced Imitation in Heterogeneous Action Space6 Apr 2019 0 repositories listed
-
Reinforcement Learning with Attention that Works: A Self-Supervised Approach6 Apr 2019 0 repositories listed
-
Multi-Preference Actor Critic5 Apr 2019 0 repositories listed
-
Self-Adapting Goals Allow Transfer of Predictive Models to New Tasks4 Apr 2019 0 repositories listed
-
PaintBot: A Reinforcement Learning Approach for Natural Media Painting3 Apr 2019 0 repositories listed
-
Centerline Depth World Reinforcement Learning-based Left Atrial Appendage Orifice Localization2 Apr 2019 0 repositories listed
-
Finding and Visualizing Weaknesses of Deep Reinforcement Learning Agents2 Apr 2019 0 repositories listed
-
Personalized Cancer Chemotherapy Schedule: a numerical comparison of performance and robustness in model-based and model-free scheduling methodologies2 Apr 2019 0 repositories listed
-
Distributed Power Control for Large Energy Harvesting Networks: A Multi-Agent Deep Reinforcement Learning Approach1 Apr 2019 0 repositories listed
-
Guided Meta-Policy Search1 Apr 2019 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning Framework for Scalping Trading31 Mar 2019 0 repositories listed
-
Power Control for Wireless VBR Video Streaming: From Optimization to Reinforcement Learning31 Mar 2019 0 repositories listed
-
Risk Averse Robust Adversarial Reinforcement Learning31 Mar 2019 0 repositories listed
-
Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints30 Mar 2019 0 repositories listed
-
Autonomous Highway Driving using Deep Reinforcement Learning29 Mar 2019 0 repositories listed
-
Improved Reinforcement Learning with Curriculum29 Mar 2019 0 repositories listed
-
Learning Good Representation via Continuous Attention29 Mar 2019 0 repositories listed
-
Robust Data Detection for MIMO Systems with One-Bit ADCs: A Reinforcement Learning Approach29 Mar 2019 0 repositories listed
-
Towards Brain-inspired System: Deep Recurrent Reinforcement Learning for Simulated Self-driving Agent29 Mar 2019 0 repositories listed
-
Meta-Learning surrogate models for sequential decision making28 Mar 2019 0 repositories listed
-
Regularizing Trajectory Optimization with Denoising Autoencoders28 Mar 2019 0 repositories listed
-
Wasserstein Dependency Measure for Representation Learning28 Mar 2019 0 repositories listed
-
Understanding the Relation Between Maximum-Entropy Inverse Reinforcement Learning and Behaviour Cloning27 Mar 2019 0 repositories listed
-
Energy Storage Management via Deep Q-Networks26 Mar 2019 0 repositories listed
-
Failure-Scenario Maker for Rule-Based Agent using Multi-agent Adversarial Reinforcement Learning and its Application to Autonomous Driving26 Mar 2019 0 repositories listed
-
Reinforcement Learning Based Text Style Transfer without Parallel Training Corpus26 Mar 2019 0 repositories listed
-
Interactions between Representation Learning and Supervision25 Mar 2019 0 repositories listed
-
On the use of Deep Autoencoders for Efficient Embedded Reinforcement Learning25 Mar 2019 0 repositories listed
-
Q-Learning for Continuous Actions with Cross-Entropy Guided Policies25 Mar 2019 0 repositories listed
-
Sub-Task Discovery with Limited Supervision: A Constrained Clustering Approach24 Mar 2019 0 repositories listed
-
Neural Program Planner for Structured Predictions23 Mar 2019 0 repositories listed
-
Temporal Logic Guided Safe Reinforcement Learning Using Control Barrier Functions23 Mar 2019 0 repositories listed
-
Deep Hierarchical Reinforcement Learning Based Recommendations via Multi-goals Abstraction22 Mar 2019 0 repositories listed
-
DQN with model-based exploration: efficient learning on environments with sparse rewards22 Mar 2019 0 repositories listed
-
Explaining Reinforcement Learning to Mere Mortals: An Empirical Study22 Mar 2019 0 repositories listed
-
Improving Safety in Reinforcement Learning Using Model-Based Architectures and Human Intervention22 Mar 2019 0 repositories listed
-
Macro Action Reinforcement Learning with Sequence Disentanglement using Variational Autoencoder22 Mar 2019 0 repositories listed
-
Symbolic Regression Methods for Reinforcement Learning22 Mar 2019 0 repositories listed
-
Distributed off-Policy Actor-Critic Reinforcement Learning with Policy Consensus21 Mar 2019 0 repositories listed
-
Augmented Memory Networks for Streaming-Based Active One-Shot Learning20 Mar 2019 0 repositories listed
-
Single-step Options for Adversary Driving20 Mar 2019 0 repositories listed
-
Diversity-Promoting Deep Reinforcement Learning for Interactive Recommendation19 Mar 2019 0 repositories listed
-
Hindsight Generative Adversarial Imitation Learning19 Mar 2019 0 repositories listed
-
A Comparison of Prediction Algorithms and Nexting for Short Term Weather Forecasts18 Mar 2019 0 repositories listed
-
Deep Reinforcement Learning with Decorrelation18 Mar 2019 0 repositories listed
-
Exploiting Hierarchy for Learning and Transfer in KL-regularized RL18 Mar 2019 0 repositories listed
-
Adaptive Genomic Evolution of Neural Network Topologies (AGENT) for State-to-Action Mapping in Autonomous Agents17 Mar 2019 0 repositories listed
-
Learning proposals for sequential importance samplers using reinforced variational inference16 Mar 2019 0 repositories listed
-
Multi-agent query reformulation: Challenges and the role of diversity16 Mar 2019 0 repositories listed
-
Robust Reinforcement Learning for Autonomous Driving16 Mar 2019 0 repositories listed
-
Online Antenna Tuning in Heterogeneous Cellular Networks with Deep Reinforcement Learning15 Mar 2019 0 repositories listed
-
Policy Distillation and Value Matching in Multiagent Reinforcement Learning15 Mar 2019 0 repositories listed
-
Can User-Centered Reinforcement Learning Allow a Robot to Attract Passersby without Causing Discomfort?14 Mar 2019 0 repositories listed
-
No-regret Exploration in Contextual Reinforcement Learning14 Mar 2019 0 repositories listed
-
On Applications of Bootstrap in Continuous Space Reinforcement Learning14 Mar 2019 0 repositories listed
-
Effective reinforcement learning based local search for the maximum k-plex problem13 Mar 2019 0 repositories listed
-
Resource Abstraction for Reinforcement Learning in Multiagent Congestion Problems13 Mar 2019 0 repositories listed
-
Task-oriented Design through Deep Reinforcement Learning13 Mar 2019 0 repositories listed
-
Trajectory Optimization for Unknown Constrained Systems using Reinforcement Learning13 Mar 2019 0 repositories listed
-
A Review of Reinforcement Learning for Autonomous Building Energy Management12 Mar 2019 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning with Discrete-Continuous Hybrid Action Spaces12 Mar 2019 0 repositories listed
-
Accelerating Minibatch Stochastic Gradient Descent using Typicality Sampling11 Mar 2019 0 repositories listed
-
Deep learning for molecular design - a review of the state of the art11 Mar 2019 0 repositories listed
-
DeepPool: Distributed Model-free Algorithm for Ride-sharing using Deep Reinforcement Learning9 Mar 2019 0 repositories listed
-
Orthogonal Estimation of Wasserstein Distances9 Mar 2019 0 repositories listed
-
Scene Memory Transformer for Embodied Agents in Long-Horizon Tasks9 Mar 2019 0 repositories listed
-
Successive Over Relaxation Q-Learning9 Mar 2019 0 repositories listed
-
A cooperative game for automated learning of elasto-plasticity knowledge graphs and models with AI-guided experimentation8 Mar 2019 0 repositories listed
-
Improved Robustness and Safety for Autonomous Vehicle Control with Adversarial Reinforcement Learning8 Mar 2019 0 repositories listed
-
Improving Skin Condition Classification with a Visual Symptom Checker Trained using Reinforcement Learning8 Mar 2019 0 repositories listed
-
Learning Self-Game-Play Agents for Combinatorial Optimization Problems8 Mar 2019 0 repositories listed
-
Pixel-Attentive Policy Gradient for Multi-Fingered Grasping in Cluttered Scenes8 Mar 2019 0 repositories listed
-
RLOC: Neurobiologically Inspired Hierarchical Reinforcement Learning Algorithm for Continuous Control of Nonlinear Dynamical Systems7 Mar 2019 0 repositories listed
-
Provably Robust Blackbox Optimization for Reinforcement Learning7 Mar 2019 0 repositories listed
-
Minigo: A Case Study in Reproducing Reinforcement Learning Research6 Mar 2019 0 repositories listed
-
Safety-Guided Deep Reinforcement Learning via Online Gaussian Process Estimation6 Mar 2019 0 repositories listed
-
Synthesizing Chemical Plant Operation Procedures using Knowledge, Dynamic Simulation and Deep Reinforcement Learning6 Mar 2019 0 repositories listed
-
Training in Task Space to Speed Up and Guide Reinforcement Learning6 Mar 2019 0 repositories listed
-
Continual Learning Using World Models for Pseudo-Rehearsal6 Mar 2019 0 repositories listed
-
Learning Dynamics Model in Reinforcement Learning by Incorporating the Long Term Future5 Mar 2019 0 repositories listed
-
Online Data Poisoning Attack5 Mar 2019 0 repositories listed
-
Towards Understanding Chinese Checkers with Heuristics, Monte Carlo Tree Search, and Deep Reinforcement Learning5 Mar 2019 0 repositories listed
-
Microscopic Traffic Simulation by Cooperative Multi-agent Deep Reinforcement Learning4 Mar 2019 0 repositories listed
-
Hacking Google reCAPTCHA v3 using Reinforcement Learning3 Mar 2019 0 repositories listed
-
A Regularized Approach to Sparse Optimal Policy in Reinforcement Learning2 Mar 2019 0 repositories listed
-
Automating Predictive Modeling Process using Reinforcement Learning2 Mar 2019 0 repositories listed
-
Discovering Options for Exploration by Minimizing Cover Time2 Mar 2019 0 repositories listed
-
OmniDRL: Robust Pedestrian Detection using Deep Reinforcement Learning on Omnidirectional Cameras2 Mar 2019 0 repositories listed
-
Straight to the point: reinforcement learning for user guidance in ultrasound2 Mar 2019 0 repositories listed