Browse State-of-the-Art › reinforcement-learning › Papers, page 122
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 122 of 135: papers 12,101 to 12,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Deep learning for molecular design - a review of the state of the art11 Mar 2019 0 repositories listed
-
DeepPool: Distributed Model-free Algorithm for Ride-sharing using Deep Reinforcement Learning9 Mar 2019 0 repositories listed
-
Orthogonal Estimation of Wasserstein Distances9 Mar 2019 0 repositories listed
-
Scene Memory Transformer for Embodied Agents in Long-Horizon Tasks9 Mar 2019 0 repositories listed
-
A cooperative game for automated learning of elasto-plasticity knowledge graphs and models with AI-guided experimentation8 Mar 2019 0 repositories listed
-
Improved Robustness and Safety for Autonomous Vehicle Control with Adversarial Reinforcement Learning8 Mar 2019 0 repositories listed
-
Improving Skin Condition Classification with a Visual Symptom Checker Trained using Reinforcement Learning8 Mar 2019 0 repositories listed
-
Pixel-Attentive Policy Gradient for Multi-Fingered Grasping in Cluttered Scenes8 Mar 2019 0 repositories listed
-
RLOC: Neurobiologically Inspired Hierarchical Reinforcement Learning Algorithm for Continuous Control of Nonlinear Dynamical Systems7 Mar 2019 0 repositories listed
-
Provably Robust Blackbox Optimization for Reinforcement Learning7 Mar 2019 0 repositories listed
-
Minigo: A Case Study in Reproducing Reinforcement Learning Research6 Mar 2019 0 repositories listed
-
Safety-Guided Deep Reinforcement Learning via Online Gaussian Process Estimation6 Mar 2019 0 repositories listed
-
Synthesizing Chemical Plant Operation Procedures using Knowledge, Dynamic Simulation and Deep Reinforcement Learning6 Mar 2019 0 repositories listed
-
Training in Task Space to Speed Up and Guide Reinforcement Learning6 Mar 2019 0 repositories listed
-
Continual Learning Using World Models for Pseudo-Rehearsal6 Mar 2019 0 repositories listed
-
Learning Dynamics Model in Reinforcement Learning by Incorporating the Long Term Future5 Mar 2019 0 repositories listed
-
Online Data Poisoning Attack5 Mar 2019 0 repositories listed
-
Microscopic Traffic Simulation by Cooperative Multi-agent Deep Reinforcement Learning4 Mar 2019 0 repositories listed
-
Hacking Google reCAPTCHA v3 using Reinforcement Learning3 Mar 2019 0 repositories listed
-
A Regularized Approach to Sparse Optimal Policy in Reinforcement Learning2 Mar 2019 0 repositories listed
-
Automating Predictive Modeling Process using Reinforcement Learning2 Mar 2019 0 repositories listed
-
Discovering Options for Exploration by Minimizing Cover Time2 Mar 2019 0 repositories listed
-
OmniDRL: Robust Pedestrian Detection using Deep Reinforcement Learning on Omnidirectional Cameras2 Mar 2019 0 repositories listed
-
Straight to the point: reinforcement learning for user guidance in ultrasound2 Mar 2019 0 repositories listed
-
Reinforcement Learning based Curriculum Optimization for Neural Machine Translation28 Feb 2019 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Caching in Hierarchical Content Delivery Networks27 Feb 2019 0 repositories listed
-
Distributed Edge Caching via Reinforcement Learning in Fog Radio Access Networks27 Feb 2019 0 repositories listed
-
Introspection Learning27 Feb 2019 0 repositories listed
-
Can Meta-Interpretive Learning outperform Deep Reinforcement Learning of Evaluable Game strategies?26 Feb 2019 0 repositories listed
-
Planning in Hierarchical Reinforcement Learning: Guarantees for Using Local Policies26 Feb 2019 0 repositories listed
-
Learning When Not to Answer: A Ternary Reward Structure for Reinforcement Learning based Question Answering26 Feb 2019 0 repositories listed
-
Adversarial Reinforcement Learning under Partial Observability in Autonomous Computer Network Defence25 Feb 2019 0 repositories listed
-
Learning Extreme Hummingbird Maneuvers on Flapping Wing Robots25 Feb 2019 0 repositories listed
-
Long-Range Indoor Navigation with PRM-RL25 Feb 2019 0 repositories listed
-
S-TRIGGER: Continual State Representation Learning via Self-Triggered Generative Replay25 Feb 2019 0 repositories listed
-
Aggregating E-commerce Search Results from Heterogeneous Sources via Hierarchical Reinforcement Learning24 Feb 2019 0 repositories listed
-
Distributionally Robust Reinforcement Learning23 Feb 2019 0 repositories listed
-
Generative Memory for Lifelong Reinforcement Learning22 Feb 2019 0 repositories listed
-
Learning Deterministic Policy with Target for Power Control in Wireless Networks21 Feb 2019 0 repositories listed
-
Statistics and Samples in Distributional Reinforcement Learning21 Feb 2019 0 repositories listed
-
Curiosity-Driven Experience Prioritization via Density Estimation20 Feb 2019 0 repositories listed
-
From Language to Goals: Inverse Reinforcement Learning for Vision-Based Instruction Following20 Feb 2019 0 repositories listed
-
A novel repetition normalized adversarial reward for headline generation19 Feb 2019 0 repositories listed
-
Investigating Generalisation in Continuous Deep Reinforcement Learning19 Feb 2019 0 repositories listed
-
Message-Dropout: An Efficient Training Method for Multi-Agent Deep Reinforcement Learning18 Feb 2019 0 repositories listed
-
Parenting: Safe Reinforcement Learning from Human Input18 Feb 2019 0 repositories listed
-
A new Potential-Based Reward Shaping for Reinforcement Learning Agent17 Feb 2019 0 repositories listed
-
Leveraging Communication Topologies Between Learning Agents in Deep Reinforcement Learning16 Feb 2019 0 repositories listed
-
Asynchronous Coagent Networks15 Feb 2019 0 repositories listed
-
Deep Reinforcement Learning Based High-level Driving Behavior Decision-making Model in Heterogeneous Traffic15 Feb 2019 0 repositories listed
-
Robust Reinforcement Learning in POMDPs with Incomplete and Noisy Observations15 Feb 2019 0 repositories listed
-
Active Perception in Adversarial Scenarios using Maximum Entropy Deep Reinforcement Learning14 Feb 2019 0 repositories listed
-
Reinforcement Learning for UA V Attitude Control13 Feb 2019 0 repositories listed
-
Reinforcement Learning to Optimize Long-term User Engagement in Recommender Systems13 Feb 2019 0 repositories listed
-
ACTRCE: Augmenting Experience via Teacher's Advice For Multi-Goal Reinforcement Learning12 Feb 2019 0 repositories listed
-
Deep Reinforcement Learning from Policy-Dependent Human Feedback12 Feb 2019 0 repositories listed
-
Latent Space Reinforcement Learning for Steering Angle Prediction11 Feb 2019 0 repositories listed
-
Performance Dynamics and Termination Errors in Reinforcement Learning: A Unifying Perspective11 Feb 2019 0 repositories listed
-
Stochastic Reinforcement Learning11 Feb 2019 0 repositories listed
-
WiseMove: A Framework for Safe Deep Reinforcement Learning for Autonomous Driving11 Feb 2019 0 repositories listed
-
A Bandit Framework for Optimal Selection of Reinforcement Learning Agents10 Feb 2019 0 repositories listed
-
Distributional reinforcement learning with linear function approximation8 Feb 2019 0 repositories listed
-
Rethinking the Discount Factor in Reinforcement Learning: A Decision Theoretic Approach8 Feb 2019 0 repositories listed
-
Metaoptimization on a Distributed System for Deep Reinforcement Learning7 Feb 2019 0 repositories listed
-
A Guiding Principle for Causal Decision Problems6 Feb 2019 0 repositories listed
-
Decentralized Multi-Agents by Imitation of a Centralized Controller6 Feb 2019 0 repositories listed
-
Neural Fictitious Self-Play on ELF Mini-RTS6 Feb 2019 0 repositories listed
-
Space Navigator: a Tool for the Optimization of Collision Avoidance Maneuvers6 Feb 2019 0 repositories listed
-
On L₂-consistency of nearest neighbor matching6 Feb 2019 0 repositories listed
-
Adaptive Stress Testing for Autonomous Vehicles5 Feb 2019 0 repositories listed
-
Polyphonic Music Composition with LSTM Neural Networks and Reinforcement Learning5 Feb 2019 0 repositories listed
-
Reinforcement Learning for Optimal Load Distribution Sequencing in Resource-Sharing System5 Feb 2019 0 repositories listed
-
Total stochastic gradient algorithms and applications in reinforcement learning5 Feb 2019 0 repositories listed
-
Value-aware Recommendation based on Reinforced Profit Maximization in E-commerce Systems3 Feb 2019 0 repositories listed
-
Learning User Preferences via Reinforcement Learning with Spatial Interface Valuing2 Feb 2019 0 repositories listed
-
Non-asymptotic Analysis of Biased Stochastic Approximation Scheme2 Feb 2019 0 repositories listed
-
When Collaborative Filtering Meets Reinforcement Learning2 Feb 2019 0 repositories listed
-
Competitive Experience Replay1 Feb 2019 0 repositories listed
-
1 Feb 2019 0 repositories listed
-
Learning Action Representations for Reinforcement Learning1 Feb 2019 0 repositories listed
-
Privacy Preserving Off-Policy Evaluation1 Feb 2019 0 repositories listed
-
Visual Rationalizations in Deep Reinforcement Learning for Atari Games1 Feb 2019 0 repositories listed
-
A Geometric Perspective on Optimal Representations for Reinforcement Learning31 Jan 2019 0 repositories listed
-
An Optimization Framework for Task Sequencing in Curriculum Learning31 Jan 2019 0 repositories listed
-
Successor Features Combine Elements of Model-Free and Model-based Reinforcement Learning31 Jan 2019 0 repositories listed
-
The Value Function Polytope in Reinforcement Learning31 Jan 2019 0 repositories listed
-
Tsallis Reinforcement Learning: A Unified Framework for Maximum Entropy Reinforcement Learning31 Jan 2019 0 repositories listed
-
A Comparative Analysis of Expected and Distributional Reinforcement Learning30 Jan 2019 0 repositories listed
-
Probability Functional Descent: A Unifying Perspective on GANs, Variational Inference, and Reinforcement Learning30 Jan 2019 0 repositories listed
-
Transfer in Deep Reinforcement Learning Using Successor Features and Generalised Policy Improvement30 Jan 2019 0 repositories listed
-
A Regulation Enforcement Solution for Multi-agent Reinforcement Learning29 Jan 2019 0 repositories listed
-
Multi-Agent Reinforcement Learning with Multi-Step Generative Models29 Jan 2019 0 repositories listed
-
CLIC: Curriculum Learning and Imitation for object Control in non-rewarding environments28 Jan 2019 0 repositories listed
-
Designing a Multi-Objective Reward Function for Creating Teams of Robotic Bodyguards Using Deep Reinforcement Learning28 Jan 2019 0 repositories listed
-
Off-Policy Deep Reinforcement Learning by Bootstrapping the Covariate Shift27 Jan 2019 0 repositories listed
-
Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning27 Jan 2019 0 repositories listed
-
Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning26 Jan 2019 0 repositories listed
-
Model-based Deep Reinforcement Learning for Dynamic Portfolio Optimization25 Jan 2019 0 repositories listed
-
Federated Deep Reinforcement Learning24 Jan 2019 0 repositories listed
-
Feudal Multi-Agent Hierarchies for Cooperative Reinforcement Learning24 Jan 2019 0 repositories listed