Browse State-of-the-Art › Reinforcement Learning › Papers, page 94
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 94 of 132: papers 9,301 to 9,400 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Transferable Concepts in Deep Reinforcement Learning16 May 2020 0 repositories listed
-
Probabilistic Guarantees for Safe Deep Reinforcement Learning14 May 2020 0 repositories listed
-
Solve Traveling Salesman Problem by Monte Carlo Tree Search and Deep Neural Network14 May 2020 0 repositories listed
-
Stealthy and Efficient Adversarial Attacks against Deep Reinforcement Learning14 May 2020 0 repositories listed
-
Explainable Reinforcement Learning: A Survey13 May 2020 0 repositories listed
-
Proxy Experience Replay: Federated Distillation for Distributed Reinforcement Learning13 May 2020 0 repositories listed
-
A New Deep Neural Architecture Search Pipeline for Face Recognition12 May 2020 0 repositories listed
-
Unbiased Deep Reinforcement Learning: A General Training Framework for Existing and Future Algorithms12 May 2020 0 repositories listed
-
A Deep Reinforcement Learning Approach to Efficient Drone Mobility Support11 May 2020 0 repositories listed
-
Deep Reinforcement Learning for Organ Localization in CT11 May 2020 0 repositories listed
-
Reinforcement Learning Based on Real-Time Iteration NMPC11 May 2020 0 repositories listed
-
TOMA: Topological Map Abstraction for Reinforcement Learning11 May 2020 0 repositories listed
-
Accelerating Deep Neuroevolution on Distributed FPGAs for Reinforcement Learning Problems10 May 2020 0 repositories listed
-
An FPGA-Based On-Device Reinforcement Learning Approach using Online Sequential Learning10 May 2020 0 repositories listed
-
Reinforcement Learning based Design of Linear Fixed Structure Controllers10 May 2020 0 repositories listed
-
Reinforcement Learning with Feedback Graphs7 May 2020 0 repositories listed
-
Robotic Arm Control and Task Training through Deep Reinforcement Learning6 May 2020 0 repositories listed
-
Safe Reinforcement Learning through Meta-learned Instincts6 May 2020 0 repositories listed
-
Generalized Planning With Deep Reinforcement Learning5 May 2020 0 repositories listed
-
Reinforcement Learning for UAV Autonomous Navigation, Mapping and Target Detection5 May 2020 0 repositories listed
-
Formal Policy Synthesis for Continuous-Space Systems via Reinforcement Learning4 May 2020 0 repositories listed
-
Noise Pollution in Hospital Readmission Prediction: Long Document Classification with Reinforcement Learning4 May 2020 0 repositories listed
-
Setting up experimental Bell test with reinforcement learning4 May 2020 0 repositories listed
-
Multi-agent Reinforcement Learning for Decentralized Stable Matching3 May 2020 0 repositories listed
-
Deep Reinforcement Learning for Intelligent Transportation Systems: A Survey2 May 2020 0 repositories listed
-
Enhancing Text-based Reinforcement Learning Agents with Commonsense Knowledge2 May 2020 0 repositories listed
-
AMRL: Aggregated Memory For Reinforcement Learning1 May 2020 0 repositories listed
-
Episodic Reinforcement Learning with Associative Memory1 May 2020 0 repositories listed
-
Exploration in Reinforcement Learning with Deep Covering Options1 May 2020 0 repositories listed
-
Improving Robustness via Risk Averse Distributional Reinforcement Learning1 May 2020 0 repositories listed
-
Is Long Horizon Reinforcement Learning More Difficult Than Short Horizon Reinforcement Learning?1 May 2020 0 repositories listed
-
Learning Heuristics for Quantified Boolean Formulas through Reinforcement Learning1 May 2020 0 repositories listed
-
Learning the Arrow of Time for Problems in Reinforcement Learning1 May 2020 0 repositories listed
-
Model-based reinforcement learning for biological sequence design1 May 2020 0 repositories listed
-
Model Based Reinforcement Learning for Atari1 May 2020 0 repositories listed
-
Posterior sampling for multi-agent reinforcement learning: solving extensive games with imperfect information1 May 2020 0 repositories listed
-
The Ingredients of Real World Robotic Reinforcement Learning1 May 2020 0 repositories listed
-
Toward Evaluating Robustness of Deep Reinforcement Learning with Continuous Control1 May 2020 0 repositories listed
-
Bootstrap Latent-Predictive Representations for Multitask Reinforcement Learning30 Apr 2020 0 repositories listed
-
Breaking (Global) Barriers in Parallel Stochastic Optimization with Wait-Avoiding Group Averaging30 Apr 2020 0 repositories listed
-
DSAC: Distributional Soft Actor Critic for Risk-Sensitive Reinforcement Learning30 Apr 2020 0 repositories listed
-
Out-of-the-box channel pruned networks30 Apr 2020 0 repositories listed
-
Plan-Space State Embeddings for Improved Reinforcement Learning30 Apr 2020 0 repositories listed
-
Reinforcement learning of minimalist grammars30 Apr 2020 0 repositories listed
-
Sim-to-Real Transfer with Incremental Environment Complexity for Reinforcement Learning of Depth-Based Robot Navigation30 Apr 2020 0 repositories listed
-
Towards Embodied Scene Description30 Apr 2020 0 repositories listed
-
Meta-Reinforcement Learning for Robotic Industrial Insertion Tasks29 Apr 2020 0 repositories listed
-
Molecular Design in Synthetically Accessible Chemical Space via Deep Reinforcement Learning29 Apr 2020 0 repositories listed
-
Reduced-Dimensional Reinforcement Learning Control using Singular Perturbation Approximations29 Apr 2020 0 repositories listed
-
Whittle index based Q-learning for restless bandits with average reward29 Apr 2020 0 repositories listed
-
Improving Sample Efficiency and Multi-Agent Communication in RL-based Train Rescheduling28 Apr 2020 0 repositories listed
-
Pitfalls of learning a reward function online28 Apr 2020 0 repositories listed
-
Sample-Efficient Model-based Actor-Critic for an Interactive Dialogue Task28 Apr 2020 0 repositories listed
-
The Immersion of Directed Multi-graphs in Embedding Fields. Generalisations28 Apr 2020 0 repositories listed
-
Adaptive model selection in photonic reservoir computing by reinforcement learning27 Apr 2020 0 repositories listed
-
Age-Aware Status Update Control for Energy Harvesting IoT Sensors via Reinforcement Learning27 Apr 2020 0 repositories listed
-
The Case for Learning Application Behavior to Improve Hardware Energy Efficiency27 Apr 2020 0 repositories listed
-
Improving Sample Complexity Bounds for (Natural) Actor-Critic Algorithms27 Apr 2020 0 repositories listed
-
Learning Neural-Symbolic Descriptive Planning Models via Cube-Space Priors: The Voyage Home (to STRIPS)27 Apr 2020 0 repositories listed
-
The Ingredients of Real-World Robotic Reinforcement Learning27 Apr 2020 0 repositories listed
-
Warm-Start AlphaZero Self-Play Search Enhancements26 Apr 2020 0 repositories listed
-
A Perspective on Deep Learning for Molecular Modeling and Simulations25 Apr 2020 0 repositories listed
-
A State Aggregation Approach for Solving Knapsack Problem with Deep Reinforcement Learning25 Apr 2020 0 repositories listed
-
Quantum machine learning and quantum biomimetics: A perspective25 Apr 2020 0 repositories listed
-
Automatic low-bit hybrid quantization of neural networks through meta learning24 Apr 2020 0 repositories listed
-
Evolution of Q Values for Deep Q Learning in Stable Baselines24 Apr 2020 0 repositories listed
-
PBCS : Efficient Exploration and Exploitation Using a Synergy between Reinforcement Learning and Motion Planning24 Apr 2020 0 repositories listed
-
Cooperative Perception with Deep Reinforcement Learning for Connected Vehicles23 Apr 2020 0 repositories listed
-
Divide-and-Conquer Monte Carlo Tree Search For Goal-Directed Planning23 Apr 2020 0 repositories listed
-
Guiding Robot Exploration in Reinforcement Learning via Automated Planning23 Apr 2020 0 repositories listed
-
Learning Dialog Policies from Weak Demonstrations23 Apr 2020 0 repositories listed
-
AutoEG: Automated Experience Grafting for Off-Policy Deep Reinforcement Learning22 Apr 2020 0 repositories listed
-
Flexible and Efficient Long-Range Planning Through Curious Exploration22 Apr 2020 0 repositories listed
-
Policy Gradient from Demonstration and Curiosity22 Apr 2020 0 repositories listed
-
Qd-tree: Learning Data Layouts for Big Data Analytics22 Apr 2020 0 repositories listed
-
Sequential Anomaly Detection using Inverse Reinforcement Learning22 Apr 2020 0 repositories listed
-
Almost Optimal Model-Free Reinforcement Learning via Reference-Advantage Decomposition21 Apr 2020 0 repositories listed
-
Never Stop Learning: The Effectiveness of Fine-Tuning in Robotic Reinforcement Learning21 Apr 2020 0 repositories listed
-
Learning Goal-oriented Dialogue Policy with Opposite Agent Awareness21 Apr 2020 0 repositories listed
-
Reinforcement Learning to Optimize the Logistics Distribution Routes of Unmanned Aerial Vehicle21 Apr 2020 0 repositories listed
-
SIBRE: Self Improvement Based REwards for Adaptive Feedback in Reinforcement Learning21 Apr 2020 0 repositories listed
-
STDPG: A Spatio-Temporal Deterministic Policy Gradient Agent for Dynamic Routing in SDN21 Apr 2020 0 repositories listed
-
Attention Routing: track-assignment detailed routing using attention-based reinforcement learning20 Apr 2020 0 repositories listed
-
Collaborative Top Distribution Identifications with Limited Interaction20 Apr 2020 0 repositories listed
-
Data-Driven Learning and Load Ensemble Control20 Apr 2020 0 repositories listed
-
Intelligent Querying for Target Tracking in Camera Networks using Deep Q-Learning with n-Step Bootstrapping20 Apr 2020 0 repositories listed
-
Learning as Reinforcement: Applying Principles of Neuroscience for More General Reinforcement Learning Agents20 Apr 2020 0 repositories listed
-
Tightening Exploration in Upper Confidence Reinforcement Learning20 Apr 2020 0 repositories listed
-
Variational Policy Propagation for Multi-agent Reinforcement Learning19 Apr 2020 0 repositories listed
-
Superkernel Neural Architecture Search for Image Denoising19 Apr 2020 0 repositories listed
-
Macro-Action-Based Deep Multi-Agent Reinforcement Learning18 Apr 2020 0 repositories listed
-
Modeling Survival in model-based Reinforcement Learning18 Apr 2020 0 repositories listed
-
Time Adaptive Reinforcement Learning18 Apr 2020 0 repositories listed
-
A Comprehensive Overview and Survey of Recent Advances in Meta-Learning17 Apr 2020 0 repositories listed
-
Approximate Inverse Reinforcement Learning from Vision-based Imitation Learning17 Apr 2020 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Learning Systems17 Apr 2020 0 repositories listed
-
F2A2: Flexible Fully-decentralized Approximate Actor-critic for Cooperative Multi-agent Reinforcement Learning17 Apr 2020 0 repositories listed
-
Goal-conditioned Batch Reinforcement Learning for Rotation Invariant Locomotion17 Apr 2020 0 repositories listed
-
Knowledge-guided Deep Reinforcement Learning for Interactive Recommendation17 Apr 2020 0 repositories listed
-
Show Us the Way: Learning to Manage Dialog from Demonstrations17 Apr 2020 0 repositories listed