Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 121
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 121 of 152: papers 12,001 to 12,100 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Variational Model-based Policy Optimization9 Jun 2020 0 repositories listed
-
A Comparison of Self-Play Algorithms Under a Generalized Framework8 Jun 2020 0 repositories listed
-
A Decentralized Policy Gradient Approach to Multi-task Reinforcement Learning8 Jun 2020 0 repositories listed
-
A Model-free Learning Algorithm for Infinite-horizon Average-reward MDPs with Near-optimal Regret8 Jun 2020 0 repositories listed
-
Balancing a CartPole System with Reinforcement Learning -- A Tutorial8 Jun 2020 0 repositories listed
-
Constrained Upper Confidence Reinforcement Learning with Known Dynamics8 Jun 2020 0 repositories listed
-
Hallucinating Value: A Pitfall of Dyna-style Planning with Imperfect Environment Models8 Jun 2020 0 repositories listed
-
Learning the model-free linear quadratic regulator via random search8 Jun 2020 0 repositories listed
-
Learning to Plan via Deep Optimistic Value Exploration8 Jun 2020 0 repositories listed
-
Maximum Entropy Model Rollouts: Fast Model Based Policy Optimization without Compounding Errors8 Jun 2020 0 repositories listed
-
Online Data Poisoning Attacks8 Jun 2020 0 repositories listed
-
Policy Optimization for ℋ₂ Linear Control with ℋ_∞ Robustness Guarantee: Implicit Regularization and Global Convergence8 Jun 2020 0 repositories listed
-
Randomized Policy Learning for Continuous State and Action MDPs8 Jun 2020 0 repositories listed
-
Scalable Reinforcement Learning of Localized Policies for Multi-Agent Networked Systems8 Jun 2020 0 repositories listed
-
Stable Reinforcement Learning with Unbounded State Space8 Jun 2020 0 repositories listed
-
Efficient Poverty Mapping using Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Implications of Human Irrationality for Reinforcement Learning7 Jun 2020 0 repositories listed
-
Incorporating Pragmatic Reasoning Communication into Emergent Language7 Jun 2020 0 repositories listed
-
Multi-Task Reinforcement Learning based Mobile Manipulation Control for Dynamic Object Tracking and Grasping7 Jun 2020 0 repositories listed
-
Real-Time Model Calibration with Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Skill Discovery of Coordination in Multi-agent Reinforcement Learning7 Jun 2020 0 repositories listed
-
Efficient Evaluation of Natural Stochastic Policies in Offline Reinforcement Learning6 Jun 2020 0 repositories listed
-
Model-Free Reinforcement Learning: from Clipped Pseudo-Regret to Sample Complexity6 Jun 2020 0 repositories listed
-
Stable and Efficient Policy Evaluation6 Jun 2020 0 repositories listed
-
AutoHAS: Efficient Hyperparameter and Architecture Search5 Jun 2020 0 repositories listed
-
Balancing Reinforcement Learning Training Experiences in Interactive Information Retrieval5 Jun 2020 0 repositories listed
-
State Action Separable Reinforcement Learning5 Jun 2020 0 repositories listed
-
Constrained Reinforcement Learning for Dynamic Optimization under Uncertainty4 Jun 2020 0 repositories listed
-
Meta-Model-Based Meta-Policy Optimization4 Jun 2020 0 repositories listed
-
Refined Continuous Control of DDPG Actors via Parametrised Activation4 Jun 2020 0 repositories listed
-
Causality and Batch Reinforcement Learning: Complementary Approaches To Planning In Unknown Domains3 Jun 2020 0 repositories listed
-
Learning to Scan: A Deep Reinforcement Learning Approach for Personalized Scanning in CT Imaging3 Jun 2020 0 repositories listed
-
The Value-Improvement Path: Towards Better Representations for Reinforcement Learning3 Jun 2020 0 repositories listed
-
A novel approach for multi-agent cooperative pursuit to capture grouped evaders1 Jun 2020 0 repositories listed
-
Active Vision for Early Recognition of Human Actions1 Jun 2020 0 repositories listed
-
Mitigating Bias in Face Recognition Using Skewness-Aware Reinforcement Learning1 Jun 2020 0 repositories listed
-
Model-Based Reinforcement Learning with Value-Targeted Regression1 Jun 2020 0 repositories listed
-
Reinforcement learning and Bayesian data assimilation for model-informed precision dosing in oncology1 Jun 2020 0 repositories listed
-
Robust Reinforcement Learning with Wasserstein Constraint1 Jun 2020 0 repositories listed
-
Temporal-Differential Learning in Continuous Environments1 Jun 2020 0 repositories listed
-
Variational Reward Estimator Bottleneck: Learning Robust Reward Estimator for Multi-Domain Task-Oriented Dialog31 May 2020 0 repositories listed
-
AI-based Resource Allocation: Reinforcement Learning for Adaptive Auto-scaling in Serverless Environments29 May 2020 0 repositories listed
-
Domain Knowledge Integration By Gradient Matching For Sample-Efficient Reinforcement Learning28 May 2020 0 repositories listed
-
Intelligent Residential Energy Management System using Deep Reinforcement Learning28 May 2020 0 repositories listed
-
Active Measure Reinforcement Learning for Observation Cost Minimization26 May 2020 0 repositories listed
-
Anomaly Detection Under Controlled Sensing Using Actor-Critic Reinforcement Learning26 May 2020 0 repositories listed
-
Breaking the Sample Size Barrier in Model-Based Reinforcement Learning with a Generative Model26 May 2020 0 repositories listed
-
Efficient Use of heuristics for accelerating XCS-based Policy Learning in Markov Games26 May 2020 0 repositories listed
-
Integrating LEO Satellite and UAV Relaying via Reinforcement Learning for Non-Terrestrial Networks26 May 2020 0 repositories listed
-
Time-Variant Variational Transfer for Value Functions26 May 2020 0 repositories listed
-
Towards intervention-centric causal reasoning in learning agents26 May 2020 0 repositories listed
-
Deep Learning Models for Automatic Summarization25 May 2020 0 repositories listed
-
Deep Reinforcement Learning Based Power Allocation for D2D Network25 May 2020 0 repositories listed
-
Dynamic Value Estimation for Single-Task Multi-Scene Reinforcement Learning25 May 2020 0 repositories listed
-
Generator and Critic: A Deep Reinforcement Learning Approach for Slate Re-ranking in E-commerce25 May 2020 0 repositories listed
-
Gradient Monitored Reinforcement Learning25 May 2020 0 repositories listed
-
Meta-Reinforcement Learning for Trajectory Design in Wireless UAV Networks25 May 2020 0 repositories listed
-
Optimization-driven Deep Reinforcement Learning for Robust Beamforming in IRS-assisted Wireless Communications25 May 2020 0 repositories listed
-
Policy Entropy for Out-of-Distribution Classification25 May 2020 0 repositories listed
-
Reinforcement Learning with Iterative Reasoning for Merging in Dense Traffic25 May 2020 0 repositories listed
-
GoChat: Goal-oriented Chatbots with Hierarchical Reinforcement Learning24 May 2020 0 repositories listed
-
Model-free Reinforcement Learning for Stochastic Stackelberg Security Games24 May 2020 0 repositories listed
-
Adaptive Reinforcement Learning through Evolving Self-Modifying Neural Networks22 May 2020 0 repositories listed
-
Evaluating Generalisation in General Video Game Playing22 May 2020 0 repositories listed
-
Reinforcement learning with human advice: a survey22 May 2020 0 repositories listed
-
Towards Automated Safety Coverage and Testing for Autonomous Vehicles with Reinforcement Learning22 May 2020 0 repositories listed
-
Reinforcement Learning with General Value Function Approximation: Provably Efficient Approach via Bounded Eluder Dimension21 May 2020 0 repositories listed
-
Q-NAV: NAV Setting Method based on Reinforcement Learning in Underwater Wireless Networks21 May 2020 0 repositories listed
-
A reinforcement learning based decision support system in textile manufacturing process20 May 2020 0 repositories listed
-
Deep Reinforcement Learning for High Level Character Control20 May 2020 0 repositories listed
-
Finite-sample Analysis of Greedy-GQ with Linear Function Approximation under Markovian Noise20 May 2020 0 repositories listed
-
Learning and Reasoning for Robot Dialog and Navigation Tasks20 May 2020 0 repositories listed
-
Reinforcement Learning for Variable Selection in a Branch and Bound Algorithm20 May 2020 0 repositories listed
-
Two-stage Deep Reinforcement Learning for Inverter-based Volt-VAR Control in Active Distribution Networks20 May 2020 0 repositories listed
-
A Survey of Reinforcement Learning Algorithms for Dynamically Varying Environments19 May 2020 0 repositories listed
-
Batch-Augmented Multi-Agent Reinforcement Learning for Efficient Traffic Signal Optimization19 May 2020 0 repositories listed
-
Experience Augmentation: Boosting and Accelerating Off-Policy Multi-Agent Reinforcement Learning19 May 2020 0 repositories listed
-
Human Instruction-Following with Deep Reinforcement Learning via Transfer-Learning from Text19 May 2020 0 repositories listed
-
Learning to Herd Agents Amongst Obstacles: Training Robust Shepherding Behaviors using Deep Reinforcement Learning19 May 2020 0 repositories listed
-
Privileged Information Dropout in Reinforcement Learning19 May 2020 0 repositories listed
-
Reinforcement Learning for Caching with Space-Time Popularity Dynamics19 May 2020 0 repositories listed
-
Automating Turbulence Modeling by Multi-Agent Reinforcement Learning18 May 2020 0 repositories listed
-
Basal Glucose Control in Type 1 Diabetes using Deep Reinforcement Learning: An In Silico Validation18 May 2020 0 repositories listed
-
Optimal Charging Method for Effective Li-ion Battery Life Extension Based on Reinforcement Learning18 May 2020 0 repositories listed
-
A Simple Imitation Learning Method via Contrastive Regularization16 May 2020 0 repositories listed
-
Learning Transferable Concepts in Deep Reinforcement Learning16 May 2020 0 repositories listed
-
Data-driven Dynamic Multi-objective Optimal Control: An Aspiration-satisfying Reinforcement Learning Approach14 May 2020 0 repositories listed
-
Probabilistic Guarantees for Safe Deep Reinforcement Learning14 May 2020 0 repositories listed
-
Solve Traveling Salesman Problem by Monte Carlo Tree Search and Deep Neural Network14 May 2020 0 repositories listed
-
Stealthy and Efficient Adversarial Attacks against Deep Reinforcement Learning14 May 2020 0 repositories listed
-
DREAM Architecture: a Developmental Approach to Open-Ended Learning in Robotics13 May 2020 0 repositories listed
-
Explainable Reinforcement Learning: A Survey13 May 2020 0 repositories listed
-
From Simulation to Real World Maneuver Execution using Deep Reinforcement Learning13 May 2020 0 repositories listed
-
Proxy Experience Replay: Federated Distillation for Distributed Reinforcement Learning13 May 2020 0 repositories listed
-
A New Deep Neural Architecture Search Pipeline for Face Recognition12 May 2020 0 repositories listed
-
Unbiased Deep Reinforcement Learning: A General Training Framework for Existing and Future Algorithms12 May 2020 0 repositories listed
-
A Deep Reinforcement Learning Approach to Efficient Drone Mobility Support11 May 2020 0 repositories listed
-
Deep Reinforcement Learning for Organ Localization in CT11 May 2020 0 repositories listed
-
Maximizing Information Gain in Partially Observable Environments via Prediction Reward11 May 2020 0 repositories listed
-
Reinforcement Learning Based on Real-Time Iteration NMPC11 May 2020 0 repositories listed