Browse State-of-the-Art › Reinforcement Learning › Papers, page 93
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 93 of 132: papers 9,201 to 9,300 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
QTRAN++: Improved Value Transformation for Cooperative Multi-Agent Reinforcement Learning22 Jun 2020 0 repositories listed
-
Risk-Sensitive Reinforcement Learning: Near-Optimal Risk-Sample Tradeoff in Regret22 Jun 2020 0 repositories listed
-
Sample-Efficient Reinforcement Learning of Undercomplete POMDPs22 Jun 2020 0 repositories listed
-
Hierarchical Reinforcement Learning for Deep Goal Reasoning: An Expressiveness Analysis21 Jun 2020 0 repositories listed
-
Reinforcement Learning for Mean Field Games with Strategic Complementarities21 Jun 2020 0 repositories listed
-
Towards Tractable Optimism in Model-Based Reinforcement Learning21 Jun 2020 0 repositories listed
-
Accelerating Safe Reinforcement Learning with Constraint-mismatched Policies20 Jun 2020 0 repositories listed
-
Entropic Risk Constrained Soft-Robust Policy Optimization20 Jun 2020 0 repositories listed
-
A Reinforcement Learning Approach for Transient Control of Liquid Rocket Engines19 Jun 2020 0 repositories listed
-
Learn to Earn: Enabling Coordination within a Ride Hailing Fleet19 Jun 2020 0 repositories listed
-
NROWAN-DQN: A Stable Noisy Network with Noise Reduction and Online Weight Adjustment for Exploration19 Jun 2020 0 repositories listed
-
On Reward-Free Reinforcement Learning with Linear Function Approximation19 Jun 2020 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning with Partial Observations18 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning amidst Lifelong Non-Stationarity18 Jun 2020 0 repositories listed
-
Interactive Recommender System via Knowledge Graph-enhanced Reinforcement Learning18 Jun 2020 0 repositories listed
-
Provably adaptive reinforcement learning in metric spaces18 Jun 2020 0 repositories listed
-
WD3: Taming the Estimation Bias in Deep Reinforcement Learning18 Jun 2020 0 repositories listed
-
Policy Evaluation and Seeking for Multi-Agent Reinforcement Learning via Best Response17 Jun 2020 0 repositories listed
-
Index Selection for NoSQL Database with Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Model Embedding Model-Based Reinforcement Learning16 Jun 2020 0 repositories listed
-
Preference-based Reinforcement Learning with Finite-Time Guarantees16 Jun 2020 0 repositories listed
-
RL-CycleGAN: Reinforcement Learning Aware Simulation-To-Real16 Jun 2020 0 repositories listed
-
Solving the Order Batching and Sequencing Problem using Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Task-agnostic Exploration in Reinforcement Learning16 Jun 2020 0 repositories listed
-
The Sample Complexity of Teaching-by-Reinforcement on Q-Learning16 Jun 2020 0 repositories listed
-
Variable Gain Gradient Descent-based Reinforcement Learning for Robust Optimal Tracking Control of Uncertain Nonlinear System with Input-Constraints15 Jun 2020 0 repositories listed
-
Reinforcement Learning with Supervision from Noisy Demonstrations14 Jun 2020 0 repositories listed
-
Tackling Morpion Solitaire with AlphaZero-likeRanked Reward Reinforcement Learning14 Jun 2020 0 repositories listed
-
Hindsight Expectation Maximization for Goal-conditioned Reinforcement Learning13 Jun 2020 0 repositories listed
-
Reinforcement Learning as Iterative and Amortised Inference13 Jun 2020 0 repositories listed
-
A Brief Look at Generalization in Visual Meta-Reinforcement Learning12 Jun 2020 0 repositories listed
-
Bridging Worlds in Reinforcement Learning with Model-Advantage12 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning for Neural Control12 Jun 2020 0 repositories listed
-
Generalizing Curricula for Reinforcement Learning12 Jun 2020 0 repositories listed
-
Hierarchical reinforcement learning for efficent exploration and transfer12 Jun 2020 0 repositories listed
-
Logical Composition in Lifelong Reinforcement Learning12 Jun 2020 0 repositories listed
-
Meta-Reinforcement Learning Robust to Distributional Shift via Model Identification and Experience Relabeling12 Jun 2020 0 repositories listed
-
Potential Field Guided Actor-Critic Reinforcement Learning12 Jun 2020 0 repositories listed
-
StarCraft II Build Order Optimization using Deep Reinforcement Learning and Monte-Carlo Tree Search12 Jun 2020 0 repositories listed
-
Systematic Generalisation through Task Temporal Logic and Deep Reinforcement Learning12 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning for Electric Transmission Voltage Control11 Jun 2020 0 repositories listed
-
Multi-Agent Informational Learning Processes11 Jun 2020 0 repositories listed
-
Sample Efficient Reinforcement Learning via Low-Rank Matrix Estimation11 Jun 2020 0 repositories listed
-
Surveys without Questions: A Reinforcement Learning Approach11 Jun 2020 0 repositories listed
-
Deep reinforcement learning for optical systems: A case study of mode-locked lasers10 Jun 2020 0 repositories listed
-
Machine learning and control engineering: The model-free case10 Jun 2020 0 repositories listed
-
Self-Supervised Reinforcement Learning for Recommender Systems10 Jun 2020 0 repositories listed
-
Transient Non-Stationarity and Generalisation in Deep Reinforcement Learning10 Jun 2020 0 repositories listed
-
An overall view of key problems in algorithmic trading and recent progress9 Jun 2020 0 repositories listed
-
Stealing Deep Reinforcement Learning Models for Fun and Profit9 Jun 2020 0 repositories listed
-
A Decentralized Policy Gradient Approach to Multi-task Reinforcement Learning8 Jun 2020 0 repositories listed
-
Balancing a CartPole System with Reinforcement Learning -- A Tutorial8 Jun 2020 0 repositories listed
-
Constrained Upper Confidence Reinforcement Learning with Known Dynamics8 Jun 2020 0 repositories listed
-
Maximum Entropy Model Rollouts: Fast Model Based Policy Optimization without Compounding Errors8 Jun 2020 0 repositories listed
-
Stable Reinforcement Learning with Unbounded State Space8 Jun 2020 0 repositories listed
-
Efficient Poverty Mapping using Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Implications of Human Irrationality for Reinforcement Learning7 Jun 2020 0 repositories listed
-
Real-Time Model Calibration with Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Skill Discovery of Coordination in Multi-agent Reinforcement Learning7 Jun 2020 0 repositories listed
-
Efficient Evaluation of Natural Stochastic Policies in Offline Reinforcement Learning6 Jun 2020 0 repositories listed
-
Balancing Reinforcement Learning Training Experiences in Interactive Information Retrieval5 Jun 2020 0 repositories listed
-
State Action Separable Reinforcement Learning5 Jun 2020 0 repositories listed
-
Constrained Reinforcement Learning for Dynamic Optimization under Uncertainty4 Jun 2020 0 repositories listed
-
Refined Continuous Control of DDPG Actors via Parametrised Activation4 Jun 2020 0 repositories listed
-
Causality and Batch Reinforcement Learning: Complementary Approaches To Planning In Unknown Domains3 Jun 2020 0 repositories listed
-
The Value-Improvement Path: Towards Better Representations for Reinforcement Learning3 Jun 2020 0 repositories listed
-
A novel approach for multi-agent cooperative pursuit to capture grouped evaders1 Jun 2020 0 repositories listed
-
Mitigating Bias in Face Recognition Using Skewness-Aware Reinforcement Learning1 Jun 2020 0 repositories listed
-
Model-Based Reinforcement Learning with Value-Targeted Regression1 Jun 2020 0 repositories listed
-
Robust Reinforcement Learning with Wasserstein Constraint1 Jun 2020 0 repositories listed
-
Temporal-Differential Learning in Continuous Environments1 Jun 2020 0 repositories listed
-
Intelligent Residential Energy Management System using Deep Reinforcement Learning28 May 2020 0 repositories listed
-
Active Measure Reinforcement Learning for Observation Cost Minimization26 May 2020 0 repositories listed
-
Anomaly Detection Under Controlled Sensing Using Actor-Critic Reinforcement Learning26 May 2020 0 repositories listed
-
Towards intervention-centric causal reasoning in learning agents26 May 2020 0 repositories listed
-
Deep Learning Models for Automatic Summarization25 May 2020 0 repositories listed
-
Deep Reinforcement Learning Based Power Allocation for D2D Network25 May 2020 0 repositories listed
-
Dynamic Value Estimation for Single-Task Multi-Scene Reinforcement Learning25 May 2020 0 repositories listed
-
Generator and Critic: A Deep Reinforcement Learning Approach for Slate Re-ranking in E-commerce25 May 2020 0 repositories listed
-
Gradient Monitored Reinforcement Learning25 May 2020 0 repositories listed
-
Meta-Reinforcement Learning for Trajectory Design in Wireless UAV Networks25 May 2020 0 repositories listed
-
Policy Entropy for Out-of-Distribution Classification25 May 2020 0 repositories listed
-
Reinforcement Learning with Iterative Reasoning for Merging in Dense Traffic25 May 2020 0 repositories listed
-
GoChat: Goal-oriented Chatbots with Hierarchical Reinforcement Learning24 May 2020 0 repositories listed
-
Model-free Reinforcement Learning for Stochastic Stackelberg Security Games24 May 2020 0 repositories listed
-
Adaptive Reinforcement Learning through Evolving Self-Modifying Neural Networks22 May 2020 0 repositories listed
-
Reinforcement learning with human advice: a survey22 May 2020 0 repositories listed
-
Towards Automated Safety Coverage and Testing for Autonomous Vehicles with Reinforcement Learning22 May 2020 0 repositories listed
-
A reinforcement learning based decision support system in textile manufacturing process20 May 2020 0 repositories listed
-
Deep Reinforcement Learning for High Level Character Control20 May 2020 0 repositories listed
-
Finite-sample Analysis of Greedy-GQ with Linear Function Approximation under Markovian Noise20 May 2020 0 repositories listed
-
Learning and Reasoning for Robot Dialog and Navigation Tasks20 May 2020 0 repositories listed
-
Reinforcement Learning for Variable Selection in a Branch and Bound Algorithm20 May 2020 0 repositories listed
-
Two-stage Deep Reinforcement Learning for Inverter-based Volt-VAR Control in Active Distribution Networks20 May 2020 0 repositories listed
-
A Survey of Reinforcement Learning Algorithms for Dynamically Varying Environments19 May 2020 0 repositories listed
-
Batch-Augmented Multi-Agent Reinforcement Learning for Efficient Traffic Signal Optimization19 May 2020 0 repositories listed
-
Privileged Information Dropout in Reinforcement Learning19 May 2020 0 repositories listed
-
Reinforcement Learning for Caching with Space-Time Popularity Dynamics19 May 2020 0 repositories listed
-
Automating Turbulence Modeling by Multi-Agent Reinforcement Learning18 May 2020 0 repositories listed
-
Optimal Charging Method for Effective Li-ion Battery Life Extension Based on Reinforcement Learning18 May 2020 0 repositories listed