Browse State-of-the-Art › reinforcement-learning › Papers, page 108
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 108 of 135: papers 10,701 to 10,800 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Breaking the Curse of Many Agents: Provable Mean Embedding Q-Iteration for Mean-Field Reinforcement Learning21 Jun 2020 0 repositories listed
-
Hierarchical Reinforcement Learning for Deep Goal Reasoning: An Expressiveness Analysis21 Jun 2020 0 repositories listed
-
Reinforcement Learning for Mean Field Games with Strategic Complementarities21 Jun 2020 0 repositories listed
-
Towards Tractable Optimism in Model-Based Reinforcement Learning21 Jun 2020 0 repositories listed
-
Accelerating Safe Reinforcement Learning with Constraint-mismatched Policies20 Jun 2020 0 repositories listed
-
Entropic Risk Constrained Soft-Robust Policy Optimization20 Jun 2020 0 repositories listed
-
Langevin Dynamics for Adaptive Inverse Reinforcement Learning of Stochastic Gradient Algorithms20 Jun 2020 0 repositories listed
-
Robust Reinforcement Learning using Least Squares Policy Iteration with Provable Performance Guarantees20 Jun 2020 0 repositories listed
-
A Reinforcement Learning Approach for Transient Control of Liquid Rocket Engines19 Jun 2020 0 repositories listed
-
Learn to Earn: Enabling Coordination within a Ride Hailing Fleet19 Jun 2020 0 repositories listed
-
NROWAN-DQN: A Stable Noisy Network with Noise Reduction and Online Weight Adjustment for Exploration19 Jun 2020 0 repositories listed
-
On Reward-Free Reinforcement Learning with Linear Function Approximation19 Jun 2020 0 repositories listed
-
FISAR: Forward Invariant Safe Reinforcement Learning with a Deep Neural Network-Based Optimize19 Jun 2020 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning with Partial Observations18 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning amidst Lifelong Non-Stationarity18 Jun 2020 0 repositories listed
-
Distributed Value Function Approximation for Collaborative Multi-Agent Reinforcement Learning18 Jun 2020 0 repositories listed
-
FLAMBE: Structural Complexity and Representation Learning of Low Rank MDPs18 Jun 2020 0 repositories listed
-
Interactive Recommender System via Knowledge Graph-enhanced Reinforcement Learning18 Jun 2020 0 repositories listed
-
Provably adaptive reinforcement learning in metric spaces18 Jun 2020 0 repositories listed
-
WD3: Taming the Estimation Bias in Deep Reinforcement Learning18 Jun 2020 0 repositories listed
-
Introduction to Machine Learning for Accelerator Physics17 Jun 2020 0 repositories listed
-
Parameterized MDPs and Reinforcement Learning Problems -- A Maximum Entropy Principle Based Framework17 Jun 2020 0 repositories listed
-
Policy Evaluation and Seeking for Multi-Agent Reinforcement Learning via Best Response17 Jun 2020 0 repositories listed
-
Reinforcement Learning with Uncertainty Estimation for Tactical Decision-Making in Intersections17 Jun 2020 0 repositories listed
-
COLREG-Compliant Collision Avoidance for Unmanned Surface Vehicle using Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Index Selection for NoSQL Database with Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Model Embedding Model-Based Reinforcement Learning16 Jun 2020 0 repositories listed
-
Multi-Agent Reinforcement Learning for Adaptive User Association in Dynamic mmWave Networks16 Jun 2020 0 repositories listed
-
Preference-based Reinforcement Learning with Finite-Time Guarantees16 Jun 2020 0 repositories listed
-
RL-CycleGAN: Reinforcement Learning Aware Simulation-To-Real16 Jun 2020 0 repositories listed
-
Solving the Order Batching and Sequencing Problem using Deep Reinforcement Learning16 Jun 2020 0 repositories listed
-
Task-agnostic Exploration in Reinforcement Learning16 Jun 2020 0 repositories listed
-
The Sample Complexity of Teaching-by-Reinforcement on Q-Learning16 Jun 2020 0 repositories listed
-
An online evolving framework for advancing reinforcement-learning based automated vehicle control15 Jun 2020 0 repositories listed
-
Designing high-fidelity multi-qubit gates for semiconductor quantum dots through deep reinforcement learning15 Jun 2020 0 repositories listed
-
Variable Gain Gradient Descent-based Reinforcement Learning for Robust Optimal Tracking Control of Uncertain Nonlinear System with Input-Constraints15 Jun 2020 0 repositories listed
-
Adversarial Attacks and Detection on Reinforcement Learning-Based Interactive Recommender Systems14 Jun 2020 0 repositories listed
-
Reinforcement Learning with Supervision from Noisy Demonstrations14 Jun 2020 0 repositories listed
-
Tackling Morpion Solitaire with AlphaZero-likeRanked Reward Reinforcement Learning14 Jun 2020 0 repositories listed
-
Hindsight Expectation Maximization for Goal-conditioned Reinforcement Learning13 Jun 2020 0 repositories listed
-
Reinforcement Learning as Iterative and Amortised Inference13 Jun 2020 0 repositories listed
-
A Brief Look at Generalization in Visual Meta-Reinforcement Learning12 Jun 2020 0 repositories listed
-
Bridging Worlds in Reinforcement Learning with Model-Advantage12 Jun 2020 0 repositories listed
-
Continuous Control for Searching and Planning with a Learned Model12 Jun 2020 0 repositories listed
-
Decorrelated Double Q-learning12 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning for Neural Control12 Jun 2020 0 repositories listed
-
Explore then Execute: Adapting without Rewards via Factorized Meta-Reinforcement Learning12 Jun 2020 0 repositories listed
-
Generalizing Curricula for Reinforcement Learning12 Jun 2020 0 repositories listed
-
Hierarchical reinforcement learning for efficent exploration and transfer12 Jun 2020 0 repositories listed
-
Human and Multi-Agent collaboration in a human-MARL teaming framework12 Jun 2020 0 repositories listed
-
Learning Intrinsically Motivated Options to Stimulate Policy Exploration12 Jun 2020 0 repositories listed
-
Logical Composition in Lifelong Reinforcement Learning12 Jun 2020 0 repositories listed
-
Meta-Reinforcement Learning Robust to Distributional Shift via Model Identification and Experience Relabeling12 Jun 2020 0 repositories listed
-
Potential Field Guided Actor-Critic Reinforcement Learning12 Jun 2020 0 repositories listed
-
Safety-guaranteed Reinforcement Learning based on Multi-class Support Vector Machine12 Jun 2020 0 repositories listed
-
StarCraft II Build Order Optimization using Deep Reinforcement Learning and Monte-Carlo Tree Search12 Jun 2020 0 repositories listed
-
Systematic Generalisation through Task Temporal Logic and Deep Reinforcement Learning12 Jun 2020 0 repositories listed
-
Using Reinforcement Learning to Allocate and Manage Service Function Chains in Cellular Networks12 Jun 2020 0 repositories listed
-
Deep Reinforcement Learning for Electric Transmission Voltage Control11 Jun 2020 0 repositories listed
-
Multi-Agent Informational Learning Processes11 Jun 2020 0 repositories listed
-
Sample Efficient Reinforcement Learning via Low-Rank Matrix Estimation11 Jun 2020 0 repositories listed
-
Scalable Multi-Agent Reinforcement Learning for Networked Systems with Average Reward11 Jun 2020 0 repositories listed
-
Surveys without Questions: A Reinforcement Learning Approach11 Jun 2020 0 repositories listed
-
Deep reinforcement learning for optical systems: A case study of mode-locked lasers10 Jun 2020 0 repositories listed
-
Learning to Play Table Tennis From Scratch using Muscular Robots10 Jun 2020 0 repositories listed
-
Machine learning and control engineering: The model-free case10 Jun 2020 0 repositories listed
-
Multi-Agent Reinforcement Learning in a Realistic Limit Order Book Market Simulation10 Jun 2020 0 repositories listed
-
Off-Policy Risk-Sensitive Reinforcement Learning Based Constrained Robust Optimal Control10 Jun 2020 0 repositories listed
-
Privacy-Cost Management in Smart Meters with Mutual Information-Based Reinforcement Learning10 Jun 2020 0 repositories listed
-
Searching Learning Strategy with Reinforcement Learning for 3D Medical Image Segmentation10 Jun 2020 0 repositories listed
-
Self-Supervised Reinforcement Learning for Recommender Systems10 Jun 2020 0 repositories listed
-
Transient Non-Stationarity and Generalisation in Deep Reinforcement Learning10 Jun 2020 0 repositories listed
-
An overall view of key problems in algorithmic trading and recent progress9 Jun 2020 0 repositories listed
-
Causal Discovery from Incomplete Data using An Encoder and Reinforcement Learning9 Jun 2020 0 repositories listed
-
Stealing Deep Reinforcement Learning Models for Fun and Profit9 Jun 2020 0 repositories listed
-
A Decentralized Policy Gradient Approach to Multi-task Reinforcement Learning8 Jun 2020 0 repositories listed
-
A Model-free Learning Algorithm for Infinite-horizon Average-reward MDPs with Near-optimal Regret8 Jun 2020 0 repositories listed
-
Balancing a CartPole System with Reinforcement Learning -- A Tutorial8 Jun 2020 0 repositories listed
-
Constrained Upper Confidence Reinforcement Learning with Known Dynamics8 Jun 2020 0 repositories listed
-
Maximum Entropy Model Rollouts: Fast Model Based Policy Optimization without Compounding Errors8 Jun 2020 0 repositories listed
-
Online Data Poisoning Attacks8 Jun 2020 0 repositories listed
-
Scalable Reinforcement Learning of Localized Policies for Multi-Agent Networked Systems8 Jun 2020 0 repositories listed
-
Stable Reinforcement Learning with Unbounded State Space8 Jun 2020 0 repositories listed
-
Efficient Poverty Mapping using Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Implications of Human Irrationality for Reinforcement Learning7 Jun 2020 0 repositories listed
-
Real-Time Model Calibration with Deep Reinforcement Learning7 Jun 2020 0 repositories listed
-
Skill Discovery of Coordination in Multi-agent Reinforcement Learning7 Jun 2020 0 repositories listed
-
Efficient Evaluation of Natural Stochastic Policies in Offline Reinforcement Learning6 Jun 2020 0 repositories listed
-
Model-Free Reinforcement Learning: from Clipped Pseudo-Regret to Sample Complexity6 Jun 2020 0 repositories listed
-
Balancing Reinforcement Learning Training Experiences in Interactive Information Retrieval5 Jun 2020 0 repositories listed
-
State Action Separable Reinforcement Learning5 Jun 2020 0 repositories listed
-
Constrained Reinforcement Learning for Dynamic Optimization under Uncertainty4 Jun 2020 0 repositories listed
-
Meta-Model-Based Meta-Policy Optimization4 Jun 2020 0 repositories listed
-
Refined Continuous Control of DDPG Actors via Parametrised Activation4 Jun 2020 0 repositories listed
-
Causality and Batch Reinforcement Learning: Complementary Approaches To Planning In Unknown Domains3 Jun 2020 0 repositories listed
-
The Value-Improvement Path: Towards Better Representations for Reinforcement Learning3 Jun 2020 0 repositories listed
-
A novel approach for multi-agent cooperative pursuit to capture grouped evaders1 Jun 2020 0 repositories listed
-
Active Vision for Early Recognition of Human Actions1 Jun 2020 0 repositories listed
-
Mitigating Bias in Face Recognition Using Skewness-Aware Reinforcement Learning1 Jun 2020 0 repositories listed
-
Model-Based Reinforcement Learning with Value-Targeted Regression1 Jun 2020 0 repositories listed