Browse State-of-the-Art › Reinforcement Learning › Papers, page 122
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 122 of 132: papers 12,101 to 12,200 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Model-Free Control for Distributed Stream Data Processing using Deep Reinforcement Learning2 Mar 2018 0 repositories listed
-
Deep Learning for Signal Authentication and Security in Massive Internet of Things Systems1 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Sponsored Search Real-time Bidding1 Mar 2018 0 repositories listed
-
Hierarchical Imitation and Reinforcement Learning1 Mar 2018 0 repositories listed
-
Inverse Reinforcement Learning via Nonparametric Spatio-Temporal Subgoal Modeling1 Mar 2018 0 repositories listed
-
On Oracle-Efficient PAC RL with Rich Observations1 Mar 2018 0 repositories listed
-
Q-CP: Learning Action Values for Cooperative Planning1 Mar 2018 0 repositories listed
-
Towards Cooperation in Sequential Prisoner's Dilemmas: a Deep Multiagent Reinforcement Learning Approach1 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Join Order Enumeration28 Feb 2018 0 repositories listed
-
Model-Based Value Estimation for Efficient Model-Free Reinforcement Learning28 Feb 2018 0 repositories listed
-
DiGrad: Multi-Task Reinforcement Learning with Shared Actions27 Feb 2018 0 repositories listed
-
Real-Time Bidding with Multi-Agent Reinforcement Learning in Display Advertising27 Feb 2018 0 repositories listed
-
Variance Reduction Methods for Sublinear Reinforcement Learning26 Feb 2018 0 repositories listed
-
Reinforcement Learning for Dynamic Bidding in Truckload Markets: an Application to Large-Scale Fleet Management with Advance Commitments25 Feb 2018 0 repositories listed
-
Temporal Difference Models: Model-Free Deep RL for Model-Based Control25 Feb 2018 0 repositories listed
-
One Big Net For Everything24 Feb 2018 0 repositories listed
-
Budget Constrained Bidding by Model-free Reinforcement Learning in Display Advertising23 Feb 2018 0 repositories listed
-
Weighted Double Deep Multiagent Reinforcement Learning in Stochastic Cooperative Environments23 Feb 2018 0 repositories listed
-
An Analysis of Categorical Distributional Reinforcement Learning22 Feb 2018 0 repositories listed
-
Diverse Exploration for Fast and Safe Policy Improvement22 Feb 2018 0 repositories listed
-
Convergent Actor-Critic Algorithms Under Off-Policy Training and Function Approximation21 Feb 2018 0 repositories listed
-
Machine Theory of Mind21 Feb 2018 0 repositories listed
-
Variational Inference for Policy Gradient21 Feb 2018 0 repositories listed
-
Continual Reinforcement Learning with Complex Synapses20 Feb 2018 0 repositories listed
-
Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning19 Feb 2018 0 repositories listed
-
Fourier Policy Gradients19 Feb 2018 0 repositories listed
-
Recommendations with Negative Feedback via Pairwise Deep Reinforcement Learning19 Feb 2018 0 repositories listed
-
Estimating scale-invariant future in continuous time18 Feb 2018 0 repositories listed
-
Improving Mild Cognitive Impairment Prediction via Reinforcement Learning and Dialogue Simulation18 Feb 2018 0 repositories listed
-
Sim-to-Real Optimization of Complex Real World Mobile Network with Imperfect Information via Deep Reinforcement Learning from Self-play18 Feb 2018 0 repositories listed
-
Bridging Cognitive Programs and Machine Learning16 Feb 2018 0 repositories listed
-
Modeling the Formation of Social Conventions from Embodied Real-Time Interactions16 Feb 2018 0 repositories listed
-
Reactive Reinforcement Learning in Asynchronous Environments16 Feb 2018 0 repositories listed
-
Prioritized Sweeping Neural DynaQ with Multiple Predecessors, and Hippocampal Replays15 Feb 2018 0 repositories listed
-
Reinforcement Learning from Imperfect Demonstrations14 Feb 2018 0 repositories listed
-
A Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems13 Feb 2018 0 repositories listed
-
Diversity-Driven Exploration Strategy for Deep Reinforcement Learning13 Feb 2018 0 repositories listed
-
Learning Robust and Adaptive Real-World Continuous Control Using Simulation and Transfer Learning13 Feb 2018 0 repositories listed
-
Progressive Reinforcement Learning with Distillation for Multi-Skilled Motion Control13 Feb 2018 0 repositories listed
-
Reinforcement Learning with Wasserstein Distance Regularisation, with Applications to Multipolicy Learning12 Feb 2018 0 repositories listed
-
12 Feb 2018 0 repositories listed
-
Q-learning with Nearest Neighbors12 Feb 2018 0 repositories listed
-
Taking gradients through experiments: LSTMs and memory proximal policy optimization for black-box quantum control12 Feb 2018 0 repositories listed
-
Sample Efficient Deep Reinforcement Learning for Dialogue Systems with Large Action Spaces11 Feb 2018 0 repositories listed
-
Beyond the One Step Greedy Approach in Reinforcement Learning10 Feb 2018 0 repositories listed
-
Path Consistency Learning in Tsallis Entropy Regularized MDPs10 Feb 2018 0 repositories listed
-
A Unified Approach for Multi-step Temporal-Difference Learning with Eligibility Traces in Reinforcement Learning9 Feb 2018 0 repositories listed
-
Balancing Two-Player Stochastic Games with Soft Q-Learning9 Feb 2018 0 repositories listed
-
Learning Robust Options9 Feb 2018 0 repositories listed
-
Improving the Universality and Learnability of Neural Programmer-Interpreters with Combinator Abstraction8 Feb 2018 0 repositories listed
-
Learning and Querying Fast Generative Models for Reinforcement Learning8 Feb 2018 0 repositories listed
-
Precision medicine as a control problem: Using simulation and deep reinforcement learning to discover adaptive, personalized multi-cytokine therapy for sepsis8 Feb 2018 0 repositories listed
-
Deep Reinforcement Learning for Image Hashing7 Feb 2018 0 repositories listed
-
Efficient collective swimming by harnessing vortices through deep reinforcement learning7 Feb 2018 0 repositories listed
-
From Game-theoretic Multi-agent Log Linear Learning to Reinforcement Learning7 Feb 2018 0 repositories listed
-
SCH-GAN: Semi-supervised Cross-modal Hashing by Generative Adversarial Network7 Feb 2018 0 repositories listed
-
Coordinated Exploration in Concurrent Reinforcement Learning5 Feb 2018 0 repositories listed
-
Guided Policy Exploration for Markov Decision Processes using an Uncertainty-Based Value-of-Information Criterion5 Feb 2018 0 repositories listed
-
Learning Parametric Closed-Loop Policies for Markov Potential Games3 Feb 2018 0 repositories listed
-
Multi-task Learning for Continuous Control3 Feb 2018 0 repositories listed
-
Elements of Effective Deep Reinforcement Learning towards Tactical Driving Decision Making1 Feb 2018 0 repositories listed
-
Goal-Oriented Chatbot Dialog Management Bootstrapping with Transfer Learning1 Feb 2018 0 repositories listed
-
Virtual-to-Real: Learning to Control in Visual Semantic Segmentation1 Feb 2018 0 repositories listed
-
VR-Goggles for Robots: Real-to-sim Domain Adaptation for Visual Control1 Feb 2018 0 repositories listed
-
Pretraining Deep Actor-Critic Reinforcement Learning Algorithms With Expert Demonstrations31 Jan 2018 0 repositories listed
-
Barrier-Certified Adaptive Reinforcement Learning with Applications to Brushbot Navigation29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning using Capsules in Advanced Game Environments29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Treatment Regimes on Medical Registry Data28 Jan 2018 0 repositories listed
-
FlashRL: A Reinforcement Learning Platform for Flash Games26 Jan 2018 0 repositories listed
-
Directly Estimating the Variance of the λ-Return Using Temporal-Difference Methods25 Jan 2018 0 repositories listed
-
Analyzing Language Learned by an Active Question Answering Agent23 Jan 2018 0 repositories listed
-
Curiosity-driven reinforcement learning with homeostatic regulation23 Jan 2018 0 repositories listed
-
Simple Hyper-heuristics Control the Neighbourhood Size of Randomised Local Search Optimally for LeadingOnes23 Jan 2018 0 repositories listed
-
Cross-Domain Transfer in Reinforcement Learning using Target Apprentice22 Jan 2018 0 repositories listed
-
A Deep Reinforcement Learning Chatbot (Short Version)20 Jan 2018 0 repositories listed
-
Experience-driven Networking: A Deep Reinforcement Learning based Approach17 Jan 2018 0 repositories listed
-
Reinforcement Learning based Recommender System using Biclustering Technique17 Jan 2018 0 repositories listed
-
The Case for Automatic Database Administration using Deep Reinforcement Learning17 Jan 2018 0 repositories listed
-
The QLBS Q-Learner Goes NuQLear: Fitted Q Iteration, Inverse RL, and Option Portfolios17 Jan 2018 0 repositories listed
-
Cellular-Connected UAVs over 5G: Deep Reinforcement Learning for Interference Management16 Jan 2018 0 repositories listed
-
GitGraph - Architecture Search Space Creation through Frequent Computational Subgraph Mining16 Jan 2018 0 repositories listed
-
Global Convergence of Policy Gradient Methods for the Linear Quadratic Regulator15 Jan 2018 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning for Low-Level Wireless Communication14 Jan 2018 0 repositories listed
-
Deep Reinforcement Fuzzing14 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning of Cell Movement in the Early Stage of C. elegans Embryogenesis14 Jan 2018 0 repositories listed
-
Evaluation of Machine Learning Fameworks on Finis Terrae II14 Jan 2018 0 repositories listed
-
Autonomous Driving in Reality with Reinforcement Learning and Image Translation13 Jan 2018 0 repositories listed
-
Model-Based Action Exploration for Learning Dynamic Motion Skills11 Jan 2018 0 repositories listed
-
Expected Policy Gradients for Reinforcement Learning10 Jan 2018 0 repositories listed
-
Deep In-GPU Experience Replay9 Jan 2018 0 repositories listed
-
Sample-Efficient Reinforcement Learning through Transfer and Architectural Priors7 Jan 2018 0 repositories listed
-
Trading the Twitter Sentiment with Reinforcement Learning7 Jan 2018 0 repositories listed
-
Faster Deep Q-learning using Neural Episodic Control6 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning based Optimal Control of Hot Water Systems4 Jan 2018 0 repositories listed
-
ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks3 Jan 2018 0 repositories listed
-
ViZDoom: DRQN with Prioritized Experience Replay, Double-Q Learning, & Snapshot Ensembling3 Jan 2018 0 repositories listed
-
A dynamic game approach to training robust deep policies1 Jan 2018 0 repositories listed
-
A Hierarchical Model for Device Placement1 Jan 2018 0 repositories listed
-
Action-dependent Control Variates for Policy Optimization via Stein Identity1 Jan 2018 0 repositories listed
-
Adversarial Policy Gradient for Alternating Markov Games1 Jan 2018 0 repositories listed