Browse State-of-the-Art › reinforcement-learning › Papers, page 128
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 128 of 135: papers 12,701 to 12,800 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Imitation Learning with Concurrent Actions in 3D Games14 Mar 2018 0 repositories listed
-
Measurement-based adaptation protocol with quantum reinforcement learning14 Mar 2018 0 repositories listed
-
Active Reinforcement Learning with Monte-Carlo Tree Search13 Mar 2018 0 repositories listed
-
Hierarchical Reinforcement Learning: Approximating Optimal Discounted TSP Using Local Policies13 Mar 2018 0 repositories listed
-
Policy Search in Continuous Action Domains: an Overview13 Mar 2018 0 repositories listed
-
Soft-Robust Actor-Critic Policy-Gradient11 Mar 2018 0 repositories listed
-
Kickstarting Deep Reinforcement Learning10 Mar 2018 0 repositories listed
-
A Multi-Objective Deep Reinforcement Learning Framework8 Mar 2018 0 repositories listed
-
DeepCAS: A Deep Reinforcement Learning Algorithm for Control-Aware Scheduling8 Mar 2018 0 repositories listed
-
Feudal Reinforcement Learning for Dialogue Management in Large Domains8 Mar 2018 0 repositories listed
-
SA-IGA: A Multiagent Reinforcement Learning Method Towards Socially Optimal Outcomes8 Mar 2018 0 repositories listed
-
A Brandom-ian view of Reinforcement Learning towards strong-AI7 Mar 2018 0 repositories listed
-
Extracting Action Sequences from Texts Based on Deep Reinforcement Learning7 Mar 2018 0 repositories listed
-
Intent-aware Multi-agent Reinforcement Learning6 Mar 2018 0 repositories listed
-
Personalized Exposure Control Using Adaptive Metering and Reinforcement Learning6 Mar 2018 0 repositories listed
-
Variance-Aware Regret Bounds for Undiscounted Reinforcement Learning in MDPs5 Mar 2018 0 repositories listed
-
Model-Free Control for Distributed Stream Data Processing using Deep Reinforcement Learning2 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Sponsored Search Real-time Bidding1 Mar 2018 0 repositories listed
-
Hierarchical Imitation and Reinforcement Learning1 Mar 2018 0 repositories listed
-
Inverse Reinforcement Learning via Nonparametric Spatio-Temporal Subgoal Modeling1 Mar 2018 0 repositories listed
-
On Oracle-Efficient PAC RL with Rich Observations1 Mar 2018 0 repositories listed
-
Towards Cooperation in Sequential Prisoner's Dilemmas: a Deep Multiagent Reinforcement Learning Approach1 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Join Order Enumeration28 Feb 2018 0 repositories listed
-
Model-Based Value Estimation for Efficient Model-Free Reinforcement Learning28 Feb 2018 0 repositories listed
-
DiGrad: Multi-Task Reinforcement Learning with Shared Actions27 Feb 2018 0 repositories listed
-
Real-Time Bidding with Multi-Agent Reinforcement Learning in Display Advertising27 Feb 2018 0 repositories listed
-
Variance Reduction Methods for Sublinear Reinforcement Learning26 Feb 2018 0 repositories listed
-
Budget Constrained Bidding by Model-free Reinforcement Learning in Display Advertising23 Feb 2018 0 repositories listed
-
Weighted Double Deep Multiagent Reinforcement Learning in Stochastic Cooperative Environments23 Feb 2018 0 repositories listed
-
An Analysis of Categorical Distributional Reinforcement Learning22 Feb 2018 0 repositories listed
-
Diverse Exploration for Fast and Safe Policy Improvement22 Feb 2018 0 repositories listed
-
Variational Inference for Policy Gradient21 Feb 2018 0 repositories listed
-
Continual Reinforcement Learning with Complex Synapses20 Feb 2018 0 repositories listed
-
Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning19 Feb 2018 0 repositories listed
-
Recommendations with Negative Feedback via Pairwise Deep Reinforcement Learning19 Feb 2018 0 repositories listed
-
Estimating scale-invariant future in continuous time18 Feb 2018 0 repositories listed
-
Improving Mild Cognitive Impairment Prediction via Reinforcement Learning and Dialogue Simulation18 Feb 2018 0 repositories listed
-
Bridging Cognitive Programs and Machine Learning16 Feb 2018 0 repositories listed
-
Modeling the Formation of Social Conventions from Embodied Real-Time Interactions16 Feb 2018 0 repositories listed
-
Reactive Reinforcement Learning in Asynchronous Environments16 Feb 2018 0 repositories listed
-
Prioritized Sweeping Neural DynaQ with Multiple Predecessors, and Hippocampal Replays15 Feb 2018 0 repositories listed
-
Reinforcement Learning from Imperfect Demonstrations14 Feb 2018 0 repositories listed
-
A Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems13 Feb 2018 0 repositories listed
-
Diversity-Driven Exploration Strategy for Deep Reinforcement Learning13 Feb 2018 0 repositories listed
-
Progressive Reinforcement Learning with Distillation for Multi-Skilled Motion Control13 Feb 2018 0 repositories listed
-
Reinforcement Learning with Wasserstein Distance Regularisation, with Applications to Multipolicy Learning12 Feb 2018 0 repositories listed
-
Sample Efficient Deep Reinforcement Learning for Dialogue Systems with Large Action Spaces11 Feb 2018 0 repositories listed
-
Beyond the One Step Greedy Approach in Reinforcement Learning10 Feb 2018 0 repositories listed
-
Learning and Querying Fast Generative Models for Reinforcement Learning8 Feb 2018 0 repositories listed
-
Precision medicine as a control problem: Using simulation and deep reinforcement learning to discover adaptive, personalized multi-cytokine therapy for sepsis8 Feb 2018 0 repositories listed
-
Deep Reinforcement Learning for Image Hashing7 Feb 2018 0 repositories listed
-
Efficient collective swimming by harnessing vortices through deep reinforcement learning7 Feb 2018 0 repositories listed
-
From Game-theoretic Multi-agent Log Linear Learning to Reinforcement Learning7 Feb 2018 0 repositories listed
-
Coordinated Exploration in Concurrent Reinforcement Learning5 Feb 2018 0 repositories listed
-
Multi-task Learning for Continuous Control3 Feb 2018 0 repositories listed
-
Elements of Effective Deep Reinforcement Learning towards Tactical Driving Decision Making1 Feb 2018 0 repositories listed
-
Pretraining Deep Actor-Critic Reinforcement Learning Algorithms With Expert Demonstrations31 Jan 2018 0 repositories listed
-
Barrier-Certified Adaptive Reinforcement Learning with Applications to Brushbot Navigation29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning using Capsules in Advanced Game Environments29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Treatment Regimes on Medical Registry Data28 Jan 2018 0 repositories listed
-
FlashRL: A Reinforcement Learning Platform for Flash Games26 Jan 2018 0 repositories listed
-
Directly Estimating the Variance of the λ-Return Using Temporal-Difference Methods25 Jan 2018 0 repositories listed
-
Analyzing Language Learned by an Active Question Answering Agent23 Jan 2018 0 repositories listed
-
Curiosity-driven reinforcement learning with homeostatic regulation23 Jan 2018 0 repositories listed
-
Cross-Domain Transfer in Reinforcement Learning using Target Apprentice22 Jan 2018 0 repositories listed
-
A Deep Reinforcement Learning Chatbot (Short Version)20 Jan 2018 0 repositories listed
-
Experience-driven Networking: A Deep Reinforcement Learning based Approach17 Jan 2018 0 repositories listed
-
Reinforcement Learning based Recommender System using Biclustering Technique17 Jan 2018 0 repositories listed
-
The Case for Automatic Database Administration using Deep Reinforcement Learning17 Jan 2018 0 repositories listed
-
The QLBS Q-Learner Goes NuQLear: Fitted Q Iteration, Inverse RL, and Option Portfolios17 Jan 2018 0 repositories listed
-
Cellular-Connected UAVs over 5G: Deep Reinforcement Learning for Interference Management16 Jan 2018 0 repositories listed
-
GitGraph - Architecture Search Space Creation through Frequent Computational Subgraph Mining16 Jan 2018 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning for Low-Level Wireless Communication14 Jan 2018 0 repositories listed
-
Deep Reinforcement Fuzzing14 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning of Cell Movement in the Early Stage of C. elegans Embryogenesis14 Jan 2018 0 repositories listed
-
Autonomous Driving in Reality with Reinforcement Learning and Image Translation13 Jan 2018 0 repositories listed
-
Expected Policy Gradients for Reinforcement Learning10 Jan 2018 0 repositories listed
-
Sample-Efficient Reinforcement Learning through Transfer and Architectural Priors7 Jan 2018 0 repositories listed
-
Trading the Twitter Sentiment with Reinforcement Learning7 Jan 2018 0 repositories listed
-
Faster Deep Q-learning using Neural Episodic Control6 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning based Optimal Control of Hot Water Systems4 Jan 2018 0 repositories listed
-
A dynamic game approach to training robust deep policies1 Jan 2018 0 repositories listed
-
Action-dependent Control Variates for Policy Optimization via Stein Identity1 Jan 2018 0 repositories listed
-
Alpha-divergence bridges maximum likelihood and reinforcement learning in neural sequence generation1 Jan 2018 0 repositories listed
-
AUTOMATA GUIDED HIERARCHICAL REINFORCEMENT LEARNING FOR ZERO-SHOT SKILL COMPOSITION1 Jan 2018 0 repositories listed
-
Autonomous Vehicle Fleet Coordination With Deep Reinforcement Learning1 Jan 2018 0 repositories listed
-
Avoiding Catastrophic States with Intrinsic Fear1 Jan 2018 0 repositories listed
-
Combination of Supervised and Reinforcement Learning For Vision-Based Autonomous Control1 Jan 2018 0 repositories listed
-
Do Deep Reinforcement Learning Algorithms really Learn to Navigate?1 Jan 2018 0 repositories listed
-
Domain Adaptation for Deep Reinforcement Learning in Visually Distinct Games1 Jan 2018 0 repositories listed
-
Exploring Deep Recurrent Models with Reinforcement Learning for Molecule Design1 Jan 2018 0 repositories listed
-
Faster Reinforcement Learning with Expert State Sequences1 Jan 2018 0 repositories listed
-
Latent forward model for Real-time Strategy game planning with incomplete information1 Jan 2018 0 repositories listed
-
Learning an Embedding Space for Transferable Robot Skills1 Jan 2018 0 repositories listed
-
Learning Dynamic State Abstractions for Model-Based Reinforcement Learning1 Jan 2018 0 repositories listed
-
Learning objects from pixels1 Jan 2018 0 repositories listed
-
Learning Robust Rewards with Adverserial Inverse Reinforcement Learning1 Jan 2018 0 repositories listed
-
Learning to Treat Sepsis with Multi-Output Gaussian Process Deep Recurrent Q-Networks1 Jan 2018 0 repositories listed
-
Long Term Memory Network for Combinatorial Optimization Problems1 Jan 2018 0 repositories listed
-
LSD-Net: Look, Step and Detect for Joint Navigation and Multi-View Recognition with Deep Reinforcement Learning1 Jan 2018 0 repositories listed