Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 144
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 144 of 152: papers 14,301 to 14,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Real-Time Bidding with Multi-Agent Reinforcement Learning in Display Advertising27 Feb 2018 0 repositories listed
-
Variance Reduction Methods for Sublinear Reinforcement Learning26 Feb 2018 0 repositories listed
-
Temporal Difference Models: Model-Free Deep RL for Model-Based Control25 Feb 2018 0 repositories listed
-
Budget Constrained Bidding by Model-free Reinforcement Learning in Display Advertising23 Feb 2018 0 repositories listed
-
Weighted Double Deep Multiagent Reinforcement Learning in Stochastic Cooperative Environments23 Feb 2018 0 repositories listed
-
An Analysis of Categorical Distributional Reinforcement Learning22 Feb 2018 0 repositories listed
-
Diverse Exploration for Fast and Safe Policy Improvement22 Feb 2018 0 repositories listed
-
Variational Inference for Policy Gradient21 Feb 2018 0 repositories listed
-
Continual Reinforcement Learning with Complex Synapses20 Feb 2018 0 repositories listed
-
Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning19 Feb 2018 0 repositories listed
-
Fourier Policy Gradients19 Feb 2018 0 repositories listed
-
Recommendations with Negative Feedback via Pairwise Deep Reinforcement Learning19 Feb 2018 0 repositories listed
-
Estimating scale-invariant future in continuous time18 Feb 2018 0 repositories listed
-
Improving Mild Cognitive Impairment Prediction via Reinforcement Learning and Dialogue Simulation18 Feb 2018 0 repositories listed
-
Bridging Cognitive Programs and Machine Learning16 Feb 2018 0 repositories listed
-
Modeling the Formation of Social Conventions from Embodied Real-Time Interactions16 Feb 2018 0 repositories listed
-
Reactive Reinforcement Learning in Asynchronous Environments16 Feb 2018 0 repositories listed
-
Prioritized Sweeping Neural DynaQ with Multiple Predecessors, and Hippocampal Replays15 Feb 2018 0 repositories listed
-
Reinforcement Learning from Imperfect Demonstrations14 Feb 2018 0 repositories listed
-
A Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems13 Feb 2018 0 repositories listed
-
Diversity-Driven Exploration Strategy for Deep Reinforcement Learning13 Feb 2018 0 repositories listed
-
Progressive Reinforcement Learning with Distillation for Multi-Skilled Motion Control13 Feb 2018 0 repositories listed
-
Reinforcement Learning with Wasserstein Distance Regularisation, with Applications to Multipolicy Learning12 Feb 2018 0 repositories listed
-
12 Feb 2018 0 repositories listed
-
Sample Efficient Deep Reinforcement Learning for Dialogue Systems with Large Action Spaces11 Feb 2018 0 repositories listed
-
Beyond the One Step Greedy Approach in Reinforcement Learning10 Feb 2018 0 repositories listed
-
Balancing Two-Player Stochastic Games with Soft Q-Learning9 Feb 2018 0 repositories listed
-
Learning and Querying Fast Generative Models for Reinforcement Learning8 Feb 2018 0 repositories listed
-
Precision medicine as a control problem: Using simulation and deep reinforcement learning to discover adaptive, personalized multi-cytokine therapy for sepsis8 Feb 2018 0 repositories listed
-
Deep Reinforcement Learning for Image Hashing7 Feb 2018 0 repositories listed
-
Efficient collective swimming by harnessing vortices through deep reinforcement learning7 Feb 2018 0 repositories listed
-
From Game-theoretic Multi-agent Log Linear Learning to Reinforcement Learning7 Feb 2018 0 repositories listed
-
Coordinated Exploration in Concurrent Reinforcement Learning5 Feb 2018 0 repositories listed
-
Multi-task Learning for Continuous Control3 Feb 2018 0 repositories listed
-
Elements of Effective Deep Reinforcement Learning towards Tactical Driving Decision Making1 Feb 2018 0 repositories listed
-
Pretraining Deep Actor-Critic Reinforcement Learning Algorithms With Expert Demonstrations31 Jan 2018 0 repositories listed
-
Barrier-Certified Adaptive Reinforcement Learning with Applications to Brushbot Navigation29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning using Capsules in Advanced Game Environments29 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Treatment Regimes on Medical Registry Data28 Jan 2018 0 repositories listed
-
FlashRL: A Reinforcement Learning Platform for Flash Games26 Jan 2018 0 repositories listed
-
Directly Estimating the Variance of the λ-Return Using Temporal-Difference Methods25 Jan 2018 0 repositories listed
-
Analyzing Language Learned by an Active Question Answering Agent23 Jan 2018 0 repositories listed
-
Curiosity-driven reinforcement learning with homeostatic regulation23 Jan 2018 0 repositories listed
-
Cross-Domain Transfer in Reinforcement Learning using Target Apprentice22 Jan 2018 0 repositories listed
-
A Deep Reinforcement Learning Chatbot (Short Version)20 Jan 2018 0 repositories listed
-
Experience-driven Networking: A Deep Reinforcement Learning based Approach17 Jan 2018 0 repositories listed
-
Reinforcement Learning based Recommender System using Biclustering Technique17 Jan 2018 0 repositories listed
-
The Case for Automatic Database Administration using Deep Reinforcement Learning17 Jan 2018 0 repositories listed
-
The QLBS Q-Learner Goes NuQLear: Fitted Q Iteration, Inverse RL, and Option Portfolios17 Jan 2018 0 repositories listed
-
Cellular-Connected UAVs over 5G: Deep Reinforcement Learning for Interference Management16 Jan 2018 0 repositories listed
-
GitGraph - Architecture Search Space Creation through Frequent Computational Subgraph Mining16 Jan 2018 0 repositories listed
-
Cooperative Multi-Agent Reinforcement Learning for Low-Level Wireless Communication14 Jan 2018 0 repositories listed
-
Deep Reinforcement Fuzzing14 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning of Cell Movement in the Early Stage of C. elegans Embryogenesis14 Jan 2018 0 repositories listed
-
Autonomous Driving in Reality with Reinforcement Learning and Image Translation13 Jan 2018 0 repositories listed
-
Expected Policy Gradients for Reinforcement Learning10 Jan 2018 0 repositories listed
-
Sample-Efficient Reinforcement Learning through Transfer and Architectural Priors7 Jan 2018 0 repositories listed
-
Trading the Twitter Sentiment with Reinforcement Learning7 Jan 2018 0 repositories listed
-
Faster Deep Q-learning using Neural Episodic Control6 Jan 2018 0 repositories listed
-
Deep Reinforcement Learning based Optimal Control of Hot Water Systems4 Jan 2018 0 repositories listed
-
A dynamic game approach to training robust deep policies1 Jan 2018 0 repositories listed
-
A Hierarchical Model for Device Placement1 Jan 2018 0 repositories listed
-
Action-dependent Control Variates for Policy Optimization via Stein Identity1 Jan 2018 0 repositories listed
-
Alpha-divergence bridges maximum likelihood and reinforcement learning in neural sequence generation1 Jan 2018 0 repositories listed
-
AUTOMATA GUIDED HIERARCHICAL REINFORCEMENT LEARNING FOR ZERO-SHOT SKILL COMPOSITION1 Jan 2018 0 repositories listed
-
Autonomous Vehicle Fleet Coordination With Deep Reinforcement Learning1 Jan 2018 0 repositories listed
-
Avoiding Catastrophic States with Intrinsic Fear1 Jan 2018 0 repositories listed
-
Combination of Supervised and Reinforcement Learning For Vision-Based Autonomous Control1 Jan 2018 0 repositories listed
-
Do Deep Reinforcement Learning Algorithms really Learn to Navigate?1 Jan 2018 0 repositories listed
-
Domain Adaptation for Deep Reinforcement Learning in Visually Distinct Games1 Jan 2018 0 repositories listed
-
Exploring Deep Recurrent Models with Reinforcement Learning for Molecule Design1 Jan 2018 0 repositories listed
-
Faster Reinforcement Learning with Expert State Sequences1 Jan 2018 0 repositories listed
-
Latent forward model for Real-time Strategy game planning with incomplete information1 Jan 2018 0 repositories listed
-
LatentPoison -- Adversarial Attacks On The Latent Space1 Jan 2018 0 repositories listed
-
Learning an Embedding Space for Transferable Robot Skills1 Jan 2018 0 repositories listed
-
Learning Dynamic State Abstractions for Model-Based Reinforcement Learning1 Jan 2018 0 repositories listed
-
Learning Gaussian Policies from Smoothed Action Value Functions1 Jan 2018 0 repositories listed
-
Learning objects from pixels1 Jan 2018 0 repositories listed
-
Learning Robust Rewards with Adverserial Inverse Reinforcement Learning1 Jan 2018 0 repositories listed
-
Learning to Treat Sepsis with Multi-Output Gaussian Process Deep Recurrent Q-Networks1 Jan 2018 0 repositories listed
-
Long Term Memory Network for Combinatorial Optimization Problems1 Jan 2018 0 repositories listed
-
LSD-Net: Look, Step and Detect for Joint Navigation and Multi-View Recognition with Deep Reinforcement Learning1 Jan 2018 0 repositories listed
-
Model-based imitation learning from state trajectories1 Jan 2018 0 repositories listed
-
Neural Task Graph Execution1 Jan 2018 0 repositories listed
-
Neuron as an Agent1 Jan 2018 0 repositories listed
-
Now I Remember! Episodic Memory For Reinforcement Learning1 Jan 2018 0 repositories listed
-
Policy Gradient For Multidimensional Action Spaces: Action Sampling and Entropy Bonus1 Jan 2018 0 repositories listed
-
Predicting Multiple Actions for Stochastic Continuous Control1 Jan 2018 0 repositories listed
-
Reinforcement Learning via Replica Stacking of Quantum Measurements for the Training of Quantum Boltzmann Machines1 Jan 2018 0 repositories listed
-
Representing Entropy : A short proof of the equivalence between soft Q-learning and policy gradients1 Jan 2018 0 repositories listed
-
Reward Estimation via State Prediction1 Jan 2018 0 repositories listed
-
Universal Agent for Disentangling Environments and Tasks1 Jan 2018 0 repositories listed
-
Using Deep Reinforcement Learning to Generate Rationales for Molecules1 Jan 2018 0 repositories listed
-
SBEED: Convergent Reinforcement Learning with Nonlinear Function Approximation29 Dec 2017 0 repositories listed
-
Reinforcement Learning with Analogical Similarity to Guide Schema Induction and Attention28 Dec 2017 0 repositories listed
-
Consensus-based Sequence Training for Video Captioning27 Dec 2017 0 repositories listed
-
A short variational proof of equivalence between policy gradients and soft Q learning22 Dec 2017 0 repositories listed
-
Least-Squares Temporal Difference Learning for the Linear Quadratic Regulator22 Dec 2017 0 repositories listed
-
Multiagent-based Participatory Urban Simulation through Inverse Reinforcement Learning21 Dec 2017 0 repositories listed
-
Hierarchical and Interpretable Skill Acquisition in Multi-task Reinforcement Learning20 Dec 2017 0 repositories listed