Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 145
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 145 of 152: papers 14,401 to 14,500 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Pseudorehearsal in actor-critic agents with neural network function approximation20 Dec 2017 0 repositories listed
-
Recurrent Attentional Reinforcement Learning for Multi-label Image Recognition20 Dec 2017 0 repositories listed
-
Revisiting the Master-Slave Architecture in Multi-Agent Deep Reinforcement Learning20 Dec 2017 0 repositories listed
-
On Wasserstein Reinforcement Learning and the Fokker-Planck equation19 Dec 2017 0 repositories listed
-
Two-dimensional Anti-jamming Mobile Communication Based on Reinforcement Learning19 Dec 2017 0 repositories listed
-
ES Is More Than Just a Traditional Finite-Difference Approximator18 Dec 2017 0 repositories listed
-
On the Relationship Between the OpenAI Evolution Strategy and Stochastic Gradient Descent18 Dec 2017 0 repositories listed
-
Integral Equations and Machine Learning17 Dec 2017 0 repositories listed
-
Towards a Deep Reinforcement Learning Approach for Tower Line Wars17 Dec 2017 0 repositories listed
-
Occam's razor is insufficient to infer the preferences of irrational agents15 Dec 2017 0 repositories listed
-
Inverse Reinforcement Learning for Marketing13 Dec 2017 0 repositories listed
-
Multi-focus Attention Network for Efficient Deep Reinforcement Learning13 Dec 2017 0 repositories listed
-
Deep Reinforcement Learning Boosted by External Knowledge12 Dec 2017 0 repositories listed
-
Interpretable Policies for Reinforcement Learning by Genetic Programming12 Dec 2017 0 repositories listed
-
Simulated Autonomous Driving on Realistic Road Networks using Deep Reinforcement Learning12 Dec 2017 0 repositories listed
-
Robust Deep Reinforcement Learning with Adversarial Attacks11 Dec 2017 0 repositories listed
-
The Eigenoption-Critic Framework11 Dec 2017 0 repositories listed
-
Reinforced dynamics for enhanced sampling in large atomic and molecular systems10 Dec 2017 0 repositories listed
-
Deep Primal-Dual Reinforcement Learning: Accelerating Actor-Critic using Bellman Duality7 Dec 2017 0 repositories listed
-
End-to-End Offline Goal-Oriented Dialog Policy Learning via Policy Gradient7 Dec 2017 0 repositories listed
-
Interactive Reinforcement Learning for Object Grounding via Self-Talking2 Dec 2017 0 repositories listed
-
Online Reinforcement Learning in Stochastic Games2 Dec 2017 0 repositories listed
-
Representation and Reinforcement Learning for Personalized Glycemic Control in Septic Patients2 Dec 2017 0 repositories listed
-
Adaptive Batch Size for Safe Policy Gradients1 Dec 2017 0 repositories listed
-
Compatible Reward Inverse Reinforcement Learning1 Dec 2017 0 repositories listed
-
Data-Efficient Reinforcement Learning in Continuous State-Action Gaussian-POMDPs1 Dec 2017 0 repositories listed
-
Dynamic-Depth Context Tree Weighting1 Dec 2017 0 repositories listed
-
Log-normality and Skewness of Estimated State/Action Values in Reinforcement Learning1 Dec 2017 0 repositories listed
-
Natural Value Approximators: Learning when to Trust Past Estimates1 Dec 2017 0 repositories listed
-
Optimistic posterior sampling for reinforcement learning: worst-case regret bounds1 Dec 2017 0 repositories listed
-
Q-LDA: Uncovering Latent Patterns in Text-based Sequential Decision Processes1 Dec 2017 0 repositories listed
-
Comparing Deep Reinforcement Learning and Evolutionary Methods in Continuous Control30 Nov 2017 0 repositories listed
-
Improved Learning in Evolution Strategies via Sparser Inter-Agent Network Topologies30 Nov 2017 0 repositories listed
-
Safe Exploration for Identifying Linear Systems via Robust Optimization30 Nov 2017 0 repositories listed
-
Transferring Autonomous Driving Knowledge on Simulated and Real Intersections30 Nov 2017 0 repositories listed
-
A Benchmarking Environment for Reinforcement Learning Based Task Oriented Dialogue Management29 Nov 2017 0 repositories listed
-
Automating Vehicles by Deep Reinforcement Learning using Task Separation with Hill Climbing29 Nov 2017 0 repositories listed
-
Can Complex Collective Behaviour Be Generated Through Randomness, Memory and a Pinch of Luck?29 Nov 2017 0 repositories listed
-
End-to-End Optimization of Task-Oriented Dialogue Model with Deep Reinforcement Learning29 Nov 2017 0 repositories listed
-
29 Nov 2017 0 repositories listed
-
Reinforcement Learning To Adapt Speech Enhancement to Instantaneous Input Signal Quality29 Nov 2017 0 repositories listed
-
Video Captioning via Hierarchical Reinforcement Learning29 Nov 2017 0 repositories listed
-
A reinforcement learning algorithm for building collaboration in multi-agent systems28 Nov 2017 0 repositories listed
-
Hierarchical Policy Search via Return-Weighted Density Estimation28 Nov 2017 0 repositories listed
-
Learning from Longitudinal Face Demonstration - Where Tractable Deep Modeling Meets Inverse Reinforcement Learning28 Nov 2017 0 repositories listed
-
Malaria Likelihood Prediction By Effectively Surveying Households Using Deep Reinforcement Learning25 Nov 2017 0 repositories listed
-
Cascade Attribute Learning Network24 Nov 2017 0 repositories listed
-
Asking the Difficult Questions: Goal-Oriented Visual Question Generation via Intermediate Rewards21 Nov 2017 0 repositories listed
-
Posterior Sampling for Large Scale Reinforcement Learning21 Nov 2017 0 repositories listed
-
Transferring Agent Behaviors from Videos via Motion GANs21 Nov 2017 0 repositories listed
-
Deep Reinforcement Learning for Multi-Resource Multi-Machine Job Scheduling20 Nov 2017 0 repositories listed
-
Neural Network Based Reinforcement Learning for Audio-Visual Gaze Control in Human-Robot Interaction18 Nov 2017 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems15 Nov 2017 0 repositories listed
-
Costate-focused models for reinforcement learning15 Nov 2017 0 repositories listed
-
Finding Efficient Swimming Strategies in a Three Dimensional Chaotic Flow by Reinforcement Learning15 Nov 2017 0 repositories listed
-
Markov Decision Processes with Continuous Side Information15 Nov 2017 0 repositories listed
-
Variational Adaptive-Newton Method for Explorative Learning15 Nov 2017 0 repositories listed
-
Loss Functions for Multiset Prediction14 Nov 2017 0 repositories listed
-
Reinforcement Learning in a large scale photonic Recurrent Neural Network14 Nov 2017 0 repositories listed
-
Saliency-based Sequential Image Attention with Multiset Prediction14 Nov 2017 0 repositories listed
-
Accelerated Method for Stochastic Composition Optimization with Nonsmooth Regularization10 Nov 2017 0 repositories listed
-
Applications of Deep Learning and Reinforcement Learning to Biological Data10 Nov 2017 0 repositories listed
-
Reinforcement Learning of Speech Recognition System Based on Policy Gradient and Hypothesis Selection10 Nov 2017 0 repositories listed
-
An Empirical Analysis of Multiple-Turn Reasoning Strategies in Reading Comprehension Tasks9 Nov 2017 0 repositories listed
-
Worm-level Control through Search-based Reinforcement Learning9 Nov 2017 0 repositories listed
-
Energy Storage Arbitrage in Real-Time Markets via Reinforcement Learning8 Nov 2017 0 repositories listed
-
Double Q(σ) and Q(σ, λ): Unifying Reinforcement Learning Control Algorithms5 Nov 2017 0 repositories listed
-
Composing Meta-Policies for Autonomous Driving Using Hierarchical Deep Reinforcement Learning4 Nov 2017 0 repositories listed
-
Policy Optimization by Genetic Distillation3 Nov 2017 0 repositories listed
-
Acquiring Target Stacking Skills by Goal-Parameterized Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automatic Text Summarization Using Reinforcement Learning with Embedding Features1 Nov 2017 0 repositories listed
-
Intelligent Parameter Tuning in Optimization-based Iterative CT Reconstruction via Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Learning to Diagnose: Assimilating Clinical Narratives using Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Paraphrase Generation with Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automata-Guided Hierarchical Reinforcement Learning for Skill Composition31 Oct 2017 0 repositories listed
-
Artificial Intelligence as Structural Estimation: Economic Interpretations of Deep Blue, Bonanza, and AlphaGo30 Oct 2017 0 repositories listed
-
Exponential improvements for quantum-accessible reinforcement learning30 Oct 2017 0 repositories listed
-
Sequence-to-Sequence ASR Optimization via Reinforcement Learning30 Oct 2017 0 repositories listed
-
Unifying Value Iteration, Advantage Learning, and Dynamic Policy Programming30 Oct 2017 0 repositories listed
-
Diff-DAC: Distributed Actor-Critic for Average Multitask Deep Reinforcement Learning28 Oct 2017 0 repositories listed
-
Inverse Reinforcement Learning Under Noisy Observations27 Oct 2017 0 repositories listed
-
Accelerated Reinforcement Learning23 Oct 2017 0 repositories listed
-
Exploiting generalization in the subspaces for faster model-based learning22 Oct 2017 0 repositories listed
-
Insulin Regimen ML-based control for T2DM patients21 Oct 2017 0 repositories listed
-
Online Monotone Games19 Oct 2017 0 repositories listed
-
Asymmetric Actor Critic for Image-Based Robot Learning18 Oct 2017 0 repositories listed
-
Map-based Multi-Policy Reinforcement Learning: Enhancing Adaptability of Robots by Deep Reinforcement Learning17 Oct 2017 0 repositories listed
-
Stochastic Variance Reduction for Policy Gradient Estimation17 Oct 2017 0 repositories listed
-
Manifold Regularization for Kernelized LSTD15 Oct 2017 0 repositories listed
-
Is Epicurus the father of Reinforcement Learning?12 Oct 2017 0 repositories listed
-
PRM-RL: Long-range Robotic Navigation Tasks by Combining Reinforcement Learning and Sampling-based Planning11 Oct 2017 0 repositories listed
-
Deep Reinforcement Learning: Framework, Applications, and Embedded Implementations10 Oct 2017 0 repositories listed
-
On- and Off-Policy Monotonic Policy Improvement10 Oct 2017 0 repositories listed
-
Meta Inverse Reinforcement Learning via Maximum Reward Sharing for Human Motion Analysis7 Oct 2017 0 repositories listed
-
Exploration in Feature Space for Reinforcement Learning5 Oct 2017 0 repositories listed
-
Event Identification as a Decision Process with Non-linear Representation of Text3 Oct 2017 0 repositories listed
-
Attention-Aware Deep Reinforcement Learning for Video Face Recognition1 Oct 2017 0 repositories listed
-
Parameter Sharing Deep Deterministic Policy Gradient for Cooperative Multi-agent Reinforcement Learning1 Oct 2017 0 repositories listed
-
Learning how to learn: an adaptive dialogue agent for incrementally learning visually grounded word meanings29 Sep 2017 0 repositories listed
-
A Policy Search Method For Temporal Logic Specified Reinforcement Learning Tasks27 Sep 2017 0 repositories listed