Browse State-of-the-Art › reinforcement-learning › Papers, page 129
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 129 of 135: papers 12,801 to 12,900 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Model-based imitation learning from state trajectories1 Jan 2018 0 repositories listed
-
Neuron as an Agent1 Jan 2018 0 repositories listed
-
Now I Remember! Episodic Memory For Reinforcement Learning1 Jan 2018 0 repositories listed
-
Policy Gradient For Multidimensional Action Spaces: Action Sampling and Entropy Bonus1 Jan 2018 0 repositories listed
-
Predicting Multiple Actions for Stochastic Continuous Control1 Jan 2018 0 repositories listed
-
Reinforcement Learning via Replica Stacking of Quantum Measurements for the Training of Quantum Boltzmann Machines1 Jan 2018 0 repositories listed
-
Representing Entropy : A short proof of the equivalence between soft Q-learning and policy gradients1 Jan 2018 0 repositories listed
-
Reward Estimation via State Prediction1 Jan 2018 0 repositories listed
-
Universal Agent for Disentangling Environments and Tasks1 Jan 2018 0 repositories listed
-
Using Deep Reinforcement Learning to Generate Rationales for Molecules1 Jan 2018 0 repositories listed
-
SBEED: Convergent Reinforcement Learning with Nonlinear Function Approximation29 Dec 2017 0 repositories listed
-
Reinforcement Learning with Analogical Similarity to Guide Schema Induction and Attention28 Dec 2017 0 repositories listed
-
A short variational proof of equivalence between policy gradients and soft Q learning22 Dec 2017 0 repositories listed
-
Multiagent-based Participatory Urban Simulation through Inverse Reinforcement Learning21 Dec 2017 0 repositories listed
-
Hierarchical and Interpretable Skill Acquisition in Multi-task Reinforcement Learning20 Dec 2017 0 repositories listed
-
Pseudorehearsal in actor-critic agents with neural network function approximation20 Dec 2017 0 repositories listed
-
Recurrent Attentional Reinforcement Learning for Multi-label Image Recognition20 Dec 2017 0 repositories listed
-
Revisiting the Master-Slave Architecture in Multi-Agent Deep Reinforcement Learning20 Dec 2017 0 repositories listed
-
On Wasserstein Reinforcement Learning and the Fokker-Planck equation19 Dec 2017 0 repositories listed
-
Two-dimensional Anti-jamming Mobile Communication Based on Reinforcement Learning19 Dec 2017 0 repositories listed
-
ES Is More Than Just a Traditional Finite-Difference Approximator18 Dec 2017 0 repositories listed
-
Integral Equations and Machine Learning17 Dec 2017 0 repositories listed
-
Towards a Deep Reinforcement Learning Approach for Tower Line Wars17 Dec 2017 0 repositories listed
-
Inverse Reinforcement Learning for Marketing13 Dec 2017 0 repositories listed
-
Multi-focus Attention Network for Efficient Deep Reinforcement Learning13 Dec 2017 0 repositories listed
-
Deep Reinforcement Learning Boosted by External Knowledge12 Dec 2017 0 repositories listed
-
Interpretable Policies for Reinforcement Learning by Genetic Programming12 Dec 2017 0 repositories listed
-
Simulated Autonomous Driving on Realistic Road Networks using Deep Reinforcement Learning12 Dec 2017 0 repositories listed
-
Robust Deep Reinforcement Learning with Adversarial Attacks11 Dec 2017 0 repositories listed
-
Reinforced dynamics for enhanced sampling in large atomic and molecular systems10 Dec 2017 0 repositories listed
-
Deep Primal-Dual Reinforcement Learning: Accelerating Actor-Critic using Bellman Duality7 Dec 2017 0 repositories listed
-
Interactive Reinforcement Learning for Object Grounding via Self-Talking2 Dec 2017 0 repositories listed
-
Online Reinforcement Learning in Stochastic Games2 Dec 2017 0 repositories listed
-
Representation and Reinforcement Learning for Personalized Glycemic Control in Septic Patients2 Dec 2017 0 repositories listed
-
Compatible Reward Inverse Reinforcement Learning1 Dec 2017 0 repositories listed
-
Data-Efficient Reinforcement Learning in Continuous State-Action Gaussian-POMDPs1 Dec 2017 0 repositories listed
-
Log-normality and Skewness of Estimated State/Action Values in Reinforcement Learning1 Dec 2017 0 repositories listed
-
Natural Value Approximators: Learning when to Trust Past Estimates1 Dec 2017 0 repositories listed
-
Optimistic posterior sampling for reinforcement learning: worst-case regret bounds1 Dec 2017 0 repositories listed
-
Comparing Deep Reinforcement Learning and Evolutionary Methods in Continuous Control30 Nov 2017 0 repositories listed
-
Improved Learning in Evolution Strategies via Sparser Inter-Agent Network Topologies30 Nov 2017 0 repositories listed
-
Transferring Autonomous Driving Knowledge on Simulated and Real Intersections30 Nov 2017 0 repositories listed
-
A Benchmarking Environment for Reinforcement Learning Based Task Oriented Dialogue Management29 Nov 2017 0 repositories listed
-
Automating Vehicles by Deep Reinforcement Learning using Task Separation with Hill Climbing29 Nov 2017 0 repositories listed
-
Can Complex Collective Behaviour Be Generated Through Randomness, Memory and a Pinch of Luck?29 Nov 2017 0 repositories listed
-
End-to-End Optimization of Task-Oriented Dialogue Model with Deep Reinforcement Learning29 Nov 2017 0 repositories listed
-
29 Nov 2017 0 repositories listed
-
Reinforcement Learning To Adapt Speech Enhancement to Instantaneous Input Signal Quality29 Nov 2017 0 repositories listed
-
Video Captioning via Hierarchical Reinforcement Learning29 Nov 2017 0 repositories listed
-
A reinforcement learning algorithm for building collaboration in multi-agent systems28 Nov 2017 0 repositories listed
-
Learning from Longitudinal Face Demonstration - Where Tractable Deep Modeling Meets Inverse Reinforcement Learning28 Nov 2017 0 repositories listed
-
Malaria Likelihood Prediction By Effectively Surveying Households Using Deep Reinforcement Learning25 Nov 2017 0 repositories listed
-
Posterior Sampling for Large Scale Reinforcement Learning21 Nov 2017 0 repositories listed
-
Transferring Agent Behaviors from Videos via Motion GANs21 Nov 2017 0 repositories listed
-
Deep Reinforcement Learning for Multi-Resource Multi-Machine Job Scheduling20 Nov 2017 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems15 Nov 2017 0 repositories listed
-
Costate-focused models for reinforcement learning15 Nov 2017 0 repositories listed
-
Finding Efficient Swimming Strategies in a Three Dimensional Chaotic Flow by Reinforcement Learning15 Nov 2017 0 repositories listed
-
Variational Adaptive-Newton Method for Explorative Learning15 Nov 2017 0 repositories listed
-
Reinforcement Learning in a large scale photonic Recurrent Neural Network14 Nov 2017 0 repositories listed
-
Saliency-based Sequential Image Attention with Multiset Prediction14 Nov 2017 0 repositories listed
-
Accelerated Method for Stochastic Composition Optimization with Nonsmooth Regularization10 Nov 2017 0 repositories listed
-
Applications of Deep Learning and Reinforcement Learning to Biological Data10 Nov 2017 0 repositories listed
-
Reinforcement Learning of Speech Recognition System Based on Policy Gradient and Hypothesis Selection10 Nov 2017 0 repositories listed
-
Worm-level Control through Search-based Reinforcement Learning9 Nov 2017 0 repositories listed
-
Energy Storage Arbitrage in Real-Time Markets via Reinforcement Learning8 Nov 2017 0 repositories listed
-
Double Q(σ) and Q(σ, λ): Unifying Reinforcement Learning Control Algorithms5 Nov 2017 0 repositories listed
-
Composing Meta-Policies for Autonomous Driving Using Hierarchical Deep Reinforcement Learning4 Nov 2017 0 repositories listed
-
Policy Optimization by Genetic Distillation3 Nov 2017 0 repositories listed
-
Acquiring Target Stacking Skills by Goal-Parameterized Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automatic Text Summarization Using Reinforcement Learning with Embedding Features1 Nov 2017 0 repositories listed
-
Intelligent Parameter Tuning in Optimization-based Iterative CT Reconstruction via Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Learning to Diagnose: Assimilating Clinical Narratives using Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Paraphrase Generation with Deep Reinforcement Learning1 Nov 2017 0 repositories listed
-
Automata-Guided Hierarchical Reinforcement Learning for Skill Composition31 Oct 2017 0 repositories listed
-
Exponential improvements for quantum-accessible reinforcement learning30 Oct 2017 0 repositories listed
-
Sequence-to-Sequence ASR Optimization via Reinforcement Learning30 Oct 2017 0 repositories listed
-
Unifying Value Iteration, Advantage Learning, and Dynamic Policy Programming30 Oct 2017 0 repositories listed
-
Diff-DAC: Distributed Actor-Critic for Average Multitask Deep Reinforcement Learning28 Oct 2017 0 repositories listed
-
Inverse Reinforcement Learning Under Noisy Observations27 Oct 2017 0 repositories listed
-
Accelerated Reinforcement Learning23 Oct 2017 0 repositories listed
-
Map-based Multi-Policy Reinforcement Learning: Enhancing Adaptability of Robots by Deep Reinforcement Learning17 Oct 2017 0 repositories listed
-
Stochastic Variance Reduction for Policy Gradient Estimation17 Oct 2017 0 repositories listed
-
Is Epicurus the father of Reinforcement Learning?12 Oct 2017 0 repositories listed
-
Deep Reinforcement Learning: Framework, Applications, and Embedded Implementations10 Oct 2017 0 repositories listed
-
On- and Off-Policy Monotonic Policy Improvement10 Oct 2017 0 repositories listed
-
Meta Inverse Reinforcement Learning via Maximum Reward Sharing for Human Motion Analysis7 Oct 2017 0 repositories listed
-
Exploration in Feature Space for Reinforcement Learning5 Oct 2017 0 repositories listed
-
Event Identification as a Decision Process with Non-linear Representation of Text3 Oct 2017 0 repositories listed
-
Attention-Aware Deep Reinforcement Learning for Video Face Recognition1 Oct 2017 0 repositories listed
-
Parameter Sharing Deep Deterministic Policy Gradient for Cooperative Multi-agent Reinforcement Learning1 Oct 2017 0 repositories listed
-
A Policy Search Method For Temporal Logic Specified Reinforcement Learning Tasks27 Sep 2017 0 repositories listed
-
A Simple Reinforcement Learning Mechanism for Resource Allocation in LTE-A Networks with Markov Decision Process and Q-Learning27 Sep 2017 0 repositories listed
-
An Optimal Online Method of Selecting Source Policies for Reinforcement Learning24 Sep 2017 0 repositories listed
-
Learning Unmanned Aerial Vehicle Control for Autonomous Target Following24 Sep 2017 0 repositories listed
-
Inverse Reinforcement Learning with Conditional Choice Probabilities22 Sep 2017 0 repositories listed
-
Multiqubit and multilevel quantum reinforcement learning with quantum technologies22 Sep 2017 0 repositories listed
-
On overfitting and asymptotic bias in batch reinforcement learning with partial observability22 Sep 2017 0 repositories listed
-
OptLayer - Practical Constrained Optimization for Deep Reinforcement Learning in the Real World22 Sep 2017 0 repositories listed
-
Feature Engineering for Predictive Modeling using Reinforcement Learning21 Sep 2017 0 repositories listed