Browse State-of-the-Art › reinforcement-learning › Papers, page 118
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 118 of 135: papers 11,701 to 11,800 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Skill Transfer in Deep Reinforcement Learning under Morphological Heterogeneity14 Aug 2019 0 repositories listed
-
Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking13 Aug 2019 0 repositories listed
-
From Crystallized Adaptivity to Fluid Adaptivity in Deep Reinforcement Learning -- Insights from Biological Systems on Adaptive Flexibility13 Aug 2019 0 repositories listed
-
Reward Tampering Problems and Solutions in Reinforcement Learning: A Causal Influence Diagram Perspective13 Aug 2019 0 repositories listed
-
Fast Adaptation with Meta-Reinforcement Learning for Trust Modelling in Human-Robot Interaction12 Aug 2019 0 repositories listed
-
Superstition in the Network: Deep Reinforcement Learning Plays Deceptive Games12 Aug 2019 0 repositories listed
-
A Review of Cooperative Multi-Agent Deep Reinforcement Learning11 Aug 2019 0 repositories listed
-
Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning10 Aug 2019 0 repositories listed
-
Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods8 Aug 2019 0 repositories listed
-
Learning to Grasp from 2.5D images: a Deep Reinforcement Learning Approach8 Aug 2019 0 repositories listed
-
A physics-informed reinforcement learning approach for the interfacial area transport in two-phase flow6 Aug 2019 0 repositories listed
-
Batch Recurrent Q-Learning for Backchannel Generation Towards Engaging Agents6 Aug 2019 0 repositories listed
-
Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning6 Aug 2019 0 repositories listed
-
Reusability and Transferability of Macro Actions for Reinforcement Learning5 Aug 2019 0 repositories listed
-
Speech Driven Backchannel Generation using Deep Q-Network for Enhancing Engagement in Human-Robot Interaction5 Aug 2019 0 repositories listed
-
A View on Deep Reinforcement Learning in System Optimization4 Aug 2019 0 repositories listed
-
Improving Deep Reinforcement Learning in Minecraft with Action Advice2 Aug 2019 0 repositories listed
-
Curiosity-driven Reinforcement Learning for Diverse Visual Paragraph Generation1 Aug 2019 0 repositories listed
-
Learning When to Drive in Intersections by Combining Reinforcement Learning and Model Predictive Control1 Aug 2019 0 repositories listed
-
Reinforcement Learning for Personalized Dialogue Management1 Aug 2019 0 repositories listed
-
Inverse Reinforcement Learning with Multiple Ranked Experts31 Jul 2019 0 repositories listed
-
31 Jul 2019 0 repositories listed
-
Optimal Attacks on Reinforcement Learning Policies31 Jul 2019 0 repositories listed
-
PrecoderNet: Hybrid Beamforming for Millimeter Wave Systems with Deep Reinforcement Learning31 Jul 2019 0 repositories listed
-
DeepPlace: Learning to Place Applications in Multi-Tenant Clusters30 Jul 2019 0 repositories listed
-
Model-Free Unsupervised Learning for Optimization Problems with Constraints30 Jul 2019 0 repositories listed
-
Wasserstein Robust Reinforcement Learning30 Jul 2019 0 repositories listed
-
Goal-Driven Sequential Data Abstraction29 Jul 2019 0 repositories listed
-
Taxable Stock Trading with Deep Reinforcement Learning28 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Personalized Search Story Recommendation26 Jul 2019 0 repositories listed
-
Large scale continuous-time mean-variance portfolio allocation via reinforcement learning26 Jul 2019 0 repositories listed
-
On Hard Exploration for Reinforcement Learning: a Case Study in Pommerman26 Jul 2019 0 repositories listed
-
Action Guidance with MCTS for Deep Reinforcement Learning25 Jul 2019 0 repositories listed
-
Dynamic Input for Deep Reinforcement Learning in Autonomous Driving25 Jul 2019 0 repositories listed
-
Interactive Lungs Auscultation with Reinforcement Learning Agent25 Jul 2019 0 repositories listed
-
AlphaStock: A Buying-Winners-and-Selling-Losers Investment Strategy using Interpretable Deep Reinforcement Attention Networks24 Jul 2019 0 repositories listed
-
Fairness in Reinforcement Learning24 Jul 2019 0 repositories listed
-
Learning Goal-Oriented Visual Dialog Agents: Imitating and Surpassing Analytic Experts24 Jul 2019 0 repositories listed
-
Terminal Prediction as an Auxiliary Task for Deep Reinforcement Learning24 Jul 2019 0 repositories listed
-
Agent Modeling as Auxiliary Task for Deep Reinforcement Learning22 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Autonomous Internet of Things: Model, Applications and Challenges22 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Clinical Decision Support: A Brief Survey22 Jul 2019 0 repositories listed
-
Efficient Policy Learning for Non-Stationary MDPs under Adversarial Manipulation22 Jul 2019 0 repositories listed
-
Surrogate Models for Enhancing the Efficiency of Neuroevolution in Reinforcement Learning22 Jul 2019 0 repositories listed
-
VRLS: A Unified Reinforcement Learning Scheduler for Vehicle-to-Vehicle Communications22 Jul 2019 0 repositories listed
-
Techniques for Automated Machine Learning21 Jul 2019 0 repositories listed
-
An Actor-Critic-Attention Mechanism for Deep Reinforcement Learning in Multi-view Environments19 Jul 2019 0 repositories listed
-
Delegative Reinforcement Learning: learning to avoid traps with a little help19 Jul 2019 0 repositories listed
-
Combinatorial Keyword Recommendations for Sponsored Search with Deep Reinforcement Learning18 Jul 2019 0 repositories listed
-
Dynamical Distance Learning for Semi-Supervised and Unsupervised Skill Discovery18 Jul 2019 0 repositories listed
-
Prioritized Guidance for Efficient Multi-Agent Reinforcement Learning Exploration18 Jul 2019 0 repositories listed
-
Photonic architecture for reinforcement learning17 Jul 2019 0 repositories listed
-
An Inductive Synthesis Framework for Verifiable Reinforcement Learning16 Jul 2019 0 repositories listed
-
Improved Reinforcement Learning through Imitation Learning Pretraining Towards Image-based Autonomous Driving16 Jul 2019 0 repositories listed
-
Model-free Control of Chaos with Continuous Deep Q-learning16 Jul 2019 0 repositories listed
-
A Dual Memory Structure for Efficient Use of Replay Memory in Deep Reinforcement Learning15 Jul 2019 0 repositories listed
-
Federated Reinforcement Distillation with Proxy Experience Memory15 Jul 2019 0 repositories listed
-
Mutual Reinforcement Learning15 Jul 2019 0 repositories listed
-
Ranking sentences from product description & bullets for better search15 Jul 2019 0 repositories listed
-
Environment Reconstruction with Hidden Confounders for Reinforcement Learning based Recommendation12 Jul 2019 0 repositories listed
-
A Model-based Approach for Sample-efficient Multi-task Reinforcement Learning11 Jul 2019 0 repositories listed
-
DisCoRL: Continual Reinforcement Learning via Policy Distillation11 Jul 2019 0 repositories listed
-
Imitation-Projected Programmatic Reinforcement Learning11 Jul 2019 0 repositories listed
-
Deep Reinforcement-Learning-based Driving Policy for Autonomous Road Vehicles10 Jul 2019 0 repositories listed
-
Assessing Transferability from Simulation to Reality for Reinforcement Learning10 Jul 2019 0 repositories listed
-
Interpretable Dynamics Models for Data-Efficient Reinforcement Learning10 Jul 2019 0 repositories listed
-
Reinforcement Learning with Chromatic Networks for Compact Architecture Search10 Jul 2019 0 repositories listed
-
Capturing Financial markets to apply Deep Reinforcement Learning9 Jul 2019 0 repositories listed
-
Dreaming machine learning: Lipschitz extensions for reinforcement learning on financial markets9 Jul 2019 0 repositories listed
-
Data Efficient Reinforcement Learning for Legged Robots8 Jul 2019 0 repositories listed
-
Policy-Gradient Algorithms Have No Guarantees of Convergence in Linear Quadratic Games8 Jul 2019 0 repositories listed
-
ShrinkML: End-to-End ASR Model Compression Using Reinforcement Learning8 Jul 2019 0 repositories listed
-
Variational Inference MPC for Bayesian Model-based Reinforcement Learning8 Jul 2019 0 repositories listed
-
A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning6 Jul 2019 0 repositories listed
-
Intrinsic Motivation Driven Intuitive Physics Learning using Deep Reinforcement Learning with Intrinsic Reward Normalization6 Jul 2019 0 repositories listed
-
Playing Flappy Bird via Asynchronous Advantage Actor Critic Algorithm6 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning For Modeling Chit-Chat Dialog With Discrete Attributes5 Jul 2019 0 repositories listed
-
On Inductive Biases in Deep Reinforcement Learning5 Jul 2019 0 repositories listed
-
Self-supervised Learning of Distance Functions for Goal-Conditioned Reinforcement Learning5 Jul 2019 0 repositories listed
-
Integration of Imitation Learning using GAIL and Reinforcement Learning using Task-achievement Rewards via Probabilistic Graphical Model3 Jul 2019 0 repositories listed
-
On the Weaknesses of Reinforcement Learning for Neural Machine Translation3 Jul 2019 0 repositories listed
-
Perspective Taking in Deep Reinforcement Learning Agents3 Jul 2019 0 repositories listed
-
Safe Approximate Dynamic Programming Via Kernelized Lipschitz Estimation3 Jul 2019 0 repositories listed
-
A Reinforcement Learning Approach for the Multichannel Rendezvous Problem2 Jul 2019 0 repositories listed
-
Dynamic Face Video Segmentation via Reinforcement Learning2 Jul 2019 0 repositories listed
-
Generalizing from a few environments in safety-critical reinforcement learning2 Jul 2019 0 repositories listed
-
Modified Actor-Critics2 Jul 2019 0 repositories listed
-
Playing Go without Game Tree Search Using Convolutional Neural Networks2 Jul 2019 0 repositories listed
-
Voting-Based Multi-Agent Reinforcement Learning for Intelligent IoT2 Jul 2019 0 repositories listed
-
Designing Deep Reinforcement Learning for Human Parameter Exploration1 Jul 2019 0 repositories listed
-
1 Jul 2019 0 repositories listed
-
FiDi-RL: Incorporating Deep Reinforcement Learning with Finite-Difference Policy Search for Efficient Learning of Continuous Control1 Jul 2019 0 repositories listed
-
Historical Text Normalization with Delayed Rewards1 Jul 2019 0 repositories listed
-
Learning World Graphs to Accelerate Hierarchical Reinforcement Learning1 Jul 2019 0 repositories listed
-
Using Semantic Similarity as Reward for Reinforcement Learning in Sentence Generation1 Jul 2019 0 repositories listed
-
Collaboration of AI Agents via Cooperative Multi-Agent Deep Reinforcement Learning30 Jun 2019 0 repositories listed
-
On Training Flexible Robots using Deep Reinforcement Learning29 Jun 2019 0 repositories listed
-
Adaptive Honeypot Engagement through Reinforcement Learning of Semi-Markov Decision Processes27 Jun 2019 0 repositories listed
-
Demonstration-Guided Deep Reinforcement Learning of Control Policies for Dexterous Human-Robot Interaction27 Jun 2019 0 repositories listed
-
From self-tuning regulators to reinforcement learning and back again27 Jun 2019 0 repositories listed