Browse State-of-the-Art › Reinforcement Learning › Papers, page 116
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 116 of 132: papers 11,501 to 11,600 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reward-estimation variance elimination in sequential decision processes15 Nov 2018 0 repositories listed
-
The Utility of Sparse Representations for Control in Reinforcement Learning15 Nov 2018 0 repositories listed
-
Tight Bayesian Ambiguity Sets for Robust MDPs15 Nov 2018 0 repositories listed
-
Woulda, Coulda, Shoulda: Counterfactually-Guided Policy Search15 Nov 2018 0 repositories listed
-
Bayesian Reinforcement Learning in Factored POMDPs14 Nov 2018 0 repositories listed
-
Emergence of Addictive Behaviors in Reinforcement Learning Agents14 Nov 2018 0 repositories listed
-
Generating Multiple Diverse Responses for Short-Text Conversation14 Nov 2018 0 repositories listed
-
Large-scale Interactive Recommendation with Tree-structured Policy Gradient14 Nov 2018 0 repositories listed
-
Image Captioning Based on a Hierarchical Attention Mechanism and Policy Gradient Optimization13 Nov 2018 0 repositories listed
-
Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG13 Nov 2018 0 repositories listed
-
Coordinating Disaster Emergency Response with Heuristic Reinforcement Learning12 Nov 2018 0 repositories listed
-
Importance Weighted Evolution Strategies12 Nov 2018 0 repositories listed
-
Learning data augmentation policies using augmented random search12 Nov 2018 0 repositories listed
-
Learning Temporal Point Processes via Reinforcement Learning12 Nov 2018 0 repositories listed
-
Navigating Assistance System for Quadcopter with Deep Reinforcement Learning12 Nov 2018 0 repositories listed
-
An initial attempt of combining visual selective attention with deep reinforcement learning11 Nov 2018 0 repositories listed
-
An Optimal Control View of Adversarial Machine Learning11 Nov 2018 0 repositories listed
-
Optimizing Taxi Carpool Policies via Reinforcement Learning and Spatio-Temporal Mining11 Nov 2018 0 repositories listed
-
Product Title Refinement via Multi-Modal Generative Adversarial Learning11 Nov 2018 0 repositories listed
-
Towards Governing Agent's Efficacy: Action-Conditional β-VAE for Deep Transparent Reinforcement Learning11 Nov 2018 0 repositories listed
-
Learning Shaping Strategies in Human-in-the-loop Interactive Reinforcement Learning10 Nov 2018 0 repositories listed
-
Reinforcement Learning Based Speech Enhancement for Robust Speech Recognition10 Nov 2018 0 repositories listed
-
Sample-Efficient Policy Learning based on Completely Behavior Cloning9 Nov 2018 0 repositories listed
-
Correlation Filter Selection for Visual Tracking Using Reinforcement Learning8 Nov 2018 0 repositories listed
-
Meta-Learning for Multi-objective Reinforcement Learning8 Nov 2018 0 repositories listed
-
Modular Architecture for StarCraft II with Deep Reinforcement Learning8 Nov 2018 0 repositories listed
-
Baselines for Reinforcement Learning in Text Games7 Nov 2018 0 repositories listed
-
Policy Certificates: Towards Accountable Reinforcement Learning7 Nov 2018 0 repositories listed
-
RoboTurk: A Crowdsourcing Platform for Robotic Skill Learning through Imitation7 Nov 2018 0 repositories listed
-
Adaptive Stress Testing: Finding Likely Failure Events with Reinforcement Learning6 Nov 2018 0 repositories listed
-
Deep Reinforcement Learning for Green Security Games with Real-Time Information6 Nov 2018 0 repositories listed
-
Deep Reinforcement Learning via L-BFGS Optimization6 Nov 2018 0 repositories listed
-
Towards continual learning in medical imaging6 Nov 2018 0 repositories listed
-
Combining Subgoal Graphs with Reinforcement Learning to Build a Rational Pathfinder5 Nov 2018 0 repositories listed
-
5 Nov 2018 0 repositories listed
-
Managing engineering systems with large state and action spaces through deep reinforcement learning5 Nov 2018 0 repositories listed
-
Reinforcement Learning based Dynamic Model Selection for Short-Term Load Forecasting5 Nov 2018 0 repositories listed
-
ReLeQ: A Reinforcement Learning Approach for Deep Quantization of Neural Networks5 Nov 2018 0 repositories listed
-
Relation Mention Extraction from Noisy Data with Hierarchical Reinforcement Learning3 Nov 2018 0 repositories listed
-
Automated Theorem Proving in Intuitionistic Propositional Logic by Deep Reinforcement Learning2 Nov 2018 0 repositories listed
-
Dantzig Selector with an Approximately Optimal Denoising Matrix and its Application to Reinforcement Learning2 Nov 2018 0 repositories listed
-
Sequence Generation with Guider Network2 Nov 2018 0 repositories listed
-
Approximate Dynamic Oracle for Dependency Parsing with Reinforcement Learning1 Nov 2018 0 repositories listed
-
Joint Modeling for Query Expansion and Information Extraction with Reinforcement Learning1 Nov 2018 0 repositories listed
-
Macquarie University at BioASQ 6b: Deep learning and deep reinforcement learning for query-based summarisation1 Nov 2018 0 repositories listed
-
Shaping a social robot's humor with Natural Language Generation and socially-aware reinforcement learning1 Nov 2018 0 repositories listed
-
SDRL: Interpretable and Data-efficient Deep Reinforcement Learning Leveraging Symbolic Planning31 Oct 2018 0 repositories listed
-
Structure Learning of Deep Neural Networks with Q-Learning31 Oct 2018 0 repositories listed
-
Towards a Simple Approach to Multi-step Model-based Reinforcement Learning31 Oct 2018 0 repositories listed
-
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning30 Oct 2018 0 repositories listed
-
Social Vehicle Swarms: A Novel Perspective on Social-aware Vehicular Communication Architecture29 Oct 2018 0 repositories listed
-
Distributive Dynamic Spectrum Access through Deep Reinforcement Learning: A Reservoir Computing Based Approach28 Oct 2018 0 repositories listed
-
Learning Abstract Options27 Oct 2018 0 repositories listed
-
Empirical Evaluation of Contextual Policy Search with a Comparison-based Surrogate Model and Active Covariance Matrix Adaptation26 Oct 2018 0 repositories listed
-
Stability-certified reinforcement learning: A control-theoretic perspective26 Oct 2018 0 repositories listed
-
TarMAC: Targeted Multi-Agent Communication26 Oct 2018 0 repositories listed
-
Differential Variable Speed Limits Control for Freeway Recurrent Bottlenecks via Deep Reinforcement learning25 Oct 2018 0 repositories listed
-
Meta-modeling game for deriving theoretical-consistent, micro-structural-based traction-separation laws via deep reinforcement learning24 Oct 2018 0 repositories listed
-
Multi-Agent Reinforcement Learning Based Resource Allocation for UAV Networks24 Oct 2018 0 repositories listed
-
Sample-Efficient Learning of Nonprehensile Manipulation Policies via Physics-Based Informed State Distributions24 Oct 2018 0 repositories listed
-
Hierarchical Approaches for Reinforcement Learning in Parameterized Action Space23 Oct 2018 0 repositories listed
-
Learning First-to-Spike Policies for Neuromorphic Control Using Policy Gradients23 Oct 2018 0 repositories listed
-
Learning Representations in Model-Free Hierarchical Reinforcement Learning23 Oct 2018 0 repositories listed
-
The Faults in Our Pi Stars: Security Issues and Open Challenges in Deep Reinforcement Learning23 Oct 2018 0 repositories listed
-
Multi-Agent Actor-Critic with Generative Cooperative Policy Network22 Oct 2018 0 repositories listed
-
Risk-Sensitive Reinforcement Learning via Policy Gradient Search22 Oct 2018 0 repositories listed
-
Teaching Inverse Reinforcement Learners via Features and Demonstrations21 Oct 2018 0 repositories listed
-
Autonomous Self-Explanation of Behavior for Interactive Reinforcement Learning Agents20 Oct 2018 0 repositories listed
-
Safe Reinforcement Learning with Model Uncertainty Estimates19 Oct 2018 0 repositories listed
-
Transfer Learning versus Multi-agent Learning regarding Distributed Decision-Making in Highway Traffic19 Oct 2018 0 repositories listed
-
Applications of Deep Reinforcement Learning in Communications and Networking: A Survey18 Oct 2018 0 repositories listed
-
Policy Gradient in Partially Observable Environments: Approximation and Convergence18 Oct 2018 0 repositories listed
-
O2A: One-shot Observational learning with Action vectors17 Oct 2018 0 repositories listed
-
At Human Speed: Deep Reinforcement Learning with Action Delay16 Oct 2018 0 repositories listed
-
Incremental learning abstract discrete planning domains and mappings to continuous perceptions16 Oct 2018 0 repositories listed
-
The Concept of Criticality in Reinforcement Learning16 Oct 2018 0 repositories listed
-
Optimizing Agent Behavior over Long Time Scales by Transporting Value15 Oct 2018 0 repositories listed
-
Using Deep Reinforcement Learning for the Continuous Control of Robotic Arms15 Oct 2018 0 repositories listed
-
Dexterous Manipulation with Deep Reinforcement Learning: Efficient, General, and Low-Cost14 Oct 2018 0 repositories listed
-
Two Can Play That Game: An Adversarial Evaluation of a Cyber-alert Inspection System13 Oct 2018 0 repositories listed
-
Bayesian Inference of Self-intention Attributed by Observer12 Oct 2018 0 repositories listed
-
A Survey and Critique of Multiagent Deep Reinforcement Learning12 Oct 2018 0 repositories listed
-
Optimal Hierarchical Learning Path Design with Reinforcement Learning12 Oct 2018 0 repositories listed
-
Sequential Learning of Movement Prediction in Dynamic Environments using LSTM Autoencoder12 Oct 2018 0 repositories listed
-
Adversarial Text Generation Without Reinforcement Learning11 Oct 2018 0 repositories listed
-
Policy Design for Active Sequential Hypothesis Testing using Deep Learning11 Oct 2018 0 repositories listed
-
The Laplacian in RL: Learning Representations with Efficient Approximations10 Oct 2018 0 repositories listed
-
A Distributed Reinforcement Learning Solution With Knowledge Transfer Capability for A Bike Rebalancing Problem9 Oct 2018 0 repositories listed
-
Continual State Representation Learning for Reinforcement Learning using Generative Replay9 Oct 2018 0 repositories listed
-
Distributed Wildfire Surveillance with Autonomous Aircraft using Deep Reinforcement Learning9 Oct 2018 0 repositories listed
-
Enabling Cognitive Smart Cities Using Big Data and Machine Learning: Approaches and Challenges9 Oct 2018 0 repositories listed
-
Investigating Enactive Learning for Autonomous Intelligent Agents9 Oct 2018 0 repositories listed
-
Realizing Learned Quadruped Locomotion Behaviors through Kinematic Motion Primitives9 Oct 2018 0 repositories listed
-
Actor-Critic Deep Reinforcement Learning for Dynamic Multichannel Access8 Oct 2018 0 repositories listed
-
Multi-agent Deep Reinforcement Learning for Zero Energy Communities8 Oct 2018 0 repositories listed
-
Reinforcement Evolutionary Learning Method for self-learning7 Oct 2018 0 repositories listed
-
Learning To Simulate5 Oct 2018 0 repositories listed
-
Zooming Network4 Oct 2018 0 repositories listed
-
Deep Reinforcement Learning for Time Scheduling in RF-Powered Backscatter Cognitive Radio Networks3 Oct 2018 0 repositories listed
-
A Teacher-Student Framework for Maintainable Dialog Manager1 Oct 2018 0 repositories listed