Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 143
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 143 of 152: papers 14,201 to 14,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Interactive Reinforcement Learning with Dynamic Reuse of Prior Knowledge from Human/Agent's Demonstration11 May 2018 0 repositories listed
-
Leveraging Grammar and Reinforcement Learning for Neural Program Synthesis11 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Optimal Control of Space Heating10 May 2018 0 repositories listed
-
Discourse-Aware Neural Rewards for Coherent Text Generation10 May 2018 0 repositories listed
-
Metatrace Actor-Critic: Online Step-size Tuning by Meta-gradient Descent for Reinforcement Learning Control10 May 2018 0 repositories listed
-
Multimodal Hierarchical Reinforcement Learning Policy for Task-Oriented Visual Dialog8 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Page-wise Recommendations7 May 2018 0 repositories listed
-
Multimodal Machine Translation with Reinforcement Learning7 May 2018 0 repositories listed
-
Planning and Learning with Stochastic Action Sets7 May 2018 0 repositories listed
-
Developing parsimonious ensembles using ensemble diversity within a reinforcement learning framework5 May 2018 0 repositories listed
-
Exploration by Distributional Reinforcement Learning4 May 2018 0 repositories listed
-
Robust Deep Reinforcement Learning for Security and Safety in Autonomous Vehicle Systems2 May 2018 0 repositories listed
-
Falsification of Cyber-Physical Systems Using Deep Reinforcement Learning1 May 2018 0 repositories listed
-
Robust Log-Optimal Strategy with Reinforcement Learning1 May 2018 0 repositories listed
-
Generating Interpretable Fuzzy Controllers using Particle Swarm Optimization and Genetic Programming29 Apr 2018 0 repositories listed
-
Towards Experienced Anomaly Detector through Reinforcement Learning29 Apr 2018 0 repositories listed
-
Sentiment Adaptive End-to-End Dialog Systems28 Apr 2018 0 repositories listed
-
Deep Reinforcement Learning to Acquire Navigation Skills for Wheel-Legged Robots in Complex Environments27 Apr 2018 0 repositories listed
-
Action Categorization for Computationally Improved Task Learning and Planning26 Apr 2018 0 repositories listed
-
Multiagent Soft Q-Learning25 Apr 2018 0 repositories listed
-
Benchmarking projective simulation in navigation problems23 Apr 2018 0 repositories listed
-
MQGrad: Reinforcement Learning of Gradient Quantization in Parameter Server22 Apr 2018 0 repositories listed
-
Event Extraction with Generative Adversarial Imitation Learning21 Apr 2018 0 repositories listed
-
PEORL: Integrating Symbolic Planning and Hierarchical Reinforcement Learning for Robust Decision-Making20 Apr 2018 0 repositories listed
-
Cell Selection with Deep Reinforcement Learning in Sparse Mobile Crowdsensing19 Apr 2018 0 repositories listed
-
Disentangling Controllable and Uncontrollable Factors of Variation by Interacting with the World19 Apr 2018 0 repositories listed
-
19 Apr 2018 0 repositories listed
-
Automated vehicle's behavior decision making using deep reinforcement learning and high-fidelity simulation environment17 Apr 2018 0 repositories listed
-
Model-Free Linear Quadratic Control via Reduction to Expert Prediction17 Apr 2018 0 repositories listed
-
On Improving Deep Reinforcement Learning for POMDPs17 Apr 2018 0 repositories listed
-
Learning How to Self-Learn: Enhancing Self-Training Using Neural Reinforcement Learning16 Apr 2018 0 repositories listed
-
State-Augmentation Transformations for Risk-Sensitive Reinforcement Learning16 Apr 2018 0 repositories listed
-
Robust Dual View Deep Agent13 Apr 2018 0 repositories listed
-
Distort-and-Recover: Color Enhancement using Deep Reinforcement Learning12 Apr 2018 0 repositories listed
-
Feature-Based Aggregation and Deep Reinforcement Learning: A Survey and Some New Implementations12 Apr 2018 0 repositories listed
-
Optimizing Query Evaluations using Reinforcement Learning for Web Search12 Apr 2018 0 repositories listed
-
Universal Successor Representations for Transfer Reinforcement Learning11 Apr 2018 0 repositories listed
-
Binary Space Partitioning as Intrinsic Reward10 Apr 2018 0 repositories listed
-
Outline Objects using Deep Reinforcement Learning10 Apr 2018 0 repositories listed
-
A clustering-based reinforcement learning approach for tailored personalization of e-Health interventions10 Apr 2018 0 repositories listed
-
Latent Space Policies for Hierarchical Reinforcement Learning9 Apr 2018 0 repositories listed
-
Hierarchical Modular Reinforcement Learning Method and Knowledge Acquisition of State-Action Rule for Multi-target Problem8 Apr 2018 0 repositories listed
-
Scalable Sentiment for Sequence-to-sequence Chatbot Response with Performance Analysis7 Apr 2018 0 repositories listed
-
Programmatically Interpretable Reinforcement Learning6 Apr 2018 0 repositories listed
-
A Human Mixed Strategy Approach to Deep Reinforcement Learning5 Apr 2018 0 repositories listed
-
Information Maximizing Exploration with a Latent Dynamics Model4 Apr 2018 0 repositories listed
-
EmoRL: Continuous Acoustic Emotion Classification using Deep Reinforcement Learning3 Apr 2018 0 repositories listed
-
Renewal Monte Carlo: Renewal theory based reinforcement learning3 Apr 2018 0 repositories listed
-
Curiosity-driven Exploration for Mapless Navigation with Deep Reinforcement Learning2 Apr 2018 0 repositories listed
-
Recall Traces: Backtracking Models for Efficient Reinforcement Learning2 Apr 2018 0 repositories listed
-
Learning to Run challenge: Synthesizing physiologically accurate motion using deep reinforcement learning31 Mar 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas31 Mar 2018 0 repositories listed
-
How an Electrical Engineer Became an Artificial Intelligence Researcher, a Multiphase Active Contours Analysis29 Mar 2018 0 repositories listed
-
Reinforcement learning for non-prehensile manipulation: Transfer from simulation to physical system28 Mar 2018 0 repositories listed
-
27 Mar 2018 0 repositories listed
-
Forward-Backward Reinforcement Learning27 Mar 2018 0 repositories listed
-
Reinforcement Learning for Fair Dynamic Pricing27 Mar 2018 0 repositories listed
-
Scalable photonic reinforcement learning by time-division multiplexing of laser chaos26 Mar 2018 0 repositories listed
-
Autonomous Ramp Merge Maneuver Based on Reinforcement Learning with Continuous Action Space25 Mar 2018 0 repositories listed
-
The Importance of Constraint Smoothness for Parameter Estimation in Computational Cognitive Modeling24 Mar 2018 0 repositories listed
-
Accelerating Learning in Constructive Predictive Frameworks with the Successor Representation23 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning with Model Learning and Monte Carlo Tree Search in Minecraft22 Mar 2018 0 repositories listed
-
DOP: Deep Optimistic Planning with Approximate Value Function Evaluation22 Mar 2018 0 repositories listed
-
Learning State Representations for Query Optimization with Deep Reinforcement Learning22 Mar 2018 0 repositories listed
-
Learning Robotic Assembly from CAD20 Mar 2018 0 repositories listed
-
Meta Reinforcement Learning with Latent Variable Gaussian Processes20 Mar 2018 0 repositories listed
-
Natural Gradient Deep Q-learning20 Mar 2018 0 repositories listed
-
Optimizing Sponsored Search Ranking Strategy by Deep Reinforcement Learning20 Mar 2018 0 repositories listed
-
Variance Reduction for Policy Gradient with Action-Dependent Factorized Baselines20 Mar 2018 0 repositories listed
-
Neural Text Generation: Past, Present and Beyond15 Mar 2018 0 repositories listed
-
Rearrangement with Nonprehensile Manipulation Using Deep Reinforcement Learning15 Mar 2018 0 repositories listed
-
Automated Speed and Lane Change Decision Making using Deep Reinforcement Learning14 Mar 2018 0 repositories listed
-
Imitation Learning with Concurrent Actions in 3D Games14 Mar 2018 0 repositories listed
-
Measurement-based adaptation protocol with quantum reinforcement learning14 Mar 2018 0 repositories listed
-
Active Reinforcement Learning with Monte-Carlo Tree Search13 Mar 2018 0 repositories listed
-
Hierarchical Reinforcement Learning: Approximating Optimal Discounted TSP Using Local Policies13 Mar 2018 0 repositories listed
-
Learning to Explore with Meta-Policy Gradient13 Mar 2018 0 repositories listed
-
Policy Search in Continuous Action Domains: an Overview13 Mar 2018 0 repositories listed
-
Soft-Robust Actor-Critic Policy-Gradient11 Mar 2018 0 repositories listed
-
Kickstarting Deep Reinforcement Learning10 Mar 2018 0 repositories listed
-
A Multi-Objective Deep Reinforcement Learning Framework8 Mar 2018 0 repositories listed
-
DeepCAS: A Deep Reinforcement Learning Algorithm for Control-Aware Scheduling8 Mar 2018 0 repositories listed
-
Feudal Reinforcement Learning for Dialogue Management in Large Domains8 Mar 2018 0 repositories listed
-
SA-IGA: A Multiagent Reinforcement Learning Method Towards Socially Optimal Outcomes8 Mar 2018 0 repositories listed
-
A Brandom-ian view of Reinforcement Learning towards strong-AI7 Mar 2018 0 repositories listed
-
Extracting Action Sequences from Texts Based on Deep Reinforcement Learning7 Mar 2018 0 repositories listed
-
Intent-aware Multi-agent Reinforcement Learning6 Mar 2018 0 repositories listed
-
Personalized Exposure Control Using Adaptive Metering and Reinforcement Learning6 Mar 2018 0 repositories listed
-
Smoothed Action Value Functions for Learning Gaussian Policies6 Mar 2018 0 repositories listed
-
Variance-Aware Regret Bounds for Undiscounted Reinforcement Learning in MDPs5 Mar 2018 0 repositories listed
-
OIL: Observational Imitation Learning3 Mar 2018 0 repositories listed
-
Model-Free Control for Distributed Stream Data Processing using Deep Reinforcement Learning2 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Sponsored Search Real-time Bidding1 Mar 2018 0 repositories listed
-
Hierarchical Imitation and Reinforcement Learning1 Mar 2018 0 repositories listed
-
Inverse Reinforcement Learning via Nonparametric Spatio-Temporal Subgoal Modeling1 Mar 2018 0 repositories listed
-
On Oracle-Efficient PAC RL with Rich Observations1 Mar 2018 0 repositories listed
-
Towards Cooperation in Sequential Prisoner's Dilemmas: a Deep Multiagent Reinforcement Learning Approach1 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning for Join Order Enumeration28 Feb 2018 0 repositories listed
-
Model-Based Value Estimation for Efficient Model-Free Reinforcement Learning28 Feb 2018 0 repositories listed
-
DiGrad: Multi-Task Reinforcement Learning with Shared Actions27 Feb 2018 0 repositories listed