Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 142
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 142 of 152: papers 14,101 to 14,200 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reinforcement Learning using Augmented Neural Networks20 Jun 2018 0 repositories listed
-
Skilled Experience Catalogue: A Skill-Balancing Mechanism for Non-Player Characters using Reinforcement Learning20 Jun 2018 0 repositories listed
-
A Survey of Inverse Reinforcement Learning: Challenges, Methods and Progress18 Jun 2018 0 repositories listed
-
A unified strategy for implementing curiosity and empowerment driven reinforcement learning18 Jun 2018 0 repositories listed
-
Learning from Outside the Viability Kernel: Why we Should Build Robots that can Fall with Grace18 Jun 2018 0 repositories listed
-
Learning Policy Representations in Multiagent Systems17 Jun 2018 0 repositories listed
-
Handling Cold-Start Collaborative Filtering with Reinforcement Learning16 Jun 2018 0 repositories listed
-
An Online Prediction Algorithm for Reinforcement Learning with Linear Function Approximation using Cross Entropy Method15 Jun 2018 0 repositories listed
-
Improving width-based planning with compact policies15 Jun 2018 0 repositories listed
-
Multi-Level Policy and Reward Reinforcement Learning for Image Captioning15 Jun 2018 0 repositories listed
-
Adaptive Shooting for Bots in First Person Shooter Games Using Reinforcement Learning14 Jun 2018 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Urban Transportation Problems14 Jun 2018 0 repositories listed
-
Qualitative Measurements of Policy Discrepancy for Return-Based Deep Q-Network14 Jun 2018 0 repositories listed
-
Learning to Shoot in First Person Shooter Games by Stabilizing Actions and Clustering Rewards for Reinforcement Learning13 Jun 2018 0 repositories listed
-
Reinforcement Learning with Function-Valued Action Spaces for Partial Differential Equation Control13 Jun 2018 0 repositories listed
-
Meta-Learning Transferable Active Learning Policies by Deep Reinforcement Learning12 Jun 2018 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning with Human Strategies12 Jun 2018 0 repositories listed
-
Unsupervised Meta-Learning for Reinforcement Learning12 Jun 2018 0 repositories listed
-
An Efficient, Generalized Bellman Update For Cooperative Inverse Reinforcement Learning11 Jun 2018 0 repositories listed
-
Deep Curiosity Loops in Social Environments10 Jun 2018 0 repositories listed
-
Implicit Policy for Reinforcement Learning10 Jun 2018 0 repositories listed
-
Automatic View Planning with Multi-scale Deep Reinforcement Learning Agents8 Jun 2018 0 repositories listed
-
Continuous-time Value Function Approximation in Reproducing Kernel Hilbert Spaces8 Jun 2018 0 repositories listed
-
Program Synthesis Through Reinforcement Learning Guided Tree Search8 Jun 2018 0 repositories listed
-
Self-Consistent Trajectory Autoencoder: Hierarchical Reinforcement Learning with Trajectory Embeddings7 Jun 2018 0 repositories listed
-
Discovering and Removing Exogenous State Variables and Rewards for Reinforcement Learning5 Jun 2018 0 repositories listed
-
Mix&Match - Agent Curricula for Reinforcement Learning5 Jun 2018 0 repositories listed
-
Adversarial Reinforcement Learning Framework for Benchmarking Collision Avoidance Mechanisms in Autonomous Vehicles4 Jun 2018 0 repositories listed
-
Mitigation of Policy Manipulation Attacks on Deep Q-Networks with Parameter-Space Noise4 Jun 2018 0 repositories listed
-
Sequential Test for the Lowest Mean: From Thompson to Murphy Sampling4 Jun 2018 0 repositories listed
-
Exploration in Structured Reinforcement Learning3 Jun 2018 0 repositories listed
-
Multi-Agent Reinforcement Learning via Double Averaging Primal-Dual Optimization3 Jun 2018 0 repositories listed
-
DAQN: Deep Auto-encoder and Q-Network2 Jun 2018 0 repositories listed
-
Deep Pepper: Expert Iteration based Chess agent in the Reinforcement Learning Setting2 Jun 2018 0 repositories listed
-
Efficient Entropy for Policy Gradient with Multidimensional Action Space2 Jun 2018 0 repositories listed
-
Internal Model from Observations for Reward Shaping2 Jun 2018 0 repositories listed
-
A Reinforcement Learning Approach to Age of Information in Multi-User Networks1 Jun 2018 0 repositories listed
-
Bootstrapping a Neural Conversational Agent with Dialogue Self-Play, Crowdsourcing and On-Line Reinforcement Learning1 Jun 2018 0 repositories listed
-
1 Jun 2018 0 repositories listed
-
Environment Upgrade Reinforcement Learning for Non-Differentiable Multi-Stage Pipelines1 Jun 2018 0 repositories listed
-
Equivalence Between Wasserstein and Value-Aware Loss for Model-based Reinforcement Learning1 Jun 2018 0 repositories listed
-
Fast Exploration with Simplified Models and Approximately Optimistic Planning in Model Based Reinforcement Learning1 Jun 2018 0 repositories listed
-
GraphBit: Bitwise Interaction Mining via Deep Reinforcement Learning1 Jun 2018 0 repositories listed
-
Improved Sample Complexity for Stochastic Compositional Variance Reduced Gradient1 Jun 2018 0 repositories listed
-
Inference Aided Reinforcement Learning for Incentive Mechanism Design in Crowdsourcing1 Jun 2018 0 repositories listed
-
Integrating Episodic Memory into a Reinforcement Learning Agent using Reservoir Sampling1 Jun 2018 0 repositories listed
-
Mining Evidences for Concept Stock Recommendation1 Jun 2018 0 repositories listed
-
Quality Signals in Generated Stories1 Jun 2018 0 repositories listed
-
SeedNet: Automatic Seed Generation With Deep Reinforcement Learning for Robust Interactive Segmentation1 Jun 2018 0 repositories listed
-
Evaluating Reinforcement Learning Algorithms in Observational Health Settings31 May 2018 0 repositories listed
-
Learning a Prior over Intent via Meta-Inverse Reinforcement Learning31 May 2018 0 repositories listed
-
Sequential Attacks on Agents for Long-Term Adversarial Goals31 May 2018 0 repositories listed
-
Adversarial Learning of Task-Oriented Neural Dialog Models30 May 2018 0 repositories listed
-
Depth and nonlinearity induce implicit exploration for RL29 May 2018 0 repositories listed
-
Observe and Look Further: Achieving Consistent Performance on Atari29 May 2018 0 repositories listed
-
Truncated Horizon Policy Search: Combining Reinforcement Learning & Imitation Learning29 May 2018 0 repositories listed
-
Variational Inverse Control with Events: A General Framework for Data-Driven Reward Definition29 May 2018 0 repositories listed
-
Virtuously Safe Reinforcement Learning29 May 2018 0 repositories listed
-
Hierarchical clustering with deep Q-learning28 May 2018 0 repositories listed
-
Importance Weighted Transfer of Samples in Reinforcement Learning28 May 2018 0 repositories listed
-
Value Propagation Networks28 May 2018 0 repositories listed
-
Fingerprint Policy Optimisation for Robust Reinforcement Learning27 May 2018 0 repositories listed
-
Deep Reinforcement Learning in Ice Hockey for Context-Aware Player Evaluation26 May 2018 0 repositories listed
-
Fast Policy Learning through Imitation and Reinforcement26 May 2018 0 repositories listed
-
A Sliding-Window Algorithm for Markov Decision Processes with Arbitrarily Changing Rewards and Transitions25 May 2018 0 repositories listed
-
Detecting Deceptive Reviews using Generative Adversarial Networks25 May 2018 0 repositories listed
-
Finite Sample Analysis of LSTD with Random Projections and Eligibility Traces25 May 2018 0 repositories listed
-
Reinforced Extractive Summarization with Question-Focused Rewards25 May 2018 0 repositories listed
-
Resource Allocation for a Wireless Coexistence Management System Based on Reinforcement Learning24 May 2018 0 repositories listed
-
Discovering Blind Spots in Reinforcement Learning23 May 2018 0 repositories listed
-
Dyna Planning using a Feature Based Generative Model23 May 2018 0 repositories listed
-
Reinforcement Learning for Heterogeneous Teams with PALO Bounds23 May 2018 0 repositories listed
-
When Simple Exploration is Sample Efficient: Identifying Sufficient Conditions for Random Exploration to Yield PAC RL Algorithms23 May 2018 0 repositories listed
-
Scalable Centralized Deep Multi-Agent Reinforcement Learning via Policy Gradients22 May 2018 0 repositories listed
-
A Framework and Method for Online Inverse Reinforcement Learning21 May 2018 0 repositories listed
-
A General Family of Robust Stochastic Operators for Reinforcement Learning21 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Hindsight21 May 2018 0 repositories listed
-
21 May 2018 0 repositories listed
-
Learning Safe Policies with Expert Guidance21 May 2018 0 repositories listed
-
Multiple-Step Greedy Policies in Online and Approximate Reinforcement Learning21 May 2018 0 repositories listed
-
Learning Real-World Robot Policies by Dreaming20 May 2018 0 repositories listed
-
Learning to Teach in Cooperative Multiagent Reinforcement Learning20 May 2018 0 repositories listed
-
Episodic Memory Deep Q-Networks19 May 2018 0 repositories listed
-
Reinforcement Learning of Theorem Proving19 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Deep Nested Agents18 May 2018 0 repositories listed
-
Two geometric input transformation methods for fast online reinforcement learning with neural nets18 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Resource Management in Network Slicing17 May 2018 0 repositories listed
-
Evolutionary RL for Container Loading17 May 2018 0 repositories listed
-
Language Expansion In Text-Based Games17 May 2018 0 repositories listed
-
Fast Retinomorphic Event Stream for Video Recognition and Reinforcement Learning16 May 2018 0 repositories listed
-
FollowNet: Robot Navigation by Following Natural Language Directions with Deep Reinforcement Learning16 May 2018 0 repositories listed
-
Optimized Computation Offloading Performance in Virtual Edge Computing Systems via Deep Reinforcement Learning16 May 2018 0 repositories listed
-
Feedback-Based Tree Search for Reinforcement Learning15 May 2018 0 repositories listed
-
Graph Signal Sampling via Reinforcement Learning15 May 2018 0 repositories listed
-
Leveraging human knowledge in tabular reinforcement learning: A study of human subjects15 May 2018 0 repositories listed
-
The Hierarchical Adaptive Forgetting Variational Filter15 May 2018 0 repositories listed
-
Low-pass Recurrent Neural Networks - A memory architecture for longer-term correlation discovery13 May 2018 0 repositories listed
-
Generating Rescheduling Knowledge using Reinforcement Learning in a Cognitive Architecture12 May 2018 0 repositories listed
-
Towards Autonomous Reinforcement Learning: Automatic Setting of Hyper-parameters using Bayesian Optimization12 May 2018 0 repositories listed
-
Deep Hierarchical Reinforcement Learning Algorithm in Partially Observable Markov Decision Processes11 May 2018 0 repositories listed