Browse State-of-the-Art › reinforcement-learning › Papers, page 127
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 127 of 135: papers 12,601 to 12,700 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Truncated Horizon Policy Search: Combining Reinforcement Learning & Imitation Learning29 May 2018 0 repositories listed
-
Variational Inverse Control with Events: A General Framework for Data-Driven Reward Definition29 May 2018 0 repositories listed
-
Virtuously Safe Reinforcement Learning29 May 2018 0 repositories listed
-
Hierarchical clustering with deep Q-learning28 May 2018 0 repositories listed
-
Importance Weighted Transfer of Samples in Reinforcement Learning28 May 2018 0 repositories listed
-
Value Propagation Networks28 May 2018 0 repositories listed
-
Fingerprint Policy Optimisation for Robust Reinforcement Learning27 May 2018 0 repositories listed
-
Deep Reinforcement Learning in Ice Hockey for Context-Aware Player Evaluation26 May 2018 0 repositories listed
-
A Sliding-Window Algorithm for Markov Decision Processes with Arbitrarily Changing Rewards and Transitions25 May 2018 0 repositories listed
-
Finite Sample Analysis of LSTD with Random Projections and Eligibility Traces25 May 2018 0 repositories listed
-
Reinforced Extractive Summarization with Question-Focused Rewards25 May 2018 0 repositories listed
-
Resource Allocation for a Wireless Coexistence Management System Based on Reinforcement Learning24 May 2018 0 repositories listed
-
Discovering Blind Spots in Reinforcement Learning23 May 2018 0 repositories listed
-
Reinforcement Learning for Heterogeneous Teams with PALO Bounds23 May 2018 0 repositories listed
-
Scalable Centralized Deep Multi-Agent Reinforcement Learning via Policy Gradients22 May 2018 0 repositories listed
-
A Framework and Method for Online Inverse Reinforcement Learning21 May 2018 0 repositories listed
-
A General Family of Robust Stochastic Operators for Reinforcement Learning21 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Hindsight21 May 2018 0 repositories listed
-
21 May 2018 0 repositories listed
-
Learning Safe Policies with Expert Guidance21 May 2018 0 repositories listed
-
Multiple-Step Greedy Policies in Online and Approximate Reinforcement Learning21 May 2018 0 repositories listed
-
Learning Real-World Robot Policies by Dreaming20 May 2018 0 repositories listed
-
Learning to Teach in Cooperative Multiagent Reinforcement Learning20 May 2018 0 repositories listed
-
Reinforcement Learning of Theorem Proving19 May 2018 0 repositories listed
-
Hierarchical Reinforcement Learning with Deep Nested Agents18 May 2018 0 repositories listed
-
Two geometric input transformation methods for fast online reinforcement learning with neural nets18 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Resource Management in Network Slicing17 May 2018 0 repositories listed
-
Language Expansion In Text-Based Games17 May 2018 0 repositories listed
-
Fast Retinomorphic Event Stream for Video Recognition and Reinforcement Learning16 May 2018 0 repositories listed
-
FollowNet: Robot Navigation by Following Natural Language Directions with Deep Reinforcement Learning16 May 2018 0 repositories listed
-
Optimized Computation Offloading Performance in Virtual Edge Computing Systems via Deep Reinforcement Learning16 May 2018 0 repositories listed
-
Feedback-Based Tree Search for Reinforcement Learning15 May 2018 0 repositories listed
-
Graph Signal Sampling via Reinforcement Learning15 May 2018 0 repositories listed
-
Leveraging human knowledge in tabular reinforcement learning: A study of human subjects15 May 2018 0 repositories listed
-
Generating Rescheduling Knowledge using Reinforcement Learning in a Cognitive Architecture12 May 2018 0 repositories listed
-
Towards Autonomous Reinforcement Learning: Automatic Setting of Hyper-parameters using Bayesian Optimization12 May 2018 0 repositories listed
-
Deep Hierarchical Reinforcement Learning Algorithm in Partially Observable Markov Decision Processes11 May 2018 0 repositories listed
-
Interactive Reinforcement Learning with Dynamic Reuse of Prior Knowledge from Human/Agent's Demonstration11 May 2018 0 repositories listed
-
Leveraging Grammar and Reinforcement Learning for Neural Program Synthesis11 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Optimal Control of Space Heating10 May 2018 0 repositories listed
-
Discourse-Aware Neural Rewards for Coherent Text Generation10 May 2018 0 repositories listed
-
Multimodal Hierarchical Reinforcement Learning Policy for Task-Oriented Visual Dialog8 May 2018 0 repositories listed
-
Deep Reinforcement Learning for Page-wise Recommendations7 May 2018 0 repositories listed
-
Multimodal Machine Translation with Reinforcement Learning7 May 2018 0 repositories listed
-
Developing parsimonious ensembles using ensemble diversity within a reinforcement learning framework5 May 2018 0 repositories listed
-
Exploration by Distributional Reinforcement Learning4 May 2018 0 repositories listed
-
Robust Deep Reinforcement Learning for Security and Safety in Autonomous Vehicle Systems2 May 2018 0 repositories listed
-
Falsification of Cyber-Physical Systems Using Deep Reinforcement Learning1 May 2018 0 repositories listed
-
Robust Log-Optimal Strategy with Reinforcement Learning1 May 2018 0 repositories listed
-
Generating Interpretable Fuzzy Controllers using Particle Swarm Optimization and Genetic Programming29 Apr 2018 0 repositories listed
-
Towards Experienced Anomaly Detector through Reinforcement Learning29 Apr 2018 0 repositories listed
-
Sentiment Adaptive End-to-End Dialog Systems28 Apr 2018 0 repositories listed
-
Deep Reinforcement Learning to Acquire Navigation Skills for Wheel-Legged Robots in Complex Environments27 Apr 2018 0 repositories listed
-
Action Categorization for Computationally Improved Task Learning and Planning26 Apr 2018 0 repositories listed
-
Multiagent Soft Q-Learning25 Apr 2018 0 repositories listed
-
Benchmarking projective simulation in navigation problems23 Apr 2018 0 repositories listed
-
MQGrad: Reinforcement Learning of Gradient Quantization in Parameter Server22 Apr 2018 0 repositories listed
-
PEORL: Integrating Symbolic Planning and Hierarchical Reinforcement Learning for Robust Decision-Making20 Apr 2018 0 repositories listed
-
Cell Selection with Deep Reinforcement Learning in Sparse Mobile Crowdsensing19 Apr 2018 0 repositories listed
-
Disentangling Controllable and Uncontrollable Factors of Variation by Interacting with the World19 Apr 2018 0 repositories listed
-
19 Apr 2018 0 repositories listed
-
Automated vehicle's behavior decision making using deep reinforcement learning and high-fidelity simulation environment17 Apr 2018 0 repositories listed
-
On Improving Deep Reinforcement Learning for POMDPs17 Apr 2018 0 repositories listed
-
Learning How to Self-Learn: Enhancing Self-Training Using Neural Reinforcement Learning16 Apr 2018 0 repositories listed
-
State-Augmentation Transformations for Risk-Sensitive Reinforcement Learning16 Apr 2018 0 repositories listed
-
Robust Dual View Deep Agent13 Apr 2018 0 repositories listed
-
Distort-and-Recover: Color Enhancement using Deep Reinforcement Learning12 Apr 2018 0 repositories listed
-
Feature-Based Aggregation and Deep Reinforcement Learning: A Survey and Some New Implementations12 Apr 2018 0 repositories listed
-
Optimizing Query Evaluations using Reinforcement Learning for Web Search12 Apr 2018 0 repositories listed
-
Universal Successor Representations for Transfer Reinforcement Learning11 Apr 2018 0 repositories listed
-
Binary Space Partitioning as Intrinsic Reward10 Apr 2018 0 repositories listed
-
Outline Objects using Deep Reinforcement Learning10 Apr 2018 0 repositories listed
-
A clustering-based reinforcement learning approach for tailored personalization of e-Health interventions10 Apr 2018 0 repositories listed
-
Latent Space Policies for Hierarchical Reinforcement Learning9 Apr 2018 0 repositories listed
-
Scalable Sentiment for Sequence-to-sequence Chatbot Response with Performance Analysis7 Apr 2018 0 repositories listed
-
Programmatically Interpretable Reinforcement Learning6 Apr 2018 0 repositories listed
-
A Human Mixed Strategy Approach to Deep Reinforcement Learning5 Apr 2018 0 repositories listed
-
Information Maximizing Exploration with a Latent Dynamics Model4 Apr 2018 0 repositories listed
-
EmoRL: Continuous Acoustic Emotion Classification using Deep Reinforcement Learning3 Apr 2018 0 repositories listed
-
Renewal Monte Carlo: Renewal theory based reinforcement learning3 Apr 2018 0 repositories listed
-
Curiosity-driven Exploration for Mapless Navigation with Deep Reinforcement Learning2 Apr 2018 0 repositories listed
-
Recall Traces: Backtracking Models for Efficient Reinforcement Learning2 Apr 2018 0 repositories listed
-
Learning to Run challenge: Synthesizing physiologically accurate motion using deep reinforcement learning31 Mar 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas31 Mar 2018 0 repositories listed
-
How an Electrical Engineer Became an Artificial Intelligence Researcher, a Multiphase Active Contours Analysis29 Mar 2018 0 repositories listed
-
Reinforcement learning for non-prehensile manipulation: Transfer from simulation to physical system28 Mar 2018 0 repositories listed
-
27 Mar 2018 0 repositories listed
-
Forward-Backward Reinforcement Learning27 Mar 2018 0 repositories listed
-
Reinforcement Learning for Fair Dynamic Pricing27 Mar 2018 0 repositories listed
-
Scalable photonic reinforcement learning by time-division multiplexing of laser chaos26 Mar 2018 0 repositories listed
-
Autonomous Ramp Merge Maneuver Based on Reinforcement Learning with Continuous Action Space25 Mar 2018 0 repositories listed
-
DOP: Deep Optimistic Planning with Approximate Value Function Evaluation22 Mar 2018 0 repositories listed
-
Learning State Representations for Query Optimization with Deep Reinforcement Learning22 Mar 2018 0 repositories listed
-
Meta Reinforcement Learning with Latent Variable Gaussian Processes20 Mar 2018 0 repositories listed
-
Natural Gradient Deep Q-learning20 Mar 2018 0 repositories listed
-
Optimizing Sponsored Search Ranking Strategy by Deep Reinforcement Learning20 Mar 2018 0 repositories listed
-
Variance Reduction for Policy Gradient with Action-Dependent Factorized Baselines20 Mar 2018 0 repositories listed
-
Neural Text Generation: Past, Present and Beyond15 Mar 2018 0 repositories listed
-
Rearrangement with Nonprehensile Manipulation Using Deep Reinforcement Learning15 Mar 2018 0 repositories listed
-
Automated Speed and Lane Change Decision Making using Deep Reinforcement Learning14 Mar 2018 0 repositories listed