Browse State-of-the-Art › Reinforcement Learning › Papers, page 121
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 121 of 132: papers 12,001 to 12,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Multiagent Soft Q-Learning25 Apr 2018 0 repositories listed
-
Benchmarking projective simulation in navigation problems23 Apr 2018 0 repositories listed
-
State Distribution-aware Sampling for Deep Q-learning23 Apr 2018 0 repositories listed
-
MQGrad: Reinforcement Learning of Gradient Quantization in Parameter Server22 Apr 2018 0 repositories listed
-
Event Extraction with Generative Adversarial Imitation Learning21 Apr 2018 0 repositories listed
-
PEORL: Integrating Symbolic Planning and Hierarchical Reinforcement Learning for Robust Decision-Making20 Apr 2018 0 repositories listed
-
Subgoal Discovery for Hierarchical Dialogue Policy Learning20 Apr 2018 0 repositories listed
-
Cell Selection with Deep Reinforcement Learning in Sparse Mobile Crowdsensing19 Apr 2018 0 repositories listed
-
Disentangling Controllable and Uncontrollable Factors of Variation by Interacting with the World19 Apr 2018 0 repositories listed
-
19 Apr 2018 0 repositories listed
-
Modeling and Simultaneously Removing Bias via Adversarial Neural Networks18 Apr 2018 0 repositories listed
-
An Adaptive Clipping Approach for Proximal Policy Optimization17 Apr 2018 0 repositories listed
-
Automated vehicle's behavior decision making using deep reinforcement learning and high-fidelity simulation environment17 Apr 2018 0 repositories listed
-
Model-Free Linear Quadratic Control via Reduction to Expert Prediction17 Apr 2018 0 repositories listed
-
17 Apr 2018 0 repositories listed
-
On Improving Deep Reinforcement Learning for POMDPs17 Apr 2018 0 repositories listed
-
Learning How to Self-Learn: Enhancing Self-Training Using Neural Reinforcement Learning16 Apr 2018 0 repositories listed
-
Multi-modality Sensor Data Classification with Selective Attention16 Apr 2018 0 repositories listed
-
On Gradient-Based Learning in Continuous Games16 Apr 2018 0 repositories listed
-
State-Augmentation Transformations for Risk-Sensitive Reinforcement Learning16 Apr 2018 0 repositories listed
-
Learning Deep Sketch Abstraction13 Apr 2018 0 repositories listed
-
Robust Dual View Deep Agent13 Apr 2018 0 repositories listed
-
Distort-and-Recover: Color Enhancement using Deep Reinforcement Learning12 Apr 2018 0 repositories listed
-
Feature-Based Aggregation and Deep Reinforcement Learning: A Survey and Some New Implementations12 Apr 2018 0 repositories listed
-
Optimizing Query Evaluations using Reinforcement Learning for Web Search12 Apr 2018 0 repositories listed
-
Personalized Dynamics Models for Adaptive Assistive Navigation Systems11 Apr 2018 0 repositories listed
-
Universal Successor Representations for Transfer Reinforcement Learning11 Apr 2018 0 repositories listed
-
Binary Space Partitioning as Intrinsic Reward10 Apr 2018 0 repositories listed
-
Outline Objects using Deep Reinforcement Learning10 Apr 2018 0 repositories listed
-
A clustering-based reinforcement learning approach for tailored personalization of e-Health interventions10 Apr 2018 0 repositories listed
-
Latent Space Policies for Hierarchical Reinforcement Learning9 Apr 2018 0 repositories listed
-
Policy Gradient With Value Function Approximation For Collective Multiagent Planning9 Apr 2018 0 repositories listed
-
Hierarchical Modular Reinforcement Learning Method and Knowledge Acquisition of State-Action Rule for Multi-target Problem8 Apr 2018 0 repositories listed
-
Scalable Sentiment for Sequence-to-sequence Chatbot Response with Performance Analysis7 Apr 2018 0 repositories listed
-
Programmatically Interpretable Reinforcement Learning6 Apr 2018 0 repositories listed
-
Reinforcement Learning based QoS/QoE-aware Service Function Chaining in Software-Driven 5G Slices6 Apr 2018 0 repositories listed
-
A Human Mixed Strategy Approach to Deep Reinforcement Learning5 Apr 2018 0 repositories listed
-
Information Maximizing Exploration with a Latent Dynamics Model4 Apr 2018 0 repositories listed
-
EmoRL: Continuous Acoustic Emotion Classification using Deep Reinforcement Learning3 Apr 2018 0 repositories listed
-
Renewal Monte Carlo: Renewal theory based reinforcement learning3 Apr 2018 0 repositories listed
-
Curiosity-driven Exploration for Mapless Navigation with Deep Reinforcement Learning2 Apr 2018 0 repositories listed
-
Exploring to learn visual saliency: The RL-IAC approach2 Apr 2018 0 repositories listed
-
Recall Traces: Backtracking Models for Efficient Reinforcement Learning2 Apr 2018 0 repositories listed
-
Toward Intelligent Vehicular Networks: A Machine Learning Framework1 Apr 2018 0 repositories listed
-
Learning to Run challenge: Synthesizing physiologically accurate motion using deep reinforcement learning31 Mar 2018 0 repositories listed
-
Snap Angle Prediction for 360° Panoramas31 Mar 2018 0 repositories listed
-
Observer-based Adaptive Optimal Output Containment Control problem of Linear Heterogeneous Multi-agent Systems with Relative Output Measurements30 Mar 2018 0 repositories listed
-
How an Electrical Engineer Became an Artificial Intelligence Researcher, a Multiphase Active Contours Analysis29 Mar 2018 0 repositories listed
-
Actor-Critic based Training Framework for Abstractive Summarization28 Mar 2018 0 repositories listed
-
Reinforcement learning for non-prehensile manipulation: Transfer from simulation to physical system28 Mar 2018 0 repositories listed
-
27 Mar 2018 0 repositories listed
-
Forward-Backward Reinforcement Learning27 Mar 2018 0 repositories listed
-
Reinforcement Learning for Fair Dynamic Pricing27 Mar 2018 0 repositories listed
-
Safe end-to-end imitation learning for model predictive control27 Mar 2018 0 repositories listed
-
Scalable photonic reinforcement learning by time-division multiplexing of laser chaos26 Mar 2018 0 repositories listed
-
Autonomous Ramp Merge Maneuver Based on Reinforcement Learning with Continuous Action Space25 Mar 2018 0 repositories listed
-
The Importance of Constraint Smoothness for Parameter Estimation in Computational Cognitive Modeling24 Mar 2018 0 repositories listed
-
Accelerating Learning in Constructive Predictive Frameworks with the Successor Representation23 Mar 2018 0 repositories listed
-
Deep Reinforcement Learning with Model Learning and Monte Carlo Tree Search in Minecraft22 Mar 2018 0 repositories listed
-
DOP: Deep Optimistic Planning with Approximate Value Function Evaluation22 Mar 2018 0 repositories listed
-
Learning State Representations for Query Optimization with Deep Reinforcement Learning22 Mar 2018 0 repositories listed
-
The Rapidly Changing Landscape of Conversational Agents22 Mar 2018 0 repositories listed
-
Learning Robotic Assembly from CAD20 Mar 2018 0 repositories listed
-
Meta Reinforcement Learning with Latent Variable Gaussian Processes20 Mar 2018 0 repositories listed
-
Natural Gradient Deep Q-learning20 Mar 2018 0 repositories listed
-
Optimizing Sponsored Search Ranking Strategy by Deep Reinforcement Learning20 Mar 2018 0 repositories listed
-
Variance Reduction for Policy Gradient with Action-Dependent Factorized Baselines20 Mar 2018 0 repositories listed
-
What Doubling Tricks Can and Can't Do for Multi-Armed Bandits19 Mar 2018 0 repositories listed
-
Fast Neural Architecture Construction using EnvelopeNets18 Mar 2018 0 repositories listed
-
Finite Horizon Throughput Maximization and Sensing Optimization in Wireless Powered Devices over Fading Channels17 Mar 2018 0 repositories listed
-
Inverse Visual Question Answering: A New Benchmark and VQA Diagnosis Tool16 Mar 2018 0 repositories listed
-
TBD: Benchmarking and Analyzing Deep Neural Network Training16 Mar 2018 0 repositories listed
-
Neural Text Generation: Past, Present and Beyond15 Mar 2018 0 repositories listed
-
Rearrangement with Nonprehensile Manipulation Using Deep Reinforcement Learning15 Mar 2018 0 repositories listed
-
Transferable Pedestrian Motion Prediction Models at Intersections15 Mar 2018 0 repositories listed
-
Automated Speed and Lane Change Decision Making using Deep Reinforcement Learning14 Mar 2018 0 repositories listed
-
Imitation Learning with Concurrent Actions in 3D Games14 Mar 2018 0 repositories listed
-
Measurement-based adaptation protocol with quantum reinforcement learning14 Mar 2018 0 repositories listed
-
The 2017 AIBIRDS Competition14 Mar 2018 0 repositories listed
-
Active Reinforcement Learning with Monte-Carlo Tree Search13 Mar 2018 0 repositories listed
-
Hierarchical Reinforcement Learning: Approximating Optimal Discounted TSP Using Local Policies13 Mar 2018 0 repositories listed
-
Learning to Explore with Meta-Policy Gradient13 Mar 2018 0 repositories listed
-
Policy Search in Continuous Action Domains: an Overview13 Mar 2018 0 repositories listed
-
From Nodes to Networks: Evolving Recurrent Neural Networks12 Mar 2018 0 repositories listed
-
Soft-Robust Actor-Critic Policy-Gradient11 Mar 2018 0 repositories listed
-
Kickstarting Deep Reinforcement Learning10 Mar 2018 0 repositories listed
-
Valuing knowledge, information and agency in Multi-agent Reinforcement Learning: a case study in smart buildings9 Mar 2018 0 repositories listed
-
A Multi-Objective Deep Reinforcement Learning Framework8 Mar 2018 0 repositories listed
-
DeepCAS: A Deep Reinforcement Learning Algorithm for Control-Aware Scheduling8 Mar 2018 0 repositories listed
-
Feudal Reinforcement Learning for Dialogue Management in Large Domains8 Mar 2018 0 repositories listed
-
SA-IGA: A Multiagent Reinforcement Learning Method Towards Socially Optimal Outcomes8 Mar 2018 0 repositories listed
-
A Brandom-ian view of Reinforcement Learning towards strong-AI7 Mar 2018 0 repositories listed
-
Extracting Action Sequences from Texts Based on Deep Reinforcement Learning7 Mar 2018 0 repositories listed
-
Intent-aware Multi-agent Reinforcement Learning6 Mar 2018 0 repositories listed
-
Personalized Exposure Control Using Adaptive Metering and Reinforcement Learning6 Mar 2018 0 repositories listed
-
Smoothed Action Value Functions for Learning Gaussian Policies6 Mar 2018 0 repositories listed
-
Less Is More: Picking Informative Frames for Video Captioning5 Mar 2018 0 repositories listed
-
Variance-Aware Regret Bounds for Undiscounted Reinforcement Learning in MDPs5 Mar 2018 0 repositories listed
-
OIL: Observational Imitation Learning3 Mar 2018 0 repositories listed
-
The History Began from AlexNet: A Comprehensive Survey on Deep Learning Approaches3 Mar 2018 0 repositories listed