Browse State-of-the-Art › Reinforcement Learning › Papers, page 114
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 114 of 132: papers 11,301 to 11,400 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP27 Jan 2019 0 repositories listed
-
Reward Shaping via Meta-Learning27 Jan 2019 0 repositories listed
-
Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning27 Jan 2019 0 repositories listed
-
Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning26 Jan 2019 0 repositories listed
-
Almost Boltzmann Exploration25 Jan 2019 0 repositories listed
-
Distributed Policy Iteration for Scalable Approximation of Cooperative Multi-Agent Policies25 Jan 2019 0 repositories listed
-
Model-based Deep Reinforcement Learning for Dynamic Portfolio Optimization25 Jan 2019 0 repositories listed
-
Federated Deep Reinforcement Learning24 Jan 2019 0 repositories listed
-
Feudal Multi-Agent Hierarchies for Cooperative Reinforcement Learning24 Jan 2019 0 repositories listed
-
Never Forget: Balancing Exploration and Exploitation via Learning Optical Flow24 Jan 2019 0 repositories listed
-
Sample Complexity of Estimating the Policy Gradient for Nearly Deterministic Dynamical Systems24 Jan 2019 0 repositories listed
-
Thirty Years of Machine Learning: The Road to Pareto-Optimal Wireless Networks24 Jan 2019 0 repositories listed
-
Distillation Strategies for Proximal Policy Optimization23 Jan 2019 0 repositories listed
-
Hierarchical Reinforcement Learning for Multi-agent MOBA Game23 Jan 2019 0 repositories listed
-
Phonetic-enriched Text Representation for Chinese Sentiment Analysis with Reinforcement Learning23 Jan 2019 0 repositories listed
-
Reinforcement Learning of Markov Decision Processes with Peak Constraints23 Jan 2019 0 repositories listed
-
Trust Region Value Optimization using Kalman Filtering23 Jan 2019 0 repositories listed
-
Robust Recovery Controller for a Quadrupedal Robot using Deep Reinforcement Learning22 Jan 2019 0 repositories listed
-
Towards Learning to Imitate from a Single Video Demonstration22 Jan 2019 0 repositories listed
-
A Short Survey on Probabilistic Reinforcement Learning21 Jan 2019 0 repositories listed
-
Learning retrosynthetic planning through self-play19 Jan 2019 0 repositories listed
-
Lifelong Federated Reinforcement Learning: A Learning Architecture for Navigation in Cloud Robotic Systems19 Jan 2019 0 repositories listed
-
Towards Physically Safe Reinforcement Learning under Supervision19 Jan 2019 0 repositories listed
-
Theory of Minds: Understanding Behavior in Groups Through Inverse Planning18 Jan 2019 0 repositories listed
-
CodeX: Bit-Flexible Encoding for Streaming-based FPGA Acceleration of DNNs17 Jan 2019 0 repositories listed
-
Multi-agent Reinforcement Learning Embedded Game for the Optimization of Building Energy Control and Power System Planning17 Jan 2019 0 repositories listed
-
Evolutionarily-Curated Curriculum Learning for Deep Reinforcement Learning Agents16 Jan 2019 0 repositories listed
-
Representation Learning on Graphs: A Reinforcement Learning Application16 Jan 2019 0 repositories listed
-
Comparing Knowledge-based Reinforcement Learning to Neural Networks in a Strategy Game15 Jan 2019 0 repositories listed
-
Improving Sepsis Treatment Strategies by Combining Deep and Kernel-Based Reinforcement Learning15 Jan 2019 0 repositories listed
-
Low Level Control of a Quadrotor with Deep Model-Based Reinforcement Learning11 Jan 2019 0 repositories listed
-
Low-Power Neuromorphic Hardware for Signal Processing Applications11 Jan 2019 0 repositories listed
-
On the Global Convergence of Imitation Learning: A Case for Linear Quadratic Regulator11 Jan 2019 0 repositories listed
-
A New Tensioning Method using Deep Reinforcement Learning for Surgical Pattern Cutting10 Jan 2019 0 repositories listed
-
Motion Perception in Reinforcement Learning with Dynamic Objects10 Jan 2019 0 repositories listed
-
Uncertainty-Based Out-of-Distribution Detection in Deep Reinforcement Learning8 Jan 2019 0 repositories listed
-
A dual mode adaptive basal-bolus advisor based on reinforcement learning7 Jan 2019 0 repositories listed
-
A* Tree Search for Portfolio Management7 Jan 2019 0 repositories listed
-
Credit Assignment Techniques in Stochastic Computation Graphs7 Jan 2019 0 repositories listed
-
Towards a Decentralized, Autonomous Multiagent Framework for Mitigating Crop Loss7 Jan 2019 0 repositories listed
-
Exploring applications of deep reinforcement learning for real-world autonomous driving systems6 Jan 2019 0 repositories listed
-
Recurrent Control Nets for Deep Reinforcement Learning6 Jan 2019 0 repositories listed
-
What Should I Do Now? Marrying Reinforcement Learning and Symbolic Planning6 Jan 2019 0 repositories listed
-
Accelerating Goal-Directed Reinforcement Learning by Model Characterization4 Jan 2019 0 repositories listed
-
Machine Teaching in Hierarchical Genetic Reinforcement Learning: Curriculum Design of Reward Functions for Swarm Shepherding4 Jan 2019 0 repositories listed
-
Optimal Decision-Making in Mixed-Agent Partially Observable Stochastic Environments via Reinforcement Learning4 Jan 2019 0 repositories listed
-
QFlow: A Learning Approach to High QoE Video Streaming at the Wireless Edge4 Jan 2019 0 repositories listed
-
A Computational Framework for Motor Skill Acquisition3 Jan 2019 0 repositories listed
-
Human-Like Autonomous Car-Following Model with Deep Reinforcement Learning3 Jan 2019 0 repositories listed
-
Imminent Collision Mitigation with Reinforcement Learning and Vision3 Jan 2019 0 repositories listed
-
Natively Interpretable Machine Learning and Artificial Intelligence: Preliminary Results and Future Directions2 Jan 2019 0 repositories listed
-
A Theoretical Analysis of Deep Q-Learning1 Jan 2019 0 repositories listed
-
Complementary reinforcement learning towards explainable agents1 Jan 2019 0 repositories listed
-
Tighter Problem-Dependent Regret Bounds in Reinforcement Learning without Domain Knowledge using Value Function Bounds1 Jan 2019 0 repositories listed
-
Deep Reinforcement Learning for Multi-Agent Systems: A Review of Challenges, Solutions and Applications31 Dec 2018 0 repositories listed
-
Stealing Neural Networks via Timing Side Channels31 Dec 2018 0 repositories listed
-
Meta Reinforcement Learning with Distribution of Exploration Parameters Learned by Evolution Strategies29 Dec 2018 0 repositories listed
-
Differential Temporal Difference Learning28 Dec 2018 0 repositories listed
-
Dynamic Planning Networks28 Dec 2018 0 repositories listed
-
MEETING BOT: Reinforcement Learning for Dialogue Based Meeting Scheduling28 Dec 2018 0 repositories listed
-
State representation learning with recurrent capsule networks28 Dec 2018 0 repositories listed
-
Dealing with Limited Backhaul Capacity in Millimeter Wave Systems: A Deep Reinforcement Learning Approach27 Dec 2018 0 repositories listed
-
Double Neural Counterfactual Regret Minimization27 Dec 2018 0 repositories listed
-
Quantum Adiabatic Algorithm Design using Reinforcement Learning27 Dec 2018 0 repositories listed
-
A New Concept of Deep Reinforcement Learning based Augmented General Sequence Tagging System26 Dec 2018 0 repositories listed
-
Learning to Refine Source Representations for Neural Machine Translation26 Dec 2018 0 repositories listed
-
Learning to Walk via Deep Reinforcement Learning26 Dec 2018 0 repositories listed
-
Optimizing Market Making using Multi-Agent Reinforcement Learning26 Dec 2018 0 repositories listed
-
Moment Matching Training for Neural Machine Translation: A Preliminary Study24 Dec 2018 0 repositories listed
-
VMAV-C: A Deep Attention-based Reinforcement Learning Algorithm for Model-based Control24 Dec 2018 0 repositories listed
-
Estimating Rationally Inattentive Utility Functions with Deep Clustering for Framing - Applications in YouTube Engagement Dynamics23 Dec 2018 0 repositories listed
-
Parallelized Interactive Machine Learning on Autonomous Vehicles23 Dec 2018 0 repositories listed
-
Escape Room: A Configurable Testbed for Hierarchical Reinforcement Learning22 Dec 2018 0 repositories listed
-
Graph Transformation Policy Network for Chemical Reaction Prediction22 Dec 2018 0 repositories listed
-
Learning to Navigate the Web21 Dec 2018 0 repositories listed
-
NADPEx: An on-policy temporally consistent exploration method for deep reinforcement learning21 Dec 2018 0 repositories listed
-
Optimizing Quantum Error Correction Codes with Reinforcement Learning20 Dec 2018 0 repositories listed
-
Deep Online Learning via Meta-Learning: Continual Adaptation for Model-Based RL18 Dec 2018 0 repositories listed
-
Deep reinforcement learning for search, recommendation, and online advertising: a survey18 Dec 2018 0 repositories listed
-
Domain Adaptation for Reinforcement Learning on the Atari18 Dec 2018 0 repositories listed
-
Incentive-based demand response for smart grid with reinforcement learning and deep neural network18 Dec 2018 0 repositories listed
-
Sim-to-Real via Sim-to-Sim: Data-efficient Robotic Grasping via Randomized-to-Canonical Adaptation Networks18 Dec 2018 0 repositories listed
-
Toward Multimodal Model-Agnostic Meta-Learning18 Dec 2018 0 repositories listed
-
A Review of Meta-Reinforcement Learning for Deep Neural Networks Architecture Search17 Dec 2018 0 repositories listed
-
Fuzzy Controller of Reward of Reinforcement Learning For Handwritten Digit Recognition17 Dec 2018 0 repositories listed
-
Malthusian Reinforcement Learning17 Dec 2018 0 repositories listed
-
Reinforcement Learning for Adaptive Caching with Dynamic Storage Pricing17 Dec 2018 0 repositories listed
-
A Logarithmic Barrier Method For Proximal Policy Optimization16 Dec 2018 0 repositories listed
-
Gold Seeker: Information Gain from Policy Distributions for Goal-oriented Vision-and-Langauge Reasoning16 Dec 2018 0 repositories listed
-
Likelihood Quantile Networks for Coordinating Multi-Agent Reinforcement Learning15 Dec 2018 0 repositories listed
-
Guaranteed satisficing and finite regret: Analysis of a cognitive satisficing value function14 Dec 2018 0 repositories listed
-
Scaling shared model governance via model splitting14 Dec 2018 0 repositories listed
-
The Entropy of Artificial Intelligence and a Case Study of AlphaZero from Shannon's Perspective14 Dec 2018 0 repositories listed
-
Learning to Communicate: A Machine Learning Framework for Heterogeneous Multi-Agent Robotic Systems13 Dec 2018 0 repositories listed
-
A predictive safety filter for learning-based control of constrained nonlinear dynamical systems13 Dec 2018 0 repositories listed
-
Scene Recomposition by Learning-based ICP13 Dec 2018 0 repositories listed
-
Deep neural networks algorithms for stochastic control problems on finite horizon: convergence analysis11 Dec 2018 0 repositories listed
-
Efficient Model-Free Reinforcement Learning Using Gaussian Process11 Dec 2018 0 repositories listed
-
KF-LAX: Kronecker-factored curvature estimation for control variate optimization in reinforcement learning11 Dec 2018 0 repositories listed
-
The Gap Between Model-Based and Model-Free Methods on the Linear Quadratic Regulator: An Asymptotic Viewpoint9 Dec 2018 0 repositories listed