Browse State-of-the-Art › Reinforcement Learning › Papers, page 100
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 100 of 132: papers 9,901 to 10,000 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Deep Reinforcement Learning for Motion Planning of Mobile Robots19 Dec 2019 0 repositories listed
-
Deep Reinforcement Learning for Smart Home Energy Management19 Dec 2019 0 repositories listed
-
Extendable NFV-Integrated Control Method Using Reinforcement Learning19 Dec 2019 0 repositories listed
-
Intra-Variable Handwriting Inspection Reinforced with Idiosyncrasy Analysis19 Dec 2019 0 repositories listed
-
Analysing Deep Reinforcement Learning Agents Trained with Domain Randomisation18 Dec 2019 0 repositories listed
-
Benchmarking the Neural Linear Model for Regression18 Dec 2019 0 repositories listed
-
Learning to grow: control of material self-assembly using evolutionary reinforcement learning18 Dec 2019 0 repositories listed
-
Relational Mimic for Visual Adversarial Imitation Learning18 Dec 2019 0 repositories listed
-
Taming an autonomous surface vehicle for path following and collision avoidance using deep reinforcement learning18 Dec 2019 0 repositories listed
-
Learning Generalizable Visual Representations via Interactive Gameplay17 Dec 2019 0 repositories listed
-
On the Bias-Variance Tradeoff: Textbooks Need an Update17 Dec 2019 0 repositories listed
-
Unpaired Image Enhancement Featuring Reinforcement-Learning-Controlled Image Editing Software17 Dec 2019 0 repositories listed
-
Complexity of Stochastic Dual Dynamic Programming16 Dec 2019 0 repositories listed
-
Coordination in Adversarial Sequential Team Games via Multi-Agent Deep Reinforcement Learning16 Dec 2019 0 repositories listed
-
Planning with Abstract Learned Models While Learning Transferable Subtasks16 Dec 2019 0 repositories listed
-
Adapting Behaviour for Learning Progress14 Dec 2019 0 repositories listed
-
Bayesian Linear Regression on Deep Representations14 Dec 2019 0 repositories listed
-
Fairness in Multi-agent Reinforcement Learning for Stock Trading14 Dec 2019 0 repositories listed
-
Natural Actor-Critic Converges Globally for Hierarchical Linear Quadratic Regulator14 Dec 2019 0 repositories listed
-
Resolving Congestions in the Air Traffic Management Domain via Multiagent Reinforcement Learning Methods14 Dec 2019 0 repositories listed
-
Spatial Influence-aware Reinforcement Learning for Intelligent Transportation System14 Dec 2019 0 repositories listed
-
Lessons from reinforcement learning for biological representations of space13 Dec 2019 0 repositories listed
-
Long-Term Planning and Situational Awareness in OpenAI Five13 Dec 2019 0 repositories listed
-
More Efficient Off-Policy Evaluation through Regularized Targeted Learning13 Dec 2019 0 repositories listed
-
Provably Efficient Reinforcement Learning with Aggregated States13 Dec 2019 0 repositories listed
-
Recruitment-imitation Mechanism for Evolutionary Reinforcement Learning13 Dec 2019 0 repositories listed
-
Control-Tutored Reinforcement Learning12 Dec 2019 0 repositories listed
-
Improved Activity Forecasting for Generating Trajectories12 Dec 2019 0 repositories listed
-
Provably Efficient Exploration in Policy Optimization12 Dec 2019 0 repositories listed
-
Text as Environment: A Deep Reinforcement Learning Text Readability Assessment Model12 Dec 2019 0 repositories listed
-
Biases for Emergent Communication in Multi-agent Reinforcement Learning11 Dec 2019 0 repositories listed
-
Doubly Robust Off-Policy Actor-Critic Algorithms for Reinforcement Learning11 Dec 2019 0 repositories listed
-
Efficient Robotic Task Generalization Using Deep Model Fusion Reinforcement Learning11 Dec 2019 0 repositories listed
-
Energy-aware Scheduling of Jobs in Heterogeneous Cluster Systems Using Deep Reinforcement Learning11 Dec 2019 0 repositories listed
-
Marginalized State Distribution Entropy Regularization in Policy Optimization11 Dec 2019 0 repositories listed
-
Online Deep Reinforcement Learning for Autonomous UAV Navigation and Exploration of Outdoor Environments11 Dec 2019 0 repositories listed
-
Quality of syntactic implication of RL-based sentence summarization11 Dec 2019 0 repositories listed
-
What Can Learned Intrinsic Rewards Capture?11 Dec 2019 0 repositories listed
-
A Finite-Time Analysis of Q-Learning with Neural Network Function Approximation10 Dec 2019 0 repositories listed
-
AVID: Learning Multi-Stage Tasks via Pixel-Level Translation of Human Videos10 Dec 2019 0 repositories listed
-
Before we can find a model, we must forget about perfection10 Dec 2019 0 repositories listed
-
Deep Bayesian Reward Learning from Preferences10 Dec 2019 0 repositories listed
-
Efficient and Robust Reinforcement Learning with Uncertainty-based Value Expansion10 Dec 2019 0 repositories listed
-
Reducing Catastrophic Forgetting in Modular Neural Networks by Dynamic Information Balancing10 Dec 2019 0 repositories listed
-
Adversarial recovery of agent rewards from latent spaces of the limit order book9 Dec 2019 0 repositories listed
-
Decentralized Multi-Agent Reinforcement Learning with Networked Agents: Recent Advances9 Dec 2019 0 repositories listed
-
Deep RL-based Trajectory Planning for AoI Minimization in UAV-assisted IoT9 Dec 2019 0 repositories listed
-
Grasping in the Wild:Learning 6DoF Closed-Loop Grasping from Low-Cost Demonstrations9 Dec 2019 0 repositories listed
-
Intelligent Coordination among Multiple Traffic Intersections Using Multi-Agent Reinforcement Learning9 Dec 2019 0 repositories listed
-
Learning Latent State Spaces for Planning through Reward Prediction9 Dec 2019 0 repositories listed
-
Learning Sparse Representations Incrementally in Deep Reinforcement Learning9 Dec 2019 0 repositories listed
-
Learning to Code: Coded Caching via Deep Reinforcement Learning9 Dec 2019 0 repositories listed
-
Optimism in Reinforcement Learning with Generalized Linear Function Approximation9 Dec 2019 0 repositories listed
-
Transformer Based Reinforcement Learning For Games9 Dec 2019 0 repositories listed
-
Unsupervised Curricula for Visual Meta-Reinforcement Learning9 Dec 2019 0 repositories listed
-
Effects of a Social Force Model reward in Robot Navigation based on Deep Reinforcement Learning8 Dec 2019 0 repositories listed
-
Value-of-Information based Arbitration between Model-based and Model-free Control8 Dec 2019 0 repositories listed
-
Driving Style Encoder: Situational Reward Adaptation for General-Purpose Planning in Automated Driving7 Dec 2019 0 repositories listed
-
From Reinforcement Learning to Optimal Control: A unified framework for sequential decisions7 Dec 2019 0 repositories listed
-
No-Regret Exploration in Goal-Oriented Reinforcement Learning7 Dec 2019 0 repositories listed
-
A pedestrian path-planning model in accordance with obstacle's danger with reinforcement learning6 Dec 2019 0 repositories listed
-
Alternative Function Approximation Parameterizations for Solving Games: An Analysis of f-Regression Counterfactual Regret Minimization6 Dec 2019 0 repositories listed
-
Deep Reinforcement Learning for Routing a Heterogeneous Fleet of Vehicles6 Dec 2019 0 repositories listed
-
How Does an Approximate Model Help in Reinforcement Learning?6 Dec 2019 0 repositories listed
-
Making Smart Homes Smarter: Optimizing Energy Consumption with Human in the Loop6 Dec 2019 0 repositories listed
-
Observational Overfitting in Reinforcement Learning6 Dec 2019 0 repositories listed
-
Risk-Averse Trust Region Optimization for Reward-Volatility Reduction6 Dec 2019 0 repositories listed
-
Reinforcement Learning with Non-Markovian Rewards5 Dec 2019 0 repositories listed
-
Dynamic Pricing on E-commerce Platform with Deep Reinforcement Learning: A Field Experiment5 Dec 2019 0 repositories listed
-
Iterative Policy-Space Expansion in Reinforcement Learning5 Dec 2019 0 repositories listed
-
Learning to run a power network challenge for training topology controllers5 Dec 2019 0 repositories listed
-
Reinforcement Learning with Convolutional Reservoir Computing5 Dec 2019 0 repositories listed
-
Scalable Reinforcement Learning for Multi-Agent Networked Systems5 Dec 2019 0 repositories listed
-
AlgaeDICE: Policy Gradient from Arbitrary Experience4 Dec 2019 0 repositories listed
-
Deep Model Compression Via Two-Stage Deep Reinforcement Learning4 Dec 2019 0 repositories listed
-
Learning Efficient Representation for Intrinsic Motivation4 Dec 2019 0 repositories listed
-
Optimizing Norm-Bounded Weighted Ambiguity Sets for Robust MDPs4 Dec 2019 0 repositories listed
-
Reinforcement learning for bandwidth estimation and congestion control in real-time communications4 Dec 2019 0 repositories listed
-
Learning Agent Communication under Limited Bandwidth by Message Pruning3 Dec 2019 0 repositories listed
-
Neighborhood Cognition Consistent Multi-Agent Reinforcement Learning3 Dec 2019 0 repositories listed
-
Online and Bandit Algorithms for Nonstationary Stochastic Saddle-Point Optimization3 Dec 2019 0 repositories listed
-
Self-Learned Formula Synthesis in Set Theory3 Dec 2019 0 repositories listed
-
Human-Robot Collaboration via Deep Reinforcement Learning of Real-World Interactions2 Dec 2019 0 repositories listed
-
2 Dec 2019 0 repositories listed
-
Just Ask:An Interactive Learning Framework for Vision and Language Navigation2 Dec 2019 0 repositories listed
-
Policy Optimization Reinforcement Learning with Entropy Regularization2 Dec 2019 0 repositories listed
-
A Family of Robust Stochastic Operators for Reinforcement Learning1 Dec 2019 0 repositories listed
-
Adversary A3C for Robust Reinforcement Learning1 Dec 2019 0 repositories listed
-
Efficient Smooth Non-Convex Stochastic Compositional Optimization via Stochastic Recursive Gradient Descent1 Dec 2019 0 repositories listed
-
Explicit Planning for Efficient Exploration in Reinforcement Learning1 Dec 2019 0 repositories listed
-
Flow Rate Control in Smart District Heating Systems Using Deep Reinforcement Learning1 Dec 2019 0 repositories listed
-
Identifying Cognitive Radars -- Inverse Reinforcement Learning using Revealed Preferences1 Dec 2019 0 repositories listed
-
Model Embedded DRL for Intelligent Greenhouse Control1 Dec 2019 0 repositories listed
-
Near-Optimal Reinforcement Learning in Dynamic Treatment Regimes1 Dec 2019 0 repositories listed
-
Neural Temporal-Difference Learning Converges to Global Optima1 Dec 2019 0 repositories listed
-
Neural Trust Region/Proximal Policy Optimization Attains Globally Optimal Policy1 Dec 2019 0 repositories listed
-
No-Press Diplomacy: Modeling Multi-Agent Gameplay1 Dec 2019 0 repositories listed
-
Optimization for Reinforcement Learning: From Single Agent to Cooperative Agents1 Dec 2019 0 repositories listed
-
Provably Efficient Q-learning with Function Approximation via Distribution Shift Error Checking Oracle1 Dec 2019 0 repositories listed
-
Provably Global Convergence of Actor-Critic: A Case for Linear Quadratic Regulator with Ergodic Cost1 Dec 2019 0 repositories listed