Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 129
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 129 of 152: papers 12,801 to 12,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Policy Optimization for ℋ₂ Linear Control with ℋ_∞ Robustness Guarantee: Implicit Regularization and Global Convergence21 Oct 2019 0 repositories listed
-
Resource Allocation in Mobility-Aware Federated Learning Networks: A Deep Reinforcement Learning Approach21 Oct 2019 0 repositories listed
-
Self-Supervised Sim-to-Real Adaptation for Visual Robotic Manipulation21 Oct 2019 0 repositories listed
-
Autonomous Industrial Management via Reinforcement Learning: Self-Learning Agents for Decision-Making -- A Review20 Oct 2019 0 repositories listed
-
Active 6D Multi-Object Pose Estimation in Cluttered Scenarios with Deep Reinforcement Learning19 Oct 2019 0 repositories listed
-
Explainable AI: Deep Reinforcement Learning Agents for Residential Demand Side Cost Savings in Smart Grids19 Oct 2019 0 repositories listed
-
Opinion shaping in social networks using reinforcement learning19 Oct 2019 0 repositories listed
-
Graph Convolutional Policy for Solving Tree Decomposition via Reinforcement Learning Heuristics18 Oct 2019 0 repositories listed
-
OffWorld Gym: open-access physical robotics environment for real-world reinforcement learning benchmark and research18 Oct 2019 0 repositories listed
-
On Connections between Constrained Optimization and Reinforcement Learning18 Oct 2019 0 repositories listed
-
On the Sample Complexity of Actor-Critic Method for Reinforcement Learning with Function Approximation18 Oct 2019 0 repositories listed
-
Unsupervised Context Rewriting for Open Domain Conversation18 Oct 2019 0 repositories listed
-
Adaptive Trade-Offs in Off-Policy Learning16 Oct 2019 0 repositories listed
-
Conditional Importance Sampling for Off-Policy Learning16 Oct 2019 0 repositories listed
-
Creativity in Robot Manipulation with Deep Reinforcement Learning16 Oct 2019 0 repositories listed
-
Parallel Exploration via Negatively Correlated Search16 Oct 2019 0 repositories listed
-
Reinforced Bit Allocation under Task-Driven Semantic Distortion Metrics16 Oct 2019 0 repositories listed
-
A unified view of likelihood ratio and reparameterization gradients and an optimal importance sampling scheme14 Oct 2019 0 repositories listed
-
Actor Critic with Differentially Private Critic14 Oct 2019 0 repositories listed
-
Coordination of PV Smart Inverters Using Deep Reinforcement Learning for Grid Voltage Regulation14 Oct 2019 0 repositories listed
-
Dynamic Graph Configuration with Reinforcement Learning for Connected Autonomous Vehicle Trajectories14 Oct 2019 0 repositories listed
-
Federated Transfer Reinforcement Learning for Autonomous Driving14 Oct 2019 0 repositories listed
-
On the Reduction of Variance and Overestimation of Deep Q-Learning14 Oct 2019 0 repositories listed
-
Neural Program Synthesis By Self-Learning13 Oct 2019 0 repositories listed
-
QoS and Jamming-Aware Wireless Networking Using Deep Reinforcement Learning13 Oct 2019 0 repositories listed
-
Rethinking Exposure Bias In Language Modeling13 Oct 2019 0 repositories listed
-
Curiosity-Driven Recommendation Strategy for Adaptive Learning via Deep Reinforcement Learning12 Oct 2019 0 repositories listed
-
Uncertainty Quantification and Exploration for Reinforcement Learning12 Oct 2019 0 repositories listed
-
Building HVAC Scheduling Using Reinforcement Learning via Neural Network Based Model Approximation11 Oct 2019 0 repositories listed
-
Green Deep Reinforcement Learning for Radio Resource Management: Architecture, Algorithm Compression and Challenge11 Oct 2019 0 repositories listed
-
Improving Gradient Estimation in Evolutionary Strategies With Past Descent Directions11 Oct 2019 0 repositories listed
-
Modeling Cyber-Physical Human Systems via an Interplay Between Reinforcement Learning and Game Theory11 Oct 2019 0 repositories listed
-
Autonomous Driving using Safe Reinforcement Learning by Incorporating a Regret-based Human Lane-Changing Decision Model10 Oct 2019 0 repositories listed
-
A Dual-Hormone Closed-Loop Delivery System for Type 1 Diabetes Using Deep Reinforcement Learning9 Oct 2019 0 repositories listed
-
Ctrl-Z: Recovering from Instability in Reinforcement Learning9 Oct 2019 0 repositories listed
-
Defensive Escort Teams via Multi-Agent Deep Reinforcement Learning9 Oct 2019 0 repositories listed
-
Fast Task-Adaptation for Tasks Labeled Using Natural Language in Reinforcement Learning9 Oct 2019 0 repositories listed
-
Imagined Value Gradients: Model-Based Policy Optimization with Transferable Latent Dynamics Models9 Oct 2019 0 repositories listed
-
Improving Generalization in Meta Reinforcement Learning using Learned Objectives9 Oct 2019 0 repositories listed
-
Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments9 Oct 2019 0 repositories listed
-
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods9 Oct 2019 0 repositories listed
-
Model-Based Reinforcement Learning Exploiting State-Action Equivalence9 Oct 2019 0 repositories listed
-
Model-based Reinforcement Learning for Predictions and Control for Limit Order Books9 Oct 2019 0 repositories listed
-
Multiple-objective Reinforcement Learning for Inverse Design and Identification9 Oct 2019 0 repositories listed
-
Black-box Optimizer with Implicit Natural Gradient9 Oct 2019 0 repositories listed
-
Tactical Reward Shaping: Bypassing Reinforcement Learning with Strategy-Based Goals8 Oct 2019 0 repositories listed
-
Is a Good Representation Sufficient for Sample Efficient Reinforcement Learning?7 Oct 2019 0 repositories listed
-
Multi-Agent Reinforcement Learning for Order-dispatching via Order-Vehicle Distribution Matching7 Oct 2019 0 repositories listed
-
Multi-step Greedy Reinforcement Learning Algorithms7 Oct 2019 0 repositories listed
-
Reinforcement Learning with Structured Hierarchical Grammar Representations of Actions7 Oct 2019 0 repositories listed
-
Biased Aggregation, Rollout, and Enhanced Policy Improvement for Reinforcement Learning6 Oct 2019 0 repositories listed
-
Probabilistic Successor Representations with Kalman Temporal Differences6 Oct 2019 0 repositories listed
-
Attention-based Fault-tolerant Approach for Multi-agent Reinforcement Learning Systems5 Oct 2019 0 repositories listed
-
DeepMNavigate: Deep Reinforced Multi-Robot Navigation Unifying Local & Global Collision Avoidance4 Oct 2019 0 repositories listed
-
Discounted Reinforcement Learning Is Not an Optimization Problem4 Oct 2019 0 repositories listed
-
I'm sorry Dave, I'm afraid I can't do that, Deep Q-learning from forbidden action4 Oct 2019 0 repositories listed
-
Manufacturing Dispatching using Reinforcement and Transfer Learning4 Oct 2019 0 repositories listed
-
Zero Shot Learning on Simulated Robots4 Oct 2019 0 repositories listed
-
Hybrid Zero Dynamics Inspired Feedback Control Policy Design for 3D Bipedal Locomotion using Reinforcement Learning3 Oct 2019 0 repositories listed
-
Machine learning strategies for path-planning microswimmers in turbulent flows3 Oct 2019 0 repositories listed
-
SensorDrop: A Reinforcement Learning Framework for Communication Overhead Reduction on the Edge3 Oct 2019 0 repositories listed
-
Using Logical Specifications of Objectives in Multi-Objective Reinforcement Learning3 Oct 2019 0 repositories listed
-
AI Assisted Annotator using Reinforcement Learning2 Oct 2019 0 repositories listed
-
CWAE-IRL: Formulating a supervised approach to Inverse Reinforcement Learning problem2 Oct 2019 0 repositories listed
-
Deep Reinforcement Learning for Single-Shot Diagnosis and Adaptation in Damaged Robots2 Oct 2019 0 repositories listed
-
Review of Learning-based Longitudinal Motion Planning for Autonomous Vehicles: Research Gaps between Self-driving and Traffic Congestion2 Oct 2019 0 repositories listed
-
Language is Power: Representing States Using Natural Language in Reinforcement Learning2 Oct 2019 0 repositories listed
-
Relationship Explainable Multi-objective Optimization Via Vector Value Function Based Reinforcement Learning2 Oct 2019 0 repositories listed
-
Never Worse, Mostly Better: Stable Policy Improvement in Deep Reinforcement Learning2 Oct 2019 0 repositories listed
-
Deep Reinforcement Active Learning for Human-in-the-Loop Person Re-Identification1 Oct 2019 0 repositories listed
-
Fair Loss: Margin-Aware Reinforcement Learning for Deep Face Recognition1 Oct 2019 0 repositories listed
-
Generalization in Generation: A closer look at Exposure Bias1 Oct 2019 0 repositories listed
-
Generating Paraphrases with Lean Vocabulary1 Oct 2019 0 repositories listed
-
Machine Translation for Machines: the Sentiment Classification Use Case1 Oct 2019 0 repositories listed
-
Quantile QT-Opt for Risk-Aware Vision-Based Robotic Grasping1 Oct 2019 0 repositories listed
-
Reinforcement Learning for Multi-Objective Optimization of Online Decisions in High-Dimensional Systems1 Oct 2019 0 repositories listed
-
Dynamic Interaction-Aware Scene Understanding for Reinforcement Learning in Autonomous Driving30 Sep 2019 0 repositories listed
-
MGHRL: Meta Goal-generation for Hierarchical Reinforcement Learning30 Sep 2019 0 repositories listed
-
End-to-End Motion Planning of Quadrotors Using Deep Reinforcement Learning30 Sep 2019 0 repositories listed
-
RLCache: Automated Cache Management Using Reinforcement Learning30 Sep 2019 0 repositories listed
-
Tensor-based Cooperative Control for Large Scale Multi-intersection Traffic Signal Using Deep Reinforcement Learning and Imitation Learning30 Sep 2019 0 repositories listed
-
Accelerating the Computation of UCB and Related Indices for Reinforcement Learning28 Sep 2019 0 repositories listed
-
Deep Reinforcement Learning Based Power control for Wireless Multicast Systems27 Sep 2019 0 repositories listed
-
Interaction-Aware Multi-Agent Reinforcement Learning for Mobile Agents with Individual Goals27 Sep 2019 0 repositories listed
-
Playing Atari Ball Games with Hierarchical Reinforcement Learning27 Sep 2019 0 repositories listed
-
Safe Reinforcement Learning on Autonomous Vehicles27 Sep 2019 0 repositories listed
-
SURREAL-System: Fully-Integrated Stack for Distributed Deep Reinforcement Learning27 Sep 2019 0 repositories listed
-
CAQL: Continuous Action Q-Learning26 Sep 2019 0 repositories listed
-
MERL: Multi-Head Reinforcement Learning26 Sep 2019 0 repositories listed
-
Relationship Explainable Multi-objective Reinforcement Learning with Semantic Explainability Generation26 Sep 2019 0 repositories listed
-
Towards a Metric for Automated Conversational Dialogue System Evaluation and Improvement26 Sep 2019 0 repositories listed
-
Adapt-to-Learn: Policy Transfer in Reinforcement Learning25 Sep 2019 0 repositories listed
-
Advantage Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning25 Sep 2019 0 repositories listed
-
Assessing Generalization in TD methods for Deep Reinforcement Learning25 Sep 2019 0 repositories listed
-
Attention Privileged Reinforcement Learning for Domain Transfer25 Sep 2019 0 repositories listed
-
AUGMENTED POLICY GRADIENT METHODS FOR EFFICIENT REINFORCEMENT LEARNING25 Sep 2019 0 repositories listed
-
Avoiding Negative Side-Effects and Promoting Safe Exploration with Imaginative Planning25 Sep 2019 0 repositories listed
-
BANANAS: Bayesian Optimization with Neural Networks for Neural Architecture Search25 Sep 2019 0 repositories listed
-
Behavior-Guided Reinforcement Learning25 Sep 2019 0 repositories listed
-
CAPACITY-LIMITED REINFORCEMENT LEARNING: APPLICATIONS IN DEEP ACTOR-CRITIC METHODS FOR CONTINUOUS CONTROL25 Sep 2019 0 repositories listed