Browse State-of-the-Art › Reinforcement Learning › Papers, page 103
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 103 of 132: papers 10,201 to 10,300 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Multi-agent Hierarchical Reinforcement Learning with Dynamic Termination21 Oct 2019 0 repositories listed
-
Policy Optimization for ℋ₂ Linear Control with ℋ_∞ Robustness Guarantee: Implicit Regularization and Global Convergence21 Oct 2019 0 repositories listed
-
Resource Allocation in Mobility-Aware Federated Learning Networks: A Deep Reinforcement Learning Approach21 Oct 2019 0 repositories listed
-
HIGhER : Improving instruction following with Hindsight Generation for Experience Replay21 Oct 2019 0 repositories listed
-
Self-Supervised Sim-to-Real Adaptation for Visual Robotic Manipulation21 Oct 2019 0 repositories listed
-
Autonomous Industrial Management via Reinforcement Learning: Self-Learning Agents for Decision-Making -- A Review20 Oct 2019 0 repositories listed
-
Diverse Behavior Is What Game AI Needs: Generating Varied Human-Like Playing Styles Using Evolutionary Multi-Objective Deep Reinforcement Learning20 Oct 2019 0 repositories listed
-
Active 6D Multi-Object Pose Estimation in Cluttered Scenarios with Deep Reinforcement Learning19 Oct 2019 0 repositories listed
-
Explainable AI: Deep Reinforcement Learning Agents for Residential Demand Side Cost Savings in Smart Grids19 Oct 2019 0 repositories listed
-
Opinion shaping in social networks using reinforcement learning19 Oct 2019 0 repositories listed
-
Graph Convolutional Policy for Solving Tree Decomposition via Reinforcement Learning Heuristics18 Oct 2019 0 repositories listed
-
OffWorld Gym: open-access physical robotics environment for real-world reinforcement learning benchmark and research18 Oct 2019 0 repositories listed
-
On Connections between Constrained Optimization and Reinforcement Learning18 Oct 2019 0 repositories listed
-
On the Sample Complexity of Actor-Critic Method for Reinforcement Learning with Function Approximation18 Oct 2019 0 repositories listed
-
Unsupervised Context Rewriting for Open Domain Conversation18 Oct 2019 0 repositories listed
-
A Survey of Deep Learning Techniques for Autonomous Driving17 Oct 2019 0 repositories listed
-
Actor-Critic Provably Finds Nash Equilibria of Linear-Quadratic Mean-Field Games16 Oct 2019 0 repositories listed
-
Adaptive Trade-Offs in Off-Policy Learning16 Oct 2019 0 repositories listed
-
Conditional Importance Sampling for Off-Policy Learning16 Oct 2019 0 repositories listed
-
Creativity in Robot Manipulation with Deep Reinforcement Learning16 Oct 2019 0 repositories listed
-
Model-Agnostic Meta-Learning using Runge-Kutta Methods16 Oct 2019 0 repositories listed
-
Parallel Exploration via Negatively Correlated Search16 Oct 2019 0 repositories listed
-
Reinforced Bit Allocation under Task-Driven Semantic Distortion Metrics16 Oct 2019 0 repositories listed
-
How a minimal learning agent can infer the existence of unobserved variables in a complex environment15 Oct 2019 0 repositories listed
-
SafeCritic: Collision-Aware Trajectory Prediction15 Oct 2019 0 repositories listed
-
Understanding the Curse of Horizon in Off-Policy Evaluation via Conditional Importance Sampling15 Oct 2019 0 repositories listed
-
A unified view of likelihood ratio and reparameterization gradients and an optimal importance sampling scheme14 Oct 2019 0 repositories listed
-
Actor Critic with Differentially Private Critic14 Oct 2019 0 repositories listed
-
Coordination of PV Smart Inverters Using Deep Reinforcement Learning for Grid Voltage Regulation14 Oct 2019 0 repositories listed
-
Dynamic Graph Configuration with Reinforcement Learning for Connected Autonomous Vehicle Trajectories14 Oct 2019 0 repositories listed
-
Federated Transfer Reinforcement Learning for Autonomous Driving14 Oct 2019 0 repositories listed
-
On the Reduction of Variance and Overestimation of Deep Q-Learning14 Oct 2019 0 repositories listed
-
Extracting Incentives from Black-Box Decisions13 Oct 2019 0 repositories listed
-
Neural Program Synthesis By Self-Learning13 Oct 2019 0 repositories listed
-
QoS and Jamming-Aware Wireless Networking Using Deep Reinforcement Learning13 Oct 2019 0 repositories listed
-
Rethinking Exposure Bias In Language Modeling13 Oct 2019 0 repositories listed
-
Curiosity-Driven Recommendation Strategy for Adaptive Learning via Deep Reinforcement Learning12 Oct 2019 0 repositories listed
-
Uncertainty Quantification and Exploration for Reinforcement Learning12 Oct 2019 0 repositories listed
-
How to Not Measure Disentanglement12 Oct 2019 0 repositories listed
-
Regularizing Model-Based Planning with Energy-Based Models12 Oct 2019 0 repositories listed
-
Bayesian Optimization Meets Riemannian Manifolds in Robot Learning11 Oct 2019 0 repositories listed
-
Building HVAC Scheduling Using Reinforcement Learning via Neural Network Based Model Approximation11 Oct 2019 0 repositories listed
-
Green Deep Reinforcement Learning for Radio Resource Management: Architecture, Algorithm Compression and Challenge11 Oct 2019 0 repositories listed
-
Improving Gradient Estimation in Evolutionary Strategies With Past Descent Directions11 Oct 2019 0 repositories listed
-
Modeling Cyber-Physical Human Systems via an Interplay Between Reinforcement Learning and Game Theory11 Oct 2019 0 repositories listed
-
Zap Q-Learning With Nonlinear Function Approximation11 Oct 2019 0 repositories listed
-
Autonomous Driving using Safe Reinforcement Learning by Incorporating a Regret-based Human Lane-Changing Decision Model10 Oct 2019 0 repositories listed
-
Efficient Intrinsically Motivated Robotic Grasping with Learning-Adaptive Imagination in Latent Space10 Oct 2019 0 repositories listed
-
A Dual-Hormone Closed-Loop Delivery System for Type 1 Diabetes Using Deep Reinforcement Learning9 Oct 2019 0 repositories listed
-
Compatible features for Monotonic Policy Improvement9 Oct 2019 0 repositories listed
-
Ctrl-Z: Recovering from Instability in Reinforcement Learning9 Oct 2019 0 repositories listed
-
Defensive Escort Teams via Multi-Agent Deep Reinforcement Learning9 Oct 2019 0 repositories listed
-
Fast Task-Adaptation for Tasks Labeled Using Natural Language in Reinforcement Learning9 Oct 2019 0 repositories listed
-
Hierarchical Deep Double Q-Routing9 Oct 2019 0 repositories listed
-
Imagined Value Gradients: Model-Based Policy Optimization with Transferable Latent Dynamics Models9 Oct 2019 0 repositories listed
-
Improving Generalization in Meta Reinforcement Learning using Learned Objectives9 Oct 2019 0 repositories listed
-
Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments9 Oct 2019 0 repositories listed
-
Learning Visual Affordances with Target-Orientated Deep Q-Network to Grasp Objects by Harnessing Environmental Fixtures9 Oct 2019 0 repositories listed
-
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods9 Oct 2019 0 repositories listed
-
Model-Based Reinforcement Learning Exploiting State-Action Equivalence9 Oct 2019 0 repositories listed
-
Model-based Reinforcement Learning for Predictions and Control for Limit Order Books9 Oct 2019 0 repositories listed
-
Multiple-objective Reinforcement Learning for Inverse Design and Identification9 Oct 2019 0 repositories listed
-
Black-box Optimizer with Implicit Natural Gradient9 Oct 2019 0 repositories listed
-
Tactical Reward Shaping: Bypassing Reinforcement Learning with Strategy-Based Goals8 Oct 2019 0 repositories listed
-
Is a Good Representation Sufficient for Sample Efficient Reinforcement Learning?7 Oct 2019 0 repositories listed
-
Multi-Agent Reinforcement Learning for Order-dispatching via Order-Vehicle Distribution Matching7 Oct 2019 0 repositories listed
-
Multi-step Greedy Reinforcement Learning Algorithms7 Oct 2019 0 repositories listed
-
Reinforcement Learning with Structured Hierarchical Grammar Representations of Actions7 Oct 2019 0 repositories listed
-
Biased Aggregation, Rollout, and Enhanced Policy Improvement for Reinforcement Learning6 Oct 2019 0 repositories listed
-
Optimising energy and overhead for large parameter space simulations6 Oct 2019 0 repositories listed
-
Probabilistic Successor Representations with Kalman Temporal Differences6 Oct 2019 0 repositories listed
-
Attention-based Fault-tolerant Approach for Multi-agent Reinforcement Learning Systems5 Oct 2019 0 repositories listed
-
DeepMNavigate: Deep Reinforced Multi-Robot Navigation Unifying Local & Global Collision Avoidance4 Oct 2019 0 repositories listed
-
Discounted Reinforcement Learning Is Not an Optimization Problem4 Oct 2019 0 repositories listed
-
If MaxEnt RL is the Answer, What is the Question?4 Oct 2019 0 repositories listed
-
I'm sorry Dave, I'm afraid I can't do that, Deep Q-learning from forbidden action4 Oct 2019 0 repositories listed
-
Learning Robust Representations with Graph Denoising Policy Network4 Oct 2019 0 repositories listed
-
Manufacturing Dispatching using Reinforcement and Transfer Learning4 Oct 2019 0 repositories listed
-
Zero Shot Learning on Simulated Robots4 Oct 2019 0 repositories listed
-
Hybrid Zero Dynamics Inspired Feedback Control Policy Design for 3D Bipedal Locomotion using Reinforcement Learning3 Oct 2019 0 repositories listed
-
Machine learning strategies for path-planning microswimmers in turbulent flows3 Oct 2019 0 repositories listed
-
SensorDrop: A Reinforcement Learning Framework for Communication Overhead Reduction on the Edge3 Oct 2019 0 repositories listed
-
Using Logical Specifications of Objectives in Multi-Objective Reinforcement Learning3 Oct 2019 0 repositories listed
-
AI Assisted Annotator using Reinforcement Learning2 Oct 2019 0 repositories listed
-
Boosting Image Recognition with Non-differentiable Constraints2 Oct 2019 0 repositories listed
-
CWAE-IRL: Formulating a supervised approach to Inverse Reinforcement Learning problem2 Oct 2019 0 repositories listed
-
Deep Reinforcement Learning for Single-Shot Diagnosis and Adaptation in Damaged Robots2 Oct 2019 0 repositories listed
-
Language is Power: Representing States Using Natural Language in Reinforcement Learning2 Oct 2019 0 repositories listed
-
Relationship Explainable Multi-objective Optimization Via Vector Value Function Based Reinforcement Learning2 Oct 2019 0 repositories listed
-
Never Worse, Mostly Better: Stable Policy Improvement in Deep Reinforcement Learning2 Oct 2019 0 repositories listed
-
Deep Reinforcement Active Learning for Human-in-the-Loop Person Re-Identification1 Oct 2019 0 repositories listed
-
Fair Loss: Margin-Aware Reinforcement Learning for Deep Face Recognition1 Oct 2019 0 repositories listed
-
Generalization in Generation: A closer look at Exposure Bias1 Oct 2019 0 repositories listed
-
Generating Paraphrases with Lean Vocabulary1 Oct 2019 0 repositories listed
-
Machine Translation for Machines: the Sentiment Classification Use Case1 Oct 2019 0 repositories listed
-
Quantile QT-Opt for Risk-Aware Vision-Based Robotic Grasping1 Oct 2019 0 repositories listed
-
Reinforcement Learning for Multi-Objective Optimization of Online Decisions in High-Dimensional Systems1 Oct 2019 0 repositories listed
-
Self-Critical Attention Learning for Person Re-Identification1 Oct 2019 0 repositories listed
-
Dynamic Interaction-Aware Scene Understanding for Reinforcement Learning in Autonomous Driving30 Sep 2019 0 repositories listed
-
MGHRL: Meta Goal-generation for Hierarchical Reinforcement Learning30 Sep 2019 0 repositories listed