Browse State-of-the-Art › reinforcement-learning › Papers, page 87
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 87 of 135: papers 8,601 to 8,700 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Offline Reinforcement Learning: Fundamental Barriers for Value Function Approximation21 Nov 2021 0 repositories listed
-
Reinforcement Learning with General LTL Objectives is Intractable21 Nov 2021 0 repositories listed
-
Renewable energy integration and microgrid energy trading using multi-agent deep reinforcement learning21 Nov 2021 0 repositories listed
-
Vulcan: Solving the Steiner Tree Problem with Graph Neural Networks and Deep Reinforcement Learning21 Nov 2021 0 repositories listed
-
Explainable Biomedical Recommendations via Reinforcement Learning Reasoning on Knowledge Graphs20 Nov 2021 0 repositories listed
-
Triples-to-Text Generation with Reinforcement Learning Based Graph-augmented Neural Networks20 Nov 2021 0 repositories listed
-
An Improved Reinforcement Learning Model Based on Sentiment Analysis19 Nov 2021 0 repositories listed
-
Learn Quasi-stationary Distributions of Finite State Markov Chain19 Nov 2021 0 repositories listed
-
Reinforcement Learning with Adaptive Curriculum Dynamics Randomization for Fault-Tolerant Robot Control19 Nov 2021 0 repositories listed
-
Uncertainty-aware Low-Rank Q-Matrix Estimation for Deep Reinforcement Learning19 Nov 2021 0 repositories listed
-
A Survey of Zero-shot Generalisation in Deep Reinforcement Learning18 Nov 2021 0 repositories listed
-
Lifelong Reinforcement Learning with Temporal Logic Formulas and Reward Machines18 Nov 2021 0 repositories listed
-
SEIHAI: A Sample-efficient Hierarchical AI for the MineRL Competition17 Nov 2021 0 repositories listed
-
Self-Learning Tuning for Post-Silicon Validation17 Nov 2021 0 repositories listed
-
CLARA: A Constrained Reinforcement Learning Based Resource Allocation Framework for Network Slicing16 Nov 2021 0 repositories listed
-
Compressive Features in Offline Reinforcement Learning for Recommender Systems16 Nov 2021 0 repositories listed
-
Deep Reinforcement Learning for Entity Alignment16 Nov 2021 0 repositories listed
-
MAD for Robust Reinforcement Learning in Machine Translation16 Nov 2021 0 repositories listed
-
Post-processing Networks: A Method for Optimizing Pipeline Task-oriented Dialogue Systems using Reinforcement Learning16 Nov 2021 0 repositories listed
-
Probing the Robustness of Trained Metrics for Conversational Dialogue Systems16 Nov 2021 0 repositories listed
-
Reinforcement Learning with Feedback from Multiple Humans with Diverse Skills16 Nov 2021 0 repositories listed
-
Route Optimization via Environment-Aware Deep Network and Reinforcement Learning16 Nov 2021 0 repositories listed
-
Optimism and Delays in Episodic Reinforcement Learning15 Nov 2021 0 repositories listed
-
Exploiting Action Impact Regularity and Exogenous State Variables for Offline Reinforcement Learning15 Nov 2021 0 repositories listed
-
ModelLight: Model-Based Meta-Reinforcement Learning for Traffic Signal Control15 Nov 2021 0 repositories listed
-
The Partially Observable History Process15 Nov 2021 0 repositories listed
-
Versatile Inverse Reinforcement Learning via Cumulative Rewards15 Nov 2021 0 repositories listed
-
VisualEnv: visual Gym environments with Blender15 Nov 2021 0 repositories listed
-
Free Will Belief as a consequence of Model-based Reinforcement Learning14 Nov 2021 0 repositories listed
-
Relative Distributed Formation and Obstacle Avoidance with Multi-agent Reinforcement Learning14 Nov 2021 0 repositories listed
-
Deep Reinforcement Learning with Shallow Controllers: An Experimental Application to PID Tuning13 Nov 2021 0 repositories listed
-
Obstacle Avoidance for UAS in Continuous Action Space Using Deep Reinforcement Learning13 Nov 2021 0 repositories listed
-
Robust Deep Reinforcement Learning for Extractive Legal Summarization13 Nov 2021 0 repositories listed
-
Causal Multi-Agent Reinforcement Learning: Review and Open Problems12 Nov 2021 0 repositories listed
-
DriverGym: Democratising Reinforcement Learning for Autonomous Driving12 Nov 2021 0 repositories listed
-
RLOps: Development Life-cycle of Reinforcement Learning Aided Open RAN12 Nov 2021 0 repositories listed
-
Adapting Surprise Minimizing Reinforcement Learning Techniques for Transactive Control11 Nov 2021 0 repositories listed
-
Agent Spaces11 Nov 2021 0 repositories listed
-
CubeTR: Learning to Solve The Rubiks Cube Using Transformers11 Nov 2021 0 repositories listed
-
Model-Based Reinforcement Learning via Stochastic Hybrid Models11 Nov 2021 0 repositories listed
-
Multi-agent Reinforcement Learning for Cooperative Lane Changing of Connected and Autonomous Vehicles in Mixed Traffic11 Nov 2021 0 repositories listed
-
Towards Robust Knowledge Graph Embedding via Multi-task Reinforcement Learning11 Nov 2021 0 repositories listed
-
Look Before You Leap: Safe Model-Based Reinforcement Learning with Human Intervention10 Nov 2021 0 repositories listed
-
Spatially and Seamlessly Hierarchical Reinforcement Learning for State Space and Policy space in Autonomous Driving10 Nov 2021 0 repositories listed
-
Dealing with the Unknown: Pessimistic Offline Reinforcement Learning9 Nov 2021 0 repositories listed
-
Risk Sensitive Model-Based Reinforcement Learning using Uncertainty Guided Planning9 Nov 2021 0 repositories listed
-
Batch Reinforcement Learning from Crowds8 Nov 2021 0 repositories listed
-
Dueling RL: Reinforcement Learning with Trajectory Preferences8 Nov 2021 0 repositories listed
-
Interactive Inverse Reinforcement Learning for Cooperative Games8 Nov 2021 0 repositories listed
-
On Assessing The Safety of Reinforcement Learning algorithms Using Formal Methods8 Nov 2021 0 repositories listed
-
Explainable Deep Reinforcement Learning for Portfolio Management: An Empirical Approach7 Nov 2021 0 repositories listed
-
FinRL: Deep Reinforcement Learning Framework to Automate Trading in Quantitative Finance7 Nov 2021 0 repositories listed
-
FinRL-Podracer: High Performance and Scalable Deep Reinforcement Learning for Quantitative Finance7 Nov 2021 0 repositories listed
-
Optimization of the Model Predictive Control Meta-Parameters Through Reinforcement Learning7 Nov 2021 0 repositories listed
-
A Deep Reinforcement Learning Approach for Composing Moving IoT Services6 Nov 2021 0 repositories listed
-
Development of collective behavior in newborn artificial agents6 Nov 2021 0 repositories listed
-
Exponential Bellman Equation and Improved Regret Bounds for Risk-Sensitive Reinforcement Learning6 Nov 2021 0 repositories listed
-
Improving RNA Secondary Structure Design using Deep Reinforcement Learning5 Nov 2021 0 repositories listed
-
Learning to Cooperate with Unseen Agent via Meta-Reinforcement Learning5 Nov 2021 0 repositories listed
-
Attacking Deep Reinforcement Learning-Based Traffic Signal Control Systems with Colluding Vehicles4 Nov 2021 0 repositories listed
-
Control of a fly-mimicking flyer in complex flow using deep reinforcement learning4 Nov 2021 0 repositories listed
-
Generalization in Dexterous Manipulation via Geometry-Aware Multi-Task Learning4 Nov 2021 0 repositories listed
-
Imagine Networks4 Nov 2021 0 repositories listed
-
Model-Free Risk-Sensitive Reinforcement Learning4 Nov 2021 0 repositories listed
-
Successor Feature Neural Episodic Control4 Nov 2021 0 repositories listed
-
Towards Learning to Speak and Hear Through Multi-Agent Communication over a Continuous Acoustic Channel4 Nov 2021 0 repositories listed
-
Value Function Spaces: Skill-Centric State Abstractions for Long-Horizon Reasoning4 Nov 2021 0 repositories listed
-
AlphaD3M: Machine Learning Pipeline Synthesis3 Nov 2021 0 repositories listed
-
Autonomous Attack Mitigation for Industrial Control Systems3 Nov 2021 0 repositories listed
-
Model-Based Episodic Memory Induces Dynamic Hybrid Controls3 Nov 2021 0 repositories listed
-
Online Service Provisioning in NFV-enabled Networks Using Deep Reinforcement Learning3 Nov 2021 0 repositories listed
-
What Robot do I Need? Fast Co-Adaptation of Morphology and Control using Graph Neural Networks3 Nov 2021 0 repositories listed
-
2 Nov 2021 0 repositories listed
-
OnSlicing: Online End-to-End Network Slicing with Reinforcement Learning2 Nov 2021 0 repositories listed
-
Robust Dynamic Bus Control: A Distributional Multi-agent Reinforcement Learning Approach2 Nov 2021 0 repositories listed
-
A Collaborative Multi-agent Reinforcement Learning Framework for Dialog Action Decomposition1 Nov 2021 0 repositories listed
-
A Generative Framework for Simultaneous Machine Translation1 Nov 2021 0 repositories listed
-
Decentralized Cooperative Reinforcement Learning with Hierarchical Information Structure1 Nov 2021 0 repositories listed
-
Investigation of Independent Reinforcement Learning Algorithms in Multi-Agent Environments1 Nov 2021 0 repositories listed
-
Learning Task Sampling Policy for Multitask Learning1 Nov 2021 0 repositories listed
-
Learning to Operate an Electric Vehicle Charging Station Considering Vehicle-grid Integration1 Nov 2021 0 repositories listed
-
Machine Learning aided Crop Yield Optimization1 Nov 2021 0 repositories listed
-
Settling the Horizon-Dependence of Sample Complexity in Reinforcement Learning1 Nov 2021 0 repositories listed
-
Decentralized Multi-Agent Reinforcement Learning: An Off-Policy Method31 Oct 2021 0 repositories listed
-
A Decentralized Reinforcement Learning Framework for Efficient Passage of Emergency Vehicles30 Oct 2021 0 repositories listed
-
Adjacency constraint for efficient hierarchical reinforcement learning30 Oct 2021 0 repositories listed
-
Convergence and Optimality of Policy Gradient Methods in Weakly Smooth Settings30 Oct 2021 0 repositories listed
-
Adaptive Discretization in Online Reinforcement Learning29 Oct 2021 0 repositories listed
-
Brick-by-Brick: Combinatorial Construction with Deep Reinforcement Learning29 Oct 2021 0 repositories listed
-
Learning to Communicate with Reinforcement Learning for an Adaptive Traffic Control System29 Oct 2021 0 repositories listed
-
Mixed Cooperative-Competitive Communication Using Multi-Agent Reinforcement Learning29 Oct 2021 0 repositories listed
-
Accelerating Robotic Reinforcement Learning via Parameterized Action Primitives28 Oct 2021 0 repositories listed
-
Bayesian Sequential Optimal Experimental Design for Nonlinear Models Using Policy Gradient Reinforcement Learning28 Oct 2021 0 repositories listed
-
Choosing the Best of Both Worlds: Diverse and Novel Recommendations through Multi-Objective Reinforcement Learning28 Oct 2021 0 repositories listed
-
D2RLIR : an improved and diversified ranking function in interactive recommendation systems based on deep reinforcement learning28 Oct 2021 0 repositories listed
-
Extracting Expert's Goals by What-if Interpretable Modeling28 Oct 2021 0 repositories listed
-
Data Informed Residual Reinforcement Learning for High-Dimensional Robotic Tracking Control28 Oct 2021 0 repositories listed
-
A Law of Iterated Logarithm for Multi-Agent Reinforcement Learning27 Oct 2021 0 repositories listed
-
A Subgame Perfect Equilibrium Reinforcement Learning Approach to Time-inconsistent Problems27 Oct 2021 0 repositories listed
-
Comparing Heuristics, Constraint Optimization, and Reinforcement Learning for an Industrial 2D Packing Problem27 Oct 2021 0 repositories listed