Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 89
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 89 of 152: papers 8,801 to 8,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects20 Mar 2022 0 repositories listed
-
Reinforcement learning reward function in unmanned aerial vehicle control tasks20 Mar 2022 0 repositories listed
-
Policy Gradients using Variational Quantum Circuits20 Mar 2022 0 repositories listed
-
Thompson Sampling on Asymmetric α-Stable Bandits19 Mar 2022 0 repositories listed
-
Deep reinforcement learning guided graph neural networks for brain network analysis18 Mar 2022 0 repositories listed
-
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning18 Mar 2022 0 repositories listed
-
Privacy-Preserving Reinforcement Learning Beyond Expectation18 Mar 2022 0 repositories listed
-
Risk-Sensitive Bayesian Games for Multi-Agent Reinforcement Learning under Policy Uncertainty18 Mar 2022 0 repositories listed
-
SURF: Semi-supervised Reward Learning with Data Augmentation for Feedback-efficient Preference-based Reinforcement Learning18 Mar 2022 0 repositories listed
-
Meta-Reinforcement Learning for the Tuning of PI Controllers: An Offline Approach17 Mar 2022 0 repositories listed
-
Near Instance-Optimal PAC Reinforcement Learning for Deterministic MDPs17 Mar 2022 0 repositories listed
-
Strategic Maneuver and Disruption with Reinforcement Learning Approaches for Multi-Agent Coordination17 Mar 2022 0 repositories listed
-
The Frost Hollow Experiments: Pavlovian Signalling as a Path to Coordination and Communication Between Agents17 Mar 2022 0 repositories listed
-
A Deep Reinforcement Learning-Based Caching Strategy for IoT Networks with Transient Data16 Mar 2022 0 repositories listed
-
A Survey of Multi-Agent Deep Reinforcement Learning with Communication16 Mar 2022 0 repositories listed
-
Backpropagation through Time and Space: Learning Numerical Methods with Multi-Agent Reinforcement Learning16 Mar 2022 0 repositories listed
-
How to Learn from Risk: Explicit Risk-Utility Reinforcement Learning for Efficient and Safe Driving Strategies16 Mar 2022 0 repositories listed
-
Lazy-MDPs: Towards Interpretable Reinforcement Learning by Learning When to Act16 Mar 2022 0 repositories listed
-
A Differentiable Approach to Combinatorial Optimization using Dataless Neural Networks15 Mar 2022 0 repositories listed
-
An Introduction to Multi-Agent Reinforcement Learning and Review of its Application to Autonomous Mobility15 Mar 2022 0 repositories listed
-
Bi-Manual Manipulation and Attachment via Sim-to-Real Reinforcement Learning15 Mar 2022 0 repositories listed
-
Blocks Assemble! Learning to Assemble with Large-Scale Structured Reinforcement Learning15 Mar 2022 0 repositories listed
-
Multi-View Dreaming: Multi-View World Model with Contrastive Learning15 Mar 2022 0 repositories listed
-
Non-Linear Reinforcement Learning in Large Action Spaces: Structural Conditions and Sample-efficiency of Posterior Sampling15 Mar 2022 0 repositories listed
-
Calibration of Derivative Pricing Models: a Multi-Agent Reinforcement Learning Perspective14 Mar 2022 0 repositories listed
-
Efficient Model-based Multi-agent Reinforcement Learning via Optimistic Equilibrium Computation14 Mar 2022 0 repositories listed
-
FRL-FI: Transient Fault Analysis for Federated Reinforcement Learning-Based Navigation Systems14 Mar 2022 0 repositories listed
-
Reinforcement Learning for Optimal Control of a District Cooling Energy Plant14 Mar 2022 0 repositories listed
-
Switch Trajectory Transformer with Distributional Value Approximation for Multi-Task Reinforcement Learning14 Mar 2022 0 repositories listed
-
The Multi-Agent Pickup and Delivery Problem: MAPF, MARL and Its Warehouse Applications14 Mar 2022 0 repositories listed
-
Uncertainty Estimation for Language Reward Models14 Mar 2022 0 repositories listed
-
DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning13 Mar 2022 0 repositories listed
-
Auto-FedRL: Federated Hyperparameter Optimization for Multi-institutional Medical Image Segmentation12 Mar 2022 0 repositories listed
-
Concentration Network for Reinforcement Learning of Large-Scale Multi-Agent Systems12 Mar 2022 0 repositories listed
-
A Machine Learning Approach for Prosumer Management in Intraday Electricity Markets11 Mar 2022 0 repositories listed
-
Active Phase-Encode Selection for Slice-Specific Fast MR Scanning Using a Transformer-Based Deep Reinforcement Learning Framework11 Mar 2022 0 repositories listed
-
Deep Binary Reinforcement Learning for Scalable Verification11 Mar 2022 0 repositories listed
-
Graph Neural Networks for Relational Inductive Bias in Vision-based Deep Reinforcement Learning of Robot Control11 Mar 2022 0 repositories listed
-
Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism11 Mar 2022 0 repositories listed
-
Reinforcement Learning for Linear Quadratic Control is Vulnerable Under Cost Manipulation11 Mar 2022 0 repositories listed
-
Action-Constrained Reinforcement Learning for Frame-Level Bit Allocation in HEVC/H.265 through Frank-Wolfe Policy Optimization10 Mar 2022 0 repositories listed
-
Breaking the Curse of Dimensionality in Multiagent State Space: A Unified Agent Permutation Framework10 Mar 2022 0 repositories listed
-
Artificial Intelligence in Vehicular Wireless Networks: A Case Study Using ns-310 Mar 2022 0 repositories listed
-
Learning Torque Control for Quadrupedal Locomotion10 Mar 2022 0 repositories listed
-
Random Ensemble Reinforcement Learning for Traffic Signal Control10 Mar 2022 0 repositories listed
-
Gym-saturation: an OpenAI Gym environment for saturation provers9 Mar 2022 0 repositories listed
-
Investigation of Factorized Optical Flows as Mid-Level Representations9 Mar 2022 0 repositories listed
-
Multi-robot Cooperative Pursuit via Potential Field-Enhanced Reinforcement Learning9 Mar 2022 0 repositories listed
-
A Complete Characterization of Linear Estimators for Offline Policy Evaluation8 Mar 2022 0 repositories listed
-
Distributed Control using Reinforcement Learning with Temporal-Logic-Based Reward Shaping8 Mar 2022 0 repositories listed
-
Graph-based Reinforcement Learning meets Mixed Integer Programs: An application to 3D robot assembly discovery8 Mar 2022 0 repositories listed
-
Designing Heterogeneous GNNs with Desired Permutation Properties for Wireless Resource Allocation8 Mar 2022 0 repositories listed
-
Multi-Agent Broad Reinforcement Learning for Intelligent Traffic Light Control8 Mar 2022 0 repositories listed
-
Policy-Based Bayesian Experimental Design for Non-Differentiable Implicit Models8 Mar 2022 0 repositories listed
-
Reinforced MOOCs Concept Recommendation in Heterogeneous Information Networks8 Mar 2022 0 repositories listed
-
Rényi State Entropy for Exploration Acceleration in Reinforcement Learning8 Mar 2022 0 repositories listed
-
Robot Learning of Mobile Manipulation with Reachability Behavior Priors8 Mar 2022 0 repositories listed
-
A Survey on Reinforcement Learning Methods in Character Animation7 Mar 2022 0 repositories listed
-
Cascaded Gaps: Towards Gap-Dependent Regret for Risk-Sensitive Reinforcement Learning7 Mar 2022 0 repositories listed
-
Efficient Policy Generation in Multi-Agent Systems via Hypergraph Neural Network7 Mar 2022 0 repositories listed
-
Fast and Data Efficient Reinforcement Learning from Pixels via Non-Parametric Value Approximation7 Mar 2022 0 repositories listed
-
Graph Neural Networks for Image Classification and Reinforcement Learning using Graph representations7 Mar 2022 0 repositories listed
-
Knowledge Transfer in Deep Reinforcement Learning for Slice-Aware Mobility Robustness Optimization7 Mar 2022 0 repositories listed
-
Learn to Match with No Regret: Reinforcement Learning in Markov Matching Markets7 Mar 2022 0 repositories listed
-
Reinforcement Learning for Location-Aware Scheduling7 Mar 2022 0 repositories listed
-
Black-Box Safety Validation of Autonomous Systems: A Multi-Fidelity Reinforcement Learning Approach7 Mar 2022 0 repositories listed
-
Scalable multi-agent reinforcement learning for distributed control of residential energy flexibility7 Mar 2022 0 repositories listed
-
Deep Reinforcement Learning based Model-free On-line Dynamic Multi-Microgrid Formation to Enhance Resilience6 Mar 2022 0 repositories listed
-
Depthwise Convolution for Multi-Agent Communication with Enhanced Mean-Field Approximation6 Mar 2022 0 repositories listed
-
Hierarchically Structured Scheduling and Execution of Tasks in a Multi-Agent Environment6 Mar 2022 0 repositories listed
-
Leveraging Reward Gradients For Reinforcement Learning in Differentiable Physics Simulations6 Mar 2022 0 repositories listed
-
Offline Deep Reinforcement Learning for Dynamic Pricing of Consumer Credit6 Mar 2022 0 repositories listed
-
Recursive Reasoning Graph for Multi-Agent Reinforcement Learning6 Mar 2022 0 repositories listed
-
Watch from sky: machine-learning-based multi-UAV network for predictive police surveillance6 Mar 2022 0 repositories listed
-
Safe Reinforcement Learning for Legged Locomotion5 Mar 2022 0 repositories listed
-
Target Network and Truncation Overcome The Deadly Triad in Q-Learning5 Mar 2022 0 repositories listed
-
Cloud-Edge Training Architecture for Sim-to-Real Deep Reinforcement Learning4 Mar 2022 0 repositories listed
-
GraspARL: Dynamic Grasping via Adversarial Reinforcement Learning4 Mar 2022 0 repositories listed
-
Reinforcement Learning in Modern Biostatistics: Constructing Optimal Adaptive Interventions4 Mar 2022 0 repositories listed
-
Bilateral Deep Reinforcement Learning Approach for Better-than-human Car Following Model3 Mar 2022 0 repositories listed
-
Deep Q-network using reservoir computing with multi-layered readout3 Mar 2022 0 repositories listed
-
Intrinsically-Motivated Reinforcement Learning: A Brief Introduction3 Mar 2022 0 repositories listed
-
Optimized cost function for demand response coordination of multiple EV charging stations using reinforcement learning3 Mar 2022 0 repositories listed
-
Quantum Reinforcement Learning via Policy Iteration3 Mar 2022 0 repositories listed
-
The Best of Both Worlds: Reinforcement Learning with Logarithmic Regret and Policy Switches3 Mar 2022 0 repositories listed
-
Follow your Nose: Using General Value Functions for Directed Exploration in Reinforcement Learning2 Mar 2022 0 repositories listed
-
Learning in Sparse Rewards settings through Quality-Diversity algorithms2 Mar 2022 0 repositories listed
-
Pareto Frontier Approximation Network (PA-Net) to Solve Bi-objective TSP2 Mar 2022 0 repositories listed
-
Reliable validation of Reinforcement Learning Benchmarks2 Mar 2022 0 repositories listed
-
A Theory of Abstraction in Reinforcement Learning1 Mar 2022 0 repositories listed
-
Approximating a deep reinforcement learning docking agent using linear model trees1 Mar 2022 0 repositories listed
-
Distributional Reinforcement Learning for Scheduling of Chemical Production Processes1 Mar 2022 0 repositories listed
-
DreamingV2: Reinforcement Learning with Discrete World Models without Reconstruction1 Mar 2022 0 repositories listed
-
Explaining a Deep Reinforcement Learning Docking Agent Using Linear Model Trees with User Adapted Visualization1 Mar 2022 0 repositories listed
-
A Survey on Recent Advances and Challenges in Reinforcement Learning Methods for Task-Oriented Dialogue Policy Learning28 Feb 2022 0 repositories listed
-
Pessimistic Q-Learning for Offline Reinforcement Learning: Towards Optimal Sample Complexity28 Feb 2022 0 repositories listed
-
Provably Efficient Convergence of Primal-Dual Actor-Critic with Nonlinear Function Approximation28 Feb 2022 0 repositories listed
-
Weakly Supervised Disentangled Representation for Goal-conditioned Reinforcement Learning28 Feb 2022 0 repositories listed
-
Neural-Progressive Hedging: Enforcing Constraints in Reinforcement Learning with Stochastic Programming27 Feb 2022 0 repositories listed
-
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions26 Feb 2022 0 repositories listed