Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 73
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 73 of 152: papers 7,201 to 7,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Look-Ahead AC Optimal Power Flow: A Model-Informed Reinforcement Learning Approach4 Mar 2023 0 repositories listed
-
Wasserstein Actor-Critic: Directed Exploration via Optimism for Continuous-Actions Control4 Mar 2023 0 repositories listed
-
Approximating Energy Market Clearing and Bidding With Model-Based Reinforcement Learning3 Mar 2023 0 repositories listed
-
Guarded Policy Optimization with Imperfect Online Demonstrations3 Mar 2023 0 repositories listed
-
Hindsight States: Blending Sim and Real Task Elements for Efficient Reinforcement Learning3 Mar 2023 0 repositories listed
-
Intelligent O-RAN Traffic Steering for URLLC Through Deep Reinforcement Learning3 Mar 2023 0 repositories listed
-
Learning to Influence Human Behavior with Offline Reinforcement Learning3 Mar 2023 0 repositories listed
-
RePreM: Representation Pre-training with Masked Model for Reinforcement Learning3 Mar 2023 0 repositories listed
-
Tile Networks: Learning Optimal Geometric Layout for Whole-page Recommendation3 Mar 2023 0 repositories listed
-
Toward Risk-based Optimistic Exploration for Cooperative Multi-Agent Reinforcement Learning3 Mar 2023 0 repositories listed
-
Co-learning Planning and Control Policies Constrained by Differentiable Logic Specifications2 Mar 2023 0 repositories listed
-
Compensating for Sensing Failures via Delegation in Human-AI Hybrid Systems2 Mar 2023 0 repositories listed
-
Data-efficient, Explainable and Safe Box Manipulation: Illustrating the Advantages of Physical Priors in Model-Predictive Control2 Mar 2023 0 repositories listed
-
Domain Adaptation of Reinforcement Learning Agents based on Network Service Proximity2 Mar 2023 0 repositories listed
-
Expert-Free Online Transfer Learning in Multi-Agent Reinforcement Learning2 Mar 2023 0 repositories listed
-
Multi-Start Team Orienteering Problem for UAS Mission Re-Planning with Data-Efficient Deep Reinforcement Learning2 Mar 2023 0 repositories listed
-
Parameter Sharing with Network Pruning for Scalable Multi-Agent Deep Reinforcement Learning2 Mar 2023 0 repositories listed
-
Reinforced Labels: Multi-Agent Deep Reinforcement Learning for Point-Feature Label Placement2 Mar 2023 0 repositories listed
-
Resource-Constrained Station-Keeping for Helium Balloons using Reinforcement Learning2 Mar 2023 0 repositories listed
-
Self-Improving Robots: End-to-End Autonomous Visuomotor Reinforcement Learning2 Mar 2023 0 repositories listed
-
T-Cell Receptor Optimization with Reinforcement Learning and Mutation Policies for Precesion Immunotherapy2 Mar 2023 0 repositories listed
-
The Ladder in Chaos: A Simple and Effective Improvement to General DRL Algorithms by Policy Path Trimming and Boosting2 Mar 2023 0 repositories listed
-
A Deep Reinforcement Learning Trader without Offline Training1 Mar 2023 0 repositories listed
-
A Variational Approach to Mutual Information-Based Coordination for Multi-Agent Reinforcement Learning1 Mar 2023 0 repositories listed
-
AR3n: A Reinforcement Learning-based Assist-As-Needed Controller for Robotic Rehabilitation28 Feb 2023 0 repositories listed
-
Auxiliary Task-based Deep Reinforcement Learning for Quantum Control28 Feb 2023 0 repositories listed
-
Efficient Exploration Using Extra Safety Budget in Constrained Policy Optimization28 Feb 2023 0 repositories listed
-
Graph Reinforcement Learning for Operator Selection in the ALNS Metaheuristic28 Feb 2023 0 repositories listed
-
Hierarchical Reinforcement Learning in Complex 3D Environments28 Feb 2023 0 repositories listed
-
Minimizing the Outage Probability in a Markov Decision Process28 Feb 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning for Pragmatic Communication and Control28 Feb 2023 0 repositories listed
-
Parameter Optimization of LLC-Converter with multiple operation points using Reinforcement Learning28 Feb 2023 0 repositories listed
-
A Reinforcement Learning Approach for Scheduling Problems With Improved Generalization Through Order Swapping27 Feb 2023 0 repositories listed
-
Distributional Method for Risk Averse Reinforcement Learning27 Feb 2023 0 repositories listed
-
Dynamic Resource Allocation for Metaverse Applications with Deep Reinforcement Learning27 Feb 2023 0 repositories listed
-
Exposure-Based Multi-Agent Inspection of a Tumbling Target Using Deep Reinforcement Learning27 Feb 2023 0 repositories listed
-
Reinforcement Learning with Depreciating Assets27 Feb 2023 0 repositories listed
-
The Provable Benefits of Unsupervised Data Sharing for Offline Reinforcement Learning27 Feb 2023 0 repositories listed
-
Q-Cogni: An Integrated Causal Reinforcement Learning Framework26 Feb 2023 0 repositories listed
-
Revolutionizing Genomics with Reinforcement Learning Techniques26 Feb 2023 0 repositories listed
-
Sim-and-Real Reinforcement Learning for Manipulation: A Consensus-based Approach26 Feb 2023 0 repositories listed
-
A Human-Centered Safe Robot Reinforcement Learning Framework with Interactive Behaviors25 Feb 2023 0 repositories listed
-
Exponential Hardness of Reinforcement Learning with Linear Function Approximation25 Feb 2023 0 repositories listed
-
Limited Query Graph Connectivity Test25 Feb 2023 0 repositories listed
-
On Bellman's principle of optimality and Reinforcement learning for safety-constrained Markov decision process25 Feb 2023 0 repositories listed
-
AC2C: Adaptively Controlled Two-Hop Communication for Multi-Agent Reinforcement Learning24 Feb 2023 0 repositories listed
-
Finding Regularized Competitive Equilibria of Heterogeneous Agent Macroeconomic Models with Reinforcement Learning24 Feb 2023 0 repositories listed
-
GraphSR: A Data Augmentation Algorithm for Imbalanced Node Classification24 Feb 2023 0 repositories listed
-
Leveraging Jumpy Models for Planning and Fast Learning in Robotic Domains24 Feb 2023 0 repositories listed
-
Logarithmic Switching Cost in Reinforcement Learning beyond Linear MDPs24 Feb 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning with Common Policy for Antenna Tilt Optimization24 Feb 2023 0 repositories listed
-
Concept Learning for Interpretable Multi-Agent Reinforcement Learning23 Feb 2023 0 repositories listed
-
To the Noise and Back: Diffusion for Shared Autonomy23 Feb 2023 0 repositories listed
-
Provably Efficient Reinforcement Learning via Surprise Bound22 Feb 2023 0 repositories listed
-
Towards Decentralized Predictive Quality of Service in Next-Generation Vehicular Networks22 Feb 2023 0 repositories listed
-
A Reinforcement Learning Framework for Online Speaker Diarization21 Feb 2023 0 repositories listed
-
Adversarial Model for Offline Reinforcement Learning21 Feb 2023 0 repositories listed
-
BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT21 Feb 2023 0 repositories listed
-
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning21 Feb 2023 0 repositories listed
-
Constrained Reinforcement Learning for Predictive Control in Real-Time Stochastic Dynamic Optimal Power Flow21 Feb 2023 0 repositories listed
-
Curiosity-driven Exploration in Sparse-reward Multi-agent Reinforcement Learning21 Feb 2023 0 repositories listed
-
Deep Reinforcement Learning for Robotic Pushing and Picking in Cluttered Environment21 Feb 2023 0 repositories listed
-
Kernel-Based Distributed Q-Learning: A Scalable Reinforcement Learning Approach for Dynamic Treatment Regimes21 Feb 2023 0 repositories listed
-
Offline Reinforcement Learning for Mixture-of-Expert Dialogue Management21 Feb 2023 0 repositories listed
-
Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret21 Feb 2023 0 repositories listed
-
Reinforcement Learning-based Control of Nonlinear Systems using Carleman Approximation: Structured and Unstructured Designs21 Feb 2023 0 repositories listed
-
Reinforcement Learning for Block Decomposition of CAD Models21 Feb 2023 0 repositories listed
-
Reinforcement Learning in a Birth and Death Process: Breaking the Dependence on the State Space21 Feb 2023 0 repositories listed
-
Robust Auto-landing Control of an agile Regional Jet Using Fuzzy Q-learning21 Feb 2023 0 repositories listed
-
Towards a Sustainable Internet-of-Underwater-Things based on AUVs, SWIPT, and Reinforcement Learning21 Feb 2023 0 repositories listed
-
UAV Path Planning Employing MPC- Reinforcement Learning Method Considering Collision Avoidance21 Feb 2023 0 repositories listed
-
Backstepping Temporal Difference Learning20 Feb 2023 0 repositories listed
-
Differentiable Arbitrating in Zero-sum Markov Games20 Feb 2023 0 repositories listed
-
Reinforcement Learning with Function Approximation: From Linear to Nonlinear20 Feb 2023 0 repositories listed
-
Safe Deep Reinforcement Learning by Verifying Task-Level Properties20 Feb 2023 0 repositories listed
-
AutoDOViz: Human-Centered Automation for Decision Optimization19 Feb 2023 0 repositories listed
-
Compositionality and Bounds for Optimal Value Functions in Reinforcement Learning19 Feb 2023 0 repositories listed
-
Interactive Video Corpus Moment Retrieval using Reinforcement Learning19 Feb 2023 0 repositories listed
-
Robust and Versatile Bipedal Jumping Control through Reinforcement Learning19 Feb 2023 0 repositories listed
-
Effective Multimodal Reinforcement Learning with Modality Alignment and Importance Enhancement18 Feb 2023 0 repositories listed
-
Efficient Exploration via Epistemic-Risk-Seeking Policy Optimization18 Feb 2023 0 repositories listed
-
HOPE: Human-Centric Off-Policy Evaluation for E-Learning and Healthcare18 Feb 2023 0 repositories listed
-
Natural Language-conditioned Reinforcement Learning with Inside-out Task Language Development and Translation18 Feb 2023 0 repositories listed
-
Promoting Cooperation in Multi-Agent Reinforcement Learning via Mutual Help18 Feb 2023 0 repositories listed
-
Reinforcement Learning in the Wild with Maximum Likelihood-based Model Transfer18 Feb 2023 0 repositories listed
-
A State Augmentation based approach to Reinforcement Learning from Human Preferences17 Feb 2023 0 repositories listed
-
Data Driven Reward Initialization for Preference based Reinforcement Learning17 Feb 2023 0 repositories listed
-
Deep Reinforcement Learning for mmWave Initial Beam Alignment17 Feb 2023 0 repositories listed
-
Exploiting Unlabeled Data for Feedback Efficient Human Preference based Reinforcement Learning17 Feb 2023 0 repositories listed
-
Mixed Traffic Control and Coordination from Pixels17 Feb 2023 0 repositories listed
-
Learning to Forecast Aleatoric and Epistemic Uncertainties over Long Horizon Trajectories17 Feb 2023 0 repositories listed
-
Robot path planning using deep reinforcement learning17 Feb 2023 0 repositories listed
-
Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning16 Feb 2023 0 repositories listed
-
CERiL: Continuous Event-based Reinforcement Learning15 Feb 2023 0 repositories listed
-
Deep Offline Reinforcement Learning for Real-world Treatment Optimization Applications15 Feb 2023 0 repositories listed
-
Meta-Reinforcement Learning via Exploratory Task Clustering15 Feb 2023 0 repositories listed
-
Optimal Sample Complexity of Reinforcement Learning for Mixing Discounted Markov Decision Processes15 Feb 2023 0 repositories listed
-
Prioritized offline Goal-swapping Experience Replay15 Feb 2023 0 repositories listed
-
Reinforcement Learning Based Power Grid Day-Ahead Planning and AI-Assisted Control15 Feb 2023 0 repositories listed
-
Scalable Multi-Agent Reinforcement Learning with General Utilities15 Feb 2023 0 repositories listed