Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 83
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 83 of 152: papers 8,201 to 8,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Contact-Safe Reinforcement Learning Framework for Contact-Rich Robot Manipulation27 Jul 2022 0 repositories listed
-
Distributional Actor-Critic Ensemble for Uncertainty-Aware Continuous Control27 Jul 2022 0 repositories listed
-
Dynamic Shielding for Reinforcement Learning in Black-Box Environments27 Jul 2022 0 repositories listed
-
Multi-Objective Provisioning of Network Slices using Deep Reinforcement Learning27 Jul 2022 0 repositories listed
-
POSET-RL: Phase ordering for Optimizing Size and Execution Time using Reinforcement Learning27 Jul 2022 0 repositories listed
-
Structural Similarity for Improved Transfer in Reinforcement Learning27 Jul 2022 0 repositories listed
-
Unsupervised Training for Neural TSP Solver27 Jul 2022 0 repositories listed
-
Branch Ranking for Efficient Mixed-Integer Programming via Offline Ranking-based Policy Learning26 Jul 2022 0 repositories listed
-
Offline Reinforcement Learning at Multiple Frequencies26 Jul 2022 0 repositories listed
-
Planning and Learning: Path-Planning for Autonomous Vehicles, a Review of the Literature26 Jul 2022 0 repositories listed
-
Semi-analytical Industrial Cooling System Model for Reinforcement Learning26 Jul 2022 0 repositories listed
-
Cooperative Actor-Critic via TD Error Aggregation25 Jul 2022 0 repositories listed
-
Dynamic Planning in Open-Ended Dialogue using Reinforcement Learning25 Jul 2022 0 repositories listed
-
Flowsheet synthesis through hierarchical reinforcement learning and graph neural networks25 Jul 2022 0 repositories listed
-
Adaptive Asynchronous Control Using Meta-learned Neural Ordinary Differential Equations25 Jul 2022 0 repositories listed
-
Online Reinforcement Learning for Periodic MDP25 Jul 2022 0 repositories listed
-
REPNP: Plug-and-Play with Deep Reinforcement Learning Prior for Robust Image Restoration25 Jul 2022 0 repositories listed
-
Adaptive Decision Making at the Intersection for Autonomous Vehicles Based on Skill Discovery24 Jul 2022 0 repositories listed
-
Anti-Overestimation Dialogue Policy Learning for Task-Completion Dialogue System24 Jul 2022 0 repositories listed
-
Epersist: A Self Balancing Robot Using PID Controller And Deep Reinforcement Learning23 Jul 2022 0 repositories listed
-
Halftoning with Multi-Agent Deep Reinforcement Learning23 Jul 2022 0 repositories listed
-
Learn Continuously, Act Discretely: Hybrid Action-Space Reinforcement Learning For Optimal Execution22 Jul 2022 0 repositories listed
-
Addressing Optimism Bias in Sequence Modeling for Reinforcement Learning21 Jul 2022 0 repositories listed
-
Multi-Asset Closed-Loop Reservoir Management Using Deep Reinforcement Learning21 Jul 2022 0 repositories listed
-
Strategising template-guided needle placement for MR-targeted prostate biopsy21 Jul 2022 0 repositories listed
-
Detecting Small Query Graphs in A Large Graph via Neural Subgraph Search21 Jul 2022 0 repositories listed
-
Towards Robust On-Ramp Merging via Augmented Multimodal Reinforcement Learning21 Jul 2022 0 repositories listed
-
Quantifying the Effect of Feedback Frequency in Interactive Reinforcement Learning for Robotic Tasks20 Jul 2022 0 repositories listed
-
Actor-Critic based Improper Reinforcement Learning19 Jul 2022 0 repositories listed
-
Feasible Adversarial Robust Reinforcement Learning for Underspecified Environments19 Jul 2022 0 repositories listed
-
Few-Shot Teamwork19 Jul 2022 0 repositories listed
-
Learning Action Translator for Meta Reinforcement Learning on Sparse-Reward Tasks19 Jul 2022 0 repositories listed
-
New Auction Algorithms for Path Planning, Network Transport, and Reinforcement Learning19 Jul 2022 0 repositories listed
-
On Decentralizing Federated Reinforcement Learning in Multi-Robot Scenarios19 Jul 2022 0 repositories listed
-
Riemannian Stochastic Gradient Method for Nested Composition Optimization19 Jul 2022 0 repositories listed
-
A Few Expert Queries Suffices for Sample-Efficient RL with Resets and Linear Value Approximation18 Jul 2022 0 repositories listed
-
An Information-Theoretic Analysis of Bayesian Reinforcement Learning18 Jul 2022 0 repositories listed
-
Boolean Decision Rules for Reinforcement Learning Policy Summarisation18 Jul 2022 0 repositories listed
-
MAD for Robust Reinforcement Learning in Machine Translation18 Jul 2022 0 repositories listed
-
MLGOPerf: An ML Guided Inliner to Optimize Performance18 Jul 2022 0 repositories listed
-
A framework for online, stabilizing reinforcement learning18 Jul 2022 0 repositories listed
-
Context sequence theory: a common explanation for multiple types of learning17 Jul 2022 0 repositories listed
-
DIMBA: Discretely Masked Black-Box Attack in Single Object Tracking17 Jul 2022 0 repositories listed
-
Minimum Description Length Control17 Jul 2022 0 repositories listed
-
Reinforcement Learning For Survival, A Clinically Motivated Method For Critically Ill Patients17 Jul 2022 0 repositories listed
-
Robust Action Governor for Uncertain Piecewise Affine Systems with Non-convex Constraints and Safe Reinforcement Learning17 Jul 2022 0 repositories listed
-
Associative Memory Based Experience Replay for Deep Reinforcement Learning16 Jul 2022 0 repositories listed
-
BCRLSP: An Offline Reinforcement Learning Framework for Sequential Targeted Promotion16 Jul 2022 0 repositories listed
-
Deep Hedging: Continuous Reinforcement Learning for Hedging of General Portfolios across Multiple Risk Aversions15 Jul 2022 0 repositories listed
-
Optimizing Data Collection in Deep Reinforcement Learning15 Jul 2022 0 repositories listed
-
Outcome-Guided Counterfactuals for Reinforcement Learning Agents from a Jointly Trained Generative Latent Space15 Jul 2022 0 repositories listed
-
Skill-based Model-based Reinforcement Learning15 Jul 2022 0 repositories listed
-
The Nature of Temporal Difference Errors in Multi-step Distributional Reinforcement Learning15 Jul 2022 0 repositories listed
-
Covy: An AI-powered Robot with a Compound Vision System for Detecting Breaches in Social Distancing14 Jul 2022 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning-Driven Mitigation of Adverse Effects of Cyber-Attacks on Electric Vehicle Charging Station14 Jul 2022 0 repositories listed
-
A Reinforcement Learning-based Offensive semantics Censorship System for Chatbots13 Jul 2022 0 repositories listed
-
Continual Meta-Reinforcement Learning for UAV-Aided Vehicular Wireless Networks13 Jul 2022 0 repositories listed
-
GriddlyJS: A Web IDE for Reinforcement Learning13 Jul 2022 0 repositories listed
-
Policy Optimization with Sparse Global Contrastive Explanations13 Jul 2022 0 repositories listed
-
Scheduling Out-of-Coverage Vehicular Communications Using Reinforcement Learning13 Jul 2022 0 repositories listed
-
Self-Play PSRO: Toward Optimal Populations in Two-Player Zero-Sum Games13 Jul 2022 0 repositories listed
-
Optimistic PAC Reinforcement Learning: the Instance-Dependent View12 Jul 2022 0 repositories listed
-
PAC Reinforcement Learning for Predictive State Representations12 Jul 2022 0 repositories listed
-
Towards Global Optimality in Cooperative MARL with the Transformation And Distillation Framework12 Jul 2022 0 repositories listed
-
Don't Start From Scratch: Leveraging Prior Data to Automate Robotic Reinforcement Learning11 Jul 2022 0 repositories listed
-
Learning Temporally Extended Skills in Continuous Domains as Symbolic Actions for Planning11 Jul 2022 0 repositories listed
-
Reinforcement Learning–Based Transient Response Shaping for Microgrids11 Jul 2022 0 repositories listed
-
State Dropout-Based Curriculum Reinforcement Learning for Self-Driving at Unsignalized Intersections10 Jul 2022 0 repositories listed
-
Deep Reinforcement Learning for Long-Term Voltage Stability Control9 Jul 2022 0 repositories listed
-
Ablation Study of How Run Time Assurance Impacts the Training and Performance of Reinforcement Learning Agents8 Jul 2022 0 repositories listed
-
High Performance Simulation for Scalable Multi-Agent Reinforcement Learning8 Jul 2022 0 repositories listed
-
Safe reinforcement learning for multi-energy management systems with known constraint functions8 Jul 2022 0 repositories listed
-
Domain Adapting Deep Reinforcement Learning for Real-world Speech Emotion Recognition7 Jul 2022 0 repositories listed
-
DRL-ISP: Multi-Objective Camera ISP with Deep Reinforcement Learning7 Jul 2022 0 repositories listed
-
Evaluating Human-like Explanations for Robot Actions in Reinforcement Learning Scenarios7 Jul 2022 0 repositories listed
-
gym-DSSAT: a crop model turned into a Reinforcement Learning environment7 Jul 2022 0 repositories listed
-
Multi-objective Optimization of Notifications Using Offline Reinforcement Learning7 Jul 2022 0 repositories listed
-
Reinforcement Learning for Distributed Transient Frequency Control with Stability and Safety Guarantees7 Jul 2022 0 repositories listed
-
Variational multiscale reinforcement learning for discovering reduced order closure models of nonlinear spatiotemporal transport systems7 Jul 2022 0 repositories listed
-
Vessel-following model for inland waterways based on deep reinforcement learning7 Jul 2022 0 repositories listed
-
Inferring and Conveying Intentionality: Beyond Numerical Rewards to Logical Intentions6 Jul 2022 0 repositories listed
-
Instance-Dependent Near-Optimal Policy Identification in Linear MDPs via Online Experiment Design6 Jul 2022 0 repositories listed
-
Model Selection in Reinforcement Learning with General Function Approximations6 Jul 2022 0 repositories listed
-
Reinforcement Learning Portfolio Manager Framework with Monte Carlo Simulation6 Jul 2022 0 repositories listed
-
AVDDPG: Federated reinforcement learning applied to autonomous platoon control5 Jul 2022 0 repositories listed
-
Decentralized scheduling through an adaptive, trading-based multi-agent system5 Jul 2022 0 repositories listed
-
Deep Reinforcement Learning Approach for Trading Automation in The Stock Market5 Jul 2022 0 repositories listed
-
Explainability in Deep Reinforcement Learning, a Review into Current Methods and Applications5 Jul 2022 0 repositories listed
-
Planning with RL and episodic-memory behavioral priors5 Jul 2022 0 repositories listed
-
Resource Allocation in Multicore Elastic Optical Networks: A Deep Reinforcement Learning Approach5 Jul 2022 0 repositories listed
-
Tackling Real-World Autonomous Driving using Deep Reinforcement Learning5 Jul 2022 0 repositories listed
-
Safe Reinforcement Learning via Confidence-Based Filters4 Jul 2022 0 repositories listed
-
Deep Bellman Hedging3 Jul 2022 0 repositories listed
-
Government Intervention in Catastrophe Insurance Markets: A Reinforcement Learning Approach3 Jul 2022 0 repositories listed
-
q-Learning in Continuous Time2 Jul 2022 0 repositories listed
-
Reinforcement Learning Approaches for the Orienteering Problem with Stochastic and Dynamic Release Dates2 Jul 2022 0 repositories listed
-
Safe Reinforcement Learning for a Robot Being Pursued but with Objectives Covering More Than Capture-avoidance2 Jul 2022 0 repositories listed
-
A Shoulder to Cry on: Towards A Motivational Virtual Assistant for Assuaging Mental Agony1 Jul 2022 0 repositories listed
-
Action-modulated midbrain dopamine activity arises from distributed control policies1 Jul 2022 0 repositories listed
-
Agent with Tangent-based Formulation and Anatomical Perception for Standard Plane Localization in 3D Ultrasound1 Jul 2022 0 repositories listed