Browse State-of-the-Art › Deep Reinforcement Learning › Papers, page 31
Deep Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 5,822 · with a code link: 1,739 · where Syntology ran a sample: 398 (340 with a run with no instrument failure, 58 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (398 of 5,822 tagged: 340 with a run with no instrument failure, 58 where every run was a failure of Syntology's instrument)
Page 31 of 59: papers 3,001 to 3,100 of 5,822, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Value function estimation using conditional diffusion models for control9 Jun 2023 0 repositories listed
-
A framework for dynamically training and adapting deep reinforcement learning models to different, low-compute, and continuously changing radiology deployment environments8 Jun 2023 0 repositories listed
-
A newborn embodied Turing test for view-invariant object recognition8 Jun 2023 0 repositories listed
-
Learning to Navigate in Turbulent Flows with Aerial Robot Swarms: A Cooperative Deep Reinforcement Learning Approach7 Jun 2023 0 repositories listed
-
Reinforcement Learning-Based Control of CrazyFlie 2.X Quadrotor6 Jun 2023 0 repositories listed
-
A Novel Multi-Agent Deep RL Approach for Traffic Signal Control5 Jun 2023 0 repositories listed
-
Deep Q-Learning versus Proximal Policy Optimization: Performance Comparison in a Material Sorting Task2 Jun 2023 0 repositories listed
-
DVFO: Learning-Based DVFS for Energy-Efficient Edge-Cloud Collaborative Inference2 Jun 2023 0 repositories listed
-
Improving the generalizability and robustness of large-scale traffic signal control2 Jun 2023 0 repositories listed
-
BitE : Accelerating Learned Query Optimization in a Mixed-Workload Environment1 Jun 2023 0 repositories listed
-
Investigating Navigation Strategies in the Morris Water Maze through Deep Reinforcement Learning1 Jun 2023 0 repositories listed
-
Multi-environment lifelong deep reinforcement learning for medical imaging31 May 2023 0 repositories listed
-
FRAMM: Fair Ranking with Missing Modalities for Clinical Trial Site Selection30 May 2023 0 repositories listed
-
Action valuation of on- and off-ball soccer players based on multi-agent deep reinforcement learning29 May 2023 0 repositories listed
-
Doing the right thing for the right reason: Evaluating artificial moral cognition by probing cost insensitivity29 May 2023 0 repositories listed
-
Perimeter Control Using Deep Reinforcement Learning: A Model-free Approach towards Homogeneous Flow Rate Optimization29 May 2023 0 repositories listed
-
A Comprehensive Overview and Comparative Analysis on Deep Learning Models: CNN, RNN, LSTM, GRU27 May 2023 0 repositories listed
-
Lucy-SKG: Learning to Play Rocket League Efficiently Using Deep Reinforcement Learning25 May 2023 0 repositories listed
-
Deep Reinforcement Learning with Plasticity Injection24 May 2023 0 repositories listed
-
Successor-Predecessor Intrinsic Exploration24 May 2023 0 repositories listed
-
Control of a simulated MRI scanner with deep reinforcement learning23 May 2023 0 repositories listed
-
Deep Reinforcement Learning-based Multi-objective Path Planning on the Off-road Terrain Environment for Ground Vehicles23 May 2023 0 repositories listed
-
Research on Multi-Agent Communication and Collaborative Decision-Making Based on Deep Reinforcement Learning23 May 2023 0 repositories listed
-
RLBoost: Boosting Supervised Models using Deep Reinforcement Learning23 May 2023 0 repositories listed
-
Semantic-aware Transmission Scheduling: a Monotonicity-driven Deep Reinforcement Learning Approach23 May 2023 0 repositories listed
-
DexPBT: Scaling up Dexterous Manipulation for Hand-Arm Systems with Population Based Training20 May 2023 0 repositories listed
-
Game-Theoretical Analysis of Reviewer Rewards in Peer-Review Journal Systems: Analysis and Experimental Evaluation using Deep Reinforcement Learning20 May 2023 0 repositories listed
-
Automatic Design Method of Building Pipeline Layout Based on Deep Reinforcement Learning18 May 2023 0 repositories listed
-
Black-Box Targeted Reward Poisoning Attack Against Online Deep Reinforcement Learning18 May 2023 0 repositories listed
-
Deep Metric Tensor Regularized Policy Gradient18 May 2023 0 repositories listed
-
Deep PackGen: A Deep Reinforcement Learning Framework for Adversarial Network Packet Generation18 May 2023 0 repositories listed
-
DRL meets DSA Networks: Convergence Analysis and Its Application to System Design18 May 2023 0 repositories listed
-
Lyapunov-Driven Deep Reinforcement Learning for Edge Inference Empowered by Reconfigurable Intelligent Surfaces18 May 2023 0 repositories listed
-
Collective Large-scale Wind Farm Multivariate Power Output Control Based on Hierarchical Communication Multi-Agent Proximal Policy Optimization17 May 2023 0 repositories listed
-
Curriculum Learning in Job Shop Scheduling using Reinforcement Learning17 May 2023 0 repositories listed
-
A Deep RL Approach on Task Placement and Scaling of Edge Resources for Cellular Vehicle-to-Network Service Provisioning16 May 2023 0 repositories listed
-
Boosting Event Extraction with Denoised Structure-to-Text Augmentation16 May 2023 0 repositories listed
-
Deep Reinforcement Learning to Maximize Arterial Usage during Extreme Congestion16 May 2023 0 repositories listed
-
Identify, Estimate and Bound the Uncertainty of Reinforcement Learning for Autonomous Driving12 May 2023 0 repositories listed
-
Intelligent multicast routing method based on multi-agent deep reinforcement learning in SDWN12 May 2023 0 repositories listed
-
Deep Reinforcement Learning for Interference Management in UAV-based 3D Networks: Potentials and Challenges11 May 2023 0 repositories listed
-
Optimizing Memory Mapping Using Deep Reinforcement Learning11 May 2023 0 repositories listed
-
Deep Reinforcement Learning Based Resource Allocation for Cloud Native Wireless Network10 May 2023 0 repositories listed
-
Sequence-Agnostic Multi-Object Navigation10 May 2023 0 repositories listed
-
Assessment of Reinforcement Learning Algorithms for Nuclear Power Plant Fuel Optimization9 May 2023 0 repositories listed
-
Cooperating Graph Neural Networks with Deep Reinforcement Learning for Vaccine Prioritization9 May 2023 0 repositories listed
-
9 May 2023 0 repositories listed
-
Safe Deep RL for Intraoperative Planning of Pedicle Screw Placement9 May 2023 0 repositories listed
-
A Deep Reinforcement Learning-based Reserve Optimization in Active Distribution Systems for Tertiary Frequency Regulation7 May 2023 0 repositories listed
-
Rescue Conversations from Dead-ends: Efficient Exploration for Task-oriented Dialogue Policy Optimization5 May 2023 0 repositories listed
-
Deep Q-Learning-based Distribution Network Reconfiguration for Reliability Improvement2 May 2023 0 repositories listed
-
BCEdge: SLO-Aware DNN Inference Services with Adaptive Batching on Edge Platforms1 May 2023 0 repositories listed
-
Representations and Exploration for Deep Reinforcement Learning using Singular Value Decomposition1 May 2023 0 repositories listed
-
Optimal Scheduling in IoT-Driven Smart Isolated Microgrids Based on Deep Reinforcement Learning28 Apr 2023 0 repositories listed
-
Adversarial Policy Optimization in Deep Reinforcement Learning27 Apr 2023 0 repositories listed
-
BCQQ: Batch-Constraint Quantum Q-Learning with Cyclic Data Re-uploading27 Apr 2023 0 repositories listed
-
Cooperative Hierarchical Deep Reinforcement Learning based Joint Sleep and Power Control in RIS-aided Energy-Efficient RAN26 Apr 2023 0 repositories listed
-
Learning Agile Soccer Skills for a Bipedal Robot with Deep Reinforcement Learning26 Apr 2023 0 repositories listed
-
A optimization framework for herbal prescription planning based on deep reinforcement learning25 Apr 2023 0 repositories listed
-
Federated Deep Reinforcement Learning for THz-Beam Search with Limited CSI25 Apr 2023 0 repositories listed
-
Roll-Drop: accounting for observation noise with a single parameter25 Apr 2023 0 repositories listed
-
Efficient Halftoning via Deep Reinforcement Learning24 Apr 2023 0 repositories listed
-
Parallel bootstrap-based on-policy deep reinforcement learning for continuous flow control applications24 Apr 2023 0 repositories listed
-
Bridging Declarative, Procedural, and Conditional Metacognitive Knowledge Gap Using Deep Reinforcement Learning23 Apr 2023 0 repositories listed
-
Two-Memory Reinforcement Learning20 Apr 2023 0 repositories listed
-
Autonomous Agent for Beyond Visual Range Air Combat: A Deep Reinforcement Learning Approach19 Apr 2023 0 repositories listed
-
Long-Term Fairness with Unknown Dynamics19 Apr 2023 0 repositories listed
-
Alzheimers Disease Diagnosis using Machine Learning: A Review17 Apr 2023 0 repositories listed
-
Deep Explainable Relational Reinforcement Learning: A Neuro-Symbolic Approach17 Apr 2023 0 repositories listed
-
Integration of Reinforcement Learning Based Behavior Planning With Sampling Based Motion Planning for Automated Driving17 Apr 2023 0 repositories listed
-
Leveraging Deep Reinforcement Learning for Metacognitive Interventions across Intelligent Tutoring Systems17 Apr 2023 0 repositories listed
-
Reclaimer: A Reinforcement Learning Approach to Dynamic Resource Allocation for Cloud Microservices17 Apr 2023 0 repositories listed
-
Context-aware Domain Adaptation for Time Series Anomaly Detection15 Apr 2023 0 repositories listed
-
MvCo-DoT:Multi-View Contrastive Domain Transfer Network for Medical Report Generation15 Apr 2023 0 repositories listed
-
Deep reinforcement learning applied to an assembly sequence planning problem with user preferences13 Apr 2023 0 repositories listed
-
Active RIS-aided EH-NOMA Networks: A Deep Reinforcement Learning Approach11 Apr 2023 0 repositories listed
-
Real-Time Model-Free Deep Reinforcement Learning for Force Control of a Series Elastic Actuator11 Apr 2023 0 repositories listed
-
Reinforcement Learning Tutor Better Supported Lower Performers in a Math Task11 Apr 2023 0 repositories listed
-
A modular framework for stabilizing deep reinforcement learning control7 Apr 2023 0 repositories listed
-
Deep Reinforcement Learning Based Optimal Infinite-Horizon Control of Probabilistic Boolean Control Networks7 Apr 2023 0 repositories listed
-
Full Gradient Deep Reinforcement Learning for Average-Reward Criterion7 Apr 2023 0 repositories listed
-
Deep Reinforcement Learning Based Vehicle Selection for Asynchronous Federated Learning Enabled Vehicular Edge Computing6 Apr 2023 0 repositories listed
-
Optimal Energy Storage Scheduling for Wind Curtailment Reduction and Energy Arbitrage: A Deep Reinforcement Learning Approach5 Apr 2023 0 repositories listed
-
Optimizing Irrigation Efficiency using Deep Reinforcement Learning in the Field4 Apr 2023 0 repositories listed
-
Regularization of the policy updates for stabilizing Mean Field Games4 Apr 2023 0 repositories listed
-
Enabling A Network AI Gym for Autonomous Cyber Agents3 Apr 2023 0 repositories listed
-
Optimal Semantic-aware Sampling and Transmission in Energy Harvesting Systems Through the AoII3 Apr 2023 0 repositories listed
-
Unified Emulation-Simulation Training Environment for Autonomous Cyber Agents3 Apr 2023 0 repositories listed
-
Multi-Microgrid Collaborative Optimization Scheduling Using an Improved Multi-Agent Soft Actor-Critic Algorithm1 Apr 2023 0 repositories listed
-
Learning Complicated Manipulation Skills via Deterministic Policy with Limited Demonstrations29 Mar 2023 0 repositories listed
-
Physical Deep Reinforcement Learning Towards Safety Guarantee29 Mar 2023 0 repositories listed
-
Quantum Deep Hedging29 Mar 2023 0 repositories listed
-
Adaptive Background Music for a Fighting Game: A Multi-Instrument Volume Modulation Approach28 Mar 2023 0 repositories listed
-
On the Use of Reinforcement Learning for Attacking and Defending Load Frequency Control28 Mar 2023 0 repositories listed
-
Bi-Manual Block Assembly via Sim-to-Real Reinforcement Learning27 Mar 2023 0 repositories listed
-
Optimal Smoothing Distribution Exploration for Backdoor Neutralization in Deep Learning-based Traffic Systems24 Mar 2023 0 repositories listed
-
Robust Path Following on Rivers Using Bootstrapped Reinforcement Learning24 Mar 2023 0 repositories listed
-
Connected Superlevel Set in (Deep) Reinforcement Learning and its Application to Minimax Theorems23 Mar 2023 0 repositories listed
-
Deep Reinforcement Learning for Localizability-Enhanced Navigation in Dynamic Human Environments22 Mar 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.