Browse State-of-the-Art › Deep Reinforcement Learning › Papers, page 23
Deep Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 5,822 · with a code link: 1,739 · where Syntology ran a sample: 398 (340 with a run with no instrument failure, 58 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (398 of 5,822 tagged: 340 with a run with no instrument failure, 58 where every run was a failure of Syntology's instrument)
Page 23 of 59: papers 2,201 to 2,300 of 5,822, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Advanced Persistent Threats (APT) Attribution Using Deep Reinforcement Learning15 Oct 2024 0 repositories listed
-
Communication-Control Codesign for Large-Scale Wireless Networked Control Systems15 Oct 2024 0 repositories listed
-
Physical Informed-Inspired Deep Reinforcement Learning Based Bi-Level Programming for Microgrid Scheduling15 Oct 2024 0 repositories listed
-
Solving The Dynamic Volatility Fitting Problem: A Deep Reinforcement Learning Approach15 Oct 2024 0 repositories listed
-
Compositional Shielding and Reinforcement Learning for Multi-Agent Systems14 Oct 2024 0 repositories listed
-
Continual Deep Reinforcement Learning to Prevent Catastrophic Forgetting in Jamming Mitigation14 Oct 2024 0 repositories listed
-
DR-MPC: Deep Residual Model Predictive Control for Real-world Social Navigation14 Oct 2024 0 repositories listed
-
Enhancing Robustness in Deep Reinforcement Learning: A Lyapunov Exponent Approach14 Oct 2024 0 repositories listed
-
MAD-TD: Model-Augmented Data stabilizes High Update Ratio RL11 Oct 2024 0 repositories listed
-
Multi-Agent Actor-Critics in Autonomous Cyber Defense11 Oct 2024 0 repositories listed
-
Masked Generative Priors Improve World Models Sequence Modelling Capabilities10 Oct 2024 0 repositories listed
-
Neuroplastic Expansion in Deep Reinforcement Learning10 Oct 2024 0 repositories listed
-
Large Vision Model-Enhanced Digital Twin with Deep Reinforcement Learning for User Association and Load Balancing in Dynamic Wireless Networks10 Oct 2024 0 repositories listed
-
Variations in Multi-Agent Actor-Critic Frameworks for Joint Optimizations in UAV Swarm Networks: Recent Evolution, Challenges, and Directions9 Oct 2024 0 repositories listed
-
AAAI Workshop on AI Planning for Cyber-Physical Systems -- CAIPI248 Oct 2024 0 repositories listed
-
Learning-Based Shielding for Safe Autonomy under Unknown Dynamics7 Oct 2024 0 repositories listed
-
Training Interactive Agent in Large FPS Game Map with Rule-enhanced Reinforcement Learning7 Oct 2024 0 repositories listed
-
Toward Debugging Deep Reinforcement Learning Programs with RLExplorer6 Oct 2024 0 repositories listed
-
Latent Action Priors for Locomotion with Deep Reinforcement Learning4 Oct 2024 0 repositories listed
-
Joint Channel Selection using FedDRL in V2X3 Oct 2024 0 repositories listed
-
Leveraging Event Streams with Deep Reinforcement Learning for End-to-End UAV Tracking3 Oct 2024 0 repositories listed
-
Semantic-Guided RL for Interpretable Feature Engineering3 Oct 2024 0 repositories listed
-
Finding path and cycle counting formulae in graphs with Deep Reinforcement Learning2 Oct 2024 0 repositories listed
-
Generative Diffusion-based Contract Design for Efficient AI Twins Migration in Vehicular Embodied AI Networks2 Oct 2024 0 repositories listed
-
Life, uh, Finds a Way: Systematic Neural Search2 Oct 2024 0 repositories listed
-
Realizable Continuous-Space Shields for Safe Reinforcement Learning2 Oct 2024 0 repositories listed
-
A transformer-based deep reinforcement learning approach to spatial navigation in a partially observable Morris Water Maze1 Oct 2024 0 repositories listed
-
Contrastive Abstraction for Reinforcement Learning1 Oct 2024 0 repositories listed
-
IoV-Oriented Integrated Sensing, Computation, and Communication: System Design and Resource Allocation1 Oct 2024 0 repositories listed
-
Adaptive Data Transport Mechanism for UAV Surveillance Missions in Lossy Environments30 Sep 2024 0 repositories listed
-
Meta Reinforcement Learning Approach for Adaptive Resource Optimization in O-RAN30 Sep 2024 0 repositories listed
-
Personalisation via Dynamic Policy Fusion30 Sep 2024 0 repositories listed
-
Methods for Mitigating Uncertainty in Real-Time Operations of a Connected Microgrid29 Sep 2024 0 repositories listed
-
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing28 Sep 2024 0 repositories listed
-
Refutation of Spectral Graph Theory Conjectures with Search Algorithms)27 Sep 2024 0 repositories listed
-
Robust Deep Reinforcement Learning for Volt-VAR Optimization in Active Distribution System under Uncertainty27 Sep 2024 0 repositories listed
-
Hierarchical End-to-End Autonomous Driving: Integrating BEV Perception with Deep Reinforcement Learning26 Sep 2024 0 repositories listed
-
Navigation in a simplified Urban Flow through Deep Reinforcement Learning26 Sep 2024 0 repositories listed
-
A Survey for Deep Reinforcement Learning Based Network Intrusion Detection25 Sep 2024 0 repositories listed
-
AI-Driven Risk-Aware Scheduling for Active Debris Removal Missions25 Sep 2024 0 repositories listed
-
Asynchronous Fractional Multi-Agent Deep Reinforcement Learning for Age-Minimal Mobile Edge Computing25 Sep 2024 0 repositories listed
-
Learning Bipedal Walking for Humanoid Robots in Challenging Environments with Obstacle Avoidance25 Sep 2024 0 repositories listed
-
Reinforcement Learning for Finite Space Mean-Field Type Games25 Sep 2024 0 repositories listed
-
Revisiting Space Mission Planning: A Reinforcement Learning-Guided Approach for Multi-Debris Rendezvous25 Sep 2024 0 repositories listed
-
Uncertainty Representations in State-Space Layers for Deep Reinforcement Learning under Partial Observability25 Sep 2024 0 repositories listed
-
A Critical Review of Safe Reinforcement Learning Techniques in Smart Grid Applications24 Sep 2024 0 repositories listed
-
Artificial Intelligence for Secured Information Systems in Smart Cities: Collaborative IoT Computing with Deep Reinforcement Learning and Blockchain24 Sep 2024 0 repositories listed
-
Online Planning for Multi-UAV Pursuit-Evasion in Unknown Environments Using Deep Reinforcement Learning24 Sep 2024 0 repositories listed
-
Neural Coordination and Capacity Control for Inventory Management24 Sep 2024 0 repositories listed
-
Deep Reinforcement Learning-based Obstacle Avoidance for Robot Movement in Warehouse Environments23 Sep 2024 0 repositories listed
-
SPformer: A Transformer Based DRL Decision Making Method for Connected Automated Vehicles23 Sep 2024 0 repositories listed
-
UAV-Enabled Data Collection for IoT Networks via Rainbow Learning22 Sep 2024 0 repositories listed
-
Optimizing Job Shop Scheduling in the Furniture Industry: A Reinforcement Learning Approach Considering Machine Setup, Batch Variability, and Intralogistics18 Sep 2024 0 repositories listed
-
Automating proton PBS treatment planning for head and neck cancers using policy gradient-based deep reinforcement learning17 Sep 2024 0 repositories listed
-
Disentangling Uncertainty for Safe Social Navigation using Deep Reinforcement Learning16 Sep 2024 0 repositories listed
-
SHIRE: Enhancing Sample Efficiency using Human Intuition in REinforcement Learning16 Sep 2024 0 repositories listed
-
Deep reinforcement learning for tracking a moving target in jellyfish-like swimming13 Sep 2024 0 repositories listed
-
OIDM: An Observability-based Intelligent Distributed Edge Sensing Method for Industrial Cyber-Physical Systems13 Sep 2024 0 repositories listed
-
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning12 Sep 2024 0 repositories listed
-
Multi-Model based Federated Learning Against Model Poisoning Attack: A Deep Learning Based Model Selection for MEC Systems12 Sep 2024 0 repositories listed
-
Tera-SpaceCom: GNN-based Deep Reinforcement Learning for Joint Resource Allocation and Task Offloading in TeraHertz Band Space Networks12 Sep 2024 0 repositories listed
-
Towards Opinion Shaping: A Deep Reinforcement Learning Approach in Bot-User Interactions12 Sep 2024 0 repositories listed
-
State-Novelty Guided Action Persistence in Deep Reinforcement Learning9 Sep 2024 0 repositories listed
-
QuantFactor REINFORCE: Mining Steady Formulaic Alpha Factors with Variance-bounded REINFORCE8 Sep 2024 0 repositories listed
-
Reinforcement-Learning-Enabled Beam Alignment for Water-Air Direct Optical Wireless Communications5 Sep 2024 0 repositories listed
-
Simplex-enabled Safe Continual Learning Machine5 Sep 2024 0 repositories listed
-
Decision Transformer for Enhancing Neural Local Search on the Job Shop Scheduling Problem4 Sep 2024 0 repositories listed
-
Two-Timescale Synchronization and Migration for Digital Twin Networks: A Multi-Agent Deep Reinforcement Learning Approach2 Sep 2024 0 repositories listed
-
Generalized Multi-hop Traffic Pressure for Heterogeneous Traffic Perimeter Control1 Sep 2024 0 repositories listed
-
Comparison of Model Predictive Control and Proximal Policy Optimization for a 1-DOF Helicopter System28 Aug 2024 0 repositories listed
-
Statistical QoS Provision in Business-Centric Networks28 Aug 2024 0 repositories listed
-
Earth Observation Satellite Scheduling with Graph Neural Networks27 Aug 2024 0 repositories listed
-
MA-CDMR: An Intelligent Cross-domain Multicast Routing Method based on Multiagent Deep Reinforcement Learning in Multi-domain SDWN27 Aug 2024 0 repositories listed
-
Model-Based Reinforcement Learning for Control of Strongly-Disturbed Unsteady Aerodynamic Flows26 Aug 2024 0 repositories listed
-
Robot Navigation with Entity-Based Collision Avoidance using Deep Reinforcement Learning26 Aug 2024 0 repositories listed
-
Multi-Agent Target Assignment and Path Finding for Intelligent Warehouse: A Cooperative Multi-Agent Deep Reinforcement Learning Perspective25 Aug 2024 0 repositories listed
-
Synesthesia of Machines (SoM)-Enhanced ISAC Precoding for Vehicular Networks with Double Dynamics24 Aug 2024 0 repositories listed
-
cc-DRL: a Convex Combined Deep Reinforcement Learning Flight Control Design for a Morphing Quadrotor23 Aug 2024 0 repositories listed
-
Localized Observation Abstraction Using Piecewise Linear Spatial Decay for Reinforcement Learning in Combat Simulations23 Aug 2024 0 repositories listed
-
Emotion-Agent: Unsupervised Deep Reinforcement Learning with Distribution-Prototype Reward for Continuous Emotional EEG Analysis22 Aug 2024 0 repositories listed
-
Fast State Stabilization using Deep Reinforcement Learning for Measurement-based Quantum Feedback Control21 Aug 2024 0 repositories listed
-
Using Part-based Representations for Explainable Deep Reinforcement Learning21 Aug 2024 0 repositories listed
-
Adaptive BESS and Grid Setpoints Optimization: A Model-Free Framework for Efficient Battery Management under Dynamic Tariff Pricing19 Aug 2024 0 repositories listed
-
Demystifying Reinforcement Learning in Production Scheduling via Explainable AI19 Aug 2024 0 repositories listed
-
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm19 Aug 2024 0 repositories listed
-
Gradient Reduction Convolutional Neural Network Policy for Financial Deep Reinforcement Learning16 Aug 2024 0 repositories listed
-
D5RL: Diverse Datasets for Data-Driven Deep Reinforcement Learning15 Aug 2024 0 repositories listed
-
BCR-DRL: Behavior- and Context-aware Reward for Deep Reinforcement Learning in Human-AI Coordination15 Aug 2024 0 repositories listed
-
Prioritizing Modalities: Flexible Importance Scheduling in Federated Multimodal Learning13 Aug 2024 0 repositories listed
-
Residual Deep Reinforcement Learning for Inverter-based Volt-Var Control13 Aug 2024 0 repositories listed
-
Robust Deep Reinforcement Learning for Inverter-based Volt-Var Control in Partially Observable Distribution Networks13 Aug 2024 0 repositories listed
-
Wireless MAC Protocol Synthesis and Optimization with Multi-Agent Distributed Reinforcement Learning12 Aug 2024 0 repositories listed
-
DeepAir: A Multi-Agent Deep Reinforcement Learning Based Scheme for an Unknown User Location Problem11 Aug 2024 0 repositories listed
-
Mitigating Metropolitan Carbon Emissions with Dynamic Eco-driving at Scale10 Aug 2024 0 repositories listed
-
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization8 Aug 2024 0 repositories listed
-
Deep Reinforcement Learning for the Design of Metamaterial Mechanisms with Functional Compliance Control8 Aug 2024 0 repositories listed
-
Goal-Oriented UAV Communication Design and Optimization for Target Tracking: A MachineLearning Approach8 Aug 2024 0 repositories listed
-
KnowPC: Knowledge-Driven Programmatic Reinforcement Learning for Zero-shot Coordination8 Aug 2024 0 repositories listed
-
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes7 Aug 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.