Methods › Reinforcement Learning › Policy Gradient Methods › DDPG
Deep Deterministic Policy Gradient
DDPG
Introduced by Timothy P. Lillicrap et al. in Continuous control with deep reinforcement learning
archive 2025-07-28 Description, source and code snippet are the archive's method entry.
DDPG, or Deep Deterministic Policy Gradient, is an actor-critic, model-free algorithm based on the deterministic policy gradient that can operate over continuous action spaces. It combines the actor-critic approach with insights from DQNs: in particular, the insights that 1) the network is trained off-policy with samples from a replay buffer to minimize correlations between samples, and 2) the network is trained with a target Q network to give consistent targets during temporal difference backups. DDPG makes use of the same ideas along with batch normalization.
Papers archive 2025-07-28
30 shown of 218, newest first. Repository counts are the archive's code-links table. A Syntology line states what Syntology ran from that paper's harvested code; it is per sample and not a correctness claim.
-
Multi-Objective Reinforcement Learning for Cognitive Radar Resource Management 25 Jun 2025 · 0 repositories · arXiv:2506.20853
-
Reliable Critics: Monotonic Improvement and Convergence Guarantees for Reinforcement Learning 8 Jun 2025 · 0 repositories · arXiv:2506.07134
-
A Novel Deep Reinforcement Learning Method for Computation Offloading in Multi-User Mobile Edge Computing with Decentralization 3 Jun 2025 · 0 repositories · arXiv:2506.02458
-
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models 21 May 2025 · 0 repositories · arXiv:2505.15293
-
Deep reinforcement learning-based longitudinal control strategy for automated vehicles at signalised intersections 13 May 2025 · 0 repositories · arXiv:2505.08896
-
Moderate Actor-Critic Methods: Controlling Overestimation Bias via Expectile Loss 14 Apr 2025 · 0 repositories · arXiv:2504.09929
-
Intelligent Joint Security and Delay Determinacy Performance Guarantee Strategy in RIS-Assisted IIoT Communication Systems 11 Mar 2025 · 0 repositories · arXiv:2503.08086
-
EvoRL: A GPU-accelerated Framework for Evolutionary Reinforcement Learning 25 Jan 2025 · 2 repositories · arXiv:2501.15129
-
Federated Deep Reinforcement Learning for Energy Efficient Multi-Functional RIS-Assisted Low-Earth Orbit Networks 19 Jan 2025 · 0 repositories · arXiv:2501.11079
-
AutoLoop: Fast Visual SLAM Fine-tuning through Agentic Curriculum Learning 15 Jan 2025 · 0 repositories · arXiv:2501.09160
-
Dynamic Portfolio Optimization via Augmented DDPG with Quantum Price Levels-Based Trading Strategy 15 Jan 2025 · 0 repositories · arXiv:2501.08528
-
An Advantage-based Optimization Method for Reinforcement Learning in Large Action Space 17 Dec 2024 · 0 repositories · arXiv:2412.12605
-
Broad Critic Deep Actor Reinforcement Learning for Continuous Control 24 Nov 2024 · 0 repositories · arXiv:2411.15806
-
Provably Efficient Action-Manipulation Attack Against Continuous Reinforcement Learning 20 Nov 2024 · 0 repositories · arXiv:2411.13116
-
Quantum Policy Gradient in Reproducing Kernel Hilbert Space 11 Nov 2024 · 0 repositories · arXiv:2411.06650
-
Mitigating Suboptimality of Deterministic Policy Gradients in Complex Q-functions 15 Oct 2024 · 0 repositories · arXiv:2410.11833
-
ETGL-DDPG: A Deep Deterministic Policy Gradient Algorithm for Sparse Reward Continuous Control 7 Oct 2024 · 0 repositories · arXiv:2410.05225
-
Robust Deep Reinforcement Learning for Volt-VAR Optimization in Active Distribution System under Uncertainty 27 Sep 2024 · 0 repositories · arXiv:2409.18937
-
FH-DRL: Exponential-Hyperbolic Frontier Heuristics with DRL for accelerated Exploration in Unknown Environments 26 Jul 2024 · 0 repositories · arXiv:2407.18892
-
The Cross-environment Hyperparameter Setting Benchmark for Reinforcement Learning 26 Jul 2024 · 0 repositories · arXiv:2407.18840
-
Reconfigurable Intelligent Surface Aided Vehicular Edge Computing: Joint Phase-shift Optimization and Multi-User Power Allocation 18 Jul 2024 · 1 repository · arXiv:2407.13123
-
Deep reinforcement learning with symmetric data augmentation applied for aircraft lateral attitude tracking control 13 Jul 2024 · 0 repositories · arXiv:2407.11077
-
Deep Reinforcement Learning Strategies in Finance: Insights into Asset Holding, Trading Behavior, and Purchase Diversity 29 Jun 2024 · 0 repositories · arXiv:2407.09557
-
Performance Comparison of Deep RL Algorithms for Mixed Traffic Cooperative Lane-Changing 25 Jun 2024 · 0 repositories · arXiv:2407.02521
-
Towards Dynamic Resource Allocation and Client Scheduling in Hierarchical Federated Learning: A Two-Phase Deep Reinforcement Learning Approach 21 Jun 2024 · 0 repositories · arXiv:2406.14910
-
Value Improved Actor Critic Algorithms 3 Jun 2024 · 0 repositories · arXiv:2406.01423
-
Meta Reinforcement Learning for Resource Allocation in Multi-Antenna UAV Network with Rate Splitting Multiple Access 18 May 2024 · 0 repositories · arXiv:2405.11306
-
Continuous Control Reinforcement Learning: Distributed Distributional DrQ Algorithms 16 Apr 2024 · 0 repositories · arXiv:2404.10645
-
Conservative DDPG -- Pessimistic RL without Ensemble 8 Mar 2024 · 0 repositories · arXiv:2403.05732
-
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control 7 Mar 2024 · 0 repositories · arXiv:2403.04195
Tasks archive 2025-07-28
20 shown of 88 tasks the archive attaches to papers tagged with this method, by distinct papers. A task without a page in the catalog is plain text.
Usage over time archive 2025-07-28
Components: the archive holds no method-to-method composition, so PwC's Components table cannot be rebuilt; the Papers list carries no Results column for the same reason (the archive does not join its leaderboard rows to method tags).
Categories archive 2025-07-28
Report a problem or propose a change · a person checks every report against the paper or source before anything changes; decisions are listed on /corrections