{"url":"/method/ddql","slug":"ddql","name":"DDQL","full_name":"Double Deep Q-Learning","full_name_withheld":false,"description_markdown":null,"description_state":"absent","introduced_year":null,"introduced_by":{"title":"Deep Reinforcement Learning with Double Q-learning","paper":"/paper/deep-reinforcement-learning-with-double-q","first_author":"Hado van Hasselt","n_authors":3,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/deep-reinforcement-learning-with-double-q"},"source":{"url":"http://arxiv.org/abs/1509.06461v3","title":"Deep Reinforcement Learning with Double Q-learning","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Reinforcement Learning","area_id":"reinforcement-learning","collection":"Reinforcement Learning Frameworks","url":"/methods/category/reinforcement-learning-frameworks","pwc_aliases":[]}],"n_papers_tagged":3,"archive_num_papers":3,"papers_newest_first":[{"paper":"/paper/flash-rl-federated-learning-addressing-system","title":"FLASH-RL: Federated Learning Addressing System and Static Heterogeneity using Reinforcement Learning","date":"2023-11-12","arxiv_id":"2311.06917","n_code_links":1,"syntology":null},{"paper":null,"title":"Privacy-Cost Management in Smart Meters Using Deep Reinforcement Learning","date":"2020-03-10","arxiv_id":"2003.04946","n_code_links":0,"syntology":null},{"paper":"/paper/deep-reinforcement-learning-with-double-q","title":"Deep Reinforcement Learning with Double Q-learning","date":"2015-09-22","arxiv_id":"1509.06461","n_code_links":97,"syntology":{"ran":55,"of":106,"unverified":51,"pointer_only":57}}],"papers_shown":3,"tasks":[{"task":"/task/deep-reinforcement-learning","name":"Deep Reinforcement Learning","papers":2},{"task":"/task/q-learning","name":"Q-Learning","papers":2},{"task":"/task/reinforcement-learning","name":"Reinforcement Learning","papers":2},{"task":"/task/reinforcement-learning-1","name":"Reinforcement Learning (RL)","papers":2},{"task":"/task/reinforcement-learning-2","name":"reinforcement-learning","papers":2},{"task":"/task/atari-games","name":"Atari Games","papers":1},{"task":"/task/federated-learning","name":"Federated Learning","papers":1},{"task":"/task/management","name":"Management","papers":1}],"tasks_shown":8,"n_tasks":8,"usage_by_year":[{"year":"2015","papers":1},{"year":"2020","papers":1},{"year":"2023","papers":1}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/ddql"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}