{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/paper/span-spatial-pyramid-attention-network-for","title":"SPAN: Spatial Pyramid Attention Network for Image Manipulation Localization","arxiv_id":null,"date":"2020-08-01","proceeding":"ECCV 2020 8","authors":["Xuefeng Hu","Zhihan Zhang","Zhenye Jiang","Syomantak Chaudhuri","Zhenheng Yang","Ram Nevatia"],"abstract":"Tehchniques for manipulating images are advancing rapidly; while these are helpful for many useful tasks, they also pose a threat to society with their ability to create believable misinformation. We present a novel, Spatial Pyramid Attention Network (SPAN) for detection and localization of multiple types of image manipulations. The proposed architecture efficiently and effecively models the relationship between image patches at multiple scales by constructing a pyramid of local self-attention blocks. The design includes a novel position projection to encode the spatial positions of the patches. SPAN is trained on a synthetic dataset but can also be fine tuned for specific datasets; The proposed method shows significant gains in performance on standard datasets over previous state-of-art methods.","url_abs":"https://www.ecva.net/papers/eccv_2020/papers_ECCV/html/3720_ECCV_2020_paper.php","url_pdf":"https://www.ecva.net/papers/eccv_2020/papers_ECCV/papers/123660307.pdf","source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","row_kind":"abstracts"},"code_links":[{"paper_slug":"span-spatial-pyramid-attention-network-for","repo_url":"https://github.com/ZhiHanZ/IRIS0-SPAN","is_official":1,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"tf","reach":null}],"tasks":[{"task_slug":"image-manipulation","task_name":"Image Manipulation"},{"task_slug":"image-manipulation-detection","task_name":"Image Manipulation Detection"},{"task_slug":"image-manipulation-localization","task_name":"Image Manipulation Localization"},{"task_slug":"misinformation","task_name":"Misinformation"},{"task_slug":null,"task_name":"Position"}],"methods":[],"datasets_introduced":[],"methods_introduced":[],"results":[{"leaderboard":"/sota/image-manipulation-detection-on-coverage","task":"Image Manipulation Detection","dataset":"COVERAGE","model":"SPAN","rank_in_archive_order":8,"of":8,"metrics":{"AUC":".670","Balanced Accuracy":".235"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-detection-on-casia-v1","task":"Image Manipulation Detection","dataset":"Casia V1+","model":"SPAN","rank_in_archive_order":8,"of":9,"metrics":{"AUC":".480","Balanced Accuracy":".112"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-detection-on-cocoglide","task":"Image Manipulation Detection","dataset":"CocoGlide","model":"SPAN","rank_in_archive_order":7,"of":8,"metrics":{"AUC":".475","Balanced Accuracy":".298"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-detection-on-dso-1","task":"Image Manipulation Detection","dataset":"DSO-1","model":"SPAN","rank_in_archive_order":8,"of":9,"metrics":{"AUC":".669","Balanced Accuracy":".233"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-localization-on-coverage","task":"Image Manipulation Localization","dataset":"COVERAGE","model":"SPAN","rank_in_archive_order":11,"of":11,"metrics":{"Average Pixel F1(Fixed threshold)":".235"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-localization-on-casia-v1","task":"Image Manipulation Localization","dataset":"Casia V1+","model":"SPAN","rank_in_archive_order":11,"of":11,"metrics":{"Average Pixel F1(Fixed threshold)":".112"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-localization-on-cocoglide","task":"Image Manipulation Localization","dataset":"CocoGlide","model":"SPAN","rank_in_archive_order":11,"of":11,"metrics":{"Average Pixel F1(Fixed threshold)":".298"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-localization-on-columbia","task":"Image Manipulation Localization","dataset":"Columbia","model":"SPAN","rank_in_archive_order":8,"of":11,"metrics":{"Average Pixel F1(Fixed threshold)":".759"},"uses_additional_data":false},{"leaderboard":"/sota/image-manipulation-localization-on-dso-1","task":"Image Manipulation Localization","dataset":"DSO-1","model":"SPAN","rank_in_archive_order":11,"of":11,"metrics":{"Average Pixel F1(Fixed threshold)":".233"},"uses_additional_data":false}],"syntology":{"atlas_url":null,"mcp":null,"developers":"https://syntology.ai/developers"},"arxiv_metadata":null,"syntology_extracted_results":null}