{"url":"/task/interactive-segmentation","name":"Interactive Segmentation","slug":"interactive-segmentation","description_markdown":null,"categories":[{"name":"Computer Vision","url":"/area/computer-vision"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":255,"papers_with_code":111,"benchmarks":14,"benchmark_tables_in_archive":14,"benchmark_tables_shown":14,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":9,"subtasks":0,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/interactive-segmentation-on-grabcut","slug":"interactive-segmentation-on-grabcut","dataset":"GrabCut","dataset_url":null,"rows_in_archive":18,"metrics":["NoC@90","NoC@85","NoC@95"],"first_row_in_archive_order":{"model":"SimpleClick CFR-1 (ViT-H, SBD)","paper_title":"CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image Segmentation","paper_url":"/paper/cfr-icl-cascade-forward-refinement-with","paper_date":"2023-03-09","arxiv_id":"2303.05620","code_links":[{"title":"TitorX/CFR-ICL-Interactive-Segmentation","url":"https://github.com/TitorX/CFR-ICL-Interactive-Segmentation"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/interactive-segmentation-on-davis","slug":"interactive-segmentation-on-davis","dataset":"DAVIS","dataset_url":"/dataset/davis","rows_in_archive":15,"metrics":["NoC@90","NoC@85","NoC@95"],"first_row_in_archive_order":{"model":"ICL CFR-1 (ViT-H, C+L)","paper_title":"CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image Segmentation","paper_url":"/paper/cfr-icl-cascade-forward-refinement-with","paper_date":"2023-03-09","arxiv_id":"2303.05620","code_links":[{"title":"TitorX/CFR-ICL-Interactive-Segmentation","url":"https://github.com/TitorX/CFR-ICL-Interactive-Segmentation"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/interactive-segmentation-on-berkeley","slug":"interactive-segmentation-on-berkeley","dataset":"Berkeley","dataset_url":null,"rows_in_archive":14,"metrics":["NoC@90","NoC@95"],"first_row_in_archive_order":{"model":"ICL CFR-1 (ViT-H, C+L)","paper_title":"CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image Segmentation","paper_url":"/paper/cfr-icl-cascade-forward-refinement-with","paper_date":"2023-03-09","arxiv_id":"2303.05620","code_links":[{"title":"TitorX/CFR-ICL-Interactive-Segmentation","url":"https://github.com/TitorX/CFR-ICL-Interactive-Segmentation"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/interactive-segmentation-on-sbd","slug":"interactive-segmentation-on-sbd","dataset":"SBD","dataset_url":"/dataset/sbd","rows_in_archive":14,"metrics":["NoC@90","NoC@85","NoC@95"],"first_row_in_archive_order":{"model":"SimpleClick CFR-1 (ViT-H, SBD)","paper_title":"CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image Segmentation","paper_url":"/paper/cfr-icl-cascade-forward-refinement-with","paper_date":"2023-03-09","arxiv_id":"2303.05620","code_links":[{"title":"TitorX/CFR-ICL-Interactive-Segmentation","url":"https://github.com/TitorX/CFR-ICL-Interactive-Segmentation"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/interactive-segmentation-on-davis-585","slug":"interactive-segmentation-on-davis-585","dataset":"DAVIS-585","dataset_url":"/dataset/davis-585","rows_in_archive":2,"metrics":["NoC@90","NoC@85"],"first_row_in_archive_order":{"model":"ViT-B+MST+CL","paper_title":"MST: Adaptive Multi-Scale Tokens Guided Interactive Segmentation","paper_url":"/paper/mst-adaptive-multi-scale-tokens-guided","paper_date":"2024-01-09","arxiv_id":"2401.04403","code_links":[{"title":"hahamyt/mst","url":"https://github.com/hahamyt/mst"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-pascal-voc","slug":"interactive-segmentation-on-pascal-voc","dataset":"PASCAL VOC","dataset_url":"/dataset/pascal-voc","rows_in_archive":2,"metrics":["NoC@95","NoC@90","NoC@85"],"first_row_in_archive_order":{"model":"ICL CFR-1 (ViT-H, C+L)","paper_title":"CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image Segmentation","paper_url":"/paper/cfr-icl-cascade-forward-refinement-with","paper_date":"2023-03-09","arxiv_id":"2303.05620","code_links":[{"title":"TitorX/CFR-ICL-Interactive-Segmentation","url":"https://github.com/TitorX/CFR-ICL-Interactive-Segmentation"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/interactive-segmentation-on-rooftop","slug":"interactive-segmentation-on-rooftop","dataset":"Rooftop","dataset_url":null,"rows_in_archive":2,"metrics":["Instance Average IoU","NoC@80"],"first_row_in_archive_order":{"model":"IOG","paper_title":"Interactive Object Segmentation With Inside-Outside Guidance","paper_url":"/paper/interactive-object-segmentation-with-inside","paper_date":"2020-06-01","arxiv_id":null,"code_links":[{"title":"shiyinzhang/Inside-Outside-Guidance","url":"https://github.com/shiyinzhang/Inside-Outside-Guidance"},{"title":"shiyinzhang/Pixel-ImageNet","url":"https://github.com/shiyinzhang/Pixel-ImageNet"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-cityscapes-val","slug":"interactive-segmentation-on-cityscapes-val","dataset":"Cityscapes val","dataset_url":"/dataset/cityscapes","rows_in_archive":1,"metrics":["Instance Average IoU"],"first_row_in_archive_order":{"model":"IOG","paper_title":"Interactive Object Segmentation With Inside-Outside Guidance","paper_url":"/paper/interactive-object-segmentation-with-inside","paper_date":"2020-06-01","arxiv_id":null,"code_links":[{"title":"shiyinzhang/Inside-Outside-Guidance","url":"https://github.com/shiyinzhang/Inside-Outside-Guidance"},{"title":"shiyinzhang/Pixel-ImageNet","url":"https://github.com/shiyinzhang/Pixel-ImageNet"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-coco","slug":"interactive-segmentation-on-coco","dataset":"COCO (Common Objects in Context)","dataset_url":"/dataset/coco","rows_in_archive":1,"metrics":["Instance Average IoU"],"first_row_in_archive_order":{"model":"IOG","paper_title":"Interactive Object Segmentation With Inside-Outside Guidance","paper_url":"/paper/interactive-object-segmentation-with-inside","paper_date":"2020-06-01","arxiv_id":null,"code_links":[{"title":"shiyinzhang/Inside-Outside-Guidance","url":"https://github.com/shiyinzhang/Inside-Outside-Guidance"},{"title":"shiyinzhang/Pixel-ImageNet","url":"https://github.com/shiyinzhang/Pixel-ImageNet"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-coco-minival","slug":"interactive-segmentation-on-coco-minival","dataset":"COCO minival","dataset_url":"/dataset/coco","rows_in_archive":1,"metrics":["NoC@85","NoC@90"],"first_row_in_archive_order":{"model":"ViT-B+MST+CL","paper_title":"MST: Adaptive Multi-Scale Tokens Guided Interactive Segmentation","paper_url":"/paper/mst-adaptive-multi-scale-tokens-guided","paper_date":"2024-01-09","arxiv_id":"2401.04403","code_links":[{"title":"hahamyt/mst","url":"https://github.com/hahamyt/mst"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-drions-db","slug":"interactive-segmentation-on-drions-db","dataset":"DRIONS-DB","dataset_url":null,"rows_in_archive":1,"metrics":["NoC@90"],"first_row_in_archive_order":{"model":"IA+SA","paper_title":"Continuous Adaptation for Interactive Object Segmentation by Learning from Corrections","paper_url":"/paper/continuous-adaptation-for-interactive-object","paper_date":"2019-11-28","arxiv_id":"1911.12709","code_links":[],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-pascal2coco","slug":"interactive-segmentation-on-pascal2coco","dataset":"PASCAL2COCO(Unseen)","dataset_url":null,"rows_in_archive":1,"metrics":["Instance Average IoU"],"first_row_in_archive_order":{"model":"IOG","paper_title":"Interactive Object Segmentation With Inside-Outside Guidance","paper_url":"/paper/interactive-object-segmentation-with-inside","paper_date":"2020-06-01","arxiv_id":null,"code_links":[{"title":"shiyinzhang/Inside-Outside-Guidance","url":"https://github.com/shiyinzhang/Inside-Outside-Guidance"},{"title":"shiyinzhang/Pixel-ImageNet","url":"https://github.com/shiyinzhang/Pixel-ImageNet"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-pascalvoc","slug":"interactive-segmentation-on-pascalvoc","dataset":"PascalVOC","dataset_url":null,"rows_in_archive":1,"metrics":["NoC@85","NoC@90"],"first_row_in_archive_order":{"model":"ViT-B+MST+CL","paper_title":"MST: Adaptive Multi-Scale Tokens Guided Interactive Segmentation","paper_url":"/paper/mst-adaptive-multi-scale-tokens-guided","paper_date":"2024-01-09","arxiv_id":"2401.04403","code_links":[{"title":"hahamyt/mst","url":"https://github.com/hahamyt/mst"}],"syntology":null}},{"leaderboard":"/sota/interactive-segmentation-on-sstem","slug":"interactive-segmentation-on-sstem","dataset":"ssTEM","dataset_url":"/dataset/sstem","rows_in_archive":1,"metrics":["Instance Average IoU"],"first_row_in_archive_order":{"model":"IOG","paper_title":"Interactive Object Segmentation With Inside-Outside Guidance","paper_url":"/paper/interactive-object-segmentation-with-inside","paper_date":"2020-06-01","arxiv_id":null,"code_links":[{"title":"shiyinzhang/Inside-Outside-Guidance","url":"https://github.com/shiyinzhang/Inside-Outside-Guidance"},{"title":"shiyinzhang/Pixel-ImageNet","url":"https://github.com/shiyinzhang/Pixel-ImageNet"}],"syntology":null}}],"datasets":[{"url":"/dataset/coco","name":"COCO (Common Objects in Context)","full_name":"Common Objects in Context","num_papers_in_archive":11922},{"url":"/dataset/cityscapes","name":"Cityscapes","full_name":"","num_papers_in_archive":3702},{"url":"/dataset/davis","name":"DAVIS","full_name":"Densely Annotated VIdeo Segmentation","num_papers_in_archive":734},{"url":"/dataset/pascal-voc","name":"PASCAL VOC","full_name":"PASCAL Visual Object Classes Challenge","num_papers_in_archive":198},{"url":"/dataset/sbd","name":"SBD","full_name":"Semantic Boundaries Dataset","num_papers_in_archive":147},{"url":"/dataset/davis-585","name":"DAVIS-585","full_name":"DAVIS-585","num_papers_in_archive":6},{"url":"/dataset/sstem","name":"ssTEM","full_name":"","num_papers_in_archive":3},{"url":"/dataset/pumavos","name":"PUMaVOS","full_name":"Partial and Unusual Masks for Video Object Segmentation","num_papers_in_archive":2},{"url":"/dataset/rclicks","name":"RClicks","full_name":"","num_papers_in_archive":1}],"subtasks":[],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":111,"tagged_in_all":255,"items":[{"url":"/paper/reviving-iterative-training-with-mask","title":"Reviving Iterative Training with Mask Guidance for Interactive Segmentation","date":"2021-02-12","arxiv_id":"2102.06583","repositories_listed":5,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/nuclick-a-deep-learning-framework-for","title":"NuClick: A Deep Learning Framework for Interactive Segmentation of Microscopy Images","date":"2020-05-29","arxiv_id":"2005.14511","repositories_listed":5,"syntology":null},{"url":"/paper/nninteractive-redefining-3d-promptable","title":"nnInteractive: Redefining 3D Promptable Segmentation","date":"2025-03-11","arxiv_id":"2503.08373","repositories_listed":4,"syntology":{"n":9,"n_ran":3,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/set-of-mark-prompting-unleashes-extraordinary","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","date":"2023-10-17","arxiv_id":"2310.11441","repositories_listed":4,"syntology":{"n":1,"n_ran":0,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/sam-med2d","title":"SAM-Med2D","date":"2023-08-30","arxiv_id":"2308.16184","repositories_listed":3,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/promptunet-toward-interactive-medical-image","title":"One-Prompt to Segment All Medical Images","date":"2023-05-17","arxiv_id":"2305.10300","repositories_listed":3,"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/segment-everything-everywhere-all-at-once","title":"Segment Everything Everywhere All at Once","date":"2023-04-13","arxiv_id":"2304.06718","repositories_listed":3,"syntology":null},{"url":"/paper/edgeflow-achieving-practical-interactive","title":"EdgeFlow: Achieving Practical Interactive Segmentation with Edge-Guided Flow","date":"2021-09-20","arxiv_id":"2109.09406","repositories_listed":3,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/getting-to-99-accuracy-in-interactive","title":"Getting to 99% Accuracy in Interactive Segmentation","date":"2020-03-17","arxiv_id":"2003.07932","repositories_listed":3,"syntology":null},{"url":"/paper/deep-interactive-object-selection","title":"Deep Interactive Object Selection","date":"2016-03-13","arxiv_id":"1603.04042","repositories_listed":3,"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/sampart3d-segment-any-part-in-3d-objects","title":"SAMPart3D: Segment Any Part in 3D Objects","date":"2024-11-11","arxiv_id":"2411.07184","repositories_listed":2,"syntology":{"n":10,"n_ran":0,"n_unverified":10,"n_pointer_only":0}},{"url":"/paper/prism-lite-a-lightweight-model-for","title":"PRISM Lite: A lightweight model for interactive 3D placenta segmentation in ultrasound","date":"2024-08-09","arxiv_id":"2408.05372","repositories_listed":2,"syntology":null},{"url":"/paper/2408-00874","title":"Medical SAM 2: Segment medical images as video via Segment Anything Model 2","date":"2024-08-01","arxiv_id":"2408.00874","repositories_listed":2,"syntology":{"n":11,"n_ran":7,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/interactive-segmentation-model-for-placenta","title":"Interactive Segmentation Model for Placenta Segmentation from 3D Ultrasound images","date":"2024-07-10","arxiv_id":"2407.08020","repositories_listed":2,"syntology":null},{"url":"/paper/prism-a-promptable-and-robust-interactive","title":"PRISM: A Promptable and Robust Interactive Segmentation Model with Visual Prompts","date":"2024-04-23","arxiv_id":"2404.15028","repositories_listed":2,"syntology":null},{"url":"/paper/one-model-to-rule-them-all-towards-universal","title":"One Model to Rule them All: Towards Universal Segmentation for Medical Images with Text Prompts","date":"2023-12-28","arxiv_id":"2312.17183","repositories_listed":2,"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":3}},{"url":"/paper/vpuformer-visual-prompt-unified-transformer","title":"PVPUFormer: Probabilistic Visual Prompt Unified Transformer for Interactive Image Segmentation","date":"2023-06-11","arxiv_id":"2306.06656","repositories_listed":2,"syntology":null},{"url":"/paper/segment-anything-model-for-medical-image","title":"Segment Anything Model for Medical Image Analysis: an Experimental Study","date":"2023-04-20","arxiv_id":"2304.10517","repositories_listed":2,"syntology":null},{"url":"/paper/clip-surgery-for-better-explainability-with","title":"A Closer Look at the Explainability of Contrastive Language-Image Pre-training","date":"2023-04-12","arxiv_id":"2304.05653","repositories_listed":2,"syntology":null},{"url":"/paper/simpleclick-interactive-image-segmentation","title":"SimpleClick: Interactive Image Segmentation with Simple Vision Transformers","date":"2022-10-20","arxiv_id":"2210.11006","repositories_listed":2,"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":1}},{"url":"/paper/econet-efficient-convolutional-online","title":"ECONet: Efficient Convolutional Online Likelihood Network for Scribble-based Interactive Segmentation","date":"2022-01-12","arxiv_id":"2201.04584","repositories_listed":2,"syntology":null},{"url":"/paper/focuscut-diving-into-a-focus-view-in","title":"FocusCut: Diving Into a Focus View in Interactive Segmentation","date":"2022-01-01","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/mideepseg-minimally-interactive-segmentation","title":"MIDeepSeg: Minimally Interactive Segmentation of Unseen Objects from Medical Images Using Deep Learning","date":"2021-04-25","arxiv_id":"2104.12166","repositories_listed":2,"syntology":null},{"url":"/paper/medical-image-segmentation-using-deep","title":"Medical Image Segmentation Using Deep Learning: A Survey","date":"2020-09-28","arxiv_id":"2009.13120","repositories_listed":2,"syntology":null},{"url":"/paper/interactive-object-segmentation-with-inside","title":"Interactive Object Segmentation With Inside-Outside Guidance","date":"2020-06-01","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/interactive-image-segmentation-with-first","title":"Interactive Image Segmentation With First Click Attention","date":"2020-06-01","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/f-brs-rethinking-backpropagating-refinement","title":"f-BRS: Rethinking Backpropagating Refinement for Interactive Segmentation","date":"2020-01-28","arxiv_id":"2001.10331","repositories_listed":2,"syntology":null},{"url":"/paper/deep-extreme-cut-from-extreme-points-to","title":"Deep Extreme Cut: From Extreme Points to Object Segmentation","date":"2017-11-24","arxiv_id":"1711.09081","repositories_listed":2,"syntology":null},{"url":"/paper/seg-wild-interactive-segmentation-based-on-3d","title":"Seg-Wild: Interactive Segmentation based on 3D Gaussian Splatting for Unconstrained Image Collections","date":"2025-07-10","arxiv_id":"2507.07395","repositories_listed":1,"syntology":null},{"url":"/paper/benchmarking-feature-upsampling-methods-for","title":"Benchmarking Feature Upsampling Methods for Vision Foundation Models using Interactive Segmentation","date":"2025-05-04","arxiv_id":"2505.02075","repositories_listed":1,"syntology":null}],"syntology_records":11,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}