{"url":"/task/semantic-segmentation","name":"Semantic Segmentation","slug":"semantic-segmentation","description_markdown":null,"categories":[{"name":"Computer Code","url":"/area/computer-code"},{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Medical","url":"/area/medical"},{"name":"Robots","url":"/area/robots"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":14763,"papers_with_code":6644,"benchmarks":150,"benchmark_tables_in_archive":152,"benchmark_tables_shown":151,"benchmark_tables_withheld_as_spam":1,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":347,"subtasks":29,"parent_tasks":1},"benchmarks":[{"leaderboard":"/sota/semantic-segmentation-on-ade20k","slug":"semantic-segmentation-on-ade20k","dataset":"ADE20K","dataset_url":"/dataset/ade20k","rows_in_archive":235,"metrics":["Validation mIoU","Test Score","Params (M)","GFLOPs (512 x 512)","GFLOPs","Mean IoU (class)"],"first_row_in_archive_order":{"model":"ViT-P (InternImage-H)","paper_title":"The Missing Point in Vision Transformers for Universal Image Segmentation","paper_url":"/paper/the-missing-point-in-vision-transformers-for","paper_date":"2025-05-26","arxiv_id":"2505.19795","code_links":[{"title":"sajjad-sh33/vit-p","url":"https://github.com/sajjad-sh33/vit-p"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-nyu-depth-v2","slug":"semantic-segmentation-on-nyu-depth-v2","dataset":"NYU Depth v2","dataset_url":"/dataset/nyuv2","rows_in_archive":121,"metrics":["Mean IoU","Mean Accuracy"],"first_row_in_archive_order":{"model":"OmniVec2","paper_title":"OmniVec2 - A Novel Transformer based Network for Large Scale Multimodal and Multitask Learning","paper_url":"/paper/omnivec2-a-novel-transformer-based-network","paper_date":"2024-01-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-cityscapes","slug":"semantic-segmentation-on-cityscapes","dataset":"Cityscapes test","dataset_url":"/dataset/cityscapes","rows_in_archive":105,"metrics":["Mean IoU (class)","Category mIoU"],"first_row_in_archive_order":{"model":"VLTSeg","paper_title":"Strong but simple: A Baseline for Domain Generalized Dense Perception by CLIP-based Transfer Learning","paper_url":"/paper/vltseg-simple-transfer-of-clip-based-vision","paper_date":"2023-12-04","arxiv_id":"2312.02021","code_links":[{"title":"VLTSeg/VLTSeg","url":"https://github.com/VLTSeg/VLTSeg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-cityscapes-val","slug":"semantic-segmentation-on-cityscapes-val","dataset":"Cityscapes val","dataset_url":"/dataset/cityscapes","rows_in_archive":99,"metrics":["mIoU","FPS","Validation mIoU"],"first_row_in_archive_order":{"model":"ViT-P (InternImage-H)","paper_title":"The Missing Point in Vision Transformers for Universal Image Segmentation","paper_url":"/paper/the-missing-point-in-vision-transformers-for","paper_date":"2025-05-26","arxiv_id":"2505.19795","code_links":[{"title":"sajjad-sh33/vit-p","url":"https://github.com/sajjad-sh33/vit-p"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-ade20k-val","slug":"semantic-segmentation-on-ade20k-val","dataset":"ADE20K val","dataset_url":"/dataset/ade20k","rows_in_archive":95,"metrics":["mIoU","Pixel Accuracy"],"first_row_in_archive_order":{"model":"BEiT-3","paper_title":"Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks","paper_url":"/paper/image-as-a-foreign-language-beit-pretraining","paper_date":"2022-08-22","arxiv_id":"2208.10442","code_links":[{"title":"microsoft/unilm","url":"https://github.com/microsoft/unilm/tree/master/beit"},{"title":"lyan62/data-curation","url":"https://github.com/lyan62/data-curation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-context","slug":"semantic-segmentation-on-pascal-context","dataset":"PASCAL Context","dataset_url":"/dataset/pascal-context","rows_in_archive":66,"metrics":["mIoU","Mean Accuracy","Pixel Accuracy"],"first_row_in_archive_order":{"model":"VPNeXt","paper_title":"VPNeXt -- Rethinking Dense Decoding for Plain Vision Transformer","paper_url":"/paper/vpnext-rethinking-dense-decoding-for-plain","paper_date":"2025-02-23","arxiv_id":"2502.16654","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-s3dis-area5","slug":"semantic-segmentation-on-s3dis-area5","dataset":"S3DIS Area5","dataset_url":"/dataset/s3dis","rows_in_archive":61,"metrics":["mIoU","mAcc","oAcc","FLOPs","Number of params"],"first_row_in_archive_order":{"model":"Sonata + PTv3","paper_title":"Sonata: Self-Supervised Learning of Reliable Point Representations","paper_url":"/paper/sonata-self-supervised-learning-of-reliable","paper_date":"2025-03-20","arxiv_id":"2503.16429","code_links":[{"title":"Pointcept/Pointcept","url":"https://github.com/Pointcept/Pointcept"},{"title":"facebookresearch/sonata","url":"https://github.com/facebookresearch/sonata"}],"syntology":{"n":19,"n_ran":5,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-s3dis","slug":"semantic-segmentation-on-s3dis","dataset":"S3DIS","dataset_url":"/dataset/s3dis","rows_in_archive":54,"metrics":["Mean IoU","mAcc","oAcc","FLOPs","Number of params","mIoU","Params (M)"],"first_row_in_archive_order":{"model":"Sonata + PTv3","paper_title":"Sonata: Self-Supervised Learning of Reliable Point Representations","paper_url":"/paper/sonata-self-supervised-learning-of-reliable","paper_date":"2025-03-20","arxiv_id":"2503.16429","code_links":[{"title":"Pointcept/Pointcept","url":"https://github.com/Pointcept/Pointcept"},{"title":"facebookresearch/sonata","url":"https://github.com/facebookresearch/sonata"}],"syntology":{"n":19,"n_ran":5,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2012","slug":"semantic-segmentation-on-pascal-voc-2012","dataset":"PASCAL VOC 2012 test","dataset_url":"/dataset/pascal-voc-2012-test","rows_in_archive":51,"metrics":["Mean IoU","FLOPS","Params"],"first_row_in_archive_order":{"model":"DeepLabv3+ (Xception-65-JFT)","paper_title":"Encoder-Decoder with Atrous Separable Convolution for Semantic Image Segmentation","paper_url":"/paper/encoder-decoder-with-atrous-separable","paper_date":"2018-02-07","arxiv_id":"1802.02611","code_links":[{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/research/deeplab"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models"},{"title":"open-mmlab/mmsegmentation","url":"https://github.com/open-mmlab/mmsegmentation"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"jfzhang95/pytorch-deeplab-xception","url":"https://github.com/jfzhang95/pytorch-deeplab-xception"},{"title":"VainF/DeepLabV3Plus-Pytorch","url":"https://github.com/VainF/DeepLabV3Plus-Pytorch"},{"title":"y-ouali/pytorch_segmentation","url":"https://github.com/y-ouali/pytorch_segmentation"},{"title":"bonlime/keras-deeplab-v3-plus","url":"https://github.com/bonlime/keras-deeplab-v3-plus"},{"title":"ayoolaolafenwa/PixelLib","url":"https://github.com/ayoolaolafenwa/PixelLib"},{"title":"rishizek/tensorflow-deeplab-v3-plus","url":"https://github.com/rishizek/tensorflow-deeplab-v3-plus"},{"title":"Media-Smart/vedaseg","url":"https://github.com/Media-Smart/vedaseg"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/blob/master/research/cv/deeplabv3plus"},{"title":"MegEngine/Models","url":"https://github.com/MegEngine/Models/tree/master/official/vision/segmentation"},{"title":"tantara/JejuNet","url":"https://github.com/tantara/JejuNet"},{"title":"shanglianlm0525/CvPytorch","url":"https://github.com/shanglianlm0525/CvPytorch"},{"title":"leimao/DeepLab_v3","url":"https://github.com/leimao/DeepLab_v3"},{"title":"leimao/DeepLab-V3","url":"https://github.com/leimao/DeepLab-V3"},{"title":"srihari-humbarwadi/DeepLabV3_Plus-Tensorflow2.0","url":"https://github.com/srihari-humbarwadi/DeepLabV3_Plus-Tensorflow2.0"},{"title":"JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models","url":"https://github.com/JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/blob/master/official/cv/deeplabv3plus"},{"title":"lattice-ai/DeepLabV3-Plus","url":"https://github.com/lattice-ai/DeepLabV3-Plus"},{"title":"FaceOnLive/Realtime-Background-Changer-SDK-Android","url":"https://github.com/FaceOnLive/Realtime-Background-Changer-SDK-Android"},{"title":"dootmaan/dsrl","url":"https://github.com/dootmaan/dsrl"},{"title":"chuhan89/wsss-tissue","url":"https://github.com/chuhan89/wsss-tissue"},{"title":"Burf/tfdetection","url":"https://github.com/Burf/tfdetection"},{"title":"nolanliou/PeopleSegmentationDemo","url":"https://github.com/nolanliou/PeopleSegmentationDemo"},{"title":"giovanniguidi/deeplabV3-PyTorch","url":"https://github.com/giovanniguidi/deeplabV3-PyTorch"},{"title":"giovanniguidi/deeplabV3_Pytorch","url":"https://github.com/giovanniguidi/deeplabV3_Pytorch"},{"title":"mlearing/pytorch-deeplab-v3-plus","url":"https://github.com/mlearing/pytorch-deeplab-v3-plus"},{"title":"MukhlasAdib/KITTI_Mapping","url":"https://github.com/MukhlasAdib/KITTI_Mapping"},{"title":"Gregor-Mendel-Institute/aradeepopsis","url":"https://github.com/Gregor-Mendel-Institute/aradeepopsis"},{"title":"parachutel/deeplabv3plus_on_Mapillary_Vistas","url":"https://github.com/parachutel/deeplabv3plus_on_Mapillary_Vistas"},{"title":"petko-nikolov/pysemseg","url":"https://github.com/petko-nikolov/pysemseg"},{"title":"czarmanu/sentinel_lakeice","url":"https://github.com/czarmanu/sentinel_lakeice"},{"title":"ucuapps/WSMIS","url":"https://github.com/ucuapps/WSMIS"},{"title":"mathildor/DeepLab-v3","url":"https://github.com/mathildor/DeepLab-v3"},{"title":"TanyaChutani/DeepLabV3Plus-Tf2.0","url":"https://github.com/TanyaChutani/DeepLabV3Plus-Tf2.0"},{"title":"shenshutao/image_segmentation","url":"https://github.com/shenshutao/image_segmentation"},{"title":"GuangyanZhang/SCNN-Deeplabv3-bisenet-icnet","url":"https://github.com/GuangyanZhang/SCNN-Deeplabv3-bisenet-icnet"},{"title":"samson6460/tf2_Segmentation","url":"https://github.com/samson6460/tf2_Segmentation"},{"title":"pideyi1025/DeepLabV3Plus-RailSem19","url":"https://github.com/pideyi1025/DeepLabV3Plus-RailSem19"},{"title":"developmentseed/looking-glass-pub","url":"https://github.com/developmentseed/looking-glass-pub"},{"title":"JinyongJeong/DeeplabV3_Apolloscape_and_CityScape","url":"https://github.com/JinyongJeong/DeeplabV3_Apolloscape_and_CityScape"},{"title":"Vignesh-95/cnn-semantic-segmentation-satellite-images","url":"https://github.com/Vignesh-95/cnn-semantic-segmentation-satellite-images"},{"title":"ensta-u2is/deeplabv3plus-muad-pytorch","url":"https://github.com/ensta-u2is/deeplabv3plus-muad-pytorch"},{"title":"wang-wg/DeepStroke","url":"https://github.com/wang-wg/DeepStroke"},{"title":"abhishekdbihani/MudrockNet","url":"https://github.com/abhishekdbihani/MudrockNet"},{"title":"giannifranchi/deeplabv3-superpixelmix","url":"https://github.com/giannifranchi/deeplabv3-superpixelmix"},{"title":"kekeller/semantic_soy_deeplabv3plus","url":"https://github.com/kekeller/semantic_soy_deeplabv3plus"},{"title":"SkyWa7ch3r/SceneSegmentation","url":"https://github.com/SkyWa7ch3r/SceneSegmentation"},{"title":"SkyWa7ch3r/ImageSegmentation","url":"https://github.com/SkyWa7ch3r/ImageSegmentation"},{"title":"Vujas-Eteph/CiVOS","url":"https://github.com/Vujas-Eteph/CiVOS"},{"title":"wangyi111/international-archaeology-ai-challenge","url":"https://github.com/wangyi111/international-archaeology-ai-challenge"},{"title":"sara-nl/SURF-segmentation","url":"https://github.com/sara-nl/SURF-segmentation"},{"title":"sara-nl/SURF-deeplab","url":"https://github.com/sara-nl/SURF-deeplab"},{"title":"samson6460/tf2_pose_estimation","url":"https://github.com/samson6460/tf2_pose_estimation"},{"title":"MindCode-4/code-3","url":"https://github.com/MindCode-4/code-3/tree/main/encoder_decoder"},{"title":"heidongxianhau/deeplab2","url":"https://github.com/heidongxianhau/deeplab2"},{"title":"zhuang42/csc420","url":"https://github.com/zhuang42/csc420"},{"title":"Robinatp/Deeplab_Tensorflow","url":"https://github.com/Robinatp/Deeplab_Tensorflow"},{"title":"kaichoulyc/course_segmentation","url":"https://github.com/kaichoulyc/course_segmentation"},{"title":"AutomatedAI/deeplab_segmentation_example","url":"https://github.com/AutomatedAI/deeplab_segmentation_example"},{"title":"chenmengyang/rename_later","url":"https://github.com/chenmengyang/rename_later"},{"title":"EdwinAlegria/object_semantic_deeplabv3","url":"https://github.com/EdwinAlegria/object_semantic_deeplabv3"},{"title":"AtrayeeNag/Image-Segmentation-deeplabv3","url":"https://github.com/AtrayeeNag/Image-Segmentation-deeplabv3"},{"title":"AutomatedAI/deeplab_inference","url":"https://github.com/AutomatedAI/deeplab_inference"},{"title":"kawausomando/green_vegetation_v2","url":"https://github.com/kawausomando/green_vegetation_v2"},{"title":"sharifelguindi/DeepLab","url":"https://github.com/sharifelguindi/DeepLab"},{"title":"Syarujianai/deeplab-commented","url":"https://github.com/Syarujianai/deeplab-commented"},{"title":"branislavhesko/segmentation_framework","url":"https://github.com/branislavhesko/segmentation_framework"},{"title":"MindSpore-paper-code-2/code400","url":"https://github.com/MindSpore-paper-code-2/code400/tree/main/DeepLabV3P"},{"title":"2023-MindSpore-1/ms-code-224","url":"https://github.com/2023-MindSpore-1/ms-code-224/tree/main/Alexnet"},{"title":"MindSpore-paper-code-2/code400","url":"https://github.com/MindSpore-paper-code-2/code400/tree/main/DeepLabv3"},{"title":"soumik12345/DeepLabV3-Plus","url":"https://github.com/soumik12345/DeepLabV3-Plus"},{"title":"saehan-choi/pixellib_auto_labelling","url":"https://github.com/saehan-choi/pixellib_auto_labelling"},{"title":"PuchatekwSzortach/voc_encoder_decoder_with_atrous_separable_convolutions","url":"https://github.com/PuchatekwSzortach/voc_encoder_decoder_with_atrous_separable_convolutions"},{"title":"phue/aradeepopsis","url":"https://github.com/phue/aradeepopsis"},{"title":"Popcorn-sugar/Deep_v2","url":"https://github.com/Popcorn-sugar/Deep_v2"}],"syntology":{"n":72,"n_ran":43,"n_unverified":29,"n_pointer_only":40}}},{"leaderboard":"/sota/semantic-segmentation-on-scannet","slug":"semantic-segmentation-on-scannet","dataset":"ScanNet","dataset_url":"/dataset/scannet","rows_in_archive":45,"metrics":["val mIoU","test mIoU"],"first_row_in_archive_order":{"model":"DITR","paper_title":"DINO in the Room: Leveraging 2D Foundation Models for 3D Segmentation","paper_url":"/paper/dino-in-the-room-leveraging-2d-foundation","paper_date":"2025-03-24","arxiv_id":"2503.18944","code_links":[{"title":"VisualComputingInstitute/DITR","url":"https://github.com/VisualComputingInstitute/DITR"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-sun-rgbd","slug":"semantic-segmentation-on-sun-rgbd","dataset":"SUN-RGBD","dataset_url":"/dataset/sun-rgb-d","rows_in_archive":44,"metrics":["Mean IoU","Mean IoU (test)"],"first_row_in_archive_order":{"model":"GeminiFusion (Swin-Large)","paper_title":"GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer","paper_url":"/paper/geminifusion-efficient-pixel-wise-multimodal","paper_date":"2024-06-03","arxiv_id":"2406.01210","code_links":[{"title":"jiadingcn/geminifusion","url":"https://github.com/jiadingcn/geminifusion"}],"syntology":{"n":10,"n_ran":7,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-densepass","slug":"semantic-segmentation-on-densepass","dataset":"DensePASS","dataset_url":"/dataset/densepass","rows_in_archive":36,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Trans4PASS+ (multi-scale)","paper_title":"Behind Every Domain There is a Shift: Adapting Distortion-aware Vision Transformers for Panoramic Semantic Segmentation","paper_url":"/paper/behind-every-domain-there-is-a-shift-adapting","paper_date":"2022-07-25","arxiv_id":"2207.11860","code_links":[{"title":"jamycheung/trans4pass","url":"https://github.com/jamycheung/trans4pass"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2012-val","slug":"semantic-segmentation-on-pascal-voc-2012-val","dataset":"PASCAL VOC 2012 val","dataset_url":null,"rows_in_archive":29,"metrics":["mIoU","Mean IoU","mIoU (Syn)"],"first_row_in_archive_order":{"model":"EfficientNet-L2+NAS-FPN (single scale test, with self-training)","paper_title":"Rethinking Pre-training and Self-training","paper_url":"/paper/rethinking-pre-training-and-self-training","paper_date":"2020-06-11","arxiv_id":"2006.06882","code_links":[{"title":"tensorflow/tpu","url":"https://github.com/tensorflow/tpu/tree/master/models/official/detection/projects/self_training"},{"title":"stanleyjzheng/PyData","url":"https://github.com/stanleyjzheng/PyData"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-dada-seg","slug":"semantic-segmentation-on-dada-seg","dataset":"DADA-seg","dataset_url":"/dataset/dada-seg","rows_in_archive":28,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"MMUDA","paper_title":"Towards Robust Semantic Segmentation of Accident Scenes via Multi-Source Mixed Sampling and Meta-Learning","paper_url":"/paper/towards-robust-semantic-segmentation-of","paper_date":"2022-03-19","arxiv_id":"2203.10395","code_links":[{"title":"xinyu-laura/mmuda","url":"https://github.com/xinyu-laura/mmuda"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-deliver","slug":"semantic-segmentation-on-deliver","dataset":"DeLiVER","dataset_url":"/dataset/deliver","rows_in_archive":26,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CAFuser-CAA","paper_title":"CAFuser: Condition-Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes","paper_url":"/paper/condition-aware-multimodal-fusion-for-robust","paper_date":"2024-10-14","arxiv_id":"2410.10791","code_links":[{"title":"timbroed/cafuser","url":"https://github.com/timbroed/cafuser"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-stanford2d3d-1","slug":"semantic-segmentation-on-stanford2d3d-1","dataset":"Stanford2D3D Panoramic","dataset_url":"/dataset/2d-3d-s","rows_in_archive":25,"metrics":["mIoU","mAcc"],"first_row_in_archive_order":{"model":"SFSS-MMSI (RGB+HHA)","paper_title":"Single Frame Semantic Segmentation Using Multi-Modal Spherical Images","paper_url":"/paper/single-frame-semantic-segmentation-using","paper_date":"2023-08-18","arxiv_id":"2308.09369","code_links":[{"title":"sguttikon/SFSS-MMSI","url":"https://github.com/sguttikon/SFSS-MMSI"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-bdd100k-val","slug":"semantic-segmentation-on-bdd100k-val","dataset":"BDD100K val","dataset_url":"/dataset/bdd100k","rows_in_archive":24,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"VLTSeg","paper_title":"Strong but simple: A Baseline for Domain Generalized Dense Perception by CLIP-based Transfer Learning","paper_url":"/paper/vltseg-simple-transfer-of-clip-based-vision","paper_date":"2023-12-04","arxiv_id":"2312.02021","code_links":[{"title":"VLTSeg/VLTSeg","url":"https://github.com/VLTSeg/VLTSeg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-mcubes","slug":"semantic-segmentation-on-mcubes","dataset":"MCubeS","dataset_url":"/dataset/mcubes","rows_in_archive":22,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"StitchFusion (RGB-A-D-N)","paper_title":"StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation","paper_url":"/paper/2408-01343","paper_date":"2024-08-02","arxiv_id":"2408.01343","code_links":[{"title":"libingyu01/stitchfusion-stitchfusion-weaving-any-visual-modalities-to-enhance-multimodal-semantic-segmentation","url":"https://github.com/libingyu01/stitchfusion-stitchfusion-weaving-any-visual-modalities-to-enhance-multimodal-semantic-segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-camvid","slug":"semantic-segmentation-on-camvid","dataset":"CamVid","dataset_url":"/dataset/camvid","rows_in_archive":21,"metrics":["Mean IoU","Global Accuracy"],"first_row_in_archive_order":{"model":"SERNet-Former","paper_title":"SERNet-Former: Semantic Segmentation by Efficient Residual Network with Attention-Boosting Gates and Attention-Fusion Networks","paper_url":"/paper/sernet-former-semantic-segmentation-by","paper_date":"2024-01-28","arxiv_id":"2401.15741","code_links":[{"title":"serdarch/sernet-former","url":"https://github.com/serdarch/sernet-former"},{"title":"serdarch/SERNet-Former","url":"https://github.com/serdarch/SERNet-Former/blob/main/README.md"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-coco-stuff-test","slug":"semantic-segmentation-on-coco-stuff-test","dataset":"COCO-Stuff test","dataset_url":"/dataset/coco-stuff","rows_in_archive":21,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"VPNeXt","paper_title":"VPNeXt -- Rethinking Dense Decoding for Plain Vision Transformer","paper_url":"/paper/vpnext-rethinking-dense-decoding-for-plain","paper_date":"2025-02-23","arxiv_id":"2502.16654","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-imagenet-s","slug":"semantic-segmentation-on-imagenet-s","dataset":"ImageNet-S","dataset_url":"/dataset/imagenet-s","rows_in_archive":20,"metrics":["mIoU (val)","mIoU (test)"],"first_row_in_archive_order":{"model":"TEC (ViT-B/16, 224x224, SSL+FT, mmseg)","paper_title":"Towards Sustainable Self-supervised Learning","paper_url":"/paper/towards-sustainable-self-supervised-learning","paper_date":"2022-10-20","arxiv_id":"2210.11016","code_links":[{"title":"sail-sg/tec","url":"https://github.com/sail-sg/tec"}],"syntology":{"n":8,"n_ran":6,"n_unverified":2,"n_pointer_only":8}}},{"leaderboard":"/sota/semantic-segmentation-on-isprs-potsdam","slug":"semantic-segmentation-on-isprs-potsdam","dataset":"ISPRS Potsdam","dataset_url":"/dataset/isprs-potsdam","rows_in_archive":20,"metrics":["Overall Accuracy","Mean F1","Mean IoU"],"first_row_in_archive_order":{"model":"AerialFormer-B","paper_title":"AerialFormer: Multi-resolution Transformer for Aerial Image Segmentation","paper_url":"/paper/aerialformer-multi-resolution-transformer-for","paper_date":"2023-06-12","arxiv_id":"2306.06842","code_links":[{"title":"UARK-AICV/AerialFormer","url":"https://github.com/UARK-AICV/AerialFormer"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-lars","slug":"semantic-segmentation-on-lars","dataset":"LaRS","dataset_url":"/dataset/lars","rows_in_archive":20,"metrics":["Q","F1","μ","mIoU"],"first_row_in_archive_order":{"model":"SWIM^2 (Mask2Former)","paper_title":"The 2nd Workshop on Maritime Computer Vision (MaCVi) 2024","paper_url":"/paper/the-2nd-workshop-on-maritime-computer-vision","paper_date":"2023-11-23","arxiv_id":"2311.14762","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-isaid","slug":"semantic-segmentation-on-isaid","dataset":"iSAID","dataset_url":"/dataset/isaid","rows_in_archive":19,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SegNeXt-L","paper_title":"SegNeXt: Rethinking Convolutional Attention Design for Semantic Segmentation","paper_url":"/paper/segnext-rethinking-convolutional-attention","paper_date":"2022-09-18","arxiv_id":"2209.08575","code_links":[{"title":"open-mmlab/mmsegmentation","url":"https://github.com/open-mmlab/mmsegmentation"},{"title":"open-edge-platform/training_extensions","url":"https://github.com/open-edge-platform/training_extensions"},{"title":"visual-attention-network/segnext","url":"https://github.com/visual-attention-network/segnext"},{"title":"open-edge-platform/geti","url":"https://github.com/open-edge-platform/geti"},{"title":"Jittor/JSeg","url":"https://github.com/Jittor/JSeg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-loveda","slug":"semantic-segmentation-on-loveda","dataset":"LoveDA","dataset_url":"/dataset/loveda","rows_in_archive":19,"metrics":["Category mIoU"],"first_row_in_archive_order":{"model":"U-Net (MaxViT-S)","paper_title":"U-Net Ensemble for Enhanced Semantic Segmentation in Remote Sensing Imagery","paper_url":"/paper/u-net-ensemble-for-enhanced-semantic","paper_date":"2024-06-08","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-kitti-360","slug":"semantic-segmentation-on-kitti-360","dataset":"KITTI-360","dataset_url":"/dataset/kitti-360","rows_in_archive":17,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"DiPFormer","paper_title":"Depth Matters: Exploring Deep Interactions of RGB-D for Semantic Segmentation in Traffic Scenes","paper_url":"/paper/depth-matters-exploring-deep-interactions-of","paper_date":"2024-09-12","arxiv_id":"2409.07995","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-semantic3d","slug":"semantic-segmentation-on-semantic3d","dataset":"Semantic3D","dataset_url":"/dataset/semantic3d","rows_in_archive":17,"metrics":["mIoU","oAcc"],"first_row_in_archive_order":{"model":"Feature Geometric Net","paper_title":"FG-Net: Fast Large-Scale LiDAR Point Clouds Understanding Network Leveraging Correlated Feature Mining and Geometric-Aware Modelling","paper_url":"/paper/fg-net-fast-large-scale-lidar-point","paper_date":"2020-12-17","arxiv_id":"2012.09439","code_links":[{"title":"KangchengLiu/Feature-Geometric-Net-FG-Net","url":"https://github.com/KangchengLiu/Feature-Geometric-Net-FG-Net"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-trans10k","slug":"semantic-segmentation-on-trans10k","dataset":"Trans10K","dataset_url":"/dataset/trans10k","rows_in_archive":15,"metrics":["mIoU","GFLOPs"],"first_row_in_archive_order":{"model":"Trans4Trans (M)","paper_title":"Trans4Trans: Efficient Transformer for Transparent Object Segmentation to Help Visually Impaired People Navigate in the Real World","paper_url":"/paper/trans4trans-efficient-transformer-for","paper_date":"2021-07-07","arxiv_id":"2107.03172","code_links":[{"title":"jamycheung/Trans4Trans","url":"https://github.com/jamycheung/Trans4Trans"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-dark-zurich","slug":"semantic-segmentation-on-dark-zurich","dataset":"Dark Zurich","dataset_url":"/dataset/dark-zurich","rows_in_archive":14,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Refign (HRDA)","paper_title":"Refign: Align and Refine for Adaptation of Semantic Segmentation to Adverse Conditions","paper_url":"/paper/refign-align-and-refine-for-adaptation-of","paper_date":"2022-07-14","arxiv_id":"2207.06825","code_links":[{"title":"brdav/refign","url":"https://github.com/brdav/refign"}],"syntology":{"n":7,"n_ran":0,"n_unverified":7,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-fmb-dataset","slug":"semantic-segmentation-on-fmb-dataset","dataset":"FMB Dataset","dataset_url":"/dataset/fmb-dataset","rows_in_archive":14,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"RoadFormer+ (RGB-Infrared)","paper_title":"RoadFormer+: Delivering RGB-X Scene Parsing through Scale-Aware Information Decoupling and Advanced Heterogeneous Feature Fusion","paper_url":"/paper/roadformer-delivering-rgb-x-scene-parsing","paper_date":"2024-07-31","arxiv_id":"2407.21631","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-urbanlf","slug":"semantic-segmentation-on-urbanlf","dataset":"UrbanLF","dataset_url":null,"rows_in_archive":14,"metrics":["mIoU (Syn)","mIoU (Real)"],"first_row_in_archive_order":{"model":"CMNeXt (RGB-LF80)","paper_title":"Delivering Arbitrary-Modal Semantic Segmentation","paper_url":"/paper/delivering-arbitrary-modal-semantic","paper_date":"2023-03-02","arxiv_id":"2303.01480","code_links":[{"title":"jamycheung/DELIVER","url":"https://github.com/jamycheung/DELIVER"}],"syntology":{"n":7,"n_ran":6,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-lip-val","slug":"semantic-segmentation-on-lip-val","dataset":"LIP val","dataset_url":"/dataset/lip","rows_in_archive":13,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Hulk(Finetune, ViT-L)","paper_title":"Hulk: A Universal Knowledge Translator for Human-Centric Tasks","paper_url":"/paper/hulk-a-universal-knowledge-translator-for","paper_date":"2023-12-04","arxiv_id":"2312.01697","code_links":[{"title":"opengvlab/humanbench","url":"https://github.com/opengvlab/humanbench"},{"title":"opengvlab/hulk","url":"https://github.com/opengvlab/hulk"}],"syntology":{"n":24,"n_ran":12,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-nighttime-driving","slug":"semantic-segmentation-on-nighttime-driving","dataset":"Nighttime Driving","dataset_url":"/dataset/nighttime-driving","rows_in_archive":13,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"TADP","paper_title":"Text-image Alignment for Diffusion-based Perception","paper_url":"/paper/text-image-alignment-for-diffusion-based","paper_date":"2023-09-29","arxiv_id":"2310.00031","code_links":[{"title":"damaggu/tadp","url":"https://github.com/damaggu/tadp"},{"title":"nkondapa/RSVC","url":"https://github.com/nkondapa/RSVC"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-vaihingen","slug":"semantic-segmentation-on-vaihingen","dataset":"Vaihingen","dataset_url":null,"rows_in_archive":13,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CMX","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-zju-rgb-p","slug":"semantic-segmentation-on-zju-rgb-p","dataset":"ZJU-RGB-P","dataset_url":"/dataset/zju-rgb-p","rows_in_archive":13,"metrics":["mIoU","Frame (fps)"],"first_row_in_archive_order":{"model":"RoadFormer+ (ConvNeXt-L, RGB-AoLP)","paper_title":"RoadFormer+: Delivering RGB-X Scene Parsing through Scale-Aware Information Decoupling and Advanced Heterogeneous Feature Fusion","paper_url":"/paper/roadformer-delivering-rgb-x-scene-parsing","paper_date":"2024-07-31","arxiv_id":"2407.21631","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-eventscape","slug":"semantic-segmentation-on-eventscape","dataset":"EventScape","dataset_url":null,"rows_in_archive":12,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CMX (B4)","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-gtav-to-cityscapes-1","slug":"semantic-segmentation-on-gtav-to-cityscapes-1","dataset":"GTAV-to-Cityscapes Labels","dataset_url":"/dataset/gta5","rows_in_archive":12,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"MIC","paper_title":"MIC: Masked Image Consistency for Context-Enhanced Domain Adaptation","paper_url":"/paper/mic-masked-image-consistency-for-context","paper_date":"2022-12-02","arxiv_id":"2212.01322","code_links":[{"title":"lhoyer/mic","url":"https://github.com/lhoyer/mic"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-isprs-vaihingen","slug":"semantic-segmentation-on-isprs-vaihingen","dataset":"ISPRS Vaihingen","dataset_url":"/dataset/isprs-vaihingen","rows_in_archive":12,"metrics":["Overall Accuracy","Average F1","Category mIoU"],"first_row_in_archive_order":{"model":"LSKNet-S","paper_title":"LSKNet: A Foundation Lightweight Backbone for Remote Sensing","paper_url":"/paper/lsknet-a-foundation-lightweight-backbone-for","paper_date":"2024-03-18","arxiv_id":"2403.11735","code_links":[{"title":"zcablii/lsknet","url":"https://github.com/zcablii/lsknet"},{"title":"zcablii/Large-Selective-Kernel-Network","url":"https://github.com/zcablii/Large-Selective-Kernel-Network"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-scannetv2","slug":"semantic-segmentation-on-scannetv2","dataset":"ScanNetV2","dataset_url":"/dataset/scannet","rows_in_archive":12,"metrics":["Mean IoU","Pixel Accuracy","Mean IoU (test)","Mean IoU (val)"],"first_row_in_archive_order":{"model":"CMX","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-bjroad","slug":"semantic-segmentation-on-bjroad","dataset":"BJRoad","dataset_url":null,"rows_in_archive":11,"metrics":["IoU"],"first_row_in_archive_order":{"model":"CMNeXt","paper_title":"Delivering Arbitrary-Modal Semantic Segmentation","paper_url":"/paper/delivering-arbitrary-modal-semantic","paper_date":"2023-03-02","arxiv_id":"2303.01480","code_links":[{"title":"jamycheung/DELIVER","url":"https://github.com/jamycheung/DELIVER"}],"syntology":{"n":7,"n_ran":6,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-potsdam","slug":"semantic-segmentation-on-potsdam","dataset":"Potsdam","dataset_url":"/dataset/potsdam","rows_in_archive":11,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"LMFNet-3","paper_title":"LMFNet: An Efficient Multimodal Fusion Approach for Semantic Segmentation in High-Resolution Remote Sensing","paper_url":"/paper/lmfnet-an-efficient-multimodal-fusion","paper_date":"2024-04-21","arxiv_id":"2404.13659","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-us3d","slug":"semantic-segmentation-on-us3d","dataset":"US3D","dataset_url":null,"rows_in_archive":11,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"LMFNet-3","paper_title":"LMFNet: An Efficient Multimodal Fusion Approach for Semantic Segmentation in High-Resolution Remote Sensing","paper_url":"/paper/lmfnet-an-efficient-multimodal-fusion","paper_date":"2024-04-21","arxiv_id":"2404.13659","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-fine-grained-grass","slug":"semantic-segmentation-on-fine-grained-grass","dataset":"Fine-Grained Grass Segmentation Dataset","dataset_url":"/dataset/fine-grained-grass-segmentation-dataset","rows_in_archive":10,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"D2LS","paper_title":"Dynamic Dictionary Learning for Remote Sensing Image Segmentation","paper_url":"/paper/dynamic-dictionary-learning-for-remote","paper_date":"2025-03-09","arxiv_id":"2503.06683","code_links":[{"title":"XavierJiezou/D2LS","url":"https://github.com/XavierJiezou/D2LS"}],"syntology":{"n":12,"n_ran":9,"n_unverified":3,"n_pointer_only":12}}},{"leaderboard":"/sota/semantic-segmentation-on-spacenet-1","slug":"semantic-segmentation-on-spacenet-1","dataset":"SpaceNet 1","dataset_url":"/dataset/spacenet-1","rows_in_archive":10,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"MAE+MTP(ViT-L)","paper_title":"MTP: Advancing Remote Sensing Foundation Model via Multi-Task Pretraining","paper_url":"/paper/mtp-advancing-remote-sensing-foundation-model","paper_date":"2024-03-20","arxiv_id":"2403.13430","code_links":[{"title":"vitae-transformer/mtp","url":"https://github.com/vitae-transformer/mtp"},{"title":"cuzyoung/crossearth","url":"https://github.com/cuzyoung/crossearth"}],"syntology":{"n":5,"n_ran":4,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-syn-udtiri","slug":"semantic-segmentation-on-syn-udtiri","dataset":"SYN-UDTIRI","dataset_url":null,"rows_in_archive":10,"metrics":["IoU"],"first_row_in_archive_order":{"model":"RoadFormer+ (B)","paper_title":"RoadFormer+: Delivering RGB-X Scene Parsing through Scale-Aware Information Decoupling and Advanced Heterogeneous Feature Fusion","paper_url":"/paper/roadformer-delivering-rgb-x-scene-parsing","paper_date":"2024-07-31","arxiv_id":"2407.21631","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-uavid","slug":"semantic-segmentation-on-uavid","dataset":"UAVid","dataset_url":"/dataset/uavid","rows_in_archive":10,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"U-Net Ensemble","paper_title":"U-Net Ensemble for Enhanced Semantic Segmentation in Remote Sensing Imagery","paper_url":"/paper/u-net-ensemble-for-enhanced-semantic","paper_date":"2024-06-08","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-coco-1","slug":"semantic-segmentation-on-coco-1","dataset":"COCO (Common Objects in Context)","dataset_url":"/dataset/coco","rows_in_archive":9,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"HyperSeg","paper_title":"HyperSeg: Towards Universal Visual Segmentation with Large Language Model","paper_url":"/paper/hyperseg-towards-universal-visual","paper_date":"2024-11-26","arxiv_id":"2411.17606","code_links":[{"title":"congvvc/HyperSeg","url":"https://github.com/congvvc/HyperSeg"}],"syntology":{"n":17,"n_ran":7,"n_unverified":10,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-ddd17","slug":"semantic-segmentation-on-ddd17","dataset":"DDD17","dataset_url":"/dataset/ddd17","rows_in_archive":9,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"BRENet","paper_title":"Rethinking RGB-Event Semantic Segmentation with a Novel Bidirectional Motion-enhanced Event Representation","paper_url":"/paper/rethinking-rgb-event-semantic-segmentation","paper_date":"2025-05-02","arxiv_id":"2505.01548","code_links":[{"title":"zyaocoder/BRENet","url":"https://github.com/zyaocoder/BRENet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-deliver-1","slug":"semantic-segmentation-on-deliver-1","dataset":"DELIVER","dataset_url":"/dataset/deliver","rows_in_archive":9,"metrics":["mIoU","test mIoU"],"first_row_in_archive_order":{"model":"CAFuser","paper_title":"CAFuser: Condition-Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes","paper_url":"/paper/condition-aware-multimodal-fusion-for-robust","paper_date":"2024-10-14","arxiv_id":"2410.10791","code_links":[{"title":"timbroed/cafuser","url":"https://github.com/timbroed/cafuser"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-dsec","slug":"semantic-segmentation-on-dsec","dataset":"DSEC","dataset_url":"/dataset/dsec","rows_in_archive":9,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"BRENet","paper_title":"Rethinking RGB-Event Semantic Segmentation with a Novel Bidirectional Motion-enhanced Event Representation","paper_url":"/paper/rethinking-rgb-event-semantic-segmentation","paper_date":"2025-05-02","arxiv_id":"2505.01548","code_links":[{"title":"zyaocoder/BRENet","url":"https://github.com/zyaocoder/BRENet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-inria-aerial-image","slug":"semantic-segmentation-on-inria-aerial-image","dataset":"INRIA Aerial Image Labeling","dataset_url":"/dataset/inria-aerial-image-labeling","rows_in_archive":8,"metrics":["IoU","mIOU"],"first_row_in_archive_order":{"model":"UANet(PVT-V2-B2)","paper_title":"Building Extraction from Remote Sensing Images via an Uncertainty-Aware Network","paper_url":"/paper/building-extraction-from-remote-sensing-1","paper_date":"2023-07-23","arxiv_id":"2307.12309","code_links":[{"title":"henryjiepanli/uncertainty-aware-network","url":"https://github.com/henryjiepanli/uncertainty-aware-network"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-llrgbd-synthetic","slug":"semantic-segmentation-on-llrgbd-synthetic","dataset":"LLRGBD-synthetic","dataset_url":null,"rows_in_archive":8,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SMMCL (SegNeXt-B)","paper_title":"Understanding Dark Scenes by Contrasting Multi-Modal Observations","paper_url":"/paper/understanding-dark-scenes-by-contrasting","paper_date":"2023-08-23","arxiv_id":"2308.12320","code_links":[{"title":"palmdong/smmcl","url":"https://github.com/palmdong/smmcl"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-mapillary-val","slug":"semantic-segmentation-on-mapillary-val","dataset":"Mapillary val","dataset_url":"/dataset/mapillary-vistas-dataset","rows_in_archive":8,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"AO-SegNet","paper_title":"Interactive Learning of Intrinsic and Extrinsic Properties for All-day Semantic Segmentation","paper_url":"/paper/interactive-learning-of-intrinsic-and","paper_date":"2023-07-07","arxiv_id":null,"code_links":[{"title":"BiQiWHU/All-day-CityScapes-segmentation","url":"https://github.com/BiQiWHU/All-day-CityScapes-segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-mcubes-p","slug":"semantic-segmentation-on-mcubes-p","dataset":"MCubeS (P)","dataset_url":"/dataset/mcubes-p","rows_in_archive":8,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"MMSFormer (RGB-A-D)","paper_title":"MMSFormer: Multimodal Transformer for Material and Semantic Segmentation","paper_url":"/paper/multimodal-transformer-for-material","paper_date":"2023-09-07","arxiv_id":"2309.04001","code_links":[{"title":"csiplab/mmsformer","url":"https://github.com/csiplab/mmsformer"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-spectralwaste","slug":"semantic-segmentation-on-spectralwaste","dataset":"SpectralWaste","dataset_url":null,"rows_in_archive":8,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CMX (RGB-HYPER)","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-uplight","slug":"semantic-segmentation-on-uplight","dataset":"UPLight","dataset_url":"/dataset/uplight","rows_in_archive":8,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"ShareCMP (B2 RGB-FP)","paper_title":"ShareCMP: Polarization-Aware RGB-P Semantic Segmentation","paper_url":"/paper/sharecmp-polarization-aware-rgb-p-semantic","paper_date":"2023-12-06","arxiv_id":"2312.03430","code_links":[{"title":"lefteyex/sharecmp","url":"https://github.com/lefteyex/sharecmp"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-foodseg103","slug":"semantic-segmentation-on-foodseg103","dataset":"FoodSeg103","dataset_url":"/dataset/foodseg103","rows_in_archive":7,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"FoodSAM","paper_title":"FoodSAM: Any Food Segmentation","paper_url":"/paper/foodsam-any-food-segmentation","paper_date":"2023-08-11","arxiv_id":"2308.05938","code_links":[{"title":"jamesjg/foodsam","url":"https://github.com/jamesjg/foodsam"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-kitti-semantic","slug":"semantic-segmentation-on-kitti-semantic","dataset":"KITTI Semantic Segmentation","dataset_url":"/dataset/kitti","rows_in_archive":7,"metrics":["Mean IoU (class)","Category IoU","Category iIoU","class iIoU"],"first_row_in_archive_order":{"model":"RPVNet [xu2021rpvnet]","paper_title":"Spherical Transformer for LiDAR-based 3D Recognition","paper_url":"/paper/spherical-transformer-for-lidar-based-3d","paper_date":"2023-03-22","arxiv_id":"2303.12766","code_links":[{"title":"dvlab-research/sphereformer","url":"https://github.com/dvlab-research/sphereformer"},{"title":"dvlab-research/mask-attention-free-transformer","url":"https://github.com/dvlab-research/mask-attention-free-transformer"}],"syntology":{"n":13,"n_ran":4,"n_unverified":9,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-pothole-mix","slug":"semantic-segmentation-on-pothole-mix","dataset":"Pothole Mix","dataset_url":"/dataset/pothole-mix","rows_in_archive":7,"metrics":["Test Dice Multiclass","Test mIoU","Validation Dice Multiclass","Validation mIoU"],"first_row_in_archive_order":{"model":"Baseline - DeepLabv3+","paper_title":"SHREC 2022: pothole and crack detection in the road pavement using images and RGB-D data","paper_url":"/paper/shrec-2022-pothole-and-crack-detection-in-the","paper_date":"2022-05-26","arxiv_id":"2205.13326","code_links":[{"title":"4ndr3aR/pothole-mix-segmentation","url":"https://gitlab.com/4ndr3aR/pothole-mix-segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-selma","slug":"semantic-segmentation-on-selma","dataset":"SELMA","dataset_url":null,"rows_in_archive":7,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CMX","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-skyscapes-dense-1","slug":"semantic-segmentation-on-skyscapes-dense-1","dataset":"SkyScapes-Dense","dataset_url":null,"rows_in_archive":7,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SkyScapesNet-Dense","paper_title":"SkyScapes Fine-Grained Semantic Understanding of Aerial Scenes","paper_url":"/paper/skyscapes-fine-grained-semantic-understanding","paper_date":"2019-10-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-synthia-to","slug":"semantic-segmentation-on-synthia-to","dataset":"SYNTHIA-to-Cityscapes","dataset_url":"/dataset/synthia","rows_in_archive":7,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"HRDA + PiPa","paper_title":"PiPa: Pixel- and Patch-wise Self-supervised Learning for Domain Adaptative Semantic Segmentation","paper_url":"/paper/pipa-pixel-and-patch-wise-self-supervised","paper_date":"2022-11-14","arxiv_id":"2211.07609","code_links":[{"title":"chen742/PiPa","url":"https://github.com/chen742/PiPa"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-vdd","slug":"semantic-segmentation-on-vdd","dataset":"VDD","dataset_url":"/dataset/vdd","rows_in_archive":7,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Segformer-B2","paper_title":"VDD: Varied Drone Dataset for Semantic Segmentation","paper_url":"/paper/vdd-varied-drone-dataset-for-semantic","paper_date":"2023-05-23","arxiv_id":"2305.13608","code_links":[{"title":"RussRobin/VDD","url":"https://github.com/RussRobin/VDD"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-acdc-scribbles","slug":"semantic-segmentation-on-acdc-scribbles","dataset":"ACDC Scribbles","dataset_url":"/dataset/acdc-scribbles","rows_in_archive":6,"metrics":["Dice (Average)"],"first_row_in_archive_order":{"model":"ScribFormer","paper_title":"ScribFormer: Transformer Makes CNN Work Better for Scribble-based Medical Image Segmentation","paper_url":"/paper/scribformer-transformer-makes-cnn-work-better","paper_date":"2024-02-03","arxiv_id":"2402.02029","code_links":[{"title":"HUANGLIZI/ScribFormer","url":"https://github.com/HUANGLIZI/ScribFormer"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-event-based","slug":"semantic-segmentation-on-event-based","dataset":"Event-based Segmentation Dataset","dataset_url":null,"rows_in_archive":6,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Bimodal SegNet","paper_title":"Bimodal SegNet: Instance Segmentation Fusing Events and RGB Frames for Robotic Grasping","paper_url":"/paper/bimodal-segnet-instance-segmentation-fusing","paper_date":"2023-03-20","arxiv_id":"2303.11228","code_links":[{"title":"sanket0707/bimodal-segnet","url":"https://github.com/sanket0707/bimodal-segnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-gamus","slug":"semantic-segmentation-on-gamus","dataset":"GAMUS","dataset_url":null,"rows_in_archive":6,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"TIMF","paper_title":"GAMUS: A Geometry-aware Multi-modal Semantic Segmentation Benchmark for Remote Sensing Data","paper_url":"/paper/gamus-a-geometry-aware-multi-modal-semantic","paper_date":"2023-05-24","arxiv_id":"2305.14914","code_links":[{"title":"earthnets/rsi-mmsegmentation","url":"https://github.com/earthnets/rsi-mmsegmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-porto","slug":"semantic-segmentation-on-porto","dataset":"Porto","dataset_url":null,"rows_in_archive":6,"metrics":["IoU"],"first_row_in_archive_order":{"model":"CMNeXt","paper_title":"Delivering Arbitrary-Modal Semantic Segmentation","paper_url":"/paper/delivering-arbitrary-modal-semantic","paper_date":"2023-03-02","arxiv_id":"2303.01480","code_links":[{"title":"jamycheung/DELIVER","url":"https://github.com/jamycheung/DELIVER"}],"syntology":{"n":7,"n_ran":6,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-stanford2d3d-rgbd","slug":"semantic-segmentation-on-stanford2d3d-rgbd","dataset":"Stanford2D3D - RGBD","dataset_url":"/dataset/2d-3d-s","rows_in_archive":6,"metrics":["mIoU","Pixel Accuracy","mAcc"],"first_row_in_archive_order":{"model":"CMX (SegFormer-B4)","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-synpass","slug":"semantic-segmentation-on-synpass","dataset":"SynPASS","dataset_url":null,"rows_in_archive":6,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Trans4PASS+","paper_title":"Behind Every Domain There is a Shift: Adapting Distortion-aware Vision Transformers for Panoramic Semantic Segmentation","paper_url":"/paper/behind-every-domain-there-is-a-shift-adapting","paper_date":"2022-07-25","arxiv_id":"2207.11860","code_links":[{"title":"jamycheung/trans4pass","url":"https://github.com/jamycheung/trans4pass"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-tlcgis","slug":"semantic-segmentation-on-tlcgis","dataset":"TLCGIS","dataset_url":null,"rows_in_archive":6,"metrics":["IoU"],"first_row_in_archive_order":{"model":"SA-Gate","paper_title":"Bi-directional Cross-Modality Feature Propagation with Separation-and-Aggregation Gate for RGB-D Semantic Segmentation","paper_url":"/paper/bi-directional-cross-modality-feature","paper_date":"2020-07-17","arxiv_id":"2007.09183","code_links":[{"title":"charlesCXK/RGBD_Semantic_Segmentation_PyTorch","url":"https://github.com/charlesCXK/RGBD_Semantic_Segmentation_PyTorch"},{"title":"David-zaiwang/114_rgbd_seg","url":"https://github.com/David-zaiwang/114_rgbd_seg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-flair-french-land","slug":"semantic-segmentation-on-flair-french-land","dataset":"FLAIR (French Land cover from Aerospace ImageRy)","dataset_url":"/dataset/flair-french-land-cover-from-aerospace","rows_in_archive":5,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Ensemble-04 MiT-0 MiT-1 RNX-1 RNX-2","paper_title":"Modernized Training of U-Net for Aerial Semantic Segmentation","paper_url":"/paper/modernized-training-of-u-net-for-aerial","paper_date":"2024-01-01","arxiv_id":null,"code_links":[{"title":"strakaj/U-Net-for-remote-sensing","url":"https://github.com/strakaj/U-Net-for-remote-sensing"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-hypersim","slug":"semantic-segmentation-on-hypersim","dataset":"Hypersim","dataset_url":"/dataset/hypersim","rows_in_archive":5,"metrics":["mIoU","mIoU (test)"],"first_row_in_archive_order":{"model":"EMSANet (2x ResNet-34 NBt1D)","paper_title":"PanopticNDT: Efficient and Robust Panoptic Mapping","paper_url":"/paper/panopticndt-efficient-and-robust-panoptic","paper_date":"2023-09-24","arxiv_id":"2309.13635","code_links":[{"title":"tui-nicr/emsanet","url":"https://github.com/tui-nicr/emsanet"},{"title":"tui-nicr/panoptic-mapping","url":"https://github.com/tui-nicr/panoptic-mapping"},{"title":"tui-nicr/nicr-scene-analysis-datasets","url":"https://github.com/tui-nicr/nicr-scene-analysis-datasets"},{"title":"tui-nicr/emsaformer","url":"https://github.com/tui-nicr/emsaformer"}],"syntology":{"n":12,"n_ran":0,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-rellis-3d-dataset","slug":"semantic-segmentation-on-rellis-3d-dataset","dataset":"RELLIS-3D Dataset","dataset_url":"/dataset/rellis-3d","rows_in_archive":5,"metrics":["Mean IoU (class)"],"first_row_in_archive_order":{"model":"Swiftnet","paper_title":"Semantic Segmentation with High Inference Speed in Off-Road Environments","paper_url":"/paper/semantic-segmentation-with-high-inference","paper_date":"2023-04-10","arxiv_id":null,"code_links":[{"title":"cufctl/segmentation","url":"https://github.com/cufctl/segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-replica","slug":"semantic-segmentation-on-replica","dataset":"Replica","dataset_url":"/dataset/replica","rows_in_archive":5,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"LabelMaker","paper_title":"LABELMAKER: Automatic Semantic Label Generation from RGB-D Trajectories","paper_url":"/paper/labelmaker-automatic-semantic-label","paper_date":"2023-11-20","arxiv_id":"2311.12174","code_links":[{"title":"cvg/labelmaker","url":"https://github.com/cvg/labelmaker"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-shapenet","slug":"semantic-segmentation-on-shapenet","dataset":"ShapeNet","dataset_url":"/dataset/shapenet","rows_in_archive":5,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"PatchFormer","paper_title":"PatchFormer: An Efficient Point Transformer with Patch Attention","paper_url":"/paper/patchformer-a-versatile-3d-transformer-based","paper_date":"2021-10-30","arxiv_id":"2111.00207","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-synthetic-bathing","slug":"semantic-segmentation-on-synthetic-bathing","dataset":"Synthetic Bathing Perception","dataset_url":null,"rows_in_archive":5,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CMX-SRA","paper_title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","paper_url":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","paper_date":"2022-03-09","arxiv_id":"2203.04838","code_links":[{"title":"huaaaliu/rgbx_semantic_segmentation","url":"https://github.com/huaaaliu/rgbx_semantic_segmentation"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-toronto-3d-l002","slug":"semantic-segmentation-on-toronto-3d-l002","dataset":"Toronto-3D L002","dataset_url":"/dataset/toronto-3d","rows_in_archive":5,"metrics":["oAcc","mIoU"],"first_row_in_archive_order":{"model":"EyeNet","paper_title":"Human Vision Based 3D Point Cloud Semantic Segmentation of Large-Scale Outdoor Scene","paper_url":"/paper/mrnet-multiple-input-receptive-field-network","paper_date":"2023-01-30","arxiv_id":"2301.12972","code_links":[{"title":"Yacovitch/EyeNet","url":"https://github.com/Yacovitch/EyeNet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-big","slug":"semantic-segmentation-on-big","dataset":"BIG","dataset_url":"/dataset/big","rows_in_archive":4,"metrics":["mBA","IoU"],"first_row_in_archive_order":{"model":"PSPNet + CascadePSP","paper_title":"CascadePSP: Toward Class-Agnostic and Very High-Resolution Segmentation via Global and Local Refinement","paper_url":"/paper/cascadepsp-toward-class-agnostic-and-very","paper_date":"2020-05-06","arxiv_id":"2005.02551","code_links":[{"title":"hkchengrex/CascadePSP","url":"https://github.com/hkchengrex/CascadePSP"},{"title":"earth-insights/ClassTrans","url":"https://github.com/earth-insights/ClassTrans"}],"syntology":{"n":7,"n_ran":2,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-cc3m-tagmask","slug":"semantic-segmentation-on-cc3m-tagmask","dataset":"CC3M-TagMask","dataset_url":"/dataset/cc3m-tagmask","rows_in_archive":4,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"TTD (TCL)","paper_title":"TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag Bias","paper_url":"/paper/ttd-text-tag-self-distillation-enhancing","paper_date":"2024-03-30","arxiv_id":"2404.00384","code_links":[{"title":"shjo-april/TTD","url":"https://github.com/shjo-april/TTD"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/semantic-segmentation-on-fine-grained-cloud","slug":"semantic-segmentation-on-fine-grained-cloud","dataset":"Fine-Grained Cloud Segmentation Dataset","dataset_url":"/dataset/fine-grained-cloud-segmentation-dataset","rows_in_archive":4,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"D2LS","paper_title":"Dynamic Dictionary Learning for Remote Sensing Image Segmentation","paper_url":"/paper/dynamic-dictionary-learning-for-remote","paper_date":"2025-03-09","arxiv_id":"2503.06683","code_links":[{"title":"XavierJiezou/D2LS","url":"https://github.com/XavierJiezou/D2LS"}],"syntology":{"n":12,"n_ran":9,"n_unverified":3,"n_pointer_only":12}}},{"leaderboard":"/sota/semantic-segmentation-on-lombardia-sentinel-2","slug":"semantic-segmentation-on-lombardia-sentinel-2","dataset":"Lombardia Sentinel-2 Image Time Series for Crop Mapping","dataset_url":"/dataset/lombardia-sentinel-2-image-time-series-for","rows_in_archive":4,"metrics":["Overall Accuracy"],"first_row_in_archive_order":{"model":"UNet3D","paper_title":"Enhancing crop segmentation in satellite image time-series with transformer networks","paper_url":"/paper/enhancing-crop-segmentation-in-satellite","paper_date":"2024-04-03","arxiv_id":null,"code_links":[{"title":"mattiagatti/sentinel2-crop-mapping-models","url":"https://gitlab.com/mattiagatti/sentinel2-crop-mapping-models"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-matterport3d","slug":"semantic-segmentation-on-matterport3d","dataset":"Matterport3D","dataset_url":"/dataset/matterport3d","rows_in_archive":4,"metrics":["Test mIoU","Validation mIoU"],"first_row_in_archive_order":{"model":"SFSS-MMSI (RGB+Depth)","paper_title":"Single Frame Semantic Segmentation Using Multi-Modal Spherical Images","paper_url":"/paper/single-frame-semantic-segmentation-using","paper_date":"2023-08-18","arxiv_id":"2308.09369","code_links":[{"title":"sguttikon/SFSS-MMSI","url":"https://github.com/sguttikon/SFSS-MMSI"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-okutama-drone-and","slug":"semantic-segmentation-on-okutama-drone-and","dataset":"Okutama Drone and Swiss Drone Dataset","dataset_url":"/dataset/okutama-drone-and-swiss-drone-dataset","rows_in_archive":4,"metrics":["mIoU","Acc"],"first_row_in_archive_order":{"model":"DeepLabv3+‐ResNet‐101","paper_title":"Deep learning with RGB and thermal images onboard a drone for monitoring operations","paper_url":"/paper/deep-learning-with-rgb-and-thermal-images","paper_date":"2022-05-31","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-petraw","slug":"semantic-segmentation-on-petraw","dataset":"PETRAW","dataset_url":"/dataset/petraw","rows_in_archive":4,"metrics":["Mean IoU (class)"],"first_row_in_archive_order":{"model":"NCC Next","paper_title":"PEg TRAnsfer Workflow recognition challenge report: Does multi-modal data improve recognition?","paper_url":"/paper/peg-transfer-workflow-recognition-challenge","paper_date":"2022-02-11","arxiv_id":"2202.05821","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-structured3d","slug":"semantic-segmentation-on-structured3d","dataset":"Structured3D","dataset_url":"/dataset/structured3d","rows_in_archive":4,"metrics":["Test mIoU","Validation mIoU"],"first_row_in_archive_order":{"model":"SFSS-MMSI (RGB+Depth+Normal)","paper_title":"Single Frame Semantic Segmentation Using Multi-Modal Spherical Images","paper_url":"/paper/single-frame-semantic-segmentation-using","paper_date":"2023-08-18","arxiv_id":"2308.09369","code_links":[{"title":"sguttikon/SFSS-MMSI","url":"https://github.com/sguttikon/SFSS-MMSI"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-thud-robotic-dataset","slug":"semantic-segmentation-on-thud-robotic-dataset","dataset":"THUD Robotic Dataset","dataset_url":null,"rows_in_archive":4,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SA-Gate","paper_title":"Bi-directional Cross-Modality Feature Propagation with Separation-and-Aggregation Gate for RGB-D Semantic Segmentation","paper_url":"/paper/bi-directional-cross-modality-feature","paper_date":"2020-07-17","arxiv_id":"2007.09183","code_links":[{"title":"charlesCXK/RGBD_Semantic_Segmentation_PyTorch","url":"https://github.com/charlesCXK/RGBD_Semantic_Segmentation_PyTorch"},{"title":"David-zaiwang/114_rgbd_seg","url":"https://github.com/David-zaiwang/114_rgbd_seg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-cems-w","slug":"semantic-segmentation-on-cems-w","dataset":"CEMS-W","dataset_url":"/dataset/cems-w","rows_in_archive":3,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"UPerNet (RN50)","paper_title":"Robust Burned Area Delineation through Multitask Learning","paper_url":"/paper/robust-burned-area-delineation-through","paper_date":"2023-09-15","arxiv_id":"2309.08368","code_links":[{"title":"links-ads/burned-area-seg","url":"https://github.com/links-ads/burned-area-seg"},{"title":"links-ads/maclean-burned-area-segmentation","url":"https://github.com/links-ads/maclean-burned-area-segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-dacl10k-v1-testdev","slug":"semantic-segmentation-on-dacl10k-v1-testdev","dataset":"dacl10k v1 testdev","dataset_url":null,"rows_in_archive":3,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"FPN EfficientNet-B4 w/ Aux loss","paper_title":"dacl10k: Benchmark for Semantic Bridge Damage Segmentation","paper_url":"/paper/dacl10k-benchmark-for-semantic-bridge-damage","paper_date":"2023-09-01","arxiv_id":"2309.00460","code_links":[{"title":"phiyodr/dacl10k-toolkit","url":"https://github.com/phiyodr/dacl10k-toolkit"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-diva-hisdb","slug":"semantic-segmentation-on-diva-hisdb","dataset":"DIVA-HisDB","dataset_url":"/dataset/diva-hisdb","rows_in_archive":3,"metrics":["Mean IoU (class)"],"first_row_in_archive_order":{"model":"U-Net","paper_title":"DIVA-DAF: A Deep Learning Framework for Historical Document Image Analysis","paper_url":"/paper/diva-daf-a-deep-learning-framework-for","paper_date":"2022-01-20","arxiv_id":"2201.08295","code_links":[{"title":"DIVA-DIA/DIVA-DAF","url":"https://github.com/DIVA-DIA/DIVA-DAF"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-montgomery-county-x","slug":"semantic-segmentation-on-montgomery-county-x","dataset":"Montgomery County X-ray Set","dataset_url":"/dataset/montgomery-county-x-ray-set","rows_in_archive":3,"metrics":["F1-score"],"first_row_in_archive_order":{"model":"UNETR + SS-CXR","paper_title":"SPCXR: Self-supervised Pretraining using Chest X-rays Towards a Domain Specific Foundation Model","paper_url":"/paper/ss-cxr-multitask-representation-learning","paper_date":"2022-11-23","arxiv_id":"2211.12944","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2011-test","slug":"semantic-segmentation-on-pascal-voc-2011-test","dataset":"PASCAL VOC 2011 test","dataset_url":"/dataset/pascal-voc-2011","rows_in_archive":3,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"Plugin network","paper_title":"Plugin Networks for Inference under Partial Evidence","paper_url":"/paper/plugin-networks-for-inference-under-partial","paper_date":"2019-01-02","arxiv_id":"1901.00326","code_links":[{"title":"tooploox/plugin-networks","url":"https://github.com/tooploox/plugin-networks"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pastis","slug":"semantic-segmentation-on-pastis","dataset":"PASTIS","dataset_url":"/dataset/pastis","rows_in_archive":3,"metrics":["Mean IoU (test)","Number of Params","Overall Accuracy"],"first_row_in_archive_order":{"model":"Exchanger+Mask2Former","paper_title":"Revisiting the Encoding of Satellite Image Time Series","paper_url":"/paper/rethinking-the-encoding-of-satellite-image","paper_date":"2023-05-03","arxiv_id":"2305.02086","code_links":[{"title":"TotalVariation/Exchanger4SITS","url":"https://github.com/TotalVariation/Exchanger4SITS"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-potsdam-1","slug":"semantic-segmentation-on-potsdam-1","dataset":"Potsdam","dataset_url":"/dataset/potsdam","rows_in_archive":3,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"HRNet-48","paper_title":"Deep High-Resolution Representation Learning for Visual Recognition","paper_url":"/paper/190807919","paper_date":"2019-08-20","arxiv_id":"1908.07919","code_links":[{"title":"open-mmlab/mmdetection","url":"https://github.com/open-mmlab/mmdetection"},{"title":"PaddlePaddle/PaddleDetection","url":"https://github.com/PaddlePaddle/PaddleDetection"},{"title":"open-mmlab/mmsegmentation","url":"https://github.com/open-mmlab/mmsegmentation"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"open-mmlab/mmpose","url":"https://github.com/open-mmlab/mmpose"},{"title":"PaddlePaddle/PaddleClas","url":"https://github.com/PaddlePaddle/PaddleClas"},{"title":"CSAILVision/semantic-segmentation-pytorch","url":"https://github.com/CSAILVision/semantic-segmentation-pytorch"},{"title":"leoxiaobin/deep-high-resolution-net.pytorch","url":"https://github.com/leoxiaobin/deep-high-resolution-net.pytorch"},{"title":"HRNet/HRNet-Semantic-Segmentation","url":"https://github.com/HRNet/HRNet-Semantic-Segmentation"},{"title":"HRNet/HRNet-Facial-Landmark-Detection","url":"https://github.com/HRNet/HRNet-Facial-Landmark-Detection"},{"title":"HRNet/HRNet-Image-Classification","url":"https://github.com/HRNet/HRNet-Image-Classification"},{"title":"HRNet/HRNet-Object-Detection","url":"https://github.com/HRNet/HRNet-Object-Detection"},{"title":"mindspore-lab/mindone","url":"https://github.com/mindspore-lab/mindone"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/tree/master/research/cv/HRNetW48_cls"},{"title":"JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models","url":"https://github.com/JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models"},{"title":"mlpc-ucsd/PRTR","url":"https://github.com/mlpc-ucsd/PRTR"},{"title":"HRNet/HRNet-MaskRCNN-Benchmark","url":"https://github.com/HRNet/HRNet-MaskRCNN-Benchmark"},{"title":"yuanyuanli85/tf-hrnet","url":"https://github.com/yuanyuanli85/tf-hrnet"},{"title":"sithu31296/pose-estimation","url":"https://github.com/sithu31296/pose-estimation"},{"title":"megvii-research/basecls","url":"https://github.com/megvii-research/basecls/tree/main/zoo/public/hrnet"},{"title":"shuuchen/HRNet","url":"https://github.com/shuuchen/HRNet"},{"title":"pikabite/segmentations_tf2","url":"https://github.com/pikabite/segmentations_tf2"},{"title":"shijianjian/HRNet_Keras","url":"https://github.com/shijianjian/HRNet_Keras"},{"title":"d-shivam/Pose-estimation-based-action-recognition-for-help-Situation-Identification","url":"https://github.com/d-shivam/Pose-estimation-based-action-recognition-for-help-Situation-Identification"},{"title":"2023-MindSpore-4/Code-5","url":"https://github.com/2023-MindSpore-4/Code-5/tree/main/HRNetW48_cls"},{"title":"eshaanagarwal/hr-net-implementation","url":"https://github.com/eshaanagarwal/hr-net-implementation"},{"title":"Mind23-2/MindCode-3","url":"https://github.com/Mind23-2/MindCode-3/tree/main/HRNetW48_cls"},{"title":"w-sugar/prtr","url":"https://github.com/w-sugar/prtr"},{"title":"2023-MindSpore-1/ms-code-214","url":"https://github.com/2023-MindSpore-1/ms-code-214/tree/main/HMR"},{"title":"2023-MindSpore-1/ms-code-214","url":"https://github.com/2023-MindSpore-1/ms-code-214/tree/main/HRNetW48_cls"},{"title":"Mind23-2/MindCode-4","url":"https://github.com/Mind23-2/MindCode-4/tree/main/hrnet"},{"title":"yukichou/PET","url":"https://github.com/yukichou/PET"},{"title":"Mind23-2/MindCode-101","url":"https://github.com/Mind23-2/MindCode-101/tree/main/HRNetW48_cls"},{"title":"alililia/ascend_HRNetW48_cls","url":"https://github.com/alililia/ascend_HRNetW48_cls"},{"title":"sdll/hrnet-pose-estimation","url":"https://github.com/sdll/hrnet-pose-estimation"},{"title":"2023-MindSpore-1/ms-code-162","url":"https://github.com/2023-MindSpore-1/ms-code-162"},{"title":"gox-ai/hrnet-pose-api","url":"https://github.com/gox-ai/hrnet-pose-api"},{"title":"anshky/HR-NET","url":"https://github.com/anshky/HR-NET"},{"title":"kingcong/gpu_HRNetW48_cls","url":"https://github.com/kingcong/gpu_HRNetW48_cls"},{"title":"yangyucheng000/HRNetW48_cls","url":"https://github.com/yangyucheng000/HRNetW48_cls"},{"title":"Calylyli/Mindsporehrnet","url":"https://github.com/Calylyli/Mindsporehrnet"},{"title":"baoshengyu/deep-high-resolution-net.pytorch","url":"https://github.com/baoshengyu/deep-high-resolution-net.pytorch"}],"syntology":{"n":34,"n_ran":3,"n_unverified":31,"n_pointer_only":16}}},{"leaderboard":"/sota/semantic-segmentation-on-sift-flow","slug":"semantic-segmentation-on-sift-flow","dataset":"SIFT-flow","dataset_url":null,"rows_in_archive":3,"metrics":["Mean Accuracy","Pixel Accuracy"],"first_row_in_archive_order":{"model":"RBE2E","paper_title":"Region-based semantic segmentation with end-to-end training","paper_url":"/paper/region-based-semantic-segmentation-with-end","paper_date":"2016-07-26","arxiv_id":"1607.07671","code_links":[{"title":"nightrome/matconvnet-calvin","url":"https://github.com/nightrome/matconvnet-calvin"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-stanford2d3d-2","slug":"semantic-segmentation-on-stanford2d3d-2","dataset":"Stanford2D3D Panoramic - RGBD","dataset_url":"/dataset/2d-3d-s","rows_in_archive":3,"metrics":["mAcc","mIoU"],"first_row_in_archive_order":{"model":"CBFC","paper_title":"Complementary Bi-directional Feature Compression for Indoor 360° Semantic Segmentation with Self-distillation","paper_url":"/paper/complementary-bi-directional-feature","paper_date":"2022-07-06","arxiv_id":"2207.02437","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-synthia","slug":"semantic-segmentation-on-synthia","dataset":"SYNTHIA","dataset_url":"/dataset/synthia","rows_in_archive":3,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CGA-Net","paper_title":"CGA-Net: Category Guided Aggregation for Point Cloud Semantic Segmentation","paper_url":"/paper/cga-net-category-guided-aggregation-for-point","paper_date":"2021-06-19","arxiv_id":null,"code_links":[{"title":"MCG-NJU/CGA-Net","url":"https://github.com/MCG-NJU/CGA-Net"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-us3d-1","slug":"semantic-segmentation-on-us3d-1","dataset":"US3D","dataset_url":null,"rows_in_archive":3,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"DeepLabV3+","paper_title":"Encoder-Decoder with Atrous Separable Convolution for Semantic Image Segmentation","paper_url":"/paper/encoder-decoder-with-atrous-separable","paper_date":"2018-02-07","arxiv_id":"1802.02611","code_links":[{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/research/deeplab"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models"},{"title":"open-mmlab/mmsegmentation","url":"https://github.com/open-mmlab/mmsegmentation"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"jfzhang95/pytorch-deeplab-xception","url":"https://github.com/jfzhang95/pytorch-deeplab-xception"},{"title":"VainF/DeepLabV3Plus-Pytorch","url":"https://github.com/VainF/DeepLabV3Plus-Pytorch"},{"title":"y-ouali/pytorch_segmentation","url":"https://github.com/y-ouali/pytorch_segmentation"},{"title":"bonlime/keras-deeplab-v3-plus","url":"https://github.com/bonlime/keras-deeplab-v3-plus"},{"title":"ayoolaolafenwa/PixelLib","url":"https://github.com/ayoolaolafenwa/PixelLib"},{"title":"rishizek/tensorflow-deeplab-v3-plus","url":"https://github.com/rishizek/tensorflow-deeplab-v3-plus"},{"title":"Media-Smart/vedaseg","url":"https://github.com/Media-Smart/vedaseg"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/blob/master/research/cv/deeplabv3plus"},{"title":"MegEngine/Models","url":"https://github.com/MegEngine/Models/tree/master/official/vision/segmentation"},{"title":"tantara/JejuNet","url":"https://github.com/tantara/JejuNet"},{"title":"shanglianlm0525/CvPytorch","url":"https://github.com/shanglianlm0525/CvPytorch"},{"title":"leimao/DeepLab_v3","url":"https://github.com/leimao/DeepLab_v3"},{"title":"leimao/DeepLab-V3","url":"https://github.com/leimao/DeepLab-V3"},{"title":"srihari-humbarwadi/DeepLabV3_Plus-Tensorflow2.0","url":"https://github.com/srihari-humbarwadi/DeepLabV3_Plus-Tensorflow2.0"},{"title":"JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models","url":"https://github.com/JanMarcelKezmann/TensorFlow-Advanced-Segmentation-Models"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/blob/master/official/cv/deeplabv3plus"},{"title":"lattice-ai/DeepLabV3-Plus","url":"https://github.com/lattice-ai/DeepLabV3-Plus"},{"title":"FaceOnLive/Realtime-Background-Changer-SDK-Android","url":"https://github.com/FaceOnLive/Realtime-Background-Changer-SDK-Android"},{"title":"dootmaan/dsrl","url":"https://github.com/dootmaan/dsrl"},{"title":"chuhan89/wsss-tissue","url":"https://github.com/chuhan89/wsss-tissue"},{"title":"Burf/tfdetection","url":"https://github.com/Burf/tfdetection"},{"title":"nolanliou/PeopleSegmentationDemo","url":"https://github.com/nolanliou/PeopleSegmentationDemo"},{"title":"giovanniguidi/deeplabV3-PyTorch","url":"https://github.com/giovanniguidi/deeplabV3-PyTorch"},{"title":"giovanniguidi/deeplabV3_Pytorch","url":"https://github.com/giovanniguidi/deeplabV3_Pytorch"},{"title":"mlearing/pytorch-deeplab-v3-plus","url":"https://github.com/mlearing/pytorch-deeplab-v3-plus"},{"title":"MukhlasAdib/KITTI_Mapping","url":"https://github.com/MukhlasAdib/KITTI_Mapping"},{"title":"Gregor-Mendel-Institute/aradeepopsis","url":"https://github.com/Gregor-Mendel-Institute/aradeepopsis"},{"title":"parachutel/deeplabv3plus_on_Mapillary_Vistas","url":"https://github.com/parachutel/deeplabv3plus_on_Mapillary_Vistas"},{"title":"petko-nikolov/pysemseg","url":"https://github.com/petko-nikolov/pysemseg"},{"title":"czarmanu/sentinel_lakeice","url":"https://github.com/czarmanu/sentinel_lakeice"},{"title":"ucuapps/WSMIS","url":"https://github.com/ucuapps/WSMIS"},{"title":"mathildor/DeepLab-v3","url":"https://github.com/mathildor/DeepLab-v3"},{"title":"TanyaChutani/DeepLabV3Plus-Tf2.0","url":"https://github.com/TanyaChutani/DeepLabV3Plus-Tf2.0"},{"title":"shenshutao/image_segmentation","url":"https://github.com/shenshutao/image_segmentation"},{"title":"GuangyanZhang/SCNN-Deeplabv3-bisenet-icnet","url":"https://github.com/GuangyanZhang/SCNN-Deeplabv3-bisenet-icnet"},{"title":"samson6460/tf2_Segmentation","url":"https://github.com/samson6460/tf2_Segmentation"},{"title":"pideyi1025/DeepLabV3Plus-RailSem19","url":"https://github.com/pideyi1025/DeepLabV3Plus-RailSem19"},{"title":"developmentseed/looking-glass-pub","url":"https://github.com/developmentseed/looking-glass-pub"},{"title":"JinyongJeong/DeeplabV3_Apolloscape_and_CityScape","url":"https://github.com/JinyongJeong/DeeplabV3_Apolloscape_and_CityScape"},{"title":"Vignesh-95/cnn-semantic-segmentation-satellite-images","url":"https://github.com/Vignesh-95/cnn-semantic-segmentation-satellite-images"},{"title":"ensta-u2is/deeplabv3plus-muad-pytorch","url":"https://github.com/ensta-u2is/deeplabv3plus-muad-pytorch"},{"title":"wang-wg/DeepStroke","url":"https://github.com/wang-wg/DeepStroke"},{"title":"abhishekdbihani/MudrockNet","url":"https://github.com/abhishekdbihani/MudrockNet"},{"title":"giannifranchi/deeplabv3-superpixelmix","url":"https://github.com/giannifranchi/deeplabv3-superpixelmix"},{"title":"kekeller/semantic_soy_deeplabv3plus","url":"https://github.com/kekeller/semantic_soy_deeplabv3plus"},{"title":"SkyWa7ch3r/SceneSegmentation","url":"https://github.com/SkyWa7ch3r/SceneSegmentation"},{"title":"SkyWa7ch3r/ImageSegmentation","url":"https://github.com/SkyWa7ch3r/ImageSegmentation"},{"title":"Vujas-Eteph/CiVOS","url":"https://github.com/Vujas-Eteph/CiVOS"},{"title":"wangyi111/international-archaeology-ai-challenge","url":"https://github.com/wangyi111/international-archaeology-ai-challenge"},{"title":"sara-nl/SURF-segmentation","url":"https://github.com/sara-nl/SURF-segmentation"},{"title":"sara-nl/SURF-deeplab","url":"https://github.com/sara-nl/SURF-deeplab"},{"title":"samson6460/tf2_pose_estimation","url":"https://github.com/samson6460/tf2_pose_estimation"},{"title":"MindCode-4/code-3","url":"https://github.com/MindCode-4/code-3/tree/main/encoder_decoder"},{"title":"heidongxianhau/deeplab2","url":"https://github.com/heidongxianhau/deeplab2"},{"title":"zhuang42/csc420","url":"https://github.com/zhuang42/csc420"},{"title":"Robinatp/Deeplab_Tensorflow","url":"https://github.com/Robinatp/Deeplab_Tensorflow"},{"title":"kaichoulyc/course_segmentation","url":"https://github.com/kaichoulyc/course_segmentation"},{"title":"AutomatedAI/deeplab_segmentation_example","url":"https://github.com/AutomatedAI/deeplab_segmentation_example"},{"title":"chenmengyang/rename_later","url":"https://github.com/chenmengyang/rename_later"},{"title":"EdwinAlegria/object_semantic_deeplabv3","url":"https://github.com/EdwinAlegria/object_semantic_deeplabv3"},{"title":"AtrayeeNag/Image-Segmentation-deeplabv3","url":"https://github.com/AtrayeeNag/Image-Segmentation-deeplabv3"},{"title":"AutomatedAI/deeplab_inference","url":"https://github.com/AutomatedAI/deeplab_inference"},{"title":"kawausomando/green_vegetation_v2","url":"https://github.com/kawausomando/green_vegetation_v2"},{"title":"sharifelguindi/DeepLab","url":"https://github.com/sharifelguindi/DeepLab"},{"title":"Syarujianai/deeplab-commented","url":"https://github.com/Syarujianai/deeplab-commented"},{"title":"branislavhesko/segmentation_framework","url":"https://github.com/branislavhesko/segmentation_framework"},{"title":"MindSpore-paper-code-2/code400","url":"https://github.com/MindSpore-paper-code-2/code400/tree/main/DeepLabV3P"},{"title":"2023-MindSpore-1/ms-code-224","url":"https://github.com/2023-MindSpore-1/ms-code-224/tree/main/Alexnet"},{"title":"MindSpore-paper-code-2/code400","url":"https://github.com/MindSpore-paper-code-2/code400/tree/main/DeepLabv3"},{"title":"soumik12345/DeepLabV3-Plus","url":"https://github.com/soumik12345/DeepLabV3-Plus"},{"title":"saehan-choi/pixellib_auto_labelling","url":"https://github.com/saehan-choi/pixellib_auto_labelling"},{"title":"PuchatekwSzortach/voc_encoder_decoder_with_atrous_separable_convolutions","url":"https://github.com/PuchatekwSzortach/voc_encoder_decoder_with_atrous_separable_convolutions"},{"title":"phue/aradeepopsis","url":"https://github.com/phue/aradeepopsis"},{"title":"Popcorn-sugar/Deep_v2","url":"https://github.com/Popcorn-sugar/Deep_v2"}],"syntology":{"n":72,"n_ran":43,"n_unverified":29,"n_pointer_only":40}}},{"leaderboard":"/sota/semantic-segmentation-on-38-cloud","slug":"semantic-segmentation-on-38-cloud","dataset":"38-Cloud","dataset_url":null,"rows_in_archive":2,"metrics":["Jaccard (Mean)"],"first_row_in_archive_order":{"model":"Cloud-Net+","paper_title":"Cloud and Cloud Shadow Segmentation for Remote Sensing Imagery via Filtered Jaccard Loss Function and Parametric Augmentation","paper_url":"/paper/cloud-net-a-cloud-segmentation-cnn-for","paper_date":"2020-01-23","arxiv_id":"2001.08768","code_links":[{"title":"SorourMo/95-Cloud-An-Extension-to-38-Cloud-Dataset","url":"https://github.com/SorourMo/95-Cloud-An-Extension-to-38-Cloud-Dataset"},{"title":"dveyarangi/cloud-net-plus","url":"https://github.com/dveyarangi/cloud-net-plus"},{"title":"dfrisinghelli/pysegcnn","url":"https://github.com/dfrisinghelli/pysegcnn"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-ai-tod","slug":"semantic-segmentation-on-ai-tod","dataset":"AI-TOD","dataset_url":"/dataset/ai-tod","rows_in_archive":2,"metrics":["Dice"],"first_row_in_archive_order":{"model":"Unet++(ResNet-50)","paper_title":"UNet++: A Nested U-Net Architecture for Medical Image Segmentation","paper_url":"/paper/unet-a-nested-u-net-architecture-for-medical","paper_date":"2018-07-18","arxiv_id":"1807.10165","code_links":[{"title":"qubvel/segmentation_models.pytorch","url":"https://github.com/qubvel/segmentation_models.pytorch"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"MrGiovanni/Nested-UNet","url":"https://github.com/MrGiovanni/Nested-UNet"},{"title":"MrGiovanni/UNetPlusPlus","url":"https://github.com/MrGiovanni/UNetPlusPlus"},{"title":"bigmb/Unet-Segmentation-Pytorch-Nest-of-Unets","url":"https://github.com/bigmb/Unet-Segmentation-Pytorch-Nest-of-Unets"},{"title":"4uiiurz1/pytorch-nested-unet","url":"https://github.com/4uiiurz1/pytorch-nested-unet"},{"title":"yingkaisha/keras-unet-collection","url":"https://github.com/yingkaisha/keras-unet-collection"},{"title":"frgfm/Holocron","url":"https://github.com/frgfm/Holocron"},{"title":"1044197988/TF.Keras-Commonly-used-models","url":"https://github.com/1044197988/TF.Keras-Commonly-used-models"},{"title":"AlphaJia/keras_unet_plus_plus","url":"https://github.com/AlphaJia/keras_unet_plus_plus"},{"title":"Burf/tfdetection","url":"https://github.com/Burf/tfdetection"},{"title":"marccoru/marinedebrisdetector","url":"https://github.com/marccoru/marinedebrisdetector"},{"title":"CarryHJR/Nested-UNet","url":"https://github.com/CarryHJR/Nested-UNet"},{"title":"sauravmishra1710/UNet-Plus-Plus---Brain-Tumor-Segmentation","url":"https://github.com/sauravmishra1710/UNet-Plus-Plus---Brain-Tumor-Segmentation"},{"title":"amirfaraji/LowDoseCTPytorch","url":"https://github.com/amirfaraji/LowDoseCTPytorch"},{"title":"mrgiovanni/dissertation","url":"https://github.com/mrgiovanni/dissertation"},{"title":"gallegi/T4E_MICCAI_BrainTumor","url":"https://github.com/gallegi/T4E_MICCAI_BrainTumor"},{"title":"tuvovan/Unet-with-EfficientnetB7-Backbone","url":"https://github.com/tuvovan/Unet-with-EfficientnetB7-Backbone"},{"title":"aqbewtra/Multi-Class-Aerial-Segmentation","url":"https://github.com/aqbewtra/Multi-Class-Aerial-Segmentation"},{"title":"16xccheng/keras-unet","url":"https://github.com/16xccheng/keras-unet"},{"title":"nnzzll/networks","url":"https://github.com/nnzzll/networks"},{"title":"Tu-kun/cultivated_landdivision","url":"https://github.com/Tu-kun/cultivated_landdivision"},{"title":"2023-MindSpore-1/ms-code-217","url":"https://github.com/2023-MindSpore-1/ms-code-217/tree/main/UNet3%2B"},{"title":"mfp0610/semantic-segmentaion","url":"https://github.com/mfp0610/semantic-segmentaion"},{"title":"ShawFromAttock/FYP-Medical-Image-Segmentation-using-Nested-UNet-Architecture","url":"https://github.com/ShawFromAttock/FYP-Medical-Image-Segmentation-using-Nested-UNet-Architecture"},{"title":"TheUser0815/unetpp-pytorch","url":"https://github.com/TheUser0815/unetpp-pytorch"},{"title":"2023-MindSpore-4/Code10","url":"https://github.com/2023-MindSpore-4/Code10/tree/main/Unet"},{"title":"2023-MindSpore-1/ms-code-7","url":"https://github.com/2023-MindSpore-1/ms-code-7/tree/main/UNet3%2B"},{"title":"yangyucheng000/MSpaper","url":"https://github.com/yangyucheng000/MSpaper/tree/main/UNet3%2B"},{"title":"JoelPendleton/Edge-Detection-CNN","url":"https://github.com/JoelPendleton/Edge-Detection-CNN"},{"title":"MS-Mind/MS-Code-08","url":"https://github.com/MS-Mind/MS-Code-08/tree/main/MIMO-UNet"},{"title":"MindSpore-paper-code-2/code3","url":"https://github.com/MindSpore-paper-code-2/code3/tree/main/UNet3%2B"},{"title":"JoelPendleton/Object-Contour-Detection-CNN","url":"https://github.com/JoelPendleton/Object-Contour-Detection-CNN"},{"title":"sjosias/Tsetse-Flies","url":"https://github.com/sjosias/Tsetse-Flies"}],"syntology":{"n":28,"n_ran":5,"n_unverified":23,"n_pointer_only":2}}},{"leaderboard":"/sota/semantic-segmentation-on-apolloscape","slug":"semantic-segmentation-on-apolloscape","dataset":"ApolloScape","dataset_url":"/dataset/apolloscape-1","rows_in_archive":2,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"ERFNet-IntRA-KD (ours)","paper_title":"Inter-Region Affinity Distillation for Road Marking Segmentation","paper_url":"/paper/inter-region-affinity-distillation-for-road","paper_date":"2020-04-11","arxiv_id":"2004.05304","code_links":[{"title":"cardwing/Codes-for-IntRA-KD","url":"https://github.com/cardwing/Codes-for-IntRA-KD"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-cityscapes-2","slug":"semantic-segmentation-on-cityscapes-2","dataset":"Cityscapes","dataset_url":"/dataset/cityscapes","rows_in_archive":2,"metrics":["mIoU","Pixel Accuracy"],"first_row_in_archive_order":{"model":"SPFNet34M","paper_title":"S$^2$-FPN: Scale-ware Strip Attention Guided Feature Pyramid Network for Real-time Semantic Segmentation","paper_url":"/paper/s-textsuperscript-2-fpn-scale-ware-strip","paper_date":"2022-06-15","arxiv_id":"2206.07298","code_links":[{"title":"mohamedac29/s2-fpn","url":"https://github.com/mohamedac29/s2-fpn"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-cleargrasp-novel","slug":"semantic-segmentation-on-cleargrasp-novel","dataset":"Cleargrasp (Novel)","dataset_url":null,"rows_in_archive":2,"metrics":["Mean IoU","Accuracy"],"first_row_in_archive_order":{"model":"Cleargrasp","paper_title":"ClearGrasp: 3D Shape Estimation of Transparent Objects for Manipulation","paper_url":"/paper/cleargrasp-3d-shape-estimation-of-transparent","paper_date":"2019-10-06","arxiv_id":"1910.02550","code_links":[{"title":"Shreeyak/cleargrasp","url":"https://github.com/Shreeyak/cleargrasp"}],"syntology":{"n":8,"n_ran":0,"n_unverified":8,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-endoscapes","slug":"semantic-segmentation-on-endoscapes","dataset":"Endoscapes","dataset_url":"/dataset/endoscapes","rows_in_archive":2,"metrics":["Mean F1"],"first_row_in_archive_order":{"model":"MoCo V2 Surg SSL -  DeepLabv3+ head","paper_title":"Dissecting Self-Supervised Learning Methods for Surgical Computer Vision","paper_url":"/paper/dissecting-self-supervised-learning-methods","paper_date":"2022-07-01","arxiv_id":"2207.00449","code_links":[{"title":"camma-public/selfsupsurg","url":"https://github.com/camma-public/selfsupsurg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-freiburg-forest","slug":"semantic-segmentation-on-freiburg-forest","dataset":"Freiburg Forest","dataset_url":"/dataset/freiburg-forest","rows_in_archive":2,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SSMA","paper_title":"Self-Supervised Model Adaptation for Multimodal Semantic Segmentation","paper_url":"/paper/self-supervised-model-adaptation-for","paper_date":"2018-08-11","arxiv_id":"1808.03833","code_links":[{"title":"DeepSceneSeg/SSMA","url":"https://github.com/DeepSceneSeg/SSMA"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-graz-02","slug":"semantic-segmentation-on-graz-02","dataset":"Graz-02","dataset_url":null,"rows_in_archive":2,"metrics":["Pixel Accuracy"],"first_row_in_archive_order":{"model":"VOLO-D5","paper_title":"VOLO: Vision Outlooker for Visual Recognition","paper_url":"/paper/volo-vision-outlooker-for-visual-recognition","paper_date":"2021-06-24","arxiv_id":"2106.13112","code_links":[{"title":"rwightman/pytorch-image-models","url":"https://github.com/rwightman/pytorch-image-models"},{"title":"xmu-xiaoma666/External-Attention-pytorch","url":"https://github.com/xmu-xiaoma666/External-Attention-pytorch/blob/master/attention/OutlookAttention.py"},{"title":"BR-IDL/PaddleViT","url":"https://github.com/BR-IDL/PaddleViT/blob/main/image_classification/VOLO"},{"title":"sail-sg/volo","url":"https://github.com/sail-sg/volo"},{"title":"leondgarse/keras_cv_attention_models","url":"https://github.com/leondgarse/keras_cv_attention_models/tree/main/keras_cv_attention_models/volo"},{"title":"mindspore-courses/External-Attention-MindSpore","url":"https://github.com/mindspore-courses/External-Attention-MindSpore/blob/main/model/attention/OutlookAttention.py"},{"title":"mindspore-courses/External-Attention-MindSpore","url":"https://github.com/mindspore-courses/External-Attention-MindSpore/blob/main/model/backbone/VOLO.py"}],"syntology":{"n":6,"n_ran":1,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-hepic","slug":"semantic-segmentation-on-hepic","dataset":"HePIC 🏛️","dataset_url":"/dataset/hepic","rows_in_archive":2,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"BIM-Net++","paper_title":"Fully Automated Scan-to-BIM Via Point Cloud Instance Segmentation","paper_url":"/paper/fully-automated-scan-to-bim-via-point-cloud","paper_date":"2023-09-11","arxiv_id":null,"code_links":[{"title":"LTTM/Scan-to-BIM","url":"https://github.com/LTTM/Scan-to-BIM"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-hera-rfi-detection","slug":"semantic-segmentation-on-hera-rfi-detection","dataset":"HERA RFI Detection","dataset_url":"/dataset/hera-and-lofar-rfi-detection","rows_in_archive":2,"metrics":["AUPRC","AUROC","F1"],"first_row_in_archive_order":{"model":"Nearest Latent Neighbours","paper_title":"RFI Detection with Spiking Neural Networks","paper_url":"/paper/rfi-detection-with-spiking-neural-networks","paper_date":"2023-11-24","arxiv_id":"2311.14303","code_links":[{"title":"pritchardn/snn-nln","url":"https://github.com/pritchardn/snn-nln"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-kvasir-instrument","slug":"semantic-segmentation-on-kvasir-instrument","dataset":"Kvasir-Instrument","dataset_url":"/dataset/kvasir-instrument","rows_in_archive":2,"metrics":["DSC","mIoU"],"first_row_in_archive_order":{"model":"DoubleUNet","paper_title":"DoubleU-Net: A Deep Convolutional Neural Network for Medical Image Segmentation","paper_url":"/paper/doubleu-net-a-deep-convolutional-neural","paper_date":"2020-06-08","arxiv_id":"2006.04868","code_links":[{"title":"DebeshJha/2020-CBMS-DoubleU-Net","url":"https://github.com/DebeshJha/2020-CBMS-DoubleU-Net"},{"title":"mehul-k5/Double-Unet","url":"https://github.com/mehul-k5/Double-Unet"},{"title":"Janetteeeeeeee/double_unet","url":"https://github.com/Janetteeeeeeee/double_unet"},{"title":"harsh-jadhav/SIIM-Pneumothorax-Case-Study2","url":"https://github.com/harsh-jadhav/SIIM-Pneumothorax-Case-Study2"}],"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":5}}},{"leaderboard":"/sota/semantic-segmentation-on-lofar-rfi-detection","slug":"semantic-segmentation-on-lofar-rfi-detection","dataset":"LOFAR RFI Detection","dataset_url":"/dataset/lofar-rfi-detection","rows_in_archive":2,"metrics":["AUPRC","AUROC","F1"],"first_row_in_archive_order":{"model":"Nearest Latent Neighbours","paper_title":"RFI Detection with Spiking Neural Networks","paper_url":"/paper/rfi-detection-with-spiking-neural-networks","paper_date":"2023-11-24","arxiv_id":"2311.14303","code_links":[{"title":"pritchardn/snn-nln","url":"https://github.com/pritchardn/snn-nln"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-muses-multi-sensor","slug":"semantic-segmentation-on-muses-multi-sensor","dataset":"MUSES: MUlti-SEnsor Semantic perception dataset","dataset_url":"/dataset/muses-multi-sensor-semantic-perception","rows_in_archive":2,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CAFuser (Swin-T)","paper_title":"CAFuser: Condition-Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes","paper_url":"/paper/condition-aware-multimodal-fusion-for-robust","paper_date":"2024-10-14","arxiv_id":"2410.10791","code_links":[{"title":"timbroed/cafuser","url":"https://github.com/timbroed/cafuser"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2007","slug":"semantic-segmentation-on-pascal-voc-2007","dataset":"PASCAL VOC 2007","dataset_url":"/dataset/pascal-voc-2007","rows_in_archive":2,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"GALDNet","paper_title":"Global Aggregation then Local Distribution in Fully Convolutional Networks","paper_url":"/paper/global-aggregation-then-local-distribution-in","paper_date":"2019-09-16","arxiv_id":"1909.07229","code_links":[{"title":"lxtGH/GALD-DGCNet","url":"https://github.com/lxtGH/GALD-DGCNet"},{"title":"lxtGH/GALD-Net","url":"https://github.com/lxtGH/GALD-Net"}],"syntology":{"n":4,"n_ran":2,"n_unverified":2,"n_pointer_only":4}}},{"leaderboard":"/sota/semantic-segmentation-on-ph2","slug":"semantic-segmentation-on-ph2","dataset":"PH2","dataset_url":"/dataset/ph2","rows_in_archive":2,"metrics":["Average Dice","Average IOU"],"first_row_in_archive_order":{"model":"MobileUNETR","paper_title":"MobileUNETR: A Lightweight End-To-End Hybrid Vision Transformer For Efficient Medical Image Segmentation","paper_url":"/paper/mobileunetr-a-lightweight-end-to-end-hybrid","paper_date":"2024-09-04","arxiv_id":"2409.03062","code_links":[{"title":"osupcvlab/mobileunetr","url":"https://github.com/osupcvlab/mobileunetr"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-skyscapes-lane-1","slug":"semantic-segmentation-on-skyscapes-lane-1","dataset":"SkyScapes-Lane","dataset_url":null,"rows_in_archive":2,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SkyScapesNet-Lane","paper_title":"SkyScapes Fine-Grained Semantic Understanding of Aerial Scenes","paper_url":"/paper/skyscapes-fine-grained-semantic-understanding","paper_date":"2019-10-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-synthia-cvpr16","slug":"semantic-segmentation-on-synthia-cvpr16","dataset":"SYNTHIA-CVPR’16","dataset_url":"/dataset/synthia","rows_in_archive":2,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SSMA","paper_title":"Self-Supervised Model Adaptation for Multimodal Semantic Segmentation","paper_url":"/paper/self-supervised-model-adaptation-for","paper_date":"2018-08-11","arxiv_id":"1808.03833","code_links":[{"title":"DeepSceneSeg/SSMA","url":"https://github.com/DeepSceneSeg/SSMA"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-airs","slug":"semantic-segmentation-on-airs","dataset":"AIRS","dataset_url":"/dataset/airs","rows_in_archive":1,"metrics":["IoU"],"first_row_in_archive_order":{"model":"ICT-Net","paper_title":"Semantic Segmentation from Remote Sensor Data and the Exploitation of Latent Learning for Classification of Auxiliary Tasks","paper_url":"/paper/semantic-segmentation-from-remote-sensor-data","paper_date":"2019-12-19","arxiv_id":"1912.09216","code_links":[{"title":"Bodhiswatta/ICTNet","url":"https://github.com/Bodhiswatta/ICTNet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-arch2s","slug":"semantic-segmentation-on-arch2s","dataset":"ARCH2S","dataset_url":"/dataset/arch2s","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"BIM-Net","paper_title":"Fully Automated Scan-to-BIM Via Point Cloud Instance Segmentation","paper_url":"/paper/fully-automated-scan-to-bim-via-point-cloud","paper_date":"2023-09-11","arxiv_id":null,"code_links":[{"title":"LTTM/Scan-to-BIM","url":"https://github.com/LTTM/Scan-to-BIM"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-atlantis","slug":"semantic-segmentation-on-atlantis","dataset":"ATLANTIS","dataset_url":"/dataset/atlantis","rows_in_archive":1,"metrics":["A-acc","A-mIoU","Accuracy","mIoU"],"first_row_in_archive_order":{"model":"Erfani et al.","paper_title":"ATLANTIS: A Benchmark for Semantic Segmentation of Waterbody Images","paper_url":"/paper/atlantis-a-benchmark-for-semantic","paper_date":"2021-11-22","arxiv_id":"2111.11567","code_links":[{"title":"smhassanerfani/atlantis","url":"https://github.com/smhassanerfani/atlantis"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-bdd","slug":"semantic-segmentation-on-bdd","dataset":"BDD","dataset_url":null,"rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"FasterSeg","paper_title":"FasterSeg: Searching for Faster Real-time Semantic Segmentation","paper_url":"/paper/fasterseg-searching-for-faster-real-time-1","paper_date":"2019-12-23","arxiv_id":"1912.10917","code_links":[{"title":"TAMU-VITA/FasterSeg","url":"https://github.com/TAMU-VITA/FasterSeg"},{"title":"gaussianer/fasterseg","url":"https://github.com/gaussianer/fasterseg"}],"syntology":{"n":13,"n_ran":2,"n_unverified":11,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-cam2bev","slug":"semantic-segmentation-on-cam2bev","dataset":"Cam2BEV","dataset_url":"/dataset/cam2bev","rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"uNetXST","paper_title":"A Sim2Real Deep Learning Approach for the Transformation of Images from Multiple Vehicle-Mounted Cameras to a Semantically Segmented Image in Bird's Eye View","paper_url":"/paper/a-sim2real-deep-learning-approach-for-the","paper_date":"2020-05-08","arxiv_id":"2005.04078","code_links":[{"title":"ika-rwth-aachen/Cam2BEV","url":"https://github.com/ika-rwth-aachen/Cam2BEV"},{"title":"ika-rwth-aachen/etsi_its_messages","url":"https://github.com/ika-rwth-aachen/etsi_its_messages"}],"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-cityscapes-3d","slug":"semantic-segmentation-on-cityscapes-3d","dataset":"Cityscapes 3D","dataset_url":"/dataset/cityscapes-3d","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"TaskPrompter","paper_title":"Joint 2D-3D Multi-Task Learning on Cityscapes-3D: 3D Detection, Segmentation, and Depth Estimation","paper_url":"/paper/joint-2d-3d-multi-task-learning-on-cityscapes","paper_date":"2023-04-03","arxiv_id":"2304.00971","code_links":[{"title":"prismformore/multi-task-transformer","url":"https://github.com/prismformore/multi-task-transformer"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-cityscapes-vipriors","slug":"semantic-segmentation-on-cityscapes-vipriors","dataset":"Cityscapes VIPriors subset","dataset_url":"/dataset/cityscapes-vipriors-subset","rows_in_archive":1,"metrics":["Accuracy","mIoU"],"first_row_in_archive_order":{"model":"EfficientSeg","paper_title":"EfficientSeg: An Efficient Semantic Segmentation Network","paper_url":"/paper/efficientseg-an-efficient-semantic","paper_date":"2020-09-14","arxiv_id":"2009.06469","code_links":[{"title":"MrGranddy/EfficientSeg","url":"https://github.com/MrGranddy/EfficientSeg"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-coco-stuff","slug":"semantic-segmentation-on-coco-stuff","dataset":"COCO-Stuff","dataset_url":"/dataset/coco-stuff","rows_in_archive":1,"metrics":["F.W. IU","Per-Class Accuracy","Pixel Accuracy","mIoU"],"first_row_in_archive_order":{"model":"Deeplab v2","paper_title":"COCO-Stuff: Thing and Stuff Classes in Context","paper_url":"/paper/coco-stuff-thing-and-stuff-classes-in-context","paper_date":"2016-12-12","arxiv_id":"1612.03716","code_links":[{"title":"kazuto1011/deeplab-pytorch","url":"https://github.com/kazuto1011/deeplab-pytorch"},{"title":"nightrome/cocostuff","url":"https://github.com/nightrome/cocostuff"},{"title":"nightrome/cocostuff10k","url":"https://github.com/nightrome/cocostuff10k"},{"title":"zllrunning/deeplab-pytorch-crf","url":"https://github.com/zllrunning/deeplab-pytorch-crf"},{"title":"johnnylu305/deeplab-imagenet-pytorch","url":"https://github.com/johnnylu305/deeplab-imagenet-pytorch"},{"title":"LeadingIndiaAI/COCO-DATASET-STUFF-SEGMENTATION-CHALLENGE","url":"https://github.com/LeadingIndiaAI/COCO-DATASET-STUFF-SEGMENTATION-CHALLENGE"},{"title":"waggle-sensor/plugin-water-detector","url":"https://github.com/waggle-sensor/plugin-water-detector"},{"title":"divyanshpuri02/COCO_2018-Stuff-Segmentation-Challenge","url":"https://github.com/divyanshpuri02/COCO_2018-Stuff-Segmentation-Challenge"},{"title":"joykour/COCO-Dataset-2018-Stuff-Segmentation-Challenge","url":"https://github.com/joykour/COCO-Dataset-2018-Stuff-Segmentation-Challenge"},{"title":"woonhahaha/place-classification","url":"https://github.com/woonhahaha/place-classification"}],"syntology":{"n":29,"n_ran":1,"n_unverified":28,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-coco-stuff-27","slug":"semantic-segmentation-on-coco-stuff-27","dataset":"COCO-Stuff-27","dataset_url":"/dataset/coco-stuff","rows_in_archive":1,"metrics":["Pixel Accuracy","mIoU"],"first_row_in_archive_order":{"model":"DiffSeg (512)","paper_title":"Diffuse, Attend, and Segment: Unsupervised Zero-Shot Segmentation using Stable Diffusion","paper_url":"/paper/diffuse-attend-and-segment-unsupervised-zero","paper_date":"2023-08-23","arxiv_id":"2308.12469","code_links":[{"title":"google/diffseg","url":"https://github.com/google/diffseg"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-coco-stuff-full","slug":"semantic-segmentation-on-coco-stuff-full","dataset":"COCO-Stuff full","dataset_url":"/dataset/coco-stuff","rows_in_archive":1,"metrics":["Mean IoU (class)"],"first_row_in_archive_order":{"model":"SegFormer-B5 (Single Scale)","paper_title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers","paper_url":"/paper/segformer-simple-and-efficient-design-for","paper_date":"2021-05-31","arxiv_id":"2105.15203","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"VikParuchuri/surya","url":"https://github.com/VikParuchuri/surya"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"NVlabs/SegFormer","url":"https://github.com/NVlabs/SegFormer"},{"title":"BR-IDL/PaddleViT","url":"https://github.com/BR-IDL/PaddleViT/tree/main/semantic_segmentation"},{"title":"sithu31296/semantic-segmentation","url":"https://github.com/sithu31296/semantic-segmentation"},{"title":"lucidrains/segformer-pytorch","url":"https://github.com/lucidrains/segformer-pytorch"},{"title":"DarshanDeshpande/jax-models","url":"https://github.com/DarshanDeshpande/jax-models"},{"title":"chenghan111/dnc","url":"https://github.com/chenghan111/dnc"},{"title":"DavidLandup0/deepvision","url":"https://github.com/DavidLandup0/deepvision"},{"title":"UAws/CV-3315-Is-All-You-Need","url":"https://github.com/UAws/CV-3315-Is-All-You-Need"},{"title":"KieDani/SegformerPlusPlus","url":"https://github.com/KieDani/SegformerPlusPlus"},{"title":"alessiomora/unlearning_fl","url":"https://github.com/alessiomora/unlearning_fl"},{"title":"dzhaoxd/seco","url":"https://github.com/dzhaoxd/seco"},{"title":"IMvision12/SegFormer-tf","url":"https://github.com/IMvision12/SegFormer-tf"},{"title":"IMvision12/keras-vision-models","url":"https://github.com/IMvision12/keras-vision-models"},{"title":"macdonaldezra/minesegsat","url":"https://github.com/macdonaldezra/minesegsat"},{"title":"GhadeerElmkaiel/SegFormer","url":"https://github.com/GhadeerElmkaiel/SegFormer"},{"title":"JoegameZhou/Segmenter_workers","url":"https://github.com/JoegameZhou/Segmenter_workers"},{"title":"toqitahamid/gasformer","url":"https://github.com/toqitahamid/gasformer"},{"title":"pwc-1/Paper-10","url":"https://github.com/pwc-1/Paper-10/tree/main/segformer"},{"title":"code-implementation1/Code8","url":"https://github.com/code-implementation1/Code8/tree/main/Segformer"},{"title":"2023-MindSpore-4/Code11","url":"https://github.com/2023-MindSpore-4/Code11/tree/main/Segformer"},{"title":"MindSpore-paper-code-3/code5","url":"https://github.com/MindSpore-paper-code-3/code5/tree/main/SemanticHumanMatting"},{"title":"2023-MindSpore-4/Code11","url":"https://github.com/2023-MindSpore-4/Code11/tree/main/SemanticHumanMatting"},{"title":"2023-MindSpore-4/Code14","url":"https://github.com/2023-MindSpore-4/Code14/tree/main/Segformer"},{"title":"MindSpore-paper-code-3/code5","url":"https://github.com/MindSpore-paper-code-3/code5/tree/main/Segformer"},{"title":"kikacaty/RAP_Benchmark","url":"https://github.com/kikacaty/RAP_Benchmark"}],"syntology":{"n":86,"n_ran":48,"n_unverified":38,"n_pointer_only":15}}},{"leaderboard":"/sota/semantic-segmentation-on-dacl10k-v1-testfinal","slug":"semantic-segmentation-on-dacl10k-v1-testfinal","dataset":"dacl10k v1 testfinal","dataset_url":null,"rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"FPN EfficientNet-B4","paper_title":"dacl10k: Benchmark for Semantic Bridge Damage Segmentation","paper_url":"/paper/dacl10k-benchmark-for-semantic-bridge-damage","paper_date":"2023-09-01","arxiv_id":"2309.00460","code_links":[{"title":"phiyodr/dacl10k-toolkit","url":"https://github.com/phiyodr/dacl10k-toolkit"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-deliver-test","slug":"semantic-segmentation-on-deliver-test","dataset":"DeLiVER test","dataset_url":"/dataset/deliver","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CAFuser","paper_title":"CAFuser: Condition-Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes","paper_url":"/paper/condition-aware-multimodal-fusion-for-robust","paper_date":"2024-10-14","arxiv_id":"2410.10791","code_links":[{"title":"timbroed/cafuser","url":"https://github.com/timbroed/cafuser"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-segmentation-on-dronedeploy","slug":"semantic-segmentation-on-dronedeploy","dataset":"DroneDeploy","dataset_url":"/dataset/dronedeploy","rows_in_archive":1,"metrics":["Mean IoU (test)","Mean IoU (val)"],"first_row_in_archive_order":{"model":"DLv3+ (Xception65)","paper_title":"Aerial Imagery Pixel-level Segmentation","paper_url":"/paper/aerial-imagery-pixel-level-segmentation","paper_date":"2020-12-03","arxiv_id":"2012.02024","code_links":[{"title":"mrheffels/aerial-imagery-segmentation","url":"https://github.com/mrheffels/aerial-imagery-segmentation"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-forward-looking","slug":"semantic-segmentation-on-forward-looking","dataset":"Forward-Looking Sonar Marine Debris Datasets","dataset_url":"/dataset/forward-looking-sonar-marine-debris-datasets","rows_in_archive":1,"metrics":["mIOU"],"first_row_in_archive_order":{"model":"Unet+RN34","paper_title":"The Marine Debris Dataset for Forward-Looking Sonar Semantic Segmentation","paper_url":"/paper/the-marine-debris-dataset-for-forward-looking","paper_date":"2021-08-15","arxiv_id":"2108.06800","code_links":[{"title":"mvaldenegro/marine-debris-fls-datasets","url":"https://github.com/mvaldenegro/marine-debris-fls-datasets"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-fp4s","slug":"semantic-segmentation-on-fp4s","dataset":"FP4S","dataset_url":"/dataset/fp4s","rows_in_archive":1,"metrics":["Dice (Average)"],"first_row_in_archive_order":{"model":"FP4S","paper_title":"Floor Plan Image Segmentation Via Scribble-Based Semi-Weakly Supervised Learning: A Style and Category-Agnostic Approach","paper_url":"/paper/floor-plan-image-segmentation-via-scribble","paper_date":"2024-02-15","arxiv_id":null,"code_links":[{"title":"JanineCHEN/FP4S","url":"https://github.com/JanineCHEN/FP4S"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-ham10000","slug":"semantic-segmentation-on-ham10000","dataset":"HAM10000","dataset_url":"/dataset/ham10000-1","rows_in_archive":1,"metrics":["Average Dice","Average IOU"],"first_row_in_archive_order":{"model":"MFSNet","paper_title":"MFSNet: A Multi Focus Segmentation Network for Skin Lesion Segmentation","paper_url":"/paper/mfsnet-a-multi-focus-segmentation-network-for","paper_date":"2022-03-27","arxiv_id":"2203.14341","code_links":[{"title":"rohit-kundu/mfsnet","url":"https://github.com/rohit-kundu/mfsnet"},{"title":"hritam-98/MFSNet","url":"https://github.com/hritam-98/MFSNet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-isic-2017","slug":"semantic-segmentation-on-isic-2017","dataset":"ISIC 2017","dataset_url":null,"rows_in_archive":1,"metrics":["Average Dice"],"first_row_in_archive_order":{"model":"MFSNet","paper_title":"MFSNet: A Multi Focus Segmentation Network for Skin Lesion Segmentation","paper_url":"/paper/mfsnet-a-multi-focus-segmentation-network-for","paper_date":"2022-03-27","arxiv_id":"2203.14341","code_links":[{"title":"rohit-kundu/mfsnet","url":"https://github.com/rohit-kundu/mfsnet"},{"title":"hritam-98/MFSNet","url":"https://github.com/hritam-98/MFSNet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-landcover-ai","slug":"semantic-segmentation-on-landcover-ai","dataset":"LandCover.ai","dataset_url":"/dataset/landcover-ai","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"U-Net (ConvFormer-M36)","paper_title":"U-Net Ensemble for Enhanced Semantic Segmentation in Remote Sensing Imagery","paper_url":"/paper/u-net-ensemble-for-enhanced-semantic","paper_date":"2024-06-08","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-manipaluavid","slug":"semantic-segmentation-on-manipaluavid","dataset":"ManipalUAVid","dataset_url":null,"rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"UVid-Net","paper_title":"UVid-Net: Enhanced Semantic Segmentation of UAV Aerial Videos by Embedding Temporal Information","paper_url":"/paper/uvid-net-enhanced-semantic-segmentation-of","paper_date":"2020-11-29","arxiv_id":"2011.14284","code_links":[{"title":"uverma/ManipalUAVid","url":"https://github.com/uverma/ManipalUAVid"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-mila-simulated","slug":"semantic-segmentation-on-mila-simulated","dataset":"Mila Simulated Floods","dataset_url":"/dataset/mila-simulated-floods","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"FloodTransformer (Ours)","paper_title":"Transformer-based Flood Scene Segmentation for Developing Countries","paper_url":"/paper/transformer-based-flood-scene-segmentation","paper_date":"2022-10-09","arxiv_id":"2210.04218","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-mixedwm38","slug":"semantic-segmentation-on-mixedwm38","dataset":"MixedWM38","dataset_url":"/dataset/mixedwm38","rows_in_archive":1,"metrics":["Dice","Mean IoU"],"first_row_in_archive_order":{"model":"WaferSegClassNet","paper_title":"WaferSegClassNet -- A Light-weight Network for Classification and Segmentation of Semiconductor Wafer Defects","paper_url":"/paper/wafersegclassnet-a-light-weight-network-for","paper_date":"2022-07-03","arxiv_id":"2207.00960","code_links":[{"title":"ckmvigil/wafersegclassnet","url":"https://github.com/ckmvigil/wafersegclassnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-openeds","slug":"semantic-segmentation-on-openeds","dataset":"OpenEDS","dataset_url":"/dataset/openeds","rows_in_archive":1,"metrics":["mIOU"],"first_row_in_archive_order":{"model":"RITnet","paper_title":"RITnet: Real-time Semantic Segmentation of the Eye for Gaze Tracking","paper_url":"/paper/ritnet-real-time-semantic-segmentation-of-the","paper_date":"2019-10-01","arxiv_id":"1910.00694","code_links":[{"title":"AayushKrChaudhary/RITnet","url":"https://github.com/AayushKrChaudhary/RITnet"},{"title":"eye-ush/ritnet","url":"https://bitbucket.org/eye-ush/ritnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc","slug":"semantic-segmentation-on-pascal-voc","dataset":"PASCAL VOC","dataset_url":"/dataset/pascal-voc","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SegCLIP","paper_title":"SegCLIP: Patch Aggregation with Learnable Centers for Open-Vocabulary Semantic Segmentation","paper_url":"/paper/segclip-patch-aggregation-with-learnable","paper_date":"2022-11-27","arxiv_id":"2211.14813","code_links":[{"title":"arrowluo/segclip","url":"https://github.com/arrowluo/segclip"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2010-test","slug":"semantic-segmentation-on-pascal-voc-2010-test","dataset":"PASCAL VOC 2010 test","dataset_url":null,"rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SIW","paper_title":"Scaling up Multi-domain Semantic Segmentation with Sentence Embeddings","paper_url":"/paper/the-devil-is-in-the-labels-semantic","paper_date":"2022-02-04","arxiv_id":"2202.02002","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2011","slug":"semantic-segmentation-on-pascal-voc-2011","dataset":"PASCAL VOC 2011","dataset_url":"/dataset/pascal-voc-2011","rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"DLDL-8s+CRF","paper_title":"Deep Label Distribution Learning with Label Ambiguity","paper_url":"/paper/deep-label-distribution-learning-with-label","paper_date":"2016-11-06","arxiv_id":"1611.01731","code_links":[{"title":"gaobb/DLDL","url":"https://github.com/gaobb/DLDL"},{"title":"paplhjak/facial-age-estimation-benchmark","url":"https://github.com/paplhjak/facial-age-estimation-benchmark"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pascal-voc-2012-1","slug":"semantic-segmentation-on-pascal-voc-2012-1","dataset":"PASCAL VOC 2012","dataset_url":null,"rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"DLDL-8s+CRF","paper_title":"Deep Label Distribution Learning with Label Ambiguity","paper_url":"/paper/deep-label-distribution-learning-with-label","paper_date":"2016-11-06","arxiv_id":"1611.01731","code_links":[{"title":"gaobb/DLDL","url":"https://github.com/gaobb/DLDL"},{"title":"paplhjak/facial-age-estimation-benchmark","url":"https://github.com/paplhjak/facial-age-estimation-benchmark"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-pastis-r","slug":"semantic-segmentation-on-pastis-r","dataset":"PASTIS-R","dataset_url":"/dataset/pastis-r","rows_in_archive":1,"metrics":["IoU"],"first_row_in_archive_order":{"model":"Late Fusion","paper_title":"Multi-Modal Temporal Attention Models for Crop Mapping from Satellite Time Series","paper_url":"/paper/multi-modal-temporal-attention-models-for","paper_date":"2021-12-14","arxiv_id":"2112.07558","code_links":[{"title":"VSainteuf/pastis-benchmark","url":"https://github.com/VSainteuf/pastis-benchmark"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-rugd","slug":"semantic-segmentation-on-rugd","dataset":"RUGD","dataset_url":"/dataset/rugd","rows_in_archive":1,"metrics":["AIOU","mIoU"],"first_row_in_archive_order":{"model":"GA-Nav","paper_title":"GANav: Efficient Terrain Segmentation for Robot Navigation in Unstructured Outdoor Environments","paper_url":"/paper/ganav-group-wise-attention-network-for","paper_date":"2021-03-07","arxiv_id":"2103.04233","code_links":[{"title":"rayguan97/GANav-offroad","url":"https://github.com/rayguan97/GANav-offroad"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-sbcoseg","slug":"semantic-segmentation-on-sbcoseg","dataset":"SBCoseg","dataset_url":"/dataset/sbcoseg","rows_in_archive":1,"metrics":["Jaccard"],"first_row_in_archive_order":{"model":"Dice loss + IS-Triplet loss","paper_title":"Improving Image co-segmentation via Deep Metric Learning","paper_url":"/paper/improving-image-co-segmentation-via-deep","paper_date":"2021-03-19","arxiv_id":"2103.10670","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-semanticposs","slug":"semantic-segmentation-on-semanticposs","dataset":"SemanticPOSS","dataset_url":"/dataset/semanticposs","rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"TFNet","paper_title":"TFNet: Exploiting Temporal Cues for Fast and Accurate LiDAR Semantic Segmentation","paper_url":"/paper/tfnet-exploiting-temporal-cues-for-fast-and","paper_date":"2023-09-14","arxiv_id":"2309.07849","code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-stare","slug":"semantic-segmentation-on-stare","dataset":"STARE","dataset_url":"/dataset/stare","rows_in_archive":1,"metrics":["AUC"],"first_row_in_archive_order":{"model":"UNet","paper_title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","paper_url":"/paper/u-net-convolutional-networks-for-biomedical","paper_date":"2015-05-18","arxiv_id":"1505.04597","code_links":[{"title":"labmlai/annotated_deep_learning_paper_implementations","url":"https://github.com/labmlai/annotated_deep_learning_paper_implementations"},{"title":"milesial/Pytorch-UNet","url":"https://github.com/milesial/Pytorch-UNet"},{"title":"open-mmlab/mmsegmentation","url":"https://github.com/open-mmlab/mmsegmentation"},{"title":"PaddlePaddle/PaddleSeg","url":"https://github.com/PaddlePaddle/PaddleSeg"},{"title":"qubvel/segmentation_models","url":"https://github.com/qubvel/segmentation_models"},{"title":"zhixuhao/unet","url":"https://github.com/zhixuhao/unet"},{"title":"osmr/imgclsmob","url":"https://github.com/osmr/imgclsmob"},{"title":"divamgupta/image-segmentation-keras","url":"https://github.com/divamgupta/image-segmentation-keras"},{"title":"LeeJunHyun/Image_Segmentation","url":"https://github.com/LeeJunHyun/Image_Segmentation"},{"title":"bigmb/Unet-Segmentation-Pytorch-Nest-of-Unets","url":"https://github.com/bigmb/Unet-Segmentation-Pytorch-Nest-of-Unets"},{"title":"jakeret/tf_unet","url":"https://github.com/jakeret/tf_unet"},{"title":"yassouali/pytorch_segmentation","url":"https://github.com/yassouali/pytorch_segmentation"},{"title":"KUR-creative/SickZil-Machine","url":"https://github.com/KUR-creative/SickZil-Machine"},{"title":"orobix/retina-unet","url":"https://github.com/orobix/retina-unet"},{"title":"usuyama/pytorch-unet","url":"https://github.com/usuyama/pytorch-unet"},{"title":"mateuszbuda/brain-segmentation-pytorch","url":"https://github.com/mateuszbuda/brain-segmentation-pytorch"},{"title":"rezazad68/BCDU-Net","url":"https://github.com/rezazad68/BCDU-Net"},{"title":"vbelz/Speech-enhancement","url":"https://github.com/vbelz/Speech-enhancement"},{"title":"vqdang/xy_net","url":"https://github.com/vqdang/xy_net"},{"title":"vqdang/hover_net","url":"https://github.com/vqdang/hover_net"},{"title":"ternaus/TernausNetV2","url":"https://github.com/ternaus/TernausNetV2"},{"title":"rishikksh20/ResUnet","url":"https://github.com/rishikksh20/ResUnet"},{"title":"vietanhdev/open-adas","url":"https://github.com/vietanhdev/open-adas"},{"title":"Media-Smart/vedaseg","url":"https://github.com/Media-Smart/vedaseg"},{"title":"xamyzhao/brainstorm","url":"https://github.com/xamyzhao/brainstorm"},{"title":"neptune-ai/open-solution-mapping-challenge","url":"https://github.com/neptune-ai/open-solution-mapping-challenge"},{"title":"minerva-ml/open-solution-mapping-challenge","url":"https://github.com/minerva-ml/open-solution-mapping-challenge"},{"title":"shreyaspadhy/unet-zoo","url":"https://github.com/shreyaspadhy/unet-zoo"},{"title":"karolzak/keras-unet","url":"https://github.com/karolzak/keras-unet"},{"title":"jvanvugt/pytorch-unet","url":"https://github.com/jvanvugt/pytorch-unet"},{"title":"frgfm/Holocron","url":"https://github.com/frgfm/Holocron"},{"title":"lee-zq/VesselSeg-Pytorch","url":"https://github.com/lee-zq/VesselSeg-Pytorch"},{"title":"DeepTrial/Retina-VesselNet","url":"https://github.com/DeepTrial/Retina-VesselNet"},{"title":"manideep2510/eye-in-the-sky","url":"https://github.com/manideep2510/eye-in-the-sky"},{"title":"bfortuner/pytorch_tiramisu","url":"https://github.com/bfortuner/pytorch_tiramisu"},{"title":"Hsankesara/DeepResearch","url":"https://github.com/Hsankesara/DeepResearch"},{"title":"ImagingLab/Colorizing-with-GANs","url":"https://github.com/ImagingLab/Colorizing-with-GANs"},{"title":"jakeret/unet","url":"https://github.com/jakeret/unet"},{"title":"shanglianlm0525/CvPytorch","url":"https://github.com/shanglianlm0525/CvPytorch"},{"title":"andrewowens/multisensory","url":"https://github.com/andrewowens/multisensory"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/tree/master/official/cv/unet"},{"title":"ZFTurbo/ZF_UNET_224_Pretrained_Model","url":"https://github.com/ZFTurbo/ZF_UNET_224_Pretrained_Model"},{"title":"ugent-korea/pytorch-unet-segmentation","url":"https://github.com/ugent-korea/pytorch-unet-segmentation"},{"title":"perslev/MultiPlanarUNet","url":"https://github.com/perslev/MultiPlanarUNet"},{"title":"gvtulder/elasticdeform","url":"https://github.com/gvtulder/elasticdeform"},{"title":"1044197988/TF.Keras-Commonly-used-models","url":"https://github.com/1044197988/TF.Keras-Commonly-used-models"},{"title":"EdwardTyantov/ultrasound-nerve-segmentation","url":"https://github.com/EdwardTyantov/ultrasound-nerve-segmentation"},{"title":"pydsgz/DeepVOG","url":"https://github.com/pydsgz/DeepVOG"},{"title":"fepegar/unet","url":"https://github.com/fepegar/unet"},{"title":"nikhilroxtomar/semantic-segmentation-architecture","url":"https://github.com/nikhilroxtomar/semantic-segmentation-architecture"},{"title":"cosmic-cortex/pytorch-UNet","url":"https://github.com/cosmic-cortex/pytorch-UNet"},{"title":"arthurflor23/surface-crack-detection","url":"https://github.com/arthurflor23/surface-crack-detection"},{"title":"YudeWang/UNet-Satellite-Image-Segmentation","url":"https://github.com/YudeWang/UNet-Satellite-Image-Segmentation"},{"title":"nikhilroxtomar/UNet-Segmentation-in-Keras-TensorFlow","url":"https://github.com/nikhilroxtomar/UNet-Segmentation-in-Keras-TensorFlow"},{"title":"qsyao/cuda_spatial_deform","url":"https://github.com/qsyao/cuda_spatial_deform"},{"title":"TobiasGruening/ARU-Net","url":"https://github.com/TobiasGruening/ARU-Net"},{"title":"hydrogo/rainnet","url":"https://github.com/hydrogo/rainnet"},{"title":"ZFTurbo/segmentation_models_3D","url":"https://github.com/ZFTurbo/segmentation_models_3D"},{"title":"IlliaOvcharenko/lung-segmentation","url":"https://github.com/IlliaOvcharenko/lung-segmentation"},{"title":"DaloroAT/first_break_picking","url":"https://github.com/DaloroAT/first_break_picking"},{"title":"johschmidt42/pytorch-2d-3d-unet-tutorial","url":"https://github.com/johschmidt42/pytorch-2d-3d-unet-tutorial"},{"title":"xahidbuffon/SUIM","url":"https://github.com/xahidbuffon/SUIM"},{"title":"GewelsJI/PNS-Net","url":"https://github.com/GewelsJI/PNS-Net"},{"title":"Jack-Etheredge/Brain-Tumor-Segmentation-3D-UNet-CNN","url":"https://github.com/Jack-Etheredge/Brain-Tumor-Segmentation-3D-UNet-CNN"},{"title":"aschethor/Spline_PINN","url":"https://github.com/aschethor/Spline_PINN"},{"title":"iarai/landslide4sense-2022","url":"https://github.com/iarai/landslide4sense-2022"},{"title":"FaceOnLive/Realtime-Background-Changer-SDK-Android","url":"https://github.com/FaceOnLive/Realtime-Background-Changer-SDK-Android"},{"title":"koshian2/OctConv-TFKeras","url":"https://github.com/koshian2/OctConv-TFKeras"},{"title":"preritj/segmentation","url":"https://github.com/preritj/segmentation"},{"title":"vdurnov/xview2_1st_place_solution","url":"https://github.com/vdurnov/xview2_1st_place_solution"},{"title":"JosephPB/XNet","url":"https://github.com/JosephPB/XNet"},{"title":"pietz/unet-keras","url":"https://github.com/pietz/unet-keras"},{"title":"aschethor/Unsupervised_Deep_Learning_of_Incompressible_Fluid_Dynamics","url":"https://github.com/aschethor/Unsupervised_Deep_Learning_of_Incompressible_Fluid_Dynamics"},{"title":"EPFL-VILAB/3DCommonCorruptions","url":"https://github.com/EPFL-VILAB/3DCommonCorruptions"},{"title":"ayushdabra/drone-images-semantic-segmentation","url":"https://github.com/ayushdabra/drone-images-semantic-segmentation"},{"title":"tanyanair/segmentation_uncertainty","url":"https://github.com/tanyanair/segmentation_uncertainty"},{"title":"ayushdabra/dubai-satellite-imagery-segmentation","url":"https://github.com/ayushdabra/dubai-satellite-imagery-segmentation"},{"title":"ternaus/angiodysplasia-segmentation","url":"https://github.com/ternaus/angiodysplasia-segmentation"},{"title":"shibuiwilliam/Keras_Autoencoder","url":"https://github.com/shibuiwilliam/Keras_Autoencoder"},{"title":"ankit-ai/GAN_breast_mammography_segmentation","url":"https://github.com/ankit-ai/GAN_breast_mammography_segmentation"},{"title":"lRomul/argus-tgs-salt","url":"https://github.com/lRomul/argus-tgs-salt"},{"title":"DIUx-xView/xView2_first_place","url":"https://github.com/DIUx-xView/xView2_first_place"},{"title":"AryaKoureshi/Brain-tumor-detection","url":"https://github.com/AryaKoureshi/Brain-tumor-detection"},{"title":"galprz/brain-tumor-segemntation","url":"https://github.com/galprz/brain-tumor-segemntation"},{"title":"galprz/brain-tumor-segmentation","url":"https://github.com/galprz/brain-tumor-segmentation"},{"title":"hycis/TensorGraph","url":"https://github.com/hycis/TensorGraph"},{"title":"highwaywu/tianchi-fft2","url":"https://github.com/highwaywu/tianchi-fft2"},{"title":"mrvturan96/Brain-Tumor-Detection-and-Segmentation-using-Deep-Learning","url":"https://github.com/mrvturan96/Brain-Tumor-Detection-and-Segmentation-using-Deep-Learning"},{"title":"trypag/pytorch-unet-segnet","url":"https://github.com/trypag/pytorch-unet-segnet"},{"title":"sraashis/deepdyn","url":"https://github.com/sraashis/deepdyn"},{"title":"sraashis/ature","url":"https://github.com/sraashis/ature"},{"title":"mberkay0/pretrained-backbones-unet","url":"https://github.com/mberkay0/pretrained-backbones-unet"},{"title":"pvjosue/LFMNet","url":"https://github.com/pvjosue/LFMNet"},{"title":"ryanxingql/powerqe","url":"https://github.com/ryanxingql/powerqe"},{"title":"ArkaJU/U-Net-Satellite","url":"https://github.com/ArkaJU/U-Net-Satellite"},{"title":"Charmve/Semantic-Segmentation-PyTorch","url":"https://github.com/Charmve/Semantic-Segmentation-PyTorch/blob/master/models/u_net.py"},{"title":"kuangzijian/Flow-Based-Video-Matting","url":"https://github.com/kuangzijian/Flow-Based-Video-Matting"},{"title":"aws-samples/amazon-sagemaker-edge-defect-detection-computer-vision","url":"https://github.com/aws-samples/amazon-sagemaker-edge-defect-detection-computer-vision"},{"title":"iarai/weather4cast","url":"https://github.com/iarai/weather4cast"},{"title":"anh-nn01/Satellite-Imagery-to-Map-Translation-using-Pix2Pix-GAN-framework","url":"https://github.com/anh-nn01/Satellite-Imagery-to-Map-Translation-using-Pix2Pix-GAN-framework"},{"title":"adityajn105/brain-tumor-segmentation-unet","url":"https://github.com/adityajn105/brain-tumor-segmentation-unet"},{"title":"LilyHu/image_segmentation_chromosomes","url":"https://github.com/LilyHu/image_segmentation_chromosomes"},{"title":"ubamba98/Brain-Segmentation","url":"https://github.com/ubamba98/Brain-Segmentation"},{"title":"soribadiaby/Deep-Learning-liver-segmentation","url":"https://github.com/soribadiaby/Deep-Learning-liver-segmentation"},{"title":"anxingle/UNet-pytorch","url":"https://github.com/anxingle/UNet-pytorch"},{"title":"EPFL-VILAB/XDEnsembles","url":"https://github.com/EPFL-VILAB/XDEnsembles"},{"title":"petko-nikolov/pysemseg","url":"https://github.com/petko-nikolov/pysemseg"},{"title":"FelixGruen/tensorflow-u-net","url":"https://github.com/FelixGruen/tensorflow-u-net"},{"title":"trichtu/ConvLSTM-RAU-net","url":"https://github.com/trichtu/ConvLSTM-RAU-net"},{"title":"vlievin/Unet","url":"https://github.com/vlievin/Unet"},{"title":"Nacriema/Loss-Functions-For-Semantic-Segmentation","url":"https://github.com/Nacriema/Loss-Functions-For-Semantic-Segmentation"},{"title":"IAmSuyogJadhav/Brainy","url":"https://github.com/IAmSuyogJadhav/Brainy"},{"title":"plesqui/4d-cbct","url":"https://github.com/plesqui/4d-cbct"},{"title":"ucuapps/WSMIS","url":"https://github.com/ucuapps/WSMIS"},{"title":"chinakook/U-Net","url":"https://github.com/chinakook/U-Net"},{"title":"BenjiKCF/Superesolution-and-watermark-removal","url":"https://github.com/BenjiKCF/Superesolution-and-watermark-removal"},{"title":"seungjunlee96/U-Net_Lung-Segmentation","url":"https://github.com/seungjunlee96/U-Net_Lung-Segmentation"},{"title":"paraficial/vae_pancreas_segmentation","url":"https://github.com/paraficial/vae_pancreas_segmentation"},{"title":"xahidbuffon/SVAM-Net","url":"https://github.com/xahidbuffon/SVAM-Net"},{"title":"hayashimasa/UNet-PyTorch","url":"https://github.com/hayashimasa/UNet-PyTorch"},{"title":"Jo-dsa/SemanticSeg","url":"https://github.com/Jo-dsa/SemanticSeg"},{"title":"alexklibisz/deep-calcium","url":"https://github.com/alexklibisz/deep-calcium"},{"title":"osilab-kaist/komet-benchmark-dataset","url":"https://github.com/osilab-kaist/komet-benchmark-dataset"},{"title":"NERSC/sc21-dl-tutorial","url":"https://github.com/NERSC/sc21-dl-tutorial"},{"title":"raun1/MICCAI2018---Complementary_Segmentation_Network-Raw-Code-Available-Under-Construction-","url":"https://github.com/raun1/MICCAI2018---Complementary_Segmentation_Network-Raw-Code-Available-Under-Construction-"},{"title":"rdadlaney/Audio-Denoiser-CNN","url":"https://github.com/rdadlaney/Audio-Denoiser-CNN"},{"title":"raun1/Complementary_Segmentation_Network","url":"https://github.com/raun1/Complementary_Segmentation_Network"},{"title":"nikhilroxtomar/Unet-for-Person-Segmentation","url":"https://github.com/nikhilroxtomar/Unet-for-Person-Segmentation"},{"title":"raun1/MICCAI2018---Complementary_Segmentation_Network-Raw-Code","url":"https://github.com/raun1/MICCAI2018---Complementary_Segmentation_Network-Raw-Code"},{"title":"raun1/Complementary_Segmentation_Network-Raw-Code-Available-Under-Construction-","url":"https://github.com/raun1/Complementary_Segmentation_Network-Raw-Code-Available-Under-Construction-"},{"title":"K-Mike/Automatic-salt-deposits-segmentation","url":"https://github.com/K-Mike/Automatic-salt-deposits-segmentation"},{"title":"siddinc/monocular_depth_estimation","url":"https://github.com/siddinc/monocular_depth_estimation"},{"title":"kdha0727/cancer-instance-segmentation-from-tissue","url":"https://github.com/kdha0727/cancer-instance-segmentation-from-tissue"},{"title":"zh320/medical-segmentation-pytorch","url":"https://github.com/zh320/medical-segmentation-pytorch"},{"title":"BioWar/Satellite-Image-Segmentation-using-Deep-Learning-for-Deforestation-Detection","url":"https://github.com/BioWar/Satellite-Image-Segmentation-using-Deep-Learning-for-Deforestation-Detection"},{"title":"klin059/lits","url":"https://github.com/klin059/lits"},{"title":"TheInfamousWayne/UNet","url":"https://github.com/TheInfamousWayne/UNet"},{"title":"iibrahimli/unet_sem_seg","url":"https://github.com/iibrahimli/unet_sem_seg"},{"title":"Nguyendat-bit/U-net","url":"https://github.com/Nguyendat-bit/U-net"},{"title":"Hedgehogues/HoChiMinh","url":"https://github.com/Hedgehogues/HoChiMinh"},{"title":"a-martyn/unet","url":"https://github.com/a-martyn/unet"},{"title":"Lkruitwagen/remote-sensing-solar-pv","url":"https://github.com/Lkruitwagen/remote-sensing-solar-pv"},{"title":"Miltos-90/UNet_Biomedical_Image_Segmentation","url":"https://github.com/Miltos-90/UNet_Biomedical_Image_Segmentation"},{"title":"aparecidovieira/Road_extraction","url":"https://github.com/aparecidovieira/Road_extraction"},{"title":"Zhz1997/Singing-voice-speration-with-U-Net","url":"https://github.com/Zhz1997/Singing-voice-speration-with-U-Net"},{"title":"Violet981/Breast_mass_Segmentation","url":"https://github.com/Violet981/Breast_mass_Segmentation"},{"title":"neuropoly/multiclass-segmentation","url":"https://github.com/neuropoly/multiclass-segmentation"},{"title":"G0rav/Automatic_Background_Removal","url":"https://github.com/G0rav/Automatic_Background_Removal"},{"title":"pranjalrai-iitd/Fetal-head-segmentation-and-circumference-measurement-from-ultrasound-images","url":"https://github.com/pranjalrai-iitd/Fetal-head-segmentation-and-circumference-measurement-from-ultrasound-images"},{"title":"Aryavir07/Detecting-Brain-Tumor-Using-Deep-Learning","url":"https://github.com/Aryavir07/Detecting-Brain-Tumor-Using-Deep-Learning"},{"title":"shenshutao/image_segmentation","url":"https://github.com/shenshutao/image_segmentation"},{"title":"bcmi/madisnet-inharmonious-region-localization","url":"https://github.com/bcmi/madisnet-inharmonious-region-localization"},{"title":"lab-midas/med_segmentation","url":"https://github.com/lab-midas/med_segmentation"},{"title":"rizalmaulanaa/robustness_of_prob_u_net","url":"https://github.com/rizalmaulanaa/robustness_of_prob_u_net"},{"title":"anoushkrit/Knowledge","url":"https://github.com/anoushkrit/Knowledge"},{"title":"sagnik1511/U-Net-Reduced-with-TF-keras","url":"https://github.com/sagnik1511/U-Net-Reduced-with-TF-keras"},{"title":"Anirudh0707/Roads-and-Building-Segmentation","url":"https://github.com/Anirudh0707/Roads-and-Building-Segmentation"},{"title":"samson6460/tf2_Segmentation","url":"https://github.com/samson6460/tf2_Segmentation"},{"title":"sagnik1511/U-Net-Reduced-with-keras","url":"https://github.com/sagnik1511/U-Net-Reduced-with-keras"},{"title":"mtancak1/PyTorch-UNet-BraTS20","url":"https://github.com/mtancak1/PyTorch-UNet-BraTS20"},{"title":"mtancak1/PyTorch-UNet-Brain-Cancer-Segmentation","url":"https://github.com/mtancak1/PyTorch-UNet-Brain-Cancer-Segmentation"},{"title":"ChengBinJin/U-Net-TensorFlow","url":"https://github.com/ChengBinJin/U-Net-TensorFlow"},{"title":"clemkoa/u-net","url":"https://github.com/clemkoa/u-net"},{"title":"mtancak/PyTorch-UNet-Brain-Cancer-Segmentation","url":"https://github.com/mtancak/PyTorch-UNet-Brain-Cancer-Segmentation"},{"title":"LucaHermes/graph-unet-traffic-prediction","url":"https://github.com/LucaHermes/graph-unet-traffic-prediction"},{"title":"chenyizi086/wu.2023.sigspatial","url":"https://github.com/chenyizi086/wu.2023.sigspatial"},{"title":"koriavinash1/Fetal-Brain-Segmentation","url":"https://github.com/koriavinash1/Fetal-Brain-Segmentation"},{"title":"kilgore92/PyTorch-UNet","url":"https://github.com/kilgore92/PyTorch-UNet"},{"title":"pripri99/Floorplan-Generation","url":"https://github.com/pripri99/Floorplan-Generation"},{"title":"Muthu2093/U-Net-for-Brain-Tumor-Segmentation","url":"https://github.com/Muthu2093/U-Net-for-Brain-Tumor-Segmentation"},{"title":"usnistgov/semantic-segmentation-unet","url":"https://github.com/usnistgov/semantic-segmentation-unet"},{"title":"javiergarciamolina/selfie-background-removal","url":"https://github.com/javiergarciamolina/selfie-background-removal"},{"title":"filippogiruzzi/semantic_segmentation","url":"https://github.com/filippogiruzzi/semantic_segmentation"},{"title":"MoaazK/unet-transformer","url":"https://github.com/MoaazK/unet-transformer"},{"title":"danielenricocahall/Keras-UNet","url":"https://github.com/danielenricocahall/Keras-UNet"},{"title":"melissande/dhi-segmentation-buildings","url":"https://github.com/melissande/dhi-segmentation-buildings"},{"title":"aritzLizoain/Image-segmentation","url":"https://github.com/aritzLizoain/Image-segmentation"},{"title":"bragancas/vnet_pytorch-atriaseg2018","url":"https://github.com/bragancas/vnet_pytorch-atriaseg2018"},{"title":"MoaazK/comp511-project","url":"https://github.com/MoaazK/comp511-project"},{"title":"Cjl-MedSeg/U-Net","url":"https://github.com/Cjl-MedSeg/U-Net"},{"title":"asylve/Sea-Ice","url":"https://github.com/asylve/Sea-Ice"},{"title":"Owais-Ansari/Unet3plus","url":"https://github.com/Owais-Ansari/Unet3plus"},{"title":"tarit21/Speech-Enhancement-module","url":"https://github.com/tarit21/Speech-Enhancement-module"},{"title":"PatriciaRodrigues1994/Satellite-Image-Segmentation","url":"https://github.com/PatriciaRodrigues1994/Satellite-Image-Segmentation"},{"title":"tsixta/jnet","url":"https://github.com/tsixta/jnet"},{"title":"Zakobian/CT_framework_","url":"https://github.com/Zakobian/CT_framework_"},{"title":"p-mc-grath/DMMFODS","url":"https://github.com/p-mc-grath/DMMFODS"},{"title":"xiey1/Nucleus_detection","url":"https://github.com/xiey1/Nucleus_detection"},{"title":"pmcgrath249/DeepCVLab","url":"https://github.com/pmcgrath249/DeepCVLab"},{"title":"jbardelli/Petrographic-Image-Segmentation","url":"https://github.com/jbardelli/Petrographic-Image-Segmentation"},{"title":"pmcgrath249/DeepCV_Lab","url":"https://github.com/pmcgrath249/DeepCV_Lab"},{"title":"AICIP-UTK/spacenet-round3","url":"https://github.com/AICIP-UTK/spacenet-round3"},{"title":"greatsharma/DeepLearning-Papers-Implementation","url":"https://github.com/greatsharma/DeepLearning-Papers-Implementation"},{"title":"pmcgrath249/DMMFODS","url":"https://github.com/pmcgrath249/DMMFODS"},{"title":"zarif101/blood_cell_segmentation_unet","url":"https://github.com/zarif101/blood_cell_segmentation_unet"},{"title":"upc-postgrads/BrainScan","url":"https://github.com/upc-postgrads/BrainScan"},{"title":"0xzayd/Wnet-cGAN","url":"https://github.com/0xzayd/Wnet-cGAN"},{"title":"albertsokol/pneumothorax-detection-unet","url":"https://github.com/albertsokol/pneumothorax-detection-unet"},{"title":"kcang2/Prune_U-Net","url":"https://github.com/kcang2/Prune_U-Net"},{"title":"FrancisCrickInstitute/Etch-a-Cell-Nuclear-Envelope","url":"https://github.com/FrancisCrickInstitute/Etch-a-Cell-Nuclear-Envelope"},{"title":"jqueguiner/camembert-as-a-service","url":"https://github.com/jqueguiner/camembert-as-a-service"},{"title":"banus/umf_unet","url":"https://github.com/banus/umf_unet"},{"title":"ivboh/3d_image_segmentation","url":"https://github.com/ivboh/3d_image_segmentation"},{"title":"imagine5am/ARU-Net","url":"https://github.com/imagine5am/ARU-Net"},{"title":"napolar/simple_unet","url":"https://github.com/napolar/simple_unet"},{"title":"jtiger958/pytorch-computer-vision-basic","url":"https://github.com/jtiger958/pytorch-computer-vision-basic"},{"title":"jtiger958/pytorch-computer-vision-tutorial","url":"https://github.com/jtiger958/pytorch-computer-vision-tutorial"},{"title":"gerardrbentley/Pytorch-U-Net-AutoEncoder","url":"https://github.com/gerardrbentley/Pytorch-U-Net-AutoEncoder"},{"title":"akhadangi/EM-net","url":"https://github.com/akhadangi/EM-net"},{"title":"jqueguiner/image-segmentation","url":"https://github.com/jqueguiner/image-segmentation"},{"title":"SahinTiryaki/Brain-tumor-segmentation-Vgg19UNet","url":"https://github.com/SahinTiryaki/Brain-tumor-segmentation-Vgg19UNet"},{"title":"charlychiu/U-Net","url":"https://github.com/charlychiu/U-Net"},{"title":"celinechanny/FV-UPatches","url":"https://github.com/celinechanny/FV-UPatches"},{"title":"LuanAdemi/VisualGo","url":"https://github.com/LuanAdemi/VisualGo"},{"title":"nbouteldja/kidneystaintranslation","url":"https://github.com/nbouteldja/kidneystaintranslation"},{"title":"SixQuant/U-Net","url":"https://github.com/SixQuant/U-Net"},{"title":"MdAli1993/Multiclass_Semantic_Segmentation","url":"https://github.com/MdAli1993/Multiclass_Semantic_Segmentation"},{"title":"YourGc/Unet_jinnan2","url":"https://github.com/YourGc/Unet_jinnan2"},{"title":"sudharshan2001/PCB-defect-detection-using-U-NET","url":"https://github.com/sudharshan2001/PCB-defect-detection-using-U-NET"},{"title":"sumiya-kuroda/EMsegmentation-mito","url":"https://github.com/sumiya-kuroda/EMsegmentation-mito"},{"title":"trichtu/Recurrent_Attention_U_net","url":"https://github.com/trichtu/Recurrent_Attention_U_net"},{"title":"sophieloiz/brain-tissues-segmentation","url":"https://github.com/sophieloiz/brain-tissues-segmentation"},{"title":"aqbewtra/Multi-Class-Aerial-Segmentation","url":"https://github.com/aqbewtra/Multi-Class-Aerial-Segmentation"},{"title":"ayushdabra/lunar-landscape-images-segmentation","url":"https://github.com/ayushdabra/lunar-landscape-images-segmentation"},{"title":"JifeiWang-WHU/Pytorch_Building_extraction","url":"https://github.com/JifeiWang-WHU/Pytorch_Building_extraction"},{"title":"sabadijou/clld_official","url":"https://github.com/sabadijou/clld_official"},{"title":"xkhoanamx1/lung_crop_xray","url":"https://github.com/xkhoanamx1/lung_crop_xray"},{"title":"condiff-dataset/ConDiff","url":"https://github.com/condiff-dataset/ConDiff"},{"title":"EvgenyDyshlyuk/Oil_Seep_Detection","url":"https://github.com/EvgenyDyshlyuk/Oil_Seep_Detection"},{"title":"wangyi111/international-archaeology-ai-challenge","url":"https://github.com/wangyi111/international-archaeology-ai-challenge"},{"title":"samson6460/tf2_pose_estimation","url":"https://github.com/samson6460/tf2_pose_estimation"},{"title":"Artsplendr/Medical-Images-Liver-Segmentation-NIfTI","url":"https://github.com/Artsplendr/Medical-Images-Liver-Segmentation-NIfTI"},{"title":"shineho2014/Unet-Pavement_Crack-Detection","url":"https://github.com/shineho2014/Unet-Pavement_Crack-Detection"},{"title":"PurabPatel555/Pytorch-UNet-Brain-MRI","url":"https://github.com/PurabPatel555/Pytorch-UNet-Brain-MRI"},{"title":"rickyHong/UNet-segmentation-pytorch-repl","url":"https://github.com/rickyHong/UNet-segmentation-pytorch-repl"},{"title":"Artsplendr/Medical-Images-Segmentation","url":"https://github.com/Artsplendr/Medical-Images-Segmentation"},{"title":"zampie/unet-colorization-pytorch","url":"https://github.com/zampie/unet-colorization-pytorch"},{"title":"DevBruce/Segmentation-UNet-PyTorch","url":"https://github.com/DevBruce/Segmentation-UNet-PyTorch"},{"title":"SarthakGarg13/Severstal-Steel-Defect-Detection","url":"https://github.com/SarthakGarg13/Severstal-Steel-Defect-Detection"},{"title":"DevBruce/PyTorch-ISBI2012-Segmentation","url":"https://github.com/DevBruce/PyTorch-ISBI2012-Segmentation"},{"title":"imagesegmentation2020/indoor","url":"https://github.com/imagesegmentation2020/indoor"},{"title":"sowit-labs/grassUNet","url":"https://github.com/sowit-labs/grassUNet"},{"title":"Shumway82/U-Net-Segmentation","url":"https://github.com/Shumway82/U-Net-Segmentation"},{"title":"vg-sravan/Cycle-Consistent-Generative-Adversarial-Networks","url":"https://github.com/vg-sravan/Cycle-Consistent-Generative-Adversarial-Networks"},{"title":"burakalperen/Pytorch-Semantic-Segmentation","url":"https://github.com/burakalperen/Pytorch-Semantic-Segmentation"},{"title":"gmatasci/SemanticSegmentation","url":"https://github.com/gmatasci/SemanticSegmentation"},{"title":"Daividao/semantic-segmentation-deeplearning","url":"https://github.com/Daividao/semantic-segmentation-deeplearning"},{"title":"kwcckw/unet_magnetic_tiles_defects","url":"https://github.com/kwcckw/unet_magnetic_tiles_defects"},{"title":"Hayashi-Yudai/ML_models","url":"https://github.com/Hayashi-Yudai/ML_models"},{"title":"zhugoldman/CNN-segmentation-for-Lung-cancer-OARs","url":"https://github.com/zhugoldman/CNN-segmentation-for-Lung-cancer-OARs"},{"title":"raspstephan/sugar-flower-fish-or-gravel","url":"https://github.com/raspstephan/sugar-flower-fish-or-gravel"},{"title":"Tu-kun/cultivated_landdivision","url":"https://github.com/Tu-kun/cultivated_landdivision"},{"title":"animikhaich/single-object-background-subtractor","url":"https://github.com/animikhaich/single-object-background-subtractor"},{"title":"lurenhaothu/CWMI","url":"https://github.com/lurenhaothu/CWMI"},{"title":"reyvaz/pneumothorax_detection","url":"https://github.com/reyvaz/pneumothorax_detection"},{"title":"e9190712/vessel_segmentation","url":"https://github.com/e9190712/vessel_segmentation"},{"title":"salimkhazem/U-net-Segmentation","url":"https://github.com/salimkhazem/U-net-Segmentation"},{"title":"park-cheol/Speech_Enhancement-DCUnet_With_Transformer","url":"https://github.com/park-cheol/Speech_Enhancement-DCUnet_With_Transformer"},{"title":"berenslab/retinal-vessel-segmentation-benchmark","url":"https://github.com/berenslab/retinal-vessel-segmentation-benchmark"},{"title":"vamsi3/pix2pix","url":"https://github.com/vamsi3/pix2pix"},{"title":"IRVLab/SUIM-Net","url":"https://github.com/IRVLab/SUIM-Net"},{"title":"IRVLab/SUIM","url":"https://github.com/IRVLab/SUIM"},{"title":"overshiki/unet-pytorch","url":"https://github.com/overshiki/unet-pytorch"},{"title":"dsandeep0138/UNet-Colorization","url":"https://github.com/dsandeep0138/UNet-Colorization"},{"title":"sungyoonahn/Hint-based-image-colorization-using-Attention-Unet","url":"https://github.com/sungyoonahn/Hint-based-image-colorization-using-Attention-Unet"},{"title":"BioMedIA-MBZUAI/Echocardiography-Assess","url":"https://github.com/BioMedIA-MBZUAI/Echocardiography-Assess"},{"title":"Zahra2351373/Image-Processing-Final-Project","url":"https://github.com/Zahra2351373/Image-Processing-Final-Project"},{"title":"DASHANANT/Video-Segmentation","url":"https://github.com/DASHANANT/Video-Segmentation"},{"title":"sadari1/TumorDetectionDeepLearning","url":"https://github.com/sadari1/TumorDetectionDeepLearning"},{"title":"MohamedFarag21/DL-papers-implementation","url":"https://github.com/MohamedFarag21/DL-papers-implementation/blob/main/Computer_vision/UNET/Code/Unet_clean_version.py"},{"title":"oliverquintana/UnetSegmentation","url":"https://github.com/oliverquintana/UnetSegmentation"},{"title":"SeonbeomKim/TensorFlow-pix2pix","url":"https://github.com/SeonbeomKim/TensorFlow-pix2pix"},{"title":"tatigabru/kaggle-lyft","url":"https://github.com/tatigabru/kaggle-lyft"},{"title":"ZeeTsing/Carvana_challenge","url":"https://github.com/ZeeTsing/Carvana_challenge"},{"title":"alexromano/nerve-segmentation","url":"https://github.com/alexromano/nerve-segmentation"},{"title":"shirans/cv_course_project","url":"https://github.com/shirans/cv_course_project"},{"title":"BboyHanat/U-Net","url":"https://github.com/BboyHanat/U-Net"},{"title":"park-cheol/Speech_Enhancement-DCUnet","url":"https://github.com/park-cheol/Speech_Enhancement-DCUnet"},{"title":"park-cheol/ASR-DCUnet","url":"https://github.com/park-cheol/ASR-DCUnet"},{"title":"wlstyql/keras_with_mat_for_unet","url":"https://github.com/wlstyql/keras_with_mat_for_unet"},{"title":"archit31uniyal/DC-Gnet","url":"https://github.com/archit31uniyal/DC-Gnet"},{"title":"jkhadley/capstone-project","url":"https://github.com/jkhadley/capstone-project"},{"title":"westgate458/xb-net","url":"https://github.com/westgate458/xb-net"},{"title":"lyffly/Segmentation_with_my_dataset","url":"https://github.com/lyffly/Segmentation_with_my_dataset"},{"title":"navidhasanzadeh/UNet-Semantic-Segmentation","url":"https://github.com/navidhasanzadeh/UNet-Semantic-Segmentation"},{"title":"raunak-sood2003/Automated-Lung-Segmentation","url":"https://github.com/raunak-sood2003/Automated-Lung-Segmentation"},{"title":"mfp0610/semantic-segmentaion","url":"https://github.com/mfp0610/semantic-segmentaion"},{"title":"44aayush/Denoising-and-Enhancement","url":"https://github.com/44aayush/Denoising-and-Enhancement"},{"title":"reenal/melanoma-skin-cancer-image-segmentation","url":"https://github.com/reenal/melanoma-skin-cancer-image-segmentation"},{"title":"sremes/a2d2","url":"https://github.com/sremes/a2d2"},{"title":"kaichoulyc/course_segmentation","url":"https://github.com/kaichoulyc/course_segmentation"},{"title":"jiandai/mlTst","url":"https://github.com/jiandai/mlTst"},{"title":"usnistgov/semantic-segmentation-fc-densenet","url":"https://github.com/usnistgov/semantic-segmentation-fc-densenet"},{"title":"AlexandreBrown/AerialSemanticSegmentation","url":"https://github.com/AlexandreBrown/AerialSemanticSegmentation"},{"title":"matzkin/deep-brain-extractor","url":"https://gitlab.com/matzkin/deep-brain-extractor"},{"title":"oakleighw/BRATS-Pretext-Tasks-for-Self-supervised-Deep-Learning","url":"https://github.com/oakleighw/BRATS-Pretext-Tasks-for-Self-supervised-Deep-Learning"},{"title":"bharath3794/UNet-Image-Segmentation","url":"https://github.com/bharath3794/UNet-Image-Segmentation"},{"title":"cabeen/neu-net","url":"https://github.com/cabeen/neu-net"},{"title":"IsaacPatole/TGS-Salt-Identification-Challenge","url":"https://github.com/IsaacPatole/TGS-Salt-Identification-Challenge"},{"title":"HadiZayer/UNet_pytorch","url":"https://github.com/HadiZayer/UNet_pytorch"},{"title":"lbareiro/Image_Segmentation-master","url":"https://github.com/lbareiro/Image_Segmentation-master"},{"title":"usnistgov/small-data-cnns","url":"https://github.com/usnistgov/small-data-cnns"},{"title":"matzkin/headctools","url":"https://gitlab.com/matzkin/headctools"},{"title":"CellSMB/EM-net","url":"https://github.com/CellSMB/EM-net"},{"title":"ahedayat/U-Net","url":"https://github.com/ahedayat/U-Net"},{"title":"kpullak/DefectSegmentation","url":"https://github.com/kpullak/DefectSegmentation"},{"title":"sk1123344/U-2-NET-and-U-NET","url":"https://github.com/sk1123344/U-2-NET-and-U-NET"},{"title":"neshitov/UNet","url":"https://github.com/neshitov/UNet"},{"title":"jovenwayfarer/pneumonia","url":"https://github.com/jovenwayfarer/pneumonia"},{"title":"CocoSungMin/Gachon_SW_Colorization_Contest","url":"https://github.com/CocoSungMin/Gachon_SW_Colorization_Contest"},{"title":"tiendatnguyen-vision/UNet-Image-Segmentation","url":"https://github.com/tiendatnguyen-vision/UNet-Image-Segmentation"},{"title":"IgorZaton/Mini-Projects","url":"https://github.com/IgorZaton/Mini-Projects"},{"title":"udacity/MLND-CN-Capstone-TGSImage","url":"https://github.com/udacity/MLND-CN-Capstone-TGSImage"},{"title":"ruixif/Unet_keras","url":"https://github.com/ruixif/Unet_keras"},{"title":"Barak123748596/CVDL_course_project","url":"https://github.com/Barak123748596/CVDL_course_project"},{"title":"c1ph3rr/U-Net-Convolutional-Networks-For-Biomedicalimage-Segmentation","url":"https://github.com/c1ph3rr/U-Net-Convolutional-Networks-For-Biomedicalimage-Segmentation"},{"title":"qianpeisheng/Unet_semicon","url":"https://github.com/qianpeisheng/Unet_semicon"},{"title":"ltracegeo/deep-mineralogical-segmentation","url":"https://github.com/ltracegeo/deep-mineralogical-segmentation"},{"title":"Yashgh7076/CU-Thesis","url":"https://github.com/Yashgh7076/CU-Thesis"},{"title":"stevensmiley1989/MoNuSAC_Grand_Challenge_S4xUNet","url":"https://github.com/stevensmiley1989/MoNuSAC_Grand_Challenge_S4xUNet"},{"title":"OlgaFomin/Speech-enhancement","url":"https://github.com/OlgaFomin/Speech-enhancement"},{"title":"BaiqingL/CS523-Final","url":"https://github.com/BaiqingL/CS523-Final"},{"title":"aksub99/U-Net-Pytorch","url":"https://github.com/aksub99/U-Net-Pytorch"},{"title":"irenazra/melanoma_segmentation_Unet","url":"https://github.com/irenazra/melanoma_segmentation_Unet"},{"title":"ayoub-sudo/Attention-Unet-web-app","url":"https://github.com/ayoub-sudo/Attention-Unet-web-app"},{"title":"gregbugaj/unet-reference-impl","url":"https://github.com/gregbugaj/unet-reference-impl"},{"title":"hemanth346/mde_bs","url":"https://github.com/hemanth346/mde_bs"},{"title":"Soren-Kierkegaard/MRI-Image-Analysis","url":"https://github.com/Soren-Kierkegaard/MRI-Image-Analysis"},{"title":"branislavhesko/segmentation_framework","url":"https://github.com/branislavhesko/segmentation_framework"},{"title":"ajjdan/Karst-Segmentation-from-DEM","url":"https://github.com/ajjdan/Karst-Segmentation-from-DEM"},{"title":"badrbmb/cities-watch","url":"https://github.com/badrbmb/cities-watch"},{"title":"pricebenjamin/unet-estimator","url":"https://github.com/pricebenjamin/unet-estimator"},{"title":"yumaloop/kaggle-tgs-salt-competition","url":"https://github.com/yumaloop/kaggle-tgs-salt-competition"},{"title":"haratzouvara/image_restoration","url":"https://github.com/haratzouvara/image_restoration"},{"title":"HaoJunNM/Unet-PretrainedMobilenetV2encoder-Flaskapp","url":"https://github.com/HaoJunNM/Unet-PretrainedMobilenetV2encoder-Flaskapp"},{"title":"inder9999/ISIC2017_skin_lesion_segmentation","url":"https://github.com/inder9999/ISIC2017_skin_lesion_segmentation"},{"title":"mitmedialab/unet4birds","url":"https://github.com/mitmedialab/unet4birds"},{"title":"MatthewQi2002/Unet_mindspore","url":"https://github.com/MatthewQi2002/Unet_mindspore"},{"title":"lrr-rachel/PCDUNet","url":"https://github.com/lrr-rachel/PCDUNet"},{"title":"VedantDere0104/Pix2Pix_GAN","url":"https://github.com/VedantDere0104/Pix2Pix_GAN"},{"title":"alexssanchez/unet-app-pucp","url":"https://github.com/alexssanchez/unet-app-pucp"},{"title":"samplecm/Organogenesis","url":"https://github.com/samplecm/Organogenesis"},{"title":"ajjdan/KaI","url":"https://github.com/ajjdan/KaI"},{"title":"ShaileshKumar97/Speech-Enhancement","url":"https://github.com/ShaileshKumar97/Speech-Enhancement"},{"title":"casi-project/casi-2d","url":"https://gitlab.com/casi-project/casi-2d"},{"title":"kelvin-jose/UNet","url":"https://github.com/kelvin-jose/UNet"},{"title":"wjcheon/MedicalImageSegmentation_Pytorch","url":"https://github.com/wjcheon/MedicalImageSegmentation_Pytorch"},{"title":"mirnadaye/Brain_Tumor_Project","url":"https://github.com/mirnadaye/Brain_Tumor_Project"},{"title":"sinandeger/RedeemTheBoar","url":"https://github.com/sinandeger/RedeemTheBoar"},{"title":"kilgore92/Probabalistic-U-Net","url":"https://github.com/kilgore92/Probabalistic-U-Net"},{"title":"massucattoj/unet-model","url":"https://github.com/massucattoj/unet-model"},{"title":"clarencenhuang/dl-colorize","url":"https://github.com/clarencenhuang/dl-colorize"},{"title":"AviTewari/Lake-Ice-Monitoring","url":"https://github.com/AviTewari/Lake-Ice-Monitoring"},{"title":"dbailey00/Semantic-Segmentation-With-Seismic-Images","url":"https://github.com/dbailey00/Semantic-Segmentation-With-Seismic-Images"},{"title":"zampie/Animation-standing-segmentation","url":"https://github.com/zampie/Animation-standing-segmentation"},{"title":"vankhoa21991/medicalImgSEg","url":"https://github.com/vankhoa21991/medicalImgSEg"},{"title":"schopfej/pytorch_unet_jvanvugt","url":"https://github.com/schopfej/pytorch_unet_jvanvugt"},{"title":"SharadGitHub/OctaveUnet","url":"https://github.com/SharadGitHub/OctaveUnet"},{"title":"CallHoganZhang/unet-medical_segmentation","url":"https://github.com/CallHoganZhang/unet-medical_segmentation"},{"title":"taha7ussein007/Papers_Implementation","url":"https://github.com/taha7ussein007/Papers_Implementation/tree/main/Paper_Implementation_From_Scratch/UNet_FromScratch_Pytorch"},{"title":"hyunjoonbok/Unet-pytorch","url":"https://github.com/hyunjoonbok/Unet-pytorch"},{"title":"oliverz17/Unet_Keras","url":"https://github.com/oliverz17/Unet_Keras"},{"title":"carinanorre/Brain-Tumour-Segmentation-Dissertation","url":"https://github.com/carinanorre/Brain-Tumour-Segmentation-Dissertation"},{"title":"harishhirthi/Indian-Traffic-Segmentation","url":"https://github.com/harishhirthi/Indian-Traffic-Segmentation"},{"title":"NicoleEic/Brainhack_Oxbridge","url":"https://github.com/NicoleEic/Brainhack_Oxbridge"},{"title":"shivamkhare95/Unet_graph","url":"https://github.com/shivamkhare95/Unet_graph"},{"title":"ShahedSabab/imagePrep","url":"https://github.com/ShahedSabab/imagePrep"},{"title":"ljllili23/unet_baseline","url":"https://github.com/ljllili23/unet_baseline"},{"title":"muramasa8191/DeepLearning","url":"https://github.com/muramasa8191/DeepLearning"},{"title":"kaland313/vitmav45-ShipSeakers","url":"https://github.com/kaland313/vitmav45-ShipSeakers"},{"title":"JHLee0513/Salt_detection_challenge","url":"https://github.com/JHLee0513/Salt_detection_challenge"},{"title":"ethanhou99/ml_learn","url":"https://github.com/ethanhou99/ml_learn"},{"title":"biss/unet","url":"https://github.com/biss/unet"},{"title":"mariosfourn/ScienceBowl","url":"https://github.com/mariosfourn/ScienceBowl"},{"title":"kimdesok/UNet_2D_Semantic_Segmentation","url":"https://github.com/kimdesok/UNet_2D_Semantic_Segmentation"},{"title":"TanyaChutani/U-Net","url":"https://github.com/TanyaChutani/U-Net"},{"title":"adityarajsahu/UNet-Implementation","url":"https://github.com/adityarajsahu/UNet-Implementation"},{"title":"salem-devloper/COVID-Lung-Segment","url":"https://github.com/salem-devloper/COVID-Lung-Segment"},{"title":"2023-MindSpore-1/ms-code-66","url":"https://github.com/2023-MindSpore-1/ms-code-66"},{"title":"2023-MindSpore-1/ms-code-67","url":"https://github.com/2023-MindSpore-1/ms-code-67"},{"title":"rahul13ramesh/cloud_understanding","url":"https://github.com/rahul13ramesh/cloud_understanding"},{"title":"kritanu82/healthif.ai","url":"https://github.com/kritanu82/healthif.ai"},{"title":"yassineAlouini/data-science-bowl-2018","url":"https://github.com/yassineAlouini/data-science-bowl-2018"},{"title":"TristansCloud/YellowstonesVegitiation","url":"https://github.com/TristansCloud/YellowstonesVegitiation"},{"title":"julia-bush/unet_TGS","url":"https://github.com/julia-bush/unet_TGS"},{"title":"dry01/segmentation-","url":"https://github.com/dry01/segmentation-"},{"title":"gomezzz/distmsmatch","url":"https://github.com/gomezzz/distmsmatch"},{"title":"KarthikDulam/U-NetCNN","url":"https://github.com/KarthikDulam/U-NetCNN"},{"title":"konny0311/unet_segmentation","url":"https://github.com/konny0311/unet_segmentation"},{"title":"sathvikyesprabhu/brats-dl","url":"https://github.com/sathvikyesprabhu/brats-dl"},{"title":"Simurgh818/UCSF_QBI_Hackathon_ImageSegmentor","url":"https://github.com/Simurgh818/UCSF_QBI_Hackathon_ImageSegmentor"},{"title":"Jeongseungwoo/U_net","url":"https://github.com/Jeongseungwoo/U_net"},{"title":"Burton2000/semantic_segmentation","url":"https://github.com/Burton2000/semantic_segmentation"},{"title":"rrkotik/k_salt_identification","url":"https://github.com/rrkotik/k_salt_identification"},{"title":"rrkotik/dental_lucency_finder","url":"https://github.com/rrkotik/dental_lucency_finder"},{"title":"jiye-ML/unet_pytorch","url":"https://github.com/jiye-ML/unet_pytorch"},{"title":"Suhird/AirbusShipDetection","url":"https://github.com/Suhird/AirbusShipDetection"},{"title":"sd2001/UNets","url":"https://github.com/sd2001/UNets"},{"title":"pirate0109/UNet_in_Pytorch","url":"https://github.com/pirate0109/UNet_in_Pytorch"},{"title":"matanrein/Understanding-Clouds-from-Satellite-Images","url":"https://github.com/matanrein/Understanding-Clouds-from-Satellite-Images"},{"title":"DarkGeekMS/Semantic_Segmentation_Models_Keras","url":"https://github.com/DarkGeekMS/Semantic_Segmentation_Models_Keras"},{"title":"Suvoo/U-Net","url":"https://github.com/Suvoo/U-Net"},{"title":"jellevankerk/Team-Challenge","url":"https://github.com/jellevankerk/Team-Challenge"},{"title":"brunasil98/u-net_Cancer","url":"https://github.com/brunasil98/u-net_Cancer"},{"title":"noornk/U-Net","url":"https://github.com/noornk/U-Net"},{"title":"TugberkErol/Semantic-Segmentation-","url":"https://github.com/TugberkErol/Semantic-Segmentation-/blob/main/unet.py"},{"title":"gundeep15/SCD_AI_Project","url":"https://github.com/gundeep15/SCD_AI_Project"},{"title":"JoelPendleton/Edge-Detection-CNN","url":"https://github.com/JoelPendleton/Edge-Detection-CNN"},{"title":"SK124/Semantic-Segmentaion-Using-UNets","url":"https://github.com/SK124/Semantic-Segmentaion-Using-UNets"},{"title":"EvaBr/AnatomyNets","url":"https://github.com/EvaBr/AnatomyNets"},{"title":"harsh-jadhav/SIIM-Pneumothorax-Case-Study2","url":"https://github.com/harsh-jadhav/SIIM-Pneumothorax-Case-Study2"},{"title":"hamdaan19/NavGuide","url":"https://github.com/hamdaan19/NavGuide"},{"title":"MargeryLab/Pytorch-UNet-copy","url":"https://github.com/MargeryLab/Pytorch-UNet-copy"},{"title":"J-jjj7230/u-net_model","url":"https://github.com/J-jjj7230/u-net_model"},{"title":"shih61/deep-learnging-3d-object-dectation","url":"https://github.com/shih61/deep-learnging-3d-object-dectation"},{"title":"nithi89/unet_darknet","url":"https://github.com/nithi89/unet_darknet"},{"title":"goyalyash1224/Nuclei-detection-and-segmentaion","url":"https://github.com/goyalyash1224/Nuclei-detection-and-segmentaion"},{"title":"trupewate/lung_segmentation_tutorial","url":"https://github.com/trupewate/lung_segmentation_tutorial"},{"title":"s9mondal9upriti/U-Net","url":"https://github.com/s9mondal9upriti/U-Net"},{"title":"rohitgupta24/unet_from_scratch","url":"https://github.com/rohitgupta24/unet_from_scratch"},{"title":"sigtot/unet-auto","url":"https://github.com/sigtot/unet-auto"},{"title":"MindSpore-scientific/code-14","url":"https://github.com/MindSpore-scientific/code-14/tree/main/segmentation-dataset"},{"title":"Gojay001/toolkit-DeepLearning","url":"https://github.com/Gojay001/toolkit-DeepLearning"},{"title":"ajoshiusc/qrsegment","url":"https://github.com/ajoshiusc/qrsegment"},{"title":"ajoshi944/Segmentation-severstal-steel","url":"https://github.com/ajoshi944/Segmentation-severstal-steel"},{"title":"chakerouari/UNET_segmetation","url":"https://github.com/chakerouari/UNET_segmetation"},{"title":"ashishpapanai/uNet","url":"https://github.com/ashishpapanai/uNet"},{"title":"TheRealBaka/Models-in-PyTorch","url":"https://github.com/TheRealBaka/Models-in-PyTorch"},{"title":"ninanikitina/BioLab","url":"https://github.com/ninanikitina/BioLab"},{"title":"hoaitrinh459/RobotNhatBongTennis","url":"https://github.com/hoaitrinh459/RobotNhatBongTennis"},{"title":"Kissonis/Quantum_test","url":"https://github.com/Kissonis/Quantum_test"},{"title":"pmcgrath249/UNet","url":"https://github.com/pmcgrath249/UNet"},{"title":"atharva417/Yoga_Pose_GNR638","url":"https://github.com/atharva417/Yoga_Pose_GNR638"},{"title":"sakasakasa/U-Net","url":"https://github.com/sakasakasa/U-Net"},{"title":"JoelPendleton/Object-Contour-Detection-CNN","url":"https://github.com/JoelPendleton/Object-Contour-Detection-CNN"},{"title":"Adityarajora/qwerty","url":"https://github.com/Adityarajora/qwerty"},{"title":"akrsrivastava/Unet","url":"https://github.com/akrsrivastava/Unet"},{"title":"jerichooconnell/tf_unet","url":"https://github.com/jerichooconnell/tf_unet"},{"title":"brdiep113/UNet","url":"https://github.com/brdiep113/UNet"},{"title":"sandeepsinghsengar/Pytoarch-UNet","url":"https://github.com/sandeepsinghsengar/Pytoarch-UNet"},{"title":"sandeepsinghsengar/U-Net","url":"https://github.com/sandeepsinghsengar/U-Net"},{"title":"Will-J-Gale/Self-Driving-Car-Vision","url":"https://github.com/Will-J-Gale/Self-Driving-Car-Vision"},{"title":"anandjebakumar/unet","url":"https://github.com/anandjebakumar/unet"},{"title":"decentNick/Signals_big_lab_SPBSTU","url":"https://github.com/decentNick/Signals_big_lab_SPBSTU"},{"title":"zamnius/uNet-seg-decathlon","url":"https://github.com/zamnius/uNet-seg-decathlon"},{"title":"laxmichary/Pytorch-UNet","url":"https://github.com/laxmichary/Pytorch-UNet"},{"title":"zyning/signalSeparation","url":"https://github.com/zyning/signalSeparation"},{"title":"gorjida/ap-unet","url":"https://github.com/gorjida/ap-unet"},{"title":"Daonancai/unet_muti_class","url":"https://github.com/Daonancai/unet_muti_class"},{"title":"HanYong201308/Pytorch-UNet2","url":"https://github.com/HanYong201308/Pytorch-UNet2"},{"title":"Spider-scnu/Instance-Segmentation-For-Cancer","url":"https://github.com/Spider-scnu/Instance-Segmentation-For-Cancer"},{"title":"jamiljami/Unet","url":"https://github.com/jamiljami/Unet"},{"title":"Sharut/CT_Segmentation","url":"https://github.com/Sharut/CT_Segmentation"},{"title":"ganeshpawar95/removebg1","url":"https://github.com/ganeshpawar95/removebg1"},{"title":"DavidCastilloAlvarado/U-NET_AUTOENCODER","url":"https://github.com/DavidCastilloAlvarado/U-NET_AUTOENCODER"},{"title":"JanOPedersen/U-Net","url":"https://github.com/JanOPedersen/U-Net"},{"title":"HHY-ZJU/Unet","url":"https://github.com/HHY-ZJU/Unet"},{"title":"Maveric4/pr19aaw01","url":"https://github.com/Maveric4/pr19aaw01"},{"title":"KeyG518/Unet_Cell_segmentation","url":"https://github.com/KeyG518/Unet_Cell_segmentation"},{"title":"vetlebh/unet","url":"https://github.com/vetlebh/unet"},{"title":"daxiaHuang/brainstorm","url":"https://github.com/daxiaHuang/brainstorm"},{"title":"Osdel/ssnets","url":"https://github.com/Osdel/ssnets"},{"title":"it6aidl/outdoorsegmentation","url":"https://github.com/it6aidl/outdoorsegmentation"},{"title":"sidify/areal_image_segmentation","url":"https://github.com/sidify/areal_image_segmentation"},{"title":"GeoDQ/Seismic-image-segmentation","url":"https://github.com/GeoDQ/Seismic-image-segmentation"},{"title":"TonyRays/U-net","url":"https://github.com/TonyRays/U-net"},{"title":"lyqcom/2D-unet","url":"https://github.com/lyqcom/2D-unet"},{"title":"2023-MindSpore-1/ms-code-118","url":"https://github.com/2023-MindSpore-1/ms-code-118"},{"title":"Aggrawal5497/UNet-Image-segmentation","url":"https://github.com/Aggrawal5497/UNet-Image-segmentation"},{"title":"jonryf/deep-learning-image-colorization-using-gan","url":"https://github.com/jonryf/deep-learning-image-colorization-using-gan"},{"title":"PlumedSerpent/tmp_perspective_map","url":"https://github.com/PlumedSerpent/tmp_perspective_map"},{"title":"2023-MindSpore-1/ms-code-183","url":"https://github.com/2023-MindSpore-1/ms-code-183"},{"title":"void-in-the-matrix/nuclei-segmentation-unet","url":"https://github.com/void-in-the-matrix/nuclei-segmentation-unet"},{"title":"pwochner/cmr_segmentation","url":"https://github.com/pwochner/cmr_segmentation"},{"title":"Holmes1204/PyTorch_Unet","url":"https://github.com/Holmes1204/PyTorch_Unet"},{"title":"work-mohit/UNet-from-scratch","url":"https://github.com/work-mohit/UNet-from-scratch"},{"title":"georgeyiasemis/U-Net-PyTorch","url":"https://github.com/georgeyiasemis/U-Net-PyTorch"},{"title":"zhiggins11/Semantic-Segmentation","url":"https://github.com/zhiggins11/Semantic-Segmentation"},{"title":"ajaystar8/UNet-PyTorch","url":"https://github.com/ajaystar8/UNet-PyTorch"},{"title":"devanshpratapsingh/U-net_for_Multiclass_Segmentation","url":"https://github.com/devanshpratapsingh/U-net_for_Multiclass_Segmentation"},{"title":"switch23/U-Net","url":"https://github.com/switch23/U-Net"},{"title":"salem-devloper/final","url":"https://github.com/salem-devloper/final"},{"title":"anminhhung/FPT_Hackathon","url":"https://github.com/anminhhung/FPT_Hackathon"},{"title":"Adarol/u-net","url":"https://github.com/Adarol/u-net"},{"title":"salem-devloper/lung-chaker","url":"https://github.com/salem-devloper/lung-chaker"},{"title":"kannyjyk/Nested-UNet","url":"https://github.com/kannyjyk/Nested-UNet"},{"title":"shermanhung/U-Net","url":"https://github.com/shermanhung/U-Net"}],"syntology":{"n":757,"n_ran":510,"n_unverified":247,"n_pointer_only":426}}},{"leaderboard":"/sota/semantic-segmentation-on-swimseg","slug":"semantic-segmentation-on-swimseg","dataset":"SWIMSEG","dataset_url":"/dataset/swimseg","rows_in_archive":1,"metrics":["Average Precision","Average Recall","F1-Score","MCC","Mean IoU"],"first_row_in_archive_order":{"model":"ACLNet","paper_title":"ACLNet: An Attention and Clustering-based Cloud Segmentation Network","paper_url":"/paper/aclnet-an-attention-and-clustering-based","paper_date":"2022-07-13","arxiv_id":"2207.06277","code_links":[{"title":"ckmvigil/aclnet","url":"https://github.com/ckmvigil/aclnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-swinseg","slug":"semantic-segmentation-on-swinseg","dataset":"SWINSEG","dataset_url":"/dataset/swinseg","rows_in_archive":1,"metrics":["Average Precision","Average Recall","F1-Score","MCC","Mean IoU"],"first_row_in_archive_order":{"model":"ACLNet","paper_title":"ACLNet: An Attention and Clustering-based Cloud Segmentation Network","paper_url":"/paper/aclnet-an-attention-and-clustering-based","paper_date":"2022-07-13","arxiv_id":"2207.06277","code_links":[{"title":"ckmvigil/aclnet","url":"https://github.com/ckmvigil/aclnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-swinyseg","slug":"semantic-segmentation-on-swinyseg","dataset":"SWINySEG","dataset_url":"/dataset/swinyseg","rows_in_archive":1,"metrics":["Average Precision","Average Recall","F1-Score","MCC","Mean IoU"],"first_row_in_archive_order":{"model":"ACLNet","paper_title":"ACLNet: An Attention and Clustering-based Cloud Segmentation Network","paper_url":"/paper/aclnet-an-attention-and-clustering-based","paper_date":"2022-07-13","arxiv_id":"2207.06277","code_links":[{"title":"ckmvigil/aclnet","url":"https://github.com/ckmvigil/aclnet"}],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-utfpr-sbd3","slug":"semantic-segmentation-on-utfpr-sbd3","dataset":"UTFPR-SBD3","dataset_url":"/dataset/utfpr-sbd3","rows_in_archive":1,"metrics":["1:1 Accuracy","IoU"],"first_row_in_archive_order":{"model":"EPYNET","paper_title":"EPYNET: Efficient Pyramidal Network for Clothing Segmentation","paper_url":"/paper/epynet-efficient-pyramidal-network-for","paper_date":"2020-10-13","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-segmentation-on-wilddash","slug":"semantic-segmentation-on-wilddash","dataset":"WildDash","dataset_url":"/dataset/wilddash","rows_in_archive":1,"metrics":["Mean IoU"],"first_row_in_archive_order":{"model":"SIW","paper_title":"Scaling up Multi-domain Semantic Segmentation with Sentence Embeddings","paper_url":"/paper/the-devil-is-in-the-labels-semantic","paper_date":"2022-02-04","arxiv_id":"2202.02002","code_links":[],"syntology":null}},{"leaderboard":null,"slug":"semantic-segmentation-on-ade20k-150-1","dataset":"ADE20K-150","dataset_url":"/dataset/ade20k","rows_in_archive":0,"metrics":["mIOU"],"first_row_in_archive_order":null}],"datasets":[{"url":"/dataset/coco","name":"COCO (Common Objects in Context)","full_name":"Common Objects in Context","num_papers_in_archive":11922},{"url":"/dataset/cityscapes","name":"Cityscapes","full_name":"","num_papers_in_archive":3702},{"url":"/dataset/kitti","name":"KITTI","full_name":"","num_papers_in_archive":3661},{"url":"/dataset/shapenet","name":"ShapeNet","full_name":"","num_papers_in_archive":1947},{"url":"/dataset/scannet","name":"ScanNet","full_name":"","num_papers_in_archive":1595},{"url":"/dataset/ade20k","name":"ADE20K","full_name":"","num_papers_in_archive":1213},{"url":"/dataset/nyuv2","name":"NYUv2","full_name":"NYU-Depth V2","num_papers_in_archive":986},{"url":"/dataset/davis","name":"DAVIS","full_name":"Densely Annotated VIdeo Segmentation","num_papers_in_archive":734},{"url":"/dataset/eurosat","name":"EuroSAT","full_name":"EuroSAT","num_papers_in_archive":687},{"url":"/dataset/synthia","name":"SYNTHIA","full_name":"SYNTHetic Collection of Imagery and Annotations","num_papers_in_archive":538},{"url":"/dataset/s3dis","name":"S3DIS","full_name":"Stanford 3D Indoor Scene Dataset (S3DIS)","num_papers_in_archive":488},{"url":"/dataset/sun-rgb-d","name":"SUN RGB-D","full_name":"SUN RGB-D","num_papers_in_archive":477},{"url":"/dataset/bdd100k","name":"BDD100K","full_name":"","num_papers_in_archive":469},{"url":"/dataset/matterport3d","name":"Matterport3D","full_name":"","num_papers_in_archive":461},{"url":"/dataset/refcoco","name":"RefCOCO","full_name":"","num_papers_in_archive":439},{"url":"/dataset/replica","name":"Replica","full_name":"","num_papers_in_archive":414},{"url":"/dataset/gta5","name":"GTA5","full_name":"Grand Theft Auto 5","num_papers_in_archive":412},{"url":"/dataset/coco-stuff","name":"COCO-Stuff","full_name":"Common Objects in COntext-stuff","num_papers_in_archive":338},{"url":"/dataset/pascal-context","name":"PASCAL Context","full_name":"","num_papers_in_archive":323},{"url":"/dataset/davis-2017","name":"DAVIS 2017","full_name":"DAVIS 2017","num_papers_in_archive":308},{"url":"/dataset/kitti-360","name":"KITTI-360","full_name":"","num_papers_in_archive":246},{"url":"/dataset/camvid","name":"CamVid","full_name":"Cambridge-driving Labeled Video Database","num_papers_in_archive":227},{"url":"/dataset/visda-2017","name":"VisDA-2017","full_name":"VisDA-2017","num_papers_in_archive":223},{"url":"/dataset/ham10000-1","name":"HAM10000","full_name":"HAM10000","num_papers_in_archive":209},{"url":"/dataset/helen","name":"Helen","full_name":"","num_papers_in_archive":201},{"url":"/dataset/kvasir-seg","name":"Kvasir-SEG","full_name":"","num_papers_in_archive":201},{"url":"/dataset/pascal-voc","name":"PASCAL VOC","full_name":"PASCAL Visual Object Classes Challenge","num_papers_in_archive":198},{"url":"/dataset/suncg","name":"SUNCG","full_name":"SUNCG","num_papers_in_archive":186},{"url":"/dataset/labelme","name":"LabelMe","full_name":"","num_papers_in_archive":178},{"url":"/dataset/pascal-5i","name":"PASCAL-5i","full_name":"","num_papers_in_archive":177},{"url":"/dataset/youtubevis","name":"YouTube-VIS 2019","full_name":"","num_papers_in_archive":163},{"url":"/dataset/objects365","name":"Objects365","full_name":"","num_papers_in_archive":161},{"url":"/dataset/partnet","name":"PartNet","full_name":"","num_papers_in_archive":156},{"url":"/dataset/2d-3d-s","name":"2D-3D-S","full_name":"2D-3D-Semantic","num_papers_in_archive":147},{"url":"/dataset/stare","name":"STARE","full_name":"Structured Analysis of the Retina","num_papers_in_archive":146},{"url":"/dataset/virtual-kitti","name":"Virtual KITTI","full_name":"","num_papers_in_archive":133},{"url":"/dataset/make3d","name":"Make3D","full_name":"","num_papers_in_archive":129},{"url":"/dataset/pascal-voc-2007","name":"PASCAL VOC 2007","full_name":"PASCAL VOC 2007","num_papers_in_archive":126},{"url":"/dataset/sun3d","name":"SUN3D","full_name":"SUN3D","num_papers_in_archive":126},{"url":"/dataset/kvasir","name":"Kvasir","full_name":"The Kvasir Dataset","num_papers_in_archive":117},{"url":"/dataset/pascal-voc-2012-test","name":"PASCAL VOC 2012 test","full_name":"","num_papers_in_archive":116},{"url":"/dataset/hypersim","name":"Hypersim","full_name":"","num_papers_in_archive":108},{"url":"/dataset/segtrack-v2-1","name":"SegTrack-v2","full_name":"","num_papers_in_archive":107},{"url":"/dataset/ave","name":"AVE","full_name":"Audio-Visual Event Localization","num_papers_in_archive":103},{"url":"/dataset/mapillary-vistas-dataset","name":"Mapillary Vistas Dataset","full_name":"","num_papers_in_archive":101},{"url":"/dataset/idd","name":"IDD","full_name":"Indian Driving Dataset","num_papers_in_archive":98},{"url":"/dataset/medical-segmentation-decathlon","name":"Medical Segmentation Decathlon","full_name":"","num_papers_in_archive":97},{"url":"/dataset/bigearthnet","name":"BigEarthNet","full_name":"","num_papers_in_archive":85},{"url":"/dataset/structured3d","name":"Structured3D","full_name":"","num_papers_in_archive":85},{"url":"/dataset/promise12","name":"PROMISE12","full_name":"PROMISE12","num_papers_in_archive":84},{"url":"/dataset/isaid","name":"iSAID","full_name":"","num_papers_in_archive":81},{"url":"/dataset/loveda","name":"LoveDA","full_name":"Remote Sensing Land-Cover Dataset for Domain Adaptive Semantic Segmentation","num_papers_in_archive":81},{"url":"/dataset/referitgame","name":"ReferItGame","full_name":"ReferItGame","num_papers_in_archive":80},{"url":"/dataset/apolloscape-1","name":"ApolloScape","full_name":"","num_papers_in_archive":74},{"url":"/dataset/semanticposs","name":"SemanticPOSS","full_name":"","num_papers_in_archive":71},{"url":"/dataset/brats-2015-1","name":"BraTS 2015","full_name":"BraTS 2015","num_papers_in_archive":69},{"url":"/dataset/consep","name":"CoNSeP","full_name":"Colorectal Nuclear Segmentation and Phenotypes","num_papers_in_archive":68},{"url":"/dataset/semantic3d","name":"Semantic3D","full_name":"","num_papers_in_archive":66},{"url":"/dataset/places365","name":"Places365","full_name":"","num_papers_in_archive":65},{"url":"/dataset/lip","name":"LIP","full_name":"Look into Person","num_papers_in_archive":61},{"url":"/dataset/pannuke","name":"PanNuke","full_name":"","num_papers_in_archive":61},{"url":"/dataset/dark-zurich","name":"Dark Zurich","full_name":"","num_papers_in_archive":57},{"url":"/dataset/lost-and-found","name":"Lost and Found","full_name":"","num_papers_in_archive":57},{"url":"/dataset/rellis-3d","name":"RELLIS-3D","full_name":null,"num_papers_in_archive":57},{"url":"/dataset/woodscape","name":"WoodScape","full_name":"","num_papers_in_archive":55},{"url":"/dataset/uavid","name":"UAVid","full_name":"","num_papers_in_archive":54},{"url":"/dataset/virtual-kitti-2","name":"Virtual KITTI 2","full_name":"","num_papers_in_archive":53},{"url":"/dataset/xbd","name":"xBD","full_name":"","num_papers_in_archive":51},{"url":"/dataset/3d-future","name":"3D-FUTURE","full_name":"","num_papers_in_archive":48},{"url":"/dataset/wilddash","name":"WildDash","full_name":"","num_papers_in_archive":47},{"url":"/dataset/stanford-background","name":"Stanford Background","full_name":"Standford Background Dataset","num_papers_in_archive":46},{"url":"/dataset/synscapes","name":"Synscapes","full_name":"","num_papers_in_archive":46},{"url":"/dataset/3r-scan","name":"3RScan","full_name":"","num_papers_in_archive":44},{"url":"/dataset/densepass","name":"DensePASS","full_name":"","num_papers_in_archive":43},{"url":"/dataset/imagenet-s","name":"ImageNet-S","full_name":"ImageNet Semantic Segmentation","num_papers_in_archive":43},{"url":"/dataset/ddd17","name":"DDD17","full_name":"DAVIS Driving Dataset 2017","num_papers_in_archive":41},{"url":"/dataset/kitti-road","name":"KITTI Road","full_name":"","num_papers_in_archive":41},{"url":"/dataset/roadtracer","name":"RoadTracer","full_name":"","num_papers_in_archive":39},{"url":"/dataset/slakh2100","name":"Slakh2100","full_name":"Synthesized Lakh Dataset","num_papers_in_archive":38},{"url":"/dataset/word","name":"WORD","full_name":"Whole abdominal  Organs Dataset","num_papers_in_archive":38},{"url":"/dataset/open-images-v4","name":"Open Images V4","full_name":"","num_papers_in_archive":37},{"url":"/dataset/stpls3d","name":"STPLS3D","full_name":"","num_papers_in_archive":36},{"url":"/dataset/pst900","name":"PST900","full_name":null,"num_papers_in_archive":35},{"url":"/dataset/oxuva","name":"OxUva","full_name":"","num_papers_in_archive":34},{"url":"/dataset/sen12ms","name":"SEN12MS","full_name":"","num_papers_in_archive":34},{"url":"/dataset/suim","name":"SUIM","full_name":"Segmentation of Underwater IMagery","num_papers_in_archive":34},{"url":"/dataset/trans10k","name":"Trans10K","full_name":"","num_papers_in_archive":33},{"url":"/dataset/openeds","name":"OpenEDS","full_name":"","num_papers_in_archive":31},{"url":"/dataset/phrasecut","name":"PhraseCut","full_name":"","num_papers_in_archive":31},{"url":"/dataset/deepfashion2","name":"DeepFashion2","full_name":"","num_papers_in_archive":30},{"url":"/dataset/interiornet","name":"InteriorNet","full_name":"","num_papers_in_archive":30},{"url":"/dataset/ocid","name":"OCID","full_name":"Object Clutter Indoor Dataset","num_papers_in_archive":29},{"url":"/dataset/partimagenet","name":"PartImageNet","full_name":"","num_papers_in_archive":29},{"url":"/dataset/segthor","name":"SegTHOR","full_name":"Segmentation of THoracic Organs at Risk","num_papers_in_archive":28},{"url":"/dataset/sensaturban","name":"SensatUrban","full_name":"","num_papers_in_archive":28},{"url":"/dataset/gid","name":"GID","full_name":"Gaofen Image Dataset","num_papers_in_archive":27},{"url":"/dataset/isic-2018-task-1","name":"ISIC 2018 Task 1","full_name":"ISIC 2018 Task 1","num_papers_in_archive":27},{"url":"/dataset/isprs-potsdam","name":"ISPRS Potsdam","full_name":"2D Semantic Labeling Contest - Potsdam","num_papers_in_archive":27},{"url":"/dataset/nighttime-driving","name":"Nighttime Driving","full_name":"","num_papers_in_archive":27},{"url":"/dataset/scribblesup","name":"ScribbleSup","full_name":"PASCAL-Scribble Dataset","num_papers_in_archive":26},{"url":"/dataset/ikea-asm","name":"IKEA ASM","full_name":"","num_papers_in_archive":25},{"url":"/dataset/rose","name":"ROSE","full_name":"Retinal OCTA SEgmentation dataset","num_papers_in_archive":25},{"url":"/dataset/dada-seg","name":"DADA-seg","full_name":"","num_papers_in_archive":24},{"url":"/dataset/toronto-3d","name":"Toronto-3D","full_name":null,"num_papers_in_archive":24},{"url":"/dataset/deepweeds","name":"DeepWeeds","full_name":"","num_papers_in_archive":23},{"url":"/dataset/digestpath","name":"DigestPath","full_name":"","num_papers_in_archive":23},{"url":"/dataset/dsec","name":"DSEC","full_name":"A Stereo Event Camera Dataset for Driving Scenarios","num_papers_in_archive":23},{"url":"/dataset/hoi4d","name":"HOI4D","full_name":"","num_papers_in_archive":23},{"url":"/dataset/carrada","name":"CARRADA","full_name":"","num_papers_in_archive":22},{"url":"/dataset/satlas","name":"Satlas","full_name":"","num_papers_in_archive":22},{"url":"/dataset/inria-aerial-image-labeling","name":"INRIA Aerial Image Labeling","full_name":"INRIA Aerial Image Labeling","num_papers_in_archive":21},{"url":"/dataset/mseg","name":"MSeg","full_name":"","num_papers_in_archive":21},{"url":"/dataset/avsbench","name":"AVSBench","full_name":"Audio −Visual Segmentation","num_papers_in_archive":20},{"url":"/dataset/fmb-dataset","name":"FMB Dataset","full_name":"Full-time Multi-modality Benchmark Dataset","num_papers_in_archive":20},{"url":"/dataset/pascal-voc-2011","name":"PASCAL VOC 2011","full_name":"PASCAL VOC 2011","num_papers_in_archive":20},{"url":"/dataset/deepfish","name":"DeepFish","full_name":"","num_papers_in_archive":19},{"url":"/dataset/deliver","name":"DELIVER","full_name":"","num_papers_in_archive":19},{"url":"/dataset/foodseg103","name":"FoodSeg103","full_name":"lewisnjue","num_papers_in_archive":19},{"url":"/dataset/hi4d","name":"Hi4D","full_name":"","num_papers_in_archive":19},{"url":"/dataset/isprs-vaihingen","name":"ISPRS Vaihingen","full_name":"2D Semantic Labeling - Vaihingen data","num_papers_in_archive":19},{"url":"/dataset/kvasir-instrument","name":"Kvasir-Instrument","full_name":"","num_papers_in_archive":19},{"url":"/dataset/mcubes","name":"MCubeS","full_name":"Multimodal Material Segmentation Dataset","num_papers_in_archive":19},{"url":"/dataset/modanet","name":"ModaNet","full_name":"","num_papers_in_archive":19},{"url":"/dataset/agriculture-vision","name":"Agriculture-Vision","full_name":"","num_papers_in_archive":18},{"url":"/dataset/ai-tod","name":"AI-TOD","full_name":"Tiny Object Detection in Aerial Images","num_papers_in_archive":18},{"url":"/dataset/crossmoda","name":"CrossMoDA","full_name":"Cross-Modality Domain Adaptation","num_papers_in_archive":18},{"url":"/dataset/pastis","name":"PASTIS","full_name":"Panoptic Segmentation of satellite image TImes Series","num_papers_in_archive":18},{"url":"/dataset/monuseg","name":"MoNuSeg","full_name":"","num_papers_in_archive":17},{"url":"/dataset/scenenet","name":"SceneNet","full_name":"SceneNet","num_papers_in_archive":17},{"url":"/dataset/cryonuseg","name":"CryoNuSeg","full_name":"","num_papers_in_archive":16},{"url":"/dataset/dada-2000","name":"DADA-2000","full_name":"","num_papers_in_archive":16},{"url":"/dataset/diva-hisdb","name":"DIVA-HisDB","full_name":"","num_papers_in_archive":15},{"url":"/dataset/paris-lille-3d","name":"Paris-Lille-3D","full_name":"","num_papers_in_archive":15},{"url":"/dataset/roadanomaly21","name":"RoadAnomaly21","full_name":"","num_papers_in_archive":15},{"url":"/dataset/fashionpedia","name":"Fashionpedia","full_name":"","num_papers_in_archive":14},{"url":"/dataset/mhp","name":"MHP","full_name":"Multiple-Human Parsing","num_papers_in_archive":14},{"url":"/dataset/refuge-challenge","name":"REFUGE Challenge","full_name":"Retinal Fundus Glaucoma Challenge","num_papers_in_archive":14},{"url":"/dataset/brats-2016","name":"BraTS 2016","full_name":"BraTS 2016","num_papers_in_archive":13},{"url":"/dataset/cityscapes-3d","name":"Cityscapes 3D","full_name":"","num_papers_in_archive":13},{"url":"/dataset/hm3dsem","name":"HM3DSem","full_name":"","num_papers_in_archive":13},{"url":"/dataset/ttpla","name":"TTPLA","full_name":"Transmission Towers and Power Lines (TTPLA)","num_papers_in_archive":13},{"url":"/dataset/waterscenes","name":"WaterScenes","full_name":"","num_papers_in_archive":13},{"url":"/dataset/partial-ilids","name":"Partial-iLIDS","full_name":"Partial-iLIDS","num_papers_in_archive":12},{"url":"/dataset/semanticstf","name":"SemanticSTF","full_name":"","num_papers_in_archive":12},{"url":"/dataset/trashcan","name":"TrashCan","full_name":"","num_papers_in_archive":12},{"url":"/dataset/wildscenes","name":"WildScenes","full_name":"","num_papers_in_archive":12},{"url":"/dataset/landcover-ai","name":"LandCover.ai","full_name":"Dataset for Automatic Mapping of Buildings, Woodlands, Water and Roads from Aerial Imagery","num_papers_in_archive":11},{"url":"/dataset/railsem19","name":"RailSem19","full_name":"RailSem19: A Dataset for Semantic Rail Scene Understanding","num_papers_in_archive":11},{"url":"/dataset/sd-198","name":"SD-198","full_name":"","num_papers_in_archive":11},{"url":"/dataset/so2sat-lcz42","name":"So2Sat LCZ42","full_name":"","num_papers_in_archive":11},{"url":"/dataset/taco","name":"TACO","full_name":null,"num_papers_in_archive":11},{"url":"/dataset/2-pm-vessel-dataset","name":"2-PM Vessel Dataset","full_name":"","num_papers_in_archive":10},{"url":"/dataset/acdc-scribbles","name":"ACDC Scribbles","full_name":"","num_papers_in_archive":10},{"url":"/dataset/cropandweed-dataset","name":"CropAndWeed","full_name":"","num_papers_in_archive":10},{"url":"/dataset/fine-grained-grass-segmentation-dataset","name":"Fine-Grained Grass Segmentation Dataset","full_name":"","num_papers_in_archive":10},{"url":"/dataset/ph2","name":"PH2","full_name":"","num_papers_in_archive":10},{"url":"/dataset/spacenet-2","name":"SpaceNet 2","full_name":"SpaceNet 2: Building Detection v2","num_papers_in_archive":10},{"url":"/dataset/airs","name":"AIRS","full_name":"","num_papers_in_archive":9},{"url":"/dataset/big","name":"BIG","full_name":"","num_papers_in_archive":9},{"url":"/dataset/bimcv-covid-19","name":"BIMCV COVID-19","full_name":"","num_papers_in_archive":9},{"url":"/dataset/egohos","name":"EgoHOS","full_name":"Fine-Grained Egocentric Hand-Object Segmentation Dataset","num_papers_in_archive":9},{"url":"/dataset/entityseg","name":"EntitySeg","full_name":"","num_papers_in_archive":9},{"url":"/dataset/perseg","name":"PerSeg","full_name":"","num_papers_in_archive":9},{"url":"/dataset/phenobench","name":"PhenoBench","full_name":"PhenoBench — A Large Dataset and Benchmarks for Semantic Image Interpretation in the Agricultural Domain","num_papers_in_archive":9},{"url":"/dataset/samrs","name":"SAMRS","full_name":"","num_papers_in_archive":9},{"url":"/dataset/sketchyscene","name":"SketchyScene","full_name":"","num_papers_in_archive":9},{"url":"/dataset/tssb","name":"TSSB","full_name":"Time Series Segmentation Benchmark","num_papers_in_archive":9},{"url":"/dataset/uiis-dataset","name":"UIIS","full_name":"General Underwater Image Instance Segmentation dataset","num_papers_in_archive":9},{"url":"/dataset/dttd2","name":"DTTD-Mobile","full_name":"","num_papers_in_archive":8},{"url":"/dataset/echonet-dynamic","name":"Echonet-Dynamic","full_name":"","num_papers_in_archive":8},{"url":"/dataset/montgomery-county-x-ray-set","name":"Montgomery County X-ray Set","full_name":"","num_papers_in_archive":8},{"url":"/dataset/rit-18","name":"RIT-18","full_name":"","num_papers_in_archive":8},{"url":"/dataset/synthcity","name":"SynthCity","full_name":"","num_papers_in_archive":8},{"url":"/dataset/zju-rgb-p","name":"ZJU-RGB-P","full_name":"","num_papers_in_archive":8},{"url":"/dataset/ndd20","name":"NDD20","full_name":"Northumberland Dolphin Dataset 2020","num_papers_in_archive":7},{"url":"/dataset/openeds2020","name":"OpenEDS2020","full_name":"","num_papers_in_archive":7},{"url":"/dataset/ost300","name":"OST300","full_name":"OST300","num_papers_in_archive":7},{"url":"/dataset/plant-seedlings-dataset","name":"Plant Seedlings Dataset","full_name":"","num_papers_in_archive":7},{"url":"/dataset/sunnybrook-cardiac-data","name":"Sunnybrook Cardiac Data","full_name":"Sunnybrook Cardiac Data","num_papers_in_archive":7},{"url":"/dataset/earthvqa","name":"EarthVQA","full_name":"A multi-modal multi-task VQA dataset for remote sensing","num_papers_in_archive":6},{"url":"/dataset/freiburg-forest","name":"Freiburg Forest","full_name":"Freiburg Forest","num_papers_in_archive":6},{"url":"/dataset/gff","name":"GFF","full_name":"Global Flood Forecasting","num_papers_in_archive":6},{"url":"/dataset/matterportlayout","name":"MatterportLayout","full_name":"","num_papers_in_archive":6},{"url":"/dataset/open-images-v7","name":"Open Images V7","full_name":"","num_papers_in_archive":6},{"url":"/dataset/swimseg","name":"SWIMSEG","full_name":"Singapore Whole sky IMaging SEGmentation Database","num_papers_in_archive":6},{"url":"/dataset/vdd","name":"VDD","full_name":"Varied Drone Dataset for Semantic Segmentation","num_papers_in_archive":6},{"url":"/dataset/ximagenet-12","name":"XImageNet-12","full_name":"XIMAGENET-12: An Explainable AI Benchmark Dataset for Model Robustness Evaluation","num_papers_in_archive":6},{"url":"/dataset/25ktrees","name":"25kTrees","full_name":"Individual Tree Crown Annotations","num_papers_in_archive":5},{"url":"/dataset/brats-2014-1","name":"BraTS 2014","full_name":"BraTS 2014","num_papers_in_archive":5},{"url":"/dataset/bup20","name":"BUP20","full_name":"Sweet Pepper 2020 University of Bonn","num_papers_in_archive":5},{"url":"/dataset/cata7","name":"Cata7","full_name":"","num_papers_in_archive":5},{"url":"/dataset/cc3m-tagmask","name":"CC3M-TagMask","full_name":"","num_papers_in_archive":5},{"url":"/dataset/golfdb","name":"GolfDB","full_name":"","num_papers_in_archive":5},{"url":"/dataset/idda","name":"IDDA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/isbda","name":"ISBDA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/kvasir-sessile-dataset","name":"Kvasir-Sessile dataset","full_name":"Sessile polyps from Kvasir-SEG","num_papers_in_archive":5},{"url":"/dataset/labpics","name":"LabPics","full_name":"LabPics Dataset for computer vision for autonomous chemistry labs and medical labs","num_papers_in_archive":5},{"url":"/dataset/lars","name":"LaRS","full_name":"Lakes, Rivers and Seas Dataset","num_papers_in_archive":5},{"url":"/dataset/m2caiseg","name":"m2caiSeg","full_name":"","num_papers_in_archive":5},{"url":"/dataset/market1501-attributes","name":"Market1501-Attributes","full_name":"Market1501-Attributes","num_papers_in_archive":5},{"url":"/dataset/nerds-360","name":"NERDS 360","full_name":"NeRF for Reconstruction, Decomposition and Scene Synthesis of 360° outdoor scenes","num_papers_in_archive":5},{"url":"/dataset/rent3d","name":"Rent3D","full_name":"","num_papers_in_archive":5},{"url":"/dataset/spacenet-1","name":"SpaceNet 1","full_name":"SpaceNet 1: Building Detection v1","num_papers_in_archive":5},{"url":"/dataset/swinseg","name":"SWINSEG","full_name":"Singapore Whole sky Nighttime Image SEGmentation Database","num_papers_in_archive":5},{"url":"/dataset/tas500","name":"TAS500","full_name":"","num_papers_in_archive":5},{"url":"/dataset/uplight","name":"UPLight","full_name":"","num_papers_in_archive":5},{"url":"/dataset/wgisd","name":"WGISD","full_name":"Embrapa Wine Grape Instance Segmentation Dataset","num_papers_in_archive":5},{"url":"/dataset/zerowaste","name":"ZeroWaste","full_name":"","num_papers_in_archive":5},{"url":"/dataset/aerorit","name":"AeroRIT","full_name":"","num_papers_in_archive":4},{"url":"/dataset/crackvision12k","name":"CrackVision12K","full_name":"","num_papers_in_archive":4},{"url":"/dataset/dukemtmc-attribute","name":"DukeMTMC-attribute","full_name":"DukeMTMC-attribute","num_papers_in_archive":4},{"url":"/dataset/eden","name":"EDEN","full_name":"","num_papers_in_archive":4},{"url":"/dataset/endoscapes","name":"Endoscapes","full_name":"Endoscapes - Semantic Segmentation","num_papers_in_archive":4},{"url":"/dataset/fine-grained-cloud-segmentation-dataset","name":"Fine-Grained Cloud Segmentation Dataset","full_name":"","num_papers_in_archive":4},{"url":"/dataset/flair-french-land-cover-from-aerospace","name":"FLAIR (French Land cover from Aerospace ImageRy)","full_name":"","num_papers_in_archive":4},{"url":"/dataset/mcubes-p","name":"MCubeS (P)","full_name":"Multimodal Material Segmentation Dataset","num_papers_in_archive":4},{"url":"/dataset/middlebury-2001","name":"Middlebury 2001","full_name":"Middlebury 2001","num_papers_in_archive":4},{"url":"/dataset/mju-waste","name":"MJU-Waste","full_name":"","num_papers_in_archive":4},{"url":"/dataset/muad","name":"MUAD","full_name":"Multiple Uncertainties for Autonomous Driving","num_papers_in_archive":4},{"url":"/dataset/muses-multi-sensor-semantic-perception","name":"MUSES: MUlti-SEnsor Semantic perception dataset","full_name":"The Multi-Sensor Semantic Perception Dataset for Driving under Uncertainty","num_papers_in_archive":4},{"url":"/dataset/pastis-r","name":"PASTIS-R","full_name":"Panoptic Segmentation of Radar and Optical Satellite image TIme Series","num_papers_in_archive":4},{"url":"/dataset/swinyseg","name":"SWINySEG","full_name":"Singapore Whole sky Nychthemeron Image SEGmentation Database","num_papers_in_archive":4},{"url":"/dataset/swiss3dcities","name":"Swiss3DCities","full_name":"","num_papers_in_archive":4},{"url":"/dataset/usis10k","name":"USIS10K","full_name":"Large-scale Underwater Salient Instance Segmentation Dataset","num_papers_in_archive":4},{"url":"/dataset/vlog-dataset","name":"VLOG Dataset","full_name":"","num_papers_in_archive":4},{"url":"/dataset/wisdom","name":"WISDOM","full_name":"Warehouse Instance Segmentation Dataset for Object Manipulation","num_papers_in_archive":4},{"url":"/dataset/aircraft-context-dataset","name":"Aircraft Context Dataset","full_name":"","num_papers_in_archive":3},{"url":"/dataset/all-day-cityscapes","name":"All-day CityScapes","full_name":"","num_papers_in_archive":3},{"url":"/dataset/arch2s","name":"ARCH2S","full_name":"Dataset, Benchmark for Learning Exterior Architectural Structures from Point Clouds","num_papers_in_archive":3},{"url":"/dataset/bright","name":"BRIGHT","full_name":"","num_papers_in_archive":3},{"url":"/dataset/chexlocalize","name":"CheXlocalize","full_name":"","num_papers_in_archive":3},{"url":"/dataset/deepsportradar-v1","name":"DeepSportRadar-v1","full_name":"","num_papers_in_archive":3},{"url":"/dataset/doors","name":"DOORS","full_name":"Dataset fOr bOuldeRs Segmentation","num_papers_in_archive":3},{"url":"/dataset/five-billion-pixels","name":"Five-Billion-Pixels","full_name":"","num_papers_in_archive":3},{"url":"/dataset/helixnet","name":"HelixNet","full_name":"HelixNet: A Dataset for Online LiDAR Segmentation","num_papers_in_archive":3},{"url":"/dataset/hephaestus","name":"Hephaestus","full_name":"Hephaestus: A large scale multitask dataset towards InSAR understanding","num_papers_in_archive":3},{"url":"/dataset/image-and-video-advertisements","name":"Image and Video Advertisements","full_name":"","num_papers_in_archive":3},{"url":"/dataset/kvasircapsule-seg","name":"KvasirCapsule-SEG","full_name":"","num_papers_in_archive":3},{"url":"/dataset/medico-automatic-polyp-segmentation-challenge","name":"Medico automatic polyp segmentation challenge (dataset)","full_name":"","num_papers_in_archive":3},{"url":"/dataset/oam-tcd","name":"OAM-TCD","full_name":"","num_papers_in_archive":3},{"url":"/dataset/openttgames","name":"OpenTTGames","full_name":"","num_papers_in_archive":3},{"url":"/dataset/petraw","name":"PETRAW","full_name":"PEg TRAnsfer Workflow recognition by different modalities","num_papers_in_archive":3},{"url":"/dataset/pic","name":"PIC","full_name":"Person In Context 2021","num_papers_in_archive":3},{"url":"/dataset/robotpush","name":"RobotPush","full_name":"RobotPush","num_papers_in_archive":3},{"url":"/dataset/ruralscapes-dataset","name":"Ruralscapes","full_name":"","num_papers_in_archive":3},{"url":"/dataset/spacenet-mvoi","name":"SpaceNet MVOI","full_name":"SpaceNet Multi-View Overhead Imagery Dataset","num_papers_in_archive":3},{"url":"/dataset/undd","name":"UNDD","full_name":"Urban Night Driving Dataset","num_papers_in_archive":3},{"url":"/dataset/vocalfolds","name":"VocalFolds","full_name":null,"num_papers_in_archive":3},{"url":"/dataset/atlantis","name":"ATLANTIS","full_name":"","num_papers_in_archive":2},{"url":"/dataset/calcrop21","name":"CalCROP21","full_name":"","num_papers_in_archive":2},{"url":"/dataset/cam2bev","name":"Cam2BEV","full_name":"","num_papers_in_archive":2},{"url":"/dataset/cityscapes-vipriors-subset","name":"Cityscapes VIPriors subset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/colorectal-adenoma","name":"Colorectal Adenoma","full_name":"","num_papers_in_archive":2},{"url":"/dataset/cumulo","name":"Cumulo","full_name":"","num_papers_in_archive":2},{"url":"/dataset/dacl10k","name":"dacl10k","full_name":"dacl10k: Dataset for Semantic Bridge Damage Segmentation","num_papers_in_archive":2},{"url":"/dataset/emds-6","name":"EMDS-6","full_name":"","num_papers_in_archive":2},{"url":"/dataset/endotect-polyp-segmentation","name":"Endotect Polyp Segmentation Challenge Dataset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/extended-agriculture-vision","name":"Extended Agriculture-Vision","full_name":"","num_papers_in_archive":2},{"url":"/dataset/forward-looking-sonar-marine-debris-datasets","name":"Forward-Looking Sonar Marine Debris Datasets","full_name":"","num_papers_in_archive":2},{"url":"/dataset/fpds","name":"FPDS","full_name":"Fallen People Data Set","num_papers_in_archive":2},{"url":"/dataset/fracatlas","name":"FracAtlas","full_name":"A Dataset for Fracture Classification, Localization and Segmentation of Musculoskeletal Radiographs","num_papers_in_archive":2},{"url":"/dataset/g-vue","name":"G-VUE","full_name":"General-purpose Visual Understanding Evaluation","num_papers_in_archive":2},{"url":"/dataset/hera-and-lofar-rfi-detection","name":"HERA RFI Detection","full_name":"Hydrogen Epoch of Reionization Array (HERA)","num_papers_in_archive":2},{"url":"/dataset/hutics","name":"HuTics","full_name":"Human Deictic Gestures Dataset","num_papers_in_archive":2},{"url":"/dataset/lofar-rfi-detection","name":"LOFAR RFI Detection","full_name":"Low-Frequency Array (LOFAR) Radio Frequency Interference Detection","num_papers_in_archive":2},{"url":"/dataset/lombardia-sentinel-2-image-time-series-for","name":"Lombardia Sentinel-2 Image Time Series for Crop Mapping","full_name":"","num_papers_in_archive":2},{"url":"/dataset/magicbathynet","name":"MagicBathyNet","full_name":"","num_papers_in_archive":2},{"url":"/dataset/mila-simulated-floods","name":"Mila Simulated Floods","full_name":"","num_papers_in_archive":2},{"url":"/dataset/music","name":"MUSIC","full_name":"Multi-Spectral Imaging via Computed Tomography","num_papers_in_archive":2},{"url":"/dataset/mvtec-d2s","name":"MVTec D2S","full_name":"MVTec Densely Segmented Supermarket","num_papers_in_archive":2},{"url":"/dataset/nvgaze","name":"NVGaze","full_name":"NVGaze: An Anatomically-Informed Dataset for Low-Latency, Near-Eye Gaze Estimation","num_papers_in_archive":2},{"url":"/dataset/oadat","name":"OADAT","full_name":"OADAT: Experimental and Synthetic Clinical Optoacoustic Data for Standardized Image Processing","num_papers_in_archive":2},{"url":"/dataset/odms","name":"ODMS","full_name":"Object Depth via Motion and Segmentation","num_papers_in_archive":2},{"url":"/dataset/omnicity","name":"OmniCity","full_name":"","num_papers_in_archive":2},{"url":"/dataset/pax-ray","name":"PAX-Ray++","full_name":"Projected Anatomy in X-Ray Dataset ++","num_papers_in_archive":2},{"url":"/dataset/photi-lakeice","name":"Photi-LakeIce","full_name":"","num_papers_in_archive":2},{"url":"/dataset/pothole-mix","name":"Pothole Mix","full_name":"Pothole Mix Semantic Segmentation Dataset for Road Damage Detection and Segmentation","num_papers_in_archive":2},{"url":"/dataset/potsdam","name":"Potsdam","full_name":"","num_papers_in_archive":2},{"url":"/dataset/retinal-microsurgery","name":"Retinal Microsurgery","full_name":"Retinal Microsurgery","num_papers_in_archive":2},{"url":"/dataset/road-scene-graph","name":"Road Scene Graph","full_name":"","num_papers_in_archive":2},{"url":"/dataset/rugd","name":"RUGD","full_name":"RUGD: Robot Unstructured Ground Driving","num_papers_in_archive":2},{"url":"/dataset/sb20","name":"SB20","full_name":"Sugar Beet 2020 University of Bonn","num_papers_in_archive":2},{"url":"/dataset/segrcdb","name":"SegRCDB","full_name":"","num_papers_in_archive":2},{"url":"/dataset/semanticspray-dataset","name":"SemanticSpray Dataset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/tas-nir","name":"TAS-NIR","full_name":"","num_papers_in_archive":2},{"url":"/dataset/topology-optimization-dataset","name":"Topology Optimization Dataset","full_name":null,"num_papers_in_archive":2},{"url":"/dataset/u-diads-bib","name":"U-DIADS-Bib","full_name":"","num_papers_in_archive":2},{"url":"/dataset/vistas-np","name":"Vistas-NP","full_name":null,"num_papers_in_archive":2},{"url":"/dataset/bcsd","name":"BCSD","full_name":"Bank Check Segmentation Dataset","num_papers_in_archive":1},{"url":"/dataset/burned-area-delineation-from-satellite","name":"Burned Area Delineation from Satellite Imagery","full_name":"A Dataset for Burned Area Delineation and Severity Estimation from Satellite Imagery","num_papers_in_archive":1},{"url":"/dataset/carla2real","name":"CARLA2Real","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ccse","name":"CCSE","full_name":"Chinese Character Stroke Extraction","num_papers_in_archive":1},{"url":"/dataset/cems-w","name":"CEMS-W","full_name":"CEMS Wildires","num_papers_in_archive":1},{"url":"/dataset/ciona17","name":"Ciona17","full_name":"","num_papers_in_archive":1},{"url":"/dataset/congnamul","name":"CongNaMul","full_name":"","num_papers_in_archive":1},{"url":"/dataset/cuts","name":"CUTS","full_name":"","num_papers_in_archive":1},{"url":"/dataset/dade","name":"DADE","full_name":"Driving Agents in Dynamic Environments","num_papers_in_archive":1},{"url":"/dataset/dronedeploy","name":"DroneDeploy","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ebhi-seg","name":"EBHI-Seg","full_name":"","num_papers_in_archive":1},{"url":"/dataset/fp4s","name":"FP4S","full_name":"Floor plan image segmentation via scribble-based semi-weakly-supervised learning","num_papers_in_archive":1},{"url":"/dataset/freiburg-terrains","name":"Freiburg Terrains","full_name":"Freiburg Terrains","num_papers_in_archive":1},{"url":"/dataset/guiss-dataset","name":"GUISS dataset","full_name":"Meshes, textures, Blend files, stereo datasets, depth maps, depth estimations)","num_papers_in_archive":1},{"url":"/dataset/hascd","name":"HASCD","full_name":"Human Activity Segmentation Challenge Dataset","num_papers_in_archive":1},{"url":"/dataset/hepic","name":"HePIC 🏛️","full_name":"","num_papers_in_archive":1},{"url":"/dataset/hutu-80","name":"HuTu 80","full_name":"HuTu 80 cell populations","num_papers_in_archive":1},{"url":"/dataset/indraeye","name":"IndraEye","full_name":"IndraEye: Infrared Electro-Optical Drone-based Aerial Object Detection Dataset","num_papers_in_archive":1},{"url":"/dataset/integrated-drone-dataset-for-semantic","name":"Integrated Drone Dataset for Semantic Segmentation","full_name":"IDD","num_papers_in_archive":1},{"url":"/dataset/lib-hsi","name":"LIB-HSI","full_name":"RGB and Hyperspectral images of Building Facades","num_papers_in_archive":1},{"url":"/dataset/meta-omnium","name":"Meta Omnium","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mixedwm38","name":"MixedWM38","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mls","name":"MLS","full_name":"Multiple Light Source","num_papers_in_archive":1},{"url":"/dataset/mosad","name":"MOSAD","full_name":"Mobile Sensing Human Activity Data Set","num_papers_in_archive":1},{"url":"/dataset/mtneuro","name":"MTNeuro","full_name":"","num_papers_in_archive":1},{"url":"/dataset/multi-species-fruit-flower-detection-datasets","name":"Multi-species fruit flower detection datasets","full_name":"","num_papers_in_archive":1},{"url":"/dataset/multispectral-and-hd-vineyard-orthomosaics","name":"Multispectral  and HD vineyard orthomosaics from central Portugal","full_name":"","num_papers_in_archive":1},{"url":"/dataset/okutama-drone-and-swiss-drone-dataset","name":"Okutama Drone and Swiss Drone Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/panoramic-video-panoptic-segmentation-dataset","name":"Panoramic Video Panoptic Segmentation Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/polyp-ash","name":"Polyp ASH","full_name":"","num_papers_in_archive":1},{"url":"/dataset/risk-aware-planning-dataset","name":"Risk-Aware Planning Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/sbcoseg","name":"SBCoseg","full_name":"SBCoseg Dataset","num_papers_in_archive":1},{"url":"/dataset/semantic-segmentation-vineyard-rows","name":"Semantic Segmentation Vineyard Rows","full_name":"","num_papers_in_archive":1},{"url":"/dataset/semanticsugarbeets","name":"SemanticSugarBeets","full_name":"","num_papers_in_archive":1},{"url":"/dataset/semanticusl","name":"SemanticUSL","full_name":"","num_papers_in_archive":1},{"url":"/dataset/sen4agrinet","name":"Sen4AgriNet","full_name":"A Sentinel-2 multi-year, multi-country benchmark dataset for crop classification and segmentation with deep learning","num_papers_in_archive":1},{"url":"/dataset/synthia-pano","name":"SYNTHIA-PANO","full_name":"","num_papers_in_archive":1},{"url":"/dataset/the-robotrix","name":"The RobotriX","full_name":"","num_papers_in_archive":1},{"url":"/dataset/thermal-face-database","name":"Thermal Face Database","full_name":"","num_papers_in_archive":1},{"url":"/dataset/timbervision-dataset","name":"TimberVision","full_name":"TimberVision","num_papers_in_archive":1},{"url":"/dataset/tinto","name":"Tinto","full_name":"Tinto: Multisensor Benchmark for 3D Hyperspectral Point Cloud Segmentation in the Geosciences","num_papers_in_archive":1},{"url":"/dataset/transproteus","name":"TransProteus","full_name":"","num_papers_in_archive":1},{"url":"/dataset/uncertainty-quantification-for-underwater","name":"Uncertainty Quantification for Underwater Object Segmentation","full_name":"","num_papers_in_archive":1},{"url":"/dataset/utfpr-sbd3","name":"UTFPR-SBD3","full_name":"","num_papers_in_archive":1},{"url":"/dataset/vizwiz-fewshot","name":"VizWiz-FewShot","full_name":"","num_papers_in_archive":1},{"url":"/dataset/xkcdcolors","name":"XKCDColors","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/aachen-heerlen-annotated-steel-microstructure","name":"Aachen-Heerlen Annotated Steel Microstructure Dataset","full_name":"","num_papers_in_archive":0},{"url":"/dataset/corn-seeds-dataset","name":"Corn Seeds Dataset","full_name":"","num_papers_in_archive":0},{"url":"/dataset/dms","name":"DMS","full_name":"Dense Material Segmentation Dataset","num_papers_in_archive":0},{"url":"/dataset/dronescapes","name":"Dronescapes","full_name":"","num_papers_in_archive":0},{"url":"/dataset/lemons-quality-control-dataset","name":"Lemons quality control dataset","full_name":"","num_papers_in_archive":0},{"url":"/dataset/mvp-24k","name":"MVP-24K","full_name":"Multi-grained Vehicle Parsing dataset","num_papers_in_archive":0},{"url":"/dataset/oct5k","name":"OCT5k","full_name":"","num_papers_in_archive":0},{"url":"/dataset/opensurfaces","name":"OpenSurfaces","full_name":"","num_papers_in_archive":0},{"url":"/dataset/outback","name":"OUTBACK: A Multimodal Synthetic Dataset for Rural Australian Off-road Robot Navigation","full_name":"","num_papers_in_archive":0},{"url":"/dataset/paxray","name":"PAXRay","full_name":"PAXRay: A Projected dataset for the segmentation of Anatomical structures in X-Ray data","num_papers_in_archive":0},{"url":"/dataset/psie","name":"PSIE","full_name":"","num_papers_in_archive":0},{"url":"/dataset/uav-based-multispectral-vineyards","name":"UAV-based multispectral vineyards","full_name":"","num_papers_in_archive":0},{"url":"/dataset/wta-tla","name":"WTA/TLA","full_name":"WTA/TLA: A UAV-captured Dataset for Semantic Segmentation of Energy Infrastructure","num_papers_in_archive":0}],"subtasks":[{"url":"/task/3d-part-segmentation","name":"3D Part Segmentation"},{"url":"/task/3d-semantic-segmentation","name":"3D Semantic Segmentation"},{"url":"/task/4d-spatio-temporal-semantic-segmentation","name":"4D Spatio Temporal Semantic Segmentation"},{"url":"/task/aerial-video-semantic-segmentation","name":"Aerial Video Semantic Segmentation"},{"url":"/task/amodal-panoptic-segmentation","name":"Amodal Panoptic Segmentation"},{"url":"/task/attentive-segmentation-networks","name":"Attentive segmentation networks"},{"url":"/task/bird-s-eye-view-semantic-segmentation","name":"Bird's-Eye View Semantic Segmentation"},{"url":"/task/class-incremental-semantic-segmentation","name":"Class-Incremental Semantic Segmentation"},{"url":"/task/crack-segmentation","name":"Crack Segmentation"},{"url":"/task/flood-extent-forecasting","name":"Flood extent forecasting"},{"url":"/task/histopathological-segmentation","name":"Histopathological Segmentation"},{"url":"/task/hyperspectral-semantic-segmentation","name":"Hyperspectral Semantic Segmentation"},{"url":"/task/one-shot-segmentation","name":"One-Shot Segmentation"},{"url":"/task/panoptic-segmentation","name":"Panoptic Segmentation"},{"url":"/task/polyp-segmentation","name":"Polyp Segmentation"},{"url":"/task/real-time-semantic-segmentation","name":"Real-Time Semantic Segmentation"},{"url":"/task/road-segementation","name":"Road Segmentation"},{"url":"/task/robust-bev-map-segmentation","name":"Robust BEV Map Segmentation"},{"url":"/task/scene-segmentation","name":"Scene Segmentation"},{"url":"/task/semi-supervised-semantic-segmentation","name":"Semi-Supervised Semantic Segmentation"},{"url":"/task/sound-prompted-semantic-segmentation","name":"Sound Prompted Semantic Segmentation"},{"url":"/task/speech-prompted-semantic-segmentation","name":"Speech Prompted Semantic Segmentation"},{"url":"/task/text-line-extraction","name":"Text-Line Extraction"},{"url":"/task/tumor-segmentation","name":"Tumor Segmentation"},{"url":"/task/unet-segmentation","name":"UNET Segmentation"},{"url":"/task/universal-segmentation","name":"Universal Segmentation"},{"url":"/task/unsupervised-semantic-segmentation","name":"Unsupervised Semantic Segmentation"},{"url":"/task/vision-language-segmentation","name":"Vision-Language Segmentation"},{"url":"/task/weakly-supervised-semantic-segmentation","name":"Weakly-Supervised Semantic Segmentation"}],"parent_tasks":[{"url":"/task/10-shot-image-generation","name":"10-shot image generation"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":6644,"tagged_in_all":14763,"items":[{"url":"/paper/u-net-convolutional-networks-for-biomedical","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","date":"2015-05-18","arxiv_id":"1505.04597","repositories_listed":487,"syntology":{"n":757,"n_ran":510,"n_unverified":247,"n_pointer_only":426}},{"url":"/paper/deep-residual-learning-for-image-recognition","title":"Deep Residual Learning for Image Recognition","date":"2015-12-10","arxiv_id":"1512.03385","repositories_listed":484,"syntology":{"n":377,"n_ran":230,"n_unverified":147,"n_pointer_only":187}},{"url":"/paper/mask-r-cnn","title":"Mask R-CNN","date":"2017-03-20","arxiv_id":"1703.06870","repositories_listed":179,"syntology":{"n":140,"n_ran":42,"n_unverified":98,"n_pointer_only":23}},{"url":"/paper/mobilenetv2-inverted-residuals-and-linear","title":"MobileNetV2: Inverted Residuals and Linear Bottlenecks","date":"2018-01-13","arxiv_id":"1801.04381","repositories_listed":159,"syntology":{"n":111,"n_ran":85,"n_unverified":26,"n_pointer_only":64}},{"url":"/paper/an-image-is-worth-16x16-words-transformers-1","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","date":"2020-10-22","arxiv_id":"2010.11929","repositories_listed":158,"syntology":{"n":419,"n_ran":281,"n_unverified":138,"n_pointer_only":154}},{"url":"/paper/mmdetection-open-mmlab-detection-toolbox-and","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","date":"2019-06-17","arxiv_id":"1906.07155","repositories_listed":142,"syntology":{"n":82,"n_ran":14,"n_unverified":68,"n_pointer_only":0}},{"url":"/paper/pointnet-deep-learning-on-point-sets-for-3d","title":"PointNet: Deep Learning on Point Sets for 3D Classification and Segmentation","date":"2016-12-02","arxiv_id":"1612.00593","repositories_listed":110,"syntology":{"n":164,"n_ran":89,"n_unverified":75,"n_pointer_only":90}},{"url":"/paper/fcos-fully-convolutional-one-stage-object","title":"FCOS: Fully Convolutional One-Stage Object Detection","date":"2019-04-02","arxiv_id":"1904.01355","repositories_listed":87,"syntology":{"n":40,"n_ran":13,"n_unverified":27,"n_pointer_only":18}},{"url":"/paper/feature-pyramid-networks-for-object-detection","title":"Feature Pyramid Networks for Object Detection","date":"2016-12-09","arxiv_id":"1612.03144","repositories_listed":85,"syntology":{"n":51,"n_ran":16,"n_unverified":35,"n_pointer_only":11}},{"url":"/paper/swin-transformer-hierarchical-vision","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","date":"2021-03-25","arxiv_id":"2103.14030","repositories_listed":80,"syntology":{"n":207,"n_ran":108,"n_unverified":99,"n_pointer_only":43}},{"url":"/paper/encoder-decoder-with-atrous-separable","title":"Encoder-Decoder with Atrous Separable Convolution for Semantic Image Segmentation","date":"2018-02-07","arxiv_id":"1802.02611","repositories_listed":78,"syntology":{"n":72,"n_ran":43,"n_unverified":29,"n_pointer_only":40}},{"url":"/paper/rethinking-atrous-convolution-for-semantic","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","date":"2017-06-17","arxiv_id":"1706.05587","repositories_listed":77,"syntology":{"n":7,"n_ran":3,"n_unverified":4,"n_pointer_only":3}},{"url":"/paper/segnet-a-deep-convolutional-encoder-decoder","title":"SegNet: A Deep Convolutional Encoder-Decoder Architecture for Image Segmentation","date":"2015-11-02","arxiv_id":"1511.00561","repositories_listed":74,"syntology":{"n":44,"n_ran":9,"n_unverified":35,"n_pointer_only":10}},{"url":"/paper/pointnet-deep-hierarchical-feature-learning","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","date":"2017-06-07","arxiv_id":"1706.02413","repositories_listed":68,"syntology":{"n":67,"n_ran":36,"n_unverified":31,"n_pointer_only":26}},{"url":"/paper/searching-for-mobilenetv3","title":"Searching for MobileNetV3","date":"2019-05-06","arxiv_id":"1905.02244","repositories_listed":67,"syntology":{"n":105,"n_ran":58,"n_unverified":47,"n_pointer_only":46}},{"url":"/paper/pyramid-scene-parsing-network","title":"Pyramid Scene Parsing Network","date":"2016-12-04","arxiv_id":"1612.01105","repositories_listed":67,"syntology":{"n":29,"n_ran":7,"n_unverified":22,"n_pointer_only":5}},{"url":"/paper/masked-autoencoders-are-scalable-vision","title":"Masked Autoencoders Are Scalable Vision Learners","date":"2021-11-11","arxiv_id":"2111.06377","repositories_listed":58,"syntology":{"n":137,"n_ran":71,"n_unverified":66,"n_pointer_only":73}},{"url":"/paper/a-convnet-for-the-2020s","title":"A ConvNet for the 2020s","date":"2022-01-10","arxiv_id":"2201.03545","repositories_listed":54,"syntology":{"n":80,"n_ran":54,"n_unverified":26,"n_pointer_only":11}},{"url":"/paper/fully-convolutional-networks-for-semantic-1","title":"Fully Convolutional Networks for Semantic Segmentation","date":"2014-11-14","arxiv_id":"1411.4038","repositories_listed":51,"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":4}},{"url":"/paper/enet-a-deep-neural-network-architecture-for","title":"ENet: A Deep Neural Network Architecture for Real-Time Semantic Segmentation","date":"2016-06-07","arxiv_id":"1606.02147","repositories_listed":49,"syntology":{"n":30,"n_ran":5,"n_unverified":25,"n_pointer_only":0}},{"url":"/paper/yolact-real-time-instance-segmentation","title":"YOLACT: Real-time Instance Segmentation","date":"2019-04-04","arxiv_id":"1904.02689","repositories_listed":48,"syntology":{"n":21,"n_ran":10,"n_unverified":11,"n_pointer_only":6}},{"url":"/paper/deeplab-semantic-image-segmentation-with-deep","title":"DeepLab: Semantic Image Segmentation with Deep Convolutional Nets, Atrous Convolution, and Fully Connected CRFs","date":"2016-06-02","arxiv_id":"1606.00915","repositories_listed":47,"syntology":{"n":63,"n_ran":28,"n_unverified":35,"n_pointer_only":16}},{"url":"/paper/190807919","title":"Deep High-Resolution Representation Learning for Visual Recognition","date":"2019-08-20","arxiv_id":"1908.07919","repositories_listed":42,"syntology":{"n":34,"n_ran":3,"n_unverified":31,"n_pointer_only":16}},{"url":"/paper/high-resolution-representations-for-labeling","title":"High-Resolution Representations for Labeling Pixels and Regions","date":"2019-04-09","arxiv_id":"1904.04514","repositories_listed":39,"syntology":{"n":18,"n_ran":3,"n_unverified":15,"n_pointer_only":5}},{"url":"/paper/deformable-convolutional-networks","title":"Deformable Convolutional Networks","date":"2017-03-17","arxiv_id":"1703.06211","repositories_listed":38,"syntology":{"n":9,"n_ran":3,"n_unverified":6,"n_pointer_only":3}},{"url":"/paper/microsoft-coco-common-objects-in-context","title":"Microsoft COCO: Common Objects in Context","date":"2014-05-01","arxiv_id":"1405.0312","repositories_listed":38,"syntology":{"n":7,"n_ran":1,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/attention-u-net-learning-where-to-look-for","title":"Attention U-Net: Learning Where to Look for the Pancreas","date":"2018-04-11","arxiv_id":"1804.03999","repositories_listed":37,"syntology":{"n":28,"n_ran":8,"n_unverified":20,"n_pointer_only":7}},{"url":"/paper/fully-convolutional-networks-for-semantic","title":"Fully Convolutional Networks for Semantic Segmentation","date":"2016-05-20","arxiv_id":"1605.06211","repositories_listed":37,"syntology":null},{"url":"/paper/resnest-split-attention-networks","title":"ResNeSt: Split-Attention Networks","date":"2020-04-19","arxiv_id":"2004.08955","repositories_listed":36,"syntology":{"n":48,"n_ran":8,"n_unverified":40,"n_pointer_only":23}},{"url":"/paper/yolact-better-real-time-instance-segmentation","title":"YOLACT++: Better Real-time Instance Segmentation","date":"2019-12-03","arxiv_id":"1912.06218","repositories_listed":36,"syntology":{"n":43,"n_ran":11,"n_unverified":32,"n_pointer_only":0}}],"syntology_records":29,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}