{"url":"/task/2d-semantic-segmentation","name":"2D Semantic Segmentation","slug":"2d-semantic-segmentation","description_markdown":null,"categories":[{"name":"Adversarial","url":"/area/adversarial"},{"name":"Audio","url":"/area/audio"},{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":79,"papers_with_code":49,"benchmarks":11,"benchmark_tables_in_archive":11,"benchmark_tables_shown":11,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":81,"subtasks":17,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/2d-semantic-segmentation-on-deep-indices","slug":"2d-semantic-segmentation-on-deep-indices","dataset":"Deep Indices","dataset_url":"/dataset/deep-indices","rows_in_archive":23,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"7x7 dense-morphological + ibf + sprb","paper_title":"DeepIndices: Remote Sensing Indices Based on Approximation of Functions through Deep-Learning, Application to Uncalibrated Vegetation Images","paper_url":"/paper/deepindices-remote-sensing-indices-based-on","paper_date":"2021-06-11","arxiv_id":null,"code_links":[{"title":"phd-thesis-adventice/phd-index-optimizer-tensorflow","url":"https://gitlab.com/phd-thesis-adventice/phd-index-optimizer-tensorflow"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-wildscenes","slug":"2d-semantic-segmentation-on-wildscenes","dataset":"WildScenes","dataset_url":"/dataset/wildscenes","rows_in_archive":5,"metrics":["mIoU","mIoU (Temporal DA) ","mIoU (Env DA)"],"first_row_in_archive_order":{"model":"Mask2Former (Swin-L)","paper_title":"Masked-attention Mask Transformer for Universal Image Segmentation","paper_url":"/paper/masked-attention-mask-transformer-for","paper_date":"2021-12-02","arxiv_id":"2112.01527","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"open-mmlab/mmdetection","url":"https://github.com/open-mmlab/mmdetection"},{"title":"facebookresearch/Mask2Former","url":"https://github.com/facebookresearch/Mask2Former"},{"title":"alibaba/EasyCV","url":"https://github.com/alibaba/EasyCV"},{"title":"DdeGeus/Mask2Former-IBS","url":"https://github.com/DdeGeus/Mask2Former-IBS"},{"title":"nihalsid/mask2former","url":"https://github.com/nihalsid/mask2former"},{"title":"MindSpore-scientific/code-7","url":"https://github.com/MindSpore-scientific/code-7/tree/main/Mask2Former"}],"syntology":{"n":8,"n_ran":2,"n_unverified":6,"n_pointer_only":0}}},{"leaderboard":"/sota/2d-semantic-segmentation-on-xbd","slug":"2d-semantic-segmentation-on-xbd","dataset":"xBD","dataset_url":"/dataset/xbd","rows_in_archive":5,"metrics":["Weighted Average F1-score","Localization F1-score","Classification F1-score"],"first_row_in_archive_order":{"model":"MambaBDA-Base","paper_title":"ChangeMamba: Remote Sensing Change Detection With Spatiotemporal State Space Model","paper_url":"/paper/changemamba-remote-sensing-change-detection","paper_date":"2024-04-04","arxiv_id":"2404.03425","code_links":[{"title":"chenhongruixuan/mambacd","url":"https://github.com/chenhongruixuan/mambacd"}],"syntology":{"n":9,"n_ran":5,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/2d-semantic-segmentation-on-rellis-3d","slug":"2d-semantic-segmentation-on-rellis-3d","dataset":"RELLIS-3D","dataset_url":"/dataset/rellis-3d","rows_in_archive":2,"metrics":["Mean IoU (class)"],"first_row_in_archive_order":{"model":"Swiftnet","paper_title":"Semantic Segmentation with High Inference Speed in Off-Road Environments","paper_url":"/paper/semantic-segmentation-with-high-inference","paper_date":"2023-04-10","arxiv_id":null,"code_links":[{"title":"cufctl/segmentation","url":"https://github.com/cufctl/segmentation"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-camvid","slug":"2d-semantic-segmentation-on-camvid","dataset":"CamVid","dataset_url":"/dataset/camvid","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SERNet-Former","paper_title":"SERNet-Former: Semantic Segmentation by Efficient Residual Network with Attention-Boosting Gates and Attention-Fusion Networks","paper_url":"/paper/sernet-former-semantic-segmentation-by","paper_date":"2024-01-28","arxiv_id":"2401.15741","code_links":[{"title":"serdarch/sernet-former","url":"https://github.com/serdarch/sernet-former"},{"title":"serdarch/SERNet-Former","url":"https://github.com/serdarch/SERNet-Former/blob/main/README.md"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-cityscapes-val","slug":"2d-semantic-segmentation-on-cityscapes-val","dataset":"Cityscapes val","dataset_url":"/dataset/cityscapes","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"SERNet-Former","paper_title":"SERNet-Former: Semantic Segmentation by Efficient Residual Network with Attention-Boosting Gates and Attention-Fusion Networks","paper_url":"/paper/sernet-former-semantic-segmentation-by","paper_date":"2024-01-28","arxiv_id":"2401.15741","code_links":[{"title":"serdarch/sernet-former","url":"https://github.com/serdarch/sernet-former"},{"title":"serdarch/SERNet-Former","url":"https://github.com/serdarch/SERNet-Former/blob/main/README.md"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-extended-heartseg","slug":"2d-semantic-segmentation-on-extended-heartseg","dataset":"Extended heartSeg","dataset_url":"/dataset/extended-heartseg","rows_in_archive":1,"metrics":["Average IOU"],"first_row_in_archive_order":{"model":"UNet","paper_title":"Methods for the frugal labeler: Multi-class semantic segmentation on heterogeneous labels","paper_url":"/paper/methods-for-the-frugal-labeler-multi-class","paper_date":"2022-02-08","arxiv_id":null,"code_links":[{"title":"Heterogeneous-Semantic-Segmentation/Utilities-for-The-Frugal-Labeler","url":"https://github.com/Heterogeneous-Semantic-Segmentation/Utilities-for-The-Frugal-Labeler"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-gf-pa66-3d-xct","slug":"2d-semantic-segmentation-on-gf-pa66-3d-xct","dataset":"GF-PA66 3D XCT","dataset_url":"/dataset/gf-pa66-3d-xct-composite-material-3d","rows_in_archive":1,"metrics":["Jaccard (Mean)"],"first_row_in_archive_order":{"model":"Modular U-Net (2D)","paper_title":"A modular U-Net for automated segmentation of X-ray tomography images in composite materials","paper_url":"/paper/a-modular-u-net-for-automated-segmentation-of","paper_date":"2021-07-15","arxiv_id":"2107.07468","code_links":[{"title":"joaopcbertoldo/tomo2seg","url":"https://github.com/joaopcbertoldo/tomo2seg"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-time-series","slug":"2d-semantic-segmentation-on-time-series","dataset":"Time Series Prediction Benchmarks","dataset_url":"/dataset/time-series-prediction-benchmarks","rows_in_archive":1,"metrics":["1:3 Accuracy"],"first_row_in_archive_order":{"model":"LSTM","paper_title":"(0,2) hybrid models","paper_url":null,"paper_date":"2018-07-24","arxiv_id":"1712.04976","code_links":[],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-waterscenes","slug":"2d-semantic-segmentation-on-waterscenes","dataset":"WaterScenes","dataset_url":"/dataset/waterscenes","rows_in_archive":1,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Achelous-FV-RDF-S2","paper_title":"Achelous: A Fast Unified Water-surface Panoptic Perception Framework based on Fusion of Monocular Camera and 4D mmWave Radar","paper_url":"/paper/achelous-a-fast-unified-water-surface","paper_date":"2023-07-14","arxiv_id":"2307.07102","code_links":[{"title":"GuanRunwei/Achelous","url":"https://github.com/GuanRunwei/Achelous"}],"syntology":null}},{"leaderboard":"/sota/2d-semantic-segmentation-on-worldfloods","slug":"2d-semantic-segmentation-on-worldfloods","dataset":"WorldFloods","dataset_url":"/dataset/worldfloods","rows_in_archive":1,"metrics":["Category mIoU","GMac","MParams"],"first_row_in_archive_order":{"model":"SWRNet","paper_title":"SWRNet: A Deep Learning Approach for Small Surface Water Area Recognition Onboard Satellite","paper_url":"/paper/swrnet-a-deep-learning-approach-for-small","paper_date":"2023-10-27","arxiv_id":null,"code_links":[{"title":"trongan93/swrnet","url":"https://github.com/trongan93/swrnet"}],"syntology":null}}],"datasets":[{"url":"/dataset/cityscapes","name":"Cityscapes","full_name":"","num_papers_in_archive":3702},{"url":"/dataset/kitti-360","name":"KITTI-360","full_name":"","num_papers_in_archive":246},{"url":"/dataset/camvid","name":"CamVid","full_name":"Cambridge-driving Labeled Video Database","num_papers_in_archive":227},{"url":"/dataset/rellis-3d","name":"RELLIS-3D","full_name":null,"num_papers_in_archive":57},{"url":"/dataset/xbd","name":"xBD","full_name":"","num_papers_in_archive":51},{"url":"/dataset/kitti-mots","name":"KITTI MOTS","full_name":"KITTI Multi-Object Tracking and Segmentation (MOTS) Evaluation","num_papers_in_archive":28},{"url":"/dataset/istd-1","name":"ISTD+","full_name":"","num_papers_in_archive":15},{"url":"/dataset/waterscenes","name":"WaterScenes","full_name":"","num_papers_in_archive":13},{"url":"/dataset/spacenet-7","name":"SpaceNet 7","full_name":"Multi-Temporal Urban Development SpaceNet Dataset","num_papers_in_archive":12},{"url":"/dataset/wildscenes","name":"WildScenes","full_name":"","num_papers_in_archive":12},{"url":"/dataset/cadis","name":"CaDIS","full_name":"Cataract Dataset for Image Segmentation","num_papers_in_archive":9},{"url":"/dataset/uiis-dataset","name":"UIIS","full_name":"General Underwater Image Instance Segmentation dataset","num_papers_in_archive":9},{"url":"/dataset/dttd2","name":"DTTD-Mobile","full_name":"","num_papers_in_archive":8},{"url":"/dataset/open-images-v7","name":"Open Images V7","full_name":"","num_papers_in_archive":6},{"url":"/dataset/deepsport-dataset","name":"DeepSport Dataset","full_name":"","num_papers_in_archive":5},{"url":"/dataset/brain-tumor-dataset","name":"Brain Tumor Dataset","full_name":"","num_papers_in_archive":4},{"url":"/dataset/carlane-benchmark","name":"CARLANE Benchmark","full_name":"","num_papers_in_archive":4},{"url":"/dataset/crackvision12k","name":"CrackVision12K","full_name":"","num_papers_in_archive":4},{"url":"/dataset/fes","name":"FES","full_name":"Fisheye Evaluation Suite","num_papers_in_archive":4},{"url":"/dataset/usis10k","name":"USIS10K","full_name":"Large-scale Underwater Salient Instance Segmentation Dataset","num_papers_in_archive":4},{"url":"/dataset/chexlocalize","name":"CheXlocalize","full_name":"","num_papers_in_archive":3},{"url":"/dataset/fluocells","name":"fluocells","full_name":"Fluorescent Neuronal Cells","num_papers_in_archive":3},{"url":"/dataset/pp-humanseg14k","name":"PP-HumanSeg14K","full_name":"","num_papers_in_archive":3},{"url":"/dataset/uiis10k","name":"UIIS10K","full_name":"General Underwater Image Instance Segmentation dataset 10K","num_papers_in_archive":3},{"url":"/dataset/aria-digital-twin-dataset","name":"Aria Digital Twin Dataset","full_name":"Aria Digital Twin Dataset","num_papers_in_archive":2},{"url":"/dataset/caffe","name":"CaFFe","full_name":"CAlving Fronts and where to Find thEm","num_papers_in_archive":2},{"url":"/dataset/electron-microscopy-dataset","name":"Electron Microscopy Dataset","full_name":"Electron Microscopy Dataset","num_papers_in_archive":2},{"url":"/dataset/faceocc","name":"FaceOcc","full_name":"Face Occlusion Dataset","num_papers_in_archive":2},{"url":"/dataset/fetreg-largescale-multi-centre-fetoscopy","name":"FetReg: Largescale Multi-centre Fetoscopy Placenta Dataset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/hutics","name":"HuTics","full_name":"Human Deictic Gestures Dataset","num_papers_in_archive":2},{"url":"/dataset/mmvr","name":"MMVR","full_name":"Millimeter-wave Multi-View Radar (MMVR) Dataset","num_papers_in_archive":2},{"url":"/dataset/pax-ray","name":"PAX-Ray++","full_name":"Projected Anatomy in X-Ray Dataset ++","num_papers_in_archive":2},{"url":"/dataset/raidar","name":"RaidaR","full_name":"RaidaR: A Rich Annotated Image Dataset of Rainy Street Scenes","num_papers_in_archive":2},{"url":"/dataset/rugd","name":"RUGD","full_name":"RUGD: Robot Unstructured Ground Driving","num_papers_in_archive":2},{"url":"/dataset/segrcdb","name":"SegRCDB","full_name":"","num_papers_in_archive":2},{"url":"/dataset/tbbr","name":"TBBR","full_name":"Thermal Bridges on Building Rooftops","num_papers_in_archive":2},{"url":"/dataset/u-diads-bib","name":"U-DIADS-Bib","full_name":"","num_papers_in_archive":2},{"url":"/dataset/acct-data-repository","name":"ACCT Data Repository","full_name":"ACCT is a fast and accessible automatic cell counting tool using machine learning for 2D image segmentation","num_papers_in_archive":1},{"url":"/dataset/aut-vi","name":"AUT-VI","full_name":"Amirkabir campus dataset","num_papers_in_archive":1},{"url":"/dataset/bcss","name":"BCSS","full_name":"Breast Cancer Semantic Segmentation","num_papers_in_archive":1},{"url":"/dataset/cryoppp","name":"cryoPPP","full_name":"CryoPPP: A Large Expert-Curated Cryo-EM Image Dataset for Machine Learning Protein Particle Picking","num_papers_in_archive":1},{"url":"/dataset/darai","name":"DARai","full_name":"Daily Activity Recordings for AI and ML applications","num_papers_in_archive":1},{"url":"/dataset/deep-indices","name":"Deep Indices","full_name":"multi-spectral leaf/vegetation segmentation","num_papers_in_archive":1},{"url":"/dataset/dermsynth3d","name":"DermSynth3D","full_name":"3DBodyTex.DermSynth3D","num_papers_in_archive":1},{"url":"/dataset/drivingweather","name":"Driving Weather","full_name":"","num_papers_in_archive":1},{"url":"/dataset/extended-heartseg","name":"Extended heartSeg","full_name":"","num_papers_in_archive":1},{"url":"/dataset/fics-pcb-image-collection-fpic","name":"FICS PCB Image Collection (FPIC)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/fp4s","name":"FP4S","full_name":"Floor plan image segmentation via scribble-based semi-weakly-supervised learning","num_papers_in_archive":1},{"url":"/dataset/gf-pa66-3d-xct-composite-material-3d","name":"GF-PA66 3D XCT","full_name":"Glass fiber-reinforced polyamide 66 (GF-PA66) 3D X-ray Computed Tomography (XCT))","num_papers_in_archive":1},{"url":"/dataset/gf-pa66-3d-xct-latest","name":"GF-PA66 3D XCT (latest)","full_name":"Glass fiber-reinforced polyamide 66 3D X-ray Computed Tomography","num_papers_in_archive":1},{"url":"/dataset/id-pattern-dataset","name":"Id Pattern Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/infraparis","name":"InfraParis","full_name":"","num_papers_in_archive":1},{"url":"/dataset/isod","name":"ISOD","full_name":"Indoor Small Object Dataset","num_papers_in_archive":1},{"url":"/dataset/microscopy-image-dataset-of-pulmonary","name":"Microscopy Image Dataset of Pulmonary Vascular Changes","full_name":"Microscopy Image Dataset for Deep Learning-Based Quantitative Assessment of Pulmonary Vascular Changes","num_papers_in_archive":1},{"url":"/dataset/monkey-doo","name":"monkey doo","full_name":"","num_papers_in_archive":1},{"url":"/dataset/niramai-oncho-dataset","name":"Niramai Oncho Dataset","full_name":"Niramai Onchocerciasis/RiverBlindness Dataset","num_papers_in_archive":1},{"url":"/dataset/npo","name":"NPO","full_name":"Negative and Positive Obstacles","num_papers_in_archive":1},{"url":"/dataset/nuscenes-occupancy-grids-dataset","name":"NuScenes Occupancy Grids Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/oc-cityscape","name":"OC-Cityscape","full_name":"Out-of-Context Cityscapes","num_papers_in_archive":1},{"url":"/dataset/plantseg","name":"PlantSeg","full_name":"","num_papers_in_archive":1},{"url":"/dataset/repogen","name":"RePoGen","full_name":"","num_papers_in_archive":1},{"url":"/dataset/rwanda-built-up-region-segmentation","name":"RWanda Built-up Region Segmentation","full_name":"","num_papers_in_archive":1},{"url":"/dataset/semantic-segmentation-dataset-on-earthquake","name":"Semantic segmentation dataset on earthquake damage","full_name":"","num_papers_in_archive":1},{"url":"/dataset/semantic-segmentation-vineyard-rows","name":"Semantic Segmentation Vineyard Rows","full_name":"","num_papers_in_archive":1},{"url":"/dataset/sickle","name":"SICKLE","full_name":"Satellite Imagery for Cropping annotated with Keyparameter LabEls","num_papers_in_archive":1},{"url":"/dataset/simbev","name":"SimBEV","full_name":"","num_papers_in_archive":1},{"url":"/dataset/simulated-micro-doppler-signatures","name":"Simulated micro-Doppler Signatures","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tecnalia-weee-hyperspectral-dataset","name":"Tecnalia WEEE HYPERSPECTRAL DATASET","full_name":"TECNALIA WEEE (Waste from Electrical and Electronic Equipment) HYPERSPECTRAL DATASET","num_papers_in_archive":1},{"url":"/dataset/tem-nanowire-morphologies-for-classification","name":"TEM nanowire morphologies for classification and segmentation","full_name":"Transmission electron microscopy (TEM) image datasets of peptide / protein nanowire morphologies","num_papers_in_archive":1},{"url":"/dataset/time-series-prediction-benchmarks","name":"Time Series Prediction Benchmarks","full_name":"Time Series Prediction Benchmarks","num_papers_in_archive":1},{"url":"/dataset/winsyn","name":"WinSyn","full_name":"WinSyn: A High Resolution Testbed for Synthetic Data","num_papers_in_archive":1},{"url":"/dataset/worldfloods","name":"WorldFloods","full_name":"","num_papers_in_archive":1},{"url":"/dataset/construction-vehicle-image-dataset-trucks","name":"Construction Vehicle Image Dataset |Trucks|Tractor etc.","full_name":"","num_papers_in_archive":0},{"url":"/dataset/corn-seeds-dataset","name":"Corn Seeds Dataset","full_name":"","num_papers_in_archive":0},{"url":"/dataset/elai-dust-storm","name":"ELAI-Dust Storm","full_name":"ELAI Dust Storm Dataset from MODIS","num_papers_in_archive":0},{"url":"/dataset/fallmud","name":"FALLMUD","full_name":"FAscicle Lower Leg Muscle Ultrasound Dataset","num_papers_in_archive":0},{"url":"/dataset/iitkgp-fence-dataset","name":"IITKGP_Fence Dataset","full_name":"","num_papers_in_archive":0},{"url":"/dataset/infiniterep","name":"InfiniteRep","full_name":"InfiniteRep","num_papers_in_archive":0},{"url":"/dataset/maadaa-faeco-dataset","name":"maadaa-FaEco Dataset","full_name":"maadaa.ai Fashion & e-Commerce Open Dataset","num_papers_in_archive":0},{"url":"/dataset/multi-spectral-leaf-segmentation","name":"Multi-Spectral Leaf Segmentation","full_name":"Multi-Spectral Leaf Segmentation For Crop/Weed Identification","num_papers_in_archive":0},{"url":"/dataset/wta-tla","name":"WTA/TLA","full_name":"WTA/TLA: A UAV-captured Dataset for Semantic Segmentation of Energy Infrastructure","num_papers_in_archive":0}],"subtasks":[{"url":"/task/all-day-semantic-segmentation","name":"All-day Semantic Segmentation"},{"url":"/task/building-damage-assessment","name":"Building Damage Assessment"},{"url":"/task/burned-area-delineation","name":"Burned Area Delineation"},{"url":"/task/continual-semantic-segmentation","name":"Continual Semantic Segmentation"},{"url":"/task/disjoint-10-1","name":"Disjoint 10-1"},{"url":"/task/disjoint-15-1","name":"Disjoint 15-1"},{"url":"/task/disjoint-15-5","name":"Disjoint 15-5"},{"url":"/task/foreground-segmentation","name":"Foreground Segmentation"},{"url":"/task/human-part-segmentation","name":"Human Part Segmentation"},{"url":"/task/image-segmentation","name":"Image Segmentation"},{"url":"/task/intention-oriented-segmentation","name":"Intention-oriented Segmentation"},{"url":"/task/landmark-based-segmentation","name":"Landmark-based segmentation"},{"url":"/task/material-segmentation","name":"Material Segmentation"},{"url":"/task/overlapped-15-1","name":"Overlapped 15-1"},{"url":"/task/reflection-removal","name":"Reflection Removal"},{"url":"/task/scene-parsing","name":"Scene Parsing"},{"url":"/task/text-style-transfoer","name":"Text Style Transfer"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":49,"tagged_in_all":79,"items":[{"url":"/paper/rethinking-atrous-convolution-for-semantic","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","date":"2017-06-17","arxiv_id":"1706.05587","repositories_listed":77,"syntology":{"n":7,"n_ran":3,"n_unverified":4,"n_pointer_only":3}},{"url":"/paper/segformer-simple-and-efficient-design-for","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers","date":"2021-05-31","arxiv_id":"2105.15203","repositories_listed":28,"syntology":{"n":86,"n_ran":48,"n_unverified":38,"n_pointer_only":15}},{"url":"/paper/unified-perceptual-parsing-for-scene","title":"Unified Perceptual Parsing for Scene Understanding","date":"2018-07-26","arxiv_id":"1807.10221","repositories_listed":25,"syntology":{"n":28,"n_ran":9,"n_unverified":19,"n_pointer_only":0}},{"url":"/paper/masked-attention-mask-transformer-for","title":"Masked-attention Mask Transformer for Universal Image Segmentation","date":"2021-12-02","arxiv_id":"2112.01527","repositories_listed":7,"syntology":{"n":8,"n_ran":2,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/xbd-a-dataset-for-assessing-building-damage","title":"xBD: A Dataset for Assessing Building Damage from Satellite Imagery","date":"2019-11-21","arxiv_id":"1911.09296","repositories_listed":4,"syntology":{"n":1,"n_ran":0,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/sernet-former-semantic-segmentation-by","title":"SERNet-Former: Semantic Segmentation by Efficient Residual Network with Attention-Boosting Gates and Attention-Fusion Networks","date":"2024-01-28","arxiv_id":"2401.15741","repositories_listed":2,"syntology":null},{"url":"/paper/cross-task-attention-mechanism-for-dense","title":"DenseMTL: Cross-task Attention Mechanism for Dense Multi-task Learning","date":"2022-06-17","arxiv_id":"2206.08927","repositories_listed":2,"syntology":null},{"url":"/paper/realtime-global-attention-network-for","title":"Realtime Global Attention Network for Semantic Segmentation","date":"2021-12-24","arxiv_id":"2112.12939","repositories_listed":2,"syntology":null},{"url":"/paper/novelseek-when-agent-becomes-the-scientist","title":"NovelSeek: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification","date":"2025-05-22","arxiv_id":"2505.16938","repositories_listed":1,"syntology":null},{"url":"/paper/rethinking-the-nested-u-net-approach","title":"Rethinking the Nested U-Net Approach: Enhancing Biomarker Segmentation with Attention Mechanisms and Multiscale Feature Fusion","date":"2025-04-08","arxiv_id":"2504.06158","repositories_listed":1,"syntology":null},{"url":"/paper/2d-semantic-guided-semantic-scene-completion","title":"2D Semantic-Guided Semantic Scene Completion","date":"2024-09-12","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/wavelet-convolutions-for-large-receptive","title":"Wavelet Convolutions for Large Receptive Fields","date":"2024-07-08","arxiv_id":"2407.05848","repositories_listed":1,"syntology":{"n":14,"n_ran":7,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/gasformer-a-transformer-based-architecture","title":"Gasformer: A Transformer-based Architecture for Segmenting Methane Emissions from Livestock in Optical Gas Imaging","date":"2024-04-16","arxiv_id":"2404.10841","repositories_listed":1,"syntology":null},{"url":"/paper/changemamba-remote-sensing-change-detection","title":"ChangeMamba: Remote Sensing Change Detection With Spatiotemporal State Space Model","date":"2024-04-04","arxiv_id":"2404.03425","repositories_listed":1,"syntology":{"n":9,"n_ran":5,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/mrfp-learning-generalizable-semantic","title":"MRFP: Learning Generalizable Semantic Segmentation from Sim-2-Real with Multi-Resolution Feature Perturbation","date":"2023-11-30","arxiv_id":"2311.18331","repositories_listed":1,"syntology":null},{"url":"/paper/swrnet-a-deep-learning-approach-for-small","title":"SWRNet: A Deep Learning Approach for Small Surface Water Area Recognition Onboard Satellite","date":"2023-10-27","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/achelous-a-fast-unified-water-surface","title":"Achelous: A Fast Unified Water-surface Panoptic Perception Framework based on Fusion of Monocular Camera and 4D mmWave Radar","date":"2023-07-14","arxiv_id":"2307.07102","repositories_listed":1,"syntology":null},{"url":"/paper/mci-net-multi-scale-context-integrated","title":"Mci-net: multi-scale context integrated network for liver ct image segmentation","date":"2023-05-03","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/semantic-segmentation-with-high-inference","title":"Semantic Segmentation with High Inference Speed in Off-Road Environments","date":"2023-04-10","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/utilizing-neural-networks-for-semantic","title":"Utilizing Neural Networks for Semantic Segmentation on RGB/LiDAR Fused Data for Off-road Autonomous Military Vehicle Perception","date":"2023-04-10","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/microstructural-segmentation-using-a-union-of","title":"Microstructural segmentation using a union of attention guided U-Net models with different color transformed images","date":"2023-04-07","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/sparsevit-revisiting-activation-sparsity-for","title":"SparseViT: Revisiting Activation Sparsity for Efficient High-Resolution Vision Transformer","date":"2023-03-30","arxiv_id":"2303.17605","repositories_listed":1,"syntology":null},{"url":"/paper/novel-class-discovery-for-3d-point-cloud","title":"Novel Class Discovery for 3D Point Cloud Semantic Segmentation","date":"2023-03-21","arxiv_id":"2303.11610","repositories_listed":1,"syntology":null},{"url":"/paper/canet-context-aware-network-with-dual-stream","title":"CANet: Context aware network with dual-stream pyramid for medical image segmentation","date":"2023-03-05","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/carlane-a-lane-detection-benchmark-for","title":"CARLANE: A Lane Detection Benchmark for Unsupervised Domain Adaptation from Simulation to multiple Real-World Domains","date":"2022-06-16","arxiv_id":"2206.08083","repositories_listed":1,"syntology":null},{"url":"/paper/s-textsuperscript-2-fpn-scale-ware-strip","title":"S$^2$-FPN: Scale-ware Strip Attention Guided Feature Pyramid Network for Real-time Semantic Segmentation","date":"2022-06-15","arxiv_id":"2206.07298","repositories_listed":1,"syntology":null},{"url":"/paper/covir-a-virtual-rendering-of-a-novel-nn","title":"COVIR: A virtual rendering of a novel NN architecture O-Net for COVID-19 Ct-scan automatic lung lesions segmentation","date":"2022-05-15","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/neural-3d-scene-reconstruction-with-the","title":"Neural 3D Scene Reconstruction with the Manhattan-world Assumption","date":"2022-05-05","arxiv_id":"2205.02836","repositories_listed":1,"syntology":null},{"url":"/paper/learning-3d-semantics-from-pose-noisy-2d","title":"Learning 3D Semantics from Pose-Noisy 2D Images with Hierarchical Full Attention Network","date":"2022-04-17","arxiv_id":"2204.08084","repositories_listed":1,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/float-factorized-learning-of-object","title":"FLOAT: Factorized Learning of Object Attributes for Improved Multi-object Multi-part Scene Parsing","date":"2022-03-30","arxiv_id":"2203.16168","repositories_listed":1,"syntology":null}],"syntology_records":8,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}