{"url":"/method/unetr","slug":"unetr","name":"UNETR","full_name":"UNet Transformer","full_name_withheld":false,"description_markdown":"**UNETR**, or **UNet Transformer**, is a [Transformer](https://paperswithcode.com/methods/category/transformers)-based architecture for [medical image segmentation](https://paperswithcode.com/task/medical-image-segmentation) that utilizes a pure [transformer](https://paperswithcode.com/method/transformer) as the encoder to learn sequence representations of the input volume -- effectively capturing the global multi-scale information. The transformer encoder is directly connected to a decoder via [skip connections](https://paperswithcode.com/methods/category/skip-connections) at different resolutions like a [U-Net](https://paperswithcode.com/method/u-net) to compute the final semantic segmentation output.","description_state":"present","introduced_year":null,"introduced_by":{"title":"UNETR: Transformers for 3D Medical Image Segmentation","paper":"/paper/unetr-transformers-for-3d-medical-image","first_author":"Ali Hatamizadeh","n_authors":8,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/unetr-transformers-for-3d-medical-image"},"source":{"url":"https://arxiv.org/abs/2103.10504v3","title":"UNETR: Transformers for 3D Medical Image Segmentation","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Computer Vision","area_id":"computer-vision","collection":"Medical Image Models","url":"/methods/category/medical-image-models","pwc_aliases":[]}],"n_papers_tagged":49,"archive_num_papers":49,"papers_newest_first":[{"paper":null,"title":"Physics-Guided Radiotherapy Treatment Planning with Deep Learning","date":"2025-06-23","arxiv_id":"2506.19880","n_code_links":0,"syntology":null},{"paper":null,"title":"Improving Prostate Gland Segmenting Using Transformer based Architectures","date":"2025-06-16","arxiv_id":"2506.14844","n_code_links":0,"syntology":null},{"paper":null,"title":"Efficient Parameter Adaptation for Multi-Modal Medical Image Segmentation and Prognosis","date":"2025-04-18","arxiv_id":"2504.13645","n_code_links":0,"syntology":null},{"paper":null,"title":"Uncertainty-Guided Coarse-to-Fine Tumor Segmentation with Anatomy-Aware Post-Processing","date":"2025-04-16","arxiv_id":"2504.12215","n_code_links":0,"syntology":null},{"paper":null,"title":"Multi-encoder nnU-Net outperforms Transformer models with self-supervised pretraining","date":"2025-04-04","arxiv_id":"2504.03474","n_code_links":0,"syntology":null},{"paper":null,"title":"Cross-Attention Fusion of MRI and Jacobian Maps for Alzheimer's Disease Diagnosis","date":"2025-03-01","arxiv_id":"2503.00586","n_code_links":0,"syntology":null},{"paper":null,"title":"Cancer-Net PCa-Seg: Benchmarking Deep Learning Models for Prostate Cancer Segmentation Using Synthetic Correlated Diffusion Imaging","date":"2025-01-15","arxiv_id":"2501.09185","n_code_links":0,"syntology":null},{"paper":"/paper/unetvl-enhancing-3d-medical-image","title":"UNetVL: Enhancing 3D Medical Image Segmentation with Chebyshev KAN Powered Vision-LSTM","date":"2025-01-13","arxiv_id":"2501.07017","n_code_links":1,"syntology":null},{"paper":"/paper/a-fuzzy-rank-based-ensemble-of-cnn-models-for-1","title":"A fuzzy rank-based ensemble of CNN models for MRI segmentation","date":"2024-12-28","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"title":"RADARSAT Constellation Mission Compact Polarisation SAR Data for Burned Area Mapping with Deep Learning","date":"2024-12-16","arxiv_id":"2412.11561","n_code_links":0,"syntology":null},{"paper":null,"title":"Enhancing Crop Segmentation in Satellite Image Time Series with Transformer Networks","date":"2024-12-02","arxiv_id":"2412.01944","n_code_links":0,"syntology":null},{"paper":null,"title":"SASWISE-UE: Segmentation and Synthesis with Interpretable Scalable Ensembles for Uncertainty Estimation","date":"2024-11-08","arxiv_id":"2411.05324","n_code_links":0,"syntology":null},{"paper":null,"title":"Multi-temporal crack segmentation in concrete structure using deep learning approaches","date":"2024-11-07","arxiv_id":"2411.04620","n_code_links":0,"syntology":null},{"paper":"/paper/optimizing-medical-image-segmentation-with","title":"Optimizing Medical Image Segmentation with Advanced Decoder Design","date":"2024-10-05","arxiv_id":"2410.04128","n_code_links":1,"syntology":null},{"paper":null,"title":"Going Beyond U-Net: Assessing Vision Transformers for Semantic Segmentation in Microscopy Image Analysis","date":"2024-09-25","arxiv_id":"2409.16940","n_code_links":0,"syntology":null},{"paper":"/paper/model-ensemble-for-brain-tumor-segmentation","title":"Model Ensemble for Brain Tumor Segmentation in Magnetic Resonance Imaging","date":"2024-09-12","arxiv_id":"2409.08232","n_code_links":1,"syntology":null},{"paper":null,"title":"MOSMOS: Multi-organ segmentation facilitated by medical report supervision","date":"2024-09-04","arxiv_id":"2409.02418","n_code_links":0,"syntology":null},{"paper":"/paper/2408-02761","title":"Dimensionality Reduction and Nearest Neighbors for Improving Out-of-Distribution Detection in Medical Image Segmentation","date":"2024-08-05","arxiv_id":"2408.02761","n_code_links":1,"syntology":null},{"paper":"/paper/3d-u-kan-implementation-for-multi-modal-mri","title":"UKAN-EP: Enhancing U-KAN with Efficient Attention and Pyramid Aggregation for 3D Multi-Modal MRI Brain Tumor Segmentation","date":"2024-08-01","arxiv_id":"2408.00273","n_code_links":1,"syntology":null},{"paper":"/paper/segstitch-multidimensional-transformer-for","title":"SegStitch: Multidimensional Transformer for Robust and Efficient Medical Imaging Segmentation","date":"2024-08-01","arxiv_id":"2408.00496","n_code_links":1,"syntology":null},{"paper":null,"title":"Knowledge-Guided Prompt Learning for Lifespan Brain MR Image Segmentation","date":"2024-07-31","arxiv_id":"2407.21328","n_code_links":0,"syntology":null},{"paper":"/paper/lora-pt-low-rank-adapting-unetr-for","title":"LoRA-PT: Low-Rank Adapting UNETR for Hippocampus Segmentation Using Principal Tensor Singular Values and Vectors","date":"2024-07-16","arxiv_id":"2407.11292","n_code_links":1,"syntology":null},{"paper":null,"title":"BraTS-PEDs: Results of the Multi-Consortium International Pediatric Brain Tumor Segmentation Challenge 2023","date":"2024-07-11","arxiv_id":"2407.08855","n_code_links":0,"syntology":null},{"paper":"/paper/swin-smt-global-sequential-modeling-in-3d","title":"Swin SMT: Global Sequential Modeling in 3D Medical Image Segmentation","date":"2024-07-10","arxiv_id":"2407.07514","n_code_links":1,"syntology":null},{"paper":null,"title":"Swin UNETR segmentation with automated geometry filtering for biomechanical modeling of knee joint cartilage","date":"2024-07-08","arxiv_id":"2407.06403","n_code_links":0,"syntology":null},{"paper":"/paper/repeat-and-concatenate-2d-to-3d-image","title":"Repeat and Concatenate: 2D to 3D Image Translation with 3D to 3D Generative Modeling","date":"2024-06-26","arxiv_id":"2406.18422","n_code_links":1,"syntology":null},{"paper":null,"title":"Improving ovarian cancer segmentation accuracy with transformers through AI-guided labeling","date":"2024-06-25","arxiv_id":"2406.17666","n_code_links":0,"syntology":null},{"paper":"/paper/cyclic-2-5d-perceptual-loss-for-cross-modal","title":"Cyclic 2.5D Perceptual Loss for Cross-Modal 3D Medical Image Synthesis: T1w MRI to Tau PET","date":"2024-06-18","arxiv_id":"2406.12632","n_code_links":1,"syntology":null},{"paper":"/paper/glims-attention-guided-lightweight-multi","title":"GLIMS: Attention-Guided Lightweight Multi-Scale Hybrid Network for Volumetric Semantic Segmentation","date":"2024-04-27","arxiv_id":"2404.17854","n_code_links":1,"syntology":null},{"paper":"/paper/vim-unet-vision-mamba-for-biomedical","title":"ViM-UNet: Vision Mamba for Biomedical Segmentation","date":"2024-04-11","arxiv_id":"2404.07705","n_code_links":1,"syntology":null}],"papers_shown":30,"tasks":[{"task":"/task/segmentation","name":"Segmentation","papers":27},{"task":"/task/semantic-segmentation","name":"Semantic Segmentation","papers":22},{"task":"/task/image-segmentation","name":"Image Segmentation","papers":19},{"task":"/task/medical-image-segmentation","name":"Medical Image Segmentation","papers":15},{"task":"/task/tumor-segmentation","name":"Tumor Segmentation","papers":11},{"task":"/task/brain-tumor-segmentation","name":"Brain Tumor Segmentation","papers":4},{"task":"/task/computational-efficiency","name":"Computational Efficiency","papers":4},{"task":"/task/self-supervised-learning","name":"Self-Supervised Learning","papers":4},{"task":"/task/computed-tomography-ct","name":"Computed Tomography (CT)","papers":3},{"task":"/task/decoder","name":"Decoder","papers":3},{"task":"/task/deep-learning","name":"Deep Learning","papers":3},{"task":"/task/prognosis","name":"Prognosis","papers":3},{"task":"/task/3d-semantic-segmentation","name":"3D Semantic Segmentation","papers":2},{"task":"/task/anatomy","name":"Anatomy","papers":2},{"task":"/task/brats2021","name":"BraTS2021","papers":2},{"task":"/task/contrastive-learning","name":"Contrastive Learning","papers":2},{"task":"/task/decision-making","name":"Decision Making","papers":2},{"task":"/task/denoising","name":"Denoising","papers":2},{"task":"/task/diagnostic","name":"Diagnostic","papers":2},{"task":"/task/dimensionality-reduction","name":"Dimensionality Reduction","papers":2}],"tasks_shown":20,"n_tasks":62,"usage_by_year":[{"year":"2021","papers":1},{"year":"2022","papers":5},{"year":"2023","papers":10},{"year":"2024","papers":25},{"year":"2025","papers":8}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/unetr"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}