{"url":"/dataset/kitti-360","name":"KITTI-360","full_name":null,"description_markdown":"KITTI-360 is a large-scale dataset that contains rich sensory information and full annotations. It is the successor of the popular KITTI dataset,  providing more comprehensive semantic/instance labels in 2D and 3D, richer 360 degree sensory information (fisheye images and pushbroom laser scans), very accurate and geo-localized vehicle and camera poses, and a series of new challenging benchmarks.","description_withheld":null,"homepage":"http://www.cvlibs.net/datasets/kitti-360/","introduced_date":"2021-09-28","introduced_date_note":null,"introduced_by":{"paper":"/paper/kitti-360-a-novel-dataset-and-benchmarks-for","title":"KITTI-360: A Novel Dataset and Benchmarks for Urban Scene Understanding in 2D and 3D","first_author":"Yiyi Liao","url":null},"license":{"name":"All datasets and benchmarks on this page are copyright by us and published under the Creative Commons Attribution-NonCommercial-ShareAlike 3.0 License. This means that you must attribute the work in the manner specified by the authors, you may not use this work for commercial purposes and if you alter, transform, or build upon this work, you may distribute the resulting work only under the same license. Per GDPR requirements, to download and to use the data you need to register and specify the i","url":null},"modalities":[{"name":"Images","url":"/datasets/modality/images"},{"name":"LiDAR","url":"/datasets/modality/lidar"}],"tasks":[{"name":"Semantic Segmentation","url":"/task/semantic-segmentation","datasets_with_task":"/datasets/task/semantic-segmentation"},{"name":"2D Semantic Segmentation","url":"/task/2d-semantic-segmentation","datasets_with_task":"/datasets/task/2d-semantic-segmentation"},{"name":"Instance Segmentation","url":"/task/instance-segmentation","datasets_with_task":"/datasets/task/instance-segmentation"},{"name":"Panoptic Segmentation","url":"/task/panoptic-segmentation","datasets_with_task":"/datasets/task/panoptic-segmentation"},{"name":"Novel View Synthesis","url":"/task/novel-view-synthesis","datasets_with_task":"/datasets/task/novel-view-synthesis"},{"name":"3D Semantic Segmentation","url":"/task/3d-semantic-segmentation","datasets_with_task":"/datasets/task/3d-semantic-segmentation"},{"name":"3D Instance Segmentation","url":"/task/3d-instance-segmentation-1","datasets_with_task":"/datasets/task/3d-instance-segmentation-1"},{"name":"3D Semantic Scene Completion","url":"/task/3d-semantic-scene-completion","datasets_with_task":"/datasets/task/3d-semantic-scene-completion"},{"name":"3D Object Detection From Monocular Images","url":"/task/3d-object-detection-from-monocular-images","datasets_with_task":"/datasets/task/3d-object-detection-from-monocular-images"},{"name":"3D Semantic Scene Completion from a single RGB image","url":"/task/3d-semantic-scene-completion-from-a-single","datasets_with_task":"/datasets/task/3d-semantic-scene-completion-from-a-single"},{"name":"Semantic SLAM","url":"/task/semantic-slam","datasets_with_task":"/datasets/task/semantic-slam"},{"name":"Weakly Supervised 3D Detection","url":"/task/weakly-supervised-3d-detection","datasets_with_task":"/datasets/task/weakly-supervised-3d-detection"}],"languages":[],"variants":["KITTI-360"],"data_loaders":[],"num_papers_in_archive":246,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[{"leaderboard":"/sota/semantic-segmentation-on-kitti-360","task":"Semantic Segmentation","dataset_variant":"KITTI-360","rows":17,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"DiPFormer","paper":"/paper/depth-matters-exploring-deep-interactions-of","metrics":{"mIoU":"68.74"},"code_links":[]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/3d-object-detection-from-monocular-images-on-7","task":"3D Object Detection From Monocular Images","dataset_variant":"KITTI-360","rows":11,"metrics":["AP50","AP25"],"first_row_in_archive_order":{"model":"SeaBird + PanopticBEV","paper":"/paper/seabird-segmentation-in-bird-s-view-with-dice","metrics":{"AP25":"37.12","AP50":"4.64"},"code_links":[{"title":"abhi1kumar/seabird","url":"https://github.com/abhi1kumar/seabird"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/3d-semantic-segmentation-on-kitti-360","task":"3D Semantic Segmentation","dataset_variant":"KITTI-360","rows":8,"metrics":["miou","mIoU Category","miou Val","Model size"],"first_row_in_archive_order":{"model":"DeepViewAgg","paper":"/paper/learning-multi-view-aggregation-in-the-wild","metrics":{"Model size":"41.2M","mIoU Category":"73.66","miou":"58.3","miou Val":"57.8"},"code_links":[{"title":"drprojects/deepviewagg","url":"https://github.com/drprojects/deepviewagg"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/3d-semantic-scene-completion-on-kitti-360","task":"3D Semantic Scene Completion","dataset_variant":"KITTI-360","rows":7,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"Symphonies","paper":"/paper/symphonize-3d-semantic-scene-completion-with","metrics":{"mIoU":"18.58"},"code_links":[{"title":"hustvl/symphonies","url":"https://github.com/hustvl/symphonies"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/3d-semantic-scene-completion-from-a-single-2","task":"3D Semantic Scene Completion from a single RGB image","dataset_variant":"KITTI-360","rows":4,"metrics":["mIoU"],"first_row_in_archive_order":{"model":"CGFormer","paper":"/paper/context-and-geometry-aware-voxel-transformer","metrics":{"mIoU":"20.05"},"code_links":[{"title":"pkqbajng/cgformer","url":"https://github.com/pkqbajng/cgformer"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/weakly-supervised-3d-detection-on-kitti-360","task":"Weakly Supervised 3D Detection","dataset_variant":"KITTI-360","rows":3,"metrics":["mAP@0.3"],"first_row_in_archive_order":{"model":"VSRD-MonoDETR","paper":"/paper/vsrd-instance-aware-volumetric-silhouette-1","metrics":{"mAP@0.3":"58.40"},"code_links":[{"title":"skmhrk1209/VSRD","url":"https://github.com/skmhrk1209/VSRD"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/panoptic-segmentation-on-kitti-360","task":"Panoptic Segmentation","dataset_variant":"KITTI-360","rows":1,"metrics":["PQ","RQ","SQ","Params (M)"],"first_row_in_archive_order":{"model":"SuperCluster","paper":"/paper/scalable-3d-panoptic-segmentation-with","metrics":{"PQ":"48.3","Params (M)":"0.79","RQ":"58.4","SQ":"75.1"},"code_links":[{"title":"drprojects/superpoint_transformer","url":"https://github.com/drprojects/superpoint_transformer"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"}],"papers_with_a_benchmark_row":[{"paper":"/paper/hspformer-hierarchical-spatial-perception","title":"HSPFormer: Hierarchical Spatial Perception Transformer for Semantic Segmentation","date":"2025-01-16","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/cloudspam-contrastive-learning-on-unlabeled","title":"CLOUDSPAM: Contrastive Learning On Unlabeled Data for Segmentation and Pre-Training Using Aggregated Point Clouds and MoCo","date":"2024-10-26","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/depth-matters-exploring-deep-interactions-of","title":"Depth Matters: Exploring Deep Interactions of RGB-D for Semantic Segmentation in Traffic Scenes","date":"2024-09-12","rows_on_this_dataset":1,"code_links":0,"syntology":null},{"paper":"/paper/context-and-geometry-aware-voxel-transformer","title":"Context and Geometry Aware Voxel Transformer for Semantic Scene Completion","date":"2024-05-22","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":1,"samples_ran":1,"samples_unverified":0,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/vsrd-instance-aware-volumetric-silhouette-1","title":"VSRD: Instance-Aware Volumetric Silhouette Rendering for Weakly Supervised 3D Object Detection","date":"2024-03-29","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":1,"samples_ran":0,"samples_unverified":1,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/seabird-segmentation-in-bird-s-view-with-dice","title":"SeaBird: Segmentation in Bird's View with Dice Loss Improves Monocular 3D Detection of Large Objects","date":"2024-03-29","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/scalable-3d-panoptic-segmentation-with","title":"Scalable 3D Panoptic Segmentation As Superpoint Graph Clustering","date":"2024-01-12","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/symphonize-3d-semantic-scene-completion-with","title":"Symphonize 3D Semantic Scene Completion with Contextual Instance Queries","date":"2023-06-27","rows_on_this_dataset":2,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":8,"samples_ran":1,"samples_unverified":7,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/efficient-3d-semantic-segmentation-with-1","title":"Efficient 3D Semantic Segmentation with Superpoint Transformer","date":"2023-06-13","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/occformer-dual-path-transformer-for-vision","title":"OccFormer: Dual-path Transformer for Vision-based 3D Semantic Occupancy Prediction","date":"2023-04-11","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":3,"samples_ran":1,"samples_unverified":2,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/delivering-arbitrary-modal-semantic","title":"Delivering Arbitrary-Modal Semantic Segmentation","date":"2023-03-02","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":7,"samples_ran":6,"samples_unverified":1,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/voxformer-sparse-voxel-transformer-for-camera","title":"VoxFormer: Sparse Voxel Transformer for Camera-based 3D Semantic Scene Completion","date":"2023-02-23","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/tri-perspective-view-for-vision-based-3d","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","date":"2023-02-15","rows_on_this_dataset":1,"code_links":3,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":4,"samples_ran":3,"samples_unverified":1,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/omni3d-a-large-benchmark-and-model-for-3d","title":"Omni3D: A Large Benchmark and Model for 3D Object Detection in the Wild","date":"2022-07-21","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/deviant-depth-equivariant-network-for","title":"DEVIANT: Depth EquiVarIAnt NeTwork for Monocular 3D Object Detection","date":"2022-07-21","rows_on_this_dataset":1,"code_links":2,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":15,"samples_ran":9,"samples_unverified":6,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/hrfuser-a-multi-resolution-sensor-fusion","title":"HRFuser: A Multi-resolution Sensor Fusion Architecture for 2D Object Detection","date":"2022-06-30","rows_on_this_dataset":3,"code_links":1,"syntology":null},{"paper":"/paper/multimodal-token-fusion-for-vision","title":"Multimodal Token Fusion for Vision Transformers","date":"2022-04-19","rows_on_this_dataset":2,"code_links":11,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":3,"samples_ran":1,"samples_unverified":2,"pointer_only_for_licence":1,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/learning-multi-view-aggregation-in-the-wild","title":"Learning Multi-View Aggregation In the Wild for Large-Scale 3D Semantic Segmentation","date":"2022-04-15","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/monodetr-depth-aware-transformer-for","title":"MonoDETR: Depth-guided Transformer for Monocular 3D Object Detection","date":"2022-03-24","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/monodtr-monocular-3d-object-detection-with","title":"MonoDTR: Monocular 3D Object Detection with Depth-Aware Transformer","date":"2022-03-21","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":8,"samples_ran":3,"samples_unverified":5,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/weakm3d-towards-weakly-supervised-monocular-1","title":"WeakM3D: Towards Weakly Supervised Monocular 3D Object Detection","date":"2022-03-16","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":3,"samples_ran":2,"samples_unverified":1,"pointer_only_for_licence":3,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/cmx-cross-modal-fusion-for-rgb-x-semantic","title":"CMX: Cross-Modal Fusion for RGB-X Semantic Segmentation with Transformers","date":"2022-03-09","rows_on_this_dataset":2,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":2,"samples_ran":2,"samples_unverified":0,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/glass-segmentation-using-intensity-and","title":"Glass Segmentation Using Intensity and Spectral Polarization Cues","date":"2022-01-01","rows_on_this_dataset":1,"code_links":0,"syntology":null},{"paper":"/paper/monoscene-monocular-3d-semantic-scene","title":"MonoScene: Monocular 3D Semantic Scene Completion","date":"2021-12-01","rows_on_this_dataset":2,"code_links":2,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":6,"samples_ran":3,"samples_unverified":3,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/geometry-uncertainty-projection-network-for","title":"Geometry Uncertainty Projection Network for Monocular 3D Object Detection","date":"2021-07-29","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":21,"samples_ran":8,"samples_unverified":13,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/perception-aware-multi-sensor-fusion-for-3d","title":"EPMF: Efficient Perception-aware Multi-sensor Fusion for 3D Semantic Segmentation","date":"2021-06-21","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/multi-modal-fusion-transformer-for-end-to-end","title":"Multi-Modal Fusion Transformer for End-to-End Autonomous Driving","date":"2021-04-19","rows_on_this_dataset":1,"code_links":2,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":15,"samples_ran":9,"samples_unverified":6,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/groomed-nms-grouped-mathematically","title":"GrooMeD-NMS: Grouped Mathematically Differentiable NMS for Monocular 3D Object Detection","date":"2021-03-31","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":7,"samples_ran":5,"samples_unverified":2,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/delving-into-localization-errors-for","title":"Delving into Localization Errors for Monocular 3D Object Detection","date":"2021-03-30","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":1,"samples_ran":1,"samples_unverified":0,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/lmscnet-lightweight-multiscale-3d-semantic","title":"LMSCNet: Lightweight Multiscale 3D Semantic Completion","date":"2020-08-24","rows_on_this_dataset":1,"code_links":3,"syntology":null},{"paper":"/paper/issafe-improving-semantic-segmentation-in","title":"ISSAFE: Improving Semantic Segmentation in Accidents by Fusing Event-based Data","date":"2020-08-20","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/autolabeling-3d-objects-with-differentiable","title":"Autolabeling 3D Objects with Differentiable Rendering of SDF Shape Priors","date":"2019-11-26","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":7,"samples_ran":2,"samples_unverified":5,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/acnet-attention-based-network-to-exploit","title":"ACNet: Attention Based Network to Exploit Complementary Features for RGBD Semantic Segmentation","date":"2019-05-24","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/deep-hough-voting-for-3d-object-detection-in","title":"Deep Hough Voting for 3D Object Detection in Point Clouds","date":"2019-04-21","rows_on_this_dataset":2,"code_links":13,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":10,"samples_ran":2,"samples_unverified":8,"pointer_only_for_licence":10,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/pointnet-deep-hierarchical-feature-learning","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","date":"2017-06-07","rows_on_this_dataset":1,"code_links":68,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":67,"samples_ran":36,"samples_unverified":31,"pointer_only_for_licence":26,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/pointnet-deep-learning-on-point-sets-for-3d","title":"PointNet: Deep Learning on Point Sets for 3D Classification and Segmentation","date":"2016-12-02","rows_on_this_dataset":1,"code_links":110,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":164,"samples_ran":89,"samples_unverified":75,"pointer_only_for_licence":90,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/semantic-scene-completion-from-a-single-depth","title":"Semantic Scene Completion from a Single Depth Image","date":"2016-11-28","rows_on_this_dataset":1,"code_links":3,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":1,"samples_ran":1,"samples_unverified":0,"pointer_only_for_licence":1,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}}],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":21,"samples_harvested":354,"samples_ran":185,"samples_unverified":169,"pointer_only_for_licence":131,"papers_with_no_sample_that_ran":1,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}