{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/paper/frustum-pointpillars-a-multi-stage-approach","title":"Frustum-PointPillars: A Multi-Stage Approach for 3D Object Detection using RGB Camera and LiDAR","arxiv_id":null,"date":"2021-10-11","proceeding":"2021 IEEE/CVF International Conference on Computer Vision Workshops (ICCVW) 2021 10","authors":["Anshul Paigwar","David Sierra-Gonzalez","Özgür Erkent","Christian Laugier"],"abstract":"Accurate 3D object detection is a key part of the perception module for autonomous vehicles. A better understanding of the objects in 3D facilitates better decision-making and path planning. RGB Cameras and LiDAR are the most commonly used sensors in autonomous vehicles for environment perception. Many approaches have shown promising results for 2D detection with RGB Images, but efficiently localizing small objects like pedestrians in the 3D point cloud of large scenes has remained a challenging area of research. We propose a novel method, Frustum-PointPillars, for 3D object detection using LiDAR data. Instead of solely relying on point cloud features, we leverage the mature field of 2D object detection to reduce the search space in the 3D space. Then, we use the Pillar Feature Encoding network for object localization in the reduced point cloud. We also propose a novel approach for masking point clouds to further improve the localization of objects. We train our network on the KITTI dataset and perform experiments to show the effectiveness of our network. On the KITTI test set our method outperforms other multi-sensor SOTA approaches for 3D pedestrian localization (Bird’s Eye View) while achieving a significantly faster runtime of 14 Hz.","url_abs":"https://ieeexplore.ieee.org/document/9607424","url_pdf":"https://hal.archives-ouvertes.fr/hal-03354114/document","source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","row_kind":"abstracts"},"code_links":[{"paper_slug":"frustum-pointpillars-a-multi-stage-approach","repo_url":"https://github.com/MS-Mind/MS-Code-06/tree/main/pointpillars","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"mindspore","reach":null},{"paper_slug":"frustum-pointpillars-a-multi-stage-approach","repo_url":"https://github.com/anshulpaigwar/Frustum-Pointpillars","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null}],"tasks":[{"task_slug":"2d-object-detection","task_name":"2D Object Detection"},{"task_slug":"3d-object-detection","task_name":"3D Object Detection"},{"task_slug":"autonomous-vehicles","task_name":"Autonomous Vehicles"},{"task_slug":"birds-eye-view-object-detection","task_name":"Birds Eye View Object Detection"},{"task_slug":"decision-making","task_name":"Decision Making"},{"task_slug":"object","task_name":"Object"},{"task_slug":"object-detection","task_name":"Object Detection"},{"task_slug":"object-localization","task_name":"Object Localization"},{"task_slug":"object-detection-1","task_name":"object-detection"}],"methods":[],"datasets_introduced":[],"methods_introduced":[],"results":[{"leaderboard":"/sota/3d-object-detection-on-kitti-pedestrians-easy","task":"3D Object Detection","dataset":"KITTI Pedestrians Easy","model":"Frustrum-PointPillars","rank_in_archive_order":5,"of":9,"metrics":{"AP":"51.22 %"},"uses_additional_data":false},{"leaderboard":"/sota/3d-object-detection-on-kitti-pedestrians-hard","task":"3D Object Detection","dataset":"KITTI Pedestrians Hard","model":"Frustrum-PointPillars","rank_in_archive_order":7,"of":9,"metrics":{"AP":"39.28 %"},"uses_additional_data":false},{"leaderboard":"/sota/3d-object-detection-on-kitti-pedestrians","task":"3D Object Detection","dataset":"KITTI Pedestrians Moderate","model":"Frustrum-PointPillars","rank_in_archive_order":7,"of":12,"metrics":{"AP":"42.89 %"},"uses_additional_data":false},{"leaderboard":"/sota/birds-eye-view-object-detection-on-kitti-16","task":"Birds Eye View Object Detection","dataset":"KITTI Pedestrians Easy","model":"Frustrum-PointPillars","rank_in_archive_order":2,"of":2,"metrics":{"AP":"60.98 %"},"uses_additional_data":false},{"leaderboard":"/sota/birds-eye-view-object-detection-on-kitti-17","task":"Birds Eye View Object Detection","dataset":"KITTI Pedestrians Hard","model":"Frustrum-PointPillars","rank_in_archive_order":1,"of":2,"metrics":{"AP":"48.30 %"},"uses_additional_data":false},{"leaderboard":"/sota/birds-eye-view-object-detection-on-kitti-1","task":"Birds Eye View Object Detection","dataset":"KITTI Pedestrians Moderate","model":"Frustrum-PointPillars","rank_in_archive_order":1,"of":6,"metrics":{"AP":"52.23 %"},"uses_additional_data":false},{"leaderboard":"/sota/object-localization-on-kitti-pedestrian-easy","task":"Object Localization","dataset":"KITTI Pedestrian Easy","model":"Frustrum-PointPillars","rank_in_archive_order":1,"of":1,"metrics":{"AP":"60.98 %"},"uses_additional_data":false},{"leaderboard":"/sota/object-localization-on-kitti-pedestrians-hard","task":"Object Localization","dataset":"KITTI Pedestrians Hard","model":"Frustrum-PointPillars","rank_in_archive_order":1,"of":3,"metrics":{"AP":"48.30 %"},"uses_additional_data":false},{"leaderboard":"/sota/object-localization-on-kitti-pedestrians","task":"Object Localization","dataset":"KITTI Pedestrians Moderate","model":"Frustrum-PointPillars","rank_in_archive_order":1,"of":3,"metrics":{"AP":"52.23 %"},"uses_additional_data":false}],"syntology":{"syntology_url":null,"atlas_url":null,"mcp":null,"developers":"https://syntology.ai/developers"},"arxiv_metadata":null,"syntology_extracted_results":null}