{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/normalize-bbox","entry":"normalize_bbox","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":23,"n_papers_ran":19,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":11,"n_samples_ran":7,"n_samples_fingerprinted":3,"n_places":24,"n_places_pointer_only":6,"by_status":{"ran_honours":0,"ran_violates":1,"ran_draft_wrong":0,"ran_fixture":1,"ran":5,"unverified":4},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2503.16013","paper":"/paper/graspcot-integrating-physical-property","title":"GraspCoT: Integrating Physical Property Reasoning for 6-DoF Grasping under Flexible Language Instructions","date":"2025-03-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cxmomo/GraspCoT","path":"llava/model/hungarian_assigner_3d.py","file_url":"https://github.com/cxmomo/GraspCoT/blob/HEAD/llava/model/hungarian_assigner_3d.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"86069c4dc82688fe","mcp_get_code":{"code_sha256":"86069c4dc82688fe"}},{"arxiv_id":"2408.15045","paper":"/paper/doclayllm-an-efficient-and-effective-multi","title":"DocLayLLM: An Efficient and Effective Multi-modal Extension of Large Language Models for Text-rich Document Understanding","date":"2024-08-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"whlscut/DocLayLLM","path":"infer_demo.py","file_url":"https://github.com/whlscut/DocLayLLM/blob/HEAD/infer_demo.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"well_formed","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"7bc6ae7862fba86d","mcp_get_code":{"code_sha256":"7bc6ae7862fba86d"}},{"arxiv_id":"2407.16955","paper":"/paper/dvpe-divided-view-position-embedding-for","title":"DVPE: Divided View Position Embedding for Multi-View 3D Object Detection","date":"2024-07-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"dop0/DVPE","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/dop0/DVPE/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a18ca9ff1a1b82c8","mcp_get_code":{"code_sha256":"a18ca9ff1a1b82c8"}},{"arxiv_id":"2407.10876","paper":"/paper/repvf-a-unified-vector-fields-representation","title":"RepVF: A Unified Vector Fields Representation for Multi-task 3D Perception","date":"2024-07-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jbji/RepVF","path":"plugins/core/bbox/util.py","file_url":"https://github.com/jbji/RepVF/blob/HEAD/plugins/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"8800486c70b30b88","mcp_get_code":{"code_sha256":"8800486c70b30b88"}},{"arxiv_id":"2407.10753","paper":"/paper/open-object-wise-position-embedding-for-multi","title":"OPEN: Object-wise Position Embedding for Multi-view 3D Object Detection","date":"2024-07-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"AlmoonYsl/OPEN","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/AlmoonYsl/OPEN/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a18ca9ff1a1b82c8","mcp_get_code":{"code_sha256":"a18ca9ff1a1b82c8"}},{"arxiv_id":"2407.06904","paper":"/paper/hypergraph-based-understanding-for-document","title":"Hypergraph based Understanding for Document Semantic Entity Recognition","date":"2024-07-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Line-Kite/HGALayoutLM","path":"utils/image_utils.py","file_url":"https://github.com/Line-Kite/HGALayoutLM/blob/HEAD/utils/image_utils.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"c23469a99394f25f","mcp_get_code":{"code_sha256":"c23469a99394f25f"}},{"arxiv_id":"2403.06093","paper":"/paper/enhancing-3d-object-detection-with-2d","title":"Enhancing 3D Object Detection with 2D Detection-Guided Query Anchors","date":"2024-03-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"nullmax-vision/QAF2D","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/nullmax-vision/QAF2D/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a18ca9ff1a1b82c8","mcp_get_code":{"code_sha256":"a18ca9ff1a1b82c8"}},{"arxiv_id":"2402.03634","paper":"/paper/beam-beta-distribution-ray-denoising-for","title":"Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection","date":"2024-02-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"liewfeng/beam","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/liewfeng/beam/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"a18ca9ff1a1b82c8","mcp_get_code":{"code_sha256":"a18ca9ff1a1b82c8"}},{"arxiv_id":"2401.11174","paper":"/paper/pixel-wise-recognition-for-holistic-surgical","title":"Pixel-Wise Recognition for Holistic Surgical Scene Understanding","date":"2024-01-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"bcv-uniandes/tapir","path":"slowfast/evaluate/convert_coco_anns_to_our_method.py","file_url":"https://github.com/bcv-uniandes/tapir/blob/HEAD/slowfast/evaluate/convert_coco_anns_to_our_method.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"829565bab809c0f8","mcp_get_code":{"code_sha256":"829565bab809c0f8"}},{"arxiv_id":"2312.14135","paper":"/paper/textit-v-guided-visual-search-as-a-core","title":"V*: Guided Visual Search as a Core Mechanism in Multimodal LLMs","date":"2023-12-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"penghao-wu/vstar","path":"vstar_bench_eval.py","file_url":"https://github.com/penghao-wu/vstar/blob/HEAD/vstar_bench_eval.py","status":"ran_violates","verification_level":1,"contract_check":"VIOLATES","metamorphic_tier":"well_formed","behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e900944d5f5029a3","mcp_get_code":{"code_sha256":"e900944d5f5029a3"}},{"arxiv_id":"2312.12144","paper":"/paper/m-bev-masked-bev-perception-for-robust","title":"M-BEV: Masked BEV Perception for Robust Autonomous Driving","date":"2023-12-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"sranc3/m-bev","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/sranc3/m-bev/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2309.14516","paper":"/paper/unibev-multi-modal-3d-object-detection-with","title":"UniBEV: Multi-modal 3D Object Detection with Uniform BEV Encoders for Robustness against Missing Sensor Modalities","date":"2023-09-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tudelft-iv/unibev","path":"projects/UniBEV/unibev_plugin/core/bbox/util.py","file_url":"https://github.com/tudelft-iv/unibev/blob/HEAD/projects/UniBEV/unibev_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2308.09616","paper":"/paper/far3d-expanding-the-horizon-for-surround-view","title":"Far3D: Expanding the Horizon for Surround-view 3D Object Detection","date":"2023-08-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"megvii-research/far3d","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/megvii-research/far3d/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"a18ca9ff1a1b82c8","mcp_get_code":{"code_sha256":"a18ca9ff1a1b82c8"}},{"arxiv_id":"2306.14289","paper":"/paper/faster-segment-anything-towards-lightweight","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","date":"2023-06-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ksugar/samapi","path":"src/samapi/utils.py","file_url":"https://github.com/ksugar/samapi/blob/HEAD/src/samapi/utils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"286aec4466101609","mcp_get_code":{"code_sha256":"286aec4466101609"}},{"arxiv_id":"2306.00526","paper":"/paper/layout-and-task-aware-instruction-prompt-for","title":"Layout and Task Aware Instruction Prompt for Zero-shot Document Image Question Answering","date":"2023-06-01","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"wenjinw/latin-prompt","path":"utils/docvqa.py","file_url":"https://github.com/wenjinw/latin-prompt/blob/HEAD/utils/docvqa.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"c23469a99394f25f","mcp_get_code":{"code_sha256":"c23469a99394f25f"}},{"arxiv_id":"2305.01938","paper":"/paper/doc2soargraph-discrete-reasoning-over","title":"Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical Graphs","date":"2023-05-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"fengbinzhu/doc2soargraph","path":"etr/model/layout_model.py","file_url":"https://github.com/fengbinzhu/doc2soargraph/blob/HEAD/etr/model/layout_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b97f0283fababae5","mcp_get_code":{"code_sha256":"b97f0283fababae5"}},{"arxiv_id":"2304.01054","paper":"/paper/voxelformer-bird-s-eye-view-feature","title":"VoxelFormer: Bird's-Eye-View Feature Generation based on Dual-view Attention for Multi-view 3D Object Detection","date":"2023-04-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lizhuoling/voxelformer-public","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/lizhuoling/voxelformer-public/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2303.16818","paper":"/paper/bevsimdet-simulated-multi-modal-distillation","title":"SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection","date":"2023-03-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"vitae-transformer/bevsimdet","path":"mmdet3d/core/bbox/util.py","file_url":"https://github.com/vitae-transformer/bevsimdet/blob/HEAD/mmdet3d/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2206.15398","paper":"/paper/polarformer-multi-camera-3d-object-detection","title":"PolarFormer: Multi-camera 3D Object Detection with Polar Transformer","date":"2022-06-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"fudan-zvg/polarformer","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/fudan-zvg/polarformer/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"8fda704fb3d1af09","mcp_get_code":{"code_sha256":"8fda704fb3d1af09"}},{"arxiv_id":"2205.13542","paper":"/paper/bevfusion-multi-task-multi-sensor-fusion-with","title":"BEVFusion: Multi-Task Multi-Sensor Fusion with Unified Bird's-Eye View Representation","date":"2022-05-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mit-han-lab/bevfusion","path":"mmdet3d/core/bbox/util.py","file_url":"https://github.com/mit-han-lab/bevfusion/blob/HEAD/mmdet3d/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2203.10642","paper":"/paper/futr3d-a-unified-sensor-fusion-framework-for","title":"FUTR3D: A Unified Sensor Fusion Framework for 3D Detection","date":"2022-03-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tsinghua-mars-lab/futr3d","path":"plugin/futr3d/core/bbox/utils.py","file_url":"https://github.com/tsinghua-mars-lab/futr3d/blob/HEAD/plugin/futr3d/core/bbox/utils.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"8800486c70b30b88","mcp_get_code":{"code_sha256":"8800486c70b30b88"}},{"arxiv_id":"2203.10642","paper":"/paper/futr3d-a-unified-sensor-fusion-framework-for","title":"FUTR3D: A Unified Sensor Fusion Framework for 3D Detection","date":"2022-03-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"xiaohao-xu/unified-pretrain-ad","path":"mmdet3d/core/bbox/util.py","file_url":"https://github.com/xiaohao-xu/unified-pretrain-ad/blob/HEAD/mmdet3d/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"2110.06923","paper":"/paper/object-dgcnn-3d-object-detection-using","title":"Object DGCNN: 3D Object Detection using Dynamic Graphs","date":"2021-10-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"wangyueft/detr3d","path":"projects/mmdet3d_plugin/core/bbox/util.py","file_url":"https://github.com/wangyueft/detr3d/blob/HEAD/projects/mmdet3d_plugin/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}},{"arxiv_id":"aaai_28577","paper":null,"title":"arXiv:aaai_28577","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"ViTAE-Transformer/SimDistill","path":"mmdet3d/core/bbox/util.py","file_url":"https://github.com/ViTAE-Transformer/SimDistill/blob/HEAD/mmdet3d/core/bbox/util.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e6ab81c2ff932920","mcp_get_code":{"code_sha256":"e6ab81c2ff932920"}}]}