{"url":"/task/multi-object-tracking-and-segmentation","name":"Multi-Object Tracking and Segmentation","slug":"multi-object-tracking-and-segmentation","description_markdown":"Multiple object tracking and segmentation requires detecting, tracking, and segmenting objects belonging to a set of given classes. \r\n\r\n(Image and definition credit: [Prototypical Cross-Attention Networks for Multiple Object Tracking and Segmentation](https://github.com/SysCV/pcan), NeurIPS 2021, Spotlight )","categories":[{"name":"Computer Vision","url":"/area/computer-vision"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":28,"papers_with_code":16,"benchmarks":2,"benchmark_tables_in_archive":2,"benchmark_tables_shown":2,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":3,"subtasks":0,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/multi-object-tracking-and-segmentation-on-3","slug":"multi-object-tracking-and-segmentation-on-3","dataset":"BDD100K val","dataset_url":"/dataset/bdd100k","rows_in_archive":8,"metrics":["mMOTSA"],"first_row_in_archive_order":{"model":"UNINEXT-H","paper_title":"Universal Instance Perception as Object Discovery and Retrieval","paper_url":"/paper/universal-instance-perception-as-object","paper_date":"2023-03-12","arxiv_id":"2303.06674","code_links":[{"title":"MasterBin-IIAU/UNINEXT","url":"https://github.com/MasterBin-IIAU/UNINEXT"}],"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/multi-object-tracking-and-segmentation-on-1","slug":"multi-object-tracking-and-segmentation-on-1","dataset":"KITTI MOTS","dataset_url":"/dataset/kitti-mots","rows_in_archive":1,"metrics":["AssA","DetA","HOTA"],"first_row_in_archive_order":{"model":"EagerMOT","paper_title":"EagerMOT: 3D Multi-Object Tracking via Sensor Fusion","paper_url":"/paper/eagermot-3d-multi-object-tracking-via-sensor","paper_date":"2021-04-29","arxiv_id":"2104.14682","code_links":[{"title":"aleksandrkim61/EagerMOT","url":"https://github.com/aleksandrkim61/EagerMOT"},{"title":"JrkJamie/eagermot_ms","url":"https://github.com/JrkJamie/eagermot_ms"},{"title":"gai-shaoyan/mind3d","url":"https://gitee.com/gai-shaoyan/mind3d"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}}],"datasets":[{"url":"/dataset/bdd100k","name":"BDD100K","full_name":"","num_papers_in_archive":469},{"url":"/dataset/kitti-mots","name":"KITTI MOTS","full_name":"KITTI Multi-Object Tracking and Segmentation (MOTS) Evaluation","num_papers_in_archive":28},{"url":"/dataset/burst","name":"BURST","full_name":"","num_papers_in_archive":18}],"subtasks":[],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":16,"of":16,"tagged_in_all":28,"items":[{"url":"/paper/bdd100k-a-diverse-driving-video-database-with","title":"BDD100K: A Diverse Driving Dataset for Heterogeneous Multitask Learning","date":"2018-05-12","arxiv_id":"1805.04687","repositories_listed":4,"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/eagermot-3d-multi-object-tracking-via-sensor","title":"EagerMOT: 3D Multi-Object Tracking via Sensor Fusion","date":"2021-04-29","arxiv_id":"2104.14682","repositories_listed":3,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/d2conv3d-dynamic-dilated-convolutions-for","title":"D2Conv3D: Dynamic Dilated Convolutions for Object Segmentation in Videos","date":"2021-11-15","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/universal-instance-perception-as-object","title":"Universal Instance Perception as Object Discovery and Retrieval","date":"2023-03-12","arxiv_id":"2303.06674","repositories_listed":1,"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/context-aware-relative-object-queries-to","title":"Context-Aware Relative Object Queries To Unify Video Instance and Panoptic Segmentation","date":"2023-01-01","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/burst-a-benchmark-for-unifying-object","title":"BURST: A Benchmark for Unifying Object Recognition, Segmentation and Tracking in Video","date":"2022-09-25","arxiv_id":"2209.12118","repositories_listed":1,"syntology":null},{"url":"/paper/multi-object-tracking-and-segmentation-via","title":"Multi-Object Tracking and Segmentation via Neural Message Passing","date":"2022-07-15","arxiv_id":"2207.07454","repositories_listed":1,"syntology":null},{"url":"/paper/towards-grand-unification-of-object-tracking","title":"Towards Grand Unification of Object Tracking","date":"2022-07-14","arxiv_id":"2207.07078","repositories_listed":1,"syntology":{"n":6,"n_ran":6,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/polytrack-tracking-with-bounding-polygons","title":"PolyTrack: Tracking with Bounding Polygons","date":"2021-11-02","arxiv_id":"2111.01606","repositories_listed":1,"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/do-different-tracking-tasks-require-different","title":"Do Different Tracking Tasks Require Different Appearance Models?","date":"2021-07-05","arxiv_id":"2107.02156","repositories_listed":1,"syntology":{"n":17,"n_ran":6,"n_unverified":11,"n_pointer_only":0}},{"url":"/paper/prototypical-cross-attention-networks-for","title":"Prototypical Cross-Attention Networks for Multiple Object Tracking and Segmentation","date":"2021-06-22","arxiv_id":"2106.11958","repositories_listed":1,"syntology":{"n":5,"n_ran":0,"n_unverified":5,"n_pointer_only":0}},{"url":"/paper/continuous-copy-paste-for-one-stage-multi","title":"Continuous Copy-Paste for One-Stage Multi-Object Tracking and Segmentation","date":"2021-01-01","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/assignment-space-based-multi-object-tracking","title":"Assignment-Space-Based Multi-Object Tracking and Segmentation","date":"2021-01-01","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/online-multi-object-tracking-and-segmentation","title":"Online Multi-Object Tracking and Segmentation with GMPHD Filter and Mask-based Affinity Fusion","date":"2020-08-31","arxiv_id":"2009.00100","repositories_listed":1,"syntology":null},{"url":"/paper/segment-as-points-for-efficient-online-multi","title":"Segment as Points for Efficient Online Multi-Object Tracking and Segmentation","date":"2020-07-03","arxiv_id":"2007.01550","repositories_listed":1,"syntology":null},{"url":"/paper/pointtrack-for-effective-online-multi-object","title":"PointTrack++ for Effective Online Multi-Object Tracking and Segmentation","date":"2020-07-03","arxiv_id":"2007.01549","repositories_listed":1,"syntology":null}],"syntology_records":7,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}