{"url":"/task/visual-place-recognition","name":"Visual Place Recognition","slug":"visual-place-recognition","description_markdown":"**Visual Place Recognition** is the task of matching a view of a place with a different view of the same place taken at a different time.\r\n\r\n<span class=\"description-source\">Source: [Visual place recognition using landmark distribution descriptors ](https://arxiv.org/abs/1608.04274)</span>\r\n\r\nImage credit: [Visual place recognition using landmark distribution descriptors](https://arxiv.org/pdf/1608.04274.pdf)","categories":[{"name":"Computer Vision","url":"/area/computer-vision"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":297,"papers_with_code":141,"benchmarks":40,"benchmark_tables_in_archive":40,"benchmark_tables_shown":40,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":28,"subtasks":3,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/visual-place-recognition-on-pittsburgh-30k","slug":"visual-place-recognition-on-pittsburgh-30k","dataset":"Pittsburgh-30k-test","dataset_url":null,"rows_in_archive":22,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"Pair-VPR-p","paper_title":"Pair-VPR: Place-Aware Pre-training and Contrastive Pair Classification for Visual Place Recognition with Vision Transformers","paper_url":"/paper/pair-vpr-place-aware-pre-training-and","paper_date":"2024-10-09","arxiv_id":"2410.06614","code_links":[{"title":"csiro-robotics/Pair-VPR","url":"https://github.com/csiro-robotics/Pair-VPR"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-mapillary-val","slug":"visual-place-recognition-on-mapillary-val","dataset":"Mapillary val","dataset_url":"/dataset/mapillary-vistas-dataset","rows_in_archive":18,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-st-lucia","slug":"visual-place-recognition-on-st-lucia","dataset":"St Lucia","dataset_url":null,"rows_in_archive":14,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"EffoVPR","paper_title":"EffoVPR: Effective Foundation Model Utilization for Visual Place Recognition","paper_url":"/paper/effovpr-effective-foundation-model","paper_date":"2024-05-28","arxiv_id":"2405.18065","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-tokyo247","slug":"visual-place-recognition-on-tokyo247","dataset":"Tokyo247","dataset_url":null,"rows_in_archive":14,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"Pair-VPR-p","paper_title":"Pair-VPR: Place-Aware Pre-training and Contrastive Pair Classification for Visual Place Recognition with Vision Transformers","paper_url":"/paper/pair-vpr-place-aware-pre-training-and","paper_date":"2024-10-09","arxiv_id":"2410.06614","code_links":[{"title":"csiro-robotics/Pair-VPR","url":"https://github.com/csiro-robotics/Pair-VPR"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-nordland","slug":"visual-place-recognition-on-nordland","dataset":"Nordland","dataset_url":"/dataset/nordland","rows_in_archive":13,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-pittsburgh-250k","slug":"visual-place-recognition-on-pittsburgh-250k","dataset":"Pittsburgh-250k-test","dataset_url":null,"rows_in_archive":13,"metrics":["Recall@1","Recall@10","Recall@5"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-mapillary-test","slug":"visual-place-recognition-on-mapillary-test","dataset":"Mapillary test","dataset_url":null,"rows_in_archive":12,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-17-places","slug":"visual-place-recognition-on-17-places","dataset":"17 Places","dataset_url":null,"rows_in_archive":8,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"SegVLAD-FineT (M)","paper_title":"Revisit Anything: Visual Place Recognition via Image Segment Retrieval","paper_url":"/paper/revisit-anything-visual-place-recognition-via","paper_date":"2024-09-26","arxiv_id":"2409.18049","code_links":[{"title":"anyloc/revisit-anything","url":"https://github.com/anyloc/revisit-anything"}],"syntology":{"n":9,"n_ran":6,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-amstertime","slug":"visual-place-recognition-on-amstertime","dataset":"AmsterTime","dataset_url":"/dataset/amstertime","rows_in_archive":8,"metrics":["Recall@1","Recall@10","Recall@5"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-baidu-mall","slug":"visual-place-recognition-on-baidu-mall","dataset":"Baidu Mall","dataset_url":null,"rows_in_archive":8,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"SegVLAD-PreT (M)","paper_title":"Revisit Anything: Visual Place Recognition via Image Segment Retrieval","paper_url":"/paper/revisit-anything-visual-place-recognition-via","paper_date":"2024-09-26","arxiv_id":"2409.18049","code_links":[{"title":"anyloc/revisit-anything","url":"https://github.com/anyloc/revisit-anything"}],"syntology":{"n":9,"n_ran":6,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-nardo-air-r","slug":"visual-place-recognition-on-nardo-air-r","dataset":"Nardo-Air R","dataset_url":null,"rows_in_archive":8,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINO","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-eynsham","slug":"visual-place-recognition-on-eynsham","dataset":"Eynsham","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1","Recall@10","Recall@5"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-gardens-point","slug":"visual-place-recognition-on-gardens-point","dataset":"Gardens Point","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-hawkins","slug":"visual-place-recognition-on-hawkins","dataset":"Hawkins","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-laurel-caverns","slug":"visual-place-recognition-on-laurel-caverns","dataset":"Laurel Caverns","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-mid-atlantic","slug":"visual-place-recognition-on-mid-atlantic","dataset":"Mid-Atlantic Ridge","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-nardo-air","slug":"visual-place-recognition-on-nardo-air","dataset":"Nardo-Air","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-oxford-robotcar-4","slug":"visual-place-recognition-on-oxford-robotcar-4","dataset":"Oxford RobotCar Dataset","dataset_url":"/dataset/oxford-robotcar-dataset","rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-sped","slug":"visual-place-recognition-on-sped","dataset":"SPED","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"BoQ","paper_title":"BoQ: A Place is Worth a Bag of Learnable Queries","paper_url":"/paper/boq-a-place-is-worth-a-bag-of-learnable","paper_date":"2024-05-12","arxiv_id":"2405.07364","code_links":[{"title":"amaralibey/bag-of-queries","url":"https://github.com/amaralibey/bag-of-queries"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-vp-air","slug":"visual-place-recognition-on-vp-air","dataset":"VP-Air","dataset_url":null,"rows_in_archive":7,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"AnyLoc-VLAD-DINOv2","paper_title":"AnyLoc: Towards Universal Visual Place Recognition","paper_url":"/paper/anyloc-towards-universal-visual-place","paper_date":"2023-08-01","arxiv_id":"2308.00688","code_links":[{"title":"AnyLoc/AnyLoc","url":"https://github.com/AnyLoc/AnyLoc"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-kitti360pose","slug":"visual-place-recognition-on-kitti360pose","dataset":"KITTI360pose","dataset_url":"/dataset/kitti360pose","rows_in_archive":5,"metrics":["Localization Recall@1 "],"first_row_in_archive_order":{"model":"MambaPlace","paper_title":"MambaPlace:Text-to-Point-Cloud Cross-Modal Place Recognition with Attention Mamba Mechanisms","paper_url":"/paper/mambaplace-text-to-point-cloud-cross-modal","paper_date":"2024-08-28","arxiv_id":"2408.15740","code_links":[{"title":"CV4RA/MambaPlace","url":"https://github.com/CV4RA/MambaPlace"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-sf-xl-test-v1","slug":"visual-place-recognition-on-sf-xl-test-v1","dataset":"SF-XL test v1","dataset_url":"/dataset/sf-xl-test-v1","rows_in_archive":5,"metrics":["Recall@1","Recall@10","Recall@5"],"first_row_in_archive_order":{"model":"EffoVPR","paper_title":"EffoVPR: Effective Foundation Model Utilization for Visual Place Recognition","paper_url":"/paper/effovpr-effective-foundation-model","paper_date":"2024-05-28","arxiv_id":"2405.18065","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-sf-xl-test-v2","slug":"visual-place-recognition-on-sf-xl-test-v2","dataset":"SF-XL test v2","dataset_url":"/dataset/sf-xl-test-v2","rows_in_archive":5,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-berlin-kudamm","slug":"visual-place-recognition-on-berlin-kudamm","dataset":"Berlin Kudamm","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"HEAPUtil","paper_title":"A Hierarchical Dual Model of Environment- and Place-Specific Utility for Visual Place Recognition","paper_url":"/paper/a-hierarchical-dual-model-of-environment-and","paper_date":"2021-07-06","arxiv_id":"2107.02440","code_links":[{"title":"Nik-V9/HEAPUtil","url":"https://github.com/Nik-V9/HEAPUtil"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-nordland-2760","slug":"visual-place-recognition-on-nordland-2760","dataset":"Nordland* (2760 queries)","dataset_url":"/dataset/nordland-2760-queries","rows_in_archive":4,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-svox-night","slug":"visual-place-recognition-on-svox-night","dataset":"SVOX-Night","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-svox-overcast","slug":"visual-place-recognition-on-svox-overcast","dataset":"SVOX-Overcast","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-svox-rain","slug":"visual-place-recognition-on-svox-rain","dataset":"SVOX-Rain","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"QAA-DINOv2-B-8192","paper_title":"Query-Based Adaptive Aggregation for Multi-Dataset Joint Training Toward Universal Visual Place Recognition","paper_url":"/paper/query-based-adaptive-aggregation-for-multi","paper_date":"2025-07-04","arxiv_id":"2507.03831","code_links":[],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-svox-snow","slug":"visual-place-recognition-on-svox-snow","dataset":"SVOX-Snow","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-svox-sun","slug":"visual-place-recognition-on-svox-sun","dataset":"SVOX-Sun","dataset_url":null,"rows_in_archive":4,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-cv-cities","slug":"visual-place-recognition-on-cv-cities","dataset":"CV-Cities","dataset_url":"/dataset/cv-cities","rows_in_archive":3,"metrics":["Recall@1","Recall@5"],"first_row_in_archive_order":{"model":"CV-Cities","paper_title":"CV-Cities: Advancing Cross-View Geo-Localization in Global Cities","paper_url":"/paper/cv-cities-advancing-cross-view-geo","paper_date":"2024-11-19","arxiv_id":"2411.12431","code_links":[{"title":"gaoshuang98/cvcities","url":"https://github.com/gaoshuang98/cvcities"}],"syntology":{"n":9,"n_ran":0,"n_unverified":9,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-msls","slug":"visual-place-recognition-on-msls","dataset":"MSLS","dataset_url":"/dataset/msls","rows_in_archive":3,"metrics":["Recall@1","Recall@5"],"first_row_in_archive_order":{"model":"ProGEO","paper_title":"ProGEO: Generating Prompts through Image-Text Contrastive Learning for Visual Geo-localization","paper_url":"/paper/progeo-generating-prompts-through-image-text","paper_date":"2024-06-04","arxiv_id":"2406.01906","code_links":[{"title":"chain-mao/progeo","url":"https://github.com/chain-mao/progeo"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-oxford-robotcar-1","slug":"visual-place-recognition-on-oxford-robotcar-1","dataset":"Oxford RobotCar (LiDAR 4096 points+RGB)","dataset_url":null,"rows_in_archive":3,"metrics":["recall@top1","recall@top1%"],"first_row_in_archive_order":{"model":"MinkLoc++ (LiDAR+RGB)","paper_title":"MinkLoc++: Lidar and Monocular Image Fusion for Place Recognition","paper_url":"/paper/minkloc-lidar-and-monocular-image-fusion-for","paper_date":"2021-04-12","arxiv_id":"2104.05327","code_links":[{"title":"jac99/MinkLocMultimodal","url":"https://github.com/jac99/MinkLocMultimodal"}],"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-san-francisco","slug":"visual-place-recognition-on-san-francisco","dataset":"San Francisco Landmark Dataset","dataset_url":"/dataset/san-francisco-landmark-dataset","rows_in_archive":3,"metrics":["Recall@1","Recall@10","Recall@5"],"first_row_in_archive_order":{"model":"BoQ","paper_title":"BoQ: A Place is Worth a Bag of Learnable Queries","paper_url":"/paper/boq-a-place-is-worth-a-bag-of-learnable","paper_date":"2024-05-12","arxiv_id":"2405.07364","code_links":[{"title":"amaralibey/bag-of-queries","url":"https://github.com/amaralibey/bag-of-queries"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-sf-xl-night","slug":"visual-place-recognition-on-sf-xl-night","dataset":"SF-XL Night","dataset_url":"/dataset/sf-xl-night","rows_in_archive":2,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-sf-xl-occlusion","slug":"visual-place-recognition-on-sf-xl-occlusion","dataset":"SF-XL Occlusion","dataset_url":"/dataset/sf-xl-occlusion","rows_in_archive":2,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-svox","slug":"visual-place-recognition-on-svox","dataset":"SVOX","dataset_url":"/dataset/svox","rows_in_archive":2,"metrics":["Recall@1","Recall@5","Recall@10"],"first_row_in_archive_order":{"model":"FoL","paper_title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","paper_url":"/paper/focus-on-local-finding-reliable-1","paper_date":"2025-04-14","arxiv_id":"2504.09881","code_links":[{"title":"chenshunpeng/FoL","url":"https://github.com/chenshunpeng/FoL"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-inside-out","slug":"visual-place-recognition-on-inside-out","dataset":"Inside Out","dataset_url":null,"rows_in_archive":1,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"SegVLAD-FineT (M)","paper_title":"Revisit Anything: Visual Place Recognition via Image Segment Retrieval","paper_url":"/paper/revisit-anything-visual-place-recognition-via","paper_date":"2024-09-26","arxiv_id":"2409.18049","code_links":[{"title":"anyloc/revisit-anything","url":"https://github.com/anyloc/revisit-anything"}],"syntology":{"n":9,"n_ran":6,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/visual-place-recognition-on-kitti","slug":"visual-place-recognition-on-kitti","dataset":"KITTI","dataset_url":"/dataset/kitti","rows_in_archive":1,"metrics":["Average F1"],"first_row_in_archive_order":{"model":"None","paper_title":"SSC: Semantic Scan Context for Large-Scale Place Recognition","paper_url":"/paper/ssc-semantic-scan-context-for-large-scale","paper_date":"2021-07-01","arxiv_id":"2107.00382","code_links":[{"title":"lilin-hitcrt/SSC","url":"https://github.com/lilin-hitcrt/SSC"}],"syntology":null}},{"leaderboard":"/sota/visual-place-recognition-on-vp-air-1","slug":"visual-place-recognition-on-vp-air-1","dataset":"VP Air","dataset_url":null,"rows_in_archive":1,"metrics":["Recall@1"],"first_row_in_archive_order":{"model":"SegVLAD-PreT (M)","paper_title":"Revisit Anything: Visual Place Recognition via Image Segment Retrieval","paper_url":"/paper/revisit-anything-visual-place-recognition-via","paper_date":"2024-09-26","arxiv_id":"2409.18049","code_links":[{"title":"anyloc/revisit-anything","url":"https://github.com/anyloc/revisit-anything"}],"syntology":{"n":9,"n_ran":6,"n_unverified":3,"n_pointer_only":0}}}],"datasets":[{"url":"/dataset/kitti","name":"KITTI","full_name":"","num_papers_in_archive":3661},{"url":"/dataset/nclt","name":"NCLT","full_name":"North Campus Long-Term Vision and LiDAR","num_papers_in_archive":124},{"url":"/dataset/mapillary-vistas-dataset","name":"Mapillary Vistas Dataset","full_name":"","num_papers_in_archive":101},{"url":"/dataset/msls","name":"MSLS","full_name":"Mapillary Street-level Sequences Dataset","num_papers_in_archive":57},{"url":"/dataset/oxford-robotcar-dataset","name":"Oxford RobotCar Dataset","full_name":"","num_papers_in_archive":42},{"url":"/dataset/ddd17","name":"DDD17","full_name":"DAVIS Driving Dataset 2017","num_papers_in_archive":41},{"url":"/dataset/gsv-cities","name":"GSV-Cities","full_name":"","num_papers_in_archive":16},{"url":"/dataset/nordland","name":"Nordland","full_name":"Nordland","num_papers_in_archive":12},{"url":"/dataset/amstertime","name":"AmsterTime","full_name":"AmsterTime: A Visual Place Recognition Benchmark Dataset for Severe Domain Shift","num_papers_in_archive":9},{"url":"/dataset/retrieval-sfm","name":"Retrieval-SfM","full_name":null,"num_papers_in_archive":7},{"url":"/dataset/sf-xl-test-v1","name":"SF-XL test v1","full_name":"San Francisco eXtra Large test v1","num_papers_in_archive":7},{"url":"/dataset/sf-xl-test-v2","name":"SF-XL test v2","full_name":"San Francisco eXtra Large test v2","num_papers_in_archive":6},{"url":"/dataset/kitti360pose","name":"KITTI360pose","full_name":"","num_papers_in_archive":5},{"url":"/dataset/alto","name":"ALTO","full_name":"Aerial-view Large-scale Terrain-Oriented","num_papers_in_archive":4},{"url":"/dataset/nordland-2760-queries","name":"Nordland* (2760 queries)","full_name":"","num_papers_in_archive":4},{"url":"/dataset/boson-nighttime","name":"Boson-nighttime","full_name":"","num_papers_in_archive":3},{"url":"/dataset/cv-cities","name":"CV-Cities","full_name":"","num_papers_in_archive":3},{"url":"/dataset/san-francisco-landmark-dataset","name":"San Francisco Landmark Dataset","full_name":"","num_papers_in_archive":3},{"url":"/dataset/spagbol","name":"SpaGBOL","full_name":"Spatial-Graph-Based Orientated Cross-View Geo-Localisation","num_papers_in_archive":3},{"url":"/dataset/vbr","name":"VBR","full_name":"VBR: A Vision Benchmark in Rome","num_papers_in_archive":3},{"url":"/dataset/sf-xl-night","name":"SF-XL Night","full_name":"","num_papers_in_archive":2},{"url":"/dataset/sf-xl-occlusion","name":"SF-XL Occlusion","full_name":"","num_papers_in_archive":2},{"url":"/dataset/svox","name":"SVOX","full_name":"","num_papers_in_archive":2},{"url":"/dataset/fas100k","name":"FAS100K","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/gta-uav","name":"GTA-UAV","full_name":"","num_papers_in_archive":1},{"url":"/dataset/hpointloc","name":"HPointLoc","full_name":"","num_papers_in_archive":1},{"url":"/dataset/naver-labs-localization-datasets","name":"NAVER LABS Localization Datasets","full_name":"","num_papers_in_archive":1},{"url":"/dataset/nyu-vpr","name":"NYU-VPR","full_name":"","num_papers_in_archive":1}],"subtasks":[{"url":"/task/3d-place-recognition","name":"3D Place Recognition"},{"url":"/task/geo-localization","name":"geo-localization"},{"url":"/task/indoor-localization","name":"Indoor Localization"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":141,"tagged_in_all":297,"items":[{"url":"/paper/emerging-properties-in-self-supervised-vision","title":"Emerging Properties in Self-Supervised Vision Transformers","date":"2021-04-29","arxiv_id":"2104.14294","repositories_listed":32,"syntology":{"n":20,"n_ran":5,"n_unverified":15,"n_pointer_only":2}},{"url":"/paper/dinov2-learning-robust-visual-features","title":"DINOv2: Learning Robust Visual Features without Supervision","date":"2023-04-14","arxiv_id":"2304.07193","repositories_listed":26,"syntology":{"n":46,"n_ran":21,"n_unverified":25,"n_pointer_only":12}},{"url":"/paper/superglue-learning-feature-matching-with","title":"SuperGlue: Learning Feature Matching with Graph Neural Networks","date":"2019-11-26","arxiv_id":"1911.11763","repositories_listed":19,"syntology":{"n":22,"n_ran":6,"n_unverified":16,"n_pointer_only":6}},{"url":"/paper/netvlad-cnn-architecture-for-weakly","title":"NetVLAD: CNN architecture for weakly supervised place recognition","date":"2015-11-23","arxiv_id":"1511.07247","repositories_listed":14,"syntology":{"n":12,"n_ran":0,"n_unverified":12,"n_pointer_only":0}},{"url":"/paper/pointnetvlad-deep-point-cloud-based-retrieval","title":"PointNetVLAD: Deep Point Cloud Based Retrieval for Large-Scale Place Recognition","date":"2018-04-10","arxiv_id":"1804.03492","repositories_listed":6,"syntology":null},{"url":"/paper/megaloc-one-retrieval-to-place-them-all","title":"MegaLoc: One Retrieval to Place Them All","date":"2025-02-24","arxiv_id":"2502.17237","repositories_listed":4,"syntology":{"n":6,"n_ran":1,"n_unverified":5,"n_pointer_only":0}},{"url":"/paper/eigenplaces-training-viewpoint-robust-models","title":"EigenPlaces: Training Viewpoint Robust Models for Visual Place Recognition","date":"2023-08-21","arxiv_id":"2308.10832","repositories_listed":4,"syntology":{"n":13,"n_ran":11,"n_unverified":2,"n_pointer_only":1}},{"url":"/paper/patch-netvlad-multi-scale-fusion-of-locally","title":"Patch-NetVLAD: Multi-Scale Fusion of Locally-Global Descriptors for Place Recognition","date":"2021-03-02","arxiv_id":"2103.01486","repositories_listed":4,"syntology":{"n":5,"n_ran":4,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/geoclip-clip-inspired-alignment-between","title":"GeoCLIP: Clip-Inspired Alignment between Locations and Images for Effective Worldwide Geo-localization","date":"2023-09-27","arxiv_id":"2309.16020","repositories_listed":3,"syntology":{"n":13,"n_ran":5,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/from-coarse-to-fine-robust-hierarchical","title":"From Coarse to Fine: Robust Hierarchical Localization at Large Scale","date":"2018-12-09","arxiv_id":"1812.03506","repositories_listed":3,"syntology":{"n":9,"n_ran":1,"n_unverified":8,"n_pointer_only":2}},{"url":"/paper/visual-localization-under-appearance-change-a","title":"Visual Localization Under Appearance Change: Filtering Approaches","date":"2018-11-20","arxiv_id":"1811.08063","repositories_listed":3,"syntology":null},{"url":"/paper/nerf-supervised-feature-point-detection-and","title":"NeRF-Supervised Feature Point Detection and Description","date":"2024-03-13","arxiv_id":"2403.08156","repositories_listed":2,"syntology":null},{"url":"/paper/long-range-uav-thermal-geo-localization-with","title":"Long-range UAV Thermal Geo-localization with Satellite Imagery","date":"2023-06-05","arxiv_id":"2306.02994","repositories_listed":2,"syntology":{"n":6,"n_ran":4,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/gluestick-robust-image-matching-by-sticking","title":"GlueStick: Robust Image Matching by Sticking Points and Lines Together","date":"2023-04-04","arxiv_id":"2304.02008","repositories_listed":2,"syntology":{"n":29,"n_ran":20,"n_unverified":9,"n_pointer_only":15}},{"url":"/paper/rethinking-visual-geo-localization-for-large","title":"Rethinking Visual Geo-localization for Large-Scale Applications","date":"2022-04-05","arxiv_id":"2204.02287","repositories_listed":2,"syntology":{"n":10,"n_ran":6,"n_unverified":4,"n_pointer_only":2}},{"url":"/paper/text2pos-text-to-point-cloud-cross-modal","title":"Text2Pos: Text-to-Point-Cloud Cross-Modal Localization","date":"2022-03-28","arxiv_id":"2203.15125","repositories_listed":2,"syntology":{"n":16,"n_ran":9,"n_unverified":7,"n_pointer_only":16}},{"url":"/paper/adaptive-attentive-geolocalization-from-few","title":"Adaptive-Attentive Geolocalization from few queries: a hybrid approach","date":"2020-10-14","arxiv_id":"2010.06897","repositories_listed":2,"syntology":{"n":8,"n_ran":1,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/181207050","title":"LPD-Net: 3D Point Cloud Learning for Large-Scale Place Recognition and Environment Analysis","date":"2018-12-11","arxiv_id":"1812.07050","repositories_listed":2,"syntology":null},{"url":"/paper/g2d-from-gta-to-data","title":"G2D: from GTA to Data","date":"2018-06-16","arxiv_id":"1806.07381","repositories_listed":2,"syntology":null},{"url":"/paper/real-time-visual-place-recognition-for","title":"Real-Time Visual Place Recognition for Personal Localization on a Mobile Device","date":"2016-11-07","arxiv_id":"1611.02061","repositories_listed":2,"syntology":null},{"url":"/paper/adversarial-attacks-and-detection-in-visual","title":"Adversarial Attacks and Detection in Visual Place Recognition for Safer Robot Navigation","date":"2025-06-19","arxiv_id":"2506.15988","repositories_listed":1,"syntology":null},{"url":"/paper/place-recognition-a-comprehensive-review","title":"Place Recognition: A Comprehensive Review, Current Challenges and Future Directions","date":"2025-05-20","arxiv_id":"2505.14068","repositories_listed":1,"syntology":null},{"url":"/paper/geolocating-earth-imagery-from-iss","title":"Geolocating Earth Imagery from ISS: Integrating Machine Learning with Astronaut Photography for Enhanced Geographic Mapping","date":"2025-04-29","arxiv_id":"2504.21194","repositories_listed":1,"syntology":null},{"url":"/paper/visual-re-ranking-with-non-visual-side","title":"Visual Re-Ranking with Non-Visual Side Information","date":"2025-04-15","arxiv_id":"2504.11134","repositories_listed":1,"syntology":null},{"url":"/paper/focus-on-local-finding-reliable-1","title":"Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition","date":"2025-04-14","arxiv_id":"2504.09881","repositories_listed":1,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/to-match-or-not-to-match-revisiting-image","title":"To Match or Not to Match: Revisiting Image Matching for Reliable Visual Place Recognition","date":"2025-04-08","arxiv_id":"2504.06116","repositories_listed":1,"syntology":null},{"url":"/paper/ugna-vpr-a-novel-training-paradigm-for-visual","title":"UGNA-VPR: A Novel Training Paradigm for Visual Place Recognition Based on Uncertainty-Guided NeRF Augmentation","date":"2025-03-27","arxiv_id":"2503.21338","repositories_listed":1,"syntology":null},{"url":"/paper/textinplace-indoor-visual-place-recognition","title":"TextInPlace: Indoor Visual Place Recognition in Repetitive Structures with Scene Text Spotting and Verification","date":"2025-03-09","arxiv_id":"2503.06501","repositories_listed":1,"syntology":null},{"url":"/paper/structvpr-distill-structural-and-semantic","title":"StructVPR++: Distill Structural and Semantic Knowledge with Weighting Samples for Visual Place Recognition","date":"2025-03-09","arxiv_id":"2503.06601","repositories_listed":1,"syntology":null},{"url":"/paper/image-based-relocalization-and-alignment-for","title":"Image-Based Relocalization and Alignment for Long-Term Monitoring of Dynamic Underwater Environments","date":"2025-03-06","arxiv_id":"2503.04096","repositories_listed":1,"syntology":null}],"syntology_records":15,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}