{"url":"/task/retrieval","name":"Retrieval","slug":"retrieval","description_markdown":"A methodology that involves selecting relevant data or examples from a large dataset to support tasks like prediction, learning, or inference. It enhances models by providing context or additional information, often used in systems like retrieval-augmented generation or in-context learning.","categories":[{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Methodology","url":"/area/methodology"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":14297,"papers_with_code":5274,"benchmarks":11,"benchmark_tables_in_archive":11,"benchmark_tables_shown":11,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":38,"subtasks":3,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/retrieval-on-quora-question-pairs","slug":"retrieval-on-quora-question-pairs","dataset":"Quora Question Pairs","dataset_url":"/dataset/quora-question-pairs","rows_in_archive":4,"metrics":["Queries per second"],"first_row_in_archive_order":{"model":"BM25S","paper_title":"BM25S: Orders of magnitude faster lexical search via eager sparse scoring","paper_url":"/paper/bm25s-orders-of-magnitude-faster-lexical","paper_date":"2024-07-04","arxiv_id":"2407.03618","code_links":[{"title":"xhluca/bm25s","url":"https://github.com/xhluca/bm25s"},{"title":"xhluca/bm25-benchmarks","url":"https://github.com/xhluca/bm25-benchmarks"},{"title":"conda-forge/bm25s-feedstock","url":"https://github.com/conda-forge/bm25s-feedstock"}],"syntology":{"n":22,"n_ran":10,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/retrieval-on-hotpotqa","slug":"retrieval-on-hotpotqa","dataset":"HotpotQA","dataset_url":"/dataset/hotpotqa","rows_in_archive":3,"metrics":["Queries per second"],"first_row_in_archive_order":{"model":"BM25S","paper_title":"BM25S: Orders of magnitude faster lexical search via eager sparse scoring","paper_url":"/paper/bm25s-orders-of-magnitude-faster-lexical","paper_date":"2024-07-04","arxiv_id":"2407.03618","code_links":[{"title":"xhluca/bm25s","url":"https://github.com/xhluca/bm25s"},{"title":"xhluca/bm25-benchmarks","url":"https://github.com/xhluca/bm25-benchmarks"},{"title":"conda-forge/bm25s-feedstock","url":"https://github.com/conda-forge/bm25s-feedstock"}],"syntology":{"n":22,"n_ran":10,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/retrieval-on-natural-questions","slug":"retrieval-on-natural-questions","dataset":"Natural Questions","dataset_url":"/dataset/natural-questions","rows_in_archive":3,"metrics":["Queries per second"],"first_row_in_archive_order":{"model":"BM25S","paper_title":"BM25S: Orders of magnitude faster lexical search via eager sparse scoring","paper_url":"/paper/bm25s-orders-of-magnitude-faster-lexical","paper_date":"2024-07-04","arxiv_id":"2407.03618","code_links":[{"title":"xhluca/bm25s","url":"https://github.com/xhluca/bm25s"},{"title":"xhluca/bm25-benchmarks","url":"https://github.com/xhluca/bm25-benchmarks"},{"title":"conda-forge/bm25s-feedstock","url":"https://github.com/conda-forge/bm25s-feedstock"}],"syntology":{"n":22,"n_ran":10,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/retrieval-on-ok-vqa","slug":"retrieval-on-ok-vqa","dataset":"OK-VQA","dataset_url":"/dataset/ok-vqa","rows_in_archive":2,"metrics":["Recall@5"],"first_row_in_archive_order":{"model":"FLMR","paper_title":"Fine-grained Late-interaction Multi-modal Retrieval for Retrieval Augmented Visual Question Answering","paper_url":"/paper/fine-grained-late-interaction-multi-modal-1","paper_date":"2023-09-29","arxiv_id":"2309.17133","code_links":[{"title":"linweizhedragon/retrieval-augmented-visual-question-answering","url":"https://github.com/linweizhedragon/retrieval-augmented-visual-question-answering"}],"syntology":{"n":8,"n_ran":8,"n_unverified":0,"n_pointer_only":8}}},{"leaderboard":"/sota/retrieval-on-infoseek","slug":"retrieval-on-infoseek","dataset":"InfoSeek","dataset_url":"/dataset/infoseek","rows_in_archive":1,"metrics":["Recall@5"],"first_row_in_archive_order":{"model":"PreFLMR","paper_title":"PreFLMR: Scaling Up Fine-Grained Late-Interaction Multi-modal Retrievers","paper_url":"/paper/preflmr-scaling-up-fine-grained-late","paper_date":"2024-02-13","arxiv_id":"2402.08327","code_links":[{"title":"linweizhedragon/retrieval-augmented-visual-question-answering","url":"https://github.com/linweizhedragon/retrieval-augmented-visual-question-answering"}],"syntology":null}},{"leaderboard":"/sota/retrieval-on-khlipaiwral-ai-ch-priichyaa","slug":"retrieval-on-khlipaiwral-ai-ch-priichyaa","dataset":"คลิปไวรัล!! ไอซ์ ปรีชญา ลืมปิดไลฟ์สดตอนอาบน้ำ ถูกแชร์กระหึ่มเน็ต","dataset_url":null,"rows_in_archive":1,"metrics":["0L"],"first_row_in_archive_order":{"model":"hello","paper_title":"A Large-scale Annotated Mechanical Components Benchmark for Classification and Retrieval Tasks with Deep Neural Networks","paper_url":"/paper/a-large-scale-annotated-mechanical-components","paper_date":"","arxiv_id":null,"code_links":[{"title":"stnoah1/mcb","url":"https://github.com/stnoah1/mcb"}],"syntology":null}},{"leaderboard":"/sota/retrieval-on-mvk","slug":"retrieval-on-mvk","dataset":"MVK","dataset_url":"/dataset/marine-video-kit","rows_in_archive":1,"metrics":["text-to-video Mean Rank"],"first_row_in_archive_order":{"model":"CLIP-KIS","paper_title":"Marine Video Kit: A New Marine Video Dataset for Content-based Analysis and Retrieval","paper_url":"/paper/marine-video-kit-a-new-marine-video-dataset","paper_date":"2022-09-23","arxiv_id":"2209.11518","code_links":[{"title":"quangtrungtruong/KIS_MVK","url":"https://github.com/quangtrungtruong/KIS_MVK"}],"syntology":null}},{"leaderboard":"/sota/retrieval-on-polyvore","slug":"retrieval-on-polyvore","dataset":"Polyvore","dataset_url":"/dataset/polyvore","rows_in_archive":1,"metrics":["Recall@5"],"first_row_in_archive_order":{"model":"CLIP4Outfit","paper_title":"Lost Your Style? Navigating with Semantic-Level Approach for Text-to-Outfit Retrieval","paper_url":"/paper/lost-your-style-navigating-with-semantic","paper_date":"2023-11-03","arxiv_id":"2311.02122","code_links":[],"syntology":null}},{"leaderboard":"/sota/retrieval-on-pubmedqa","slug":"retrieval-on-pubmedqa","dataset":"PubMedQA","dataset_url":"/dataset/pubmedqa","rows_in_archive":1,"metrics":["Accuracy (Top-1)"],"first_row_in_archive_order":{"model":"MetaGen Blended RAG","paper_title":"MetaGen Blended RAG: Higher Accuracy for Domain-Specific Q&A Without Fine-Tuning","paper_url":"/paper/metagen-blended-rag-higher-accuracy-for","paper_date":"2025-05-23","arxiv_id":"2505.18247","code_links":[{"title":"ibm-self-serve-assets/metagen-blended-rag","url":"https://github.com/ibm-self-serve-assets/metagen-blended-rag"}],"syntology":null}},{"leaderboard":"/sota/retrieval-on-pubmedqa-corpus-with-metadata","slug":"retrieval-on-pubmedqa-corpus-with-metadata","dataset":"PubMedQA corpus with metadata","dataset_url":"/dataset/pubmedqa-corpus-with-metadata","rows_in_archive":1,"metrics":["Accuracy (Top-1)"],"first_row_in_archive_order":{"model":"MetaGen Blended RAG","paper_title":"MetaGen Blended RAG: Higher Accuracy for Domain-Specific Q&A Without Fine-Tuning","paper_url":"/paper/metagen-blended-rag-higher-accuracy-for","paper_date":"2025-05-23","arxiv_id":"2505.18247","code_links":[{"title":"ibm-self-serve-assets/metagen-blended-rag","url":"https://github.com/ibm-self-serve-assets/metagen-blended-rag"}],"syntology":null}},{"leaderboard":"/sota/retrieval-on-toollens","slug":"retrieval-on-toollens","dataset":"ToolLens","dataset_url":"/dataset/toollens","rows_in_archive":1,"metrics":["COMP@"],"first_row_in_archive_order":{"model":"COLT","paper_title":"Towards Completeness-Oriented Tool Retrieval for Large Language Models","paper_url":"/paper/colt-towards-completeness-oriented-tool","paper_date":"2024-05-25","arxiv_id":"2405.16089","code_links":[{"title":"quchangle1/colt","url":"https://github.com/quchangle1/colt"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":3}}}],"datasets":[{"url":"/dataset/natural-questions","name":"Natural Questions","full_name":"","num_papers_in_archive":1404},{"url":"/dataset/hotpotqa","name":"HotpotQA","full_name":"","num_papers_in_archive":933},{"url":"/dataset/ok-vqa","name":"OK-VQA","full_name":"Outside Knowledge Visual Question Answering","num_papers_in_archive":368},{"url":"/dataset/pubmedqa","name":"PubMedQA","full_name":"PubMedQA","num_papers_in_archive":276},{"url":"/dataset/popqa","name":"PopQA","full_name":"","num_papers_in_archive":91},{"url":"/dataset/polyvore","name":"Polyvore","full_name":"Polyvore Outfits","num_papers_in_archive":62},{"url":"/dataset/quora-question-pairs","name":"Quora Question Pairs","full_name":"","num_papers_in_archive":55},{"url":"/dataset/alce","name":"ALCE","full_name":"Automatic LLMs' Citation Evaluation","num_papers_in_archive":39},{"url":"/dataset/infoseek","name":"InfoSeek","full_name":"Visual Information Seeking","num_papers_in_archive":36},{"url":"/dataset/aro","name":"ARO","full_name":"ARO","num_papers_in_archive":35},{"url":"/dataset/proofnet","name":"ProofNet","full_name":"","num_papers_in_archive":27},{"url":"/dataset/rsvgd","name":"DIOR-RSVG","full_name":"","num_papers_in_archive":25},{"url":"/dataset/qampari","name":"QAMPARI","full_name":"","num_papers_in_archive":19},{"url":"/dataset/xcodeeval","name":"xCodeEval","full_name":"xCodeEval","num_papers_in_archive":15},{"url":"/dataset/marine-video-kit","name":"MVK","full_name":"Marine Video Kit","num_papers_in_archive":9},{"url":"/dataset/bsard","name":"BSARD","full_name":"Belgian Statutory Article Retrieval Dataset","num_papers_in_archive":6},{"url":"/dataset/shapetalk","name":"ShapeTalk","full_name":"The ShapeTalk Dataset","num_papers_in_archive":6},{"url":"/dataset/comfact","name":"ComFact","full_name":"","num_papers_in_archive":5},{"url":"/dataset/discq","name":"DiSCQ","full_name":"Discharge Summary Clinical Questions","num_papers_in_archive":4},{"url":"/dataset/cosian","name":"COSIAN","full_name":"a collection of singing voice annotation","num_papers_in_archive":3},{"url":"/dataset/fanoutqa","name":"FanOutQA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/lleqa","name":"LLeQA","full_name":"Long-form Legal Question Answering","num_papers_in_archive":3},{"url":"/dataset/toollens","name":"ToolLens","full_name":"","num_papers_in_archive":3},{"url":"/dataset/dtgb","name":"DTGB","full_name":"Dynamic Text-attributed Graph Benchmark","num_papers_in_archive":2},{"url":"/dataset/posescript","name":"PoseScript","full_name":"","num_papers_in_archive":2},{"url":"/dataset/romqa","name":"RoMQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/claim-matching-robustness","name":"Claim Matching Robustness","full_name":"","num_papers_in_archive":1},{"url":"/dataset/coresearch","name":"CoreSearch","full_name":"","num_papers_in_archive":1},{"url":"/dataset/crsb","name":"CRSB","full_name":"Context Retrieval Supervision Benchmark","num_papers_in_archive":1},{"url":"/dataset/dapfam","name":"DAPFAM","full_name":"A Domain‑Aware Patent Retrieval Dataset Aggregated at the Family Level","num_papers_in_archive":1},{"url":"/dataset/fewdr","name":"FewDR","full_name":"","num_papers_in_archive":1},{"url":"/dataset/luna-1","name":"Luna-1","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ptvd","name":"PTVD","full_name":"","num_papers_in_archive":1},{"url":"/dataset/pubmedqa-corpus-with-metadata","name":"PubMedQA corpus with metadata","full_name":"","num_papers_in_archive":1},{"url":"/dataset/spiced","name":"Spiced","full_name":"","num_papers_in_archive":1},{"url":"/dataset/statcan-dialogue-dataset","name":"Statcan Dialogue Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/visual-haystacks-vhs","name":"Visual Haystacks (VHs)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/multimodal-needle-in-a-haystack-mmneedle","name":"Multimodal Needle in a Haystack (MMNeedle)","full_name":"","num_papers_in_archive":0}],"subtasks":[{"url":"/task/deep-hashing","name":"Deep Hashing"},{"url":"/task/table-retrieval","name":"Table Retrieval"},{"url":"/task/text-retrieval","name":"Text Retrieval"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":5274,"tagged_in_all":14297,"items":[{"url":"/paper/beyond-part-models-person-retrieval-with","title":"Beyond Part Models: Person Retrieval with Refined Part Pooling (and a Strong Convolutional Baseline)","date":"2017-11-26","arxiv_id":"1711.09349","repositories_listed":29,"syntology":null},{"url":"/paper/modeling-relational-data-with-graph","title":"Modeling Relational Data with Graph Convolutional Networks","date":"2017-03-17","arxiv_id":"1703.06103","repositories_listed":27,"syntology":{"n":32,"n_ran":10,"n_unverified":22,"n_pointer_only":15}},{"url":"/paper/transfertransfo-a-transfer-learning-approach","title":"TransferTransfo: A Transfer Learning Approach for Neural Network Based Conversational Agents","date":"2019-01-23","arxiv_id":"1901.08149","repositories_listed":23,"syntology":{"n":26,"n_ran":8,"n_unverified":18,"n_pointer_only":7}},{"url":"/paper/dense-passage-retrieval-for-open-domain","title":"Dense Passage Retrieval for Open-Domain Question Answering","date":"2020-04-10","arxiv_id":"2004.04906","repositories_listed":19,"syntology":{"n":14,"n_ran":10,"n_unverified":4,"n_pointer_only":9}},{"url":"/paper/retrieval-augmented-generation-for-knowledge","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","date":"2020-05-22","arxiv_id":"2005.11401","repositories_listed":18,"syntology":{"n":6,"n_ran":4,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/circle-loss-a-unified-perspective-of-pair","title":"Circle Loss: A Unified Perspective of Pair Similarity Optimization","date":"2020-02-25","arxiv_id":"2002.10857","repositories_listed":16,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/unsupervised-feature-learning-via-non","title":"Unsupervised Feature Learning via Non-Parametric Instance-level Discrimination","date":"2018-05-05","arxiv_id":"1805.01978","repositories_listed":15,"syntology":{"n":23,"n_ran":19,"n_unverified":4,"n_pointer_only":16}},{"url":"/paper/codesearchnet-challenge-evaluating-the-state","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","date":"2019-09-20","arxiv_id":"1909.09436","repositories_listed":14,"syntology":{"n":17,"n_ran":8,"n_unverified":9,"n_pointer_only":0}},{"url":"/paper/fine-tuning-cnn-image-retrieval-with-no-human","title":"Fine-tuning CNN Image Retrieval with No Human Annotation","date":"2017-11-03","arxiv_id":"1711.02512","repositories_listed":14,"syntology":{"n":24,"n_ran":3,"n_unverified":21,"n_pointer_only":2}},{"url":"/paper/netvlad-cnn-architecture-for-weakly","title":"NetVLAD: CNN architecture for weakly supervised place recognition","date":"2015-11-23","arxiv_id":"1511.07247","repositories_listed":14,"syntology":{"n":12,"n_ran":0,"n_unverified":12,"n_pointer_only":0}},{"url":"/paper/large-scale-image-retrieval-with-attentive","title":"Large-Scale Image Retrieval with Attentive Deep Local Features","date":"2016-12-19","arxiv_id":"1612.06321","repositories_listed":13,"syntology":{"n":12,"n_ran":3,"n_unverified":9,"n_pointer_only":0}},{"url":"/paper/revisiting-the-inverted-indices-for-billion","title":"Revisiting the Inverted Indices for Billion-Scale Approximate Nearest Neighbors","date":"2018-02-07","arxiv_id":"1802.02422","repositories_listed":12,"syntology":null},{"url":"/paper/vilbert-pretraining-task-agnostic","title":"ViLBERT: Pretraining Task-Agnostic Visiolinguistic Representations for Vision-and-Language Tasks","date":"2019-08-06","arxiv_id":"1908.02265","repositories_listed":11,"syntology":{"n":34,"n_ran":10,"n_unverified":24,"n_pointer_only":34}},{"url":"/paper/visual-dialog","title":"Visual Dialog","date":"2016-11-26","arxiv_id":"1611.08669","repositories_listed":11,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/sinkhorn-distances-lightspeed-computation-of-1","title":"Sinkhorn Distances: Lightspeed Computation of Optimal Transportation Distances","date":"2013-06-04","arxiv_id":"1306.0895","repositories_listed":11,"syntology":{"n":30,"n_ran":23,"n_unverified":7,"n_pointer_only":23}},{"url":"/paper/product-based-neural-networks-for-user-1","title":"Product-based Neural Networks for User Response Prediction over Multi-field Categorical Data","date":"2018-07-01","arxiv_id":"1807.00311","repositories_listed":10,"syntology":null},{"url":"/paper/camera-style-adaptation-for-person-re","title":"Camera Style Adaptation for Person Re-identification","date":"2017-11-28","arxiv_id":"1711.10295","repositories_listed":10,"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":3}},{"url":"/paper/vse-improving-visual-semantic-embeddings-with","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","date":"2017-07-18","arxiv_id":"1707.05612","repositories_listed":10,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":4}},{"url":"/paper/reading-wikipedia-to-answer-open-domain","title":"Reading Wikipedia to Answer Open-Domain Questions","date":"2017-03-31","arxiv_id":"1704.00051","repositories_listed":10,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/blip-bootstrapping-language-image-pre","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","date":"2022-01-28","arxiv_id":"2201.12086","repositories_listed":9,"syntology":null},{"url":"/paper/linear-transformers-are-secretly-fast-weight","title":"Linear Transformers Are Secretly Fast Weight Programmers","date":"2021-02-22","arxiv_id":"2102.11174","repositories_listed":9,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/declarative-experimentation-in-information","title":"Declarative Experimentation in Information Retrieval using PyTerrier","date":"2020-07-28","arxiv_id":"2007.14271","repositories_listed":9,"syntology":null},{"url":"/paper/colbert-efficient-and-effective-passage","title":"ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT","date":"2020-04-27","arxiv_id":"2004.12832","repositories_listed":9,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/margin-based-parallel-corpus-mining-with","title":"Margin-based Parallel Corpus Mining with Multilingual Sentence Embeddings","date":"2018-11-03","arxiv_id":"1811.01136","repositories_listed":9,"syntology":null},{"url":"/paper/deep-complex-networks","title":"Deep Complex Networks","date":"2017-05-27","arxiv_id":"1705.09792","repositories_listed":9,"syntology":{"n":6,"n_ran":3,"n_unverified":3,"n_pointer_only":3}},{"url":"/paper/looking-at-outfit-to-parse-clothing","title":"Looking at Outfit to Parse Clothing","date":"2017-03-04","arxiv_id":"1703.01386","repositories_listed":9,"syntology":null},{"url":"/paper/learning-deep-representations-of-fine-grained","title":"Learning Deep Representations of Fine-grained Visual Descriptions","date":"2016-05-17","arxiv_id":"1605.05395","repositories_listed":9,"syntology":null},{"url":"/paper/leveraging-passage-retrieval-with-generative","title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","date":"2020-07-02","arxiv_id":"2007.01282","repositories_listed":8,"syntology":null},{"url":"/paper/huse-hierarchical-universal-semantic","title":"HUSE: Hierarchical Universal Semantic Embeddings","date":"2019-11-14","arxiv_id":"1911.05978","repositories_listed":8,"syntology":null},{"url":"/paper/deep-learning-based-recommender-system-a","title":"Deep Learning based Recommender System: A Survey and New Perspectives","date":"2017-07-24","arxiv_id":"1707.07435","repositories_listed":8,"syntology":null}],"syntology_records":19,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}