{"url":"/task/question-answering","name":"Question Answering","slug":"question-answering","description_markdown":"Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include [SQuAD](/dataset/squad), [HotPotQA](/dataset/hotpotqa), [bAbI](/dataset/babi-1), [TriviaQA](/dataset/triviaqa), [WikiQA](/dataset/wikiqa), and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.\r\n\r\n( Image credit: [SQuAD](https://rajpurkar.github.io/mlx/qa-and-squad/) )","categories":[{"name":"Miscellaneous","url":"/area/miscellaneous"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"},{"name":"Reasoning","url":"/area/reasoning"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":10817,"papers_with_code":4171,"benchmarks":142,"benchmark_tables_in_archive":152,"benchmark_tables_shown":152,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":413,"subtasks":19,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/question-answering-on-squad20","slug":"question-answering-on-squad20","dataset":"SQuAD2.0","dataset_url":"/dataset/squad","rows_in_archive":286,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"IE-Net (ensemble)","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-squad11","slug":"question-answering-on-squad11","dataset":"SQuAD1.1","dataset_url":"/dataset/squad","rows_in_archive":213,"metrics":["EM","F1","Hardware Burden","Exact Match","Operations per network pass"],"first_row_in_archive_order":{"model":"{ANNA} (single model)","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-hotpotqa","slug":"question-answering-on-hotpotqa","dataset":"HotpotQA","dataset_url":"/dataset/hotpotqa","rows_in_archive":72,"metrics":["JOINT-F1","ANS-EM","ANS-F1","SUP-EM","SUP-F1","JOINT-EM"],"first_row_in_archive_order":{"model":"Beam Retrieval","paper_title":"End-to-End Beam Retrieval for Multi-Hop Question Answering","paper_url":"/paper/beam-retrieval-general-end-to-end-retrieval","paper_date":"2023-08-17","arxiv_id":"2308.08973","code_links":[{"title":"ShayekhBinIslam/openrag","url":"https://github.com/ShayekhBinIslam/openrag"},{"title":"canghongjian/beam_retriever","url":"https://github.com/canghongjian/beam_retriever"},{"title":"Alab-NII/2wikimultihop","url":"https://github.com/Alab-NII/2wikimultihop"}],"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-piqa","slug":"question-answering-on-piqa","dataset":"PIQA","dataset_url":"/dataset/piqa","rows_in_archive":67,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Unicorn 11B (fine-tuned)","paper_title":"UNICORN on RAINBOW: A Universal Commonsense Reasoning Model on a New Multitask Benchmark","paper_url":"/paper/unicorn-on-rainbow-a-universal-commonsense","paper_date":"2021-03-24","arxiv_id":"2103.13009","code_links":[{"title":"allenai/rainbow","url":"https://github.com/allenai/rainbow"}],"syntology":{"n":5,"n_ran":0,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-boolq","slug":"question-answering-on-boolq","dataset":"BoolQ","dataset_url":"/dataset/boolq","rows_in_archive":65,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Mistral-Nemo 12B (HPT)","paper_title":"Hierarchical Prompting Taxonomy: A Universal Evaluation Framework for Large Language Models Aligned with Human Cognitive Principles","paper_url":"/paper/hierarchical-prompting-taxonomy-a-universal","paper_date":"2024-06-18","arxiv_id":"2406.12644","code_links":[{"title":"devichand579/HPT","url":"https://github.com/devichand579/HPT"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-copa","slug":"question-answering-on-copa","dataset":"COPA","dataset_url":"/dataset/copa","rows_in_archive":60,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"PaLM 540B (finetuned)","paper_title":"PaLM: Scaling Language Modeling with Pathways","paper_url":"/paper/palm-scaling-language-modeling-with-pathways-1","paper_date":"2022-04-05","arxiv_id":"2204.02311","code_links":[{"title":"lucidrains/CoCa-pytorch","url":"https://github.com/lucidrains/CoCa-pytorch"},{"title":"lucidrains/PaLM-pytorch","url":"https://github.com/lucidrains/PaLM-pytorch"},{"title":"google/paxml","url":"https://github.com/google/paxml"},{"title":"foundation-model-stack/fms-fsdp","url":"https://github.com/foundation-model-stack/fms-fsdp"},{"title":"lucidrains/PaLM-jax","url":"https://github.com/lucidrains/PaLM-jax"},{"title":"chrisociepa/allamo","url":"https://github.com/chrisociepa/allamo"},{"title":"conceptofmind/PaLM-flax","url":"https://github.com/conceptofmind/PaLM-flax"}],"syntology":{"n":37,"n_ran":30,"n_unverified":7,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-triviaqa","slug":"question-answering-on-triviaqa","dataset":"TriviaQA","dataset_url":"/dataset/triviaqa","rows_in_archive":56,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"Claude 2 (few-shot, k=5)","paper_title":"Model Card and Evaluations for Claude Models","paper_url":"/paper/model-card-and-evaluations-for-claude-models","paper_date":"2023-07-11","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-squad11-dev","slug":"question-answering-on-squad11-dev","dataset":"SQuAD1.1 dev","dataset_url":"/dataset/squad","rows_in_archive":55,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"T5-11B","paper_title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","paper_url":"/paper/exploring-the-limits-of-transfer-learning","paper_date":"2019-10-23","arxiv_id":"1910.10683","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/t5"},{"title":"google-research/text-to-text-transfer-transformer","url":"https://github.com/google-research/text-to-text-transfer-transformer"},{"title":"amazon-science/chronos-forecasting","url":"https://github.com/amazon-science/chronos-forecasting"},{"title":"google-research/t5x","url":"https://github.com/google-research/t5x"},{"title":"allenai/dolma","url":"https://github.com/allenai/dolma"},{"title":"thudm/swissarmytransformer","url":"https://github.com/thudm/swissarmytransformer"},{"title":"Ki6an/fastT5","url":"https://github.com/Ki6an/fastT5"},{"title":"google/seqio","url":"https://github.com/google/seqio"},{"title":"facebookresearch/atlas","url":"https://github.com/facebookresearch/atlas"},{"title":"conceptofmind/LaMDA-pytorch","url":"https://github.com/conceptofmind/LaMDA-pytorch"},{"title":"conceptofmind/lamda-rlhf-pytorch","url":"https://github.com/conceptofmind/lamda-rlhf-pytorch"},{"title":"thu-keg/omnievent","url":"https://github.com/thu-keg/omnievent"},{"title":"asahi417/lm-question-generation","url":"https://github.com/asahi417/lm-question-generation"},{"title":"abelriboulot/onnxt5","url":"https://github.com/abelriboulot/onnxt5"},{"title":"volcengine/vegiantmodel","url":"https://github.com/volcengine/vegiantmodel"},{"title":"airc-keti/ke-t5","url":"https://github.com/airc-keti/ke-t5"},{"title":"yizhongw/tk-instruct","url":"https://github.com/yizhongw/tk-instruct"},{"title":"asahi417/lmppl","url":"https://github.com/asahi417/lmppl"},{"title":"gulucaptain/dynamictrl","url":"https://github.com/gulucaptain/dynamictrl"},{"title":"google-research/t5x_retrieval","url":"https://github.com/google-research/t5x_retrieval"},{"title":"bigscience-workshop/architecture-objective","url":"https://github.com/bigscience-workshop/architecture-objective"},{"title":"dawn0815/UniSA","url":"https://github.com/dawn0815/UniSA"},{"title":"ibm/graph_ensemble_learning","url":"https://github.com/ibm/graph_ensemble_learning"},{"title":"wangcongcong123/ttt","url":"https://github.com/wangcongcong123/ttt"},{"title":"safakkbilici/Academic-Paper-Title-Recommendation","url":"https://github.com/safakkbilici/Academic-Paper-Title-Recommendation"},{"title":"bayer-science-for-a-better-life/data2text-bioleaflets","url":"https://github.com/bayer-science-for-a-better-life/data2text-bioleaflets"},{"title":"allenai/c4-documentation","url":"https://github.com/allenai/c4-documentation"},{"title":"um-arm-lab/efficient-eng-2-ltl","url":"https://github.com/um-arm-lab/efficient-eng-2-ltl"},{"title":"lesterpjy/numeric-t5","url":"https://github.com/lesterpjy/numeric-t5"},{"title":"zhiqic/chartreader","url":"https://github.com/zhiqic/chartreader"},{"title":"LeoLaugier/conditional-auto-encoder-text-to-text-transfer-transformer","url":"https://github.com/LeoLaugier/conditional-auto-encoder-text-to-text-transfer-transformer"},{"title":"s-nlp/russe_detox_2022","url":"https://github.com/s-nlp/russe_detox_2022"},{"title":"skoltech-nlp/russe_detox_2022","url":"https://github.com/skoltech-nlp/russe_detox_2022"},{"title":"jongwooko/nash-pruning-official","url":"https://github.com/jongwooko/nash-pruning-official"},{"title":"xiuyu0000/new_papers_codes","url":"https://github.com/xiuyu0000/new_papers_codes/tree/main/t5"},{"title":"luomancs/retriever_reader_for_okvqa","url":"https://github.com/luomancs/retriever_reader_for_okvqa"},{"title":"qipengguo/p2_webnlg2020","url":"https://github.com/qipengguo/p2_webnlg2020"},{"title":"JunnYu/x-transformers-paddle","url":"https://github.com/JunnYu/x-transformers-paddle"},{"title":"Sharif-SLPL/t5-fa","url":"https://github.com/Sharif-SLPL/t5-fa"},{"title":"shivamraval98/multitask-t5_ae","url":"https://github.com/shivamraval98/multitask-t5_ae"},{"title":"junnyu/paddle_t5","url":"https://github.com/junnyu/paddle_t5"},{"title":"ChernovAndrey/chronos-forecasting-wasserstein","url":"https://github.com/ChernovAndrey/chronos-forecasting-wasserstein"},{"title":"cccntu/ft5-demo","url":"https://github.com/cccntu/ft5-demo"},{"title":"ArvinZhuang/BiTAG","url":"https://github.com/ArvinZhuang/BiTAG"},{"title":"MS-P3/code5","url":"https://github.com/MS-P3/code5/tree/main/t5"},{"title":"cccntu/ft5-demo-space","url":"https://github.com/cccntu/ft5-demo-space"},{"title":"xuetianci/pacit","url":"https://github.com/xuetianci/pacit"},{"title":"vgaraujov/seq2seq-spanish-plms","url":"https://github.com/vgaraujov/seq2seq-spanish-plms"},{"title":"yli-z/ml4h_are_clinical_t5_models_better_for_clinical_text","url":"https://github.com/yli-z/ml4h_are_clinical_t5_models_better_for_clinical_text"},{"title":"thecodemasterk/Text-to-Text-transfer-transformers","url":"https://github.com/thecodemasterk/Text-to-Text-transfer-transformers"},{"title":"2023-MindSpore-4/Code12","url":"https://github.com/2023-MindSpore-4/Code12/tree/main/MindFormers/t5"},{"title":"KAGUYAHONGLAI/SRC","url":"https://github.com/KAGUYAHONGLAI/SRC"},{"title":"Nimesh-Patel/text-to-text-transfer-transformer","url":"https://github.com/Nimesh-Patel/text-to-text-transfer-transformer"},{"title":"souvikshanku/translit-former","url":"https://github.com/souvikshanku/translit-former"},{"title":"itzprashu1/prashant","url":"https://github.com/itzprashu1/prashant"},{"title":"2023-MindSpore-1/ms-code-164","url":"https://github.com/2023-MindSpore-1/ms-code-164"}],"syntology":{"n":31,"n_ran":2,"n_unverified":29,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-natural-questions","slug":"question-answering-on-natural-questions","dataset":"Natural Questions","dataset_url":"/dataset/natural-questions","rows_in_archive":47,"metrics":["EM"],"first_row_in_archive_order":{"model":"Atlas (full, Wiki-dec-2018 index)","paper_title":"Atlas: Few-shot Learning with Retrieval Augmented Language Models","paper_url":"/paper/few-shot-learning-with-retrieval-augmented","paper_date":"2022-08-05","arxiv_id":"2208.03299","code_links":[{"title":"facebookresearch/atlas","url":"https://github.com/facebookresearch/atlas"},{"title":"thunlp/clueanchor","url":"https://github.com/thunlp/clueanchor"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}}},{"leaderboard":"/sota/question-answering-on-openbookqa","slug":"question-answering-on-openbookqa","dataset":"OpenBookQA","dataset_url":"/dataset/openbookqa","rows_in_archive":45,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"GPT-4 + knowledge base","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-webquestions","slug":"question-answering-on-webquestions","dataset":"WebQuestions","dataset_url":"/dataset/webquestions","rows_in_archive":37,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"CoA","paper_title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","paper_url":"/paper/chain-of-action-faithful-and-multimodal","paper_date":"2024-03-26","arxiv_id":"2403.17359","code_links":[{"title":"MAGICS-LAB/Chain-of-Actions","url":"https://github.com/MAGICS-LAB/Chain-of-Actions"}],"syntology":{"n":10,"n_ran":8,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-truthfulqa","slug":"question-answering-on-truthfulqa","dataset":"TruthfulQA","dataset_url":"/dataset/truthfulqa","rows_in_archive":33,"metrics":["MC1","MC2","% true","% info","% true (GPT-judge)","BLEURT","ROUGE","BLEU","EM","Accuracy"],"first_row_in_archive_order":{"model":"GPT-4 (RLHF)","paper_title":"GPT-4 Technical Report","paper_url":"/paper/gpt-4-technical-report-1","paper_date":"2023-03-15","arxiv_id":"2303.08774","code_links":[{"title":"openai/evals","url":"https://github.com/openai/evals"},{"title":"shmsw25/factscore","url":"https://github.com/shmsw25/factscore"},{"title":"unispac/visual-adversarial-examples-jailbreak-large-language-models","url":"https://github.com/unispac/visual-adversarial-examples-jailbreak-large-language-models"},{"title":"gpt4life/alpagasus","url":"https://github.com/gpt4life/alpagasus"},{"title":"emrgnt-cmplxty/zero-shot-replication","url":"https://github.com/emrgnt-cmplxty/zero-shot-replication"},{"title":"ethz-privsec/superhuman-ai-consistency","url":"https://github.com/ethz-privsec/superhuman-ai-consistency"},{"title":"ethz-spylab/superhuman-ai-consistency","url":"https://github.com/ethz-spylab/superhuman-ai-consistency"},{"title":"eternityyw/tram-benchmark","url":"https://github.com/eternityyw/tram-benchmark"},{"title":"AUCOHL/RTL-Repo","url":"https://github.com/AUCOHL/RTL-Repo"},{"title":"zach-zhiling-zheng/reticular_chemist","url":"https://github.com/zach-zhiling-zheng/reticular_chemist"},{"title":"lflage/openfactscore","url":"https://github.com/lflage/openfactscore"}],"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":1}}},{"leaderboard":"/sota/question-answering-on-multirc","slug":"question-answering-on-multirc","dataset":"MultiRC","dataset_url":"/dataset/multirc","rows_in_archive":30,"metrics":["F1","EM"],"first_row_in_archive_order":{"model":"PaLM 540B (finetuned)","paper_title":"PaLM: Scaling Language Modeling with Pathways","paper_url":"/paper/palm-scaling-language-modeling-with-pathways-1","paper_date":"2022-04-05","arxiv_id":"2204.02311","code_links":[{"title":"lucidrains/CoCa-pytorch","url":"https://github.com/lucidrains/CoCa-pytorch"},{"title":"lucidrains/PaLM-pytorch","url":"https://github.com/lucidrains/PaLM-pytorch"},{"title":"google/paxml","url":"https://github.com/google/paxml"},{"title":"foundation-model-stack/fms-fsdp","url":"https://github.com/foundation-model-stack/fms-fsdp"},{"title":"lucidrains/PaLM-jax","url":"https://github.com/lucidrains/PaLM-jax"},{"title":"chrisociepa/allamo","url":"https://github.com/chrisociepa/allamo"},{"title":"conceptofmind/PaLM-flax","url":"https://github.com/conceptofmind/PaLM-flax"}],"syntology":{"n":37,"n_ran":30,"n_unverified":7,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-pubmedqa","slug":"question-answering-on-pubmedqa","dataset":"PubMedQA","dataset_url":"/dataset/pubmedqa","rows_in_archive":30,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Meditron-70B (CoT + SC)","paper_title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","paper_url":"/paper/meditron-70b-scaling-medical-pretraining-for","paper_date":"2023-11-27","arxiv_id":"2311.16079","code_links":[{"title":"epfllm/meditron","url":"https://github.com/epfllm/meditron"}],"syntology":{"n":14,"n_ran":9,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-cronquestions","slug":"question-answering-on-cronquestions","dataset":"CronQuestions","dataset_url":"/dataset/cronquestions","rows_in_archive":29,"metrics":["Hits@1"],"first_row_in_archive_order":{"model":"GenTKGQA","paper_title":"Two-stage Generative Question Answering on Temporal Knowledge Graph Using Large Language Models","paper_url":"/paper/two-stage-generative-question-answering-on","paper_date":"2024-02-26","arxiv_id":"2402.16568","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-medqa-usmle","slug":"question-answering-on-medqa-usmle","dataset":"MedQA","dataset_url":"/dataset/medqa-usmle","rows_in_archive":27,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Med-Gemini","paper_title":"Capabilities of Gemini Models in Medicine","paper_url":"/paper/capabilities-of-gemini-models-in-medicine","paper_date":"2024-04-29","arxiv_id":"2404.18416","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-wikiqa","slug":"question-answering-on-wikiqa","dataset":"WikiQA","dataset_url":"/dataset/wikiqa","rows_in_archive":25,"metrics":["MAP","MRR"],"first_row_in_archive_order":{"model":"TANDA-DeBERTa-V3-Large + ALL","paper_title":"Structural Self-Supervised Objectives for Transformers","paper_url":"/paper/structural-self-supervised-objectives-for","paper_date":"2023-09-15","arxiv_id":"2309.08272","code_links":[{"title":"lucadiliello/transformers-framework","url":"https://github.com/lucadiliello/transformers-framework"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-social-iqa","slug":"question-answering-on-social-iqa","dataset":"SIQA","dataset_url":"/dataset/social-iqa","rows_in_archive":24,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Unicorn 11B (fine-tuned)","paper_title":"UNICORN on RAINBOW: A Universal Commonsense Reasoning Model on a New Multitask Benchmark","paper_url":"/paper/unicorn-on-rainbow-a-universal-commonsense","paper_date":"2021-03-24","arxiv_id":"2103.13009","code_links":[{"title":"allenai/rainbow","url":"https://github.com/allenai/rainbow"}],"syntology":{"n":5,"n_ran":0,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-storycloze","slug":"question-answering-on-storycloze","dataset":"StoryCloze","dataset_url":"/dataset/storycloze","rows_in_archive":23,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BLOOMZ","paper_title":"Crosslingual Generalization through Multitask Finetuning","paper_url":"/paper/crosslingual-generalization-through-multitask","paper_date":"2022-11-03","arxiv_id":"2211.01786","code_links":[{"title":"bigscience-workshop/xmtf","url":"https://github.com/bigscience-workshop/xmtf"}],"syntology":{"n":4,"n_ran":1,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-danetqa","slug":"question-answering-on-danetqa","dataset":"DaNetQA","dataset_url":"/dataset/danetqa","rows_in_archive":22,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Golden Transformer","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-timequestions","slug":"question-answering-on-timequestions","dataset":"TimeQuestions","dataset_url":"/dataset/timequestions","rows_in_archive":21,"metrics":["P@1"],"first_row_in_archive_order":{"model":"TimeR4","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-quora-question-pairs","slug":"question-answering-on-quora-question-pairs","dataset":"Quora Question Pairs","dataset_url":"/dataset/quora-question-pairs","rows_in_archive":19,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"XLNet (single model)","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-newsqa","slug":"question-answering-on-newsqa","dataset":"NewsQA","dataset_url":"/dataset/newsqa","rows_in_archive":18,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"OpenAI/o3-2025-01-31-high","paper_title":"o3-mini vs DeepSeek-R1: Which One is Safer?","paper_url":"/paper/o3-mini-vs-deepseek-r1-which-one-is-safer","paper_date":"2025-01-30","arxiv_id":"2501.18438","code_links":[{"title":"trust4ai/astral","url":"https://github.com/trust4ai/astral"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-cnn-daily-mail","slug":"question-answering-on-cnn-daily-mail","dataset":"CNN / Daily Mail","dataset_url":"/dataset/cnn-daily-mail-1","rows_in_archive":16,"metrics":["CNN","Daily Mail"],"first_row_in_archive_order":{"model":"GA+MAGE (32)","paper_title":"Linguistic Knowledge as Memory for Recurrent Neural Networks","paper_url":"/paper/linguistic-knowledge-as-memory-for-recurrent","paper_date":"2017-03-07","arxiv_id":"1703.02620","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-drop-test","slug":"question-answering-on-drop-test","dataset":"DROP Test","dataset_url":"/dataset/drop","rows_in_archive":16,"metrics":["F1"],"first_row_in_archive_order":{"model":"QDGAT (ensemble)","paper_title":"Question Directed Graph Attention Network for Numerical Reasoning over Text","paper_url":"/paper/question-directed-graph-attention-network-for","paper_date":"2020-09-16","arxiv_id":"2009.07448","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-babi","slug":"question-answering-on-babi","dataset":"bAbi","dataset_url":null,"rows_in_archive":14,"metrics":["Accuracy (trained on 10k)","Accuracy (trained on 1k)","Mean Error Rate"],"first_row_in_archive_order":{"model":"STM","paper_title":"Self-Attentive Associative Memory","paper_url":"/paper/self-assttentive-associative-memory","paper_date":"2020-02-10","arxiv_id":"2002.03519","code_links":[{"title":"thaihungle/SAM","url":"https://github.com/thaihungle/SAM"}],"syntology":{"n":4,"n_ran":1,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-natural-questions-long","slug":"question-answering-on-natural-questions-long","dataset":"Natural Questions (long)","dataset_url":"/dataset/natural-questions","rows_in_archive":13,"metrics":["F1","EM"],"first_row_in_archive_order":{"model":"DensePhrases","paper_title":"Learning Dense Representations of Phrases at Scale","paper_url":"/paper/learning-dense-representations-of-phrases-at","paper_date":"2020-12-23","arxiv_id":"2012.12624","code_links":[{"title":"princeton-nlp/SimCSE","url":"https://github.com/princeton-nlp/SimCSE"},{"title":"jhyuklee/DensePhrases","url":"https://github.com/jhyuklee/DensePhrases"},{"title":"princeton-nlp/DensePhrases","url":"https://github.com/princeton-nlp/DensePhrases"},{"title":"dmis-lab/gener","url":"https://github.com/dmis-lab/gener"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-squad20-dev","slug":"question-answering-on-squad20-dev","dataset":"SQuAD2.0 dev","dataset_url":"/dataset/squad","rows_in_archive":13,"metrics":["F1","EM"],"first_row_in_archive_order":{"model":"XLNet (single model)","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-trecqa","slug":"question-answering-on-trecqa","dataset":"TrecQA","dataset_url":"/dataset/trecqa","rows_in_archive":13,"metrics":["MAP","MRR"],"first_row_in_archive_order":{"model":"TANDA DeBERTa-V3-Large + ALL","paper_title":"Structural Self-Supervised Objectives for Transformers","paper_url":"/paper/structural-self-supervised-objectives-for","paper_date":"2023-09-15","arxiv_id":"2309.08272","code_links":[{"title":"lucadiliello/transformers-framework","url":"https://github.com/lucadiliello/transformers-framework"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-strategyqa","slug":"question-answering-on-strategyqa","dataset":"StrategyQA","dataset_url":"/dataset/strategyqa","rows_in_archive":12,"metrics":["Accuracy","EM"],"first_row_in_archive_order":{"model":"PaLM 2 (few-shot, CoT, SC)","paper_title":"PaLM 2 Technical Report","paper_url":"/paper/palm-2-technical-report-1","paper_date":"2023-05-17","arxiv_id":"2305.10403","code_links":[{"title":"eternityyw/tram-benchmark","url":"https://github.com/eternityyw/tram-benchmark"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-multitq","slug":"question-answering-on-multitq","dataset":"MultiTQ","dataset_url":"/dataset/multitq","rows_in_archive":11,"metrics":["Hits@1","Hits@10"],"first_row_in_archive_order":{"model":"Prog-TQA","paper_title":"Self-Improvement Programming for Temporal Knowledge Graph Question Answering","paper_url":"/paper/self-improvement-programming-for-temporal","paper_date":"2024-04-02","arxiv_id":"2404.01720","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-narrativeqa","slug":"question-answering-on-narrativeqa","dataset":"NarrativeQA","dataset_url":"/dataset/narrativeqa","rows_in_archive":10,"metrics":["Rouge-L","BLEU-1","BLEU-4","METEOR"],"first_row_in_archive_order":{"model":"Masque (NarrativeQA + MS MARCO)","paper_title":"Multi-style Generative Reading Comprehension","paper_url":"/paper/multi-style-generative-reading-comprehension","paper_date":"2019-01-08","arxiv_id":"1901.02262","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-bamboogle","slug":"question-answering-on-bamboogle","dataset":"Bamboogle","dataset_url":"/dataset/bamboogle","rows_in_archive":9,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ReST meets ReAct (PaLM 2-L + Google Search)","paper_title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","paper_url":"/paper/rest-meets-react-self-improvement-for-multi","paper_date":"2023-12-15","arxiv_id":"2312.10003","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-coqa","slug":"question-answering-on-coqa","dataset":"CoQA","dataset_url":"/dataset/coqa","rows_in_archive":9,"metrics":["In-domain","Out-of-domain","Overall"],"first_row_in_archive_order":{"model":"BERT Large Augmented (single model)","paper_title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","paper_url":"/paper/bert-pre-training-of-deep-bidirectional","paper_date":"2018-10-11","arxiv_id":"1810.04805","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp"},{"title":"labmlai/annotated_deep_learning_paper_implementations","url":"https://github.com/labmlai/annotated_deep_learning_paper_implementations"},{"title":"google-research/bert","url":"https://github.com/google-research/bert"},{"title":"graykode/nlp-tutorial","url":"https://github.com/graykode/nlp-tutorial"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP"},{"title":"brightmart/text_classification","url":"https://github.com/brightmart/text_classification"},{"title":"PaddlePaddle/models","url":"https://github.com/PaddlePaddle/models"},{"title":"codertimo/BERT-pytorch","url":"https://github.com/codertimo/BERT-pytorch"},{"title":"bentrevett/pytorch-sentiment-analysis","url":"https://github.com/bentrevett/pytorch-sentiment-analysis"},{"title":"pytorch/text","url":"https://github.com/pytorch/text"},{"title":"shreyashankar/gpt3-sandbox","url":"https://github.com/shreyashankar/gpt3-sandbox"},{"title":"brightmart/roberta_zh","url":"https://github.com/brightmart/roberta_zh"},{"title":"dmlc/gluon-nlp","url":"https://github.com/dmlc/gluon-nlp"},{"title":"CyberZHG/keras-bert","url":"https://github.com/CyberZHG/keras-bert"},{"title":"alibaba/EasyNLP","url":"https://github.com/alibaba/EasyNLP"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"deepset-ai/FARM","url":"https://github.com/deepset-ai/FARM"},{"title":"ProsusAI/finBERT","url":"https://github.com/ProsusAI/finBERT"},{"title":"yoshitomo-matsubara/torchdistill","url":"https://github.com/yoshitomo-matsubara/torchdistill"},{"title":"Tencent/TurboTransformers","url":"https://github.com/Tencent/TurboTransformers"},{"title":"kyzhouhzau/BERT-NER","url":"https://github.com/kyzhouhzau/BERT-NER"},{"title":"kamalkraj/BERT_NER","url":"https://github.com/kamalkraj/BERT_NER"},{"title":"lonePatient/Bert-Multi-Label-Text-Classification","url":"https://github.com/lonePatient/Bert-Multi-Label-Text-Classification"},{"title":"Y1ran/NLP-BERT--ChineseVersion","url":"https://github.com/Y1ran/NLP-BERT--ChineseVersion"},{"title":"lukemelas/PyTorch-Pretrained-ViT","url":"https://github.com/lukemelas/PyTorch-Pretrained-ViT"},{"title":"kpe/bert-for-tf2","url":"https://github.com/kpe/bert-for-tf2"},{"title":"IndicoDataSolutions/finetune","url":"https://github.com/IndicoDataSolutions/finetune"},{"title":"Unbabel/COMET","url":"https://github.com/Unbabel/COMET"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"dhlee347/pytorchic-bert","url":"https://github.com/dhlee347/pytorchic-bert"},{"title":"google/seqio","url":"https://github.com/google/seqio"},{"title":"re-search/DocProduct","url":"https://github.com/re-search/DocProduct"},{"title":"kpot/keras-transformer","url":"https://github.com/kpot/keras-transformer"},{"title":"imgarylai/bert-embedding","url":"https://github.com/imgarylai/bert-embedding"},{"title":"lemonhu/ner-bert-pytorch","url":"https://github.com/lemonhu/ner-bert-pytorch"},{"title":"R1j1t/contextualSpellCheck","url":"https://github.com/R1j1t/contextualSpellCheck"},{"title":"sberbank-ai/ner-bert","url":"https://github.com/sberbank-ai/ner-bert"},{"title":"kamalkraj/BERT-SQuAD","url":"https://github.com/kamalkraj/BERT-SQuAD"},{"title":"Microsoft/AzureML-BERT","url":"https://github.com/Microsoft/AzureML-BERT"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"thu-keg/omnievent","url":"https://github.com/thu-keg/omnievent"},{"title":"pengming617/bert_classification","url":"https://github.com/pengming617/bert_classification"},{"title":"awslabs/mlm-scoring","url":"https://github.com/awslabs/mlm-scoring"},{"title":"piegu/language-models","url":"https://github.com/piegu/language-models"},{"title":"charles9n/bert-sklearn","url":"https://github.com/charles9n/bert-sklearn"},{"title":"kyubyong/bert_ner","url":"https://github.com/kyubyong/bert_ner"},{"title":"louis-udm/ner-bert-crf","url":"https://github.com/louis-udm/ner-bert-crf"},{"title":"volcengine/vegiantmodel","url":"https://github.com/volcengine/vegiantmodel"},{"title":"AtmaHou/MetaDialog","url":"https://github.com/AtmaHou/MetaDialog"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/tree/master/official/nlp/bert"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/tree/master/official/nlp/bert_thor"},{"title":"salesforce/GeDi","url":"https://github.com/salesforce/GeDi"},{"title":"helboukkouri/character-bert","url":"https://github.com/helboukkouri/character-bert"},{"title":"meelfy/pytorch_pretrained_bert","url":"https://github.com/meelfy/pytorch_pretrained_bert"},{"title":"google-deepmind/xquad","url":"https://github.com/google-deepmind/xquad"},{"title":"deepmind/xquad","url":"https://github.com/deepmind/xquad"},{"title":"BinWang28/BERT_Sentence_Embedding","url":"https://github.com/BinWang28/BERT_Sentence_Embedding"},{"title":"BinWang28/SBERT-WK-Sentence-Embedding","url":"https://github.com/BinWang28/SBERT-WK-Sentence-Embedding"},{"title":"glassroom/heinsen_routing","url":"https://github.com/glassroom/heinsen_routing"},{"title":"chiayewken/bert-qa","url":"https://github.com/chiayewken/bert-qa"},{"title":"chambliss/Multilingual_NER","url":"https://github.com/chambliss/Multilingual_NER"},{"title":"epfml/collaborative-attention","url":"https://github.com/epfml/collaborative-attention"},{"title":"manideep2510/siamese-BERT-fake-news-detection-LIAR","url":"https://github.com/manideep2510/siamese-BERT-fake-news-detection-LIAR"},{"title":"chujiezheng/ChID-Dataset","url":"https://github.com/chujiezheng/ChID-Dataset"},{"title":"zhengcj1/ChID-Dataset","url":"https://github.com/zhengcj1/ChID-Dataset"},{"title":"lvyufeng/mindspore-nlp-tutorial","url":"https://github.com/lvyufeng/mindspore-nlp-tutorial"},{"title":"wenhuchen/HDSA-Dialog","url":"https://github.com/wenhuchen/HDSA-Dialog"},{"title":"KeithGalli/pycon2020","url":"https://github.com/KeithGalli/pycon2020"},{"title":"ymcui/LAMB_Optimizer_TF","url":"https://github.com/ymcui/LAMB_Optimizer_TF"},{"title":"Sanyuan-Chen/RecAdam","url":"https://github.com/Sanyuan-Chen/RecAdam"},{"title":"mindspore-lab/mindnlp","url":"https://github.com/mindspore-lab/mindnlp/blob/master/mindnlp/models/bert/bert.py"},{"title":"ganeshjawahar/interpret_bert","url":"https://github.com/ganeshjawahar/interpret_bert"},{"title":"joongbo/tta","url":"https://github.com/joongbo/tta"},{"title":"dreamgonfly/BERT-pytorch","url":"https://github.com/dreamgonfly/BERT-pytorch"},{"title":"yifding/hetseq","url":"https://github.com/yifding/hetseq"},{"title":"musixmatchresearch/umberto","url":"https://github.com/musixmatchresearch/umberto"},{"title":"lonePatient/BERT-chinese-text-classification-pytorch","url":"https://github.com/lonePatient/BERT-chinese-text-classification-pytorch"},{"title":"athms/learning-from-brains","url":"https://github.com/athms/learning-from-brains"},{"title":"MLH-Fellowship/Social-BERTerfly","url":"https://github.com/MLH-Fellowship/Social-BERTerfly"},{"title":"Kyubyong/bert-token-embeddings","url":"https://github.com/Kyubyong/bert-token-embeddings"},{"title":"wzzzd/LM_NER","url":"https://github.com/wzzzd/LM_NER"},{"title":"writerai/fitbert","url":"https://github.com/writerai/fitbert"},{"title":"Qordobacode/fitbert","url":"https://github.com/Qordobacode/fitbert"},{"title":"okanvk/ENELPI---Soru-Cevap-Sistemi","url":"https://github.com/okanvk/ENELPI---Soru-Cevap-Sistemi"},{"title":"okanvk/Turkish-Reading-Comprehension-Question-Answering-Dataset","url":"https://github.com/okanvk/Turkish-Reading-Comprehension-Question-Answering-Dataset"},{"title":"whqwill/seq2seq-keyphrase-bert","url":"https://github.com/whqwill/seq2seq-keyphrase-bert"},{"title":"sagorbrur/bangla-bert","url":"https://github.com/sagorbrur/bangla-bert"},{"title":"avichaychriqui/HeBERT","url":"https://github.com/avichaychriqui/HeBERT"},{"title":"deepmipt/Slavic-BERT-NER","url":"https://github.com/deepmipt/Slavic-BERT-NER"},{"title":"reppy4620/Dialog","url":"https://github.com/reppy4620/Dialog"},{"title":"airsplay/vimpac","url":"https://github.com/airsplay/vimpac"},{"title":"huanghonggit/Mask-Language-Model","url":"https://github.com/huanghonggit/Mask-Language-Model"},{"title":"maknotavailable/pytorch-pretrained-bert","url":"https://github.com/maknotavailable/pytorch-pretrained-bert"},{"title":"Skumarr53/Attention-is-All-you-Need-PyTorch","url":"https://github.com/Skumarr53/Attention-is-All-you-Need-PyTorch"},{"title":"deping-1/2019-false-news-detection-challenge","url":"https://github.com/deping-1/2019-false-news-detection-challenge"},{"title":"lvyufeng/Cybertron","url":"https://github.com/lvyufeng/Cybertron/blob/master/cybertron/models/bert.py"},{"title":"babelscape/wikineural","url":"https://github.com/babelscape/wikineural"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms"},{"title":"aws-samples/amazon-sagemaker-bert-pytorch","url":"https://github.com/aws-samples/amazon-sagemaker-bert-pytorch"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"CVxTz/music_genre_classification","url":"https://github.com/CVxTz/music_genre_classification"},{"title":"qywu/Chinese-GPT","url":"https://github.com/qywu/Chinese-GPT"},{"title":"phohenecker/pytorch-transformer","url":"https://github.com/phohenecker/pytorch-transformer"},{"title":"lonePatient/ERNIE-text-classification-pytorch","url":"https://github.com/lonePatient/ERNIE-text-classification-pytorch"},{"title":"IBM/MAX-Text-Sentiment-Classifier","url":"https://github.com/IBM/MAX-Text-Sentiment-Classifier"},{"title":"ericperfect/Bert_Position_BiLSTM_Attention_CRF_LSTMDecoder","url":"https://github.com/ericperfect/Bert_Position_BiLSTM_Attention_CRF_LSTMDecoder"},{"title":"duyunshu/bert-sentiment-analysis","url":"https://github.com/duyunshu/bert-sentiment-analysis"},{"title":"andi611/Mockingjay-Speech-Representation","url":"https://github.com/andi611/Mockingjay-Speech-Representation"},{"title":"SatyamSoni23/Smart-Question-Answering-System-on-Document","url":"https://github.com/SatyamSoni23/Smart-Question-Answering-System-on-Document"},{"title":"IBM/MAX-Toxic-Comment-Classifier","url":"https://github.com/IBM/MAX-Toxic-Comment-Classifier"},{"title":"ShivamRajSharma/Transformer-Architectures-From-Scratch","url":"https://github.com/ShivamRajSharma/Transformer-Architectures-From-Scratch"},{"title":"bit-ml/anoshift","url":"https://github.com/bit-ml/anoshift"},{"title":"skoltech-nlp/rudetoxifier","url":"https://github.com/skoltech-nlp/rudetoxifier"},{"title":"lonePatient/bert-sentence-similarity-pytorch","url":"https://github.com/lonePatient/bert-sentence-similarity-pytorch"},{"title":"tugstugi/mongolian-bert","url":"https://github.com/tugstugi/mongolian-bert"},{"title":"TeamLab/bert-gcn-for-paper-citation","url":"https://github.com/TeamLab/bert-gcn-for-paper-citation"},{"title":"wzzzd/Pretrain_Bert_with_MaskLM","url":"https://github.com/wzzzd/Pretrain_Bert_with_MaskLM"},{"title":"anton-bushuiev/ppiformer","url":"https://github.com/anton-bushuiev/ppiformer"},{"title":"Karthik-Bhaskar/Context-Based-Question-Answering","url":"https://github.com/Karthik-Bhaskar/Context-Based-Question-Answering"},{"title":"KomorebiLHX/Emotion-Recognition-in-Conversations","url":"https://github.com/KomorebiLHX/Emotion-Recognition-in-Conversations"},{"title":"stefan-it/europeana-bert","url":"https://github.com/stefan-it/europeana-bert"},{"title":"wangcongcong123/ttt","url":"https://github.com/wangcongcong123/ttt"},{"title":"khalidsaifullaah/bertify","url":"https://github.com/khalidsaifullaah/bertify"},{"title":"benywon/ReCO","url":"https://github.com/benywon/ReCO"},{"title":"thunlp/ReInfoSelect","url":"https://github.com/thunlp/ReInfoSelect"},{"title":"noise-learning/selfmix","url":"https://github.com/noise-learning/selfmix"},{"title":"lyccol/CodeBERT-based-webshell-detection","url":"https://github.com/lyccol/CodeBERT-based-webshell-detection"},{"title":"sagorbrur/codeswitch","url":"https://github.com/sagorbrur/codeswitch"},{"title":"KnightZhang625/BERT_TF","url":"https://github.com/KnightZhang625/BERT_TF"},{"title":"Farahn/AES","url":"https://github.com/Farahn/AES"},{"title":"geondopark/ckd","url":"https://github.com/geondopark/ckd"},{"title":"IBM/MAX-Question-Answering","url":"https://github.com/IBM/MAX-Question-Answering"},{"title":"benywon/ChiQA","url":"https://github.com/benywon/ChiQA"},{"title":"AdamStein97/Semi-Supervised-BERT-NER","url":"https://github.com/AdamStein97/Semi-Supervised-BERT-NER"},{"title":"LorenzoAgnolucci/BERT_for_ABSA","url":"https://github.com/LorenzoAgnolucci/BERT_for_ABSA"},{"title":"devJWSong/bert-crf-entity-recognition-pytorch","url":"https://github.com/devJWSong/bert-crf-entity-recognition-pytorch"},{"title":"ypeleg/MinimalIsAllYouNeed","url":"https://github.com/ypeleg/MinimalIsAllYouNeed"},{"title":"ilhamfp/indonesian-text-classification-multilingual","url":"https://github.com/ilhamfp/indonesian-text-classification-multilingual"},{"title":"sunyilgdx/prompts4keras","url":"https://github.com/sunyilgdx/prompts4keras"},{"title":"AutomatedProgramRepair-2021/dear-auto-fix","url":"https://github.com/AutomatedProgramRepair-2021/dear-auto-fix"},{"title":"Impavidity/relogic","url":"https://github.com/Impavidity/relogic"},{"title":"MalteHB/-l-ctra","url":"https://github.com/MalteHB/-l-ctra"},{"title":"octanove/grammartagger","url":"https://github.com/octanove/grammartagger"},{"title":"abhilash1910/BERTSimilarity","url":"https://github.com/abhilash1910/BERTSimilarity"},{"title":"overfitter/biobert_embedding","url":"https://github.com/overfitter/biobert_embedding"},{"title":"linlei1214/SITS-BERT","url":"https://github.com/linlei1214/SITS-BERT"},{"title":"benywon/ChineseBert","url":"https://github.com/benywon/ChineseBert"},{"title":"brightmart/bert_customized","url":"https://github.com/brightmart/bert_customized"},{"title":"uva-dsa/ems-pipeline","url":"https://github.com/uva-dsa/ems-pipeline"},{"title":"ElizaLo/Question-Answering-based-on-SQuAD","url":"https://github.com/ElizaLo/Question-Answering-based-on-SQuAD"},{"title":"af-ai-center/nerblackbox","url":"https://github.com/af-ai-center/nerblackbox"},{"title":"flxst/nerblackbox","url":"https://github.com/flxst/nerblackbox"},{"title":"SkullFang/BERT_NLP_Classification","url":"https://github.com/SkullFang/BERT_NLP_Classification"},{"title":"GauthierDmn/question_answering","url":"https://github.com/GauthierDmn/question_answering"},{"title":"ABaldrati/MT-BERT","url":"https://github.com/ABaldrati/MT-BERT"},{"title":"Colanim/BERT_STS-B","url":"https://github.com/Colanim/BERT_STS-B"},{"title":"guoyaohua/BERT-Chinese-Annotation","url":"https://github.com/guoyaohua/BERT-Chinese-Annotation"},{"title":"Kanishkparganiha/Named-Entity-Recognition-using-BERT-with-PyTorch","url":"https://github.com/Kanishkparganiha/Named-Entity-Recognition-using-BERT-with-PyTorch"},{"title":"mkavim/finetune_bert","url":"https://github.com/mkavim/finetune_bert"},{"title":"guoyaohua/BERT-Classifier","url":"https://github.com/guoyaohua/BERT-Classifier"},{"title":"HuihuiChyan/BJTUNLP_Practice2020","url":"https://github.com/HuihuiChyan/BJTUNLP_Practice2020"},{"title":"stefan-it/historic-ner","url":"https://github.com/stefan-it/historic-ner"},{"title":"baotramduong/Sentiment-Analysis-with-Deep-Learning-using-BERT","url":"https://github.com/baotramduong/Sentiment-Analysis-with-Deep-Learning-using-BERT"},{"title":"dbmdz/historic-ner","url":"https://github.com/dbmdz/historic-ner"},{"title":"baotramduong/Twitter-Sentiment-Analysis-with-Deep-Learning-using-BERT","url":"https://github.com/baotramduong/Twitter-Sentiment-Analysis-with-Deep-Learning-using-BERT"},{"title":"MansMeg/IntroML","url":"https://github.com/MansMeg/IntroML"},{"title":"bino282/bert4news","url":"https://github.com/bino282/bert4news"},{"title":"benywon/ComQA","url":"https://github.com/benywon/ComQA"},{"title":"madhawav/MML","url":"https://github.com/madhawav/MML"},{"title":"uygarkurt/BERT-PyTorch","url":"https://github.com/uygarkurt/BERT-PyTorch"},{"title":"xiangyue9607/CliniRC","url":"https://github.com/xiangyue9607/CliniRC"},{"title":"SindhuMadi/FakeNewsDetection","url":"https://github.com/SindhuMadi/FakeNewsDetection"},{"title":"xiuyu0000/new_papers_codes","url":"https://github.com/xiuyu0000/new_papers_codes/tree/main/bert"},{"title":"ambityga/memsem","url":"https://github.com/ambityga/memsem"},{"title":"debnsuma/Intro-Transformer-BERT","url":"https://github.com/debnsuma/Intro-Transformer-BERT"},{"title":"cybertronai/megatron-lm","url":"https://github.com/cybertronai/megatron-lm"},{"title":"smarton-empower/smarton-ai","url":"https://github.com/smarton-empower/smarton-ai"},{"title":"SAP-samples/acl2019-commonsense","url":"https://github.com/SAP-samples/acl2019-commonsense"},{"title":"SAP-samples/acl2019-commonsense-reasoning","url":"https://github.com/SAP-samples/acl2019-commonsense-reasoning"},{"title":"lcs2-iiitd/emotion-flip-reasoning","url":"https://github.com/lcs2-iiitd/emotion-flip-reasoning"},{"title":"han-shi/SparseBERT","url":"https://github.com/han-shi/SparseBERT"},{"title":"davidbellamy/labrador","url":"https://github.com/davidbellamy/labrador"},{"title":"heraclex12/vietpunc","url":"https://github.com/heraclex12/vietpunc"},{"title":"DimasDMM/nlp-completer","url":"https://github.com/DimasDMM/nlp-completer"},{"title":"af-ai-center/bert","url":"https://github.com/af-ai-center/bert"},{"title":"Jackma3/NER-Bert-BiLstm","url":"https://github.com/Jackma3/NER-Bert-BiLstm"},{"title":"eagle705/bert","url":"https://github.com/eagle705/bert"},{"title":"DimasDMM/transformers","url":"https://github.com/DimasDMM/transformers"},{"title":"fancyerii/bert","url":"https://github.com/fancyerii/bert"},{"title":"cedrickchee/pytorch-pretrained-BERT","url":"https://github.com/cedrickchee/pytorch-pretrained-BERT"},{"title":"Susheel-1999/Sentence_Similarity","url":"https://github.com/Susheel-1999/Sentence_Similarity"},{"title":"xiaopingzhong/bert-finetune-for-classfier","url":"https://github.com/xiaopingzhong/bert-finetune-for-classfier"},{"title":"SYangDong/bert-with-frozen-code","url":"https://github.com/SYangDong/bert-with-frozen-code"},{"title":"tree-park/bert-pretrainer","url":"https://github.com/tree-park/bert-pretrainer"},{"title":"abhilashreddys/Fake-News-Article","url":"https://github.com/abhilashreddys/Fake-News-Article"},{"title":"autobotasia/vibert","url":"https://github.com/autobotasia/vibert"},{"title":"rasta-nitzsche/Bert-For-Algerian-Dialect-DariBERTo","url":"https://github.com/rasta-nitzsche/Bert-For-Algerian-Dialect-DariBERTo"},{"title":"tobyatgithub/bert_tutorial","url":"https://github.com/tobyatgithub/bert_tutorial"},{"title":"Holldean/BERT-Pruning","url":"https://github.com/Holldean/BERT-Pruning"},{"title":"mindspore-courses/ABSA-MindSpore","url":"https://github.com/mindspore-courses/ABSA-MindSpore"},{"title":"theneuralbeing/bert-finetuning-webinar","url":"https://github.com/theneuralbeing/bert-finetuning-webinar"},{"title":"HuihuiChyan/BJTUNLP_Practice2021","url":"https://github.com/HuihuiChyan/BJTUNLP_Practice2021"},{"title":"nerdimite/bert-finetuning-webinar","url":"https://github.com/nerdimite/bert-finetuning-webinar"},{"title":"soutsios/pos-tagger-bert-tensorflow","url":"https://github.com/soutsios/pos-tagger-bert-tensorflow"},{"title":"hate-alert/indicabusive","url":"https://github.com/hate-alert/indicabusive"},{"title":"viniciusoliveirasd/bert-applications","url":"https://github.com/viniciusoliveirasd/bert-applications"},{"title":"EssayKillerBrain/NLP-BERT-Chinese","url":"https://github.com/EssayKillerBrain/NLP-BERT-Chinese"},{"title":"lehoanganh298/BERT-Question-Answering","url":"https://github.com/lehoanganh298/BERT-Question-Answering"},{"title":"derronxu/sparsebert","url":"https://github.com/derronxu/sparsebert"},{"title":"kelly2016/multi-label-bert","url":"https://github.com/kelly2016/multi-label-bert"},{"title":"nicolashernandez/readi-lrec22","url":"https://github.com/nicolashernandez/readi-lrec22"},{"title":"circlePi/BERT_Chinese_Text_Class_By_pytorch","url":"https://github.com/circlePi/BERT_Chinese_Text_Class_By_pytorch"},{"title":"gcunhase/embracebert","url":"https://github.com/gcunhase/embracebert"},{"title":"zer0sh0t/artificial_intelligence","url":"https://github.com/zer0sh0t/artificial_intelligence/tree/master/language_models/bidirectional_encoder_representations_from_transformers"},{"title":"anupamsingh610/bert_ner_stride","url":"https://github.com/anupamsingh610/bert_ner_stride"},{"title":"itsShnik/adaptively-finetuning-transformers","url":"https://github.com/itsShnik/adaptively-finetuning-transformers"},{"title":"DylanCope/Image-Captioning-with-Bimodal-Transformers","url":"https://github.com/DylanCope/Image-Captioning-with-Bimodal-Transformers"},{"title":"sydney-machine-learning/sentimentanalysis-uselections","url":"https://github.com/sydney-machine-learning/sentimentanalysis-uselections"},{"title":"arkel23/PyTorch-Pretrained-ViT","url":"https://github.com/arkel23/PyTorch-Pretrained-ViT"},{"title":"hegebharat/sentiment-Analysis-for-German-Datasets","url":"https://github.com/hegebharat/sentiment-Analysis-for-German-Datasets"},{"title":"deepmipt/bert","url":"https://github.com/deepmipt/bert/tree/feat/multi_gpu"},{"title":"ManasRMohanty/DS5500-capstone","url":"https://github.com/ManasRMohanty/DS5500-capstone"},{"title":"Raman-Raje/Machine-Reading-Comprehension-Neural-Question-Answer-","url":"https://github.com/Raman-Raje/Machine-Reading-Comprehension-Neural-Question-Answer-"},{"title":"karta282950/bert-multiclass","url":"https://github.com/karta282950/bert-multiclass"},{"title":"om00839/machine-suneung","url":"https://github.com/om00839/machine-suneung"},{"title":"jungomi/swiss-language-model","url":"https://github.com/jungomi/swiss-language-model"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"asgaardlab/test-case-similarity-technique","url":"https://github.com/asgaardlab/test-case-similarity-technique"},{"title":"rajlm10/Chandler","url":"https://github.com/rajlm10/Chandler"},{"title":"harenlin/IMDB-Sentiment-Analysis-Using-BERT-Fine-Tuning","url":"https://github.com/harenlin/IMDB-Sentiment-Analysis-Using-BERT-Fine-Tuning"},{"title":"noelkelias/multitok","url":"https://github.com/noelkelias/multitok"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"arielsho/decomposition-table-reasoning","url":"https://github.com/arielsho/decomposition-table-reasoning"},{"title":"scotthlee/injury_autocoding","url":"https://github.com/scotthlee/injury_autocoding"},{"title":"broccolik/BERT-NER","url":"https://github.com/broccolik/BERT-NER"},{"title":"abhaskumarsinha/Keras-implementation-of-Transformer-Architecture","url":"https://github.com/abhaskumarsinha/Keras-implementation-of-Transformer-Architecture"},{"title":"vmware-labs/bert-pretraining","url":"https://github.com/vmware-labs/bert-pretraining"},{"title":"RonRaifer/BERT-Ghazali","url":"https://github.com/RonRaifer/BERT-Ghazali"},{"title":"kobowon/cs470_project_version2","url":"https://github.com/kobowon/cs470_project_version2"},{"title":"venkyr91193/Sentiment-Analysis-with-BERT","url":"https://github.com/venkyr91193/Sentiment-Analysis-with-BERT"},{"title":"ltgoslo/assessing_and_probing_sentiment","url":"https://github.com/ltgoslo/assessing_and_probing_sentiment"},{"title":"LeoWood/bert-horovod","url":"https://github.com/LeoWood/bert-horovod"},{"title":"mocherson/aki_bert","url":"https://github.com/mocherson/aki_bert"},{"title":"polzinben/TensorFlow_NLP","url":"https://github.com/polzinben/TensorFlow_NLP"},{"title":"siramatu/brigade-visualizer","url":"https://github.com/siramatu/brigade-visualizer"},{"title":"samirsahoo007/Audio-and-Speech-Processing","url":"https://github.com/samirsahoo007/Audio-and-Speech-Processing"},{"title":"Doffery/BERT-Sentiment-Analysis-Amazon-Review","url":"https://github.com/Doffery/BERT-Sentiment-Analysis-Amazon-Review"},{"title":"venkyr91193/Sentiment_Analysis_with_BERT","url":"https://github.com/venkyr91193/Sentiment_Analysis_with_BERT"},{"title":"why2000/DuReader-bert","url":"https://github.com/why2000/DuReader-bert"},{"title":"weidafeng/NLU2019","url":"https://github.com/weidafeng/NLU2019"},{"title":"theQuert/inlpfun","url":"https://github.com/theQuert/inlpfun"},{"title":"johnr0/TaleBrush-backend","url":"https://github.com/johnr0/TaleBrush-backend"},{"title":"Jun-Zhang-32108/Sentiment-Analysis","url":"https://github.com/Jun-Zhang-32108/Sentiment-Analysis"},{"title":"MS-Mind/MS-Code-01","url":"https://github.com/MS-Mind/MS-Code-01/tree/main/soft_masked_bert"},{"title":"gouwenrui/cpe-pro-main","url":"https://github.com/gouwenrui/cpe-pro-main"},{"title":"2024-MindSpore-1/Code3","url":"https://github.com/2024-MindSpore-1/Code3/tree/main/scBERT"},{"title":"hoangtrungchinh/Bert-SQuAD-v2","url":"https://github.com/hoangtrungchinh/Bert-SQuAD-v2"},{"title":"nageshsinghc4/deepwrap","url":"https://github.com/nageshsinghc4/deepwrap"},{"title":"ArvinZhuang/BiTAG","url":"https://github.com/ArvinZhuang/BiTAG"},{"title":"eaishwa/quora-ques-pair-similarity","url":"https://github.com/eaishwa/quora-ques-pair-similarity"},{"title":"rohanshad/cmr_transformer","url":"https://github.com/rohanshad/cmr_transformer"},{"title":"MichaelZhouwang/LMlexsub","url":"https://github.com/MichaelZhouwang/LMlexsub"},{"title":"the-Quert/iNLPfun","url":"https://github.com/the-Quert/iNLPfun"},{"title":"Coda-s/BJTU_NLP_Practice","url":"https://github.com/Coda-s/BJTU_NLP_Practice"},{"title":"goldenbili/bert_lamb_pretrain","url":"https://github.com/goldenbili/bert_lamb_pretrain"},{"title":"MaZhiyuanBUAA/bert-tf1.4.0","url":"https://github.com/MaZhiyuanBUAA/bert-tf1.4.0"},{"title":"dispink/xpt","url":"https://github.com/dispink/xpt"},{"title":"mirbostani/QA-KD-AL","url":"https://github.com/mirbostani/QA-KD-AL"},{"title":"abhineet/sentence_classification_pubmed_scibert","url":"https://github.com/abhineet/sentence_classification_pubmed_scibert"},{"title":"frankcgq105/BERTCHEN","url":"https://github.com/frankcgq105/BERTCHEN"},{"title":"Kerram/Deephol-Bert-Zpp","url":"https://github.com/Kerram/Deephol-Bert-Zpp"},{"title":"cospplay/bert-master","url":"https://github.com/cospplay/bert-master"},{"title":"YuanEric88/bert-nlu","url":"https://github.com/YuanEric88/bert-nlu"},{"title":"yuelinan/c3vg","url":"https://github.com/yuelinan/c3vg"},{"title":"Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-","url":"https://github.com/Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-"},{"title":"scut-bds/example_repo_from_scutbds","url":"https://github.com/scut-bds/example_repo_from_scutbds"},{"title":"Alihassan7726/Multi-Class-classification-using-BERT-","url":"https://github.com/Alihassan7726/Multi-Class-classification-using-BERT-"},{"title":"kriesbeck/masked-language-prediction","url":"https://github.com/kriesbeck/masked-language-prediction"},{"title":"IMPLabUniPr/UniParma-at-semeval-2021-task-5","url":"https://github.com/IMPLabUniPr/UniParma-at-semeval-2021-task-5"},{"title":"SumitM0432/Quora-Insincere-Questions-Classification","url":"https://github.com/SumitM0432/Quora-Insincere-Questions-Classification"},{"title":"MS-P3/code5","url":"https://github.com/MS-P3/code5/tree/main/bert"},{"title":"AbhishekD15/Sentiment-Analysis_BERT","url":"https://github.com/AbhishekD15/Sentiment-Analysis_BERT"},{"title":"Misoknisky/Bert-MultiGpu","url":"https://github.com/Misoknisky/Bert-MultiGpu"},{"title":"thethirdwheel/malumagraph","url":"https://github.com/thethirdwheel/malumagraph"},{"title":"cmunnis/BERT_vs_Transformer-XL","url":"https://github.com/cmunnis/BERT_vs_Transformer-XL"},{"title":"brightmart/bert_original","url":"https://github.com/brightmart/bert_original"},{"title":"JNUpython/bert","url":"https://github.com/JNUpython/bert"},{"title":"Zeeshan75/Bert_Telugu_Ner","url":"https://github.com/Zeeshan75/Bert_Telugu_Ner"},{"title":"AGiannoutsos/COVID19-document-retrieval-with-BERT","url":"https://github.com/AGiannoutsos/COVID19-document-retrieval-with-BERT"},{"title":"BirgerMoell/bertcastle","url":"https://github.com/BirgerMoell/bertcastle"},{"title":"BroCoLySTyLe/SQLovaReview","url":"https://github.com/BroCoLySTyLe/SQLovaReview"},{"title":"tornermarton/bert-keras","url":"https://github.com/tornermarton/bert-keras"},{"title":"YongWookHa/BERT-on-Pytorch-Template","url":"https://github.com/YongWookHa/BERT-on-Pytorch-Template"},{"title":"yanzhitech/bert","url":"https://github.com/yanzhitech/bert"},{"title":"common-english/bert-all","url":"https://github.com/common-english/bert-all"},{"title":"JMSaindon/NlpSquad","url":"https://github.com/JMSaindon/NlpSquad"},{"title":"amauriciorr/AubreyBot","url":"https://github.com/amauriciorr/AubreyBot"},{"title":"Nilanshrajput/Intent_classification","url":"https://github.com/Nilanshrajput/Intent_classification"},{"title":"wyf-python/Bert-Pytorch-TextClassification","url":"https://github.com/wyf-python/Bert-Pytorch-TextClassification"},{"title":"teghub/TurkishNER-BERT","url":"https://github.com/teghub/TurkishNER-BERT"},{"title":"SpikeKing/My-Bert","url":"https://github.com/SpikeKing/My-Bert"},{"title":"sonalisrijan/Deep-Learning-based-Defect-Prediction-Model-for-Source-Code","url":"https://github.com/sonalisrijan/Deep-Learning-based-Defect-Prediction-Model-for-Source-Code"},{"title":"avishek-018/single_notebook_projects","url":"https://github.com/avishek-018/single_notebook_projects"},{"title":"gbcolborne/lang_id","url":"https://github.com/gbcolborne/lang_id"},{"title":"krantirk/BERT-Pretrained-model","url":"https://github.com/krantirk/BERT-Pretrained-model"},{"title":"saravanakumarjsk/BERT-collection","url":"https://github.com/saravanakumarjsk/BERT-collection"},{"title":"Katsumata420/bert_mlm","url":"https://github.com/Katsumata420/bert_mlm"},{"title":"socc-io/piqaboo","url":"https://github.com/socc-io/piqaboo"},{"title":"a414351664/Bert_MRC","url":"https://github.com/a414351664/Bert_MRC"},{"title":"zaaztt/bert_chinese_example","url":"https://github.com/zaaztt/bert_chinese_example"},{"title":"mayurnewase/Quora-Bert","url":"https://github.com/mayurnewase/Quora-Bert"},{"title":"Eeun-ju/NLP-study","url":"https://github.com/Eeun-ju/NLP-study"},{"title":"ricardordb/bert","url":"https://github.com/ricardordb/bert"},{"title":"luckynozomi/PPI_Bert","url":"https://github.com/luckynozomi/PPI_Bert"},{"title":"surancy/nlp-classification-with-BERT","url":"https://github.com/surancy/nlp-classification-with-BERT"},{"title":"hoichunlaw/COVID-BERT","url":"https://github.com/hoichunlaw/COVID-BERT"},{"title":"evtaktasheva/dependency_extraction","url":"https://github.com/evtaktasheva/dependency_extraction"},{"title":"flyliu2017/bert","url":"https://github.com/flyliu2017/bert"},{"title":"Guowei-Yan/Data","url":"https://github.com/Guowei-Yan/Data"},{"title":"h4ste/oscar","url":"https://github.com/h4ste/oscar"},{"title":"lkfo415579/MT-Readling-List","url":"https://github.com/lkfo415579/MT-Readling-List"},{"title":"vanslerry/long_text","url":"https://github.com/vanslerry/long_text"},{"title":"debnsuma/AmazonSageMaker101","url":"https://github.com/debnsuma/AmazonSageMaker101"},{"title":"jsantoso2/yelp-clone-ml-project","url":"https://github.com/jsantoso2/yelp-clone-ml-project"},{"title":"goldenbili/Bert_Test3","url":"https://github.com/goldenbili/Bert_Test3"},{"title":"coco60/bert-test","url":"https://github.com/coco60/bert-test"},{"title":"vanpersie32/Multigpu-Bert","url":"https://github.com/vanpersie32/Multigpu-Bert"},{"title":"danlim-wz/analysis_of_social_media_data_about_singapore","url":"https://github.com/danlim-wz/analysis_of_social_media_data_about_singapore"},{"title":"nicholasbao/nlp_job","url":"https://github.com/nicholasbao/nlp_job"},{"title":"shaikhzhas/bert","url":"https://github.com/shaikhzhas/bert"},{"title":"somiltg/xquad","url":"https://github.com/somiltg/xquad"},{"title":"xbtlin/All-about-Machine-Learning","url":"https://github.com/xbtlin/All-about-Machine-Learning"},{"title":"meizi1114/bert","url":"https://github.com/meizi1114/bert"},{"title":"ufal/wembedding_service","url":"https://github.com/ufal/wembedding_service"},{"title":"nmfisher/bert-modified","url":"https://github.com/nmfisher/bert-modified"},{"title":"JA-Bar/nlp-depression","url":"https://github.com/JA-Bar/nlp-depression"},{"title":"OweysMomenzada/Evergreen-Content-Classifier-for-german-Text","url":"https://github.com/OweysMomenzada/Evergreen-Content-Classifier-for-german-Text"},{"title":"wchh127/yykf","url":"https://github.com/wchh127/yykf"},{"title":"nalbarr/coursera-ai4med-course3","url":"https://github.com/nalbarr/coursera-ai4med-course3"},{"title":"appcoreopc/berty","url":"https://github.com/appcoreopc/berty"},{"title":"fabiocorreacordeiro/Elsevier_abstracts-Classification","url":"https://github.com/fabiocorreacordeiro/Elsevier_abstracts-Classification"},{"title":"Nstats/my_bert","url":"https://github.com/Nstats/my_bert"},{"title":"LoveYang/bert_test","url":"https://github.com/LoveYang/bert_test"},{"title":"mohamedateya/bert-fine-tuning-sentence-classification-for-cola","url":"https://github.com/mohamedateya/bert-fine-tuning-sentence-classification-for-cola"},{"title":"qbxlvnf11/pretrained-language-model-BERT","url":"https://github.com/qbxlvnf11/pretrained-language-model-BERT"},{"title":"davidsvaughn/dts-tf","url":"https://github.com/davidsvaughn/dts-tf"},{"title":"Alihassan7726/Fine-tuning-BERT-for-semantic-sentence-pairs-classification","url":"https://github.com/Alihassan7726/Fine-tuning-BERT-for-semantic-sentence-pairs-classification"},{"title":"xiuyu0000/tutorials","url":"https://github.com/xiuyu0000/tutorials/tree/main/bert"},{"title":"habibullah-araphat/BERT-NER-TPU","url":"https://github.com/habibullah-araphat/BERT-NER-TPU"},{"title":"RxstydnR/Stock_BERT","url":"https://github.com/RxstydnR/Stock_BERT"},{"title":"Vladimetr/ASR-Knowledge-Transferring","url":"https://github.com/Vladimetr/ASR-Knowledge-Transferring"},{"title":"AhmedYounes94/Semi-supervised-BERT-NER","url":"https://github.com/AhmedYounes94/Semi-supervised-BERT-NER"},{"title":"mtzcorporations/nlp_teamjodka","url":"https://github.com/mtzcorporations/nlp_teamjodka"},{"title":"darr/nerbert","url":"https://github.com/darr/nerbert"},{"title":"EuphoriaYan/bert_component","url":"https://github.com/EuphoriaYan/bert_component"},{"title":"Hibb-bb/ALLM","url":"https://github.com/Hibb-bb/ALLM"},{"title":"bcaitech1/p2-klue-Heeseok-Jeong","url":"https://github.com/bcaitech1/p2-klue-Heeseok-Jeong"},{"title":"binhetech/bert-application","url":"https://github.com/binhetech/bert-application"},{"title":"hegebharat/SelfDiscovery","url":"https://github.com/hegebharat/SelfDiscovery"},{"title":"Chonwai/Learning_BERT","url":"https://github.com/Chonwai/Learning_BERT"},{"title":"tdd-ai/data-collection","url":"https://github.com/tdd-ai/data-collection"},{"title":"MINGG2333/bert_ms","url":"https://github.com/MINGG2333/bert_ms"},{"title":"junhahyung/bert_finetune","url":"https://github.com/junhahyung/bert_finetune"},{"title":"Kosuke-Szk/BERT-NER-ja","url":"https://github.com/Kosuke-Szk/BERT-NER-ja"},{"title":"jageshmaharjan/BERT_Service","url":"https://github.com/jageshmaharjan/BERT_Service"},{"title":"MarcosGrzeca/drunktweets","url":"https://github.com/MarcosGrzeca/drunktweets"},{"title":"jiyuan/ainote","url":"https://github.com/jiyuan/ainote"},{"title":"qbxlvnf11/contextualized-embedding-BERT","url":"https://github.com/qbxlvnf11/contextualized-embedding-BERT"},{"title":"TOSHISTATS/Classification-of-Japanese-news-with-BERT","url":"https://github.com/TOSHISTATS/Classification-of-Japanese-news-with-BERT"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"lennonzurich/lalala","url":"https://github.com/lennonzurich/lalala"},{"title":"qbxlvnf11/BERT","url":"https://github.com/qbxlvnf11/BERT"},{"title":"Nstats/bert_senti_analysis_ch","url":"https://github.com/Nstats/bert_senti_analysis_ch"},{"title":"flyliu2017/bert_modularized","url":"https://github.com/flyliu2017/bert_modularized"},{"title":"xuzhezhaozhao/bert_reading","url":"https://github.com/xuzhezhaozhao/bert_reading"},{"title":"kiko441500/google_bert","url":"https://github.com/kiko441500/google_bert"},{"title":"abhiagg92/bert_sentiment","url":"https://github.com/abhiagg92/bert_sentiment"},{"title":"Zehui127/SQUAD_BERT","url":"https://github.com/Zehui127/SQUAD_BERT"},{"title":"UnknownGenie/altered-BERT-KPE","url":"https://github.com/UnknownGenie/altered-BERT-KPE"},{"title":"guzhang480/Google_BERT","url":"https://github.com/guzhang480/Google_BERT"},{"title":"RenXiangyuan/tf_bert","url":"https://github.com/RenXiangyuan/tf_bert"},{"title":"crx934080895/Bert-CRF_New2","url":"https://github.com/crx934080895/Bert-CRF_New2"},{"title":"diabhaque/Sixth-Sense","url":"https://github.com/diabhaque/Sixth-Sense"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"itspreeti25/Q-A-implementation-using-BERT-finetuned-on-multiple-datasets","url":"https://github.com/itspreeti25/Q-A-implementation-using-BERT-finetuned-on-multiple-datasets"},{"title":"gggggeun/DeepLearning_Architecture","url":"https://github.com/gggggeun/DeepLearning_Architecture"},{"title":"aaronHuang0121/AI-CUP-2020","url":"https://github.com/aaronHuang0121/AI-CUP-2020"},{"title":"pisalore/roberta_results","url":"https://github.com/pisalore/roberta_results"},{"title":"rohan400/PepperQA","url":"https://github.com/rohan400/PepperQA"},{"title":"StoneGH/bert","url":"https://github.com/StoneGH/bert"},{"title":"xiaopp123/bert_explain","url":"https://github.com/xiaopp123/bert_explain"},{"title":"JeheonPark596/sentimentsurvival","url":"https://github.com/JeheonPark596/sentimentsurvival"},{"title":"Xinsen-Zhang/transformer","url":"https://github.com/Xinsen-Zhang/transformer"},{"title":"MOHAMEDELDAKDOUKY/bert_adjusted","url":"https://github.com/MOHAMEDELDAKDOUKY/bert_adjusted"},{"title":"StuartCHAN/KARL","url":"https://github.com/StuartCHAN/KARL"},{"title":"goodluck4s/bert-","url":"https://github.com/goodluck4s/bert-"},{"title":"thecodemasterk/BERT","url":"https://github.com/thecodemasterk/BERT"},{"title":"dzqjorking/transpose","url":"https://github.com/dzqjorking/transpose"},{"title":"pingheng001/Cnn-Bert","url":"https://github.com/pingheng001/Cnn-Bert"},{"title":"TheNeuromancer/SentEmb","url":"https://github.com/TheNeuromancer/SentEmb"},{"title":"Arthurizijar/Bert_Airport","url":"https://github.com/Arthurizijar/Bert_Airport"},{"title":"MatthewSwahn/news-headlines-sarcasm-detector","url":"https://github.com/MatthewSwahn/news-headlines-sarcasm-detector"},{"title":"epcpu/deep-nlp-links","url":"https://github.com/epcpu/deep-nlp-links"},{"title":"chunghyunhee/twitter_disaster_NLP","url":"https://github.com/chunghyunhee/twitter_disaster_NLP"},{"title":"XINZXZHANG/Bert_repo","url":"https://github.com/XINZXZHANG/Bert_repo"},{"title":"yuhangT/tf_bert","url":"https://github.com/yuhangT/tf_bert"},{"title":"mithunpaul08/bert_tensorflow","url":"https://github.com/mithunpaul08/bert_tensorflow"},{"title":"DeligientSloth/bert-tensorflow","url":"https://github.com/DeligientSloth/bert-tensorflow"},{"title":"chandu7077/mybert","url":"https://github.com/chandu7077/mybert"},{"title":"darr/nlp_work","url":"https://github.com/darr/nlp_work"},{"title":"halo090770/bert","url":"https://github.com/halo090770/bert"},{"title":"llx666/git_demo","url":"https://github.com/llx666/git_demo"},{"title":"chalothon/BERT_Practice","url":"https://github.com/chalothon/BERT_Practice"},{"title":"ps2811/Bert-Multi-Label-Text-Classification-GitVersion","url":"https://github.com/ps2811/Bert-Multi-Label-Text-Classification-GitVersion"},{"title":"SCismycat/bert_code_view","url":"https://github.com/SCismycat/bert_code_view"},{"title":"karenacorn99/explore-bert","url":"https://github.com/karenacorn99/explore-bert"},{"title":"uabinf/nlp-fall-2019-project-shuhui_shuqu","url":"https://github.com/uabinf/nlp-fall-2019-project-shuhui_shuqu"},{"title":"knuddy/op_text","url":"https://github.com/knuddy/op_text"},{"title":"jinzhenfan/BERT","url":"https://github.com/jinzhenfan/BERT"},{"title":"Nimesh-Patel/BERT","url":"https://github.com/Nimesh-Patel/BERT"},{"title":"knuddj1/op_text","url":"https://github.com/knuddj1/op_text"},{"title":"FaskyCC/TextClassification","url":"https://github.com/FaskyCC/TextClassification"},{"title":"tvinith/bert","url":"https://github.com/tvinith/bert"},{"title":"nachiketaa/bert","url":"https://github.com/nachiketaa/bert"},{"title":"nachiketaa/BERT-pytorch","url":"https://github.com/nachiketaa/BERT-pytorch"},{"title":"Dongcf/Pytorch_Bert_Text_Classification","url":"https://github.com/Dongcf/Pytorch_Bert_Text_Classification"},{"title":"rickyHong/Google-BERT-repl","url":"https://github.com/rickyHong/Google-BERT-repl"},{"title":"EthanWYB/bert-classification","url":"https://github.com/EthanWYB/bert-classification"},{"title":"DataScienceNigeria/Supervised-NLP-from-Facebook-AI-Team","url":"https://github.com/DataScienceNigeria/Supervised-NLP-from-Facebook-AI-Team"},{"title":"maxudong1993/mybert","url":"https://github.com/maxudong1993/mybert"},{"title":"liuqiangict/lamb_optimizer","url":"https://github.com/liuqiangict/lamb_optimizer"},{"title":"YuehChuan/bert-Agus","url":"https://github.com/YuehChuan/bert-Agus"},{"title":"idiotprofessorchen/bert.github.io","url":"https://github.com/idiotprofessorchen/bert.github.io"},{"title":"TonyX19/bert_hyperpartisan","url":"https://github.com/TonyX19/bert_hyperpartisan"},{"title":"Walter-B/bert-20-classes","url":"https://github.com/Walter-B/bert-20-classes"},{"title":"yangyucheng000/bert_GPU","url":"https://github.com/yangyucheng000/bert_GPU"},{"title":"2023-MindSpore-4/Code12","url":"https://github.com/2023-MindSpore-4/Code12/tree/main/MindFormers/bert"},{"title":"yangyucheng000/bert_Ascend","url":"https://github.com/yangyucheng000/bert_Ascend"},{"title":"kingcong/gpu_albert","url":"https://github.com/kingcong/gpu_albert"},{"title":"MindSpore-paper-code-3/code9","url":"https://github.com/MindSpore-paper-code-3/code9/tree/main/soft_masked_bert"},{"title":"yangyucheng000/ascend_albert","url":"https://github.com/yangyucheng000/ascend_albert"},{"title":"Osobarako/alduswarrensewell","url":"https://github.com/Osobarako/alduswarrensewell"},{"title":"Gaozhen0816/BERT_QA_for_Chinese","url":"https://github.com/Gaozhen0816/BERT_QA_for_Chinese"},{"title":"zhang-huihui/git-repository","url":"https://github.com/zhang-huihui/git-repository"},{"title":"Soren-Kierkegaard/BERT-for-tweet-Classifcation","url":"https://github.com/Soren-Kierkegaard/BERT-for-tweet-Classifcation"},{"title":"eunseo1092/Graduation_project","url":"https://github.com/eunseo1092/Graduation_project"},{"title":"aleksac99/SQuAD-SR","url":"https://github.com/aleksac99/SQuAD-SR"},{"title":"luozhilin99/bert","url":"https://github.com/luozhilin99/bert"},{"title":"2023-MindSpore-1/ms-code-12","url":"https://github.com/2023-MindSpore-1/ms-code-12"},{"title":"2023-MindSpore-1/ms-code-11","url":"https://github.com/2023-MindSpore-1/ms-code-11"},{"title":"2023-MindSpore-1/ms-code-56","url":"https://github.com/2023-MindSpore-1/ms-code-56"},{"title":"TannerFry/CS522-Final-Project","url":"https://github.com/TannerFry/CS522-Final-Project"},{"title":"MindSpore-scientific/code-7","url":"https://github.com/MindSpore-scientific/code-7/tree/main/bert"},{"title":"svakulenk0/response_eval","url":"https://github.com/svakulenk0/response_eval"},{"title":"zsweet/BERT_zsw","url":"https://github.com/zsweet/BERT_zsw"},{"title":"lovedavidsilva/bert_old_version","url":"https://github.com/lovedavidsilva/bert_old_version"},{"title":"myamamoto555/tf-bert","url":"https://github.com/myamamoto555/tf-bert"},{"title":"longbowking/bert","url":"https://github.com/longbowking/bert"},{"title":"semal/bert","url":"https://github.com/semal/bert"},{"title":"Gaozhen0816/BERT_QA_For_AILaw","url":"https://github.com/Gaozhen0816/BERT_QA_For_AILaw"},{"title":"icewing1996/bert_dep","url":"https://github.com/icewing1996/bert_dep"},{"title":"NehaTamore/TextSimilarity","url":"https://github.com/NehaTamore/TextSimilarity"},{"title":"saurabhnlp/bert","url":"https://github.com/saurabhnlp/bert"},{"title":"kinimod23/NMT_Project","url":"https://github.com/kinimod23/NMT_Project"},{"title":"fciannel/bert_fciannel","url":"https://github.com/fciannel/bert_fciannel"},{"title":"TSLNIHAOGIT/bert_run","url":"https://github.com/TSLNIHAOGIT/bert_run"},{"title":"goldenbili/Bert_Test2","url":"https://github.com/goldenbili/Bert_Test2"},{"title":"jangjoongkeon/JK","url":"https://github.com/jangjoongkeon/JK"},{"title":"JohannLee1996/bert","url":"https://github.com/JohannLee1996/bert"},{"title":"kingcheng2000/bert","url":"https://github.com/kingcheng2000/bert"},{"title":"zapplea/bert","url":"https://github.com/zapplea/bert"},{"title":"roshaan7zafar/-MAX-Text-Sentiment-Classifier","url":"https://github.com/roshaan7zafar/-MAX-Text-Sentiment-Classifier"},{"title":"2023-MindSpore-1/ms-code-150","url":"https://github.com/2023-MindSpore-1/ms-code-150"},{"title":"bhavitvyamalik/bert","url":"https://github.com/bhavitvyamalik/bert"},{"title":"g-eklund/bert_tutorial","url":"https://github.com/g-eklund/bert_tutorial"},{"title":"habibullah-araphat/BERT-GPU","url":"https://github.com/habibullah-araphat/BERT-GPU"},{"title":"thanhlong1997/bert_quora","url":"https://github.com/thanhlong1997/bert_quora"},{"title":"TSLNIHAOGIT/bert","url":"https://github.com/TSLNIHAOGIT/bert"},{"title":"YYGXjpg/BERT_WL","url":"https://github.com/YYGXjpg/BERT_WL"},{"title":"haydlite/sparse-bert-ner","url":"https://github.com/haydlite/sparse-bert-ner"},{"title":"faizansuhail89/bert","url":"https://github.com/faizansuhail89/bert"},{"title":"Sikun/dlam_project","url":"https://github.com/Sikun/dlam_project"},{"title":"DeokO/bert-excercise-ongoing","url":"https://github.com/DeokO/bert-excercise-ongoing"},{"title":"yydai/bert_test","url":"https://github.com/yydai/bert_test"},{"title":"enod/arxiv-nlp-notes","url":"https://github.com/enod/arxiv-nlp-notes"},{"title":"tyxr/bert","url":"https://github.com/tyxr/bert"},{"title":"pengshuyuan/Bert","url":"https://github.com/pengshuyuan/Bert"},{"title":"TYTYTYTYTYTYTYTYTY/558-project","url":"https://github.com/TYTYTYTYTYTYTYTYTY/558-project"},{"title":"vijay120/bert","url":"https://github.com/vijay120/bert"},{"title":"Kevin-Vora/bert-embedding-gluonnlp-edit-","url":"https://github.com/Kevin-Vora/bert-embedding-gluonnlp-edit-"},{"title":"xesdiny/test-bert-master","url":"https://github.com/xesdiny/test-bert-master"},{"title":"tcnguyen/bert","url":"https://github.com/tcnguyen/bert"},{"title":"rpuiggari/bert2","url":"https://github.com/rpuiggari/bert2"},{"title":"bluejurand/Kaggle_QA_Google_Labeling","url":"https://github.com/bluejurand/Kaggle_QA_Google_Labeling"},{"title":"Mind23-2/MindCode-133","url":"https://github.com/Mind23-2/MindCode-133"},{"title":"yiyc-kor/bert-study","url":"https://github.com/yiyc-kor/bert-study"},{"title":"coronazap/bert_client","url":"https://github.com/coronazap/bert_client"},{"title":"Mind23-2/MindCode-144","url":"https://github.com/Mind23-2/MindCode-144"},{"title":"saurabhkulkarni77/BERT_multilabel","url":"https://github.com/saurabhkulkarni77/BERT_multilabel"},{"title":"junhahyung/bert_transfer","url":"https://github.com/junhahyung/bert_transfer"},{"title":"Maz101/pretrainingdataset","url":"https://github.com/Maz101/pretrainingdataset"},{"title":"Shinya-Kouda/kgc","url":"https://github.com/Shinya-Kouda/kgc"},{"title":"algharak/BERTenhance","url":"https://github.com/algharak/BERTenhance"},{"title":"FengJiaChunFromSYSU/Bert","url":"https://github.com/FengJiaChunFromSYSU/Bert"},{"title":"Priyanshiguptaaa/CoLA_Sentence_Classification_BERT","url":"https://github.com/Priyanshiguptaaa/CoLA_Sentence_Classification_BERT"},{"title":"owainwest/uniprot_bert","url":"https://github.com/owainwest/uniprot_bert"},{"title":"Linar23/Research_work","url":"https://github.com/Linar23/Research_work"},{"title":"Maz101/Bert","url":"https://github.com/Maz101/Bert"},{"title":"abmitra84/Language_Modeling","url":"https://github.com/abmitra84/Language_Modeling"},{"title":"xitianxiaofeixue/BERT","url":"https://github.com/xitianxiaofeixue/BERT"},{"title":"paolanu/BERT_epitope","url":"https://github.com/paolanu/BERT_epitope"},{"title":"cuber2460/bert","url":"https://github.com/cuber2460/bert"},{"title":"Nstats/bert_MRC","url":"https://github.com/Nstats/bert_MRC"},{"title":"DeligientSloth/QQsim","url":"https://github.com/DeligientSloth/QQsim"},{"title":"Caesarzhang/bert-zh","url":"https://github.com/Caesarzhang/bert-zh"},{"title":"joytianya/google_bert","url":"https://github.com/joytianya/google_bert"},{"title":"Yipeng91/text_classifier_pub","url":"https://github.com/Yipeng91/text_classifier_pub"},{"title":"elenalenaelena/machine-learning-viz","url":"https://github.com/elenalenaelena/machine-learning-viz"},{"title":"Charliesgithub20221030/BERT","url":"https://github.com/Charliesgithub20221030/BERT"},{"title":"mhaseeb123/DeepMSim","url":"https://github.com/mhaseeb123/DeepMSim"},{"title":"1wy/bert","url":"https://github.com/1wy/bert"},{"title":"wayalhruhi/gogle_bert","url":"https://github.com/wayalhruhi/gogle_bert"},{"title":"chen-xiong-yi/OwnBERT","url":"https://github.com/chen-xiong-yi/OwnBERT"},{"title":"sherinaseri/bert","url":"https://github.com/sherinaseri/bert"},{"title":"keiyamashita111/aaproject","url":"https://github.com/keiyamashita111/aaproject"},{"title":"TidalPaladin/neural-summarizer","url":"https://github.com/TidalPaladin/neural-summarizer"},{"title":"Satan012/BERT","url":"https://github.com/Satan012/BERT"},{"title":"pfecht/bert-exploration","url":"https://github.com/pfecht/bert-exploration"},{"title":"chrisleunglokhin/Capstone-BERT","url":"https://github.com/chrisleunglokhin/Capstone-BERT"},{"title":"haidershaour/bert","url":"https://github.com/haidershaour/bert"},{"title":"somiltg/bert","url":"https://github.com/somiltg/bert"},{"title":"tmalbonph/tcbert","url":"https://github.com/tmalbonph/tcbert"}],"syntology":{"n":659,"n_ran":204,"n_unverified":455,"n_pointer_only":149}}},{"leaderboard":"/sota/question-answering-on-obqa","slug":"question-answering-on-obqa","dataset":"OBQA","dataset_url":"/dataset/openbookqa","rows_in_archive":9,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"FLAN 137B (zero-shot)","paper_title":"Finetuned Language Models Are Zero-Shot Learners","paper_url":"/paper/finetuned-language-models-are-zero-shot","paper_date":"2021-09-03","arxiv_id":"2109.01652","code_links":[{"title":"hiyouga/llama-efficient-tuning","url":"https://github.com/hiyouga/llama-efficient-tuning"},{"title":"bigcode-project/starcoder","url":"https://github.com/bigcode-project/starcoder"},{"title":"bigscience-workshop/promptsource","url":"https://github.com/bigscience-workshop/promptsource"},{"title":"google-research/flan","url":"https://github.com/google-research/flan"},{"title":"ukplab/arxiv2025-inherent-limits-plms","url":"https://github.com/ukplab/arxiv2025-inherent-limits-plms"},{"title":"openbiolink/promptsource","url":"https://github.com/openbiolink/promptsource"},{"title":"MS-P3/code6","url":"https://github.com/MS-P3/code6/tree/main/finetune"},{"title":"hojjat-mokhtarabadi/promptsource","url":"https://github.com/hojjat-mokhtarabadi/promptsource"}],"syntology":{"n":1,"n_ran":0,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-tiq","slug":"question-answering-on-tiq","dataset":"TIQ","dataset_url":"/dataset/tiq","rows_in_archive":9,"metrics":["P@1"],"first_row_in_archive_order":{"model":"FAITH","paper_title":"Faithful Temporal Question Answering over Heterogeneous Sources","paper_url":"/paper/faithful-temporal-question-answering-over","paper_date":"2024-02-23","arxiv_id":"2402.15400","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-wikihop","slug":"question-answering-on-wikihop","dataset":"WikiHop","dataset_url":"/dataset/wikihop","rows_in_archive":9,"metrics":["Test"],"first_row_in_archive_order":{"model":"BigBird-etc","paper_title":"Big Bird: Transformers for Longer Sequences","paper_url":"/paper/big-bird-transformers-for-longer-sequences","paper_date":"2020-07-28","arxiv_id":"2007.14062","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp/projects/bigbird"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/paddlenlp/transformers/bigbird"},{"title":"facebookresearch/xformers","url":"https://github.com/facebookresearch/xformers"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"monologg/kobigbird","url":"https://github.com/monologg/kobigbird"},{"title":"mim-solutions/bert_for_longer_texts","url":"https://github.com/mim-solutions/bert_for_longer_texts"},{"title":"mim-solutions/roberta_for_longer_texts","url":"https://github.com/mim-solutions/roberta_for_longer_texts"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/big_bird"},{"title":"sergeykramp/mthesis-bigbird-embeddings","url":"https://github.com/sergeykramp/mthesis-bigbird-embeddings"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/big_bird"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/bigbird_pegasus"}],"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}}},{"leaderboard":"/sota/question-answering-on-childrens-book-test","slug":"question-answering-on-childrens-book-test","dataset":"Children's Book Test","dataset_url":"/dataset/children-s-book-test","rows_in_archive":8,"metrics":["Accuracy-CN","Accuracy-NE"],"first_row_in_archive_order":{"model":"NSE","paper_title":"Gated-Attention Readers for Text Comprehension","paper_url":"/paper/gated-attention-readers-for-text","paper_date":"2016-06-05","arxiv_id":"1606.01549","code_links":[{"title":"AI-metrics/AI-metrics","url":"https://github.com/AI-metrics/AI-metrics"},{"title":"bdhingra/ga-reader","url":"https://github.com/bdhingra/ga-reader"},{"title":"gchhablani/ReCAM","url":"https://github.com/gchhablani/ReCAM"},{"title":"aartika/experiment1","url":"https://github.com/aartika/experiment1"}],"syntology":{"n":3,"n_ran":1,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-fever","slug":"question-answering-on-fever","dataset":"FEVER","dataset_url":"/dataset/fever","rows_in_archive":8,"metrics":["EM"],"first_row_in_archive_order":{"model":"CoA","paper_title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","paper_url":"/paper/chain-of-action-faithful-and-multimodal","paper_date":"2024-03-26","arxiv_id":"2403.17359","code_links":[{"title":"MAGICS-LAB/Chain-of-Actions","url":"https://github.com/MAGICS-LAB/Chain-of-Actions"}],"syntology":{"n":10,"n_ran":8,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-tempquestions","slug":"question-answering-on-tempquestions","dataset":"TempQuestions","dataset_url":"/dataset/tempquestions","rows_in_archive":8,"metrics":["Hits@1","F1"],"first_row_in_archive_order":{"model":"SF-TQA","paper_title":"Semantic Framework based Query Generation for Temporal Question Answering over Knowledge Graphs","paper_url":"/paper/semantic-framework-based-query-generation-for","paper_date":"2022-10-10","arxiv_id":"2210.04490","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-bioasq","slug":"question-answering-on-bioasq","dataset":"BioASQ","dataset_url":"/dataset/bioasq","rows_in_archive":7,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BioLinkBERT (large)","paper_title":"LinkBERT: Pretraining Language Models with Document Links","paper_url":"/paper/linkbert-pretraining-language-models-with","paper_date":"2022-03-29","arxiv_id":"2203.15827","code_links":[{"title":"michiyasunaga/LinkBERT","url":"https://github.com/michiyasunaga/LinkBERT"}],"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-fquad-1","slug":"question-answering-on-fquad-1","dataset":"FQuAD","dataset_url":"/dataset/fquad","rows_in_archive":7,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"CamemBERT-Large","paper_title":"FQuAD: French Question Answering Dataset","paper_url":"/paper/fquad-french-question-answering-dataset","paper_date":"2020-02-14","arxiv_id":"2002.06071","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-kilt-eli5","slug":"question-answering-on-kilt-eli5","dataset":"KILT: ELI5","dataset_url":"/dataset/kilt","rows_in_archive":7,"metrics":["Rouge-L","F1"],"first_row_in_archive_order":{"model":"RBG","paper_title":"Read before Generate! Faithful Long Form Question Answering with Machine Reading","paper_url":"/paper/read-before-generate-faithful-long-form","paper_date":"2022-03-01","arxiv_id":"2203.00343","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-qasent","slug":"question-answering-on-qasent","dataset":"QASent","dataset_url":null,"rows_in_archive":7,"metrics":["MAP","MRR"],"first_row_in_archive_order":{"model":"Attentive LSTM","paper_title":"Neural Variational Inference for Text Processing","paper_url":"/paper/neural-variational-inference-for-text","paper_date":"2015-11-19","arxiv_id":"1511.06038","code_links":[{"title":"carpedm20/variational-text-tensorflow","url":"https://github.com/carpedm20/variational-text-tensorflow"},{"title":"jiacheng-xu/vmf_vae_nlp","url":"https://github.com/jiacheng-xu/vmf_vae_nlp"},{"title":"ysmiao/nvdm","url":"https://github.com/ysmiao/nvdm"},{"title":"YongfeiYan/Neural-Document-Modeling","url":"https://github.com/YongfeiYan/Neural-Document-Modeling"},{"title":"shining-spring/nvlda","url":"https://github.com/shining-spring/nvlda"},{"title":"jainshobhit/Variational-Autoencoder","url":"https://github.com/jainshobhit/Variational-Autoencoder"}],"syntology":{"n":4,"n_ran":1,"n_unverified":3,"n_pointer_only":1}}},{"leaderboard":"/sota/question-answering-on-quasart-t","slug":"question-answering-on-quasart-t","dataset":"Quasart-T","dataset_url":"/dataset/quasar-t","rows_in_archive":7,"metrics":["EM"],"first_row_in_archive_order":{"model":"Cluster-Former (#C=512)","paper_title":"Cluster-Former: Clustering-based Sparse Transformer for Long-Range Dependency Encoding","paper_url":"/paper/cluster-former-clustering-based-sparse","paper_date":"2020-09-13","arxiv_id":"2009.06097","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-race","slug":"question-answering-on-race","dataset":"RACE","dataset_url":"/dataset/race","rows_in_archive":7,"metrics":["RACE-m","RACE-h","RACE"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-sqa3d","slug":"question-answering-on-sqa3d","dataset":"SQA3D","dataset_url":"/dataset/sqa3d","rows_in_archive":7,"metrics":["AnswerExactMatch (Question Answering)"],"first_row_in_archive_order":{"model":"CREMA","paper_title":"CREMA: Generalizable and Efficient Video-Language Reasoning via Multimodal Modular Fusion","paper_url":"/paper/crema-multimodal-compositional-video","paper_date":"2024-02-08","arxiv_id":"2402.05889","code_links":[{"title":"Yui010206/CREMA","url":"https://github.com/Yui010206/CREMA"}],"syntology":{"n":10,"n_ran":8,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-story-cloze","slug":"question-answering-on-story-cloze","dataset":"Story Cloze","dataset_url":null,"rows_in_archive":7,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Neo-6B (QA + WS)","paper_title":"Ask Me Anything: A simple strategy for prompting language models","paper_url":"/paper/ask-me-anything-a-simple-strategy-for","paper_date":"2022-10-05","arxiv_id":"2210.02441","code_links":[{"title":"hazyresearch/ama_prompting","url":"https://github.com/hazyresearch/ama_prompting"},{"title":"simran-arora/privacy_fm","url":"https://github.com/simran-arora/privacy_fm"},{"title":"simran-arora/focus","url":"https://github.com/simran-arora/focus"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-yahoocqa","slug":"question-answering-on-yahoocqa","dataset":"YahooCQA","dataset_url":null,"rows_in_archive":7,"metrics":["P@1","MRR"],"first_row_in_archive_order":{"model":"sMIM (1024) +","paper_title":"SentenceMIM: A Latent Variable Language Model","paper_url":"/paper/200302645","paper_date":"2020-02-18","arxiv_id":"2003.02645","code_links":[{"title":"seraphlabs-ca/SentenceMIM-demo","url":"https://github.com/seraphlabs-ca/SentenceMIM-demo"}],"syntology":{"n":9,"n_ran":1,"n_unverified":8,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-drop","slug":"question-answering-on-drop","dataset":"DROP","dataset_url":"/dataset/drop","rows_in_archive":6,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"PaLM 540B (Self Improvement, Self Consistency)","paper_title":"Large Language Models Can Self-Improve","paper_url":"/paper/large-language-models-can-self-improve","paper_date":"2022-10-20","arxiv_id":"2210.11610","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-finqa","slug":"question-answering-on-finqa","dataset":"FinQA","dataset_url":"/dataset/finqa","rows_in_archive":6,"metrics":["Execution Accuracy","Program Accuracy"],"first_row_in_archive_order":{"model":"APOLLO","paper_title":"APOLLO: An Optimized Training Approach for Long-form Numerical Reasoning","paper_url":"/paper/apollo-an-optimized-training-approach-for","paper_date":"2022-12-14","arxiv_id":"2212.07249","code_links":[{"title":"gasolsun36/iter-cot","url":"https://github.com/gasolsun36/iter-cot"},{"title":"gasolsun36/dynamicrag","url":"https://github.com/gasolsun36/dynamicrag"},{"title":"gasolsun36/apollo","url":"https://github.com/gasolsun36/apollo"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-friendsqa","slug":"question-answering-on-friendsqa","dataset":"FriendsQA","dataset_url":null,"rows_in_archive":6,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"Ma et al. - ELECTRA","paper_title":"Enhanced Speaker-aware Multi-party Multi-turn Dialogue Comprehension","paper_url":"/paper/enhanced-speaker-aware-multi-party-multi-turn","paper_date":"2021-09-09","arxiv_id":"2109.04066","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-next-qa-open-ended","slug":"question-answering-on-next-qa-open-ended","dataset":"NExT-QA (Open-ended VideoQA)","dataset_url":"/dataset/next-qa-open-ended-videoqa","rows_in_archive":6,"metrics":["Accuracy","Confidence Score"],"first_row_in_archive_order":{"model":"Flash-VStream","paper_title":"Flash-VStream: Memory-Based Real-Time Understanding for Long Video Streams","paper_url":"/paper/flash-vstream-memory-based-real-time","paper_date":"2024-06-12","arxiv_id":"2406.08085","code_links":[{"title":"IVGSZ/Flash-VStream","url":"https://github.com/IVGSZ/Flash-VStream"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-nq-beir","slug":"question-answering-on-nq-beir","dataset":"NQ (BEIR)","dataset_url":"/dataset/natural-questions","rows_in_archive":6,"metrics":["nDCG@10"],"first_row_in_archive_order":{"model":"Blended RAG","paper_title":"Blended RAG: Improving RAG (Retriever-Augmented Generation) Accuracy with Semantic Search and Hybrid Query-Based Retrievers","paper_url":"/paper/blended-rag-improving-rag-retriever-augmented","paper_date":"2024-03-22","arxiv_id":"2404.07220","code_links":[{"title":"ibm-ecosystem-engineering/blended-rag","url":"https://github.com/ibm-ecosystem-engineering/blended-rag"}],"syntology":{"n":2,"n_ran":1,"n_unverified":1,"n_pointer_only":2}}},{"leaderboard":"/sota/question-answering-on-peerqa","slug":"question-answering-on-peerqa","dataset":"PeerQA","dataset_url":"/dataset/peerqa","rows_in_archive":6,"metrics":["Prometheus-2 Answer Correctness","Rouge-L","AlignScore"],"first_row_in_archive_order":{"model":"GPT-4o-2024-08-06-128k","paper_title":"GPT-4 Technical Report","paper_url":"/paper/gpt-4-technical-report-1","paper_date":"2023-03-15","arxiv_id":"2303.08774","code_links":[{"title":"openai/evals","url":"https://github.com/openai/evals"},{"title":"shmsw25/factscore","url":"https://github.com/shmsw25/factscore"},{"title":"unispac/visual-adversarial-examples-jailbreak-large-language-models","url":"https://github.com/unispac/visual-adversarial-examples-jailbreak-large-language-models"},{"title":"gpt4life/alpagasus","url":"https://github.com/gpt4life/alpagasus"},{"title":"emrgnt-cmplxty/zero-shot-replication","url":"https://github.com/emrgnt-cmplxty/zero-shot-replication"},{"title":"ethz-privsec/superhuman-ai-consistency","url":"https://github.com/ethz-privsec/superhuman-ai-consistency"},{"title":"ethz-spylab/superhuman-ai-consistency","url":"https://github.com/ethz-spylab/superhuman-ai-consistency"},{"title":"eternityyw/tram-benchmark","url":"https://github.com/eternityyw/tram-benchmark"},{"title":"AUCOHL/RTL-Repo","url":"https://github.com/AUCOHL/RTL-Repo"},{"title":"zach-zhiling-zheng/reticular_chemist","url":"https://github.com/zach-zhiling-zheng/reticular_chemist"},{"title":"lflage/openfactscore","url":"https://github.com/lflage/openfactscore"}],"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":1}}},{"leaderboard":"/sota/question-answering-on-semevalcqa","slug":"question-answering-on-semevalcqa","dataset":"SemEvalCQA","dataset_url":null,"rows_in_archive":5,"metrics":["P@1","MAP"],"first_row_in_archive_order":{"model":"HyperQA","paper_title":"Hyperbolic Representation Learning for Fast and Efficient Neural Question Answering","paper_url":"/paper/hyperbolic-representation-learning-for-fast","paper_date":"2017-07-25","arxiv_id":"1707.07847","code_links":[{"title":"vanzytay/WSDM2018_HyperQA","url":"https://github.com/vanzytay/WSDM2018_HyperQA"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-ai2-kaggle-dataset","slug":"question-answering-on-ai2-kaggle-dataset","dataset":"AI2 Kaggle Dataset","dataset_url":null,"rows_in_archive":4,"metrics":["P@1"],"first_row_in_archive_order":{"model":"IR Baseline","paper_title":"Tell Me Why: Using Question Answering as Distant Supervision for Answer Justification","paper_url":"/paper/tell-me-why-using-question-answering-as","paper_date":"2017-08-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-blurb","slug":"question-answering-on-blurb","dataset":"BLURB","dataset_url":"/dataset/blurb","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BioLinkBERT (large)","paper_title":"LinkBERT: Pretraining Language Models with Document Links","paper_url":"/paper/linkbert-pretraining-language-models-with","paper_date":"2022-03-29","arxiv_id":"2203.15827","code_links":[{"title":"michiyasunaga/LinkBERT","url":"https://github.com/michiyasunaga/LinkBERT"}],"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-catbabi-lm-mode","slug":"question-answering-on-catbabi-lm-mode","dataset":"catbAbI LM-mode","dataset_url":"/dataset/catbabi-lm-mode","rows_in_archive":4,"metrics":["Accuracy (mean)"],"first_row_in_archive_order":{"model":"Fast Weight Memory","paper_title":"Learning Associative Inference Using Fast Weight Memory","paper_url":"/paper/learning-associative-inference-using-fast-1","paper_date":"2020-11-16","arxiv_id":"2011.07831","code_links":[{"title":"ischlag/Fast-Weight-Memory-public","url":"https://github.com/ischlag/Fast-Weight-Memory-public"}],"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-catbabi-qa-mode","slug":"question-answering-on-catbabi-qa-mode","dataset":"catbAbI QA-mode","dataset_url":"/dataset/catbabi","rows_in_archive":4,"metrics":["1:1 Accuracy"],"first_row_in_archive_order":{"model":"Fast Weight Memory","paper_title":"Learning Associative Inference Using Fast Weight Memory","paper_url":"/paper/learning-associative-inference-using-fast-1","paper_date":"2020-11-16","arxiv_id":"2011.07831","code_links":[{"title":"ischlag/Fast-Weight-Memory-public","url":"https://github.com/ischlag/Fast-Weight-Memory-public"}],"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-chegeka","slug":"question-answering-on-chegeka","dataset":"CheGeKa","dataset_url":"/dataset/chegeka","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Human benchmark","paper_title":"TAPE: Assessing Few-shot Russian Language Understanding","paper_url":"/paper/tape-assessing-few-shot-russian-language","paper_date":"2022-10-23","arxiv_id":"2210.12813","code_links":[{"title":"RussianNLP/TAPE","url":"https://github.com/RussianNLP/TAPE"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-complex-cronquestions","slug":"question-answering-on-complex-cronquestions","dataset":"Complex-CronQuestions","dataset_url":"/dataset/complex-cronquestions","rows_in_archive":4,"metrics":["Hits@1"],"first_row_in_archive_order":{"model":"SubGTR","paper_title":"Temporal knowledge graph question answering via subgraph reasoning","paper_url":"/paper/temporal-knowledge-graph-question-answering","paper_date":"2022-05-30","arxiv_id":null,"code_links":[{"title":"czy1999/SubGTR","url":"https://github.com/czy1999/SubGTR"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-egotaskqa","slug":"question-answering-on-egotaskqa","dataset":"EgoTaskQA","dataset_url":"/dataset/egotaskqa","rows_in_archive":4,"metrics":["Direct"],"first_row_in_archive_order":{"model":"EgoVLPv2","paper_title":"EgoVLPv2: Egocentric Video-Language Pre-training with Fusion in the Backbone","paper_url":"/paper/egovlpv2-egocentric-video-language-pre","paper_date":"2023-07-11","arxiv_id":"2307.05463","code_links":[{"title":"facebookresearch/EgoVLPv2","url":"https://github.com/facebookresearch/EgoVLPv2"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-fairytaleqa","slug":"question-answering-on-fairytaleqa","dataset":"FairytaleQA","dataset_url":"/dataset/fairytaleqa","rows_in_archive":4,"metrics":["F1","Rouge-L"],"first_row_in_archive_order":{"model":"BART fine-tuned on FairytaleQA","paper_title":"Fantastic Questions and Where to Find Them: FairytaleQA -- An Authentic Dataset for Narrative Comprehension","paper_url":"/paper/fantastic-questions-and-where-to-find-them-1","paper_date":"2022-03-26","arxiv_id":"2203.13947","code_links":[{"title":"uci-soe/fairytaleqadata","url":"https://github.com/uci-soe/fairytaleqadata"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-fiqa-2018-beir","slug":"question-answering-on-fiqa-2018-beir","dataset":"FiQA-2018 (BEIR)","dataset_url":"/dataset/beir","rows_in_archive":4,"metrics":["nDCG@10"],"first_row_in_archive_order":{"model":"monoT5-3B","paper_title":"No Parameter Left Behind: How Distillation and Model Size Affect Zero-Shot Retrieval","paper_url":"/paper/no-parameter-left-behind-how-distillation-and","paper_date":"2022-06-06","arxiv_id":"2206.02873","code_links":[{"title":"guilhermemr04/scaling-zero-shot-retrieval","url":"https://github.com/guilhermemr04/scaling-zero-shot-retrieval"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-hotpotqa-beir","slug":"question-answering-on-hotpotqa-beir","dataset":"HotpotQA (BEIR)","dataset_url":"/dataset/beir","rows_in_archive":4,"metrics":["nDCG@10"],"first_row_in_archive_order":{"model":"monoT5-3B","paper_title":"No Parameter Left Behind: How Distillation and Model Size Affect Zero-Shot Retrieval","paper_url":"/paper/no-parameter-left-behind-how-distillation-and","paper_date":"2022-06-06","arxiv_id":"2206.02873","code_links":[{"title":"guilhermemr04/scaling-zero-shot-retrieval","url":"https://github.com/guilhermemr04/scaling-zero-shot-retrieval"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-hybridqa","slug":"question-answering-on-hybridqa","dataset":"HybridQA","dataset_url":"/dataset/hybridqa","rows_in_archive":4,"metrics":["ANS-EM"],"first_row_in_archive_order":{"model":"MAFiD","paper_title":"MAFiD: Moving Average Equipped Fusion-in-Decoder for Question Answering over Tabular and Textual Data","paper_url":"/paper/mafid-moving-average-equipped-fusion-in","paper_date":"2023-05-02","arxiv_id":null,"code_links":[{"title":"ZIZUN/MAFiD","url":"https://github.com/ZIZUN/MAFiD"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-molweni","slug":"question-answering-on-molweni","dataset":"Molweni","dataset_url":"/dataset/molweni","rows_in_archive":4,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"Ma et al. - ELECTRA","paper_title":"Enhanced Speaker-aware Multi-party Multi-turn Dialogue Comprehension","paper_url":"/paper/enhanced-speaker-aware-multi-party-multi-turn","paper_date":"2021-09-09","arxiv_id":"2109.04066","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-ms-marco","slug":"question-answering-on-ms-marco","dataset":"MS MARCO","dataset_url":"/dataset/ms-marco","rows_in_archive":4,"metrics":["Rouge-L","BLEU-1"],"first_row_in_archive_order":{"model":"Masque Q&A Style","paper_title":"Multi-style Generative Reading Comprehension","paper_url":"/paper/multi-style-generative-reading-comprehension","paper_date":"2019-01-08","arxiv_id":"1901.02262","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-multiq","slug":"question-answering-on-multiq","dataset":"MultiQ","dataset_url":"/dataset/multiq","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Human benchmark","paper_title":"TAPE: Assessing Few-shot Russian Language Understanding","paper_url":"/paper/tape-assessing-few-shot-russian-language","paper_date":"2022-10-23","arxiv_id":"2210.12813","code_links":[{"title":"RussianNLP/TAPE","url":"https://github.com/RussianNLP/TAPE"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-naturalqa","slug":"question-answering-on-naturalqa","dataset":"NaturalQA","dataset_url":null,"rows_in_archive":4,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"DPR","paper_title":"Dense Passage Retrieval for Open-Domain Question Answering","paper_url":"/paper/dense-passage-retrieval-for-open-domain","paper_date":"2020-04-10","arxiv_id":"2004.04906","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"deepset-ai/haystack","url":"https://github.com/deepset-ai/haystack"},{"title":"facebookresearch/DPR","url":"https://github.com/facebookresearch/DPR"},{"title":"texttron/tevatron","url":"https://github.com/texttron/tevatron"},{"title":"luyug/GC-DPR","url":"https://github.com/luyug/GC-DPR"},{"title":"DevSinghSachan/unsupervised-passage-reranking","url":"https://github.com/DevSinghSachan/unsupervised-passage-reranking"},{"title":"AkariAsai/XORQA","url":"https://github.com/AkariAsai/XORQA"},{"title":"oriram/spider","url":"https://github.com/oriram/spider"},{"title":"efficientqa/retrieval-based-baselines","url":"https://github.com/efficientqa/retrieval-based-baselines"},{"title":"Hannibal046/nanoDPR","url":"https://github.com/Hannibal046/nanoDPR"},{"title":"openmatch/ance-tele","url":"https://github.com/openmatch/ance-tele"},{"title":"amzn/refuel-open-domain-qa","url":"https://github.com/amzn/refuel-open-domain-qa"},{"title":"Ankur3107/dpr-tf","url":"https://github.com/Ankur3107/dpr-tf"},{"title":"alexlimh/DPR_MUF","url":"https://github.com/alexlimh/DPR_MUF"},{"title":"hongyuntw/DPR","url":"https://github.com/hongyuntw/DPR"},{"title":"junnyu/dpr_paddle","url":"https://github.com/junnyu/dpr_paddle"},{"title":"hongyuntw/DPR_BESS","url":"https://github.com/hongyuntw/DPR_BESS"},{"title":"nidhikamal-emb/DPR_repo","url":"https://github.com/nidhikamal-emb/DPR_repo"},{"title":"AhmedHussKhalifa/Dense_Passage_Retrieval_in_Conversational_Search","url":"https://github.com/AhmedHussKhalifa/Dense_Passage_Retrieval_in_Conversational_Search"}],"syntology":{"n":14,"n_ran":10,"n_unverified":4,"n_pointer_only":9}}},{"leaderboard":"/sota/question-answering-on-quality","slug":"question-answering-on-quality","dataset":"QuALITY","dataset_url":"/dataset/quality","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Claude 1.3 (5-shot)","paper_title":"Model Card and Evaluations for Claude Models","paper_url":"/paper/model-card-and-evaluations-for-claude-models","paper_date":"2023-07-11","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-ruopenbookqa","slug":"question-answering-on-ruopenbookqa","dataset":"RuOpenBookQA","dataset_url":"/dataset/ruopenbookqa","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Human benchmark","paper_title":"TAPE: Assessing Few-shot Russian Language Understanding","paper_url":"/paper/tape-assessing-few-shot-russian-language","paper_date":"2022-10-23","arxiv_id":"2210.12813","code_links":[{"title":"RussianNLP/TAPE","url":"https://github.com/RussianNLP/TAPE"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-casehold","slug":"question-answering-on-casehold","dataset":"CaseHOLD","dataset_url":"/dataset/casehold","rows_in_archive":3,"metrics":["Macro F1 (10-fold)"],"first_row_in_archive_order":{"model":"Custom Legal-BERT","paper_title":"When Does Pretraining Help? Assessing Self-Supervised Learning for Law and the CaseHOLD Dataset","paper_url":"/paper/when-does-pretraining-help-assessing-self","paper_date":"2021-04-18","arxiv_id":"2104.08671","code_links":[{"title":"reglab/casehold","url":"https://github.com/reglab/casehold"},{"title":"trusthlt/privacy-legal-nlp-lm","url":"https://github.com/trusthlt/privacy-legal-nlp-lm"}],"syntology":{"n":9,"n_ran":0,"n_unverified":9,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-conditionalqa","slug":"question-answering-on-conditionalqa","dataset":"ConditionalQA","dataset_url":"/dataset/conditionalqa","rows_in_archive":3,"metrics":["Conditional (answers)","Conditional (w/ conditions)","Overall (answers)","Overall (w/ conditions)"],"first_row_in_archive_order":{"model":"FiD","paper_title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","paper_url":"/paper/leveraging-passage-retrieval-with-generative","paper_date":"2020-07-02","arxiv_id":"2007.01282","code_links":[{"title":"jhyuklee/DensePhrases","url":"https://github.com/jhyuklee/DensePhrases"},{"title":"princeton-nlp/DensePhrases","url":"https://github.com/princeton-nlp/DensePhrases"},{"title":"facebookresearch/FiD","url":"https://github.com/facebookresearch/FiD"},{"title":"amzn/refuel-open-domain-qa","url":"https://github.com/amzn/refuel-open-domain-qa"},{"title":"uclnlp/APE","url":"https://github.com/uclnlp/APE"},{"title":"xfactlab/emnlp2023-damaging-retrieval","url":"https://github.com/xfactlab/emnlp2023-damaging-retrieval"},{"title":"ZIZUN/MAFiD","url":"https://github.com/ZIZUN/MAFiD"},{"title":"FenQQQ/Fusion-in-decoder","url":"https://github.com/FenQQQ/Fusion-in-decoder"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-convfinqa","slug":"question-answering-on-convfinqa","dataset":"ConvFinQA","dataset_url":"/dataset/convfinqa","rows_in_archive":3,"metrics":["Execution Accuracy"],"first_row_in_archive_order":{"model":"GPT-4 (8k)","paper_title":"Are ChatGPT and GPT-4 General-Purpose Solvers for Financial Text Analytics? A Study on Several Typical Tasks","paper_url":"/paper/are-chatgpt-and-gpt-4-general-purpose-solvers","paper_date":"2023-05-10","arxiv_id":"2305.05862","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-duorc","slug":"question-answering-on-duorc","dataset":"DuoRC","dataset_url":"/dataset/duorc","rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Vector Database (ChromaDB)","paper_title":"RecallM: An Adaptable Memory Mechanism with Temporal Understanding for Large Language Models","paper_url":"/paper/recallm-an-architecture-for-temporal-context","paper_date":"2023-07-06","arxiv_id":"2307.02738","code_links":[{"title":"cisco-open/DeepVision","url":"https://github.com/cisco-open/DeepVision/tree/main/recallm"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mathematics-dataset","slug":"question-answering-on-mathematics-dataset","dataset":"Mathematics Dataset","dataset_url":"/dataset/mathematics","rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"TP-Transformer","paper_title":"Enhancing the Transformer with Explicit Relational Encoding for Math Problem Solving","paper_url":"/paper/enhancing-the-transformer-with-explicit-1","paper_date":"2019-10-15","arxiv_id":"1910.06611","code_links":[{"title":"ischlag/TP-Transformer","url":"https://github.com/ischlag/TP-Transformer"},{"title":"jlrussin/interpret-math-transformer","url":"https://github.com/jlrussin/interpret-math-transformer"},{"title":"andrear632/ProjectDeepLearning","url":"https://github.com/andrear632/ProjectDeepLearning"}],"syntology":{"n":11,"n_ran":1,"n_unverified":10,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-ott-qa","slug":"question-answering-on-ott-qa","dataset":"OTT-QA","dataset_url":"/dataset/ott-qa","rows_in_archive":3,"metrics":["ANS-EM"],"first_row_in_archive_order":{"model":"Fusion Retriever+ETC","paper_title":"Open Question Answering over Tables and Text","paper_url":"/paper/open-question-answering-over-tables-and-text-1","paper_date":"2020-10-20","arxiv_id":"2010.10439","code_links":[{"title":"wenhuchen/OTT-QA","url":"https://github.com/wenhuchen/OTT-QA"}],"syntology":{"n":5,"n_ran":4,"n_unverified":1,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-reclor","slug":"question-answering-on-reclor","dataset":"ReClor","dataset_url":"/dataset/reclor","rows_in_archive":3,"metrics":["Accuracy","Accuracy (easy)","Accuracy (hard)"],"first_row_in_archive_order":{"model":"XLNet-large","paper_title":"ReClor: A Reading Comprehension Dataset Requiring Logical Reasoning","paper_url":"/paper/reclor-a-reading-comprehension-dataset-1","paper_date":"2020-02-11","arxiv_id":"2002.04326","code_links":[{"title":"yuweihao/reclor","url":"https://github.com/yuweihao/reclor"}],"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":2}}},{"leaderboard":"/sota/question-answering-on-sberquad","slug":"question-answering-on-sberquad","dataset":"SberQuAD","dataset_url":"/dataset/sberquad","rows_in_archive":3,"metrics":["EM","F1"],"first_row_in_archive_order":{"model":"DeepPavlov RuBERT","paper_title":"SberQuAD -- Russian Reading Comprehension Dataset: Description and Analysis","paper_url":"/paper/sberquad-russian-reading-comprehension","paper_date":"2019-12-20","arxiv_id":"1912.09723","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-scde-1","slug":"question-answering-on-scde-1","dataset":"SCDE","dataset_url":"/dataset/scde","rows_in_archive":3,"metrics":["BA","PA","DE"],"first_row_in_archive_order":{"model":"albert-xxlarge + APN(baseline)","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-tweetqa","slug":"question-answering-on-tweetqa","dataset":"TweetQA","dataset_url":"/dataset/tweetqa","rows_in_archive":3,"metrics":["BLEU-1","ROUGE-L"],"first_row_in_archive_order":{"model":"ByT5 (small)","paper_title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","paper_url":"/paper/byt5-towards-a-token-free-future-with-pre","paper_date":"2021-05-28","arxiv_id":"2105.13626","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers/tree/master/src/transformers/models/byt5"},{"title":"google-research/byt5","url":"https://github.com/google-research/byt5"},{"title":"ufal/multilexnorm2021","url":"https://github.com/ufal/multilexnorm2021"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/byt5"},{"title":"yoreG123/Paddle-ByT5","url":"https://github.com/yoreG123/Paddle-ByT5"}],"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-vnhsge-english","slug":"question-answering-on-vnhsge-english","dataset":"VNHSGE-English","dataset_url":"/dataset/vnhsge","rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-agi-eval","slug":"question-answering-on-agi-eval","dataset":"AGI Eval","dataset_url":null,"rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Orca 2-13B","paper_title":"Orca 2: Teaching Small Language Models How to Reason","paper_url":"/paper/orca-2-teaching-small-language-models-how-to","paper_date":"2023-11-18","arxiv_id":"2311.11045","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-aristo-kaggle-allen-ai","slug":"question-answering-on-aristo-kaggle-allen-ai","dataset":"Aristo Kaggle Allen AI 8th grade questions","dataset_url":null,"rows_in_archive":2,"metrics":["1:1 Accuracy"],"first_row_in_archive_order":{"model":"Cardal","paper_title":"Moving Beyond the Turing Test with the Allen AI Science Challenge","paper_url":"/paper/moving-beyond-the-turing-test-with-the-allen","paper_date":"2016-04-14","arxiv_id":"1604.04315","code_links":[{"title":"Cardal/Kaggle_AllenAIscience","url":"https://github.com/Cardal/Kaggle_AllenAIscience"},{"title":"amsqr/Allen_AI_Kaggle","url":"https://github.com/amsqr/Allen_AI_Kaggle"},{"title":"bwilbertz/kaggle_allen_ai","url":"https://github.com/bwilbertz/kaggle_allen_ai"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-clicr","slug":"question-answering-on-clicr","dataset":"CliCR","dataset_url":"/dataset/clicr","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"Gated-Attention Reader","paper_title":"CliCR: A Dataset of Clinical Case Reports for Machine Reading Comprehension","paper_url":"/paper/clicr-a-dataset-of-clinical-case-reports-for","paper_date":"2018-03-26","arxiv_id":"1803.09720","code_links":[{"title":"clips/clicr","url":"https://github.com/clips/clicr"}],"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":4}}},{"leaderboard":"/sota/question-answering-on-codah","slug":"question-answering-on-codah","dataset":"CODAH","dataset_url":"/dataset/codah","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"G-DAUG-Combo + RoBERTa-Large","paper_title":"Generative Data Augmentation for Commonsense Reasoning","paper_url":"/paper/g-daug-generative-data-augmentation-for","paper_date":"2020-04-24","arxiv_id":"2004.11546","code_links":[{"title":"yangyiben/G-DAUG-c-Generative-Data-Augmentation-for-Commonsense-Reasoning","url":"https://github.com/yangyiben/G-DAUG-c-Generative-Data-Augmentation-for-Commonsense-Reasoning"}],"syntology":{"n":4,"n_ran":2,"n_unverified":2,"n_pointer_only":4}}},{"leaderboard":"/sota/question-answering-on-complexquestions","slug":"question-answering-on-complexquestions","dataset":"COMPLEXQUESTIONS","dataset_url":null,"rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"WebQA","paper_title":"Evaluating Semantic Parsing against a Simple Web-based Question Answering Model","paper_url":"/paper/evaluating-semantic-parsing-against-a-simple","paper_date":"2017-07-14","arxiv_id":"1707.04412","code_links":[{"title":"worksheets/0x91d77db3","url":"https://worksheets.codalab.org/worksheets/0x91d77db37e0a4bbbaeb37b8972f4784f"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-geoquestions1089","slug":"question-answering-on-geoquestions1089","dataset":"GeoQuestions1089","dataset_url":"/dataset/geoquestions1089","rows_in_archive":2,"metrics":["Percentage correct"],"first_row_in_archive_order":{"model":"GeoQA2","paper_title":"Benchmarking Geospatial Question Answering Engines using the Dataset GeoQuestions1089","paper_url":"/paper/benchmarking-geospatial-question-answering","paper_date":"2023-11-06","arxiv_id":null,"code_links":[{"title":"AI-team-UoA/GeoQuestions1089","url":"https://github.com/AI-team-UoA/GeoQuestions1089"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mapeval-api-1","slug":"question-answering-on-mapeval-api-1","dataset":"MapEval-API","dataset_url":"/dataset/mapeval-api","rows_in_archive":2,"metrics":["Accuracy (%)"],"first_row_in_archive_order":{"model":"Claude-3.5-Sonnet (ReAct)","paper_title":"MapEval: A Map-Based Evaluation of Geo-Spatial Reasoning in Foundation Models","paper_url":"/paper/mapeval-a-map-based-evaluation-of-geo-spatial","paper_date":"2024-12-31","arxiv_id":"2501.00316","code_links":[{"title":"MapEval/MapEval-Visual","url":"https://github.com/MapEval/MapEval-Visual"},{"title":"MapEval/MapEval-API","url":"https://github.com/MapEval/MapEval-API"},{"title":"MapEval/MapEval-Textual","url":"https://github.com/MapEval/MapEval-Textual"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-mctest-500","slug":"question-answering-on-mctest-500","dataset":"MCTest-500","dataset_url":"/dataset/mctest","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Parallel-Hierarchical","paper_title":"A Parallel-Hierarchical Model for Machine Comprehension on Sparse Data","paper_url":"/paper/a-parallel-hierarchical-model-for-machine","paper_date":"2016-03-29","arxiv_id":"1603.08884","code_links":[{"title":"Maluuba/mctest-model","url":"https://github.com/Maluuba/mctest-model"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-medturkquad-medical","slug":"question-answering-on-medturkquad-medical","dataset":"MedTurkQuAD: Medical Turkish Question-Answering Dataset","dataset_url":"/dataset/medturkquad-medical-turkish-question","rows_in_archive":2,"metrics":["Exact Match","F1 Score"],"first_row_in_archive_order":{"model":"BERTurk (cased, 32k)","paper_title":"Developing Question-Answering Models in Low-Resource Languages: A Case Study on Turkish Medical Texts Using Transformer-Based Approaches","paper_url":"/paper/developing-question-answering-models-in-low","paper_date":"2024-10-16","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mrqa-2019","slug":"question-answering-on-mrqa-2019","dataset":"MRQA","dataset_url":"/dataset/mrqa-2019","rows_in_archive":2,"metrics":["Average F1"],"first_row_in_archive_order":{"model":"LinkBERT (large)","paper_title":"LinkBERT: Pretraining Language Models with Document Links","paper_url":"/paper/linkbert-pretraining-language-models-with","paper_date":"2022-03-29","arxiv_id":"2203.15827","code_links":[{"title":"michiyasunaga/LinkBERT","url":"https://github.com/michiyasunaga/LinkBERT"}],"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-muld-hotpotqa","slug":"question-answering-on-muld-hotpotqa","dataset":"MuLD (HotpotQA)","dataset_url":"/dataset/muld","rows_in_archive":2,"metrics":["BLEU-1","BLEU-4","METEOR","Rouge-L"],"first_row_in_archive_order":{"model":"Longformer","paper_title":"MuLD: The Multitask Long Document Benchmark","paper_url":"/paper/muld-the-multitask-long-document-benchmark","paper_date":"2022-02-15","arxiv_id":"2202.07362","code_links":[{"title":"ghomashudson/muld","url":"https://github.com/ghomashudson/muld"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-muld-narrativeqa","slug":"question-answering-on-muld-narrativeqa","dataset":"MuLD (NarrativeQA)","dataset_url":"/dataset/muld","rows_in_archive":2,"metrics":["BLEU-1","BLEU-4","METEOR","Rouge-L"],"first_row_in_archive_order":{"model":"Longformer","paper_title":"MuLD: The Multitask Long Document Benchmark","paper_url":"/paper/muld-the-multitask-long-document-benchmark","paper_date":"2022-02-15","arxiv_id":"2202.07362","code_links":[{"title":"ghomashudson/muld","url":"https://github.com/ghomashudson/muld"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-popqa","slug":"question-answering-on-popqa","dataset":"PopQA","dataset_url":"/dataset/popqa","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"SelfRAG-7b","paper_title":"Self-RAG: Learning to Retrieve, Generate, and Critique through Self-Reflection","paper_url":"/paper/self-rag-learning-to-retrieve-generate-and","paper_date":"2023-10-17","arxiv_id":"2310.11511","code_links":[{"title":"ruc-nlpir/flashrag","url":"https://github.com/ruc-nlpir/flashrag"},{"title":"AkariAsai/self-rag","url":"https://github.com/AkariAsai/self-rag"},{"title":"fate-ubw/raglab","url":"https://github.com/fate-ubw/raglab"},{"title":"ShayekhBinIslam/openrag","url":"https://github.com/ShayekhBinIslam/openrag"},{"title":"llm-lab-org/CLASP","url":"https://github.com/llm-lab-org/CLASP"},{"title":"kaistai/semiparametric_token-sequence_co-supervision","url":"https://github.com/kaistai/semiparametric_token-sequence_co-supervision"}],"syntology":{"n":14,"n_ran":8,"n_unverified":6,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-pubchemqa","slug":"question-answering-on-pubchemqa","dataset":"PubChemQA","dataset_url":"/dataset/pubchemqa","rows_in_archive":2,"metrics":["BLEU-2","BLEU-4","ROUGE-1","ROUGE-2","ROUGE-L","MEATOR"],"first_row_in_archive_order":{"model":"BioMedGPT-10B","paper_title":"BioMedGPT: Open Multimodal Generative Pre-trained Transformer for BioMedicine","paper_url":"/paper/biomedgpt-open-multimodal-generative-pre","paper_date":"2023-08-18","arxiv_id":"2308.09442","code_links":[{"title":"pharmolix/openbiomed","url":"https://github.com/pharmolix/openbiomed"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-quac","slug":"question-answering-on-quac","dataset":"QuAC","dataset_url":"/dataset/quac","rows_in_archive":2,"metrics":["F1","HEQD","HEQQ"],"first_row_in_archive_order":{"model":"FlowQA (single model)","paper_title":"FlowQA: Grasping Flow in History for Conversational Machine Comprehension","paper_url":"/paper/flowqa-grasping-flow-in-history-for","paper_date":"2018-10-06","arxiv_id":"1810.06683","code_links":[{"title":"momohuang/FlowQA","url":"https://github.com/momohuang/FlowQA"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-reverb","slug":"question-answering-on-reverb","dataset":"Reverb","dataset_url":"/dataset/reverb-challenge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Weakly Supervised Embeddings","paper_title":"Open Question Answering with Weakly Supervised Embedding Models","paper_url":"/paper/open-question-answering-with-weakly","paper_date":"2014-04-16","arxiv_id":"1404.4326","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-squad-1","slug":"question-answering-on-squad-1","dataset":"SQuAD","dataset_url":"/dataset/squad","rows_in_archive":2,"metrics":["Exact Match","F1"],"first_row_in_archive_order":{"model":"Blended RAG","paper_title":"Blended RAG: Improving RAG (Retriever-Augmented Generation) Accuracy with Semantic Search and Hybrid Query-Based Retrievers","paper_url":"/paper/blended-rag-improving-rag-retriever-augmented","paper_date":"2024-03-22","arxiv_id":"2404.07220","code_links":[{"title":"ibm-ecosystem-engineering/blended-rag","url":"https://github.com/ibm-ecosystem-engineering/blended-rag"}],"syntology":{"n":2,"n_ran":1,"n_unverified":1,"n_pointer_only":2}}},{"leaderboard":"/sota/question-answering-on-tempqa-wd","slug":"question-answering-on-tempqa-wd","dataset":"TempQA-WD","dataset_url":"/dataset/tempqa-wd","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"BestOfBoth","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-torque","slug":"question-answering-on-torque","dataset":"Torque","dataset_url":"/dataset/torque","rows_in_archive":2,"metrics":["F1","EM","C"],"first_row_in_archive_order":{"model":"ECONET","paper_title":"ECONET: Effective Continual Pretraining of Language Models for Event Temporal Reasoning","paper_url":"/paper/deer-a-data-efficient-language-model-for","paper_date":"2020-12-30","arxiv_id":"2012.15283","code_links":[{"title":"ZHEvent/ZHEvent.github.io","url":"https://github.com/ZHEvent/ZHEvent.github.io"},{"title":"pluslabnlp/econet","url":"https://github.com/pluslabnlp/econet"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-uniprotqa","slug":"question-answering-on-uniprotqa","dataset":"UniProtQA","dataset_url":"/dataset/uniprotqa","rows_in_archive":2,"metrics":["BLEU-2","BLEU-4","ROUGE-1","ROUGE-2","ROUGE-L","MEATOR"],"first_row_in_archive_order":{"model":"BioMedGPT-10B","paper_title":"BioMedGPT: Open Multimodal Generative Pre-trained Transformer for BioMedicine","paper_url":"/paper/biomedgpt-open-multimodal-generative-pre","paper_date":"2023-08-18","arxiv_id":"2308.09442","code_links":[{"title":"pharmolix/openbiomed","url":"https://github.com/pharmolix/openbiomed"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-biology","slug":"question-answering-on-vnhsge-biology","dataset":"VNHSGE-Biology","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-chemistry","slug":"question-answering-on-vnhsge-chemistry","dataset":"VNHSGE-Chemistry","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing  Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-civic","slug":"question-answering-on-vnhsge-civic","dataset":"VNHSGE-Civic","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-geography","slug":"question-answering-on-vnhsge-geography","dataset":"VNHSGE-Geography","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-history","slug":"question-answering-on-vnhsge-history","dataset":"VNHSGE-History","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-literature","slug":"question-answering-on-vnhsge-literature","dataset":"VNHSGE-Literature","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ChatGPT","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-mathematics-1","slug":"question-answering-on-vnhsge-mathematics-1","dataset":"VNHSGE Mathematics","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing  Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-vnhsge-physics","slug":"question-answering-on-vnhsge-physics","dataset":"VNHSGE-Physics","dataset_url":"/dataset/vnhsge","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Bing Chat","paper_title":"VNHSGE: VietNamese High School Graduation Examination Dataset for Large Language Models","paper_url":"/paper/vnhsge-vietnamese-high-school-graduation","paper_date":"2023-05-20","arxiv_id":"2305.12199","code_links":[{"title":"xdao85/vnhsge","url":"https://github.com/xdao85/vnhsge"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-wikisql","slug":"question-answering-on-wikisql","dataset":"WikiSQL","dataset_url":"/dataset/wikisql","rows_in_archive":2,"metrics":["Exact Match (EM)"],"first_row_in_archive_order":{"model":"PieTa","paper_title":"Piece of Table: A Divide-and-Conquer Approach for Selecting Sub-Tables in Table Question Answering","paper_url":"/paper/piece-of-table-a-divide-and-conquer-approach","paper_date":"2024-12-10","arxiv_id":"2412.07629","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-wikitablequestions","slug":"question-answering-on-wikitablequestions","dataset":"WikiTableQuestions","dataset_url":"/dataset/wikitablequestions","rows_in_archive":2,"metrics":["Accuracy","Accuracy (Test)"],"first_row_in_archive_order":{"model":"ChatGPT 3.5 SpatialFormat","paper_title":"LAPDoc: Layout-Aware Prompting for Documents","paper_url":"/paper/lapdoc-layout-aware-prompting-for-documents","paper_date":"2024-02-15","arxiv_id":"2402.09841","code_links":[],"syntology":null}},{"leaderboard":"/sota/product-question-answering-on-jd-product","slug":"product-question-answering-on-jd-product","dataset":"JD Product Question Answer","dataset_url":null,"rows_in_archive":1,"metrics":["BLEU"],"first_row_in_archive_order":{"model":"PAAG","paper_title":"Product-Aware Answer Generation in E-Commerce Question-Answering","paper_url":"/paper/product-aware-answer-generation-in-e-commerce","paper_date":"2019-01-23","arxiv_id":"1901.07696","code_links":[{"title":"gsh199449/productqa","url":"https://github.com/gsh199449/productqa"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-aviationqa","slug":"question-answering-on-aviationqa","dataset":"AviationQA","dataset_url":"/dataset/aviationqa","rows_in_archive":1,"metrics":["Hits@1"],"first_row_in_archive_order":{"model":"KGT5","paper_title":"There is No Big Brother or Small Brother: Knowledge Infusion in Language Models for Link Prediction and Question Answering","paper_url":"/paper/there-is-no-big-brother-or-small-brother","paper_date":"2023-01-10","arxiv_id":"2301.04013","code_links":[{"title":"ankush9812/knowledge-infusion-in-lm-for-qa","url":"https://github.com/ankush9812/knowledge-infusion-in-lm-for-qa"},{"title":"ankush9812/aviation-question-answer-pairs","url":"https://github.com/ankush9812/aviation-question-answer-pairs"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-bbh","slug":"question-answering-on-bbh","dataset":"BBH","dataset_url":"/dataset/bbh","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Shakti-LLM (2.5B)","paper_title":"SHAKTI: A 2.5 Billion Parameter Small Language Model Optimized for Edge AI and Low-Resource Environments","paper_url":"/paper/shakti-a-2-5-billion-parameter-small-language","paper_date":"2024-10-15","arxiv_id":"2410.11331","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-chaii-hindi-and-tamil","slug":"question-answering-on-chaii-hindi-and-tamil","dataset":"ChAII - Hindi and Tamil Question Answering","dataset_url":"/dataset/chaii-hindi-and-tamil-question-answering","rows_in_archive":1,"metrics":["Jaccard"],"first_row_in_archive_order":{"model":"MuCoT","paper_title":"MuCoT: Multilingual Contrastive Training for Question-Answering in Low-resource Languages","paper_url":"/paper/mucot-multilingual-contrastive-training-for","paper_date":"2022-04-12","arxiv_id":"2204.05814","code_links":[{"title":"gokulkarthik/mucot","url":"https://github.com/gokulkarthik/mucot"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-coco-visual-question","slug":"question-answering-on-coco-visual-question","dataset":"COCO Visual Question Answering (VQA) real images 1.0 open ended","dataset_url":"/dataset/coco","rows_in_archive":1,"metrics":["Test"],"first_row_in_archive_order":{"model":"MaMMUT (2B)","paper_title":"MaMMUT: A Simple Architecture for Joint Learning for MultiModal Tasks","paper_url":"/paper/mammut-a-simple-architecture-for-joint","paper_date":"2023-03-29","arxiv_id":"2303.16839","code_links":[{"title":"lucidrains/mammut-pytorch","url":"https://github.com/lucidrains/mammut-pytorch"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-complexwebquestions","slug":"question-answering-on-complexwebquestions","dataset":"ComplexWebQuestions","dataset_url":"/dataset/complexwebquestions","rows_in_archive":1,"metrics":["EM"],"first_row_in_archive_order":{"model":"TOME-2","paper_title":"Mention Memory: incorporating textual knowledge into Transformers through entity mention attention","paper_url":"/paper/mention-memory-incorporating-textual-1","paper_date":"2021-10-12","arxiv_id":"2110.06176","code_links":[{"title":"google-research/language","url":"https://github.com/google-research/language/tree/master/language/mentionmemory"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-efficientqa-dev","slug":"question-answering-on-efficientqa-dev","dataset":"EfficientQA dev","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"UnitedQA","paper_title":"UnitedQA: A Hybrid Approach for Open Domain Question Answering","paper_url":"/paper/unitedqa-a-hybrid-approach-for-open-domain","paper_date":"2021-01-01","arxiv_id":"2101.00178","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-efficientqa-test","slug":"question-answering-on-efficientqa-test","dataset":"EfficientQA test","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"UnitedQA","paper_title":"UnitedQA: A Hybrid Approach for Open Domain Question Answering","paper_url":"/paper/unitedqa-a-hybrid-approach-for-open-domain","paper_date":"2021-01-01","arxiv_id":"2101.00178","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-graphquestions","slug":"question-answering-on-graphquestions","dataset":"GraphQuestions","dataset_url":"/dataset/graphquestions","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ChatGPT","paper_title":"Can ChatGPT Replace Traditional KBQA Models? An In-depth Analysis of the Question Answering Performance of the GPT LLM Family","paper_url":"/paper/evaluation-of-chatgpt-as-a-question-answering","paper_date":"2023-03-14","arxiv_id":"2303.07992","code_links":[{"title":"tan92hl/complex-question-answering-evaluation-of-gpt-family","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-gpt-family"},{"title":"tan92hl/complex-question-answering-evaluation-of-chatgpt","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-chatgpt"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-hellaswag","slug":"question-answering-on-hellaswag","dataset":"HellaSwag","dataset_url":"/dataset/hellaswag","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Shakti-LLM (2.5B)","paper_title":"SHAKTI: A 2.5 Billion Parameter Small Language Model Optimized for Edge AI and Low-Resource Environments","paper_url":"/paper/shakti-a-2-5-billion-parameter-small-language","paper_date":"2024-10-15","arxiv_id":"2410.11331","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-jaquad","slug":"question-answering-on-jaquad","dataset":"JaQuAD","dataset_url":"/dataset/jaquad","rows_in_archive":1,"metrics":["Exact Match","F1"],"first_row_in_archive_order":{"model":"BERT-Japanese","paper_title":"JaQuAD: Japanese Question Answering Dataset for Machine Reading Comprehension","paper_url":"/paper/jaquad-japanese-question-answering-dataset","paper_date":"2022-02-03","arxiv_id":"2202.01764","code_links":[{"title":"SkelterLabsInc/JaQuAD","url":"https://github.com/SkelterLabsInc/JaQuAD"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-kqa-pro","slug":"question-answering-on-kqa-pro","dataset":"KQA Pro","dataset_url":"/dataset/kqa-pro","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ChatGPT","paper_title":"Can ChatGPT Replace Traditional KBQA Models? An In-depth Analysis of the Question Answering Performance of the GPT LLM Family","paper_url":"/paper/evaluation-of-chatgpt-as-a-question-answering","paper_date":"2023-03-14","arxiv_id":"2303.07992","code_links":[{"title":"tan92hl/complex-question-answering-evaluation-of-gpt-family","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-gpt-family"},{"title":"tan92hl/complex-question-answering-evaluation-of-chatgpt","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-chatgpt"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mapeval-textual","slug":"question-answering-on-mapeval-textual","dataset":"MapEval-Textual","dataset_url":"/dataset/mapeval-textual","rows_in_archive":1,"metrics":["Accuracy (% )"],"first_row_in_archive_order":{"model":"Claude-3.5-Sonnet","paper_title":"MapEval: A Map-Based Evaluation of Geo-Spatial Reasoning in Foundation Models","paper_url":"/paper/mapeval-a-map-based-evaluation-of-geo-spatial","paper_date":"2024-12-31","arxiv_id":"2501.00316","code_links":[{"title":"MapEval/MapEval-Visual","url":"https://github.com/MapEval/MapEval-Visual"},{"title":"MapEval/MapEval-API","url":"https://github.com/MapEval/MapEval-API"},{"title":"MapEval/MapEval-Textual","url":"https://github.com/MapEval/MapEval-Textual"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":3}}},{"leaderboard":"/sota/question-answering-on-mctest-160","slug":"question-answering-on-mctest-160","dataset":"MCTest-160","dataset_url":"/dataset/mctest","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"syntax, frame, coreference, and word embedding features","paper_title":"A Parallel-Hierarchical Model for Machine Comprehension on Sparse Data","paper_url":"/paper/a-parallel-hierarchical-model-for-machine","paper_date":"2016-03-29","arxiv_id":"1603.08884","code_links":[{"title":"Maluuba/mctest-model","url":"https://github.com/Maluuba/mctest-model"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-medmcqa-dev","slug":"question-answering-on-medmcqa-dev","dataset":"MedMCQA Dev","dataset_url":null,"rows_in_archive":1,"metrics":["Accuarcy"],"first_row_in_archive_order":{"model":"MedMobile (3.8B)","paper_title":"MedMobile: A mobile-sized language model with expert-level clinical capabilities","paper_url":"/paper/medmobile-a-mobile-sized-language-model-with","paper_date":"2024-10-11","arxiv_id":"2410.09019","code_links":[{"title":"nyuolab/MedMobile","url":"https://github.com/nyuolab/MedMobile"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-metaqa","slug":"question-answering-on-metaqa","dataset":"MetaQA","dataset_url":"/dataset/metaqa","rows_in_archive":1,"metrics":["AnswerExactMatch (Question Answering)"],"first_row_in_archive_order":{"model":"T5-small+prolog","paper_title":"Domain Specific Question Answering Over Knowledge Graphs Using Logical Programming and Large Language Models","paper_url":"/paper/answering-questions-over-knowledge-graphs","paper_date":"2023-03-03","arxiv_id":"2303.02206","code_links":[{"title":"navidmdn/logic_based_qa","url":"https://github.com/navidmdn/logic_based_qa"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mmlu","slug":"question-answering-on-mmlu","dataset":"MML","dataset_url":"/dataset/mmlu","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"qwen-LLM 7B","paper_title":"SHAKTI: A 2.5 Billion Parameter Small Language Model Optimized for Edge AI and Low-Resource Environments","paper_url":"/paper/shakti-a-2-5-billion-parameter-small-language","paper_date":"2024-10-15","arxiv_id":"2410.11331","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-mrqa-out-of-domain","slug":"question-answering-on-mrqa-out-of-domain","dataset":"MRQA out-of-domain","dataset_url":null,"rows_in_archive":1,"metrics":["Average F1"],"first_row_in_archive_order":{"model":"RGX","paper_title":"Cooperative Self-training of Machine Reading Comprehension","paper_url":"/paper/cooperative-learning-of-zero-shot-machine","paper_date":"2021-03-12","arxiv_id":"2103.07449","code_links":[{"title":"luohongyin/RGX","url":"https://github.com/luohongyin/RGX"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-multispanqa","slug":"question-answering-on-multispanqa","dataset":"MultiSpanQA","dataset_url":null,"rows_in_archive":1,"metrics":["Exact F1"],"first_row_in_archive_order":{"model":"RoBERTa-large Tagger + LIQUID (Ensemble)","paper_title":"LIQUID: A Framework for List Question Answering Dataset Generation","paper_url":"/paper/liquid-a-framework-for-list-question","paper_date":"2023-02-03","arxiv_id":"2302.01691","code_links":[{"title":"dmis-lab/liquid","url":"https://github.com/dmis-lab/liquid"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}}},{"leaderboard":"/sota/question-answering-on-qasper","slug":"question-answering-on-qasper","dataset":"QASPER","dataset_url":"/dataset/qasper","rows_in_archive":1,"metrics":["Token F1"],"first_row_in_archive_order":{"model":"Longformer Encoder Decoder (base)","paper_title":"A Dataset of Information-Seeking Questions and Answers Anchored in Research Papers","paper_url":"/paper/a-dataset-of-information-seeking-questions","paper_date":"2021-05-07","arxiv_id":"2105.03011","code_links":[{"title":"allenai/qasper-led-baseline","url":"https://github.com/allenai/qasper-led-baseline"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-recipeqa","slug":"question-answering-on-recipeqa","dataset":"RecipeQA","dataset_url":"/dataset/recipeqa","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"multimodal+LXMERT+ConstrainedMaxPooling","paper_title":"Latent Alignment of Procedural Concepts in Multimodal Recipes","paper_url":"/paper/latent-alignment-of-procedural-concepts-in-1","paper_date":"2021-01-12","arxiv_id":"2101.04727","code_links":[{"title":"HLR/LatentAlignmentProcedural","url":"https://github.com/HLR/LatentAlignmentProcedural"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-schizzosquad","slug":"question-answering-on-schizzosquad","dataset":"SchizzoSQUAD","dataset_url":"/dataset/schizzosquad","rows_in_archive":1,"metrics":["Average F1","Averaged Precision"],"first_row_in_archive_order":{"model":"SchizzoBioBERT","paper_title":"Question-Answering Model for Schizophrenia Symptoms and Their Impact on Daily Life using Mental Health Forums Data","paper_url":"/paper/question-answering-model-for-schizophrenia","paper_date":"2023-09-30","arxiv_id":"2310.00448","code_links":[],"syntology":null}},{"leaderboard":"/sota/question-answering-on-simplequestions","slug":"question-answering-on-simplequestions","dataset":"SimpleQuestions","dataset_url":"/dataset/simplequestions","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"Memory Networks (ensemble)","paper_title":"Large-scale Simple Question Answering with Memory Networks","paper_url":"/paper/large-scale-simple-question-answering-with","paper_date":"2015-06-05","arxiv_id":"1506.02075","code_links":[{"title":"facebookresearch/ParlAI","url":"https://github.com/facebookresearch/ParlAI"},{"title":"au1khan/FactQA","url":"https://github.com/au1khan/FactQA"},{"title":"aukhanee/FactQA","url":"https://github.com/aukhanee/FactQA"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-stepgame","slug":"question-answering-on-stepgame","dataset":"StepGame","dataset_url":"/dataset/stepgame","rows_in_archive":1,"metrics":["1-of-100 Accuracy"],"first_row_in_archive_order":{"model":"TP-MANN","paper_title":"StepGame: A New Benchmark for Robust Multi-Hop Spatial Reasoning in Texts","paper_url":"/paper/stepgame-a-new-benchmark-for-robust-multi-hop-1","paper_date":"2022-04-18","arxiv_id":"2204.08292","code_links":[{"title":"ZhengxiangShi/StepGame","url":"https://github.com/ZhengxiangShi/StepGame"}],"syntology":{"n":7,"n_ran":5,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-swag","slug":"question-answering-on-swag","dataset":"SWAG","dataset_url":"/dataset/swag","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"DeBERTaV3large","paper_title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","paper_url":"/paper/debertav3-improving-deberta-using-electra","paper_date":"2021-11-18","arxiv_id":"2111.09543","code_links":[{"title":"microsoft/DeBERTa","url":"https://github.com/microsoft/DeBERTa"},{"title":"dashenzi721/hra","url":"https://github.com/dashenzi721/hra"},{"title":"stareru/csqa_debertav3","url":"https://github.com/stareru/csqa_debertav3"}],"syntology":{"n":7,"n_ran":0,"n_unverified":7,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-tat-qa","slug":"question-answering-on-tat-qa","dataset":"TAT-QA","dataset_url":"/dataset/tat-qa","rows_in_archive":1,"metrics":["Exact Match (EM)"],"first_row_in_archive_order":{"model":"TagOp","paper_title":"TAT-QA: A Question Answering Benchmark on a Hybrid of Tabular and Textual Content in Finance","paper_url":"/paper/tat-qa-a-question-answering-benchmark-on-a","paper_date":"2021-05-17","arxiv_id":"2105.07624","code_links":[{"title":"NExTplusplus/TAT-QA","url":"https://github.com/NExTplusplus/TAT-QA"}],"syntology":{"n":12,"n_ran":2,"n_unverified":10,"n_pointer_only":0}}},{"leaderboard":"/sota/question-answering-on-webquestionssp","slug":"question-answering-on-webquestionssp","dataset":"WebQuestionsSP","dataset_url":"/dataset/webquestionssp","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ChatGPT","paper_title":"Can ChatGPT Replace Traditional KBQA Models? An In-depth Analysis of the Question Answering Performance of the GPT LLM Family","paper_url":"/paper/evaluation-of-chatgpt-as-a-question-answering","paper_date":"2023-03-14","arxiv_id":"2303.07992","code_links":[{"title":"tan92hl/complex-question-answering-evaluation-of-gpt-family","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-gpt-family"},{"title":"tan92hl/complex-question-answering-evaluation-of-chatgpt","url":"https://github.com/tan92hl/complex-question-answering-evaluation-of-chatgpt"}],"syntology":null}},{"leaderboard":"/sota/question-answering-on-websrc","slug":"question-answering-on-websrc","dataset":"WebSRC","dataset_url":"/dataset/websrc","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"ChatGPT 3.5 SpatialFormat","paper_title":"LAPDoc: Layout-Aware Prompting for Documents","paper_url":"/paper/lapdoc-layout-aware-prompting-for-documents","paper_date":"2024-02-15","arxiv_id":"2402.09841","code_links":[],"syntology":null}},{"leaderboard":null,"slug":"question-answering-on-adversarial-qa","dataset":"adversarial_qa","dataset_url":"/dataset/adversarialqa","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-agriqa","dataset":"AgriQA","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squad-adversarial","dataset":"squad_adversarial","dataset_url":"/dataset/squad","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squad-tr","dataset":"squad_tr","dataset_url":null,"rows_in_archive":0,"metrics":["F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squad-v2","dataset":"squad_v2","dataset_url":"/dataset/squad","rows_in_archive":0,"metrics":["Exact Match","f1","total"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squadshifts-amazon","dataset":"squadshifts amazon","dataset_url":"/dataset/squad-shifts","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squadshifts-new-wiki","dataset":"squadshifts new_wiki","dataset_url":"/dataset/squad-shifts","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squadshifts-nyt","dataset":"squadshifts nyt","dataset_url":"/dataset/squad-shifts","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-squadshifts-reddit","dataset":"squadshifts reddit","dataset_url":"/dataset/reddit","rows_in_archive":0,"metrics":["Exact Match","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"question-answering-on-tigrinya-q-a","dataset":"Tigrinya Q&A","dataset_url":null,"rows_in_archive":0,"metrics":["Eval Loss","Perplexity"],"first_row_in_archive_order":null}],"datasets":[{"url":"/dataset/coco","name":"COCO (Common Objects in Context)","full_name":"Common Objects in Context","num_papers_in_archive":11922},{"url":"/dataset/mnist","name":"MNIST","full_name":"","num_papers_in_archive":7651},{"url":"/dataset/mmlu","name":"MML","full_name":"Massive Multitask Language Understanding","num_papers_in_archive":1922},{"url":"/dataset/natural-questions","name":"Natural Questions","full_name":"","num_papers_in_archive":1404},{"url":"/dataset/ms-marco","name":"MS MARCO","full_name":"Microsoft Machine Reading Comprehension Dataset","num_papers_in_archive":1036},{"url":"/dataset/hellaswag","name":"HellaSwag","full_name":"","num_papers_in_archive":994},{"url":"/dataset/triviaqa","name":"TriviaQA","full_name":"","num_papers_in_archive":953},{"url":"/dataset/hotpotqa","name":"HotpotQA","full_name":"","num_papers_in_archive":933},{"url":"/dataset/conceptnet","name":"ConceptNet","full_name":"","num_papers_in_archive":852},{"url":"/dataset/piqa","name":"PIQA","full_name":"Physical Interaction: Question Answering","num_papers_in_archive":772},{"url":"/dataset/winogrande","name":"WinoGrande","full_name":"","num_papers_in_archive":703},{"url":"/dataset/boolq","name":"BoolQ","full_name":"Boolean Questions","num_papers_in_archive":701},{"url":"/dataset/reddit","name":"Reddit","full_name":"","num_papers_in_archive":699},{"url":"/dataset/openbookqa","name":"OpenBookQA","full_name":"OBQA","num_papers_in_archive":635},{"url":"/dataset/truthfulqa","name":"TruthfulQA","full_name":"","num_papers_in_archive":607},{"url":"/dataset/cnn-daily-mail-1","name":"CNN/Daily Mail","full_name":"CNN/Daily Mail","num_papers_in_archive":530},{"url":"/dataset/fever","name":"FEVER","full_name":"Fact Extraction and VERification","num_papers_in_archive":498},{"url":"/dataset/textvqa","name":"TextVQA","full_name":"","num_papers_in_archive":476},{"url":"/dataset/race","name":"RACE","full_name":"ReAding Comprehension dataset from Examinations","num_papers_in_archive":412},{"url":"/dataset/drop","name":"DROP","full_name":"Discrete Reasoning Over Paragraphs","num_papers_in_archive":382},{"url":"/dataset/ok-vqa","name":"OK-VQA","full_name":"Outside Knowledge Visual Question Answering","num_papers_in_archive":368},{"url":"/dataset/bbh","name":"BBH","full_name":"BIG-Bench Hard","num_papers_in_archive":352},{"url":"/dataset/conceptual-captions","name":"Conceptual Captions","full_name":"Conceptual Captions","num_papers_in_archive":352},{"url":"/dataset/scienceqa","name":"ScienceQA","full_name":"Science Question Answering","num_papers_in_archive":339},{"url":"/dataset/copa","name":"COPA","full_name":"Choice of Plausible Alternatives","num_papers_in_archive":329},{"url":"/dataset/medqa-usmle","name":"MedQA","full_name":"","num_papers_in_archive":328},{"url":"/dataset/beir","name":"BEIR","full_name":"Benchmarking IR","num_papers_in_archive":311},{"url":"/dataset/strategyqa","name":"StrategyQA","full_name":"","num_papers_in_archive":291},{"url":"/dataset/docvqa","name":"DocVQA","full_name":"","num_papers_in_archive":290},{"url":"/dataset/coqa","name":"CoQA","full_name":"Conversational Question Answering Challenge","num_papers_in_archive":281},{"url":"/dataset/pubmedqa","name":"PubMedQA","full_name":"PubMedQA","num_papers_in_archive":276},{"url":"/dataset/newsqa","name":"NewsQA","full_name":"","num_papers_in_archive":272},{"url":"/dataset/wikisql","name":"WikiSQL","full_name":"WikiSQL","num_papers_in_archive":267},{"url":"/dataset/mathvista","name":"MathVista","full_name":"Mathematical Reasoning of in Visual Contexts","num_papers_in_archive":242},{"url":"/dataset/webquestions","name":"WebQuestions","full_name":"","num_papers_in_archive":241},{"url":"/dataset/lama","name":"LAMA","full_name":"LAnguage Model Analysis","num_papers_in_archive":214},{"url":"/dataset/ai2d","name":"AI2D","full_name":"AI2 Diagrams","num_papers_in_archive":207},{"url":"/dataset/narrativeqa","name":"NarrativeQA","full_name":"NarrativeQA","num_papers_in_archive":206},{"url":"/dataset/wikiqa","name":"WikiQA","full_name":"Wikipedia open-domain Question Answering","num_papers_in_archive":196},{"url":"/dataset/bioasq","name":"BioASQ","full_name":"Biomedical Semantic Indexing and Question Answering","num_papers_in_archive":192},{"url":"/dataset/xquad","name":"XQuAD","full_name":"XQuAD","num_papers_in_archive":190},{"url":"/dataset/quac","name":"QuAC","full_name":"Question Answering in Context","num_papers_in_archive":178},{"url":"/dataset/next-qa","name":"NExT-QA","full_name":"","num_papers_in_archive":174},{"url":"/dataset/atomic","name":"ATOMIC","full_name":"","num_papers_in_archive":170},{"url":"/dataset/mlqa","name":"MLQA","full_name":"MultiLingual Question Answering","num_papers_in_archive":167},{"url":"/dataset/cord-19","name":"CORD-19","full_name":"CORD-19","num_papers_in_archive":163},{"url":"/dataset/swag","name":"SWAG","full_name":"Situations With Adversarial Generations","num_papers_in_archive":163},{"url":"/dataset/multirc","name":"MultiRC","full_name":"Multi-Sentence Reading Comprehension","num_papers_in_archive":162},{"url":"/dataset/mathqa","name":"MathQA","full_name":"","num_papers_in_archive":159},{"url":"/dataset/visdial","name":"VisDial","full_name":"Visual Dialog","num_papers_in_archive":159},{"url":"/dataset/eli5","name":"ELI5","full_name":"ELI5","num_papers_in_archive":158},{"url":"/dataset/squad","name":"SQuAD","full_name":"Stanford Question Answering Dataset","num_papers_in_archive":151},{"url":"/dataset/tydi-qa","name":"TyDiQA","full_name":"Typologically Diverse Question Answering","num_papers_in_archive":148},{"url":"/dataset/activitynet-qa","name":"ActivityNet-QA","full_name":"","num_papers_in_archive":146},{"url":"/dataset/e-snli","name":"e-SNLI","full_name":"","num_papers_in_archive":139},{"url":"/dataset/shapes-1","name":"SHAPES","full_name":"Swarm Heuristics based Adaptive and Penalized Estimation of Splines","num_papers_in_archive":120},{"url":"/dataset/simplequestions","name":"SimpleQuestions","full_name":"","num_papers_in_archive":120},{"url":"/dataset/social-iqa","name":"SIQA","full_name":"Social Interaction QA","num_papers_in_archive":120},{"url":"/dataset/kilt","name":"KILT","full_name":"KILT Benchmark","num_papers_in_archive":117},{"url":"/dataset/t-rex","name":"T-REx","full_name":"","num_papers_in_archive":117},{"url":"/dataset/mrqa-2019","name":"MRQA","full_name":"","num_papers_in_archive":116},{"url":"/dataset/mctest","name":"MCTest","full_name":"","num_papers_in_archive":114},{"url":"/dataset/qasc","name":"QASC","full_name":"Question Answering via Sentence Composition","num_papers_in_archive":114},{"url":"/dataset/finqa","name":"FinQA","full_name":"","num_papers_in_archive":110},{"url":"/dataset/dvs128-gesture-dataset","name":"DVS128 Gesture","full_name":"","num_papers_in_archive":103},{"url":"/dataset/2wikimultihopqa","name":"2WikiMultiHopQA","full_name":"","num_papers_in_archive":102},{"url":"/dataset/cosmosqa","name":"CosmosQA","full_name":"","num_papers_in_archive":102},{"url":"/dataset/qasper","name":"QASPER","full_name":"","num_papers_in_archive":102},{"url":"/dataset/quality","name":"QuALITY","full_name":"Question Answering with Long Input Texts, Yes!","num_papers_in_archive":98},{"url":"/dataset/raven","name":"RAVEN","full_name":"","num_papers_in_archive":96},{"url":"/dataset/cbt","name":"CBT","full_name":"Children’s Book Test","num_papers_in_archive":92},{"url":"/dataset/tgif-qa","name":"TGIF-QA","full_name":"TGIF-QA","num_papers_in_archive":92},{"url":"/dataset/popqa","name":"PopQA","full_name":"","num_papers_in_archive":91},{"url":"/dataset/st-vqa","name":"ST-VQA","full_name":"Scene Text Visual Question Answering","num_papers_in_archive":90},{"url":"/dataset/pathvqa","name":"PathVQA","full_name":"","num_papers_in_archive":89},{"url":"/dataset/reclor","name":"ReClor","full_name":"","num_papers_in_archive":88},{"url":"/dataset/metaqa","name":"MetaQA","full_name":"MoviE Text Audio QA","num_papers_in_archive":81},{"url":"/dataset/wikitablequestions","name":"WikiTableQuestions","full_name":"","num_papers_in_archive":79},{"url":"/dataset/tat-qa","name":"TAT-QA","full_name":"","num_papers_in_archive":76},{"url":"/dataset/semantic-scholar","name":"Semantic Scholar","full_name":"Semantic Scholar","num_papers_in_archive":75},{"url":"/dataset/trecqa","name":"TrecQA","full_name":"Text Retrieval Conference Question Answering","num_papers_in_archive":73},{"url":"/dataset/hybridqa","name":"HybridQA","full_name":"","num_papers_in_archive":70},{"url":"/dataset/beavertails","name":"BeaverTails","full_name":"","num_papers_in_archive":68},{"url":"/dataset/belebele","name":"Belebele","full_name":"","num_papers_in_archive":68},{"url":"/dataset/dream","name":"DREAM","full_name":"","num_papers_in_archive":68},{"url":"/dataset/cfq","name":"CFQ","full_name":"Compositional Freebase Questions","num_papers_in_archive":66},{"url":"/dataset/wikihop","name":"WikiHop","full_name":"","num_papers_in_archive":66},{"url":"/dataset/coco-qa","name":"COCO-QA","full_name":"","num_papers_in_archive":62},{"url":"/dataset/complexwebquestions","name":"ComplexWebQuestions","full_name":"ComplexWebQuestions","num_papers_in_archive":62},{"url":"/dataset/figureqa","name":"FigureQA","full_name":"","num_papers_in_archive":61},{"url":"/dataset/webquestionssp","name":"WebQuestionsSP","full_name":"WebQuestions Semantic Parses Dataset","num_papers_in_archive":61},{"url":"/dataset/tvqa-1","name":"TVQA+","full_name":"","num_papers_in_archive":60},{"url":"/dataset/canard","name":"CANARD","full_name":"A Dataset for Question-in-Context Rewriting","num_papers_in_archive":58},{"url":"/dataset/sqa3d","name":"SQA3D","full_name":"Situated Question Answering in 3D Scenes","num_papers_in_archive":58},{"url":"/dataset/prontoqa","name":"PrOntoQA","full_name":"Proof and Ontology-Generated Question-Answering","num_papers_in_archive":55},{"url":"/dataset/quasar-t","name":"QUASAR-T","full_name":"QUestion Answering by Search And Reading – Trivia","num_papers_in_archive":55},{"url":"/dataset/quora-question-pairs","name":"Quora Question Pairs","full_name":"","num_papers_in_archive":55},{"url":"/dataset/reverb-challenge","name":"ReVerb Challenge","full_name":"REverberant Voice Enhancement and Recognition Benchmark","num_papers_in_archive":55},{"url":"/dataset/bamboogle","name":"Bamboogle","full_name":"","num_papers_in_archive":54},{"url":"/dataset/daquar","name":"DAQUAR","full_name":"","num_papers_in_archive":54},{"url":"/dataset/drcd","name":"DRCD","full_name":"Delta Reading Comprehension Dataset","num_papers_in_archive":53},{"url":"/dataset/music-avqa","name":"MUSIC-AVQA","full_name":"","num_papers_in_archive":51},{"url":"/dataset/qrecc","name":"QReCC","full_name":"","num_papers_in_archive":51},{"url":"/dataset/storycloze","name":"StoryCloze","full_name":"","num_papers_in_archive":51},{"url":"/dataset/tgif","name":"TGIF","full_name":"Tumblr GIF","num_papers_in_archive":51},{"url":"/dataset/tofu","name":"TOFU","full_name":"Task of Fictitious Unlearning","num_papers_in_archive":51},{"url":"/dataset/children-s-book-test","name":"Children's Book Test","full_name":"","num_papers_in_archive":50},{"url":"/dataset/emrqa","name":"emrQA","full_name":"","num_papers_in_archive":50},{"url":"/dataset/plotqa","name":"PlotQA","full_name":"","num_papers_in_archive":50},{"url":"/dataset/dvqa","name":"DVQA","full_name":"Data Visualizations via Question Answering","num_papers_in_archive":49},{"url":"/dataset/mkqa","name":"MKQA","full_name":"Multilingual Knowledge Questions and Answers","num_papers_in_archive":49},{"url":"/dataset/tqa","name":"TQA","full_name":"Textbook Question Answering","num_papers_in_archive":48},{"url":"/dataset/quasar-1","name":"QUASAR","full_name":"QUestion Answering by Search And Reading","num_papers_in_archive":47},{"url":"/dataset/cos-e","name":"CoS-E","full_name":"Commonsense Explanations Dataset","num_papers_in_archive":46},{"url":"/dataset/geoqa","name":"GeoQA","full_name":"Geometric Question Answering","num_papers_in_archive":46},{"url":"/dataset/dart","name":"DART","full_name":"","num_papers_in_archive":45},{"url":"/dataset/geometry3k","name":"Geometry3K","full_name":"","num_papers_in_archive":45},{"url":"/dataset/sharc","name":"ShARC","full_name":"Shaping Answers with Rules through Conversation","num_papers_in_archive":43},{"url":"/dataset/duorc","name":"DuoRC","full_name":"DuoRC","num_papers_in_archive":42},{"url":"/dataset/scrolls","name":"SCROLLS","full_name":"Standardized CompaRison Over Long Language Sequences","num_papers_in_archive":42},{"url":"/dataset/blurb","name":"BLURB","full_name":"Biomedical Language Understanding and Reasoning Benchmark","num_papers_in_archive":40},{"url":"/dataset/csqa","name":"CSQA","full_name":"","num_papers_in_archive":40},{"url":"/dataset/theoremqa","name":"TheoremQA","full_name":"TheoremQA","num_papers_in_archive":40},{"url":"/dataset/break","name":"BREAK","full_name":"BREAK","num_papers_in_archive":39},{"url":"/dataset/wikimovies","name":"WikiMovies","full_name":"","num_papers_in_archive":39},{"url":"/dataset/convfinqa","name":"ConvFinQA","full_name":"Conversational Finance Question Answering","num_papers_in_archive":38},{"url":"/dataset/insuranceqa","name":"InsuranceQA","full_name":"","num_papers_in_archive":38},{"url":"/dataset/tydiqa-goldp","name":"TyDiQA-GoldP","full_name":"TyDiQA-GoldP","num_papers_in_archive":38},{"url":"/dataset/doc2dial-1","name":"Doc2Dial","full_name":"Doc2Dial: Document-grounded Dialogue","num_papers_in_archive":36},{"url":"/dataset/mslr-web10k","name":"MSLR-WEB10K","full_name":"","num_papers_in_archive":36},{"url":"/dataset/ott-qa","name":"OTT-QA","full_name":null,"num_papers_in_archive":36},{"url":"/dataset/visualmrc","name":"VisualMRC","full_name":"VisualMRC: Machine Reading Comprehension on Document Images","num_papers_in_archive":36},{"url":"/dataset/meqsum","name":"MeQSum","full_name":null,"num_papers_in_archive":33},{"url":"/dataset/scirex","name":"SciREX","full_name":"SciREX","num_papers_in_archive":33},{"url":"/dataset/worldtree","name":"Worldtree","full_name":"","num_papers_in_archive":32},{"url":"/dataset/image-paragraph-captioning","name":"Image Paragraph Captioning","full_name":"","num_papers_in_archive":31},{"url":"/dataset/quartz","name":"QuaRTz","full_name":"QuaRTz Dataset","num_papers_in_archive":30},{"url":"/dataset/codah","name":"CODAH","full_name":"COmmonsense Dataset Adversarially-authored by Humans","num_papers_in_archive":29},{"url":"/dataset/molweni","name":"Molweni","full_name":"","num_papers_in_archive":29},{"url":"/dataset/decanlp","name":"decaNLP","full_name":"Natural Language Decathlon Benchmark","num_papers_in_archive":28},{"url":"/dataset/kaggledbqa","name":"KaggleDBQA","full_name":"KaggleDBQA: Realistic Text-to-SQL dataset","num_papers_in_archive":28},{"url":"/dataset/casehold","name":"CaseHOLD","full_name":"Case Holdings On Legal Decisions","num_papers_in_archive":27},{"url":"/dataset/vqa-hat","name":"VQA-HAT","full_name":"VQA Human Attention","num_papers_in_archive":27},{"url":"/dataset/adversarialqa","name":"AdversarialQA","full_name":"","num_papers_in_archive":26},{"url":"/dataset/dude","name":"DUDE","full_name":"Document UnderstanDing of Everything","num_papers_in_archive":26},{"url":"/dataset/fairytaleqa","name":"FairytaleQA","full_name":"","num_papers_in_archive":26},{"url":"/dataset/genericskb","name":"GenericsKB","full_name":"GenericsKB","num_papers_in_archive":26},{"url":"/dataset/multidoc2dial","name":"MultiDoc2Dial","full_name":"MultiDoc2Dial: Modeling Dialogues Grounded in Multiple Documents","num_papers_in_archive":26},{"url":"/dataset/wikireading","name":"WikiReading","full_name":"","num_papers_in_archive":26},{"url":"/dataset/asnq","name":"ASNQ","full_name":"Answer Sentence Natural Questions","num_papers_in_archive":25},{"url":"/dataset/rsvgd","name":"DIOR-RSVG","full_name":"","num_papers_in_archive":25},{"url":"/dataset/oasst1","name":"OASST1","full_name":"OpenAssistant Conversations Dataset","num_papers_in_archive":25},{"url":"/dataset/arcd","name":"ARCD","full_name":"","num_papers_in_archive":24},{"url":"/dataset/recipeqa","name":"RecipeQA","full_name":"","num_papers_in_archive":24},{"url":"/dataset/spoken-squad","name":"Spoken-SQuAD","full_name":null,"num_papers_in_archive":24},{"url":"/dataset/techqa","name":"TechQA","full_name":"The TechQA Dataset","num_papers_in_archive":24},{"url":"/dataset/tempquestions","name":"TempQuestions","full_name":"","num_papers_in_archive":24},{"url":"/dataset/headqa","name":"HeadQA","full_name":"","num_papers_in_archive":23},{"url":"/dataset/kqa-pro","name":"KQA Pro","full_name":"","num_papers_in_archive":23},{"url":"/dataset/situatedqa","name":"SituatedQA","full_name":"","num_papers_in_archive":23},{"url":"/dataset/social-iq","name":"Social-IQ","full_name":"","num_papers_in_archive":23},{"url":"/dataset/timequestions","name":"TimeQuestions","full_name":"","num_papers_in_archive":23},{"url":"/dataset/booktest","name":"BookTest","full_name":"","num_papers_in_archive":22},{"url":"/dataset/exams","name":"EXAMS","full_name":"","num_papers_in_archive":22},{"url":"/dataset/topiocqa","name":"TopiOCQA","full_name":"","num_papers_in_archive":22},{"url":"/dataset/websrc","name":"WebSRC","full_name":"WebSRC: A Dataset for Web-Based Structural Reading Comprehension","num_papers_in_archive":22},{"url":"/dataset/clicr","name":"CliCR","full_name":"CliCR","num_papers_in_archive":21},{"url":"/dataset/fquad","name":"FQuAD","full_name":"French Question Answering Dataset","num_papers_in_archive":21},{"url":"/dataset/wiqa","name":"WIQA","full_name":"What-If Question Answering","num_papers_in_archive":21},{"url":"/dataset/cloth","name":"CLOTH","full_name":"CLOze test by TeacHers","num_papers_in_archive":20},{"url":"/dataset/mintaka","name":"MINTAKA","full_name":"","num_papers_in_archive":20},{"url":"/dataset/quarel","name":"QuaRel","full_name":"QuaRel","num_papers_in_archive":20},{"url":"/dataset/webchild","name":"WebChild","full_name":"","num_papers_in_archive":20},{"url":"/dataset/cronquestions","name":"CronQuestions","full_name":"","num_papers_in_archive":19},{"url":"/dataset/mathematics","name":"Mathematics Dataset","full_name":"","num_papers_in_archive":19},{"url":"/dataset/qampari","name":"QAMPARI","full_name":"","num_papers_in_archive":19},{"url":"/dataset/qulac","name":"Qulac","full_name":null,"num_papers_in_archive":19},{"url":"/dataset/staqc","name":"StaQC","full_name":"","num_papers_in_archive":19},{"url":"/dataset/trafficqa","name":"SUTD-TrafficQA","full_name":"","num_papers_in_archive":19},{"url":"/dataset/torque","name":"Torque","full_name":"","num_papers_in_archive":19},{"url":"/dataset/tweetqa","name":"TweetQA","full_name":"","num_papers_in_archive":19},{"url":"/dataset/doqa","name":"DoQA","full_name":"","num_papers_in_archive":18},{"url":"/dataset/orcas","name":"ORCAS","full_name":"","num_papers_in_archive":18},{"url":"/dataset/violin","name":"Violin","full_name":"VIdeO-and-Language INference","num_papers_in_archive":18},{"url":"/dataset/clevr-ref","name":"CLEVR-Ref+","full_name":"","num_papers_in_archive":17},{"url":"/dataset/convquestions","name":"ConvQuestions","full_name":"","num_papers_in_archive":17},{"url":"/dataset/egotaskqa","name":"EgoTaskQA","full_name":"","num_papers_in_archive":17},{"url":"/dataset/freebaseqa","name":"FreebaseQA","full_name":"","num_papers_in_archive":17},{"url":"/dataset/orconvqa","name":"ORConvQA","full_name":"Open-Retrieval Conversational Question Answering","num_papers_in_archive":17},{"url":"/dataset/toolqa","name":"ToolQA","full_name":"","num_papers_in_archive":16},{"url":"/dataset/tvc","name":"TVC","full_name":"TV show Captions","num_papers_in_archive":16},{"url":"/dataset/covidqa","name":"CovidQA","full_name":"","num_papers_in_archive":15},{"url":"/dataset/qed","name":"QED","full_name":null,"num_papers_in_archive":15},{"url":"/dataset/stepgame","name":"StepGame","full_name":"StepGame","num_papers_in_archive":15},{"url":"/dataset/uit-viquad","name":"UIT-ViQuAD","full_name":"","num_papers_in_archive":15},{"url":"/dataset/amazonqa","name":"AmazonQA","full_name":"","num_papers_in_archive":14},{"url":"/dataset/graphquestions","name":"GraphQuestions","full_name":"","num_papers_in_archive":14},{"url":"/dataset/medhop","name":"MedHop","full_name":"MedHop","num_papers_in_archive":14},{"url":"/dataset/antique","name":"ANTIQUE","full_name":"","num_papers_in_archive":13},{"url":"/dataset/gooaq","name":"GooAQ","full_name":"","num_papers_in_archive":13},{"url":"/dataset/jec-qa","name":"JEC-QA","full_name":"","num_papers_in_archive":13},{"url":"/dataset/klej","name":"KLEJ","full_name":"","num_papers_in_archive":13},{"url":"/dataset/medconceptsqa","name":"MedConceptsQA","full_name":"","num_papers_in_archive":13},{"url":"/dataset/mediqa-ans","name":"MEDIQA-AnS","full_name":"MEDIQA-Answer Summarization","num_papers_in_archive":13},{"url":"/dataset/moviegraphs","name":"MovieGraphs","full_name":"","num_papers_in_archive":13},{"url":"/dataset/sara","name":"SARA","full_name":"StAtutory Reasoning Assessment","num_papers_in_archive":13},{"url":"/dataset/super-clevr","name":"Super-CLEVR","full_name":"","num_papers_in_archive":13},{"url":"/dataset/visual-madlibs","name":"Visual Madlibs","full_name":"","num_papers_in_archive":13},{"url":"/dataset/who-did-what","name":"Who-did-What","full_name":"Who did What","num_papers_in_archive":13},{"url":"/dataset/conditionalqa","name":"ConditionalQA","full_name":"","num_papers_in_archive":12},{"url":"/dataset/dramaqa","name":"DramaQA","full_name":"","num_papers_in_archive":12},{"url":"/dataset/habitat-platform","name":"Habitat Platform","full_name":"","num_papers_in_archive":12},{"url":"/dataset/peerqa","name":"PeerQA","full_name":"","num_papers_in_archive":12},{"url":"/dataset/policyqa","name":"PolicyQA","full_name":"","num_papers_in_archive":12},{"url":"/dataset/prost","name":"PROST","full_name":"Physical Reasoning about Objects Through Space and Time","num_papers_in_archive":12},{"url":"/dataset/house3d-environment","name":"House3D Environment","full_name":"","num_papers_in_archive":11},{"url":"/dataset/multitq","name":"MultiTQ","full_name":"","num_papers_in_archive":11},{"url":"/dataset/protoqa","name":"ProtoQA","full_name":null,"num_papers_in_archive":11},{"url":"/dataset/tiq","name":"TIQ","full_name":"","num_papers_in_archive":11},{"url":"/dataset/clevr-dialog","name":"CLEVR-Dialog","full_name":"CLEVR-Dialog","num_papers_in_archive":10},{"url":"/dataset/fm-iqa","name":"FM-IQA","full_name":"Freestyle Multilingual Image Question Answering","num_papers_in_archive":10},{"url":"/dataset/xquad-r","name":"LAReQA","full_name":"","num_papers_in_archive":10},{"url":"/dataset/perception-test","name":"Perception Test","full_name":"","num_papers_in_archive":10},{"url":"/dataset/reqa","name":"ReQA","full_name":"Retrieval Question-Answering","num_papers_in_archive":10},{"url":"/dataset/sberquad","name":"SberQuAD","full_name":"Sberbank Question Answering Dataset","num_papers_in_archive":10},{"url":"/dataset/wikiconv","name":"WikiConv","full_name":"","num_papers_in_archive":10},{"url":"/dataset/aqua","name":"AQUA","full_name":"","num_papers_in_archive":9},{"url":"/dataset/comqa","name":"ComQA","full_name":"","num_papers_in_archive":9},{"url":"/dataset/cqasumm","name":"CQASUMM","full_name":"","num_papers_in_archive":9},{"url":"/dataset/e-kar","name":"E-KAR","full_name":"Benchmark for Explainable Knowledge-intensive Analogical Reasoning","num_papers_in_archive":9},{"url":"/dataset/how2r","name":"How2R","full_name":"How2R","num_papers_in_archive":9},{"url":"/dataset/knowit-vqa","name":"KnowIT VQA","full_name":"","num_papers_in_archive":9},{"url":"/dataset/leaf-qa","name":"LEAF-QA","full_name":"","num_papers_in_archive":9},{"url":"/dataset/radqa","name":"RadQA","full_name":"A Question Answering Dataset to Improve Comprehension of Radiology Reports","num_papers_in_archive":9},{"url":"/dataset/selqa","name":"SelQA","full_name":"","num_papers_in_archive":9},{"url":"/dataset/spartqa","name":"SPARTQA","full_name":"SPAtial Reasoning on Textual Question Answering","num_papers_in_archive":9},{"url":"/dataset/spartqa-1","name":"SPARTQA -","full_name":"SPAtial Reasoning on Textual Question Answering.","num_papers_in_archive":9},{"url":"/dataset/squad-shifts","name":"SQuADShifts","full_name":"","num_papers_in_archive":9},{"url":"/dataset/webcpm","name":"WebCPM","full_name":"","num_papers_in_archive":9},{"url":"/dataset/clevr-math","name":"CLEVR-Math","full_name":"","num_papers_in_archive":8},{"url":"/dataset/germanquad","name":"GermanQuAD","full_name":"","num_papers_in_archive":8},{"url":"/dataset/opiec","name":"OPIEC","full_name":"Open Information Extraction Corpus","num_papers_in_archive":8},{"url":"/dataset/peyma","name":"PEYMA","full_name":"","num_papers_in_archive":8},{"url":"/dataset/quasar-s","name":"QUASAR-S","full_name":"QUestion Answering by Search And Reading – Stack Overflow","num_papers_in_archive":8},{"url":"/dataset/quizbowl","name":"Quizbowl","full_name":"","num_papers_in_archive":8},{"url":"/dataset/subjqa","name":"SubjQA","full_name":null,"num_papers_in_archive":8},{"url":"/dataset/cog","name":"COG","full_name":"","num_papers_in_archive":7},{"url":"/dataset/danetqa","name":"DaNetQA","full_name":"Yes/no Question Answering Dataset for the Russian","num_papers_in_archive":7},{"url":"/dataset/dblp-quad","name":"DBLP-QuAD","full_name":"DBLP Question Answering Dataset","num_papers_in_archive":7},{"url":"/dataset/forecastqa","name":"ForecastQA","full_name":"","num_papers_in_archive":7},{"url":"/dataset/ghosts","name":"GHOSTS","full_name":"","num_papers_in_archive":7},{"url":"/dataset/iquad","name":"IQUAD","full_name":"Interactive Question Answering Dataset","num_papers_in_archive":7},{"url":"/dataset/marc-ja","name":"JGLUE","full_name":"","num_papers_in_archive":7},{"url":"/dataset/k-qa","name":"k-qa","full_name":"K-QA: A Real-World Medical Q&A Benchmark","num_papers_in_archive":7},{"url":"/dataset/liveqa","name":"LiveQA","full_name":"","num_papers_in_archive":7},{"url":"/dataset/manymodalqa","name":"ManyModalQA","full_name":"","num_papers_in_archive":7},{"url":"/dataset/next-qa-open-ended-videoqa","name":"NExT-QA (Open-ended VideoQA)","full_name":"","num_papers_in_archive":7},{"url":"/dataset/rubq","name":"RuBQ","full_name":"Russian Knowledge Base Questions","num_papers_in_archive":7},{"url":"/dataset/vnhsge","name":"VNHSGE","full_name":"VietNamese High School Graduation Examination Dataset for Large Language Models","num_papers_in_archive":7},{"url":"/dataset/bipia","name":"BIPIA","full_name":"Benchmark of Indirect Prompt Injection Attacks","num_papers_in_archive":6},{"url":"/dataset/frenchmedmcqa","name":"FrenchMedMCQA","full_name":"FrenchMedMCQA: A French Multiple-Choice Question Answering Dataset for Medical domain","num_papers_in_archive":6},{"url":"/dataset/kamel","name":"KAMEL","full_name":"Knowledge Analysis with Multitoken Entities in Language Models","num_papers_in_archive":6},{"url":"/dataset/moviefib","name":"MovieFIB","full_name":"Movie Fill-in-the-Blank","num_papers_in_archive":6},{"url":"/dataset/muserc","name":"MuSeRC","full_name":"Russian Multi-Sentence Reading Comprehension","num_papers_in_archive":6},{"url":"/dataset/relx","name":"RELX","full_name":null,"num_papers_in_archive":6},{"url":"/dataset/v2c","name":"V2C","full_name":"Video-to-Commonsense","num_papers_in_archive":6},{"url":"/dataset/xqa","name":"XQA","full_name":"XQA","num_papers_in_archive":6},{"url":"/dataset/ai2d-rst","name":"AI2D-RST","full_name":"","num_papers_in_archive":5},{"url":"/dataset/flenqa","name":"FlenQA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/kg20c","name":"KG20C","full_name":"A scholarly knowledge graph benchmark dataset","num_papers_in_archive":5},{"url":"/dataset/matinf","name":"MATINF","full_name":"Maternal and Infant Dataset","num_papers_in_archive":5},{"url":"/dataset/moa","name":"MoA","full_name":"MoA_Long_ModelQA","num_papers_in_archive":5},{"url":"/dataset/mocha","name":"MOCHA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/onestopqa","name":"OneStopQA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/pquad","name":"PQuAD","full_name":"Persian Question Answering Dataset","num_papers_in_archive":5},{"url":"/dataset/qaconv","name":"QAConv","full_name":"","num_papers_in_archive":5},{"url":"/dataset/rucos","name":"RuCoS","full_name":"Russian Reading Comprehension with Commonsense Reasoning","num_papers_in_archive":5},{"url":"/dataset/spartun","name":"SpaRTUN","full_name":"","num_papers_in_archive":5},{"url":"/dataset/tutorialvqa","name":"TutorialVQA","full_name":"TutorialVQA","num_papers_in_archive":5},{"url":"/dataset/wikihowqa","name":"WikiHowQA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/ccpe-m","name":"CCPE-M","full_name":"Coached Conversational Preference Elicitation dataset for Movies","num_papers_in_archive":4},{"url":"/dataset/compmix","name":"CompMix","full_name":"","num_papers_in_archive":4},{"url":"/dataset/convref","name":"ConvRef","full_name":"","num_papers_in_archive":4},{"url":"/dataset/cs1qa","name":"CS1QA","full_name":"","num_papers_in_archive":4},{"url":"/dataset/discq","name":"DiSCQ","full_name":"Discharge Summary Clinical Questions","num_papers_in_archive":4},{"url":"/dataset/indonlg","name":"IndoNLG","full_name":"","num_papers_in_archive":4},{"url":"/dataset/jaquad","name":"JaQuAD","full_name":"","num_papers_in_archive":4},{"url":"/dataset/scde","name":"SCDE","full_name":"SCDE","num_papers_in_archive":4},{"url":"/dataset/uniprotqa","name":"UniProtQA","full_name":"","num_papers_in_archive":4},{"url":"/dataset/videonavqa","name":"VideoNavQA","full_name":"","num_papers_in_archive":4},{"url":"/dataset/xor-tydi-qa","name":"XOR-TYDI QA","full_name":"","num_papers_in_archive":4},{"url":"/dataset/afriqa","name":"AfriQA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/allegro-reviews","name":"Allegro Reviews","full_name":"","num_papers_in_archive":3},{"url":"/dataset/chq-summ","name":"CHQ-Summ","full_name":"Consumer Healthcare Question Summarization","num_papers_in_archive":3},{"url":"/dataset/clarq","name":"ClarQ","full_name":"ClarQ","num_papers_in_archive":3},{"url":"/dataset/complex-cronquestions","name":"Complex-CronQuestions","full_name":"","num_papers_in_archive":3},{"url":"/dataset/simran-arora","name":"ConcurrentQA Benchmark","full_name":"","num_papers_in_archive":3},{"url":"/dataset/covid-q","name":"COVID-Q","full_name":"","num_papers_in_archive":3},{"url":"/dataset/italian-crime-news","name":"DICE: a Dataset of Italian Crime Event news","full_name":"from Gazzetta di Modena [2011-2021]","num_papers_in_archive":3},{"url":"/dataset/disfl-qa","name":"Disfl-QA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/drugehrqa","name":"DrugEHRQA","full_name":"Electronic Health Record QA","num_papers_in_archive":3},{"url":"/dataset/explaincpe","name":"ExplainCPE","full_name":"","num_papers_in_archive":3},{"url":"/dataset/fanoutqa","name":"FanOutQA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/lleqa","name":"LLeQA","full_name":"Long-form Legal Question Answering","num_papers_in_archive":3},{"url":"/dataset/mimic-sparql","name":"MIMIC-SPARQL","full_name":"","num_papers_in_archive":3},{"url":"/dataset/mmed","name":"MMED","full_name":"","num_papers_in_archive":3},{"url":"/dataset/muld","name":"MuLD","full_name":"Multitask Long Document Benchmark","num_papers_in_archive":3},{"url":"/dataset/multiq","name":"MultiQ","full_name":"MultiQ","num_papers_in_archive":3},{"url":"/dataset/odsqa","name":"ODSQA","full_name":"Open-Domain Spoken Question Answering","num_papers_in_archive":3},{"url":"/dataset/pdfvqa","name":"PDFVQA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/pubchemqa","name":"PubChemQA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/qald-9-plus","name":"QALD-9-Plus","full_name":"","num_papers_in_archive":3},{"url":"/dataset/researchy-questions","name":"Researchy Questions","full_name":"","num_papers_in_archive":3},{"url":"/dataset/resq","name":"ResQ","full_name":"Real-world Spatial Question Answering","num_papers_in_archive":3},{"url":"/dataset/shmoop-corpus","name":"Shmoop Corpus","full_name":"","num_papers_in_archive":3},{"url":"/dataset/textbox-2-0","name":"TextBox 2.0","full_name":"","num_papers_in_archive":3},{"url":"/dataset/triviahg","name":"TriviaHG","full_name":"","num_papers_in_archive":3},{"url":"/dataset/uit-vicov19qa","name":"UIT-ViCoV19QA","full_name":"","num_papers_in_archive":3},{"url":"/dataset/almawave-slu","name":"Almawave-SLU","full_name":"","num_papers_in_archive":2},{"url":"/dataset/aws-documentation","name":"AWS Documentation","full_name":"","num_papers_in_archive":2},{"url":"/dataset/chegeka","name":"CheGeKa","full_name":"CheGeKa","num_papers_in_archive":2},{"url":"/dataset/cii-bench","name":"CII-Bench","full_name":"Chinese Image Implication understanding Benchmark","num_papers_in_archive":2},{"url":"/dataset/expmrc","name":"ExpMRC","full_name":"","num_papers_in_archive":2},{"url":"/dataset/g-vue","name":"G-VUE","full_name":"General-purpose Visual Understanding Evaluation","num_papers_in_archive":2},{"url":"/dataset/m2qa","name":"M2QA","full_name":"Multi-domain Multilingual Question Answering","num_papers_in_archive":2},{"url":"/dataset/milkqa","name":"MilkQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/multireqa","name":"MultiReQA","full_name":null,"num_papers_in_archive":2},{"url":"/dataset/nquad","name":"NQuAD","full_name":"Nuclear Question Answering Dataset","num_papers_in_archive":2},{"url":"/dataset/posescript","name":"PoseScript","full_name":"","num_papers_in_archive":2},{"url":"/dataset/quite","name":"QUITE","full_name":"Quantifying Uncertainty in natural language Text","num_papers_in_archive":2},{"url":"/dataset/reviewqa","name":"ReviewQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/romqa","name":"RoMQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/ruopenbookqa","name":"RuOpenBookQA","full_name":"RuOpenBookQA","num_papers_in_archive":2},{"url":"/dataset/mosh-levy","name":"Shortcut QA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/simpledbpediaqa","name":"SimpleDBpediaQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/schema2qa","name":"Stanford Schema2QA Dataset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/tempqa-wd","name":"TempQA-WD","full_name":"","num_papers_in_archive":2},{"url":"/dataset/visual-beliefs","name":"Visual Beliefs","full_name":"","num_papers_in_archive":2},{"url":"/dataset/vizwiz-priv","name":"VizWiz-Priv","full_name":"Visual Privacy dataset","num_papers_in_archive":2},{"url":"/dataset/vizwiz-qualityissues","name":"VizWiz-QualityIssues","full_name":"","num_papers_in_archive":2},{"url":"/dataset/vqa-360deg","name":"VQA 360°","full_name":"","num_papers_in_archive":2},{"url":"/dataset/x-wikire","name":"X-WikiRE","full_name":"X-WikiRE","num_papers_in_archive":2},{"url":"/dataset/xorqa-in","name":"XorQA-IN:","full_name":"XorQA-IN:","num_papers_in_archive":2},{"url":"/dataset/xquad-in","name":"XQuAD-IN","full_name":"","num_papers_in_archive":2},{"url":"/dataset/access-denied-inc","name":"ACCESS DENIED INC","full_name":"","num_papers_in_archive":1},{"url":"/dataset/accord-csqa-0-5","name":"ACCORD CSQA 0-5","full_name":"","num_papers_in_archive":1},{"url":"/dataset/aviationqa","name":"AviationQA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/bdd-qa","name":"BDD-QA","full_name":"BDD-QA","num_papers_in_archive":1},{"url":"/dataset/catbabi-lm-mode","name":"catbAbI LM-mode","full_name":"concatenated-bAbI","num_papers_in_archive":1},{"url":"/dataset/catbabi","name":"catbAbI QA-mode","full_name":"concatenated-bAbI","num_papers_in_archive":1},{"url":"/dataset/cc-riddle","name":"CC-Riddle","full_name":"Chinese Character Riddle","num_papers_in_archive":1},{"url":"/dataset/chaii-hindi-and-tamil-question-answering","name":"ChAII - Hindi and Tamil Question Answering","full_name":"","num_papers_in_archive":1},{"url":"/dataset/chiqa","name":"ChiQA","full_name":"Chinese VQA","num_papers_in_archive":1},{"url":"/dataset/compmix-ir","name":"CompMix-IR","full_name":"","num_papers_in_archive":1},{"url":"/dataset/copa-hr","name":"COPA-HR","full_name":"","num_papers_in_archive":1},{"url":"/dataset/coresearch","name":"CoreSearch","full_name":"","num_papers_in_archive":1},{"url":"/dataset/crsb","name":"CRSB","full_name":"Context Retrieval Supervision Benchmark","num_papers_in_archive":1},{"url":"/dataset/cuhk-qa","name":"CUHK-QA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/diaforge-utc-r-0725","name":"diaforge-utc-r-0725","full_name":"DiaFORGE UTC: Unified Tool-Calling Conversations Dataset","num_papers_in_archive":1},{"url":"/dataset/dialog-based-language-learning-dataset","name":"Dialog-based Language Learning dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/dyntom","name":"DynToM","full_name":"","num_papers_in_archive":1},{"url":"/dataset/epik-eval","name":"EpiK-Eval","full_name":"Epistemic Knowledge Evaluation","num_papers_in_archive":1},{"url":"/dataset/event-qa","name":"Event-QA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/financial-language-understanding-evaluation","name":"Financial Language Understanding Evaluation","full_name":"","num_papers_in_archive":1},{"url":"/dataset/geoquestions1089","name":"GeoQuestions1089","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ilsp-greek-evaluation-suite","name":"ILSP Greek Evaluation Suite","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mapeval","name":"MapEval","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mapeval-api","name":"MapEval-API","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mapeval-textual","name":"MapEval-Textual","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mattools","name":"MatTools","full_name":"","num_papers_in_archive":1},{"url":"/dataset/medturkquad-medical-turkish-question","name":"MedTurkQuAD: Medical Turkish Question-Answering Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mf3qa","name":"MF3QA","full_name":"Medical Free Form Farsi Question Answering dataset","num_papers_in_archive":1},{"url":"/dataset/mf3qa-uncleaned","name":"MF3QA_uncleaned","full_name":"Medical Free Form Farsi Question Answering dataset (uncleaned)","num_papers_in_archive":1},{"url":"/dataset/milu","name":"MILU","full_name":"Multi-task Indic Language Understanding Benchmark","num_papers_in_archive":1},{"url":"/dataset/mlquestions","name":"MLQuestions","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mminstruct-gpt4v","name":"MMInstruct-GPT4V","full_name":"MMInstruct: A High-Quality Multi-Modal Instruction Tuning Dataset with Extensive Diversity","num_papers_in_archive":1},{"url":"/dataset/nitibench","name":"NitiBench","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ntext","name":"NText","full_name":"","num_papers_in_archive":1},{"url":"/dataset/orkg-qa","name":"ORKG-QA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/pentachromatic-cultural-palette-dataset","name":"Pentachromatic Cultural Palette  Dataset","full_name":"Pentachromatic Cultural Palette  Dataset","num_papers_in_archive":1},{"url":"/dataset/persian-nlp-hub","name":"Persian NLP Hub","full_name":"","num_papers_in_archive":1},{"url":"/dataset/persianqa","name":"PersianQA","full_name":"Persian Question Answering Dataset","num_papers_in_archive":1},{"url":"/dataset/phrase-in-context","name":"Phrase-in-Context","full_name":"Phrase-in-Context","num_papers_in_archive":1},{"url":"/dataset/physico","name":"PhysiCo","full_name":"","num_papers_in_archive":1},{"url":"/dataset/pira","name":"Pirá","full_name":"Pirá: A Bilingual Portuguese-English Dataset for Question-Answering about the Ocean","num_papers_in_archive":1},{"url":"/dataset/pq-decanlp","name":"PQ-decaNLP","full_name":"Paraphrase Questions - decaNLP","num_papers_in_archive":1},{"url":"/dataset/pqaref","name":"PQAref","full_name":"Pubmed Question Answering with references","num_papers_in_archive":1},{"url":"/dataset/qasina","name":"QASiNa","full_name":"Question Answering Sirah Nabawiyah","num_papers_in_archive":1},{"url":"/dataset/qasports","name":"QASports","full_name":"A Question Answering Dataset about Sports","num_papers_in_archive":1},{"url":"/dataset/rgrs","name":"RGRS","full_name":"ResearchGate dataset for Recommending Systems","num_papers_in_archive":1},{"url":"/dataset/schizzosquad","name":"SchizzoSQUAD","full_name":"","num_papers_in_archive":1},{"url":"/dataset/scienceexamcer","name":"ScienceExamCER","full_name":"","num_papers_in_archive":1},{"url":"/dataset/scimat","name":"SCIMAT","full_name":"","num_papers_in_archive":1},{"url":"/dataset/simply-clevr","name":"simply-CLEVR","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/sotu-qa-2023","name":"SOTU_QA_2023","full_name":"","num_papers_in_archive":1},{"url":"/dataset/timelinekgqa","name":"TimelineKGQA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tinysocial","name":"TinySocial","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tom-qa","name":"ToM QA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tqba","name":"TQBA++","full_name":"Tiny QA Benchmark++","num_papers_in_archive":1},{"url":"/dataset/tumtraffic-videoqa","name":"TUMTraffic-VideoQA","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tupleinf-open-ie-dataset","name":"TupleInf Open IE Dataset","full_name":"TupleInf Open IE Dataset","num_papers_in_archive":1},{"url":"/dataset/vcg-112k","name":"VCG+112K","full_name":"Video Instruction Dataset 112K","num_papers_in_archive":1},{"url":"/dataset/vdqg","name":"VDQG","full_name":"Visual Discriminative Question Generation","num_papers_in_archive":1},{"url":"/dataset/visual-choice-of-plausible-alternatives","name":"Visual Choice of Plausible Alternatives","full_name":"VCOPA","num_papers_in_archive":1},{"url":"/dataset/visual-haystacks-vhs","name":"Visual Haystacks (VHs)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/vlogqa","name":"VlogQA","full_name":"Vietnamese Spoken-Based Machine Reading Comprehension","num_papers_in_archive":1},{"url":"/dataset/vqa-nle-llava","name":"vqa-nle-llava","full_name":"","num_papers_in_archive":1},{"url":"/dataset/vtqa","name":"VTQA","full_name":"Visual Text Question Answering","num_papers_in_archive":1},{"url":"/dataset/wangchanx-legal-thaiccl-rag","name":"WangchanX-Legal-ThaiCCL-RAG","full_name":"","num_papers_in_archive":1},{"url":"/dataset/wikiqaar","name":"WikiQAar","full_name":"English-Arabic Wikipedia Question-Answering","num_papers_in_archive":1},{"url":"/dataset/wikisuggest","name":"WikiSuggest","full_name":"","num_papers_in_archive":1},{"url":"/dataset/xamarin-q-a","name":"Xamarin Q&A","full_name":"","num_papers_in_archive":1},{"url":"/dataset/xlingeval","name":"XLingEval","full_name":"XLingEval","num_papers_in_archive":1}],"subtasks":[{"url":"/task/answer-selection","name":"Answer Selection"},{"url":"/task/community-question-answering","name":"Community Question Answering"},{"url":"/task/conversational-question-answering","name":"Conversational Question Answering"},{"url":"/task/cross-lingual-question-answering","name":"Cross-Lingual Question Answering"},{"url":"/task/generative-question-answering","name":"Generative Question Answering"},{"url":"/task/knowledge-base-question-answering","name":"Knowledge Base Question Answering"},{"url":"/task/logical-reasoning-question-ansering","name":"Logical Reasoning Question Answering"},{"url":"/task/long-form-question-answering","name":"Long Form Question Answering"},{"url":"/task/mathematical-question-answering","name":"Mathematical Question Answering"},{"url":"/task/multilingual-machine-comprehension","name":"Multilingual Machine Comprehension in English Hindi"},{"url":"/task/multiple-choice-qa","name":"Multiple Choice Question Answering (MCQA)"},{"url":"/task/open-domain-question-answering","name":"Open-Domain Question Answering"},{"url":"/task/open-question","name":"Open-Ended Question Answering"},{"url":"/task/question-quality-assessment","name":"Question Quality Assessment"},{"url":"/task/science-question-answering","name":"Science Question Answering"},{"url":"/task/table-based-question-answering","name":"Table-based Question Answering"},{"url":"/task/temporal-casual-qa","name":"Temporal/Casual QA"},{"url":"/task/true-or-false-question-answering","name":"True or False Question Answering"},{"url":"/task/zeroshot-video-question-answer","name":"Zero-Shot Video Question Answer"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":4171,"tagged_in_all":10817,"items":[{"url":"/paper/attention-is-all-you-need","title":"Attention Is All You Need","date":"2017-06-12","arxiv_id":"1706.03762","repositories_listed":595,"syntology":{"n":946,"n_ran":600,"n_unverified":346,"n_pointer_only":451}},{"url":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","arxiv_id":"1810.04805","repositories_listed":534,"syntology":{"n":659,"n_ran":204,"n_unverified":455,"n_pointer_only":149}},{"url":"/paper/graph-attention-networks","title":"Graph Attention Networks","date":"2017-10-30","arxiv_id":"1710.10903","repositories_listed":93,"syntology":{"n":106,"n_ran":50,"n_unverified":56,"n_pointer_only":43}},{"url":"/paper/language-models-are-few-shot-learners","title":"Language Models are Few-Shot Learners","date":"2020-05-28","arxiv_id":"2005.14165","repositories_listed":67,"syntology":{"n":65,"n_ran":15,"n_unverified":50,"n_pointer_only":4}},{"url":"/paper/roberta-a-robustly-optimized-bert-pretraining","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","date":"2019-07-26","arxiv_id":"1907.11692","repositories_listed":67,"syntology":{"n":48,"n_ran":22,"n_unverified":26,"n_pointer_only":23}},{"url":"/paper/llama-open-and-efficient-foundation-language-1","title":"LLaMA: Open and Efficient Foundation Language Models","date":"2023-02-27","arxiv_id":"2302.13971","repositories_listed":57,"syntology":{"n":58,"n_ran":26,"n_unverified":32,"n_pointer_only":4}},{"url":"/paper/exploring-the-limits-of-transfer-learning","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","date":"2019-10-23","arxiv_id":"1910.10683","repositories_listed":57,"syntology":{"n":31,"n_ran":2,"n_unverified":29,"n_pointer_only":0}},{"url":"/paper/albert-a-lite-bert-for-self-supervised","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","date":"2019-09-26","arxiv_id":"1909.11942","repositories_listed":48,"syntology":{"n":126,"n_ran":46,"n_unverified":80,"n_pointer_only":22}},{"url":"/paper/bart-denoising-sequence-to-sequence-pre","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","date":"2019-10-29","arxiv_id":"1910.13461","repositories_listed":47,"syntology":{"n":53,"n_ran":22,"n_unverified":31,"n_pointer_only":7}},{"url":"/paper/deep-contextualized-word-representations","title":"Deep contextualized word representations","date":"2018-02-15","arxiv_id":"1802.05365","repositories_listed":46,"syntology":{"n":58,"n_ran":23,"n_unverified":35,"n_pointer_only":25}},{"url":"/paper/end-to-end-memory-networks","title":"End-To-End Memory Networks","date":"2015-03-31","arxiv_id":"1503.08895","repositories_listed":44,"syntology":{"n":15,"n_ran":2,"n_unverified":13,"n_pointer_only":5}},{"url":"/paper/distilbert-a-distilled-version-of-bert","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","date":"2019-10-02","arxiv_id":"1910.01108","repositories_listed":37,"syntology":{"n":27,"n_ran":19,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/reducing-bert-pre-training-time-from-3-days","title":"Large Batch Optimization for Deep Learning: Training BERT in 76 minutes","date":"2019-04-01","arxiv_id":"1904.00962","repositories_listed":32,"syntology":{"n":11,"n_ran":1,"n_unverified":10,"n_pointer_only":9}},{"url":"/paper/xlnet-generalized-autoregressive-pretraining","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","date":"2019-06-19","arxiv_id":"1906.08237","repositories_listed":27,"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}},{"url":"/paper/bidirectional-attention-flow-for-machine","title":"Bidirectional Attention Flow for Machine Comprehension","date":"2016-11-05","arxiv_id":"1611.01603","repositories_listed":27,"syntology":{"n":11,"n_ran":8,"n_unverified":3,"n_pointer_only":7}},{"url":"/paper/distributed-representations-of-sentences-and","title":"Distributed Representations of Sentences and Documents","date":"2014-05-16","arxiv_id":"1405.4053","repositories_listed":27,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/longformer-the-long-document-transformer","title":"Longformer: The Long-Document Transformer","date":"2020-04-10","arxiv_id":"2004.05150","repositories_listed":22,"syntology":{"n":35,"n_ran":15,"n_unverified":20,"n_pointer_only":5}},{"url":"/paper/language-models-are-unsupervised-multitask","title":"Language Models are Unsupervised Multitask Learners","date":"2019-02-14","arxiv_id":null,"repositories_listed":21,"syntology":null},{"url":"/paper/squad-100000-questions-for-machine","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","date":"2016-06-16","arxiv_id":"1606.05250","repositories_listed":21,"syntology":{"n":6,"n_ran":4,"n_unverified":2,"n_pointer_only":6}},{"url":"/paper/pay-attention-to-mlps","title":"Pay Attention to MLPs","date":"2021-05-17","arxiv_id":"2105.08050","repositories_listed":20,"syntology":{"n":44,"n_ran":34,"n_unverified":10,"n_pointer_only":11}},{"url":"/paper/a-simple-neural-network-module-for-relational","title":"A simple neural network module for relational reasoning","date":"2017-06-05","arxiv_id":"1706.01427","repositories_listed":20,"syntology":{"n":7,"n_ran":3,"n_unverified":4,"n_pointer_only":1}},{"url":"/paper/towards-ai-complete-question-answering-a-set","title":"Towards AI-Complete Question Answering: A Set of Prerequisite Toy Tasks","date":"2015-02-19","arxiv_id":"1502.05698","repositories_listed":20,"syntology":{"n":3,"n_ran":1,"n_unverified":2,"n_pointer_only":2}},{"url":"/paper/llama-2-open-foundation-and-fine-tuned-chat","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","date":"2023-07-18","arxiv_id":"2307.09288","repositories_listed":19,"syntology":{"n":52,"n_ran":31,"n_unverified":21,"n_pointer_only":16}},{"url":"/paper/chain-of-thought-prompting-elicits-reasoning","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","date":"2022-01-28","arxiv_id":"2201.11903","repositories_listed":19,"syntology":{"n":7,"n_ran":2,"n_unverified":5,"n_pointer_only":0}},{"url":"/paper/dense-passage-retrieval-for-open-domain","title":"Dense Passage Retrieval for Open-Domain Question Answering","date":"2020-04-10","arxiv_id":"2004.04906","repositories_listed":19,"syntology":{"n":14,"n_ran":10,"n_unverified":4,"n_pointer_only":9}},{"url":"/paper/electra-pre-training-text-encoders-as-1","title":"ELECTRA: Pre-training Text Encoders as Discriminators Rather Than Generators","date":"2020-03-23","arxiv_id":"2003.10555","repositories_listed":19,"syntology":{"n":40,"n_ran":26,"n_unverified":14,"n_pointer_only":10}},{"url":"/paper/ernie-enhanced-representation-through","title":"ERNIE: Enhanced Representation through Knowledge Integration","date":"2019-04-19","arxiv_id":"1904.09223","repositories_listed":19,"syntology":{"n":7,"n_ran":0,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/biobert-a-pre-trained-biomedical-language","title":"BioBERT: a pre-trained biomedical language representation model for biomedical text mining","date":"2019-01-25","arxiv_id":"1901.08746","repositories_listed":19,"syntology":{"n":25,"n_ran":4,"n_unverified":21,"n_pointer_only":1}},{"url":"/paper/retrieval-augmented-generation-for-knowledge","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","date":"2020-05-22","arxiv_id":"2005.11401","repositories_listed":18,"syntology":{"n":6,"n_ran":4,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/qanet-combining-local-convolution-with-global","title":"QANet: Combining Local Convolution with Global Self-Attention for Reading Comprehension","date":"2018-04-23","arxiv_id":"1804.09541","repositories_listed":15,"syntology":{"n":19,"n_ran":7,"n_unverified":12,"n_pointer_only":2}}],"syntology_records":29,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":4,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}