{"url":"/task/named-entity-recognition-ner","name":"Named Entity Recognition (NER)","slug":"named-entity-recognition-ner","description_markdown":"**Named Entity Recognition (NER)** is a task of Natural Language Processing (NLP) that involves identifying and classifying named entities in a text into predefined categories such as person names, organizations, locations, and others. The goal of NER is to extract structured information from unstructured text data and represent it in a machine-readable format. Approaches typically use BIO notation, which differentiates the beginning (B) and the inside (I) of entities. O is used for non-entity tokens.\r\n\r\nExample:\r\n\r\n| Mark | Watney | visited | Mars |\r\n| --- | ---| --- | --- |\r\n| B-PER | I-PER | O | B-LOC |\r\n\r\n<span style=\"color:grey; opacity: 0.6\">( Image credit: [Zalando](https://research.zalando.com/welcome/mission/research-projects/flair-nlp/) )</span>","categories":[{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":2874,"papers_with_code":955,"benchmarks":76,"benchmark_tables_in_archive":76,"benchmark_tables_shown":76,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":130,"subtasks":13,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/named-entity-recognition-ner-on-conll-2003","slug":"named-entity-recognition-ner-on-conll-2003","dataset":"CoNLL 2003 (English)","dataset_url":"/dataset/conll-1","rows_in_archive":73,"metrics":["F1"],"first_row_in_archive_order":{"model":"ACE + document-context","paper_title":"Automated Concatenation of Embeddings for Structured Prediction","paper_url":"/paper/automated-concatenation-of-embeddings-for-1","paper_date":"2020-10-10","arxiv_id":"2010.05006","code_links":[{"title":"Alibaba-NLP/ACE","url":"https://github.com/Alibaba-NLP/ACE"},{"title":"zhaoyuesun/phee","url":"https://github.com/zhaoyuesun/phee"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-ontonotes-v5","slug":"named-entity-recognition-ner-on-ontonotes-v5","dataset":"Ontonotes v5 (English)","dataset_url":"/dataset/ontonotes-5-0","rows_in_archive":28,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"BERT-MRC+DSC","paper_title":"Dice Loss for Data-imbalanced NLP Tasks","paper_url":"/paper/dice-loss-for-data-imbalanced-nlp-tasks","paper_date":"2019-11-07","arxiv_id":"1911.02855","code_links":[{"title":"ShannonAI/dice_loss_for_NLP","url":"https://github.com/ShannonAI/dice_loss_for_NLP"},{"title":"fursovia/self-adj-dice","url":"https://github.com/fursovia/self-adj-dice"},{"title":"MindCode-4/code-6","url":"https://github.com/MindCode-4/code-6/tree/main/drop-an-octave-reducing-spatial"},{"title":"MindCode-4/code-11","url":"https://github.com/MindCode-4/code-11/tree/main/dice-loss-for-data-imbalanced-nlp-tasks"}],"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-ner-on-ncbi-disease","slug":"named-entity-recognition-ner-on-ncbi-disease","dataset":"NCBI-disease","dataset_url":"/dataset/ncbi-disease-1","rows_in_archive":26,"metrics":["F1"],"first_row_in_archive_order":{"model":"BioBERT","paper_title":"BioBERT: a pre-trained biomedical language representation model for biomedical text mining","paper_url":"/paper/biobert-a-pre-trained-biomedical-language","paper_date":"2019-01-25","arxiv_id":"1901.08746","code_links":[{"title":"dmis-lab/biobert","url":"https://github.com/dmis-lab/biobert"},{"title":"EmilyAlsentzer/clinicalBERT","url":"https://github.com/EmilyAlsentzer/clinicalBERT"},{"title":"naver/biobert-pretrained","url":"https://github.com/naver/biobert-pretrained"},{"title":"plkmo/BERT-Relation-Extraction","url":"https://github.com/plkmo/BERT-Relation-Extraction"},{"title":"ncbi-nlp/NCBI_BERT","url":"https://github.com/ncbi-nlp/NCBI_BERT"},{"title":"re-search/DocProduct","url":"https://github.com/re-search/DocProduct"},{"title":"charles9n/bert-sklearn","url":"https://github.com/charles9n/bert-sklearn"},{"title":"dmis-lab/bern","url":"https://github.com/dmis-lab/bern"},{"title":"MeRajat/SolvingAlmostAnythingWithBert","url":"https://github.com/MeRajat/SolvingAlmostAnythingWithBert"},{"title":"phucdev/TL_Bio_RE","url":"https://github.com/phucdev/TL_Bio_RE"},{"title":"ManasRMohanty/DS5500-capstone","url":"https://github.com/ManasRMohanty/DS5500-capstone"},{"title":"kuldeep7688/BioMedicalBertNer","url":"https://github.com/kuldeep7688/BioMedicalBertNer"},{"title":"mocherson/aki_bert","url":"https://github.com/mocherson/aki_bert"},{"title":"jpablou/Matching-The-Blanks-Ths","url":"https://github.com/jpablou/Matching-The-Blanks-Ths"},{"title":"rahul-1996/KGraphs-QA","url":"https://github.com/rahul-1996/KGraphs-QA"},{"title":"ardakdemir/my_bert_ner","url":"https://github.com/ardakdemir/my_bert_ner"},{"title":"cypressd1999/FYP_2021","url":"https://github.com/cypressd1999/FYP_2021"},{"title":"hieudepchai/BERT_IE","url":"https://github.com/hieudepchai/BERT_IE"},{"title":"Dean/BioBERT-DAGsHub","url":"https://dagshub.com/Dean/BioBERT-DAGsHub"}],"syntology":{"n":25,"n_ran":13,"n_unverified":12,"n_pointer_only":1}}},{"leaderboard":"/sota/named-entity-recognition-on-wnut-2017","slug":"named-entity-recognition-on-wnut-2017","dataset":"WNUT 2017","dataset_url":"/dataset/wnut-2017-emerging-and-rare-entity","rows_in_archive":23,"metrics":["F1","F1 (surface form)","Precision","Recall"],"first_row_in_archive_order":{"model":"CL-KL","paper_title":"Improving Named Entity Recognition by External Context Retrieving and Cooperative Learning","paper_url":"/paper/improving-named-entity-recognition-by","paper_date":"2021-05-08","arxiv_id":"2105.03654","code_links":[{"title":"modelscope/adaseq","url":"https://github.com/modelscope/adaseq"},{"title":"modelscope/AdaSeq","url":"https://github.com/modelscope/AdaSeq/tree/master/examples/RaNER"},{"title":"Alibaba-NLP/CLNER","url":"https://github.com/Alibaba-NLP/CLNER"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-ace-2005","slug":"named-entity-recognition-on-ace-2005","dataset":"ACE 2005","dataset_url":"/dataset/ace-2005","rows_in_archive":20,"metrics":["F1"],"first_row_in_archive_order":{"model":"Ours: cross-sentence ALB","paper_title":"A Frustratingly Easy Approach for Entity and Relation Extraction","paper_url":"/paper/a-frustratingly-easy-approach-for-joint","paper_date":"2020-10-24","arxiv_id":"2010.12812","code_links":[{"title":"princeton-nlp/PURE","url":"https://github.com/princeton-nlp/PURE"},{"title":"YaoXinZhi/BERT-for-BioNLP-OST2019-AGAC-Task2","url":"https://github.com/YaoXinZhi/BERT-for-BioNLP-OST2019-AGAC-Task2"}],"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":1}}},{"leaderboard":"/sota/named-entity-recognition-ner-on-jnlpba","slug":"named-entity-recognition-ner-on-jnlpba","dataset":"JNLPBA","dataset_url":"/dataset/jnlpba","rows_in_archive":17,"metrics":["F1"],"first_row_in_archive_order":{"model":"KeBioLM","paper_title":"Improving Biomedical Pretrained Language Models with Knowledge","paper_url":"/paper/improving-biomedical-pretrained-language","paper_date":"2021-04-21","arxiv_id":"2104.10344","code_links":[{"title":"GanjinZero/KeBioLM","url":"https://github.com/GanjinZero/KeBioLM"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-bc5cdr","slug":"named-entity-recognition-ner-on-bc5cdr","dataset":"BC5CDR","dataset_url":"/dataset/bc5cdr","rows_in_archive":16,"metrics":["F1"],"first_row_in_archive_order":{"model":"BINDER","paper_title":"Optimizing Bi-Encoder for Named Entity Recognition via Contrastive Learning","paper_url":"/paper/optimizing-bi-encoder-for-named-entity","paper_date":"2022-08-30","arxiv_id":"2208.14565","code_links":[{"title":"microsoft/binder","url":"https://github.com/microsoft/binder"}],"syntology":{"n":4,"n_ran":4,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-genia","slug":"named-entity-recognition-on-genia","dataset":"GENIA","dataset_url":"/dataset/genia","rows_in_archive":14,"metrics":["F1"],"first_row_in_archive_order":{"model":"DeepStruct multi-task w/ finetune","paper_title":"DeepStruct: Pretraining of Language Models for Structure Prediction","paper_url":"/paper/deepstruct-pretraining-of-language-models-for-1","paper_date":"2022-05-21","arxiv_id":"2205.10475","code_links":[{"title":"cgraywang/deepstruct","url":"https://github.com/cgraywang/deepstruct"}],"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-bc2gm","slug":"named-entity-recognition-on-bc2gm","dataset":"BC2GM","dataset_url":"/dataset/bc2gm","rows_in_archive":13,"metrics":["F1"],"first_row_in_archive_order":{"model":"Spark NLP","paper_title":"Biomedical Named Entity Recognition at Scale","paper_url":"/paper/biomedical-named-entity-recognition-at-scale","paper_date":"2020-11-12","arxiv_id":"2011.06315","code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop/blob/master/tutorials/Certification_Trainings/Healthcare/1.4.Biomedical_NER_SparkNLP_paper_reproduce.ipynb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-bc5cdr-chemical","slug":"named-entity-recognition-on-bc5cdr-chemical","dataset":"BC5CDR-chemical","dataset_url":"/dataset/bc5cdr","rows_in_archive":13,"metrics":["F1"],"first_row_in_archive_order":{"model":"Spark NLP","paper_title":"Biomedical Named Entity Recognition at Scale","paper_url":"/paper/biomedical-named-entity-recognition-at-scale","paper_date":"2020-11-12","arxiv_id":"2011.06315","code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop/blob/master/tutorials/Certification_Trainings/Healthcare/1.4.Biomedical_NER_SparkNLP_paper_reproduce.ipynb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-slue","slug":"named-entity-recognition-on-slue","dataset":"SLUE","dataset_url":"/dataset/slue","rows_in_archive":13,"metrics":["F1 (%)","label-F1 (%)","Text model"],"first_row_in_archive_order":{"model":"W2V2-L-LL60K (pipeline approach, uses LM)","paper_title":"SLUE: New Benchmark Tasks for Spoken Language Understanding Evaluation on Natural Speech","paper_url":"/paper/slue-new-benchmark-tasks-for-spoken-language","paper_date":"2021-11-19","arxiv_id":"2111.10367","code_links":[{"title":"asappresearch/slue-toolkit","url":"https://github.com/asappresearch/slue-toolkit"}],"syntology":{"n":12,"n_ran":11,"n_unverified":1,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-conll","slug":"named-entity-recognition-on-conll","dataset":"CoNLL++","dataset_url":"/dataset/conll","rows_in_archive":11,"metrics":["F1"],"first_row_in_archive_order":{"model":"LUKE + SubRegWeigh (K-means)","paper_title":"SubRegWeigh: Effective and Efficient Annotation Weighing with Subword Regularization","paper_url":"/paper/subregweigh-effective-and-efficient","paper_date":"2024-09-10","arxiv_id":"2409.06216","code_links":[{"title":"4ldk/SubRegWeigh","url":"https://github.com/4ldk/SubRegWeigh"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-bc5cdr-disease","slug":"named-entity-recognition-on-bc5cdr-disease","dataset":"BC5CDR-disease","dataset_url":"/dataset/bc5cdr","rows_in_archive":10,"metrics":["F1"],"first_row_in_archive_order":{"model":"BioMegatron","paper_title":"BioMegatron: Larger Biomedical Domain Language Model","paper_url":"/paper/biomegatron-larger-biomedical-domain-language","paper_date":"2020-10-12","arxiv_id":"2010.06060","code_links":[{"title":"NVIDIA/NeMo","url":"https://github.com/NVIDIA/NeMo"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-ace-2004","slug":"named-entity-recognition-on-ace-2004","dataset":"ACE 2004","dataset_url":"/dataset/ace-2004","rows_in_archive":9,"metrics":["F1","Multi-Task Supervision"],"first_row_in_archive_order":{"model":"Ours: cross-sentence ALB","paper_title":"A Frustratingly Easy Approach for Entity and Relation Extraction","paper_url":"/paper/a-frustratingly-easy-approach-for-joint","paper_date":"2020-10-24","arxiv_id":"2010.12812","code_links":[{"title":"princeton-nlp/PURE","url":"https://github.com/princeton-nlp/PURE"},{"title":"YaoXinZhi/BERT-for-BioNLP-OST2019-AGAC-Task2","url":"https://github.com/YaoXinZhi/BERT-for-BioNLP-OST2019-AGAC-Task2"}],"syntology":{"n":4,"n_ran":3,"n_unverified":1,"n_pointer_only":1}}},{"leaderboard":"/sota/named-entity-recognition-ner-on-scierc","slug":"named-entity-recognition-ner-on-scierc","dataset":"SciERC","dataset_url":"/dataset/scierc","rows_in_archive":7,"metrics":["F1"],"first_row_in_archive_order":{"model":"SciDeBERTa v2","paper_title":"SciDeBERTa: Learning DeBERTa for Science Technology Documents and Fine-Tuning Information Extraction Tasks","paper_url":"/paper/scideberta-learning-deberta-for-science","paper_date":"2022-06-08","arxiv_id":null,"code_links":[{"title":"Eunhui-Kim/SciDeBERTa-Fine-Tuning","url":"https://github.com/Eunhui-Kim/SciDeBERTa-Fine-Tuning"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-bc4chemd","slug":"named-entity-recognition-on-bc4chemd","dataset":"BC4CHEMD","dataset_url":"/dataset/bc4chemd","rows_in_archive":7,"metrics":["F1"],"first_row_in_archive_order":{"model":"BertForTokenClassification (Spark NLP)","paper_title":"Accurate clinical and biomedical Named entity recognition at scale","paper_url":"/paper/accurate-clinical-and-biomedical-named-entity","paper_date":"2022-07-19","arxiv_id":null,"code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-wnut-2016","slug":"named-entity-recognition-on-wnut-2016","dataset":"WNUT 2016","dataset_url":"/dataset/wnut-2016-ner","rows_in_archive":7,"metrics":["F1"],"first_row_in_archive_order":{"model":"HGN","paper_title":"Hero-Gang Neural Model For Named Entity Recognition","paper_url":"/paper/hero-gang-neural-model-for-named-entity","paper_date":"2022-05-15","arxiv_id":"2205.07177","code_links":[{"title":"jinpeng01/hgn","url":"https://github.com/jinpeng01/hgn"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll-2002","slug":"named-entity-recognition-on-conll-2002","dataset":"CoNLL 2002 (Spanish)","dataset_url":"/dataset/conll-2002","rows_in_archive":6,"metrics":["F1"],"first_row_in_archive_order":{"model":"ACE + document-context","paper_title":"Automated Concatenation of Embeddings for Structured Prediction","paper_url":"/paper/automated-concatenation-of-embeddings-for-1","paper_date":"2020-10-10","arxiv_id":"2010.05006","code_links":[{"title":"Alibaba-NLP/ACE","url":"https://github.com/Alibaba-NLP/ACE"},{"title":"zhaoyuesun/phee","url":"https://github.com/zhaoyuesun/phee"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll-2002-dutch","slug":"named-entity-recognition-on-conll-2002-dutch","dataset":"CoNLL 2002 (Dutch)","dataset_url":"/dataset/conll-2002","rows_in_archive":6,"metrics":["F1"],"first_row_in_archive_order":{"model":"ACE + document-context","paper_title":"Automated Concatenation of Embeddings for Structured Prediction","paper_url":"/paper/automated-concatenation-of-embeddings-for-1","paper_date":"2020-10-10","arxiv_id":"2010.05006","code_links":[{"title":"Alibaba-NLP/ACE","url":"https://github.com/Alibaba-NLP/ACE"},{"title":"zhaoyuesun/phee","url":"https://github.com/zhaoyuesun/phee"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll-2003-german","slug":"named-entity-recognition-on-conll-2003-german","dataset":"CoNLL 2003 (German)","dataset_url":"/dataset/conll-1","rows_in_archive":6,"metrics":["F1"],"first_row_in_archive_order":{"model":"ACE + document-context","paper_title":"Automated Concatenation of Embeddings for Structured Prediction","paper_url":"/paper/automated-concatenation-of-embeddings-for-1","paper_date":"2020-10-10","arxiv_id":"2010.05006","code_links":[{"title":"Alibaba-NLP/ACE","url":"https://github.com/Alibaba-NLP/ACE"},{"title":"zhaoyuesun/phee","url":"https://github.com/zhaoyuesun/phee"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-few-nerd-sup","slug":"named-entity-recognition-on-few-nerd-sup","dataset":"Few-NERD (SUP)","dataset_url":"/dataset/few-nerd","rows_in_archive":6,"metrics":["F1-Measure","Precision","Recall"],"first_row_in_archive_order":{"model":"PL-Marker","paper_title":"Packed Levitated Marker for Entity and Relation Extraction","paper_url":"/paper/pack-together-entity-and-relation-extraction","paper_date":"2021-09-13","arxiv_id":"2109.06067","code_links":[{"title":"tomaarsen/spanmarkerner","url":"https://github.com/tomaarsen/spanmarkerner"},{"title":"thunlp/pl-marker","url":"https://github.com/thunlp/pl-marker"}],"syntology":{"n":9,"n_ran":6,"n_unverified":3,"n_pointer_only":1}}},{"leaderboard":"/sota/named-entity-recognition-on-linnaeus","slug":"named-entity-recognition-on-linnaeus","dataset":"LINNAEUS","dataset_url":"/dataset/linnaeus","rows_in_archive":6,"metrics":["F1"],"first_row_in_archive_order":{"model":"BLSTM-CNN-Char (SparkNLP)","paper_title":"Biomedical Named Entity Recognition at Scale","paper_url":"/paper/biomedical-named-entity-recognition-at-scale","paper_date":"2020-11-12","arxiv_id":"2011.06315","code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop/blob/master/tutorials/Certification_Trainings/Healthcare/1.4.Biomedical_NER_SparkNLP_paper_reproduce.ipynb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-anatem","slug":"named-entity-recognition-on-anatem","dataset":"AnatEM","dataset_url":null,"rows_in_archive":5,"metrics":["F1"],"first_row_in_archive_order":{"model":"ConNER","paper_title":"Enhancing Label Consistency on Document-level Named Entity Recognition","paper_url":"/paper/enhancing-label-consistency-on-document-level","paper_date":"2022-10-24","arxiv_id":"2210.12949","code_links":[{"title":"dmis-lab/conner","url":"https://github.com/dmis-lab/conner"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll-2003-german-1","slug":"named-entity-recognition-on-conll-2003-german-1","dataset":"CoNLL 2003 (German) Revised","dataset_url":"/dataset/conll-1","rows_in_archive":5,"metrics":["F1"],"first_row_in_archive_order":{"model":"FLERT XLM-R","paper_title":"FLERT: Document-Level Features for Named Entity Recognition","paper_url":"/paper/flert-document-level-features-for-named","paper_date":"2020-11-13","arxiv_id":"2011.06993","code_links":[{"title":"flairNLP/flair","url":"https://github.com/flairNLP/flair"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll03","slug":"named-entity-recognition-on-conll03","dataset":"CoNLL03","dataset_url":"/dataset/conll","rows_in_archive":5,"metrics":["F1","F1 (micro)"],"first_row_in_archive_order":{"model":"UniNER-7B","paper_title":"UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity Recognition","paper_url":"/paper/universalner-targeted-distillation-from-large","paper_date":"2023-08-07","arxiv_id":"2308.03279","code_links":[{"title":"universal-ner/universal-ner","url":"https://github.com/universal-ner/universal-ner"},{"title":"emma1066/retrieval-augmented-it-openner","url":"https://github.com/emma1066/retrieval-augmented-it-openner"}],"syntology":{"n":12,"n_ran":7,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-ner-on-cord-r","slug":"named-entity-recognition-ner-on-cord-r","dataset":"CORD-r","dataset_url":"/dataset/cord-r","rows_in_archive":4,"metrics":["F1"],"first_row_in_archive_order":{"model":"TPP (LayoutLMv3)","paper_title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","paper_url":"/paper/reading-order-matters-information-extraction","paper_date":"2023-10-17","arxiv_id":"2310.11016","code_links":[{"title":"chongzhangfdu/tpp","url":"https://github.com/chongzhangfdu/tpp"},{"title":"WinterShiver/Token-Path-Prediction","url":"https://github.com/WinterShiver/Token-Path-Prediction"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-funsd-r","slug":"named-entity-recognition-ner-on-funsd-r","dataset":"FUNSD-r","dataset_url":"/dataset/funsd-r","rows_in_archive":4,"metrics":["F1"],"first_row_in_archive_order":{"model":"TPP (LayoutLMv3)","paper_title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","paper_url":"/paper/reading-order-matters-information-extraction","paper_date":"2023-10-17","arxiv_id":"2310.11016","code_links":[{"title":"chongzhangfdu/tpp","url":"https://github.com/chongzhangfdu/tpp"},{"title":"WinterShiver/Token-Path-Prediction","url":"https://github.com/WinterShiver/Token-Path-Prediction"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-species-800","slug":"named-entity-recognition-on-species-800","dataset":"Species-800","dataset_url":"/dataset/species-800","rows_in_archive":4,"metrics":["F1"],"first_row_in_archive_order":{"model":"BioBERT","paper_title":"BioBERT: a pre-trained biomedical language representation model for biomedical text mining","paper_url":"/paper/biobert-a-pre-trained-biomedical-language","paper_date":"2019-01-25","arxiv_id":"1901.08746","code_links":[{"title":"dmis-lab/biobert","url":"https://github.com/dmis-lab/biobert"},{"title":"EmilyAlsentzer/clinicalBERT","url":"https://github.com/EmilyAlsentzer/clinicalBERT"},{"title":"naver/biobert-pretrained","url":"https://github.com/naver/biobert-pretrained"},{"title":"plkmo/BERT-Relation-Extraction","url":"https://github.com/plkmo/BERT-Relation-Extraction"},{"title":"ncbi-nlp/NCBI_BERT","url":"https://github.com/ncbi-nlp/NCBI_BERT"},{"title":"re-search/DocProduct","url":"https://github.com/re-search/DocProduct"},{"title":"charles9n/bert-sklearn","url":"https://github.com/charles9n/bert-sklearn"},{"title":"dmis-lab/bern","url":"https://github.com/dmis-lab/bern"},{"title":"MeRajat/SolvingAlmostAnythingWithBert","url":"https://github.com/MeRajat/SolvingAlmostAnythingWithBert"},{"title":"phucdev/TL_Bio_RE","url":"https://github.com/phucdev/TL_Bio_RE"},{"title":"ManasRMohanty/DS5500-capstone","url":"https://github.com/ManasRMohanty/DS5500-capstone"},{"title":"kuldeep7688/BioMedicalBertNer","url":"https://github.com/kuldeep7688/BioMedicalBertNer"},{"title":"mocherson/aki_bert","url":"https://github.com/mocherson/aki_bert"},{"title":"jpablou/Matching-The-Blanks-Ths","url":"https://github.com/jpablou/Matching-The-Blanks-Ths"},{"title":"rahul-1996/KGraphs-QA","url":"https://github.com/rahul-1996/KGraphs-QA"},{"title":"ardakdemir/my_bert_ner","url":"https://github.com/ardakdemir/my_bert_ner"},{"title":"cypressd1999/FYP_2021","url":"https://github.com/cypressd1999/FYP_2021"},{"title":"hieudepchai/BERT_IE","url":"https://github.com/hieudepchai/BERT_IE"},{"title":"Dean/BioBERT-DAGsHub","url":"https://dagshub.com/Dean/BioBERT-DAGsHub"}],"syntology":{"n":25,"n_ran":13,"n_unverified":12,"n_pointer_only":1}}},{"leaderboard":"/sota/named-entity-recognition-ner-on-semclinbr","slug":"named-entity-recognition-ner-on-semclinbr","dataset":"SemClinBr","dataset_url":"/dataset/semclinbr","rows_in_archive":3,"metrics":["Micro F1"],"first_row_in_archive_order":{"model":"pucpr/biobertpt-clin","paper_title":"BioBERTpt - A Portuguese Neural Language Model for Clinical Named Entity Recognition","paper_url":"/paper/biobertpt-a-portuguese-neural-language-model","paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-bionlp13-cg","slug":"named-entity-recognition-on-bionlp13-cg","dataset":"BioNLP13-CG","dataset_url":null,"rows_in_archive":3,"metrics":["F1"],"first_row_in_archive_order":{"model":"BLSTM-CNN-Char (SparkNLP)","paper_title":"Biomedical Named Entity Recognition at Scale","paper_url":"/paper/biomedical-named-entity-recognition-at-scale","paper_date":"2020-11-12","arxiv_id":"2011.06315","code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop/blob/master/tutorials/Certification_Trainings/Healthcare/1.4.Biomedical_NER_SparkNLP_paper_reproduce.ipynb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-biored","slug":"named-entity-recognition-on-biored","dataset":"BioRED","dataset_url":"/dataset/biored","rows_in_archive":3,"metrics":["F1"],"first_row_in_archive_order":{"model":"PubMedBERT-CRF","paper_title":"BioRED: A Rich Biomedical Relation Extraction Dataset","paper_url":"/paper/biored-a-comprehensive-biomedical-relation","paper_date":"2022-04-08","arxiv_id":"2204.04263","code_links":[{"title":"ncbi/BioRED","url":"https://github.com/ncbi/BioRED"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-dwie","slug":"named-entity-recognition-on-dwie","dataset":"DWIE","dataset_url":"/dataset/dwie","rows_in_archive":3,"metrics":["F1-Hard"],"first_row_in_archive_order":{"model":"REXEL","paper_title":"REXEL: An End-to-end Model for Document-Level Relation Extraction and Entity Linking","paper_url":"/paper/rexel-an-end-to-end-model-for-document-level","paper_date":"2024-04-19","arxiv_id":"2404.12788","code_links":[{"title":"amazon-science/e2e-docie","url":"https://github.com/amazon-science/e2e-docie"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-findvehicle","slug":"named-entity-recognition-on-findvehicle","dataset":"FindVehicle","dataset_url":"/dataset/findvehicle","rows_in_archive":3,"metrics":["F1 Score","F1"],"first_row_in_archive_order":{"model":"BiLSTM-CRF","paper_title":"Bidirectional LSTM-CRF Models for Sequence Tagging","paper_url":"/paper/bidirectional-lstm-crf-models-for-sequence","paper_date":"2015-08-09","arxiv_id":"1508.01991","code_links":[{"title":"determined22/zh-ner-tf","url":"https://github.com/determined22/zh-ner-tf"},{"title":"guillaumegenthial/tf_ner","url":"https://github.com/guillaumegenthial/tf_ner"},{"title":"baiyang2464/chatbot-base-on-Knowledge-Graph","url":"https://github.com/baiyang2464/chatbot-base-on-Knowledge-Graph"},{"title":"GlassyWing/bi-lstm-crf","url":"https://github.com/GlassyWing/bi-lstm-crf"},{"title":"mindspore-ai/models","url":"https://github.com/mindspore-ai/models/tree/master/research/nlp/lstm_crf"},{"title":"jidasheng/bi-lstm-crf","url":"https://github.com/jidasheng/bi-lstm-crf"},{"title":"aonotas/deep-crf","url":"https://github.com/aonotas/deep-crf"},{"title":"gxzzz/bilstm-crf","url":"https://github.com/gxzzz/bilstm-crf"},{"title":"epwalsh/pytorch-crf","url":"https://github.com/epwalsh/pytorch-crf"},{"title":"ngoquanghuy99/POS-Tagging-BiLSTM-CRF","url":"https://github.com/ngoquanghuy99/POS-Tagging-BiLSTM-CRF"},{"title":"HassanAzzam/Arabic-NER","url":"https://github.com/HassanAzzam/Arabic-NER"},{"title":"zysite/post","url":"https://github.com/zysite/post"},{"title":"DimasDMM/diseases-ner","url":"https://github.com/DimasDMM/diseases-ner"},{"title":"hazelnutsgz/Naive-LSTM-CRF","url":"https://github.com/hazelnutsgz/Naive-LSTM-CRF"},{"title":"kyzhouhzau/CCLNER","url":"https://github.com/kyzhouhzau/CCLNER"},{"title":"JZ-LIANG/CRF-LSTM-NER","url":"https://github.com/JZ-LIANG/CRF-LSTM-NER"},{"title":"moejoe95/crf-vs-rnn-ner","url":"https://github.com/moejoe95/crf-vs-rnn-ner"},{"title":"sarveshsparab/BiLSTMCRFSeqTag","url":"https://github.com/sarveshsparab/BiLSTMCRFSeqTag"},{"title":"sumehta/bilstm_crf_extract","url":"https://github.com/sumehta/bilstm_crf_extract"},{"title":"UcasLzz/ChineseWordSeg-POS","url":"https://github.com/UcasLzz/ChineseWordSeg-POS"},{"title":"Akshayanti/supersense-sequence-labelling","url":"https://github.com/Akshayanti/supersense-sequence-labelling"},{"title":"MindSpore-paper-code-3/code9","url":"https://github.com/MindSpore-paper-code-3/code9/tree/main/lstm_crf"},{"title":"UcasLzz/CWS","url":"https://github.com/UcasLzz/CWS"},{"title":"akshay-gupta123/BI-LSTM-CRF_Tensorflow","url":"https://github.com/akshay-gupta123/BI-LSTM-CRF_Tensorflow"},{"title":"2023-MindSpore-1/ms-code-5","url":"https://github.com/2023-MindSpore-1/ms-code-5/tree/main/lstm_crf"}],"syntology":{"n":8,"n_ran":0,"n_unverified":8,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-nemo-corpus-morph-1","slug":"named-entity-recognition-on-nemo-corpus-morph-1","dataset":"NEMO-Corpus (morph,test)","dataset_url":"/dataset/nemo-corpus","rows_in_archive":3,"metrics":["F1"],"first_row_in_archive_order":{"model":"AlephBERT-base Pipeline","paper_title":"AlephBERT:A Hebrew Large Pre-Trained Language Model to Start-off your Hebrew NLP Application With","paper_url":"/paper/alephbert-a-hebrew-large-pre-trained-language","paper_date":"2021-04-08","arxiv_id":"2104.04052","code_links":[{"title":"8400thehealthnetwork/hebsafeharbor","url":"https://github.com/8400thehealthnetwork/hebsafeharbor"},{"title":"OnlpLab/Hebrew-Sentiment-Data","url":"https://github.com/OnlpLab/Hebrew-Sentiment-Data"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-ontonotes","slug":"named-entity-recognition-on-ontonotes","dataset":"OntoNotes","dataset_url":"/dataset/ontonotes-5-0","rows_in_archive":3,"metrics":["F1"],"first_row_in_archive_order":{"model":"DeepStruct multi-task w/ finetune","paper_title":"DeepStruct: Pretraining of Language Models for Structure Prediction","paper_url":"/paper/deepstruct-pretraining-of-language-models-for-1","paper_date":"2022-05-21","arxiv_id":"2205.10475","code_links":[{"title":"cgraywang/deepstruct","url":"https://github.com/cgraywang/deepstruct"}],"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-wnut-20-task-1","slug":"named-entity-recognition-on-wnut-20-task-1","dataset":"WNUT 2020","dataset_url":"/dataset/wnut-20-task-1-extracting-entities-and","rows_in_archive":3,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"mgsohrab","paper_title":"mgsohrab at WNUT 2020 Shared Task-1: Neural Exhaustive Approach for Entity and Relation Recognition Over Wet Lab Protocols","paper_url":"/paper/mgsohrab-at-wnut-2020-shared-task-1-neural","paper_date":"2020-11-01","arxiv_id":null,"code_links":[{"title":"dnanhkhoa/WNUT-2020","url":"https://github.com/dnanhkhoa/WNUT-2020"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-conll-2020","slug":"named-entity-recognition-ner-on-conll-2020","dataset":"CoNLL-2020","dataset_url":"/dataset/conll-2020","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"LUKE + SubRegWeigh (K-means)","paper_title":"SubRegWeigh: Effective and Efficient Annotation Weighing with Subword Regularization","paper_url":"/paper/subregweigh-effective-and-efficient","paper_date":"2024-09-10","arxiv_id":"2409.06216","code_links":[{"title":"4ldk/SubRegWeigh","url":"https://github.com/4ldk/SubRegWeigh"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-ace2005","slug":"named-entity-recognition-on-ace2005","dataset":"ACE2005","dataset_url":"/dataset/ace-2005","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"DeepStruct multi-task w/ finetune","paper_title":"DeepStruct: Pretraining of Language Models for Structure Prediction","paper_url":"/paper/deepstruct-pretraining-of-language-models-for-1","paper_date":"2022-05-21","arxiv_id":"2205.10475","code_links":[{"title":"cgraywang/deepstruct","url":"https://github.com/cgraywang/deepstruct"}],"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-bc7-nlm-chem","slug":"named-entity-recognition-on-bc7-nlm-chem","dataset":"BC7 NLM-Chem","dataset_url":"/dataset/bc7-nlm-chem","rows_in_archive":2,"metrics":["F1-score (strict)"],"first_row_in_archive_order":{"model":"PubMedBERT+MLP+CRF","paper_title":"Chemical identification and indexing in PubMed full-text articles using deep learning and heuristics","paper_url":"/paper/chemical-identification-and-indexing-in-1","paper_date":"2022-07-01","arxiv_id":null,"code_links":[{"title":"bioinformatics-ua/biocreativeVII_track2","url":"https://github.com/bioinformatics-ua/biocreativeVII_track2"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-cmeee","slug":"named-entity-recognition-on-cmeee","dataset":"CMeEE","dataset_url":"/dataset/cmeee","rows_in_archive":2,"metrics":["F1","Micro F1"],"first_row_in_archive_order":{"model":"BERT-CRF (Replicated in AdaSeq)","paper_title":"Improving Named Entity Recognition by External Context Retrieving and Cooperative Learning","paper_url":"/paper/improving-named-entity-recognition-by","paper_date":"2021-05-08","arxiv_id":"2105.03654","code_links":[{"title":"modelscope/adaseq","url":"https://github.com/modelscope/adaseq"},{"title":"modelscope/AdaSeq","url":"https://github.com/modelscope/AdaSeq/tree/master/examples/RaNER"},{"title":"Alibaba-NLP/CLNER","url":"https://github.com/Alibaba-NLP/CLNER"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-dane","slug":"named-entity-recognition-on-dane","dataset":"DaNE","dataset_url":"/dataset/dane","rows_in_archive":2,"metrics":["Micro-average F1"],"first_row_in_archive_order":{"model":"saattrupdan/nbailab-base-ner-scandi","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-hiner-collapsed","slug":"named-entity-recognition-on-hiner-collapsed","dataset":"HiNER-collapsed","dataset_url":"/dataset/hiner-collapsed-1","rows_in_archive":2,"metrics":["F1-score (Weighted)"],"first_row_in_archive_order":{"model":"cfilt/HiNER-collapsed-xlm-roberta-large","paper_title":"HiNER: A Large Hindi Named Entity Recognition Dataset","paper_url":"/paper/hiner-a-large-hindi-named-entity-recognition","paper_date":"2022-04-28","arxiv_id":"2204.13743","code_links":[{"title":"cfiltnlp/hiner","url":"https://github.com/cfiltnlp/hiner"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-hiner-original","slug":"named-entity-recognition-on-hiner-original","dataset":"HiNER-original","dataset_url":"/dataset/hiner-original-1","rows_in_archive":2,"metrics":["F1-score (Weighted)"],"first_row_in_archive_order":{"model":"cfilt/HiNER-original-xlm-roberta-large","paper_title":"HiNER: A Large Hindi Named Entity Recognition Dataset","paper_url":"/paper/hiner-a-large-hindi-named-entity-recognition","paper_date":"2022-04-28","arxiv_id":"2204.13743","code_links":[{"title":"cfiltnlp/hiner","url":"https://github.com/cfiltnlp/hiner"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-nemo-corpus-token-1","slug":"named-entity-recognition-on-nemo-corpus-token-1","dataset":"NEMO-Corpus (token,test)","dataset_url":"/dataset/nemo-corpus","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"AlephBERT-base","paper_title":"AlephBERT:A Hebrew Large Pre-Trained Language Model to Start-off your Hebrew NLP Application With","paper_url":"/paper/alephbert-a-hebrew-large-pre-trained-language","paper_date":"2021-04-08","arxiv_id":"2104.04052","code_links":[{"title":"8400thehealthnetwork/hebsafeharbor","url":"https://github.com/8400thehealthnetwork/hebsafeharbor"},{"title":"OnlpLab/Hebrew-Sentiment-Data","url":"https://github.com/OnlpLab/Hebrew-Sentiment-Data"}],"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-ontonotes-5-0","slug":"named-entity-recognition-on-ontonotes-5-0","dataset":"OntoNotes 5.0","dataset_url":"/dataset/ontonotes-5-0","rows_in_archive":2,"metrics":["Average F1","Micro F1"],"first_row_in_archive_order":{"model":"HGN","paper_title":"Hero-Gang Neural Model For Named Entity Recognition","paper_url":"/paper/hero-gang-neural-model-for-named-entity","paper_date":"2022-05-15","arxiv_id":"2205.07177","code_links":[{"title":"jinpeng01/hgn","url":"https://github.com/jinpeng01/hgn"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-species800","slug":"named-entity-recognition-on-species800","dataset":"Species800","dataset_url":null,"rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"BLSTM-CNN-Char (SparkNLP)","paper_title":"Biomedical Named Entity Recognition at Scale","paper_url":"/paper/biomedical-named-entity-recognition-at-scale","paper_date":"2020-11-12","arxiv_id":"2011.06315","code_links":[{"title":"JohnSnowLabs/spark-nlp-workshop","url":"https://github.com/JohnSnowLabs/spark-nlp-workshop/blob/master/tutorials/Certification_Trainings/Healthcare/1.4.Biomedical_NER_SparkNLP_paper_reproduce.ipynb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-wlpc","slug":"named-entity-recognition-on-wlpc","dataset":"WLPC","dataset_url":null,"rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"DyGIE","paper_title":"A General Framework for Information Extraction using Dynamic Span Graphs","paper_url":"/paper/a-general-framework-for-information","paper_date":"2019-04-05","arxiv_id":"1904.03296","code_links":[{"title":"luanyi/DyGIE","url":"https://github.com/luanyi/DyGIE"},{"title":"tricktreat/trimf","url":"https://github.com/tricktreat/trimf"},{"title":"AndrewSukhobok95/DL_GraphEntity_project","url":"https://github.com/AndrewSukhobok95/DL_GraphEntity_project"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-nemo-corpus","slug":"named-entity-recognition-ner-on-nemo-corpus","dataset":"NEMO-Corpus","dataset_url":"/dataset/nemo-corpus","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"AlephBERTGimmel-base MTL","paper_title":"Large Pre-Trained Models with Extra-Large Vocabularies: A Contrastive Analysis of Hebrew BERT Models and a New One to Outperform Them All","paper_url":"/paper/large-pre-trained-models-with-extra-large","paper_date":"2022-11-28","arxiv_id":"2211.15199","code_links":[],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1","slug":"named-entity-recognition-ner-on-uner-v1","dataset":"UNER v1 (Danish)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-1","slug":"named-entity-recognition-ner-on-uner-v1-1","dataset":"UNER v1 (English)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-2","slug":"named-entity-recognition-ner-on-uner-v1-2","dataset":"UNER v1 (Croatian)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-3","slug":"named-entity-recognition-ner-on-uner-v1-3","dataset":"UNER v1 (Portuguese)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-4","slug":"named-entity-recognition-ner-on-uner-v1-4","dataset":"UNER v1 (Slovak)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-5","slug":"named-entity-recognition-ner-on-uner-v1-5","dataset":"UNER v1 (Serbian)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-6","slug":"named-entity-recognition-ner-on-uner-v1-6","dataset":"UNER v1 (Swedish)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-7","slug":"named-entity-recognition-ner-on-uner-v1-7","dataset":"UNER v1 (Chinese)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-8","slug":"named-entity-recognition-ner-on-uner-v1-8","dataset":"UNER v1 (Chinese Simplified)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-pud","slug":"named-entity-recognition-ner-on-uner-v1-pud","dataset":"UNER v1 - PUD (English)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-pud-1","slug":"named-entity-recognition-ner-on-uner-v1-pud-1","dataset":"UNER v1 - PUD (Portuguese)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-pud-2","slug":"named-entity-recognition-ner-on-uner-v1-pud-2","dataset":"UNER v1 - PUD (Swedish)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-uner-v1-pud-3","slug":"named-entity-recognition-ner-on-uner-v1-pud-3","dataset":"UNER v1 - PUD (Chinese)","dataset_url":"/dataset/uner-v1","rows_in_archive":1,"metrics":["F1 (micro)"],"first_row_in_archive_order":{"model":"UNER XML-R","paper_title":"Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark","paper_url":"/paper/universal-ner-a-gold-standard-multilingual-1","paper_date":"2023-11-15","arxiv_id":"2311.09122","code_links":[{"title":"opennlg/openba-v2","url":"https://github.com/opennlg/openba-v2"},{"title":"UniversalNER/uner_code","url":"https://github.com/UniversalNER/uner_code"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-ner-on-wetlab","slug":"named-entity-recognition-ner-on-wetlab","dataset":"WetLab","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"BiLSTM-CRF with ELMo","paper_title":"Using Similarity Measures to Select Pretraining Data for NER","paper_url":"/paper/using-similarity-measures-to-select","paper_date":"2019-04-01","arxiv_id":"1904.00585","code_links":[{"title":"daixiangau/naacl2019-select-pretraining-data-for-ner","url":"https://github.com/daixiangau/naacl2019-select-pretraining-data-for-ner"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-adverse-drug","slug":"named-entity-recognition-on-adverse-drug","dataset":"Adverse Drug Events (ADE) Corpus","dataset_url":"/dataset/ade-corpus","rows_in_archive":1,"metrics":["NER Macro F1"],"first_row_in_archive_order":{"model":"Spark NLP","paper_title":"Mining Adverse Drug Reactions from Unstructured Mediums at Scale","paper_url":"/paper/mining-adverse-drug-reactions-from","paper_date":"2022-01-05","arxiv_id":"2201.01405","code_links":[],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-broad-twitter","slug":"named-entity-recognition-on-broad-twitter","dataset":"Broad Twitter Corpus","dataset_url":"/dataset/broad-twitter-corpus","rows_in_archive":1,"metrics":["Entity F1"],"first_row_in_archive_order":{"model":"WORD_GAZ","paper_title":"The Utility and Interplay of Gazetteers and Entity Segmentation for Named Entity Recognition in English","paper_url":"/paper/the-utility-and-interplay-of-gazetteers-and","paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-code-switching","slug":"named-entity-recognition-on-code-switching","dataset":"Code-Switching English-Spanish NER","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"HME (word + BPE + char)","paper_title":"Hierarchical Meta-Embeddings for Code-Switching Named Entity Recognition","paper_url":"/paper/hierarchical-meta-embeddings-for-code","paper_date":"2019-09-18","arxiv_id":"1909.08504","code_links":[{"title":"gentaiscool/meta-emb","url":"https://github.com/gentaiscool/meta-emb"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-conll-2000","slug":"named-entity-recognition-on-conll-2000","dataset":"CoNLL 2000","dataset_url":"/dataset/conll-1","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"SWEM-CRF","paper_title":"Baseline Needs More Love: On Simple Word-Embedding-Based Models and Associated Pooling Mechanisms","paper_url":"/paper/baseline-needs-more-love-on-simple-word","paper_date":"2018-05-24","arxiv_id":"1805.09843","code_links":[{"title":"dinghanshen/SWEM","url":"https://github.com/dinghanshen/SWEM"},{"title":"nyk510/scdv-python","url":"https://github.com/nyk510/scdv-python"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-french-treebank","slug":"named-entity-recognition-on-french-treebank","dataset":"French Treebank","dataset_url":null,"rows_in_archive":1,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"CamemBERT (subword masking)","paper_title":"CamemBERT: a Tasty French Language Model","paper_url":"/paper/camembert-a-tasty-french-language-model","paper_date":"2019-11-10","arxiv_id":"1911.03894","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"Karthik-Bhaskar/Context-Based-Question-Answering","url":"https://github.com/Karthik-Bhaskar/Context-Based-Question-Answering"},{"title":"anaishoareau/french_preprocessing","url":"https://github.com/anaishoareau/french_preprocessing"},{"title":"bourrel/French-News-Clustering","url":"https://github.com/bourrel/French-News-Clustering"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/camembert"},{"title":"hbaflast/bert-sentiment-analysis-pytorch","url":"https://github.com/hbaflast/bert-sentiment-analysis-pytorch"},{"title":"hbaflast/bert-sentiment-analysis-tensorflow","url":"https://github.com/hbaflast/bert-sentiment-analysis-tensorflow"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/camembert"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-gellus","slug":"named-entity-recognition-on-gellus","dataset":"Gellus","dataset_url":null,"rows_in_archive":1,"metrics":["F1 (%)"],"first_row_in_archive_order":{"model":"ConNER","paper_title":"Enhancing Label Consistency on Document-level Named Entity Recognition","paper_url":"/paper/enhancing-label-consistency-on-document-level","paper_date":"2022-10-24","arxiv_id":"2210.12949","code_links":[{"title":"dmis-lab/conner","url":"https://github.com/dmis-lab/conner"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-i2b2-de","slug":"named-entity-recognition-on-i2b2-de","dataset":"i2b2 De-identification Dataset","dataset_url":"/dataset/i2b2-de-identification-dataset","rows_in_archive":1,"metrics":["F1","Precision"],"first_row_in_archive_order":{"model":"BiLSTM with ELMo","paper_title":"MASK: A flexible framework to facilitate de-identification of clinical texts","paper_url":"/paper/mask-a-flexible-framework-to-facilitate-de","paper_date":"2020-05-24","arxiv_id":"2005.11687","code_links":[{"title":"icescentral/MASK_public","url":"https://github.com/icescentral/MASK_public"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-iecsil-fire-2018","slug":"named-entity-recognition-on-iecsil-fire-2018","dataset":"IECSIL FIRE-2018 Shared Task","dataset_url":"/dataset/iecsil-fire-2018-shared-task","rows_in_archive":1,"metrics":["Average F1"],"first_row_in_archive_order":{"model":"XLM-RoBERTa","paper_title":"Analysis Of Contextual and Non-Contextual Word Embedding Models For Hindi NER With Web Application For Data Collection","paper_url":"/paper/analysis-of-contextual-and-non-contextual","paper_date":"2021-02-18","arxiv_id":null,"code_links":[{"title":"AindriyaBarua/Contextual-vs-Non-Contextual-Word-Embeddings-For-Hindi-NER-With-WebApp","url":"https://github.com/AindriyaBarua/Contextual-vs-Non-Contextual-Word-Embeddings-For-Hindi-NER-With-WebApp"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-legalnero","slug":"named-entity-recognition-on-legalnero","dataset":"LegalNERo","dataset_url":"/dataset/legalnero","rows_in_archive":1,"metrics":["Avg F1"],"first_row_in_archive_order":{"model":"Marcell","paper_title":"Named Entity Recognition in the Romanian Legal Domain","paper_url":"/paper/named-entity-recognition-in-the-romanian","paper_date":"","arxiv_id":null,"code_links":[{"title":"racai-ai/LegalNER","url":"https://github.com/racai-ai/LegalNER"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-lener-br","slug":"named-entity-recognition-on-lener-br","dataset":"LeNER-Br","dataset_url":"/dataset/lener-br","rows_in_archive":1,"metrics":["Micro F1 (Exact Span)","Micro F1 (Tokens)"],"first_row_in_archive_order":{"model":"LSTM-CRF","paper_title":"LeNER-Br: a Dataset for Named Entity Recognition in Brazilian Legal Text","paper_url":"/paper/lener-br-a-dataset-for-named-entity","paper_date":"2018-09-24","arxiv_id":null,"code_links":[{"title":"peluz/lener-br","url":"https://github.com/peluz/lener-br"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-ncbi-disease","slug":"named-entity-recognition-on-ncbi-disease","dataset":"NCBI Disease","dataset_url":"/dataset/ncbi-disease-1","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"UniNER-7B","paper_title":"UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity Recognition","paper_url":"/paper/universalner-targeted-distillation-from-large","paper_date":"2023-08-07","arxiv_id":"2308.03279","code_links":[{"title":"universal-ner/universal-ner","url":"https://github.com/universal-ner/universal-ner"},{"title":"emma1066/retrieval-augmented-it-openner","url":"https://github.com/emma1066/retrieval-augmented-it-openner"}],"syntology":{"n":12,"n_ran":7,"n_unverified":5,"n_pointer_only":0}}},{"leaderboard":"/sota/named-entity-recognition-on-semeval-2022","slug":"named-entity-recognition-on-semeval-2022","dataset":"SemEval 2022 - BanglaCoNER","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"POS Tagger, Prefix, Suffix, k-Neighbor Words, k-means clustering","paper_title":"BanglaCoNER: Towards Robust Bangla Complex Named Entity Recognition","paper_url":"/paper/towards-robust-bangla-complex-named-entity","paper_date":"2023-03-16","arxiv_id":"2303.09306","code_links":[{"title":"ramisa2108/bangla-complex-named-entity-recognition-challenge","url":"https://github.com/ramisa2108/bangla-complex-named-entity-recognition-challenge"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-semeval-2022-2023","slug":"named-entity-recognition-on-semeval-2022-2023","dataset":"SemEval 2022-2023 - BanglaCoNER","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"FT-Bangla BERT Large","paper_title":"BanglaCoNER: Towards Robust Bangla Complex Named Entity Recognition","paper_url":"/paper/towards-robust-bangla-complex-named-entity","paper_date":"2023-03-16","arxiv_id":"2303.09306","code_links":[{"title":"ramisa2108/bangla-complex-named-entity-recognition-challenge","url":"https://github.com/ramisa2108/bangla-complex-named-entity-recognition-challenge"}],"syntology":null}},{"leaderboard":"/sota/named-entity-recognition-on-soscisoci","slug":"named-entity-recognition-on-soscisoci","dataset":"SoSciSoCi","dataset_url":null,"rows_in_archive":1,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"Bi-LSTM-CRF (SSC->GSC)","paper_title":"Investigating Software Usage in the Social Sciences: A Knowledge Graph Approach","paper_url":"/paper/investigating-software-usage-in-the-social","paper_date":"2020-03-24","arxiv_id":"2003.10715","code_links":[],"syntology":null}}],"datasets":[{"url":"/dataset/conll-2003","name":"CoNLL 2003","full_name":"","num_papers_in_archive":755},{"url":"/dataset/pubmedqa","name":"PubMedQA","full_name":"PubMedQA","num_papers_in_archive":276},{"url":"/dataset/ontonotes-5-0","name":"OntoNotes 5.0","full_name":"","num_papers_in_archive":254},{"url":"/dataset/bc5cdr","name":"BC5CDR","full_name":"BioCreative V CDR corpus","num_papers_in_archive":191},{"url":"/dataset/conll-1","name":"CoNLL","full_name":"","num_papers_in_archive":187},{"url":"/dataset/funsd","name":"FUNSD","full_name":"Form Understanding in Noisy Scanned Documents","num_papers_in_archive":179},{"url":"/dataset/ncbi-disease-1","name":"NCBI Disease","full_name":"","num_papers_in_archive":154},{"url":"/dataset/scierc","name":"SciERC","full_name":"","num_papers_in_archive":134},{"url":"/dataset/blue","name":"BLUE","full_name":"Biomedical Language Understanding Evaluation","num_papers_in_archive":133},{"url":"/dataset/wnut-2017-emerging-and-rare-entity","name":"WNUT 2017","full_name":"WNUT 2017 Emerging and Rare entity recognition","num_papers_in_archive":127},{"url":"/dataset/genia","name":"GENIA","full_name":"","num_papers_in_archive":121},{"url":"/dataset/cord","name":"CORD","full_name":"Consolidated Receipt Dataset for Post-OCR Parsing","num_papers_in_archive":100},{"url":"/dataset/radgraph","name":"RadGraph","full_name":"RadGraph: Extracting Clinical Entities and Relations from Radiology Reports","num_papers_in_archive":78},{"url":"/dataset/few-nerd","name":"Few-NERD","full_name":"Few-NERD","num_papers_in_archive":77},{"url":"/dataset/wikiann-1","name":"WikiANN","full_name":"PAN-X","num_papers_in_archive":72},{"url":"/dataset/conll-2002","name":"CoNLL 2002","full_name":"","num_papers_in_archive":70},{"url":"/dataset/ace-2005","name":"ACE 2005","full_name":"ACE 2005 Multilingual Training Corpus","num_papers_in_archive":65},{"url":"/dataset/conll","name":"CoNLL++","full_name":"","num_papers_in_archive":56},{"url":"/dataset/masakhaner","name":"MasakhaNER","full_name":"","num_papers_in_archive":56},{"url":"/dataset/ace-2004","name":"ACE 2004","full_name":"ACE 2004 Multilingual Training Corpus","num_papers_in_archive":51},{"url":"/dataset/medmentions","name":"MedMentions","full_name":"","num_papers_in_archive":48},{"url":"/dataset/multiconer","name":"MultiCoNER","full_name":"","num_papers_in_archive":47},{"url":"/dataset/fin","name":"FIN","full_name":"","num_papers_in_archive":39},{"url":"/dataset/ipm-nel","name":"IPM NEL","full_name":"Derczynski IPM Named Entity Linking","num_papers_in_archive":32},{"url":"/dataset/wikicoref","name":"WikiCoref","full_name":"","num_papers_in_archive":28},{"url":"/dataset/biored","name":"BioRED","full_name":"","num_papers_in_archive":25},{"url":"/dataset/slue","name":"SLUE","full_name":"Spoken Language Understanding Evaluation","num_papers_in_archive":22},{"url":"/dataset/klue","name":"KLUE","full_name":"Korean Language Understanding Evaluation","num_papers_in_archive":21},{"url":"/dataset/lince","name":"LinCE","full_name":"Linguistic Code-switching Evaluation Dataset","num_papers_in_archive":21},{"url":"/dataset/jnlpba","name":"JNLPBA","full_name":"JNLPBA","num_papers_in_archive":20},{"url":"/dataset/xfun","name":"XFUND","full_name":"A Multilingual Form Understanding Benchmark","num_papers_in_archive":20},{"url":"/dataset/nne","name":"NNE","full_name":"","num_papers_in_archive":19},{"url":"/dataset/wnut-2016-ner","name":"WNUT 2016 NER","full_name":"WNUT 2016 Twitter Named Entity Recognition","num_papers_in_archive":19},{"url":"/dataset/dwie","name":"DWIE","full_name":"Deutsche Welle corpus for Information Extraction","num_papers_in_archive":18},{"url":"/dataset/groningen-meaning-bank","name":"Groningen Meaning Bank","full_name":"","num_papers_in_archive":18},{"url":"/dataset/indicglue","name":"IndicGLUE","full_name":"Indic General Language Understanding Evaluation Benchmark","num_papers_in_archive":16},{"url":"/dataset/crossner","name":"CrossNER","full_name":"","num_papers_in_archive":15},{"url":"/dataset/ade-corpus","name":"Adverse Drug Events (ADE) Corpus","full_name":"","num_papers_in_archive":14},{"url":"/dataset/bc2gm","name":"BC2GM","full_name":"BC2GM","num_papers_in_archive":13},{"url":"/dataset/gum","name":"GUM","full_name":"Georgetown University Multilayer corpus","num_papers_in_archive":13},{"url":"/dataset/broad-twitter-corpus","name":"Broad Twitter Corpus","full_name":"","num_papers_in_archive":12},{"url":"/dataset/earnings-21","name":"Earnings-21","full_name":"","num_papers_in_archive":12},{"url":"/dataset/ncbi-disease-corpus","name":"NCBI Datasets","full_name":"","num_papers_in_archive":11},{"url":"/dataset/cmeee","name":"CMeEE","full_name":"Chinese Medical Named Entity Recognition Dataset","num_papers_in_archive":10},{"url":"/dataset/polyglot-ner","name":"Polyglot-NER","full_name":"","num_papers_in_archive":10},{"url":"/dataset/geowebnews","name":"GeoWebNews","full_name":"","num_papers_in_archive":9},{"url":"/dataset/2018-n2c2-track-2-adverse-drug-events-and","name":"2018 n2c2 (Track 2) - Adverse Drug Events and Medication Extraction","full_name":"2018 n2c2 shared task on adverse drug events and medication extraction in electronic health records","num_papers_in_archive":8},{"url":"/dataset/bb","name":"BB","full_name":"Bacteria Biotope","num_papers_in_archive":8},{"url":"/dataset/conll-2000-1","name":"CoNLL-2000","full_name":"","num_papers_in_archive":8},{"url":"/dataset/peyma","name":"PEYMA","full_name":"","num_papers_in_archive":8},{"url":"/dataset/winogender-schemas","name":"Winogender Schemas","full_name":"","num_papers_in_archive":8},{"url":"/dataset/bc4chemd","name":"BC4CHEMD","full_name":"BioCreative IV Chemical compound and drug name recognition","num_papers_in_archive":6},{"url":"/dataset/dane","name":"DaNE","full_name":"Danish Dependency Treebank","num_papers_in_archive":6},{"url":"/dataset/legal-ner","name":"legal_NER","full_name":"","num_papers_in_archive":6},{"url":"/dataset/media","name":"MEDIA","full_name":"MEDIA","num_papers_in_archive":6},{"url":"/dataset/naamapadam-1","name":"Naamapadam","full_name":"","num_papers_in_archive":6},{"url":"/dataset/pgr","name":"PGR","full_name":"Phenotype-Gene Relations","num_papers_in_archive":6},{"url":"/dataset/wikineural","name":"WikiNEuRal","full_name":"","num_papers_in_archive":6},{"url":"/dataset/wnut-20-task-1-extracting-entities-and","name":"WNUT 2020","full_name":"WNUT-2020 Task 1 Overview: Extracting Entities and Relations from Wet Lab Protocols","num_papers_in_archive":6},{"url":"/dataset/amalgum","name":"AMALGUM","full_name":"A Machine Annotated Lookalike of GUM","num_papers_in_archive":5},{"url":"/dataset/dan","name":"DaN+","full_name":"","num_papers_in_archive":5},{"url":"/dataset/europeana-newspapers","name":"Europeana Newspapers","full_name":"","num_papers_in_archive":5},{"url":"/dataset/linnaeus","name":"LINNAEUS","full_name":"","num_papers_in_archive":5},{"url":"/dataset/somesci","name":"SoMeSci","full_name":"Software Mentions in Scientific Articles","num_papers_in_archive":5},{"url":"/dataset/species-800","name":"Species-800","full_name":"Species-800","num_papers_in_archive":5},{"url":"/dataset/findvehicle","name":"FindVehicle","full_name":"","num_papers_in_archive":4},{"url":"/dataset/finer","name":"Finer","full_name":"Finnish News Corpus for Named Entity Recognition","num_papers_in_archive":4},{"url":"/dataset/i2b2-de-identification-dataset","name":"i2b2 De-identification Dataset","full_name":"Informatics for Integrating Biology and the Bedside (i2b2) Project — De-identification Dataset","num_papers_in_archive":4},{"url":"/dataset/legalnero","name":"LegalNERo","full_name":"Romanian Named Entity Recognition in the Legal domain","num_papers_in_archive":4},{"url":"/dataset/ronec","name":"RONEC","full_name":"Romanian Named Entity Corpus","num_papers_in_archive":4},{"url":"/dataset/buster","name":"BUSTER","full_name":"BUSiness Transaction Entity Recognition dataset.","num_papers_in_archive":3},{"url":"/dataset/cord-r","name":"CORD-r","full_name":"","num_papers_in_archive":3},{"url":"/dataset/covid-q","name":"COVID-Q","full_name":"","num_papers_in_archive":3},{"url":"/dataset/dr-bench","name":"DR.BENCH","full_name":"Diagnostic Reasoning Benchmark for clinical natural language processing","num_papers_in_archive":3},{"url":"/dataset/e-ner","name":"E-NER","full_name":"","num_papers_in_archive":3},{"url":"/dataset/funsd-r","name":"FUNSD-r","full_name":"","num_papers_in_archive":3},{"url":"/dataset/kind","name":"KIND","full_name":"Kessler Italian Named-entities Dataset","num_papers_in_archive":3},{"url":"/dataset/lener-br","name":"LeNER-Br","full_name":"","num_papers_in_archive":3},{"url":"/dataset/nemo-corpus","name":"NEMO-Corpus","full_name":"NEMO Hebrew NER and Morphology Corpus","num_papers_in_archive":3},{"url":"/dataset/parstwiner","name":"ParsTwiner","full_name":"","num_papers_in_archive":3},{"url":"/dataset/phoner-covid19","name":"PhoNER COVID19","full_name":"","num_papers_in_archive":3},{"url":"/dataset/share-clef-2014-task-2-disorders","name":"ShARe/CLEF 2014: Task 2 Disorders","full_name":"","num_papers_in_archive":3},{"url":"/dataset/the-quaero-french-medical-corpus","name":"The QUAERO French Medical Corpus","full_name":"The QUAERO French Medical Corpus","num_papers_in_archive":3},{"url":"/dataset/vimq","name":"ViMQ","full_name":"","num_papers_in_archive":3},{"url":"/dataset/barner","name":"BarNER","full_name":"","num_papers_in_archive":2},{"url":"/dataset/bc7-nlm-chem","name":"BC7 NLM-Chem","full_name":"BioCreative VII NLM-Chem","num_papers_in_archive":2},{"url":"/dataset/biographical","name":"Biographical","full_name":"Biographical: A Semi-Supervised Relation Extraction Dataset","num_papers_in_archive":2},{"url":"/dataset/chinese-gigaword","name":"Chinese Gigaword","full_name":"Chinese Gigaword","num_papers_in_archive":2},{"url":"/dataset/cluener2020","name":"CLUENER2020","full_name":"","num_papers_in_archive":2},{"url":"/dataset/conll-2020","name":"CoNLL-2020","full_name":"CoNLLpp","num_papers_in_archive":2},{"url":"/dataset/dataset-of-legal-documents","name":"Dataset of Legal Documents","full_name":"","num_papers_in_archive":2},{"url":"/dataset/inlegalner","name":"InLegalNER","full_name":"InLegalNER","num_papers_in_archive":2},{"url":"/dataset/kaznerd","name":"KazNERD","full_name":"","num_papers_in_archive":2},{"url":"/dataset/mobie","name":"MobIE","full_name":"","num_papers_in_archive":2},{"url":"/dataset/pcmsp","name":"PcMSP","full_name":"","num_papers_in_archive":2},{"url":"/dataset/pioner","name":"pioNER","full_name":null,"num_papers_in_archive":2},{"url":"/dataset/rare-disease-annotation-from-mimic-iii","name":"Rare Diseases Mentions in MIMIC-III","full_name":"Rare disease mention annotations from a sample of MIMIC-III clinical notes","num_papers_in_archive":2},{"url":"/dataset/semclinbr","name":"SemClinBr","full_name":"A multi‑institutional and multi‑specialty semantically annotated corpus for Portuguese clinical NLP tasks","num_papers_in_archive":2},{"url":"/dataset/thyme-2016","name":"THYME-2016","full_name":"","num_papers_in_archive":2},{"url":"/dataset/arendt","name":"Arendt","full_name":"","num_papers_in_archive":1},{"url":"/dataset/baitbuster-bangla","name":"BaitBuster-Bangla: A Comprehensive Dataset for Clickbait Detection in Bangla with Multi-Feature and Multi-Modal Analysis","full_name":"","num_papers_in_archive":1},{"url":"/dataset/business-license","name":"Business License","full_name":"","num_papers_in_archive":1},{"url":"/dataset/careercoach-2022","name":"CareerCoach 2022","full_name":"","num_papers_in_archive":1},{"url":"/dataset/chem-finese","name":"Chem-FINESE","full_name":"","num_papers_in_archive":1},{"url":"/dataset/chinese-literature-ner-re","name":"Chinese Literature NER RE","full_name":"","num_papers_in_archive":1},{"url":"/dataset/diakg","name":"DiaKG","full_name":"","num_papers_in_archive":1},{"url":"/dataset/esg-dlt-ner","name":"ESG-DLT-NER","full_name":"","num_papers_in_archive":1},{"url":"/dataset/financial-language-understanding-evaluation","name":"Financial Language Understanding Evaluation","full_name":"","num_papers_in_archive":1},{"url":"/dataset/first-harem","name":"First HAREM","full_name":"Primeiro HAREM","num_papers_in_archive":1},{"url":"/dataset/gsap-ner","name":"GSAP-NER","full_name":"GSAP-NER 1.0","num_papers_in_archive":1},{"url":"/dataset/hengamcorpus","name":"HengamCorpus","full_name":"","num_papers_in_archive":1},{"url":"/dataset/hiner-collapsed-1","name":"HiNER-collapsed","full_name":"HiNER: A Large Hindi Named Entity Recognition Dataset","num_papers_in_archive":1},{"url":"/dataset/hiner-original-1","name":"HiNER-original","full_name":"HiNER: A Large Hindi Named Entity Recognition Dataset","num_papers_in_archive":1},{"url":"/dataset/iecsil-fire-2018-shared-task","name":"IECSIL FIRE-2018 Shared Task","full_name":"","num_papers_in_archive":1},{"url":"/dataset/lpsc","name":"LPSC","full_name":"Planetary Science Data Set","num_papers_in_archive":1},{"url":"/dataset/masc","name":"MASC","full_name":"Manually Annotated Sub-Corpus","num_papers_in_archive":1},{"url":"/dataset/medical-case-report-corpus","name":"Medical Case Report Corpus","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mini-harem","name":"Mini HAREM","full_name":"","num_papers_in_archive":1},{"url":"/dataset/msner","name":"MSNER","full_name":"Multilingual Spoken Named Entity Recognition","num_papers_in_archive":1},{"url":"/dataset/scienceexamcer","name":"ScienceExamCER","full_name":"","num_papers_in_archive":1},{"url":"/dataset/sturm","name":"Sturm","full_name":"","num_papers_in_archive":1},{"url":"/dataset/sumeczech-ner","name":"SumeCzech-NER","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tasteset","name":"TASTEset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/twitter-cyberthreat-detection-dataset","name":"Twitter Cyberthreat Detection Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/uner-v1","name":"UNER v1","full_name":"Universal NER v1","num_papers_in_archive":1},{"url":"/dataset/vietmed-ner","name":"VietMed-NER","full_name":"","num_papers_in_archive":1},{"url":"/dataset/popcorn","name":"POPCORN","full_name":"POPCORN: Fictional and Synthetic Intelligence Reports for Named Entity Recognition and Relation Extraction Tasks","num_papers_in_archive":0},{"url":"/dataset/second-harem","name":"Second HAREM","full_name":"Segundo HAREM","num_papers_in_archive":0},{"url":"/dataset/sigarra-news-corpus","name":"SIGARRA News Corpus","full_name":"","num_papers_in_archive":0},{"url":"/dataset/stem-ecr","name":"STEM-ECR","full_name":"","num_papers_in_archive":0}],"subtasks":[{"url":"/task/cg","name":"NER"},{"url":"/task/chinese-named-entity-recognition","name":"Chinese Named Entity Recognition"},{"url":"/task/cross-domain-named-entity-recognition","name":"Cross-Domain Named Entity Recognition"},{"url":"/task/few-shot-ner","name":"Few-shot NER"},{"url":"/task/medical-named-entity-recognition","name":"Medical Named Entity Recognition"},{"url":"/task/multi-grained-named-entity-recognition","name":"Multi-Grained Named Entity Recognition"},{"url":"/task/multi-modal-named-entity-recognition","name":"Multi-modal Named Entity Recognition"},{"url":"/task/multilingual-named-entity-recognition","name":"Multilingual Named Entity Recognition"},{"url":"/task/named-entity-recognition-in-vietnamese","name":"Named Entity Recognition In Vietnamese"},{"url":"/task/nested-named-entity-recognition","name":"Nested Named Entity Recognition"},{"url":"/task/scientific-concept-extraction","name":"Scientific Concept Extraction"},{"url":"/task/toponym-recognition","name":"Toponym Recognition"},{"url":"/task/zero-shot-named-entity-recognition-ner","name":"Zero-shot Named Entity Recognition (NER)"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":955,"tagged_in_all":2874,"items":[{"url":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","arxiv_id":"1810.04805","repositories_listed":534,"syntology":{"n":659,"n_ran":208,"n_unverified":451,"n_pointer_only":149}},{"url":"/paper/deep-contextualized-word-representations","title":"Deep contextualized word representations","date":"2018-02-15","arxiv_id":"1802.05365","repositories_listed":46,"syntology":{"n":58,"n_ran":24,"n_unverified":34,"n_pointer_only":25}},{"url":"/paper/neural-architectures-for-named-entity","title":"Neural Architectures for Named Entity Recognition","date":"2016-03-04","arxiv_id":"1603.01360","repositories_listed":43,"syntology":{"n":36,"n_ran":10,"n_unverified":26,"n_pointer_only":6}},{"url":"/paper/end-to-end-sequence-labeling-via-bi","title":"End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF","date":"2016-03-04","arxiv_id":"1603.01354","repositories_listed":25,"syntology":{"n":24,"n_ran":4,"n_unverified":20,"n_pointer_only":3}},{"url":"/paper/bidirectional-lstm-crf-models-for-sequence","title":"Bidirectional LSTM-CRF Models for Sequence Tagging","date":"2015-08-09","arxiv_id":"1508.01991","repositories_listed":25,"syntology":{"n":8,"n_ran":0,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/ernie-enhanced-representation-through","title":"ERNIE: Enhanced Representation through Knowledge Integration","date":"2019-04-19","arxiv_id":"1904.09223","repositories_listed":19,"syntology":{"n":7,"n_ran":6,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/biobert-a-pre-trained-biomedical-language","title":"BioBERT: a pre-trained biomedical language representation model for biomedical text mining","date":"2019-01-25","arxiv_id":"1901.08746","repositories_listed":19,"syntology":{"n":25,"n_ran":13,"n_unverified":12,"n_pointer_only":1}},{"url":"/paper/deberta-decoding-enhanced-bert-with","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","date":"2020-06-05","arxiv_id":"2006.03654","repositories_listed":14,"syntology":{"n":13,"n_ran":4,"n_unverified":9,"n_pointer_only":3}},{"url":"/paper/named-entity-recognition-with-bidirectional","title":"Named Entity Recognition with Bidirectional LSTM-CNNs","date":"2015-11-26","arxiv_id":"1511.08308","repositories_listed":14,"syntology":{"n":9,"n_ran":4,"n_unverified":5,"n_pointer_only":4}},{"url":"/paper/nezha-neural-contextualized-representation","title":"NEZHA: Neural Contextualized Representation for Chinese Language Understanding","date":"2019-08-31","arxiv_id":"1909.00204","repositories_listed":10,"syntology":null},{"url":"/paper/luke-deep-contextualized-entity","title":"LUKE: Deep Contextualized Entity Representations with Entity-aware Self-attention","date":"2020-10-02","arxiv_id":"2010.01057","repositories_listed":9,"syntology":{"n":10,"n_ran":3,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/camembert-a-tasty-french-language-model","title":"CamemBERT: a Tasty French Language Model","date":"2019-11-10","arxiv_id":"1911.03894","repositories_listed":8,"syntology":null},{"url":"/paper/a-unified-mrc-framework-for-named-entity","title":"A Unified MRC Framework for Named Entity Recognition","date":"2019-10-25","arxiv_id":"1910.11476","repositories_listed":8,"syntology":{"n":5,"n_ran":3,"n_unverified":2,"n_pointer_only":2}},{"url":"/paper/few-nerd-a-few-shot-named-entity-recognition","title":"Few-NERD: A Few-Shot Named Entity Recognition Dataset","date":"2021-05-16","arxiv_id":"2105.07464","repositories_listed":7,"syntology":{"n":7,"n_ran":1,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/tener-adapting-transformer-encoder-for-name","title":"TENER: Adapting Transformer Encoder for Named Entity Recognition","date":"2019-11-10","arxiv_id":"1911.04474","repositories_listed":6,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/scibert-pretrained-contextualized-embeddings","title":"SciBERT: A Pretrained Language Model for Scientific Text","date":"2019-03-26","arxiv_id":"1903.10676","repositories_listed":6,"syntology":null},{"url":"/paper/the-natural-language-decathlon-multitask","title":"The Natural Language Decathlon: Multitask Learning as Question Answering","date":"2018-06-20","arxiv_id":"1806.08730","repositories_listed":6,"syntology":{"n":13,"n_ran":1,"n_unverified":12,"n_pointer_only":4}},{"url":"/paper/optimal-hyperparameters-for-deep-lstm","title":"Optimal Hyperparameters for Deep LSTM-Networks for Sequence Labeling Tasks","date":"2017-07-21","arxiv_id":"1707.06799","repositories_listed":6,"syntology":null},{"url":"/paper/crossner-evaluating-cross-domain-named-entity","title":"CrossNER: Evaluating Cross-Domain Named Entity Recognition","date":"2020-12-08","arxiv_id":"2012.04373","repositories_listed":5,"syntology":null},{"url":"/paper/biomedical-and-clinical-english-model","title":"Biomedical and Clinical English Model Packages in the Stanza Python NLP Library","date":"2020-07-29","arxiv_id":"2007.14640","repositories_listed":5,"syntology":null},{"url":"/paper/stanza-a-python-natural-language-processing","title":"Stanza: A Python Natural Language Processing Toolkit for Many Human Languages","date":"2020-03-16","arxiv_id":"2003.07082","repositories_listed":5,"syntology":{"n":30,"n_ran":16,"n_unverified":14,"n_pointer_only":28}},{"url":"/paper/multi-task-identification-of-entities","title":"Multi-Task Identification of Entities, Relations, and Coreference for Scientific Knowledge Graph Construction","date":"2018-08-29","arxiv_id":"1808.09602","repositories_listed":5,"syntology":null},{"url":"/paper/reporting-score-distributions-makes-a","title":"Reporting Score Distributions Makes a Difference: Performance Study of LSTM-networks for Sequence Tagging","date":"2017-07-31","arxiv_id":"1707.09861","repositories_listed":5,"syntology":null},{"url":"/paper/layoutlmv3-pre-training-for-document-ai-with","title":"LayoutLMv3: Pre-training for Document AI with Unified Text and Image Masking","date":"2022-04-18","arxiv_id":"2204.08387","repositories_listed":4,"syntology":null},{"url":"/paper/klue-korean-language-understanding-evaluation","title":"KLUE: Korean Language Understanding Evaluation","date":"2021-05-20","arxiv_id":"2105.09680","repositories_listed":4,"syntology":null},{"url":"/paper/rethinking-embedding-coupling-in-pre-trained-1","title":"Rethinking embedding coupling in pre-trained language models","date":"2020-10-24","arxiv_id":"2010.12821","repositories_listed":4,"syntology":null},{"url":"/paper/neural-modeling-for-named-entities-and","title":"Neural Modeling for Named Entities and Morphology (NEMO^2)","date":"2020-07-30","arxiv_id":"2007.15620","repositories_listed":4,"syntology":null},{"url":"/paper/arabert-transformer-based-model-for-arabic","title":"AraBERT: Transformer-based Model for Arabic Language Understanding","date":"2020-02-28","arxiv_id":"2003.00104","repositories_listed":4,"syntology":null},{"url":"/paper/dice-loss-for-data-imbalanced-nlp-tasks","title":"Dice Loss for Data-imbalanced NLP Tasks","date":"2019-11-07","arxiv_id":"1911.02855","repositories_listed":4,"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/entity-relation-and-event-extraction-with","title":"Entity, Relation, and Event Extraction with Contextualized Span Representations","date":"2019-09-08","arxiv_id":"1909.03546","repositories_listed":4,"syntology":{"n":7,"n_ran":5,"n_unverified":2,"n_pointer_only":0}}],"syntology_records":17,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-25T09:33:49+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}