{"url":"/dataset/wikiann-1","name":"WikiANN","full_name":"PAN-X","description_markdown":"**WikiANN**, also known as **PAN-X**, is a multilingual named entity recognition dataset. It consists of Wikipedia articles that have been annotated with **LOC** (location), **PER** (person), and **ORG** (organization) tags in the **IOB2 format**¹². This dataset serves as a valuable resource for training and evaluating named entity recognition models across various languages.\r\n\r\nFor instance, it includes information about notable individuals, places, and organizations mentioned in Wikipedia articles. Researchers and practitioners can use WikiANN to develop and improve natural language processing systems that identify and classify named entities in text.\r\n\r\n(1) wikiann · Datasets at Hugging Face. https://huggingface.co/datasets/wikiann.\r\n(2) wikiann | TensorFlow Datasets. https://tensorflow.google.cn/datasets/catalog/wikiann.\r\n(3) wikiann · Datasets at Hugging Face. https://huggingface.co/datasets/wikiann/viewer/en.\r\n(4) WikiAnn Dataset | Papers With Code. https://paperswithcode.com/dataset/wikiann-1.","description_withheld":null,"homepage":"https://tensorflow.google.cn/datasets/catalog/wikiann","introduced_date":"2023-09-14","introduced_date_note":null,"introduced_by":{"paper":"/paper/cross-lingual-name-tagging-and-linking-for","title":"Cross-lingual Name Tagging and Linking for 282 Languages","first_author":"Xiaoman Pan","url":null},"license":null,"modalities":[],"tasks":[{"name":"Named Entity Recognition (NER)","url":"/task/named-entity-recognition-ner","datasets_with_task":"/datasets/task/named-entity-recognition-ner"},{"name":"Cross-Lingual Transfer","url":"/task/cross-lingual-transfer","datasets_with_task":"/datasets/task/cross-lingual-transfer"},{"name":"Cross-Lingual NER","url":"/task/cross-lingual-ner","datasets_with_task":"/datasets/task/cross-lingual-ner"},{"name":"UIE","url":"/task/uie","datasets_with_task":"/datasets/task/uie"},{"name":"Token Classification","url":"/task/token-classification","datasets_with_task":"/datasets/task/token-classification"},{"name":"Named Entity Recognition","url":"/task/named-entity-recognition-1","datasets_with_task":"/datasets/task/named-entity-recognition-1"},{"name":"Word Embeddings","url":"/task/word-embeddings","datasets_with_task":"/datasets/task/word-embeddings"}],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"French","url":"/datasets/language/french"},{"name":"Spanish","url":"/datasets/language/spanish"},{"name":"German","url":"/datasets/language/german"},{"name":"Italian","url":"/datasets/language/italian"},{"name":"Chinese","url":"/datasets/language/chinese"},{"name":"Bengali","url":"/datasets/language/bengali"},{"name":"Multilingual","url":"/datasets/language/multilingual"},{"name":"Japanese","url":"/datasets/language/japanese"},{"name":"Russian","url":"/datasets/language/russian"},{"name":"Portuguese","url":"/datasets/language/portuguese"},{"name":"Afrikaans","url":"/datasets/language/afrikaans"},{"name":"Albanian","url":"/datasets/language/albanian"},{"name":"Amharic","url":"/datasets/language/amharic"},{"name":"Arabic","url":"/datasets/language/arabic"},{"name":"Armenian","url":"/datasets/language/armenian"},{"name":"Bambara","url":"/datasets/language/bambara"},{"name":"Basque","url":"/datasets/language/basque"},{"name":"Belarusian","url":"/datasets/language/belarusian"},{"name":"Breton","url":"/datasets/language/breton"},{"name":"Bulgarian","url":"/datasets/language/bulgarian"},{"name":"Catalan","url":"/datasets/language/catalan"},{"name":"Church Slavic","url":"/datasets/language/church-slavic"},{"name":"Croatian","url":"/datasets/language/croatian"},{"name":"Czech","url":"/datasets/language/czech"},{"name":"Danish","url":"/datasets/language/danish"},{"name":"Dutch","url":"/datasets/language/dutch"},{"name":"Erzya","url":"/datasets/language/erzya"},{"name":"Estonian","url":"/datasets/language/estonian"},{"name":"Faroese","url":"/datasets/language/faroese"},{"name":"Finnish","url":"/datasets/language/finnish"},{"name":"Galician","url":"/datasets/language/galician"},{"name":"Gothic","url":"/datasets/language/gothic"},{"name":"Hebrew","url":"/datasets/language/hebrew"},{"name":"Hindi","url":"/datasets/language/hindi"},{"name":"Hungarian","url":"/datasets/language/hungarian"},{"name":"Icelandic","url":"/datasets/language/icelandic"},{"name":"Indonesian","url":"/datasets/language/indonesian"},{"name":"Irish","url":"/datasets/language/irish"},{"name":"Kazakh","url":"/datasets/language/kazakh"},{"name":"Komi-Permyak","url":"/datasets/language/komi-permyak"},{"name":"Korean","url":"/datasets/language/korean"},{"name":"Latin","url":"/datasets/language/latin"},{"name":"Latvian","url":"/datasets/language/latvian"},{"name":"Lithuanian","url":"/datasets/language/lithuanian"},{"name":"Livvi","url":"/datasets/language/livvi"},{"name":"Maltese","url":"/datasets/language/maltese"},{"name":"Manx","url":"/datasets/language/manx"},{"name":"Marathi","url":"/datasets/language/marathi"},{"name":"Moksha","url":"/datasets/language/moksha"},{"name":"Northern Sami","url":"/datasets/language/northern-sami"},{"name":"Norwegian","url":"/datasets/language/norwegian"},{"name":"Persian","url":"/datasets/language/persian"},{"name":"Polish","url":"/datasets/language/polish"},{"name":"Romanian","url":"/datasets/language/romanian"},{"name":"Russia Buriat","url":"/datasets/language/russia-buriat"},{"name":"Sanskrit","url":"/datasets/language/sanskrit"},{"name":"Scottish Gaelic","url":"/datasets/language/scottish-gaelic"},{"name":"Serbian","url":"/datasets/language/serbian"},{"name":"Slovak","url":"/datasets/language/slovak"},{"name":"Slovenian","url":"/datasets/language/slovenian"},{"name":"Swedish","url":"/datasets/language/swedish"},{"name":"Tagalog","url":"/datasets/language/tagalog"},{"name":"Tamil","url":"/datasets/language/tamil"},{"name":"Telugu","url":"/datasets/language/telugu"},{"name":"Thai","url":"/datasets/language/thai"},{"name":"Turkish","url":"/datasets/language/turkish"},{"name":"Uighur","url":"/datasets/language/uighur"},{"name":"Ukrainian","url":"/datasets/language/ukrainian"},{"name":"Upper Sorbian","url":"/datasets/language/upper-sorbian"},{"name":"Urdu","url":"/datasets/language/urdu"},{"name":"Vietnamese","url":"/datasets/language/vietnamese"},{"name":"Welsh","url":"/datasets/language/welsh"},{"name":"Wolof","url":"/datasets/language/wolof"},{"name":"Yoruba","url":"/datasets/language/yoruba"},{"name":"Afar","url":"/datasets/language/afar"},{"name":"Abkhazian","url":"/datasets/language/abkhazian"},{"name":"Achinese","url":"/datasets/language/achinese"},{"name":"Adyghe","url":"/datasets/language/adyghe"},{"name":"Akan","url":"/datasets/language/akan"},{"name":"Tosk Albanian","url":"/datasets/language/tosk-albanian"},{"name":"Old English (ca. 450-1100)","url":"/datasets/language/old-english-ca-450-1100"},{"name":"Official Aramaic (700-300 BCE)","url":"/datasets/language/official-aramaic-700-300-bce"},{"name":"Aragonese","url":"/datasets/language/aragonese"},{"name":"Egyptian Arabic","url":"/datasets/language/egyptian-arabic"},{"name":"Assamese","url":"/datasets/language/assamese"},{"name":"Asturian","url":"/datasets/language/asturian"},{"name":"Avaric","url":"/datasets/language/avaric"},{"name":"Aymara","url":"/datasets/language/aymara"},{"name":"South Azerbaijani","url":"/datasets/language/south-azerbaijani"},{"name":"Azerbaijani","url":"/datasets/language/azerbaijani"},{"name":"Bashkir","url":"/datasets/language/bashkir"},{"name":"Bavarian","url":"/datasets/language/bavarian"},{"name":"Central Bikol","url":"/datasets/language/central-bikol"},{"name":"Bislama","url":"/datasets/language/bislama"},{"name":"Banjar","url":"/datasets/language/banjar"},{"name":"Tibetan","url":"/datasets/language/tibetan"},{"name":"Bosnian","url":"/datasets/language/bosnian"},{"name":"Bishnupriya","url":"/datasets/language/bishnupriya"},{"name":"Buginese","url":"/datasets/language/buginese"},{"name":"Min Dong Chinese","url":"/datasets/language/min-dong-chinese"},{"name":"Cebuano","url":"/datasets/language/cebuano"},{"name":"Chamorro","url":"/datasets/language/chamorro"},{"name":"Chechen","url":"/datasets/language/chechen"},{"name":"Choctaw","url":"/datasets/language/choctaw"},{"name":"Cherokee","url":"/datasets/language/cherokee"},{"name":"Chuvash","url":"/datasets/language/chuvash"},{"name":"Cheyenne","url":"/datasets/language/cheyenne"},{"name":"Central Kurdish","url":"/datasets/language/central-kurdish"},{"name":"Cornish","url":"/datasets/language/cornish"},{"name":"Corsican","url":"/datasets/language/corsican"},{"name":"Cree","url":"/datasets/language/cree"},{"name":"Crimean Tatar","url":"/datasets/language/crimean-tatar"},{"name":"Kashubian","url":"/datasets/language/kashubian"},{"name":"Dimli (individual language)","url":"/datasets/language/dimli-individual-language"},{"name":"Dhivehi","url":"/datasets/language/dhivehi"},{"name":"Lower Sorbian","url":"/datasets/language/lower-sorbian"},{"name":"Dzongkha","url":"/datasets/language/dzongkha"},{"name":"Modern Greek (1453-)","url":"/datasets/language/modern-greek-1453"},{"name":"Esperanto","url":"/datasets/language/esperanto"},{"name":"Ewe","url":"/datasets/language/ewe"},{"name":"Extremaduran","url":"/datasets/language/extremaduran"},{"name":"Fijian","url":"/datasets/language/fijian"},{"name":"Arpitan","url":"/datasets/language/arpitan"},{"name":"Northern Frisian","url":"/datasets/language/northern-frisian"},{"name":"Western Frisian","url":"/datasets/language/western-frisian"},{"name":"Fulah","url":"/datasets/language/fulah"},{"name":"Friulian","url":"/datasets/language/friulian"},{"name":"Gagauz","url":"/datasets/language/gagauz"},{"name":"Gan Chinese","url":"/datasets/language/gan-chinese"},{"name":"Gilaki","url":"/datasets/language/gilaki"},{"name":"Goan Konkani","url":"/datasets/language/goan-konkani"},{"name":"Guarani","url":"/datasets/language/guarani"},{"name":"Gujarati","url":"/datasets/language/gujarati"},{"name":"Hakka Chinese","url":"/datasets/language/hakka-chinese"},{"name":"Haitian","url":"/datasets/language/haitian"},{"name":"Hausa","url":"/datasets/language/hausa"},{"name":"Hawaiian","url":"/datasets/language/hawaiian"},{"name":"Serbo-Croatian","url":"/datasets/language/serbo-croatian"},{"name":"Herero","url":"/datasets/language/herero"},{"name":"Fiji Hindi","url":"/datasets/language/fiji-hindi"},{"name":"Hiri Motu","url":"/datasets/language/hiri-motu"},{"name":"Igbo","url":"/datasets/language/igbo"},{"name":"Ido","url":"/datasets/language/ido"},{"name":"Sichuan Yi","url":"/datasets/language/sichuan-yi"},{"name":"Inuktitut","url":"/datasets/language/inuktitut"},{"name":"Interlingue","url":"/datasets/language/interlingue"},{"name":"Iloko","url":"/datasets/language/iloko"},{"name":"Interlingua (International Auxiliary Language Association)","url":"/datasets/language/interlingua-international-auxiliary-language-association"},{"name":"Inupiaq","url":"/datasets/language/inupiaq"},{"name":"Jamaican Creole English","url":"/datasets/language/jamaican-creole-english"},{"name":"Javanese","url":"/datasets/language/javanese"},{"name":"Lojban","url":"/datasets/language/lojban"},{"name":"Kara-Kalpak","url":"/datasets/language/kara-kalpak"},{"name":"Kabyle","url":"/datasets/language/kabyle"},{"name":"Kalaallisut","url":"/datasets/language/kalaallisut"},{"name":"Kannada","url":"/datasets/language/kannada"},{"name":"Kashmiri","url":"/datasets/language/kashmiri"},{"name":"Georgian","url":"/datasets/language/georgian"},{"name":"Kanuri","url":"/datasets/language/kanuri"},{"name":"Kabardian","url":"/datasets/language/kabardian"},{"name":"Central Khmer","url":"/datasets/language/central-khmer"},{"name":"Kikuyu","url":"/datasets/language/kikuyu"},{"name":"Kinyarwanda","url":"/datasets/language/kinyarwanda"},{"name":"Kirghiz","url":"/datasets/language/kirghiz"},{"name":"Komi","url":"/datasets/language/komi"},{"name":"Kongo","url":"/datasets/language/kongo"},{"name":"Karachay-Balkar","url":"/datasets/language/karachay-balkar"},{"name":"Kölsch","url":"/datasets/language/k-lsch"},{"name":"Kuanyama","url":"/datasets/language/kuanyama"},{"name":"Kurdish","url":"/datasets/language/kurdish"},{"name":"Ladino","url":"/datasets/language/ladino"},{"name":"Lao","url":"/datasets/language/lao"},{"name":"Lak","url":"/datasets/language/lak"},{"name":"Lezghian","url":"/datasets/language/lezghian"},{"name":"Ligurian","url":"/datasets/language/ligurian"},{"name":"Limburgan","url":"/datasets/language/limburgan"},{"name":"Lingala","url":"/datasets/language/lingala"},{"name":"Lombard","url":"/datasets/language/lombard"},{"name":"Northern Luri","url":"/datasets/language/northern-luri"},{"name":"Latgalian","url":"/datasets/language/latgalian"},{"name":"Luxembourgish","url":"/datasets/language/luxembourgish"},{"name":"Ganda","url":"/datasets/language/ganda"},{"name":"Marshallese","url":"/datasets/language/marshallese"},{"name":"Maithili","url":"/datasets/language/maithili"},{"name":"Malayalam","url":"/datasets/language/malayalam"},{"name":"Eastern Mari","url":"/datasets/language/eastern-mari"},{"name":"Minangkabau","url":"/datasets/language/minangkabau"},{"name":"Macedonian","url":"/datasets/language/macedonian"},{"name":"Malagasy","url":"/datasets/language/malagasy"},{"name":"Mongolian","url":"/datasets/language/mongolian"},{"name":"Maori","url":"/datasets/language/maori"},{"name":"Western Mari","url":"/datasets/language/western-mari"},{"name":"Malay (macrolanguage)","url":"/datasets/language/malay-macrolanguage"},{"name":"Creek","url":"/datasets/language/creek"},{"name":"Mirandese","url":"/datasets/language/mirandese"},{"name":"Burmese","url":"/datasets/language/burmese"},{"name":"Mazanderani","url":"/datasets/language/mazanderani"},{"name":"Neapolitan","url":"/datasets/language/neapolitan"},{"name":"Nauru","url":"/datasets/language/nauru"},{"name":"Navajo","url":"/datasets/language/navajo"},{"name":"Ndonga","url":"/datasets/language/ndonga"},{"name":"Low German","url":"/datasets/language/low-german"},{"name":"Nepali (macrolanguage)","url":"/datasets/language/nepali-macrolanguage"},{"name":"Newari","url":"/datasets/language/newari"},{"name":"Norwegian Nynorsk","url":"/datasets/language/norwegian-nynorsk"},{"name":"Novial","url":"/datasets/language/novial"},{"name":"Narom","url":"/datasets/language/narom"},{"name":"Pedi","url":"/datasets/language/pedi"},{"name":"Nyanja","url":"/datasets/language/nyanja"},{"name":"Occitan (post 1500)","url":"/datasets/language/occitan-post-1500"},{"name":"Oriya (macrolanguage)","url":"/datasets/language/oriya-macrolanguage"},{"name":"Oromo","url":"/datasets/language/oromo"},{"name":"Ossetian","url":"/datasets/language/ossetian"},{"name":"Pangasinan","url":"/datasets/language/pangasinan"},{"name":"Pampanga","url":"/datasets/language/pampanga"},{"name":"Papiamento","url":"/datasets/language/papiamento"},{"name":"Picard","url":"/datasets/language/picard"},{"name":"Pennsylvania German","url":"/datasets/language/pennsylvania-german"},{"name":"Pfaelzisch","url":"/datasets/language/pfaelzisch"},{"name":"Pitcairn-Norfolk","url":"/datasets/language/pitcairn-norfolk"},{"name":"Pali","url":"/datasets/language/pali"},{"name":"Piemontese","url":"/datasets/language/piemontese"},{"name":"Western Panjabi","url":"/datasets/language/western-panjabi"},{"name":"Pontic","url":"/datasets/language/pontic"},{"name":"Pushto","url":"/datasets/language/pushto"},{"name":"Quechua","url":"/datasets/language/quechua"},{"name":"Vlax Romani","url":"/datasets/language/vlax-romani"},{"name":"Romansh","url":"/datasets/language/romansh"},{"name":"Rusyn","url":"/datasets/language/rusyn"},{"name":"Rundi","url":"/datasets/language/rundi"},{"name":"Sango","url":"/datasets/language/sango"},{"name":"Yakut","url":"/datasets/language/yakut"},{"name":"Sicilian","url":"/datasets/language/sicilian"},{"name":"Scots","url":"/datasets/language/scots"},{"name":"Sinhala","url":"/datasets/language/sinhala"},{"name":"Samoan","url":"/datasets/language/samoan"},{"name":"Shona","url":"/datasets/language/shona"},{"name":"Sindhi","url":"/datasets/language/sindhi"},{"name":"Somali","url":"/datasets/language/somali"},{"name":"Southern Sotho","url":"/datasets/language/southern-sotho"},{"name":"Sardinian","url":"/datasets/language/sardinian"},{"name":"Sranan Tongo","url":"/datasets/language/sranan-tongo"},{"name":"Swati","url":"/datasets/language/swati"},{"name":"Saterfriesisch","url":"/datasets/language/saterfriesisch"},{"name":"Sundanese","url":"/datasets/language/sundanese"},{"name":"Swahili (macrolanguage)","url":"/datasets/language/swahili-macrolanguage"},{"name":"Silesian","url":"/datasets/language/silesian"},{"name":"Tahitian","url":"/datasets/language/tahitian"},{"name":"Tatar","url":"/datasets/language/tatar"},{"name":"Tulu","url":"/datasets/language/tulu"},{"name":"Tetum","url":"/datasets/language/tetum"},{"name":"Tajik","url":"/datasets/language/tajik"},{"name":"Tigrinya","url":"/datasets/language/tigrinya"},{"name":"Tonga (Tonga Islands)","url":"/datasets/language/tonga-tonga-islands"},{"name":"Tok Pisin","url":"/datasets/language/tok-pisin"},{"name":"Tswana","url":"/datasets/language/tswana"},{"name":"Tsonga","url":"/datasets/language/tsonga"},{"name":"Turkmen","url":"/datasets/language/turkmen"},{"name":"Tumbuka","url":"/datasets/language/tumbuka"},{"name":"Twi","url":"/datasets/language/twi"},{"name":"Tuvinian","url":"/datasets/language/tuvinian"},{"name":"Udmurt","url":"/datasets/language/udmurt"},{"name":"Uzbek","url":"/datasets/language/uzbek"},{"name":"Venetian","url":"/datasets/language/venetian"},{"name":"Venda","url":"/datasets/language/venda"},{"name":"Veps","url":"/datasets/language/veps"},{"name":"Vlaams","url":"/datasets/language/vlaams"},{"name":"Volapük","url":"/datasets/language/volap-k"},{"name":"Waray (Philippines)","url":"/datasets/language/waray-philippines"},{"name":"Walloon","url":"/datasets/language/walloon"},{"name":"Wu Chinese","url":"/datasets/language/wu-chinese"},{"name":"Kalmyk","url":"/datasets/language/kalmyk"},{"name":"Xhosa","url":"/datasets/language/xhosa"},{"name":"Mingrelian","url":"/datasets/language/mingrelian"},{"name":"Yiddish","url":"/datasets/language/yiddish"},{"name":"Zeeuws","url":"/datasets/language/zeeuws"},{"name":"Zhuang","url":"/datasets/language/zhuang"},{"name":"Zulu","url":"/datasets/language/zulu"}],"variants":["Wikiann","WikiANN","WikiAnn NER","wikiann sk","HiNER Collapsed","HiNER Original","WikiAnn (Maltese)","WikiAnn (en, ko, es, pt)"],"data_loaders":[{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/unimelb-nlp/wikiann","frameworks":["tf","pytorch","jax"]},{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/cfilt/HiNER-original","frameworks":["tf","pytorch","jax"]},{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/cfilt/HiNER-collapsed","frameworks":["tf","pytorch","jax"]},{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/wikiann","frameworks":["tf","pytorch","jax"]},{"repo":"https://github.com/tensorflow/datasets","url":"https://www.tensorflow.org/datasets/catalog/wikiann","frameworks":["tf","jax"]}],"num_papers_in_archive":72,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[{"leaderboard":"/sota/cross-lingual-ner-on-wikiann-ner","task":"Cross-Lingual NER","dataset_variant":"WikiAnn NER","rows":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"ByT5 XXL","paper":"/paper/byt5-towards-a-token-free-future-with-pre","metrics":{"F1":"67.7"},"code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers/tree/master/src/transformers/models/byt5"},{"title":"google-research/byt5","url":"https://github.com/google-research/byt5"},{"title":"ufal/multilexnorm2021","url":"https://github.com/ufal/multilexnorm2021"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/byt5"},{"title":"yoreG123/Paddle-ByT5","url":"https://github.com/yoreG123/Paddle-ByT5"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/uie-on-wikiann","task":"UIE","dataset_variant":"WikiANN","rows":1,"metrics":["F1 score"],"first_row_in_archive_order":{"model":"KnowCoder-7b-IE","paper":"/paper/knowcoder-coding-structured-knowledge-into","metrics":{"F1 score":"87.0"},"code_links":[{"title":"ICT-GoKnow/KnowCoder","url":"https://github.com/ICT-GoKnow/KnowCoder"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/token-classification-on-wikiann","task":"Token Classification","dataset_variant":"Wikiann","rows":0,"metrics":["Accuracy","F1","Precision","Recall"],"first_row_in_archive_order":null,"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"},{"leaderboard":"/sota/token-classification-on-wikiann-sk-1","task":"Token Classification","dataset_variant":"wikiann sk","rows":0,"metrics":["Accuracy","F1","Precision","Recall"],"first_row_in_archive_order":null,"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"}],"papers_with_a_benchmark_row":[{"paper":"/paper/knowcoder-coding-structured-knowledge-into","title":"KnowCoder: Coding Structured Knowledge into LLMs for Universal Information Extraction","date":"2024-03-12","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/byt5-towards-a-token-free-future-with-pre","title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","date":"2021-05-28","rows_on_this_dataset":1,"code_links":5,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":6,"samples_ran":0,"samples_unverified":6,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}}],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":1,"samples_harvested":6,"samples_ran":0,"samples_unverified":6,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":1,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}