{"url":"/dataset/cmrc-2018","name":"CMRC 2018","full_name":"Chinese Machine Reading Comprehension 2018","description_markdown":"**CMRC 2018** is a dataset for **Chinese Machine Reading Comprehension**. Specifically, it is a span-extraction reading comprehension dataset that is similar to SQuAD.\r\n\r\nSource: [http://ymcui.com/cmrc2018/](http://ymcui.com/cmrc2018/)","description_withheld":null,"homepage":"http://ymcui.com/cmrc2018/","introduced_date":null,"introduced_date_note":null,"introduced_by":{"paper":"/paper/a-span-extraction-dataset-for-chinese-machine","title":"A Span-Extraction Dataset for Chinese Machine Reading Comprehension","first_author":"Yiming Cui","url":null},"license":{"name":"CC BY-SA 4.0","url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode"},"modalities":[{"name":"Texts","url":"/datasets/modality/texts"}],"tasks":[{"name":"Language Modelling","url":"/task/language-modelling","datasets_with_task":"/datasets/task/language-modelling"},{"name":"Reading Comprehension","url":"/task/reading-comprehension","datasets_with_task":"/datasets/task/reading-comprehension"},{"name":"Chinese Reading Comprehension","url":"/task/chinese-reading-comprehension","datasets_with_task":"/datasets/task/chinese-reading-comprehension"},{"name":"Machine Reading Comprehension","url":"/task/machine-reading-comprehension","datasets_with_task":"/datasets/task/machine-reading-comprehension"},{"name":"Reading Comprehension (Zero-Shot)","url":"/task/reading-comprehension-zero-shot","datasets_with_task":"/datasets/task/reading-comprehension-zero-shot"},{"name":"Reading Comprehension (One-Shot)","url":"/task/reading-comprehension-one-shot","datasets_with_task":"/datasets/task/reading-comprehension-one-shot"},{"name":"Reading Comprehension (Few-Shot)","url":"/task/reading-comprehension-few-shot","datasets_with_task":"/datasets/task/reading-comprehension-few-shot"}],"languages":[{"name":"English","url":"/datasets/language/english"}],"variants":["CMRC 2018 (Simplified Chinese) Dev","CMRC 2018 (Simplified Chinese)","CMRC 2018 (Simplified Chinese) Challenge","CMRC 2018","CMRC 2018 (Chinese Machine Reading Comprehension 2018)"],"data_loaders":[{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/hfl/cmrc2018","frameworks":["tf","pytorch","jax"]},{"repo":"https://github.com/huggingface/datasets","url":"https://huggingface.co/datasets/cmrc2018","frameworks":["tf","pytorch","jax"]}],"num_papers_in_archive":49,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}