{"url":"/dataset/covost","name":"CoVoST","full_name":null,"description_markdown":"CoVoST is a large-scale multilingual speech-to-text translation corpus. Its latest 2nd version covers translations from 21 languages into English and from English into 15 languages. It has total 2880 hours of speech and is diversified with 78K speakers and 66 accents.\r\n\r\nSource: [CoVoST 2 and Massively Multilingual Speech-to-Text Translation](/paper/covost-2-a-massively-multilingual-speech-to)","description_withheld":null,"homepage":"https://github.com/facebookresearch/covost","introduced_date":"2020-02-04","introduced_date_note":null,"introduced_by":{"paper":"/paper/covost-a-diverse-multilingual-speech-to-text","title":"CoVoST: A Diverse Multilingual Speech-To-Text Translation Corpus","first_author":"Changhan Wang","url":null},"license":{"name":"CC0","url":"https://creativecommons.org/share-your-work/public-domain/cc0/"},"modalities":[{"name":"Texts","url":"/datasets/modality/texts"},{"name":"Audio","url":"/datasets/modality/audio"},{"name":"Speech","url":"/datasets/modality/speech"}],"tasks":[{"name":"Speech Recognition","url":"/task/speech-recognition","datasets_with_task":"/datasets/task/speech-recognition"},{"name":"Cross-Lingual Transfer","url":"/task/cross-lingual-transfer","datasets_with_task":"/datasets/task/cross-lingual-transfer"},{"name":"Speech-to-Text Translation","url":"/task/speech-to-text-translation","datasets_with_task":"/datasets/task/speech-to-text-translation"},{"name":"automatic-speech-translation","url":"/task/automatic-speech-translation","datasets_with_task":"/datasets/task/automatic-speech-translation"}],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"French","url":"/datasets/language/french"},{"name":"Spanish","url":"/datasets/language/spanish"},{"name":"German","url":"/datasets/language/german"},{"name":"Italian","url":"/datasets/language/italian"},{"name":"Chinese","url":"/datasets/language/chinese"},{"name":"Japanese","url":"/datasets/language/japanese"},{"name":"Russian","url":"/datasets/language/russian"},{"name":"Portuguese","url":"/datasets/language/portuguese"},{"name":"Arabic","url":"/datasets/language/arabic"},{"name":"Catalan","url":"/datasets/language/catalan"},{"name":"Dutch","url":"/datasets/language/dutch"},{"name":"Estonian","url":"/datasets/language/estonian"},{"name":"Indonesian","url":"/datasets/language/indonesian"},{"name":"Latvian","url":"/datasets/language/latvian"},{"name":"Persian","url":"/datasets/language/persian"},{"name":"Slovenian","url":"/datasets/language/slovenian"},{"name":"Swedish","url":"/datasets/language/swedish"},{"name":"Tamil","url":"/datasets/language/tamil"},{"name":"Turkish","url":"/datasets/language/turkish"},{"name":"Welsh","url":"/datasets/language/welsh"},{"name":"Mongolian","url":"/datasets/language/mongolian"}],"variants":["CoVoST"],"data_loaders":[{"repo":"https://github.com/facebookresearch/covost","url":"https://github.com/facebookresearch/covost","frameworks":["pytorch"]}],"num_papers_in_archive":34,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}