{"url":"/dataset/petci","name":"PETCI","full_name":"PETCI: A Parallel English Translation Dataset of Chinese Idioms","description_markdown":"PETCI is a Parallel English Translation dataset of Chinese Idioms, collected from an idiom dictionary and Google and DeepL translation. PETCI contains 4,310 Chinese idioms with 29,936 English translations. These translations capture diverse translation errors and paraphrase strategies.","description_withheld":null,"homepage":"https://github.com/kt2k01/petci","introduced_date":"2022-02-19","introduced_date_note":null,"introduced_by":{"paper":"/paper/petci-a-parallel-english-translation-dataset","title":"PETCI: A Parallel English Translation Dataset of Chinese Idioms","first_author":"Kenan Tang","url":null},"license":{"name":"Apache-2.0","url":"https://github.com/kt2k01/petci/blob/main/LICENSE"},"modalities":[{"name":"Texts","url":"/datasets/modality/texts"}],"tasks":[{"name":"Machine Translation","url":"/task/machine-translation","datasets_with_task":"/datasets/task/machine-translation"},{"name":"Translation","url":"/task/translation","datasets_with_task":"/datasets/task/translation"}],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"Chinese","url":"/datasets/language/chinese"}],"variants":["PETCI"],"data_loaders":[],"num_papers_in_archive":2,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}