{"url":"/dataset/mint","name":"Mint","full_name":"Multilingual Intimacy analysis","description_markdown":"**Mint** is a new Multilingual intimacy analysis dataset covering 13,384 tweets in 10 languages including English, French, Spanish, Italian, Portuguese, Korean, Dutch, Chinese, Hindi, and Arabic. The dataset is released along with the SemEval 2023 Task 9: Multilingual Tweet Intimacy Analysis.","description_withheld":null,"homepage":"https://sites.google.com/umich.edu/semeval-2023-tweet-intimacy","introduced_date":"2022-10-03","introduced_date_note":null,"introduced_by":{"paper":"/paper/semeval-2023-task-9-multilingual-tweet","title":"SemEval 2023 Task 9: Multilingual Tweet Intimacy Analysis","first_author":"Jiaxin Pei","url":null},"license":null,"modalities":[{"name":"Texts","url":"/datasets/modality/texts"}],"tasks":[],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"French","url":"/datasets/language/french"},{"name":"Spanish","url":"/datasets/language/spanish"},{"name":"Italian","url":"/datasets/language/italian"},{"name":"Chinese","url":"/datasets/language/chinese"},{"name":"Portuguese","url":"/datasets/language/portuguese"},{"name":"Arabic","url":"/datasets/language/arabic"},{"name":"Dutch","url":"/datasets/language/dutch"},{"name":"Hindi","url":"/datasets/language/hindi"},{"name":"Korean","url":"/datasets/language/korean"}],"variants":["Mint"],"data_loaders":[],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}