{"url":"/dataset/multisum","name":"MultiSum","full_name":null,"description_markdown":"**MultiSum** is a dataset for multimodal summarization (MSMO). It consists of 17 categories and 170 subcategories to encapsulate a diverse array of real-world scenarios. The dataset features:\r\n\r\n1)Human-validated summaries for both video and textual content, providing superior human instruction and labels for multimodal learning. \r\n\r\n2) Comprehensively and meticulously arranged categorization, spanning 17 principal categories and 170 subcategories to encapsulate a diverse array of real-world scenarios. \r\n\r\n3) Benchmark tests performed on the proposed dataset to assess varied tasks and methods, including video temporal segmentation, video summarization, text summarization, and multimodal summarization.\r\n\r\nSource: [MultiSum: A Dataset for Multimodal Summarization and Thumbnail Generation of Videos](https://arxiv.org/pdf/2306.04216v1.pdf)\r\n\r\nImage Source: [MultiSum: A Dataset for Multimodal Summarization and Thumbnail Generation of Videos](https://arxiv.org/pdf/2306.04216v1.pdf)","description_withheld":null,"homepage":"https://multisum-dataset.github.io/","introduced_date":"2023-06-07","introduced_date_note":null,"introduced_by":{"paper":"/paper/multisum-a-dataset-for-multimodal","title":"MMSum: A Dataset for Multimodal Summarization and Thumbnail Generation of Videos","first_author":"JieLin Qiu","url":null},"license":null,"modalities":[{"name":"Videos","url":"/datasets/modality/videos"},{"name":"Texts","url":"/datasets/modality/texts"}],"tasks":[{"name":"Text Summarization","url":"/task/text-summarization","datasets_with_task":"/datasets/task/text-summarization"},{"name":"Video Summarization","url":"/task/video-summarization","datasets_with_task":"/datasets/task/video-summarization"}],"languages":[],"variants":["MultiSum"],"data_loaders":[],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}