{"url":"/dataset/opendebateevidence","name":"OpenDebateEvidence","full_name":null,"description_markdown":"We introduce OpenDebateEvidence, a comprehensive dataset for argument mining\r\nand summarization sourced from the American Competitive Debate community.\r\nThis dataset includes over 3.5 million documents with rich metadata, making it\r\none of the most extensive collections of debate evidence. OpenDebateEvidence\r\ncaptures the complexity of arguments in high school and college debates, pro-\r\nviding valuable resources for training and evaluation. Our extensive experiments\r\ndemonstrate the efficacy of fine-tuning state-of-the-art large language models for\r\nargumentative abstractive summarization across various methods, models, and\r\ndatasets. By providing this comprehensive resource, we aim to advance com-\r\nputational argumentation and support practical applications for debaters, edu-\r\ncators, and researchers. OpenDebateEvidence is publicly available to support\r\nfurther research and innovation in computational argumentation. Access it here:\r\nhttps://huggingface.co/datasets/Yusuf5/OpenCaselist","description_withheld":null,"homepage":"https://huggingface.co/datasets/Yusuf5/OpenCaselist","introduced_date":"2024-06-20","introduced_date_note":null,"introduced_by":{"paper":"/paper/opendebateevidence-a-massive-scale-argument","title":"OpenDebateEvidence: A Massive-Scale Argument Mining and Summarization Dataset","first_author":"Allen Roush","url":null},"license":{"name":"MIT","url":null},"modalities":[{"name":"Texts","url":"/datasets/modality/texts"}],"tasks":[{"name":"Text Generation","url":"/task/text-generation","datasets_with_task":"/datasets/task/text-generation"},{"name":"Text Summarization","url":"/task/text-summarization","datasets_with_task":"/datasets/task/text-summarization"},{"name":"Information Retrieval","url":"/task/information-retrieval","datasets_with_task":"/datasets/task/information-retrieval"},{"name":"Abstractive Text Summarization","url":"/task/abstractive-text-summarization","datasets_with_task":"/datasets/task/abstractive-text-summarization"},{"name":"Argument Mining","url":"/task/argument-mining","datasets_with_task":"/datasets/task/argument-mining"},{"name":"Extractive Summarization","url":"/task/extractive-summarization","datasets_with_task":"/datasets/task/extractive-summarization"}],"languages":[{"name":"English","url":"/datasets/language/english"}],"variants":["OpenDebateEvidence"],"data_loaders":[],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}