{"url":"/task/extreme-summarization","name":"Extreme Summarization","slug":"extreme-summarization","description_markdown":"Image credit: [TLDR: Extreme Summarization of Scientific Documents](https://arxiv.org/pdf/2004.15011v3.pdf)","categories":[{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":22,"papers_with_code":13,"benchmarks":4,"benchmark_tables_in_archive":4,"benchmark_tables_shown":4,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":7,"subtasks":0,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/extreme-summarization-on-citesum","slug":"extreme-summarization-on-citesum","dataset":"CiteSum","dataset_url":"/dataset/citesum","rows_in_archive":9,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"EXT-ORACLE","paper_title":"CiteSum: Citation Text-guided Scientific Extreme Summarization and Domain Adaptation with Limited Supervision","paper_url":"/paper/citesum-citation-text-guided-scientific","paper_date":"2022-05-12","arxiv_id":"2205.06207","code_links":[{"title":"morningmoni/citesum","url":"https://github.com/morningmoni/citesum"}],"syntology":null}},{"leaderboard":"/sota/extreme-summarization-on-gem-xsum","slug":"extreme-summarization-on-gem-xsum","dataset":"GEM-XSum","dataset_url":"/dataset/gem","rows_in_archive":6,"metrics":["ROUGE-2","BLEU score","Parameters"],"first_row_in_archive_order":{"model":"PEGASUS","paper_title":"The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics","paper_url":"/paper/the-gem-benchmark-natural-language-generation","paper_date":"2021-02-02","arxiv_id":"2102.01672","code_links":[],"syntology":null}},{"leaderboard":"/sota/extreme-summarization-on-tldr9","slug":"extreme-summarization-on-tldr9","dataset":"TLDR9+","dataset_url":"/dataset/tldr9","rows_in_archive":4,"metrics":["RG-1(%)","RG-2(%)","RG-L(%)"],"first_row_in_archive_order":{"model":"ORACLE-EXT","paper_title":"TLDR9+: A Large Scale Resource for Extreme Summarization of Social Media Posts","paper_url":"/paper/tldr9-a-large-scale-resource-for-extreme","paper_date":"2021-10-04","arxiv_id":"2110.01159","code_links":[{"title":"sajastu/reddit_collector","url":"https://github.com/sajastu/reddit_collector"}],"syntology":null}},{"leaderboard":"/sota/extreme-summarization-on-xsum","slug":"extreme-summarization-on-xsum","dataset":"XSum","dataset_url":"/dataset/xsum","rows_in_archive":1,"metrics":["METEOR"],"first_row_in_archive_order":{"model":"PEGASUS","paper_title":"The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics","paper_url":"/paper/the-gem-benchmark-natural-language-generation","paper_date":"2021-02-02","arxiv_id":"2102.01672","code_links":[],"syntology":null}}],"datasets":[{"url":"/dataset/gem","name":"GEM","full_name":"Generation, Evaluation, and Metrics","num_papers_in_archive":45},{"url":"/dataset/xsum","name":"XSum","full_name":null,"num_papers_in_archive":32},{"url":"/dataset/scitldr","name":"SciTLDR","full_name":"","num_papers_in_archive":13},{"url":"/dataset/citesum","name":"CiteSum","full_name":"","num_papers_in_archive":4},{"url":"/dataset/elsevier-oa-cc-by","name":"Elsevier OA CC-BY","full_name":"","num_papers_in_archive":2},{"url":"/dataset/tldr9","name":"TLDR9+","full_name":"","num_papers_in_archive":2},{"url":"/dataset/summzoo","name":"SummZoo","full_name":"","num_papers_in_archive":1}],"subtasks":[],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":13,"of":13,"tagged_in_all":22,"items":[{"url":"/paper/byt5-towards-a-token-free-future-with-pre","title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","date":"2021-05-28","arxiv_id":"2105.13626","repositories_listed":5,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/a-convolutional-attention-network-for-extreme","title":"A Convolutional Attention Network for Extreme Summarization of Source Code","date":"2016-02-09","arxiv_id":"1602.03001","repositories_listed":5,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/tldr-extreme-summarization-of-scientific","title":"TLDR: Extreme Summarization of Scientific Documents","date":"2020-04-30","arxiv_id":"2004.15011","repositories_listed":4,"syntology":{"n":19,"n_ran":12,"n_unverified":7,"n_pointer_only":4}},{"url":"/paper/indicbart-a-pre-trained-model-for-natural","title":"IndicBART: A Pre-trained Model for Indic Natural Language Generation","date":"2021-09-07","arxiv_id":"2109.02903","repositories_listed":3,"syntology":null},{"url":"/paper/dont-give-me-the-details-just-the-summary","title":"Don't Give Me the Details, Just the Summary! Topic-Aware Convolutional Neural Networks for Extreme Summarization","date":"2018-08-27","arxiv_id":"1808.08745","repositories_listed":3,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/apex-2-adaptive-and-extreme-summarization-for","title":"APEX$^2$: Adaptive and Extreme Summarization for Personalized Knowledge Graphs","date":"2024-12-23","arxiv_id":"2412.17336","repositories_listed":1,"syntology":{"n":15,"n_ran":0,"n_unverified":15,"n_pointer_only":0}},{"url":"/paper/rouge-k-do-your-summaries-have-keywords","title":"ROUGE-K: Do Your Summaries Have Keywords?","date":"2024-03-08","arxiv_id":"2403.05186","repositories_listed":1,"syntology":null},{"url":"/paper/wikides-a-wikipedia-based-dataset-for","title":"WikiDes: A Wikipedia-Based Dataset for Generating Short Descriptions from Paragraphs","date":"2022-09-27","arxiv_id":"2209.13101","repositories_listed":1,"syntology":null},{"url":"/paper/x-scitldr-cross-lingual-extreme-summarization","title":"X-SCITLDR: Cross-Lingual Extreme Summarization of Scholarly Documents","date":"2022-05-30","arxiv_id":"2205.15051","repositories_listed":1,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/citesum-citation-text-guided-scientific","title":"CiteSum: Citation Text-guided Scientific Extreme Summarization and Domain Adaptation with Limited Supervision","date":"2022-05-12","arxiv_id":"2205.06207","repositories_listed":1,"syntology":null},{"url":"/paper/tldr9-a-large-scale-resource-for-extreme","title":"TLDR9+: A Large Scale Resource for Extreme Summarization of Social Media Posts","date":"2021-10-04","arxiv_id":"2110.01159","repositories_listed":1,"syntology":null},{"url":"/paper/multi-xscience-a-large-scale-dataset-for","title":"Multi-XScience: A Large-scale Dataset for Extreme Multi-document Summarization of Scientific Articles","date":"2020-10-27","arxiv_id":"2010.14235","repositories_listed":1,"syntology":null},{"url":"/paper/what-is-this-article-about-extreme","title":"What is this Article about? Extreme Summarization with Topic-aware Convolutional Neural Networks","date":"2019-07-19","arxiv_id":"1907.08722","repositories_listed":1,"syntology":null}],"syntology_records":6,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}