{"url":"/task/text-summarization","name":"Text Summarization","slug":"text-summarization","description_markdown":"**Text Summarization** is a natural language processing (NLP) task that involves condensing a lengthy text document into a shorter, more compact version while still retaining the most important information and meaning. The goal is to produce a summary that accurately represents the content of the original text in a concise form. \r\n\r\nThere are different approaches to text summarization, including extractive methods that identify and extract important sentences or phrases from the text, and abstractive methods that generate new text based on the content of the original text.","categories":[{"name":"Knowledge Base","url":"/area/knowledge-base"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":1340,"papers_with_code":440,"benchmarks":37,"benchmark_tables_in_archive":37,"benchmark_tables_shown":37,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":98,"subtasks":12,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/text-summarization-on-gigaword","slug":"text-summarization-on-gigaword","dataset":"GigaWord","dataset_url":null,"rows_in_archive":41,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"OpenAI/o3-mini","paper_title":null,"paper_url":null,"paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-pubmed-1","slug":"text-summarization-on-pubmed-1","dataset":"Pubmed","dataset_url":"/dataset/pubmed","rows_in_archive":29,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"Top Down Transformer (AdaPool) (464M)","paper_title":"Long Document Summarization with Top-down and Bottom-up Inference","paper_url":"/paper/long-document-summarization-with-top-down-and-1","paper_date":"2022-03-15","arxiv_id":"2203.07586","code_links":[{"title":"lllyasviel/framepack","url":"https://github.com/lllyasviel/framepack"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-arxiv","slug":"text-summarization-on-arxiv","dataset":"Arxiv HEP-TH citation graph","dataset_url":"/dataset/arxiv","rows_in_archive":28,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"Top Down Transformer (AdaPool) (464M)","paper_title":"Long Document Summarization with Top-down and Bottom-up Inference","paper_url":"/paper/long-document-summarization-with-top-down-and-1","paper_date":"2022-03-15","arxiv_id":"2203.07586","code_links":[{"title":"lllyasviel/framepack","url":"https://github.com/lllyasviel/framepack"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-mteb","slug":"text-summarization-on-mteb","dataset":"MTEB","dataset_url":"/dataset/mteb","rows_in_archive":26,"metrics":["Spearman Correlation"],"first_row_in_archive_order":{"model":"MPNet-multilingual","paper_title":"MTEB: Massive Text Embedding Benchmark","paper_url":"/paper/mteb-massive-text-embedding-benchmark","paper_date":"2022-10-13","arxiv_id":"2210.07316","code_links":[{"title":"embeddings-benchmark/mteb","url":"https://github.com/embeddings-benchmark/mteb"},{"title":"lyon-nlp/mteb-french","url":"https://github.com/lyon-nlp/mteb-french"},{"title":"climsocana/tecb-de","url":"https://github.com/climsocana/tecb-de"},{"title":"wadoodabdul/clinical_ner_benchmark","url":"https://github.com/wadoodabdul/clinical_ner_benchmark"},{"title":"basf/chemteb","url":"https://github.com/basf/chemteb"}],"syntology":{"n":13,"n_ran":3,"n_unverified":10,"n_pointer_only":0}}},{"leaderboard":"/sota/text-summarization-on-x-sum","slug":"text-summarization-on-x-sum","dataset":"X-Sum","dataset_url":"/dataset/xsum","rows_in_archive":18,"metrics":["ROUGE-1","ROUGE-2","ROUGE-3","ROUGE-L"],"first_row_in_archive_order":{"model":"Selfmem","paper_title":"Lift Yourself Up: Retrieval-augmented Text Generation with Self Memory","paper_url":"/paper/lift-yourself-up-retrieval-augmented-text","paper_date":"2023-05-03","arxiv_id":"2305.02437","code_links":[{"title":"hannibal046/selfmemory","url":"https://github.com/hannibal046/selfmemory"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/text-summarization-on-cnn-daily-mail-2","slug":"text-summarization-on-cnn-daily-mail-2","dataset":"CNN / Daily Mail (Anonymized)","dataset_url":"/dataset/cnn-daily-mail-1","rows_in_archive":13,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"HSSAS","paper_title":"A Hierarchical Structured Self-Attentive Model for Extractive Document Summarization (HSSAS)","paper_url":"/paper/a-hierarchical-structured-self-attentive","paper_date":"2018-05-20","arxiv_id":"1805.07799","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-duc-2004-task-1","slug":"text-summarization-on-duc-2004-task-1","dataset":"DUC 2004 Task 1","dataset_url":"/dataset/duc-2004","rows_in_archive":13,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"Transformer+WDrop","paper_title":"Rethinking Perturbations in Encoder-Decoders for Fast Training","paper_url":"/paper/rethinking-perturbations-in-encoder-decoders","paper_date":"2021-04-05","arxiv_id":"2104.01853","code_links":[{"title":"takase/rethink_perturbations","url":"https://github.com/takase/rethink_perturbations"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/text-summarization-on-samsum-corpus","slug":"text-summarization-on-samsum-corpus","dataset":"SAMSum","dataset_url":"/dataset/samsum-corpus","rows_in_archive":12,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L","BertScoreF1"],"first_row_in_archive_order":{"model":"OmniVec2","paper_title":"OmniVec2 - A Novel Transformer based Network for Large Scale Multimodal and Multitask Learning","paper_url":"/paper/omnivec2-a-novel-transformer-based-network","paper_date":"2024-01-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-reddit-tifu","slug":"text-summarization-on-reddit-tifu","dataset":"Reddit TIFU","dataset_url":"/dataset/reddit-tifu","rows_in_archive":5,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"PEGASUS 2B + SLiC","paper_title":"Calibrating Sequence likelihood Improves Conditional Language Generation","paper_url":"/paper/calibrating-sequence-likelihood-improves","paper_date":"2022-09-30","arxiv_id":"2210.00045","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-arxiv-summarization","slug":"text-summarization-on-arxiv-summarization","dataset":"arXiv Summarization Dataset","dataset_url":"/dataset/arxiv-summarization-dataset","rows_in_archive":4,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"PRIMER","paper_title":"PRIMERA: Pyramid-based Masked Sentence Pre-training for Multi-document Summarization","paper_url":"/paper/primer-pyramid-based-masked-sentence-pre","paper_date":"2021-10-16","arxiv_id":"2110.08499","code_links":[{"title":"allenai/primer","url":"https://github.com/allenai/primer"},{"title":"allenai/open-mds","url":"https://github.com/allenai/open-mds"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/longformer"}],"syntology":{"n":7,"n_ran":4,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/text-summarization-on-dialogsum","slug":"text-summarization-on-dialogsum","dataset":"DialogSum","dataset_url":"/dataset/dialogsum","rows_in_archive":4,"metrics":["Rouge1","Rouge2","RougeL","BertScore"],"first_row_in_archive_order":{"model":"InstructDS","paper_title":"Instructive Dialogue Summarization with Query Aggregations","paper_url":"/paper/instructive-dialogue-summarization-with-query","paper_date":"2023-10-17","arxiv_id":"2310.10981","code_links":[{"title":"BinWang28/InstructDS","url":"https://github.com/BinWang28/InstructDS"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-klexikon","slug":"text-summarization-on-klexikon","dataset":"Klexikon","dataset_url":"/dataset/klexikon","rows_in_archive":4,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"Luhn's algorithm (25 sentences)","paper_title":"Klexikon: A German Dataset for Joint Summarization and Simplification","paper_url":"/paper/klexikon-a-german-dataset-for-joint","paper_date":"2022-01-18","arxiv_id":"2201.07198","code_links":[{"title":"dennlinger/klexikon","url":"https://github.com/dennlinger/klexikon"},{"title":"dennlinger/summaries","url":"https://github.com/dennlinger/summaries"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-booksum","slug":"text-summarization-on-booksum","dataset":"BookSum","dataset_url":"/dataset/booksum","rows_in_archive":3,"metrics":["ROUGE","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"Echoes-Extractive-Abstractive","paper_title":"Echoes from Alexandria: A Large Resource for Multilingual Book Summarization","paper_url":"/paper/echoes-from-alexandria-a-large-resource-for","paper_date":"2023-06-07","arxiv_id":"2306.04334","code_links":[{"title":"babelscape/echoes-from-alexandria","url":"https://github.com/babelscape/echoes-from-alexandria"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-gigaword-10k","slug":"text-summarization-on-gigaword-10k","dataset":"GigaWord-10k","dataset_url":null,"rows_in_archive":3,"metrics":["ROUGE-L","ROUGE-1","ROUGE-2"],"first_row_in_archive_order":{"model":"ERNIE-GENLARGE (large-scale text corpora)","paper_title":"ERNIE-GEN: An Enhanced Multi-Flow Pre-training and Fine-tuning Framework for Natural Language Generation","paper_url":"/paper/ernie-gen-an-enhanced-multi-flow-pre-training","paper_date":"2020-01-26","arxiv_id":"2001.11314","code_links":[{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/blob/develop/paddlenlp/transformers/ernie_gen/modeling.py"},{"title":"Sharpiless/Versailles-text-generation-with-paddlepaddle","url":"https://github.com/Sharpiless/Versailles-text-generation-with-paddlepaddle"},{"title":"https-github-com-GiangHoang9912/ernie-gen","url":"https://github.com/https-github-com-GiangHoang9912/ernie-gen"},{"title":"MindSpore-scientific/code-12","url":"https://github.com/MindSpore-scientific/code-12/tree/main/FDDE/train-fine"},{"title":"MindCode-4/code-10","url":"https://github.com/MindCode-4/code-10/tree/main/FDDE/train-fine"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-wikihow","slug":"text-summarization-on-wikihow","dataset":"WikiHow","dataset_url":"/dataset/wikihow","rows_in_archive":3,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L","Content F1"],"first_row_in_archive_order":{"model":"BertSum","paper_title":"Abstractive Summarization of Spoken andWritten Instructions with BERT","paper_url":"/paper/abstractive-summarization-of-spoken","paper_date":"2020-08-21","arxiv_id":"2008.09676","code_links":[{"title":"nlpyang/PreSumm","url":"https://github.com/nlpyang/PreSumm"},{"title":"alebryvas/berk266","url":"https://github.com/alebryvas/berk266"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-bigpatent","slug":"text-summarization-on-bigpatent","dataset":"BigPatent","dataset_url":"/dataset/bigpatent","rows_in_archive":2,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"LongT5","paper_title":"LongT5: Efficient Text-To-Text Transformer for Long Sequences","paper_url":"/paper/longt5-efficient-text-to-text-transformer-for","paper_date":"2021-12-15","arxiv_id":"2112.07916","code_links":[{"title":"google-research/longt5","url":"https://github.com/google-research/longt5"},{"title":"utsjiyaoli/qa-attack","url":"https://github.com/utsjiyaoli/qa-attack"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/longt5"},{"title":"MindSpore-scientific-2/code-14","url":"https://github.com/MindSpore-scientific-2/code-14/tree/main/longt5"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/text-summarization-on-govreport","slug":"text-summarization-on-govreport","dataset":"GovReport","dataset_url":"/dataset/govreport","rows_in_archive":2,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"FactorSum","paper_title":"Factorizing Content and Budget Decisions in Abstractive Summarization of Long Documents","paper_url":"/paper/factorizing-content-and-budget-decisions-in","paper_date":"2022-05-25","arxiv_id":"2205.12486","code_links":[{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-how2","slug":"text-summarization-on-how2","dataset":"How2","dataset_url":"/dataset/how2","rows_in_archive":2,"metrics":["Content F1","ROUGE-L","ROUGE-1"],"first_row_in_archive_order":{"model":"Ground-truth transcript + Action with Hierarchical Attn","paper_title":"Multimodal Abstractive Summarization for How2 Videos","paper_url":"/paper/multimodal-abstractive-summarization-for-how2","paper_date":"2019-06-19","arxiv_id":"1906.07901","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-meetingbank","slug":"text-summarization-on-meetingbank","dataset":"MeetingBank","dataset_url":"/dataset/meetingbank","rows_in_archive":2,"metrics":["ROUGE-L","Rouge-1","ROUGE-2"],"first_row_in_archive_order":{"model":"CriSPO 3-shot","paper_title":"CriSPO: Multi-Aspect Critique-Suggestion-guided Automatic Prompt Optimization for Text Generation","paper_url":"/paper/crispo-multi-aspect-critique-suggestion","paper_date":"2024-10-03","arxiv_id":"2410.02748","code_links":[{"title":"amazon-science/crispo","url":"https://github.com/amazon-science/crispo"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-orangesum","slug":"text-summarization-on-orangesum","dataset":"OrangeSum","dataset_url":"/dataset/orangesum","rows_in_archive":2,"metrics":["ROUGE-1"],"first_row_in_archive_order":{"model":"mBARThez (OrangeSum abstract)","paper_title":"BARThez: a Skilled Pretrained French Sequence-to-Sequence Model","paper_url":"/paper/barthez-a-skilled-pretrained-french-sequence","paper_date":"2020-10-23","arxiv_id":"2010.12321","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"moussaKam/BARThez","url":"https://github.com/moussaKam/BARThez"},{"title":"Tixierae/OrangeSum","url":"https://github.com/Tixierae/OrangeSum"},{"title":"moussaKam/OrangeSum","url":"https://github.com/moussaKam/OrangeSum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/barthez"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-aci-bench","slug":"text-summarization-on-aci-bench","dataset":"ACI-Bench","dataset_url":"/dataset/aci-bench","rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"CriSPO 3-shot","paper_title":"CriSPO: Multi-Aspect Critique-Suggestion-guided Automatic Prompt Optimization for Text Generation","paper_url":"/paper/crispo-multi-aspect-critique-suggestion","paper_date":"2024-10-03","arxiv_id":"2410.02748","code_links":[{"title":"amazon-science/crispo","url":"https://github.com/amazon-science/crispo"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-ami","slug":"text-summarization-on-ami","dataset":"AMI","dataset_url":null,"rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"HAT-CNNDM","paper_title":"Hierarchical Learning for Generation with Long Source Sequences","paper_url":"/paper/hierarchical-learning-for-generation-with","paper_date":"2021-04-15","arxiv_id":"2104.07545","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-arxiv-1","slug":"text-summarization-on-arxiv-1","dataset":"arXiv","dataset_url":"/dataset/arxiv-1","rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"BigBird-Pegasus","paper_title":"Big Bird: Transformers for Longer Sequences","paper_url":"/paper/big-bird-transformers-for-longer-sequences","paper_date":"2020-07-28","arxiv_id":"2007.14062","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp/projects/bigbird"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/paddlenlp/transformers/bigbird"},{"title":"facebookresearch/xformers","url":"https://github.com/facebookresearch/xformers"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"monologg/kobigbird","url":"https://github.com/monologg/kobigbird"},{"title":"mim-solutions/bert_for_longer_texts","url":"https://github.com/mim-solutions/bert_for_longer_texts"},{"title":"mim-solutions/roberta_for_longer_texts","url":"https://github.com/mim-solutions/roberta_for_longer_texts"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/big_bird"},{"title":"sergeykramp/mthesis-bigbird-embeddings","url":"https://github.com/sergeykramp/mthesis-bigbird-embeddings"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/big_bird"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/bigbird_pegasus"}],"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}}},{"leaderboard":"/sota/text-summarization-on-bbc-xsum","slug":"text-summarization-on-bbc-xsum","dataset":"BBC XSum","dataset_url":null,"rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"MatchSum","paper_title":"Extractive Summarization as Text Matching","paper_url":"/paper/extractive-summarization-as-text-matching","paper_date":"2020-04-19","arxiv_id":"2004.08795","code_links":[{"title":"maszhongming/MatchSum","url":"https://github.com/maszhongming/MatchSum"},{"title":"HHousen/TransformerSum","url":"https://github.com/HHousen/TransformerSum"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-billsum","slug":"text-summarization-on-billsum","dataset":"BillSum","dataset_url":"/dataset/billsum","rows_in_archive":1,"metrics":["rouge1"],"first_row_in_archive_order":{"model":"Longformer Encoder Decoder","paper_title":"BillSum: A Corpus for Automatic Summarization of US Legislation","paper_url":"/paper/billsum-a-corpus-for-automatic-summarization","paper_date":"2019-10-01","arxiv_id":"1910.00523","code_links":[{"title":"FiscalNote/BillSum","url":"https://github.com/FiscalNote/BillSum"},{"title":"allisontam/bills867","url":"https://github.com/allisontam/bills867"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-cl-scisumm","slug":"text-summarization-on-cl-scisumm","dataset":"CL-SciSumm","dataset_url":"/dataset/cl-scisumm","rows_in_archive":1,"metrics":["ROUGE-2"],"first_row_in_archive_order":{"model":"GCN Hybrid","paper_title":"ScisummNet: A Large Annotated Corpus and Content-Impact Models for Scientific Paper Summarization with Citation Networks","paper_url":"/paper/scisummnet-a-large-annotated-dataset-and","paper_date":"2019-09-04","arxiv_id":"1909.01716","code_links":[{"title":"WING-NUS/scisumm-corpus","url":"https://github.com/WING-NUS/scisumm-corpus"}],"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/text-summarization-on-cord-19","slug":"text-summarization-on-cord-19","dataset":"CORD-19","dataset_url":"/dataset/cord-19","rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"GenCompareSum","paper_title":"GenCompareSum: a hybrid unsupervised summarization method using salience","paper_url":"/paper/gencomparesum-a-hybrid-unsupervised","paper_date":"","arxiv_id":null,"code_links":[{"title":"jbshp/gencomparesum","url":"https://github.com/jbshp/gencomparesum"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-eurekaalert","slug":"text-summarization-on-eurekaalert","dataset":"EurekaAlert","dataset_url":"/dataset/eurekaalert","rows_in_archive":1,"metrics":["Avg. Test Rouge1"],"first_row_in_archive_order":{"model":"SATS","paper_title":"SATS: simplification aware text summarization of scientific documents","paper_url":"/paper/sats-simplification-aware-text-summarization","paper_date":"2024-07-10","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-gazeta","slug":"text-summarization-on-gazeta","dataset":"Gazeta","dataset_url":"/dataset/gazeta","rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L","BLEU","Meteor"],"first_row_in_archive_order":{"model":"Finetuned mBART","paper_title":"Dataset for Automatic Summarization of Russian News","paper_url":"/paper/dataset-for-automatic-summarization-of","paper_date":"2020-06-19","arxiv_id":"2006.11063","code_links":[{"title":"IlyaGusev/summarus","url":"https://github.com/IlyaGusev/summarus"},{"title":"IlyaGusev/gazeta","url":"https://github.com/IlyaGusev/gazeta"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-lcsts","slug":"text-summarization-on-lcsts","dataset":"LCSTS","dataset_url":"/dataset/lcsts","rows_in_archive":1,"metrics":["ROUGE-1"],"first_row_in_archive_order":{"model":"LSTM-seq2seq","paper_title":"LCSTS: A Large Scale Chinese Short Text Summarization Dataset","paper_url":"/paper/lcsts-a-large-scale-chinese-short-text","paper_date":"2015-06-19","arxiv_id":"1506.05865","code_links":[{"title":"CLUEbenchmark/CLGE","url":"https://github.com/CLUEbenchmark/CLGE"},{"title":"CaseyPan/Chinese-Preprocessing","url":"https://github.com/CaseyPan/Chinese-Preprocessing"},{"title":"jessie0624/Automatic-Text-Summarization","url":"https://github.com/jessie0624/Automatic-Text-Summarization"}],"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/text-summarization-on-mediasum","slug":"text-summarization-on-mediasum","dataset":"MediaSum","dataset_url":null,"rows_in_archive":1,"metrics":["ROUGE-1"],"first_row_in_archive_order":{"model":"SRformer-BART","paper_title":"Segmented Recurrent Transformer: An Efficient Sequence-to-Sequence Model","paper_url":"/paper/segmented-recurrent-transformer-an-efficient","paper_date":"2023-05-24","arxiv_id":"2305.16340","code_links":[{"title":"yinghanlong/SRtransformer","url":"https://github.com/yinghanlong/SRtransformer"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-mentsum","slug":"text-summarization-on-mentsum","dataset":"MentSum","dataset_url":"/dataset/mentsum","rows_in_archive":1,"metrics":["Rouge-1","Rouge-2","Rouge-L"],"first_row_in_archive_order":{"model":"BART","paper_title":"MentSum: A Resource for Exploring Summarization of Mental Health Online Posts","paper_url":"/paper/mentsum-a-resource-for-exploring","paper_date":"2022-06-02","arxiv_id":"2206.00856","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-meqsum","slug":"text-summarization-on-meqsum","dataset":"MeQSum","dataset_url":"/dataset/meqsum","rows_in_archive":1,"metrics":["RougeL"],"first_row_in_archive_order":{"model":"BiomedGPT","paper_title":"BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks","paper_url":"/paper/biomedgpt-a-unified-and-generalist-biomedical","paper_date":"2023-05-26","arxiv_id":"2305.17100","code_links":[{"title":"taokz/biomedgpt","url":"https://github.com/taokz/biomedgpt"}],"syntology":{"n":8,"n_ran":1,"n_unverified":7,"n_pointer_only":7}}},{"leaderboard":"/sota/text-summarization-on-qmsum","slug":"text-summarization-on-qmsum","dataset":"QMSum","dataset_url":"/dataset/qmsum","rows_in_archive":1,"metrics":["ROUGE-1"],"first_row_in_archive_order":{"model":"BART-LS","paper_title":"Adapting Pretrained Text-to-Text Models for Long Text Sequences","paper_url":"/paper/adapting-pretrained-text-to-text-models-for","paper_date":"2022-09-21","arxiv_id":"2209.10052","code_links":[{"title":"facebookresearch/bart_ls","url":"https://github.com/facebookresearch/bart_ls"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-s2orc","slug":"text-summarization-on-s2orc","dataset":"S2ORC","dataset_url":"/dataset/s2orc","rows_in_archive":1,"metrics":["ROUGE-1","ROUGE-2","ROUGE-L"],"first_row_in_archive_order":{"model":"GenCompareSum","paper_title":"GenCompareSum: a hybrid unsupervised summarization method using salience","paper_url":"/paper/gencomparesum-a-hybrid-unsupervised","paper_date":"","arxiv_id":null,"code_links":[{"title":"jbshp/gencomparesum","url":"https://github.com/jbshp/gencomparesum"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-webis-snippet-20-corpus","slug":"text-summarization-on-webis-snippet-20-corpus","dataset":"Webis-Snippet-20 Corpus","dataset_url":null,"rows_in_archive":1,"metrics":["Rouge-1","Rouge-2","Rouge-L"],"first_row_in_archive_order":{"model":"Anchor-context + Query biased","paper_title":"Abstractive Snippet Generation","paper_url":"/paper/abstractive-snippet-generation","paper_date":"2020-02-25","arxiv_id":"2002.10782","code_links":[{"title":"webis-de/WWW-20","url":"https://github.com/webis-de/WWW-20"}],"syntology":null}},{"leaderboard":"/sota/text-summarization-on-xsum-2","slug":"text-summarization-on-xsum-2","dataset":"XSum","dataset_url":"/dataset/xsum","rows_in_archive":1,"metrics":["ROUGE-1"],"first_row_in_archive_order":{"model":"SRformer-BART","paper_title":"Segmented Recurrent Transformer: An Efficient Sequence-to-Sequence Model","paper_url":"/paper/segmented-recurrent-transformer-an-efficient","paper_date":"2023-05-24","arxiv_id":"2305.16340","code_links":[{"title":"yinghanlong/SRtransformer","url":"https://github.com/yinghanlong/SRtransformer"}],"syntology":null}}],"datasets":[{"url":"/dataset/pubmed","name":"Pubmed","full_name":"","num_papers_in_archive":1236},{"url":"/dataset/reddit","name":"Reddit","full_name":"","num_papers_in_archive":699},{"url":"/dataset/cnn-daily-mail-1","name":"CNN/Daily Mail","full_name":"CNN/Daily Mail","num_papers_in_archive":530},{"url":"/dataset/new-york-times-annotated-corpus","name":"New York Times Annotated Corpus","full_name":"","num_papers_in_archive":262},{"url":"/dataset/cord-19","name":"CORD-19","full_name":"CORD-19","num_papers_in_archive":163},{"url":"/dataset/mteb","name":"MTEB","full_name":"Massive Text Embedding Benchmark","num_papers_in_archive":155},{"url":"/dataset/s2orc","name":"S2ORC","full_name":"S2ORC","num_papers_in_archive":152},{"url":"/dataset/samsum-corpus","name":"SAMSum","full_name":"","num_papers_in_archive":145},{"url":"/dataset/wikihow","name":"WikiHow","full_name":"","num_papers_in_archive":127},{"url":"/dataset/multi-news","name":"Multi-News","full_name":"Multi-News","num_papers_in_archive":122},{"url":"/dataset/newsroom","name":"NEWSROOM","full_name":"CORNELL NEWSROOM","num_papers_in_archive":107},{"url":"/dataset/kp20k","name":"KP20k","full_name":"KP20k","num_papers_in_archive":87},{"url":"/dataset/how2","name":"How2","full_name":"","num_papers_in_archive":84},{"url":"/dataset/govreport","name":"GovReport","full_name":"","num_papers_in_archive":83},{"url":"/dataset/qmsum","name":"QMSum","full_name":"","num_papers_in_archive":69},{"url":"/dataset/xl-sum","name":"XL-Sum","full_name":"","num_papers_in_archive":64},{"url":"/dataset/sentence-compression","name":"Sentence Compression","full_name":"","num_papers_in_archive":63},{"url":"/dataset/dialogsum","name":"DialogSum","full_name":"","num_papers_in_archive":62},{"url":"/dataset/lcsts","name":"LCSTS","full_name":"","num_papers_in_archive":58},{"url":"/dataset/wikilingua","name":"WikiLingua","full_name":"","num_papers_in_archive":52},{"url":"/dataset/bigpatent","name":"BigPatent","full_name":"","num_papers_in_archive":50},{"url":"/dataset/billsum","name":"BillSum","full_name":"BillSum","num_papers_in_archive":47},{"url":"/dataset/reddit-tifu","name":"Reddit TIFU","full_name":"","num_papers_in_archive":47},{"url":"/dataset/mlsum","name":"MLSUM","full_name":"MultiLingual SUMmarization","num_papers_in_archive":45},{"url":"/dataset/scrolls","name":"SCROLLS","full_name":"Standardized CompaRison Over Long Language Sequences","num_papers_in_archive":42},{"url":"/dataset/booksum","name":"BookSum","full_name":"","num_papers_in_archive":39},{"url":"/dataset/arxiv","name":"Arxiv HEP-TH citation graph","full_name":"","num_papers_in_archive":35},{"url":"/dataset/xp3","name":"xP3","full_name":"","num_papers_in_archive":34},{"url":"/dataset/meqsum","name":"MeQSum","full_name":null,"num_papers_in_archive":33},{"url":"/dataset/xsum","name":"XSum","full_name":null,"num_papers_in_archive":32},{"url":"/dataset/oasst1","name":"OASST1","full_name":"OpenAssistant Conversations Dataset","num_papers_in_archive":25},{"url":"/dataset/aeslc","name":"AESLC","full_name":"","num_papers_in_archive":22},{"url":"/dataset/scisummnet","name":"ScisummNet","full_name":"","num_papers_in_archive":20},{"url":"/dataset/meetingbank","name":"MeetingBank","full_name":"","num_papers_in_archive":16},{"url":"/dataset/duc-2004","name":"DUC 2004","full_name":"DUC 2004","num_papers_in_archive":15},{"url":"/dataset/arxiv-summarization-dataset","name":"arXiv Summarization Dataset","full_name":"","num_papers_in_archive":13},{"url":"/dataset/korsts","name":"KorSTS","full_name":"","num_papers_in_archive":13},{"url":"/dataset/ectsum","name":"ECTSum","full_name":"","num_papers_in_archive":12},{"url":"/dataset/indosum","name":"IndoSum","full_name":null,"num_papers_in_archive":9},{"url":"/dataset/aci-bench","name":"ACI-Bench","full_name":"","num_papers_in_archive":8},{"url":"/dataset/eur-lex-sum","name":"EUR-Lex-Sum","full_name":"","num_papers_in_archive":8},{"url":"/dataset/orangesum","name":"OrangeSum","full_name":"","num_papers_in_archive":8},{"url":"/dataset/wikicatsum","name":"WikiCatSum","full_name":null,"num_papers_in_archive":7},{"url":"/dataset/bbc-news-summary","name":"BBC News Summary","full_name":"","num_papers_in_archive":6},{"url":"/dataset/cells","name":"CELLS","full_name":"","num_papers_in_archive":6},{"url":"/dataset/convosumm","name":"ConvoSumm","full_name":"","num_papers_in_archive":6},{"url":"/dataset/talksumm","name":"TalkSumm","full_name":"TalkSumm","num_papers_in_archive":6},{"url":"/dataset/klexikon","name":"Klexikon","full_name":"Klexikon: A German Dataset for Joint Summarization and Simplification","num_papers_in_archive":5},{"url":"/dataset/liputan6","name":"Liputan6","full_name":"","num_papers_in_archive":5},{"url":"/dataset/ssn","name":"SSN","full_name":"Semantic Scholar Network","num_papers_in_archive":5},{"url":"/dataset/wikihowqa","name":"WikiHowQA","full_name":"","num_papers_in_archive":5},{"url":"/dataset/arxiv-1","name":"arXiv","full_name":"","num_papers_in_archive":4},{"url":"/dataset/eurekaalert","name":"EurekaAlert","full_name":"Eureka Alert","num_papers_in_archive":4},{"url":"/dataset/gazeta","name":"Gazeta","full_name":null,"num_papers_in_archive":4},{"url":"/dataset/indonlg","name":"IndoNLG","full_name":"","num_papers_in_archive":4},{"url":"/dataset/oasum","name":"OASum","full_name":"","num_papers_in_archive":4},{"url":"/dataset/pn-summary","name":"pn-summary","full_name":null,"num_papers_in_archive":4},{"url":"/dataset/chq-summ","name":"CHQ-Summ","full_name":"Consumer Healthcare Question Summarization","num_papers_in_archive":3},{"url":"/dataset/cnewsum","name":"CNewSum","full_name":"","num_papers_in_archive":3},{"url":"/dataset/perkey","name":"PerKey","full_name":"","num_papers_in_archive":3},{"url":"/dataset/pubmedcite","name":"PubMedCite","full_name":"","num_papers_in_archive":3},{"url":"/dataset/textbox-2-0","name":"TextBox 2.0","full_name":"","num_papers_in_archive":3},{"url":"/dataset/crosssum-in","name":"CrossSum-IN","full_name":"CrossSum-IN","num_papers_in_archive":2},{"url":"/dataset/danewsroom","name":"DaNewsroom","full_name":"DaNewsroom: A Large-scale Danish Summarisation Dataset","num_papers_in_archive":2},{"url":"/dataset/duc-2007","name":"DUC 2007","full_name":"Document Understanding Conferences","num_papers_in_archive":2},{"url":"/dataset/elsevier-oa-cc-by","name":"Elsevier OA CC-BY","full_name":"","num_papers_in_archive":2},{"url":"/dataset/fib","name":"FIB","full_name":"Factual Inconsistency Benchmark","num_papers_in_archive":2},{"url":"/dataset/humset","name":"HumSet","full_name":"HumSet","num_papers_in_archive":2},{"url":"/dataset/mentsum","name":"MentSum","full_name":"Mental Health Summarization Dataset","num_papers_in_archive":2},{"url":"/dataset/openasp","name":"OpenAsp","full_name":"","num_papers_in_archive":2},{"url":"/dataset/sume","name":"SuMe","full_name":"A Dataset Towards Summarizing Biomedical Mechanisms","num_papers_in_archive":2},{"url":"/dataset/loukritia-stefanou","name":"AUTH at BioLaySumm 2024: Bringing Scientific Content to Kids","full_name":"","num_papers_in_archive":1},{"url":"/dataset/bengali-curated-news-summary-dataset","name":"Bengali Curated News Summary Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/brwac2wiki","name":"BrWac2Wiki","full_name":"","num_papers_in_archive":1},{"url":"/dataset/cl-scisumm","name":"CL-SciSumm","full_name":"","num_papers_in_archive":1},{"url":"/dataset/comsum","name":"ComSum","full_name":"","num_papers_in_archive":1},{"url":"/dataset/csl-2022","name":"CSL (Chinese Scientific Literature)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/duc-2006","name":"DUC 2006","full_name":"Document Understanding Conferences","num_papers_in_archive":1},{"url":"/dataset/famous-keyword-twitter-replies","name":"Famous Keyword Twitter Replies","full_name":"","num_papers_in_archive":1},{"url":"/dataset/inshorts-news","name":"Inshorts News","full_name":"Inshorts English News dataset","num_papers_in_archive":1},{"url":"/dataset/mos-dataset","name":"MOS Dataset","full_name":"Microblog Opinion Summarisation","num_papers_in_archive":1},{"url":"/dataset/multisum","name":"MultiSum","full_name":"","num_papers_in_archive":1},{"url":"/dataset/opendebateevidence","name":"OpenDebateEvidence","full_name":"","num_papers_in_archive":1},{"url":"/dataset/pmc-sa","name":"PMC-SA","full_name":"PMC Structured Abstracts","num_papers_in_archive":1},{"url":"/dataset/prompt-opin-summ","name":"prompt-opin-summ","full_name":"","num_papers_in_archive":1},{"url":"/dataset/proto-summ","name":"Proto Summ","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/public-meetings","name":"public_meetings","full_name":"","num_papers_in_archive":1},{"url":"/dataset/robust-summarization-evaluation-benchmark","name":"Robust Summarization Evaluation Benchmark","full_name":"","num_papers_in_archive":1},{"url":"/dataset/shoptc-100k","name":"ShopTC-100K","full_name":"","num_papers_in_archive":1},{"url":"/dataset/subsume","name":"SubSumE","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tqba","name":"TQBA++","full_name":"Tiny QA Benchmark++","num_papers_in_archive":1},{"url":"/dataset/ukil-db-en","name":"UKIL-DB-EN","full_name":"","num_papers_in_archive":1},{"url":"/dataset/vietmed-sum","name":"VietMed-Sum","full_name":"","num_papers_in_archive":1},{"url":"/dataset/wiki-en","name":"Wiki-en","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/wiki-zh","name":"Wiki-zh","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/wikides","name":"WikiDes","full_name":"","num_papers_in_archive":1},{"url":"/dataset/wikiweb2m","name":"WikiWeb2M","full_name":"Wikipedia Webpage 2M","num_papers_in_archive":1},{"url":"/dataset/lsars","name":"LSARS","full_name":"Large Scale Abstractive multi-Review Summarization","num_papers_in_archive":0}],"subtasks":[{"url":"/task/abstractive-text-summarization","name":"Abstractive Text Summarization"},{"url":"/task/document-summarization","name":"Document Summarization"},{"url":"/task/extractive-document-summarization","name":"Extractive Text Summarization"},{"url":"/task/long-form-narrative-summarization","name":"Long-Form Narrative Summarization"},{"url":"/task/multi-document-summarization","name":"Multi-Document Summarization"},{"url":"/task/opinion-summarization","name":"Opinion Summarization"},{"url":"/task/query-based-extractive-summarization","name":"Query-Based Extractive Summarization"},{"url":"/task/scientific-article-summarization","name":"Scientific Document Summarization"},{"url":"/task/sentence-compression","name":"Sentence Compression"},{"url":"/task/sentence-summarization","name":"Sentence Summarization"},{"url":"/task/summarization-consistency-evaluation","name":"Summarization Consistency Evaluation"},{"url":"/task/unsupervised-opinion-summarization","name":"Unsupervised Opinion Summarization"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":440,"tagged_in_all":1340,"items":[{"url":"/paper/attention-is-all-you-need","title":"Attention Is All You Need","date":"2017-06-12","arxiv_id":"1706.03762","repositories_listed":595,"syntology":{"n":946,"n_ran":600,"n_unverified":346,"n_pointer_only":451}},{"url":"/paper/bart-denoising-sequence-to-sequence-pre","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","date":"2019-10-29","arxiv_id":"1910.13461","repositories_listed":47,"syntology":{"n":53,"n_ran":22,"n_unverified":31,"n_pointer_only":7}},{"url":"/paper/get-to-the-point-summarization-with-pointer","title":"Get To The Point: Summarization with Pointer-Generator Networks","date":"2017-04-14","arxiv_id":"1704.04368","repositories_listed":39,"syntology":{"n":64,"n_ran":30,"n_unverified":34,"n_pointer_only":44}},{"url":"/paper/pegasus-pre-training-with-extracted-gap","title":"PEGASUS: Pre-training with Extracted Gap-sentences for Abstractive Summarization","date":"2019-12-18","arxiv_id":"1912.08777","repositories_listed":19,"syntology":{"n":19,"n_ran":1,"n_unverified":18,"n_pointer_only":0}},{"url":"/paper/text-summarization-with-pretrained-encoders","title":"Text Summarization with Pretrained Encoders","date":"2019-08-22","arxiv_id":"1908.08345","repositories_listed":19,"syntology":{"n":21,"n_ran":7,"n_unverified":14,"n_pointer_only":0}},{"url":"/paper/big-bird-transformers-for-longer-sequences","title":"Big Bird: Transformers for Longer Sequences","date":"2020-07-28","arxiv_id":"2007.14062","repositories_listed":14,"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}},{"url":"/paper/fastformer-additive-attention-is-all-you-need","title":"Fastformer: Additive Attention Can Be All You Need","date":"2021-08-20","arxiv_id":"2108.09084","repositories_listed":13,"syntology":{"n":4,"n_ran":4,"n_unverified":0,"n_pointer_only":3}},{"url":"/paper/a-deep-reinforced-model-for-abstractive","title":"A Deep Reinforced Model for Abstractive Summarization","date":"2017-05-11","arxiv_id":"1705.04304","repositories_listed":10,"syntology":null},{"url":"/paper/unified-language-model-pre-training-for","title":"Unified Language Model Pre-training for Natural Language Understanding and Generation","date":"2019-05-08","arxiv_id":"1905.03197","repositories_listed":9,"syntology":null},{"url":"/paper/wikihow-a-large-scale-text-summarization","title":"WikiHow: A Large Scale Text Summarization Dataset","date":"2018-10-18","arxiv_id":"1810.09305","repositories_listed":9,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/leveraging-bert-for-extractive-text","title":"Leveraging BERT for Extractive Text Summarization on Lectures","date":"2019-06-07","arxiv_id":"1906.04165","repositories_listed":8,"syntology":null},{"url":"/paper/nlg-evaluation-metrics-beyond-correlation","title":"NLG Evaluation Metrics Beyond Correlation Analysis: An Empirical Metric Preference Checklist","date":"2023-05-15","arxiv_id":"2305.08566","repositories_listed":7,"syntology":null},{"url":"/paper/leveraging-pre-trained-checkpoints-for","title":"Leveraging Pre-trained Checkpoints for Sequence Generation Tasks","date":"2019-07-29","arxiv_id":"1907.12461","repositories_listed":7,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/mass-masked-sequence-to-sequence-pre-training","title":"MASS: Masked Sequence to Sequence Pre-training for Language Generation","date":"2019-05-07","arxiv_id":"1905.02450","repositories_listed":7,"syntology":null},{"url":"/paper/summarunner-a-recurrent-neural-network-based","title":"SummaRuNNer: A Recurrent Neural Network based Sequence Model for Extractive Summarization of Documents","date":"2016-11-14","arxiv_id":"1611.04230","repositories_listed":7,"syntology":{"n":7,"n_ran":0,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/incorporating-copying-mechanism-in-sequence","title":"Incorporating Copying Mechanism in Sequence-to-Sequence Learning","date":"2016-03-21","arxiv_id":"1603.06393","repositories_listed":7,"syntology":null},{"url":"/paper/summeval-re-evaluating-summarization","title":"SummEval: Re-evaluating Summarization Evaluation","date":"2020-07-24","arxiv_id":"2007.12626","repositories_listed":6,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/mteb-massive-text-embedding-benchmark","title":"MTEB: Massive Text Embedding Benchmark","date":"2022-10-13","arxiv_id":"2210.07316","repositories_listed":5,"syntology":{"n":13,"n_ran":3,"n_unverified":10,"n_pointer_only":0}},{"url":"/paper/pangu-a-large-scale-autoregressive-pretrained","title":"PanGu-$α$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","date":"2021-04-26","arxiv_id":"2104.12369","repositories_listed":5,"syntology":null},{"url":"/paper/barthez-a-skilled-pretrained-french-sequence","title":"BARThez: a Skilled Pretrained French Sequence-to-Sequence Model","date":"2020-10-23","arxiv_id":"2010.12321","repositories_listed":5,"syntology":null},{"url":"/paper/ernie-gen-an-enhanced-multi-flow-pre-training","title":"ERNIE-GEN: An Enhanced Multi-Flow Pre-training and Fine-tuning Framework for Natural Language Generation","date":"2020-01-26","arxiv_id":"2001.11314","repositories_listed":5,"syntology":null},{"url":"/paper/prophetnet-predicting-future-n-gram-for","title":"ProphetNet: Predicting Future N-gram for Sequence-to-Sequence Pre-training","date":"2020-01-13","arxiv_id":"2001.04063","repositories_listed":5,"syntology":null},{"url":"/paper/neural-abstractive-text-summarization-with","title":"Neural Abstractive Text Summarization with Sequence-to-Sequence Models","date":"2018-12-05","arxiv_id":"1812.02303","repositories_listed":5,"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/longlora-efficient-fine-tuning-of-long","title":"LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models","date":"2023-09-21","arxiv_id":"2309.12307","repositories_listed":4,"syntology":{"n":13,"n_ran":11,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/unifying-architectures-tasks-and-modalities","title":"OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework","date":"2022-02-07","arxiv_id":"2202.03052","repositories_listed":4,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/longt5-efficient-text-to-text-transformer-for","title":"LongT5: Efficient Text-To-Text Transformer for Long Sequences","date":"2021-12-15","arxiv_id":"2112.07916","repositories_listed":4,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/evaluating-the-factual-consistency-of","title":"Evaluating the Factual Consistency of Abstractive Text Summarization","date":"2019-10-28","arxiv_id":"1910.12840","repositories_listed":4,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/pretraining-based-natural-language-generation","title":"Pretraining-Based Natural Language Generation for Text Summarization","date":"2019-02-25","arxiv_id":"1902.09243","repositories_listed":4,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/a-neural-attention-model-for-abstractive","title":"A Neural Attention Model for Abstractive Sentence Summarization","date":"2015-09-02","arxiv_id":"1509.00685","repositories_listed":4,"syntology":null},{"url":"/paper/text-tuple-table-towards-information","title":"Text-Tuple-Table: Towards Information Integration in Text-to-Table Generation via Global Tuple Extraction","date":"2024-04-22","arxiv_id":"2404.14215","repositories_listed":3,"syntology":{"n":10,"n_ran":8,"n_unverified":2,"n_pointer_only":9}}],"syntology_records":19,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}