{"url":"/task/text-classification","name":"Text Classification","slug":"text-classification","description_markdown":"**Text Classification** is the task of assigning a sentence or document an appropriate category. The categories depend on the chosen dataset and can range from topics. \r\n\r\nText Classification problems include emotion classification, news classification, citation intent classification, among others. Benchmark datasets for evaluating text classification capabilities include GLUE, AGNews,  among others. \r\n\r\nIn recent years, deep learning techniques like XLNet and RoBERTa have attained some of the biggest performance jumps for text classification problems. \r\n\r\n<span style=\"color:grey; opacity: 0.6\">( Image credit: [Text Classification Algorithms: A Survey](https://arxiv.org/pdf/1904.08067v4.pdf) )</span>","categories":[{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":3635,"papers_with_code":1308,"benchmarks":68,"benchmark_tables_in_archive":100,"benchmark_tables_shown":100,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":167,"subtasks":16,"parent_tasks":1},"benchmarks":[{"leaderboard":"/sota/text-classification-on-mteb","slug":"text-classification-on-mteb","dataset":"MTEB","dataset_url":"/dataset/mteb","rows_in_archive":31,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ST5-XXL","paper_title":"MTEB: Massive Text Embedding Benchmark","paper_url":"/paper/mteb-massive-text-embedding-benchmark","paper_date":"2022-10-13","arxiv_id":"2210.07316","code_links":[{"title":"embeddings-benchmark/mteb","url":"https://github.com/embeddings-benchmark/mteb"},{"title":"lyon-nlp/mteb-french","url":"https://github.com/lyon-nlp/mteb-french"},{"title":"climsocana/tecb-de","url":"https://github.com/climsocana/tecb-de"},{"title":"wadoodabdul/clinical_ner_benchmark","url":"https://github.com/wadoodabdul/clinical_ner_benchmark"},{"title":"basf/chemteb","url":"https://github.com/basf/chemteb"}],"syntology":{"n":13,"n_ran":3,"n_unverified":10,"n_pointer_only":0}}},{"leaderboard":"/sota/text-classification-on-ag-news","slug":"text-classification-on-ag-news","dataset":"AG News","dataset_url":"/dataset/ag-news","rows_in_archive":24,"metrics":["Error"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/text-classification-on-dbpedia","slug":"text-classification-on-dbpedia","dataset":"DBpedia","dataset_url":"/dataset/dbpedia","rows_in_archive":21,"metrics":["Error"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/text-classification-on-r8","slug":"text-classification-on-r8","dataset":"R8","dataset_url":null,"rows_in_archive":21,"metrics":["Accuracy","F-measure"],"first_row_in_archive_order":{"model":"DeBERTa","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-trec-6","slug":"text-classification-on-trec-6","dataset":"TREC-6","dataset_url":null,"rows_in_archive":19,"metrics":["Error"],"first_row_in_archive_order":{"model":"Automatic Label Error Correction","paper_title":"The Re-Label Method For Data-Centric Machine Learning","paper_url":"/paper/the-re-label-method-for-data-centric-machine","paper_date":"2023-02-09","arxiv_id":"2302.04391","code_links":[{"title":"guotong1988/Automatic-Label-Error-Correction","url":"https://github.com/guotong1988/Automatic-Label-Error-Correction"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-20news","slug":"text-classification-on-20news","dataset":"20NEWS","dataset_url":null,"rows_in_archive":16,"metrics":["Accuracy","F-measure","Precision","Recall"],"first_row_in_archive_order":{"model":"LinearSVM+TFIDF","paper_title":"A Comparison of SVM against Pre-trained Language Models (PLMs) for Text Classification Tasks","paper_url":"/paper/a-comparison-of-svm-against-pre-trained","paper_date":"2022-11-04","arxiv_id":"2211.02563","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-uk-key-stage","slug":"text-classification-on-uk-key-stage","dataset":"UK Key Stage Readability","dataset_url":"/dataset/uk-key-stage-readability","rows_in_archive":15,"metrics":["F1"],"first_row_in_archive_order":{"model":"ELECTRA + ANN","paper_title":"What Differentiates Educational Literature? A Multimodal Fusion Approach of Transformers and Computational Linguistics","paper_url":"/paper/what-differentiates-educational-literature-a","paper_date":"2024-11-26","arxiv_id":"2411.17593","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-imdb","slug":"text-classification-on-imdb","dataset":"IMDb","dataset_url":"/dataset/imdb-movie-reviews","rows_in_archive":13,"metrics":["Accuracy","F1","Precision","Recall"],"first_row_in_archive_order":{"model":"BERT-ITPT-FiT","paper_title":"How to Fine-Tune BERT for Text Classification?","paper_url":"/paper/how-to-fine-tune-bert-for-text-classification","paper_date":"2019-05-14","arxiv_id":"1905.05583","code_links":[{"title":"xuyige/BERT4doc-Classification","url":"https://github.com/xuyige/BERT4doc-Classification"},{"title":"ongunuzaymacar/comparatively-finetuning-bert","url":"https://github.com/ongunuzaymacar/comparatively-finetuning-bert"},{"title":"uzaymacar/comparatively-finetuning-bert","url":"https://github.com/uzaymacar/comparatively-finetuning-bert"},{"title":"helmy-elrais/RoBERT_Recurrence_over_BERT","url":"https://github.com/helmy-elrais/RoBERT_Recurrence_over_BERT"},{"title":"GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data","url":"https://github.com/GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data"},{"title":"heraclex12/VLSP2020-Fake-News-Detection","url":"https://github.com/heraclex12/VLSP2020-Fake-News-Detection"},{"title":"bcaitech1/p4-dkt-no_caffeine_no_gain","url":"https://github.com/bcaitech1/p4-dkt-no_caffeine_no_gain"},{"title":"soarsmu/BiasFinder","url":"https://github.com/soarsmu/BiasFinder"},{"title":"qinhanmin2014/fine-tune-bert-for-text-classification","url":"https://github.com/qinhanmin2014/fine-tune-bert-for-text-classification"},{"title":"Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-","url":"https://github.com/Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-"},{"title":"Derposoft/ai-educator","url":"https://github.com/Derposoft/ai-educator"},{"title":"arctic-yen/Google_QUEST_Q-A_Labeling","url":"https://github.com/arctic-yen/Google_QUEST_Q-A_Labeling"},{"title":"sahil00199/KYC","url":"https://github.com/sahil00199/KYC"},{"title":"jyp1111/sentiment_analysis","url":"https://github.com/jyp1111/sentiment_analysis"},{"title":"saproovarun/Google-Quest-Q-A","url":"https://github.com/saproovarun/Google-Quest-Q-A"}],"syntology":{"n":18,"n_ran":6,"n_unverified":12,"n_pointer_only":5}}},{"leaderboard":"/sota/text-classification-on-mr","slug":"text-classification-on-mr","dataset":"MR","dataset_url":"/dataset/mr","rows_in_archive":10,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"VLAWE","paper_title":"Vector of Locally-Aggregated Word Embeddings (VLAWE): A Novel Document-level Representation","paper_url":"/paper/vector-of-locally-aggregated-word-embeddings","paper_date":"2019-02-23","arxiv_id":"1902.08850","code_links":[{"title":"raduionescu/vlawe-boswe","url":"https://github.com/raduionescu/vlawe-boswe"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-ohsumed","slug":"text-classification-on-ohsumed","dataset":"Ohsumed","dataset_url":"/dataset/ohsumed","rows_in_archive":10,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"RoBERTaGCN","paper_title":"BertGCN: Transductive Text Classification by Combining GCN and BERT","paper_url":"/paper/bertgcn-transductive-text-classification-by","paper_date":"2021-05-12","arxiv_id":"2105.05727","code_links":[{"title":"ZeroRin/BertGCN","url":"https://github.com/ZeroRin/BertGCN"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-yahoo-answers","slug":"text-classification-on-yahoo-answers","dataset":"Yahoo! Answers","dataset_url":"/dataset/yahoo-answers","rows_in_archive":10,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BERT-ITPT-FiT","paper_title":"How to Fine-Tune BERT for Text Classification?","paper_url":"/paper/how-to-fine-tune-bert-for-text-classification","paper_date":"2019-05-14","arxiv_id":"1905.05583","code_links":[{"title":"xuyige/BERT4doc-Classification","url":"https://github.com/xuyige/BERT4doc-Classification"},{"title":"ongunuzaymacar/comparatively-finetuning-bert","url":"https://github.com/ongunuzaymacar/comparatively-finetuning-bert"},{"title":"uzaymacar/comparatively-finetuning-bert","url":"https://github.com/uzaymacar/comparatively-finetuning-bert"},{"title":"helmy-elrais/RoBERT_Recurrence_over_BERT","url":"https://github.com/helmy-elrais/RoBERT_Recurrence_over_BERT"},{"title":"GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data","url":"https://github.com/GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data"},{"title":"heraclex12/VLSP2020-Fake-News-Detection","url":"https://github.com/heraclex12/VLSP2020-Fake-News-Detection"},{"title":"bcaitech1/p4-dkt-no_caffeine_no_gain","url":"https://github.com/bcaitech1/p4-dkt-no_caffeine_no_gain"},{"title":"soarsmu/BiasFinder","url":"https://github.com/soarsmu/BiasFinder"},{"title":"qinhanmin2014/fine-tune-bert-for-text-classification","url":"https://github.com/qinhanmin2014/fine-tune-bert-for-text-classification"},{"title":"Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-","url":"https://github.com/Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-"},{"title":"Derposoft/ai-educator","url":"https://github.com/Derposoft/ai-educator"},{"title":"arctic-yen/Google_QUEST_Q-A_Labeling","url":"https://github.com/arctic-yen/Google_QUEST_Q-A_Labeling"},{"title":"sahil00199/KYC","url":"https://github.com/sahil00199/KYC"},{"title":"jyp1111/sentiment_analysis","url":"https://github.com/jyp1111/sentiment_analysis"},{"title":"saproovarun/Google-Quest-Q-A","url":"https://github.com/saproovarun/Google-Quest-Q-A"}],"syntology":{"n":18,"n_ran":6,"n_unverified":12,"n_pointer_only":5}}},{"leaderboard":"/sota/text-classification-on-climabench","slug":"text-classification-on-climabench","dataset":"Climabench","dataset_url":"/dataset/climabench","rows_in_archive":8,"metrics":["Evaluation Macro F1"],"first_row_in_archive_order":{"model":"CliReBERT (P0L3/clirebert_clirevocab_uncased)","paper_title":"Climate Research Domain BERTs: Pretraining, Adaptation, and Evaluation","paper_url":"/paper/climate-research-domain-berts-pretraining","paper_date":"2025-05-19","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-newsdiscourse","slug":"text-classification-on-newsdiscourse","dataset":"NewsDiscourse","dataset_url":null,"rows_in_archive":8,"metrics":["macro F1"],"first_row_in_archive_order":{"model":"Human (Post-Rec.) (Spangher et al., 2021)","paper_title":"Multitask Semi-Supervised Learning for Class-Imbalanced Discourse Classification","paper_url":"/paper/multitask-semi-supervised-learning-for-class","paper_date":"","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-r52","slug":"text-classification-on-r52","dataset":"R52","dataset_url":null,"rows_in_archive":8,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"1-6 BertGCN","paper_title":"BertGCN: Transductive Text Classification by Combining GCN and BERT","paper_url":"/paper/bertgcn-transductive-text-classification-by","paper_date":"2021-05-12","arxiv_id":"2105.05727","code_links":[{"title":"ZeroRin/BertGCN","url":"https://github.com/ZeroRin/BertGCN"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-yelp-5","slug":"text-classification-on-yelp-5","dataset":"Yelp-5","dataset_url":"/dataset/yelp","rows_in_archive":7,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"HAHNN (CNN)","paper_title":"Hierarchical Attentional Hybrid Neural Networks for Document Classification","paper_url":"/paper/hierarchical-attentional-hybrid-neural","paper_date":"2019-01-20","arxiv_id":"1901.06610","code_links":[{"title":"luisfredgs/cnn-hierarchical-network-for-document-classification","url":"https://github.com/luisfredgs/cnn-hierarchical-network-for-document-classification"},{"title":"abhilash1910/MiniAttention","url":"https://github.com/abhilash1910/MiniAttention"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-dodf-data","slug":"text-classification-on-dodf-data","dataset":"DODF Data","dataset_url":null,"rows_in_archive":5,"metrics":["Average F1","Weighted F1"],"first_row_in_archive_order":{"model":"ULMFiT (pre-trained vocab, no gradual unfreezing)","paper_title":"Inferring the source of official texts: can SVM beat ULMFiT?","paper_url":"/paper/inferring-the-source-of-official-texts-can","paper_date":"2020-03-02","arxiv_id":null,"code_links":[{"title":"peluz/kneedle-exploration","url":"https://github.com/peluz/kneedle-exploration"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-lot-insts","slug":"text-classification-on-lot-insts","dataset":"Lot-insts","dataset_url":"/dataset/lot-insts","rows_in_archive":5,"metrics":["Accuracy","Macro-F1"],"first_row_in_archive_order":{"model":"Character-BERT+RS","paper_title":"Text Classification in the Wild: a Large-scale Long-tailed Name Normalization Dataset","paper_url":"/paper/text-classification-in-the-wild-a-large-scale","paper_date":"2023-02-19","arxiv_id":"2302.09509","code_links":[{"title":"lumia-group/lot-insts","url":"https://github.com/lumia-group/lot-insts"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-mvictor-type","slug":"text-classification-on-mvictor-type","dataset":"MVICTOR (type)","dataset_url":null,"rows_in_archive":5,"metrics":["Average F1","Weighted F1"],"first_row_in_archive_order":{"model":"CNN + CRF","paper_title":"VICTOR: a Dataset for Brazilian Legal Documents Classification","paper_url":"/paper/victor-a-dataset-for-brazilian-legal","paper_date":"2020-05-01","arxiv_id":null,"code_links":[{"title":"peluz/VICTOR-dataset","url":"https://github.com/peluz/VICTOR-dataset"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-onestopenglish","slug":"text-classification-on-onestopenglish","dataset":"OneStopEnglish (Readability Assessment)","dataset_url":null,"rows_in_archive":5,"metrics":["Accuracy (5-fold)"],"first_row_in_archive_order":{"model":"RoBERTa-RF-T1 hybrid","paper_title":"Pushing on Text Readability Assessment: A Transformer Meets Handcrafted Linguistic Features","paper_url":"/paper/pushing-on-text-readability-assessment-a","paper_date":"2021-09-25","arxiv_id":"2109.12258","code_links":[{"title":"brucewlee/lingfeat","url":"https://github.com/brucewlee/lingfeat"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-svictor-type","slug":"text-classification-on-svictor-type","dataset":"SVICTOR (type)","dataset_url":null,"rows_in_archive":5,"metrics":["Average F1","Weighted F1"],"first_row_in_archive_order":{"model":"CNN + CRF","paper_title":"VICTOR: a Dataset for Brazilian Legal Documents Classification","paper_url":"/paper/victor-a-dataset-for-brazilian-legal","paper_date":"2020-05-01","arxiv_id":null,"code_links":[{"title":"peluz/VICTOR-dataset","url":"https://github.com/peluz/VICTOR-dataset"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-weebit-readability","slug":"text-classification-on-weebit-readability","dataset":"WeeBit (Readability Assessment)","dataset_url":null,"rows_in_archive":5,"metrics":["Accuracy (5-fold)"],"first_row_in_archive_order":{"model":"BERT-FP-LBL","paper_title":"A Unified Neural Network Model for Readability Assessment with Feature Projection and Length-Balanced Loss","paper_url":"/paper/a-unified-neural-network-model-for-1","paper_date":"2022-10-19","arxiv_id":"2210.10305","code_links":[{"title":"liwb1219/zhfeat","url":"https://github.com/liwb1219/zhfeat"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-yelp-2","slug":"text-classification-on-yelp-2","dataset":"Yelp-2","dataset_url":"/dataset/yelp","rows_in_archive":5,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/text-classification-on-amazon-2","slug":"text-classification-on-amazon-2","dataset":"Amazon-2","dataset_url":null,"rows_in_archive":4,"metrics":["Error"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/text-classification-on-arxiv-10","slug":"text-classification-on-arxiv-10","dataset":"arXiv-10","dataset_url":"/dataset/arxiv-10","rows_in_archive":4,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Protoformer","paper_title":"Protoformer: Embedding Prototypes for Transformers","paper_url":"/paper/protoformer-embedding-prototypes-for-1","paper_date":"2022-06-25","arxiv_id":"2206.12710","code_links":[{"title":"codelion/adaptive-classifier","url":"https://github.com/codelion/adaptive-classifier/blob/main/src/adaptive_classifier/memory.py"},{"title":"ashfarhangi/Protoformer","url":"https://github.com/ashfarhangi/Protoformer"},{"title":"EthanCoder24/Protofomer-NLP","url":"https://github.com/EthanCoder24/Protofomer-NLP"},{"title":"GitF82/NLP-Embeddings-Protoformer-Paper","url":"https://github.com/GitF82/NLP-Embeddings-Protoformer-Paper"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-hatexplain-1","slug":"text-classification-on-hatexplain-1","dataset":"HateXplain","dataset_url":"/dataset/hatexplain","rows_in_archive":4,"metrics":["Accuracy (2 classes)","F1 Macro"],"first_row_in_archive_order":{"model":"Space-XLNet","paper_title":"Breaking Free Transformer Models: Task-specific Context Attribution Promises Improved Generalizability Without Fine-tuning Pre-trained LLMs","paper_url":"/paper/breaking-free-transformer-models-task","paper_date":"2024-01-30","arxiv_id":"2401.16638","code_links":[{"title":"stepantita/space-model","url":"https://github.com/stepantita/space-model"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-rcv1","slug":"text-classification-on-rcv1","dataset":"RCV1","dataset_url":"/dataset/rcv1","rows_in_archive":4,"metrics":["Accuracy","Macro F1","Micro F1","P@1","P@3","P@5","nDCG@1","nDCG@3","nDCG@5"],"first_row_in_archive_order":{"model":"oh-CNN + two LSTM tv-embed.","paper_title":"Supervised and Semi-Supervised Text Categorization using LSTM for Region Embeddings","paper_url":"/paper/supervised-and-semi-supervised-text","paper_date":"2016-02-07","arxiv_id":"1602.02373","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-threatgram-101-extreme","slug":"text-classification-on-threatgram-101-extreme","dataset":"ThreatGram 101 - Extreme Telegram Data","dataset_url":"/dataset/threatgram-101-extreme-telegram-data","rows_in_archive":4,"metrics":["weighted-F1 score"],"first_row_in_archive_order":{"model":"GPT-2","paper_title":"Exploring Multi-Level Threats in Telegram Data with AI-Human Annotation: A Preliminary Study","paper_url":"/paper/exploring-multi-level-threats-in-telegram","paper_date":"2023-12-15","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-amazon-5","slug":"text-classification-on-amazon-5","dataset":"Amazon-5","dataset_url":null,"rows_in_archive":3,"metrics":["Error"],"first_row_in_archive_order":{"model":"XLNet","paper_title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","paper_url":"/paper/xlnet-generalized-autoregressive-pretraining","paper_date":"2019-06-19","arxiv_id":"1906.08237","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/xlnet"},{"title":"zihangdai/xlnet","url":"https://github.com/zihangdai/xlnet"},{"title":"kaushaltrivedi/fast-bert","url":"https://github.com/kaushaltrivedi/fast-bert"},{"title":"utterworks/fast-bert","url":"https://github.com/utterworks/fast-bert"},{"title":"graykode/xlnet-Pytorch","url":"https://github.com/graykode/xlnet-Pytorch"},{"title":"facebookresearch/anli","url":"https://github.com/facebookresearch/anli"},{"title":"lvyufeng/bert4ms","url":"https://github.com/lvyufeng/bert4ms/blob/master/bert4ms/models/xlnet.py"},{"title":"huggingface/xlnet","url":"https://github.com/huggingface/xlnet"},{"title":"cuhksz-nlp/SAPar","url":"https://github.com/cuhksz-nlp/SAPar"},{"title":"joshuaWang-bit/Textclassification-pytorch","url":"https://github.com/joshuaWang-bit/Textclassification-pytorch"},{"title":"fanchenyou/transformer-study","url":"https://github.com/fanchenyou/transformer-study"},{"title":"https-seyhan/BugAI","url":"https://github.com/https-seyhan/BugAI"},{"title":"NathanDuran/Sentence-Encoding-for-DA-Classification","url":"https://github.com/NathanDuran/Sentence-Encoding-for-DA-Classification"},{"title":"2miatran/Natural-Language-Processing","url":"https://github.com/2miatran/Natural-Language-Processing"},{"title":"chesterdu/contrastive_summary","url":"https://github.com/chesterdu/contrastive_summary"},{"title":"pauldevos/python-notes","url":"https://github.com/pauldevos/python-notes"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/5/xlnet"},{"title":"MindCode-4/code-5","url":"https://github.com/MindCode-4/code-5/tree/main/xlnet"},{"title":"pwc-1/Paper-9","url":"https://github.com/pwc-1/Paper-9/tree/main/1/xlnet"},{"title":"samwisegamjeee/pytorch-transformers","url":"https://github.com/samwisegamjeee/pytorch-transformers"},{"title":"SambhawDrag/XLNet.jl","url":"https://github.com/SambhawDrag/XLNet.jl"},{"title":"tomgoter/nlp_finalproject","url":"https://github.com/tomgoter/nlp_finalproject"},{"title":"MS-P3/code7","url":"https://github.com/MS-P3/code7/tree/main/xlnet"},{"title":"zaradana/Fast_BERT","url":"https://github.com/zaradana/Fast_BERT"},{"title":"jonahwinninghoff/Text-Summarization","url":"https://github.com/jonahwinninghoff/Text-Summarization"},{"title":"listenviolet/XLNet","url":"https://github.com/listenviolet/XLNet"}],"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}}},{"leaderboard":"/sota/text-classification-on-bala-copa","slug":"text-classification-on-bala-copa","dataset":"Bala-Copa","dataset_url":"/dataset/bala-copa","rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Qwen2.5-32B + CAPO","paper_title":"CAPO: Cost-Aware Prompt Optimization","paper_url":"/paper/capo-cost-aware-prompt-optimization","paper_date":"2025-04-22","arxiv_id":"2504.16005","code_links":[{"title":"finitearth/promptolution","url":"https://github.com/finitearth/promptolution"},{"title":"finitearth/capo","url":"https://github.com/finitearth/capo"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-blurb","slug":"text-classification-on-blurb","dataset":"BLURB","dataset_url":"/dataset/blurb","rows_in_archive":3,"metrics":["F1"],"first_row_in_archive_order":{"model":"BioLinkBERT (large)","paper_title":"LinkBERT: Pretraining Language Models with Document Links","paper_url":"/paper/linkbert-pretraining-language-models-with","paper_date":"2022-03-29","arxiv_id":"2203.15827","code_links":[{"title":"michiyasunaga/LinkBERT","url":"https://github.com/michiyasunaga/LinkBERT"}],"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/text-classification-on-imdb-movie-reviews-1","slug":"text-classification-on-imdb-movie-reviews-1","dataset":"IMDb Movie Reviews","dataset_url":"/dataset/imdb-movie-reviews","rows_in_archive":3,"metrics":["AUC","Accuracy (2 classes)","F1 Macro"],"first_row_in_archive_order":{"model":"Logistic Regression","paper_title":"Anytime Active Learning","paper_url":"/paper/anytime-active-learning","paper_date":"2014-07-27","arxiv_id":null,"code_links":[{"title":"Bhavneet1492/Anytime-Active-Learning","url":"https://github.com/Bhavneet1492/Anytime-Active-Learning"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-overruling","slug":"text-classification-on-overruling","dataset":"Overruling","dataset_url":"/dataset/overruling","rows_in_archive":3,"metrics":["F1(10-fold)"],"first_row_in_archive_order":{"model":"Custom Legal-BERT","paper_title":"When Does Pretraining Help? Assessing Self-Supervised Learning for Law and the CaseHOLD Dataset","paper_url":"/paper/when-does-pretraining-help-assessing-self","paper_date":"2021-04-18","arxiv_id":"2104.08671","code_links":[{"title":"reglab/casehold","url":"https://github.com/reglab/casehold"},{"title":"trusthlt/privacy-legal-nlp-lm","url":"https://github.com/trusthlt/privacy-legal-nlp-lm"}],"syntology":{"n":9,"n_ran":0,"n_unverified":9,"n_pointer_only":0}}},{"leaderboard":"/sota/text-classification-on-sogou-news","slug":"text-classification-on-sogou-news","dataset":"Sogou News","dataset_url":null,"rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BERT-ITPT-FiT","paper_title":"How to Fine-Tune BERT for Text Classification?","paper_url":"/paper/how-to-fine-tune-bert-for-text-classification","paper_date":"2019-05-14","arxiv_id":"1905.05583","code_links":[{"title":"xuyige/BERT4doc-Classification","url":"https://github.com/xuyige/BERT4doc-Classification"},{"title":"ongunuzaymacar/comparatively-finetuning-bert","url":"https://github.com/ongunuzaymacar/comparatively-finetuning-bert"},{"title":"uzaymacar/comparatively-finetuning-bert","url":"https://github.com/uzaymacar/comparatively-finetuning-bert"},{"title":"helmy-elrais/RoBERT_Recurrence_over_BERT","url":"https://github.com/helmy-elrais/RoBERT_Recurrence_over_BERT"},{"title":"GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data","url":"https://github.com/GeorgeLuImmortal/Hierarchical-BERT-Model-with-Limited-Labelled-Data"},{"title":"heraclex12/VLSP2020-Fake-News-Detection","url":"https://github.com/heraclex12/VLSP2020-Fake-News-Detection"},{"title":"bcaitech1/p4-dkt-no_caffeine_no_gain","url":"https://github.com/bcaitech1/p4-dkt-no_caffeine_no_gain"},{"title":"soarsmu/BiasFinder","url":"https://github.com/soarsmu/BiasFinder"},{"title":"qinhanmin2014/fine-tune-bert-for-text-classification","url":"https://github.com/qinhanmin2014/fine-tune-bert-for-text-classification"},{"title":"Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-","url":"https://github.com/Domminique/Deploy-BERT-for-Sentiment-Analysis-with-FastAPI-"},{"title":"Derposoft/ai-educator","url":"https://github.com/Derposoft/ai-educator"},{"title":"arctic-yen/Google_QUEST_Q-A_Labeling","url":"https://github.com/arctic-yen/Google_QUEST_Q-A_Labeling"},{"title":"sahil00199/KYC","url":"https://github.com/sahil00199/KYC"},{"title":"jyp1111/sentiment_analysis","url":"https://github.com/jyp1111/sentiment_analysis"},{"title":"saproovarun/Google-Quest-Q-A","url":"https://github.com/saproovarun/Google-Quest-Q-A"}],"syntology":{"n":18,"n_ran":6,"n_unverified":12,"n_pointer_only":5}}},{"leaderboard":"/sota/text-classification-on-terms-of-service","slug":"text-classification-on-terms-of-service","dataset":"Terms of Service","dataset_url":"/dataset/terms-of-service","rows_in_archive":3,"metrics":["F1(10-fold)"],"first_row_in_archive_order":{"model":"Custom Legal-BERT","paper_title":"When Does Pretraining Help? Assessing Self-Supervised Learning for Law and the CaseHOLD Dataset","paper_url":"/paper/when-does-pretraining-help-assessing-self","paper_date":"2021-04-18","arxiv_id":"2104.08671","code_links":[{"title":"reglab/casehold","url":"https://github.com/reglab/casehold"},{"title":"trusthlt/privacy-legal-nlp-lm","url":"https://github.com/trusthlt/privacy-legal-nlp-lm"}],"syntology":{"n":9,"n_ran":0,"n_unverified":9,"n_pointer_only":0}}},{"leaderboard":"/sota/text-classification-on-twitter","slug":"text-classification-on-twitter","dataset":"Twitter","dataset_url":null,"rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ERNIE 2.0","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-an-amharic-news-text","slug":"text-classification-on-an-amharic-news-text","dataset":"An Amharic News Text classification Dataset","dataset_url":"/dataset/an-amharic-news-text-classification-dataset","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Naive Bayes using Tf-idf features","paper_title":"An Amharic News Text classification Dataset","paper_url":"/paper/an-amharic-news-text-classification-dataset","paper_date":"2021-03-10","arxiv_id":"2103.05639","code_links":[{"title":"IsraelAbebe/An-Amharic-News-Text-classification-Dataset","url":"https://github.com/IsraelAbebe/An-Amharic-News-Text-classification-Dataset"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-glue-sst2","slug":"text-classification-on-glue-sst2","dataset":"GLUE SST2","dataset_url":"/dataset/glue","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"TRANS-BLSTM","paper_title":"TRANS-BLSTM: Transformer with Bidirectional LSTM for Language Understanding","paper_url":"/paper/trans-blstm-transformer-with-bidirectional","paper_date":"2020-03-16","arxiv_id":"2003.07000","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-muld-character-type","slug":"text-classification-on-muld-character-type","dataset":"MuLD (Character Type)","dataset_url":"/dataset/muld","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"Longformer","paper_title":"MuLD: The Multitask Long Document Benchmark","paper_url":"/paper/muld-the-multitask-long-document-benchmark","paper_date":"2022-02-15","arxiv_id":"2202.07362","code_links":[{"title":"ghomashudson/muld","url":"https://github.com/ghomashudson/muld"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-searchsnippets","slug":"text-classification-on-searchsnippets","dataset":"Searchsnippets","dataset_url":null,"rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"DistilBERT","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-social-media","slug":"text-classification-on-social-media","dataset":"Social media attributions of YouTube comments","dataset_url":"/dataset/social-media-attributions-of-youtube-comments","rows_in_archive":2,"metrics":["Accuracy (2 classes)","F1 Macro"],"first_row_in_archive_order":{"model":"Space-BERT","paper_title":"Breaking Free Transformer Models: Task-specific Context Attribution Promises Improved Generalizability Without Fine-tuning Pre-trained LLMs","paper_url":"/paper/breaking-free-transformer-models-task","paper_date":"2024-01-30","arxiv_id":"2401.16638","code_links":[{"title":"stepantita/space-model","url":"https://github.com/stepantita/space-model"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-sst-2","slug":"text-classification-on-sst-2","dataset":"SST-2","dataset_url":"/dataset/sst-2","rows_in_archive":2,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"DeBERTa","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-this-is-not-a-dataset","slug":"text-classification-on-this-is-not-a-dataset","dataset":"This is not a Dataset","dataset_url":"/dataset/this-is-not-a-dataset","rows_in_archive":2,"metrics":["Accuracy","Coherence"],"first_row_in_archive_order":{"model":"Vicuna13B v1.1","paper_title":"This is not a Dataset: A Large Negation Benchmark to Challenge Large Language Models","paper_url":"/paper/this-is-not-a-dataset-a-large-negation","paper_date":"2023-10-24","arxiv_id":"2310.15941","code_links":[{"title":"hitz-zentroa/this-is-not-a-dataset","url":"https://github.com/hitz-zentroa/this-is-not-a-dataset"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-trec-50","slug":"text-classification-on-trec-50","dataset":"TREC-50","dataset_url":null,"rows_in_archive":2,"metrics":["Error"],"first_row_in_archive_order":{"model":"Rules","paper_title":"High Accuracy Rule-based Question Classification using Question Syntax and Semantics","paper_url":"/paper/high-accuracy-rule-based-question","paper_date":"2016-12-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-20-newsgroups","slug":"text-classification-on-20-newsgroups","dataset":"20 Newsgroups","dataset_url":"/dataset/20-newsgroups","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"RoBERTaGCN","paper_title":"BertGCN: Transductive Text Classification by Combining GCN and BERT","paper_url":"/paper/bertgcn-transductive-text-classification-by","paper_date":"2021-05-12","arxiv_id":"2105.05727","code_links":[{"title":"ZeroRin/BertGCN","url":"https://github.com/ZeroRin/BertGCN"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-adverse-drug-events","slug":"text-classification-on-adverse-drug-events","dataset":"Adverse Drug Events (ADE) Corpus","dataset_url":"/dataset/ade-corpus","rows_in_archive":1,"metrics":["F1 - macro"],"first_row_in_archive_order":{"model":"Spark NLP","paper_title":"Mining Adverse Drug Reactions from Unstructured Mediums at Scale","paper_url":"/paper/mining-adverse-drug-reactions-from","paper_date":"2022-01-05","arxiv_id":"2201.01405","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-affcon-2020-emotion","slug":"text-classification-on-affcon-2020-emotion","dataset":"AffCon 2020 Emotion Detection","dataset_url":null,"rows_in_archive":1,"metrics":["F1 score"],"first_row_in_archive_order":{"model":"BERT-based Ensembles","paper_title":"BERT-based Ensembles for Modeling Disclosure and Support in Conversational Social Media Text","paper_url":"/paper/bert-based-ensembles-for-modeling-disclosure","paper_date":"2020-06-01","arxiv_id":"2006.01222","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-arxiv","slug":"text-classification-on-arxiv","dataset":"Arxiv HEP-TH citation graph","dataset_url":"/dataset/arxiv","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BigBird","paper_title":"Big Bird: Transformers for Longer Sequences","paper_url":"/paper/big-bird-transformers-for-longer-sequences","paper_date":"2020-07-28","arxiv_id":"2007.14062","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp/projects/bigbird"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/paddlenlp/transformers/bigbird"},{"title":"facebookresearch/xformers","url":"https://github.com/facebookresearch/xformers"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"monologg/kobigbird","url":"https://github.com/monologg/kobigbird"},{"title":"mim-solutions/bert_for_longer_texts","url":"https://github.com/mim-solutions/bert_for_longer_texts"},{"title":"mim-solutions/roberta_for_longer_texts","url":"https://github.com/mim-solutions/roberta_for_longer_texts"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/big_bird"},{"title":"sergeykramp/mthesis-bigbird-embeddings","url":"https://github.com/sergeykramp/mthesis-bigbird-embeddings"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/big_bird"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/bigbird_pegasus"}],"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}}},{"leaderboard":"/sota/text-classification-on-banking77","slug":"text-classification-on-banking77","dataset":"BANKING77","dataset_url":"/dataset/banking77","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"RoBERTa-Large + ICDA","paper_title":"Selective In-Context Data Augmentation for Intent Detection using Pointwise V-Information","paper_url":"/paper/selective-in-context-data-augmentation-for","paper_date":"2023-02-10","arxiv_id":"2302.05096","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-facebook-media","slug":"text-classification-on-facebook-media","dataset":"Facebook Media","dataset_url":null,"rows_in_archive":1,"metrics":["F1 (Hidden Test Set)"],"first_row_in_archive_order":{"model":"Our proposed method Model Averaging(D + E + F)","paper_title":"A Unified System for Aggression Identification in English Code-Mixed and Uni-Lingual Texts","paper_url":"/paper/aggressionnet-generalised-multi-modal-deep","paper_date":"2020-01-15","arxiv_id":"2001.05493","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-fmc-mwo2kg-1","slug":"text-classification-on-fmc-mwo2kg-1","dataset":"FMC-MWO2KG","dataset_url":"/dataset/fmc-mwo2kg","rows_in_archive":1,"metrics":["Macro F1","Micro F1"],"first_row_in_archive_order":{"model":"Flair","paper_title":"MWO2KG and Echidna: Constructing and exploring knowledge graphs from maintenance data","paper_url":"/paper/mwo2kg-and-echidna-constructing-and-exploring","paper_date":"2022-11-05","arxiv_id":null,"code_links":[{"title":"nlp-tlp/mwo2kg-and-echidna","url":"https://github.com/nlp-tlp/mwo2kg-and-echidna"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-glue-cola","slug":"text-classification-on-glue-cola","dataset":"GLUE COLA","dataset_url":"/dataset/glue","rows_in_archive":1,"metrics":["Matthews Correlation"],"first_row_in_archive_order":{"model":"TRANS-BLSTM","paper_title":"TRANS-BLSTM: Transformer with Bidirectional LSTM for Language Understanding","paper_url":"/paper/trans-blstm-transformer-with-bidirectional","paper_date":"2020-03-16","arxiv_id":"2003.07000","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-glue-mrpc","slug":"text-classification-on-glue-mrpc","dataset":"GLUE MRPC","dataset_url":"/dataset/glue","rows_in_archive":1,"metrics":["Accuracy","F1"],"first_row_in_archive_order":{"model":"TRANS-BLSTM","paper_title":"TRANS-BLSTM: Transformer with Bidirectional LSTM for Language Understanding","paper_url":"/paper/trans-blstm-transformer-with-bidirectional","paper_date":"2020-03-16","arxiv_id":"2003.07000","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-glue-rte","slug":"text-classification-on-glue-rte","dataset":"GLUE RTE","dataset_url":"/dataset/glue","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"TRANS-BLSTM","paper_title":"TRANS-BLSTM: Transformer with Bidirectional LSTM for Language Understanding","paper_url":"/paper/trans-blstm-transformer-with-bidirectional","paper_date":"2020-03-16","arxiv_id":"2003.07000","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-glue-stsb","slug":"text-classification-on-glue-stsb","dataset":"GLUE STSB","dataset_url":"/dataset/glue","rows_in_archive":1,"metrics":["Spearmanr"],"first_row_in_archive_order":{"model":"TRANS-BLSTM","paper_title":"TRANS-BLSTM: Transformer with Bidirectional LSTM for Language Understanding","paper_url":"/paper/trans-blstm-transformer-with-bidirectional","paper_date":"2020-03-16","arxiv_id":"2003.07000","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-hyperpartisan-1","slug":"text-classification-on-hyperpartisan-1","dataset":"Hyperpartisan","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BigBird","paper_title":"Big Bird: Transformers for Longer Sequences","paper_url":"/paper/big-bird-transformers-for-longer-sequences","paper_date":"2020-07-28","arxiv_id":"2007.14062","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp/projects/bigbird"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/paddlenlp/transformers/bigbird"},{"title":"facebookresearch/xformers","url":"https://github.com/facebookresearch/xformers"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"monologg/kobigbird","url":"https://github.com/monologg/kobigbird"},{"title":"mim-solutions/bert_for_longer_texts","url":"https://github.com/mim-solutions/bert_for_longer_texts"},{"title":"mim-solutions/roberta_for_longer_texts","url":"https://github.com/mim-solutions/roberta_for_longer_texts"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/big_bird"},{"title":"sergeykramp/mthesis-bigbird-embeddings","url":"https://github.com/sergeykramp/mthesis-bigbird-embeddings"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/big_bird"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/bigbird_pegasus"}],"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}}},{"leaderboard":"/sota/text-classification-on-nice-2","slug":"text-classification-on-nice-2","dataset":"NICE-2","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"RoBERTa","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-nice-45","slug":"text-classification-on-nice-45","dataset":"NICE-45","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BERT","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-patents","slug":"text-classification-on-patents","dataset":"Patents","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BigBird","paper_title":"Big Bird: Transformers for Longer Sequences","paper_url":"/paper/big-bird-transformers-for-longer-sequences","paper_date":"2020-07-28","arxiv_id":"2007.14062","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp/projects/bigbird"},{"title":"PaddlePaddle/PaddleNLP","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/paddlenlp/transformers/bigbird"},{"title":"facebookresearch/xformers","url":"https://github.com/facebookresearch/xformers"},{"title":"google-research/bigbird","url":"https://github.com/google-research/bigbird"},{"title":"monologg/kobigbird","url":"https://github.com/monologg/kobigbird"},{"title":"mim-solutions/bert_for_longer_texts","url":"https://github.com/mim-solutions/bert_for_longer_texts"},{"title":"mim-solutions/roberta_for_longer_texts","url":"https://github.com/mim-solutions/roberta_for_longer_texts"},{"title":"sajjjadayobi/ParsBigBird","url":"https://github.com/sajjjadayobi/ParsBigBird"},{"title":"thefonseca/factorsum","url":"https://github.com/thefonseca/factorsum"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/big_bird"},{"title":"sergeykramp/mthesis-bigbird-embeddings","url":"https://github.com/sergeykramp/mthesis-bigbird-embeddings"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/big_bird"},{"title":"pwc-1/Paper-8","url":"https://github.com/pwc-1/Paper-8/tree/main/bigbird_pegasus"}],"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}}},{"leaderboard":"/sota/text-classification-on-rusage-corpus-for-age","slug":"text-classification-on-rusage-corpus-for-age","dataset":"RusAge: Corpus for Age-Based Text Classification","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"LSVC + linguistic features + publishing attributes","paper_title":"A Comparative Study of Feature Types for Age-Based Text Classification","paper_url":"/paper/a-comparative-study-of-feature-types-for-age","paper_date":"2020-09-24","arxiv_id":"2009.11898","code_links":[{"title":"oldaandozerskaya/age_based_classification","url":"https://github.com/oldaandozerskaya/age_based_classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-silicone-benchmark","slug":"text-classification-on-silicone-benchmark","dataset":"SILICONE Benchmark","dataset_url":"/dataset/silicone-benchmark","rows_in_archive":1,"metrics":["1:1 Accuracy"],"first_row_in_archive_order":{"model":"Pretrained Hierarchical Transformer","paper_title":"Hierarchical Pre-training for Sequence Labelling in Spoken Dialog","paper_url":"/paper/hierarchical-pre-training-for-sequence","paper_date":"2020-09-23","arxiv_id":"2009.11152","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-stops-2","slug":"text-classification-on-stops-2","dataset":"STOPS-2","dataset_url":null,"rows_in_archive":1,"metrics":["STOPS-2"],"first_row_in_archive_order":{"model":"ERNIE 2.0","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-stops-41","slug":"text-classification-on-stops-41","dataset":"STOPS-41","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"DeBERTa","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-trac2-benghali-task-2","slug":"text-classification-on-trac2-benghali-task-2","dataset":"TRAC2-Benghali. Task 2.","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"BERT","paper_title":"BERT of all trades, master of some","paper_url":"/paper/bert-of-all-trades-master-of-some","paper_date":"2020-05-01","arxiv_id":null,"code_links":[{"title":"InstituteForIndustrialEconomics/trac2","url":"https://github.com/InstituteForIndustrialEconomics/trac2"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-trac2-english-task2","slug":"text-classification-on-trac2-english-task2","dataset":"TRAC2-English. Task2.","dataset_url":null,"rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"BERT","paper_title":"BERT of all trades, master of some","paper_url":"/paper/bert-of-all-trades-master-of-some","paper_date":"2020-05-01","arxiv_id":null,"code_links":[{"title":"InstituteForIndustrialEconomics/trac2","url":"https://github.com/InstituteForIndustrialEconomics/trac2"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-trec-10","slug":"text-classification-on-trec-10","dataset":"TREC-10","dataset_url":"/dataset/trec-10","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"BERT","paper_title":"Transformers are Short Text Classifiers: A Study of Inductive Short Text Classifiers on Benchmarks and Real-world Datasets","paper_url":"/paper/transformers-are-short-text-classifiers-a","paper_date":"2022-11-30","arxiv_id":"2211.16878","code_links":[{"title":"FKarl/short-text-classification","url":"https://github.com/FKarl/short-text-classification"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-twitter-sentiment-1","slug":"text-classification-on-twitter-sentiment-1","dataset":"Twitter Sentiment Analysis","dataset_url":"/dataset/twitter-sentiment-analysis","rows_in_archive":1,"metrics":["AUC"],"first_row_in_archive_order":{"model":"Logistic Regression","paper_title":"Anytime Active Learning","paper_url":"/paper/anytime-active-learning","paper_date":"2014-07-27","arxiv_id":null,"code_links":[{"title":"Bhavneet1492/Anytime-Active-Learning","url":"https://github.com/Bhavneet1492/Anytime-Active-Learning"}],"syntology":null}},{"leaderboard":"/sota/text-classification-on-twitter-us","slug":"text-classification-on-twitter-us","dataset":"Twitter-US","dataset_url":null,"rows_in_archive":1,"metrics":["F1 (Hidden Test Set)"],"first_row_in_archive_order":{"model":"Our proposed method Model Averaging(D + E + F)","paper_title":"A Unified System for Aggression Identification in English Code-Mixed and Uni-Lingual Texts","paper_url":"/paper/aggressionnet-generalised-multi-modal-deep","paper_date":"2020-01-15","arxiv_id":"2001.05493","code_links":[],"syntology":null}},{"leaderboard":"/sota/text-classification-on-wnut-2020-task-2","slug":"text-classification-on-wnut-2020-task-2","dataset":"WNUT-2020 Task 2","dataset_url":"/dataset/wnut-2020-task-2","rows_in_archive":1,"metrics":["F1"],"first_row_in_archive_order":{"model":"NutCracker","paper_title":"NutCracker at WNUT-2020 Task 2: Robustly Identifying Informative COVID-19 Tweets using Ensembling and Adversarial Training","paper_url":"/paper/nutcracker-at-wnut-2020-task-2-robustly","paper_date":"2020-10-09","arxiv_id":"2010.04335","code_links":[{"title":"kpriyanshu256/WNUT-2020-Task-2","url":"https://github.com/kpriyanshu256/WNUT-2020-Task-2"}],"syntology":null}},{"leaderboard":null,"slug":"text-classification-on-ade-corpus-v2ade","dataset":"ade_corpus_v2Ade_corpus_v2_classification","dataset_url":null,"rows_in_archive":0,"metrics":["Validation Accuracy","Validation F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-ag-news-1","dataset":"ag_news","dataset_url":"/dataset/ag-news","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-amazon-polarity","dataset":"amazon_polarity","dataset_url":null,"rows_in_archive":0,"metrics":["AUC","Accuracy","F1","Precision","Recall","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-amazon-reviews-multi","dataset":"amazon_reviews_multi","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-boolq","dataset":"BoolQ","dataset_url":"/dataset/boolq","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-catalonia-independence","dataset":"catalonia_independence","dataset_url":"/dataset/cic","rows_in_archive":0,"metrics":["Accuracy","F1 Macro","F1 Micro","F1 Weighted","Precision Macro","Precision Micro","Precision Weighted","Recall Macro","Recall Micro","Recall Weighted","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-clinc-oos","dataset":"clinc_oos","dataset_url":"/dataset/clinc150","rows_in_archive":0,"metrics":["Accuracy","F1 Macro","F1 Micro","F1 Weighted","Precision Macro","Precision Micro","Precision Weighted","Recall Macro","Recall Micro","Recall Weighted","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-common-language","dataset":"common_language","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-dbpedia-14","dataset":"dbpedia_14","dataset_url":"/dataset/dbpedia","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-emotion","dataset":"emotion","dataset_url":"/dataset/emotion","rows_in_archive":0,"metrics":["Accuracy","F1","F1 Macro","F1 Micro","F1 Weighted","Precision Macro","Precision Micro","Precision Weighted","Recall Macro","Recall Micro","Recall Weighted","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-financial-phrasebank","dataset":"financial_phrasebank","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy","Precision","Recall"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-glue","dataset":"GLUE","dataset_url":"/dataset/glue","rows_in_archive":0,"metrics":["AUC","Accuracy","F1","Matthews Correlation","Precision","Recall","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-glue-mnli","dataset":"GLUE MNLI","dataset_url":"/dataset/glue","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-glue-qnli","dataset":"GLUE QNLI","dataset_url":"/dataset/glue","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-glue-qqp","dataset":"GLUE QQP","dataset_url":"/dataset/glue","rows_in_archive":0,"metrics":["Accuracy","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-glue-wnli","dataset":"GLUE WNLI","dataset_url":"/dataset/glue","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-hate-speech18","dataset":"hate_speech18","dataset_url":"/dataset/hate-speech","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-indonlu","dataset":"indonlu","dataset_url":"/dataset/indonlu-benchmark","rows_in_archive":0,"metrics":["Accuracy","F1","Precision","Recall"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-klue","dataset":"KLUE","dataset_url":"/dataset/klue","rows_in_archive":0,"metrics":["Accuracy","F1","Pearsonr"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-lenu","dataset":"lenu","dataset_url":null,"rows_in_archive":0,"metrics":["f1","f1 macro"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-nsfw-safe-dataset","dataset":"NSFW-Safe-Dataset","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-reuters21578","dataset":"reuters21578","dataset_url":"/dataset/reuters-21578","rows_in_archive":0,"metrics":["Accuracy","F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-sai1908-mental-health","dataset":"sai1908/Mental_Health_Condition_Classification","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy","Validation Loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-sst2","dataset":"SST2","dataset_url":"/dataset/sst","rows_in_archive":0,"metrics":["Accuracy","F1 Macro","F1 Micro","F1 Weighted","Precision Macro","Precision Micro","Precision Weighted","Recall Macro","Recall Micro","Recall Weighted","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-tecla","dataset":"tecla","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-trec-1","dataset":"trec","dataset_url":"/dataset/trecqa","rows_in_archive":0,"metrics":["Accuracy","F1 Macro","F1 Micro","F1 Weighted","Precision Macro","Precision Micro","Precision Weighted","Recall Macro","Recall Micro","Recall Weighted","loss"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-turkish-toxic-language","dataset":"Turkish Toxic Language Dataset","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy","F1","Precision","Recall"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-tweet-eval","dataset":"tweet_eval","dataset_url":"/dataset/emotion","rows_in_archive":0,"metrics":["F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-twitter-financial-news","dataset":"twitter-financial-news-topic","dataset_url":null,"rows_in_archive":0,"metrics":["F1","accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-wiki-labeled-articles","dataset":"Wiki Labeled Articles","dataset_url":null,"rows_in_archive":0,"metrics":["F1"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-yahoo-answers-topics","dataset":"yahoo_answers_topics","dataset_url":null,"rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"text-classification-on-yelp-polarity","dataset":"yelp_polarity","dataset_url":"/dataset/yelp","rows_in_archive":0,"metrics":["Accuracy"],"first_row_in_archive_order":null}],"datasets":[{"url":"/dataset/mnist","name":"MNIST","full_name":"","num_papers_in_archive":7651},{"url":"/dataset/glue","name":"GLUE","full_name":"General Language Understanding Evaluation benchmark","num_papers_in_archive":3197},{"url":"/dataset/sst","name":"SST","full_name":"Stanford Sentiment Treebank","num_papers_in_archive":2354},{"url":"/dataset/sst-2","name":"SST-2","full_name":"","num_papers_in_archive":1808},{"url":"/dataset/imdb-movie-reviews","name":"IMDb Movie Reviews","full_name":"","num_papers_in_archive":1787},{"url":"/dataset/ag-news","name":"AG News","full_name":"AG’s News Corpus","num_papers_in_archive":969},{"url":"/dataset/boolq","name":"BoolQ","full_name":"Boolean Questions","num_papers_in_archive":701},{"url":"/dataset/reddit","name":"Reddit","full_name":"","num_papers_in_archive":699},{"url":"/dataset/dbpedia","name":"DBpedia","full_name":"DBpedia","num_papers_in_archive":597},{"url":"/dataset/rcv1","name":"RCV1","full_name":"Reuters Corpus Volume 1","num_papers_in_archive":336},{"url":"/dataset/openwebtext","name":"OpenWebText","full_name":"","num_papers_in_archive":207},{"url":"/dataset/hate-speech","name":"Hate Speech","full_name":"","num_papers_in_archive":180},{"url":"/dataset/mteb","name":"MTEB","full_name":"Massive Text Embedding Benchmark","num_papers_in_archive":155},{"url":"/dataset/e-snli","name":"e-SNLI","full_name":"","num_papers_in_archive":139},{"url":"/dataset/yahoo-answers","name":"Yahoo! Answers","full_name":"","num_papers_in_archive":132},{"url":"/dataset/banking77","name":"BANKING77","full_name":"BANKING77","num_papers_in_archive":131},{"url":"/dataset/emotion","name":"CARER","full_name":"Contextualized Affect Representations for Emotion Recognition","num_papers_in_archive":123},{"url":"/dataset/hatexplain","name":"HateXplain","full_name":"","num_papers_in_archive":105},{"url":"/dataset/clue","name":"CLUE","full_name":"Chinese Language Understanding Evaluation Benchmark","num_papers_in_archive":99},{"url":"/dataset/clinc150","name":"CLINC150","full_name":"CLINC150","num_papers_in_archive":87},{"url":"/dataset/yelp","name":"Yelp","full_name":"","num_papers_in_archive":86},{"url":"/dataset/tweeteval","name":"TweetEval","full_name":"","num_papers_in_archive":84},{"url":"/dataset/trecqa","name":"TrecQA","full_name":"Text Retrieval Conference Question Answering","num_papers_in_archive":73},{"url":"/dataset/reuters-21578","name":"Reuters-21578","full_name":"","num_papers_in_archive":66},{"url":"/dataset/web-of-science-dataset","name":"WOS","full_name":"Web of Science Dataset","num_papers_in_archive":59},{"url":"/dataset/peerread","name":"PeerRead","full_name":"","num_papers_in_archive":42},{"url":"/dataset/amazon-product-data","name":"Amazon Product Data","full_name":"rithik","num_papers_in_archive":41},{"url":"/dataset/blurb","name":"BLURB","full_name":"Biomedical Language Understanding and Reasoning Benchmark","num_papers_in_archive":40},{"url":"/dataset/yelp-review-polarity","name":"Yelp Review Polarity","full_name":"","num_papers_in_archive":37},{"url":"/dataset/arxiv","name":"Arxiv HEP-TH citation graph","full_name":"","num_papers_in_archive":35},{"url":"/dataset/mr","name":"MR","full_name":"MR Movie Reviews","num_papers_in_archive":28},{"url":"/dataset/wnut-2020-task-2","name":"WNUT-2020 Task 2","full_name":"WNUT-2020 Task 2: Identification of Informative COVID-19 English Tweets","num_papers_in_archive":28},{"url":"/dataset/20-newsgroups","name":"20 Newsgroups","full_name":"","num_papers_in_archive":27},{"url":"/dataset/basil","name":"BASIL","full_name":"","num_papers_in_archive":27},{"url":"/dataset/evidence-inference","name":"Evidence Inference","full_name":"","num_papers_in_archive":27},{"url":"/dataset/biored","name":"BioRED","full_name":"","num_papers_in_archive":25},{"url":"/dataset/moral-stories","name":"Moral Stories","full_name":"","num_papers_in_archive":24},{"url":"/dataset/eurlex57k","name":"EURLEX57K","full_name":"","num_papers_in_archive":23},{"url":"/dataset/klue","name":"KLUE","full_name":"Korean Language Understanding Evaluation","num_papers_in_archive":21},{"url":"/dataset/terms-of-service","name":"Terms of Service","full_name":"","num_papers_in_archive":21},{"url":"/dataset/pubmed-rct","name":"PubMed RCT","full_name":"PubMed 200k RCT","num_papers_in_archive":20},{"url":"/dataset/lshtc","name":"LSHTC","full_name":"","num_papers_in_archive":18},{"url":"/dataset/turingbench","name":"TURINGBENCH","full_name":"","num_papers_in_archive":18},{"url":"/dataset/smhd","name":"SMHD","full_name":"Self-reported Mental Health Diagnoses","num_papers_in_archive":16},{"url":"/dataset/tweepfake","name":"TweepFake","full_name":"","num_papers_in_archive":16},{"url":"/dataset/beeradvocate","name":"BeerAdvocate","full_name":"","num_papers_in_archive":15},{"url":"/dataset/ade-corpus","name":"Adverse Drug Events (ADE) Corpus","full_name":"","num_papers_in_archive":14},{"url":"/dataset/indonlu-benchmark","name":"IndoNLU Benchmark","full_name":"","num_papers_in_archive":14},{"url":"/dataset/ghostbuster","name":"Ghostbuster","full_name":"","num_papers_in_archive":13},{"url":"/dataset/hopeedi","name":"HopeEDI","full_name":"HopeEDI: A Multilingual Hope Speech Detection Dataset for Equality, Diversity, and Inclusion","num_papers_in_archive":13},{"url":"/dataset/outfox","name":"OUTFOX","full_name":"","num_papers_in_archive":13},{"url":"/dataset/flue-french-language-understanding-evaluation","name":"FLUE","full_name":"French Language Understanding Evaluation","num_papers_in_archive":12},{"url":"/dataset/overruling","name":"Overruling","full_name":"","num_papers_in_archive":12},{"url":"/dataset/mage","name":"MAGE","full_name":"","num_papers_in_archive":11},{"url":"/dataset/ohsumed","name":"Ohsumed","full_name":"","num_papers_in_archive":11},{"url":"/dataset/card-660","name":"CARD-660","full_name":"","num_papers_in_archive":10},{"url":"/dataset/covid-19-twitter-chatter-dataset","name":"COVID-19 Twitter Chatter Dataset","full_name":"","num_papers_in_archive":10},{"url":"/dataset/marc-ja","name":"JGLUE","full_name":"","num_papers_in_archive":7},{"url":"/dataset/tunizi","name":"TUNIZI","full_name":"","num_papers_in_archive":7},{"url":"/dataset/arxiv-10","name":"arXiv-10","full_name":"","num_papers_in_archive":6},{"url":"/dataset/omics","name":"OMICS","full_name":"Open Mind Indoor Common Sense","num_papers_in_archive":6},{"url":"/dataset/trec-10","name":"TREC-10","full_name":"TREC-10 Question Classification","num_papers_in_archive":6},{"url":"/dataset/illness-dataset","name":"Illness-dataset","full_name":"Illness multi-domain textual dataset","num_papers_in_archive":5},{"url":"/dataset/mumin","name":"MuMiN","full_name":"","num_papers_in_archive":5},{"url":"/dataset/taiga-corpus","name":"Taiga Corpus","full_name":"An open-source corpus for machine learning.","num_papers_in_archive":5},{"url":"/dataset/climabench","name":"Climabench","full_name":"","num_papers_in_archive":4},{"url":"/dataset/liar2","name":"LIAR2","full_name":"","num_papers_in_archive":4},{"url":"/dataset/medical-abstracts","name":"Medical Abstracts","full_name":"Medical Abstracts Text Classification Dataset","num_papers_in_archive":4},{"url":"/dataset/metahate","name":"MetaHate","full_name":"","num_papers_in_archive":4},{"url":"/dataset/mixset","name":"MixSet","full_name":"Mixcase Dataset","num_papers_in_archive":4},{"url":"/dataset/mn-ds","name":"MN-DS","full_name":"Multilabeled News Dataset","num_papers_in_archive":4},{"url":"/dataset/sv-ident","name":"SV-Ident","full_name":"Survey Variable Identification","num_papers_in_archive":4},{"url":"/dataset/tarc","name":"TArC","full_name":"","num_papers_in_archive":4},{"url":"/dataset/twitter-sentiment-analysis","name":"Twitter Sentiment Analysis","full_name":"Entity-Level Twitter Sentiment Analysis Dataset","num_papers_in_archive":4},{"url":"/dataset/uit-vsmec","name":"UIT-VSMEC","full_name":"Vietnamese Social Media Emotion Corpus","num_papers_in_archive":4},{"url":"/dataset/fresada","name":"FreSaDa","full_name":"","num_papers_in_archive":3},{"url":"/dataset/lleqa","name":"LLeQA","full_name":"Long-form Legal Question Answering","num_papers_in_archive":3},{"url":"/dataset/muld","name":"MuLD","full_name":"Multitask Long Document Benchmark","num_papers_in_archive":3},{"url":"/dataset/resd","name":"RESD","full_name":"Russian Emotional Speech Dialogs with annotated text","num_papers_in_archive":3},{"url":"/dataset/sdcnl-suicide-vs-depression-classification","name":"SDCNL (Suicide vs Depression Classification)","full_name":"","num_papers_in_archive":3},{"url":"/dataset/tcab","name":"TCAB","full_name":"Text Classification Attack Benchmark","num_papers_in_archive":3},{"url":"/dataset/wikipedia-title","name":"Wikipedia Title","full_name":null,"num_papers_in_archive":3},{"url":"/dataset/ags-corpus","name":"AG’s Corpus","full_name":"AG's corpus of news articlesNews","num_papers_in_archive":2},{"url":"/dataset/biographical","name":"Biographical","full_name":"Biographical: A Semi-Supervised Relation Extraction Dataset","num_papers_in_archive":2},{"url":"/dataset/cic","name":"CIC","full_name":"Catalonia Independence Corpus","num_papers_in_archive":2},{"url":"/dataset/hlgd","name":"HLGD","full_name":"Headline Grouping Dataset","num_papers_in_archive":2},{"url":"/dataset/kanhope","name":"KanHope","full_name":"Kannada Hope speech dataset","num_papers_in_archive":2},{"url":"/dataset/latamxix","name":"LatamXIX","full_name":"19th Century Latin American Spanish Newspaper Corpus with LLM OCR Correction","num_papers_in_archive":2},{"url":"/dataset/law-stack-exchange","name":"Law Stack Exchange","full_name":"","num_papers_in_archive":2},{"url":"/dataset/nlp-taxonomy-classification-test-data","name":"NLP Taxonomy Classification Data","full_name":"","num_papers_in_archive":2},{"url":"/dataset/pmoa-cite","name":"PMOA-CITE","full_name":"PMOA-CITE","num_papers_in_archive":2},{"url":"/dataset/reddit-ideological-and-extreme-bias-dataset","name":"Reddit Ideological and Extreme Bias Dataset","full_name":"","num_papers_in_archive":2},{"url":"/dataset/rsdd-time","name":"RSDD-Time","full_name":"","num_papers_in_archive":2},{"url":"/dataset/rusentne","name":"RuSentNE","full_name":"RuSentNE-2023","num_papers_in_archive":2},{"url":"/dataset/scihtc","name":"SciHTC","full_name":"","num_papers_in_archive":2},{"url":"/dataset/social-media-attributions-of-youtube-comments","name":"Social media attributions of YouTube comments","full_name":"Social media attributions dataset of YouTube comments in the context of water crisis","num_papers_in_archive":2},{"url":"/dataset/the-call-me-sexist-but-dataset-cmsb","name":"The 'Call me sexist but' Dataset (CMSB)","full_name":"","num_papers_in_archive":2},{"url":"/dataset/threatgram-101-extreme-telegram-data","name":"ThreatGram 101 - Extreme Telegram Data","full_name":"ThreatGram 101 - Extreme Telegram Replies Data with Threat Levels","num_papers_in_archive":2},{"url":"/dataset/twitter-stance-election-2020","name":"Twitter Stance Election 2020","full_name":"","num_papers_in_archive":2},{"url":"/dataset/agb-de","name":"AGB-DE","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ai-ga-ai-generated-abstracts-dataset","name":"AI-GA: AI-Generated Abstracts dataset","full_name":"AI-GA: AI-Generated Abstracts dataset","num_papers_in_archive":1},{"url":"/dataset/ai-generated-twitter-timelines","name":"AI-generated Twitter Timelines","full_name":"","num_papers_in_archive":1},{"url":"/dataset/an-amharic-news-text-classification-dataset","name":"An Amharic News Text classification Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/appealcase","name":"AppealCase","full_name":"","num_papers_in_archive":1},{"url":"/dataset/arxiv-categories","name":"arXiv Categories","full_name":"arXiv Categories Multi-label Text Classification Dataset","num_papers_in_archive":1},{"url":"/dataset/avicenna-deductive-commonsense-reasoning","name":"Avicenna: Deductive Commonsense Reasoning","full_name":"","num_papers_in_archive":1},{"url":"/dataset/bala-copa","name":"Bala-Copa","full_name":"Balanced-COPA","num_papers_in_archive":1},{"url":"/dataset/banglabook","name":"BanglaBook","full_name":"Large-scale Bangla Dataset for Sentiment Analysis from Book Reviews","num_papers_in_archive":1},{"url":"/dataset/banglaemotion","name":"BanglaEmotion","full_name":"BanglaEmotion: A Benchmark Dataset for Bangla Textual Emotion Analysis","num_papers_in_archive":1},{"url":"/dataset/basir","name":"BASIR","full_name":"BASIR_Budget_Assisted_Sectoral_Impact_Ranking","num_papers_in_archive":1},{"url":"/dataset/bugclassify","name":"BugClassify","full_name":"","num_papers_in_archive":1},{"url":"/dataset/cards-against-humanity","name":"Cards Against Humanity","full_name":"","num_papers_in_archive":1},{"url":"/dataset/careercoach-2022","name":"CareerCoach 2022","full_name":"","num_papers_in_archive":1},{"url":"/dataset/caselaw4","name":"Caselaw4","full_name":"","num_papers_in_archive":1},{"url":"/dataset/chinese-ai-and-law-cail-2018","name":"Chinese AI and Law (CAIL) 2018","full_name":"","num_papers_in_archive":1},{"url":"/dataset/covid-19-tweets-with-motivation-and-topics","name":"COVID-19 Tweets with Motivation and Topics","full_name":"","num_papers_in_archive":1},{"url":"/dataset/csl-2022","name":"CSL (Chinese Scientific Literature)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/dejan-synthetic-taxonomy-dataset","name":"DEJAN Synthetic Taxonomy Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/dissonance-twitter-dataset","name":"Dissonance Twitter Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/fednlp","name":"FedNLP","full_name":"FOMC Docs and Speeches","num_papers_in_archive":1},{"url":"/dataset/finsen","name":"FinSen","full_name":"","num_papers_in_archive":1},{"url":"/dataset/fmc-mwo2kg","name":"FMC-MWO2KG","full_name":"The MWO2KG Failure Mode Classification Dataset","num_papers_in_archive":1},{"url":"/dataset/forex-news-annotated-dataset-for-sentiment","name":"Forex News Annotated Dataset for Sentiment Analysis","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ftr-18","name":"FTR-18","full_name":"","num_papers_in_archive":1},{"url":"/dataset/gtc-topic-based-paragraph-classification","name":"Genocide Transcript Corpus (GTC): Topic-Based Paragraph Classification in Genocide-Related Court Transcripts","full_name":"","num_papers_in_archive":1},{"url":"/dataset/human-chatgpt-texts","name":"Human-ChatGPT texts","full_name":"","num_papers_in_archive":1},{"url":"/dataset/ilur-news-texts","name":"iLur News Texts","full_name":"","num_papers_in_archive":1},{"url":"/dataset/invisible-mobile-keyboard-dataset","name":"Invisible Mobile Keyboard Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/legal-advice-reddit","name":"Legal Advice Reddit","full_name":"","num_papers_in_archive":1},{"url":"/dataset/lot-insts","name":"Lot-insts","full_name":"Long-Tailed instituition names","num_papers_in_archive":1},{"url":"/dataset/m-phasis","name":"M-Phasis","full_name":"A Feature-Based Corpus of Hate Online","num_papers_in_archive":1},{"url":"/dataset/mathwell-human-annotation-dataset","name":"MATHWELL Human Annotation Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mist","name":"MiST","full_name":"","num_papers_in_archive":1},{"url":"/dataset/modern-hebrew-sentiment-dataset","name":"Modern Hebrew Sentiment Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mumin-large","name":"MuMiN-large","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mumin-medium","name":"MuMiN-medium","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mumin-small","name":"MuMiN-small","full_name":"","num_papers_in_archive":1},{"url":"/dataset/natcat","name":"NatCat","full_name":"","num_papers_in_archive":1},{"url":"/dataset/novic-caption-object-data","name":"NOVIC Caption-Object Data","full_name":"","num_papers_in_archive":1},{"url":"/dataset/paper-field","name":"Paper Field","full_name":"Paper Field","num_papers_in_archive":1},{"url":"/dataset/persian-nlp-hub","name":"Persian NLP Hub","full_name":"","num_papers_in_archive":1},{"url":"/dataset/scientific-statement-classification-dataset","name":"Scientific statement classification dataset from arXMLiv 08.2018","full_name":"","num_papers_in_archive":1},{"url":"/dataset/shapeit","name":"ShapeIt","full_name":"","num_papers_in_archive":1},{"url":"/dataset/shoptc-100k","name":"ShopTC-100K","full_name":"","num_papers_in_archive":1},{"url":"/dataset/shortpersianemo","name":"ShortPersianEmo","full_name":"","num_papers_in_archive":1},{"url":"/dataset/silicone-benchmark","name":"SILICONE Benchmark","full_name":"SILICONE","num_papers_in_archive":1},{"url":"/dataset/smokeng","name":"SmokEng","full_name":"","num_papers_in_archive":1},{"url":"/dataset/steducov-a-dataset-on-stance-detection-in","name":"STEDUCOV: A DATASET ON STANCE DETECTION IN TWEETS TOWARDS ONLINE EDUCATION DURING COVID-19 PANDEMIC","full_name":"","num_papers_in_archive":1},{"url":"/dataset/the-mafia-dataset","name":"The Mafia Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/this-is-not-a-dataset","name":"This is not a Dataset","full_name":"This is not a Dataset: A Large Negation Benchmark to Challenge Large Language Models","num_papers_in_archive":1},{"url":"/dataset/tibetan-news-classification","name":"tibetan_news_classification","full_name":"","num_papers_in_archive":1},{"url":"/dataset/towards-a-data-driven-requirements","name":"Towards a Data-Driven Requirements Engineering Approach: Automatic Analysis of User Reviews","full_name":"","num_papers_in_archive":1},{"url":"/dataset/trilemma-dataset","name":"Trilemma Dataset","full_name":"The Trilemma of Truth in Large Language Models","num_papers_in_archive":1},{"url":"/dataset/truthgen","name":"TruthGen","full_name":"","num_papers_in_archive":1},{"url":"/dataset/twitter-abusive-context","name":"Twitter Abusive Context","full_name":"","num_papers_in_archive":1},{"url":"/dataset/uk-key-stage-readability","name":"UK Key Stage Readability","full_name":"UK Key Stage Readability for English Texts","num_papers_in_archive":1},{"url":"/dataset/user-story-neodataset","name":"User Story NeoDataset","full_name":"User Story NeoDataset","num_papers_in_archive":1},{"url":"/dataset/wiki-en","name":"Wiki-en","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/wiki-reliability","name":"Wiki-Reliability","full_name":"","num_papers_in_archive":1},{"url":"/dataset/wiki-zh","name":"Wiki-zh","full_name":null,"num_papers_in_archive":1},{"url":"/dataset/covid-19-disinfo","name":"COVID-19 Disinfo","full_name":"COVID-19 Disinformation Twitter Dataset","num_papers_in_archive":0},{"url":"/dataset/eduge","name":"Eduge","full_name":"Eduge news classification dataset","num_papers_in_archive":0},{"url":"/dataset/events-classification-biotech","name":"Events classification - Biotech news","full_name":"","num_papers_in_archive":0},{"url":"/dataset/indian-number-plates-dataset-vehicle-number","name":"Indian Number Plates Dataset | Vehicle Number Plates | English OCR Detection","full_name":"","num_papers_in_archive":0},{"url":"/dataset/mnad","name":"MNAD","full_name":"Moroccan News Articles Dataset","num_papers_in_archive":0},{"url":"/dataset/ruadrect","name":"RuADReCT","full_name":"The Russian Adverse Drug Reaction Corpus  of Tweets","num_papers_in_archive":0},{"url":"/dataset/comentarios-vacuna-vph","name":"Text_VPH","full_name":"","num_papers_in_archive":0}],"subtasks":[{"url":"/task/citation-intent-classification","name":"Citation Intent Classification"},{"url":"/task/coherence-evaluation","name":"Coherence Evaluation"},{"url":"/task/cross-domain-text-classification","name":"Cross-Domain Text Classification"},{"url":"/task/document-classification","name":"Document Classification"},{"url":"/task/emotion-classification","name":"Emotion Classification"},{"url":"/task/few-shot-text-classification","name":"Few-Shot Text Classification"},{"url":"/task/hierarchical-text-classification-of-blurbs","name":"Hierarchical Text Classification of Blurbs (GermEval 2019)"},{"url":"/task/multi-label-text-classification","name":"Multi-Label Text Classification"},{"url":"/task/satire-detection","name":"Satire Detection"},{"url":"/task/semi-supervised-text-classification-1","name":"Semi-Supervised Text Classification"},{"url":"/task/sentence-classification","name":"Sentence Classification"},{"url":"/task/text-categorization","name":"Text Categorization"},{"url":"/task/topic-models","name":"Topic Models"},{"url":"/task/toxic-comment-classification","name":"Toxic Comment Classification"},{"url":"/task/unsupervised-text-classification","name":"Unsupervised Text Classification"},{"url":"/task/variable-detection","name":"Variable Detection"}],"parent_tasks":[{"url":"/task/classification-1","name":"Classification"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":1308,"tagged_in_all":3635,"items":[{"url":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","arxiv_id":"1810.04805","repositories_listed":534,"syntology":{"n":659,"n_ran":204,"n_unverified":455,"n_pointer_only":149}},{"url":"/paper/semi-supervised-sequence-learning","title":"Semi-supervised Sequence Learning","date":"2015-11-04","arxiv_id":"1511.01432","repositories_listed":161,"syntology":null},{"url":"/paper/roberta-a-robustly-optimized-bert-pretraining","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","date":"2019-07-26","arxiv_id":"1907.11692","repositories_listed":67,"syntology":{"n":48,"n_ran":22,"n_unverified":26,"n_pointer_only":23}},{"url":"/paper/universal-language-model-fine-tuning-for-text","title":"Universal Language Model Fine-tuning for Text Classification","date":"2018-01-18","arxiv_id":"1801.06146","repositories_listed":66,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":3}},{"url":"/paper/bag-of-tricks-for-efficient-text","title":"Bag of Tricks for Efficient Text Classification","date":"2016-07-06","arxiv_id":"1607.01759","repositories_listed":65,"syntology":{"n":9,"n_ran":2,"n_unverified":7,"n_pointer_only":2}},{"url":"/paper/fasttextzip-compressing-text-classification","title":"FastText.zip: Compressing text classification models","date":"2016-12-12","arxiv_id":"1612.03651","repositories_listed":44,"syntology":{"n":18,"n_ran":3,"n_unverified":15,"n_pointer_only":12}},{"url":"/paper/character-level-convolutional-networks-for","title":"Character-level Convolutional Networks for Text Classification","date":"2015-09-04","arxiv_id":"1509.01626","repositories_listed":30,"syntology":{"n":20,"n_ran":4,"n_unverified":16,"n_pointer_only":5}},{"url":"/paper/xlnet-generalized-autoregressive-pretraining","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","date":"2019-06-19","arxiv_id":"1906.08237","repositories_listed":27,"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}},{"url":"/paper/distributed-representations-of-sentences-and","title":"Distributed Representations of Sentences and Documents","date":"2014-05-16","arxiv_id":"1405.4053","repositories_listed":27,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/revisiting-semi-supervised-learning-with","title":"Revisiting Semi-Supervised Learning with Graph Embeddings","date":"2016-03-29","arxiv_id":"1603.08861","repositories_listed":26,"syntology":{"n":28,"n_ran":15,"n_unverified":13,"n_pointer_only":4}},{"url":"/paper/universal-sentence-encoder","title":"Universal Sentence Encoder","date":"2018-03-29","arxiv_id":"1803.11175","repositories_listed":24,"syntology":{"n":22,"n_ran":1,"n_unverified":21,"n_pointer_only":1}},{"url":"/paper/very-deep-convolutional-networks-for-text","title":"Very Deep Convolutional Networks for Text Classification","date":"2016-06-06","arxiv_id":"1606.01781","repositories_listed":24,"syntology":{"n":5,"n_ran":3,"n_unverified":2,"n_pointer_only":5}},{"url":"/paper/roformer-enhanced-transformer-with-rotary","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","date":"2021-04-20","arxiv_id":"2104.09864","repositories_listed":20,"syntology":{"n":16,"n_ran":14,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/unsupervised-data-augmentation-1","title":"Unsupervised Data Augmentation for Consistency Training","date":"2019-04-29","arxiv_id":"1904.12848","repositories_listed":20,"syntology":{"n":52,"n_ran":15,"n_unverified":37,"n_pointer_only":9}},{"url":"/paper/parameter-efficient-transfer-learning-for-nlp","title":"Parameter-Efficient Transfer Learning for NLP","date":"2019-02-02","arxiv_id":"1902.00751","repositories_listed":17,"syntology":{"n":22,"n_ran":8,"n_unverified":14,"n_pointer_only":3}},{"url":"/paper/eda-easy-data-augmentation-techniques-for","title":"EDA: Easy Data Augmentation Techniques for Boosting Performance on Text Classification Tasks","date":"2019-01-31","arxiv_id":"1901.11196","repositories_listed":16,"syntology":{"n":13,"n_ran":2,"n_unverified":11,"n_pointer_only":1}},{"url":"/paper/how-to-fine-tune-bert-for-text-classification","title":"How to Fine-Tune BERT for Text Classification?","date":"2019-05-14","arxiv_id":"1905.05583","repositories_listed":15,"syntology":{"n":18,"n_ran":6,"n_unverified":12,"n_pointer_only":5}},{"url":"/paper/big-bird-transformers-for-longer-sequences","title":"Big Bird: Transformers for Longer Sequences","date":"2020-07-28","arxiv_id":"2007.14062","repositories_listed":14,"syntology":{"n":15,"n_ran":10,"n_unverified":5,"n_pointer_only":11}},{"url":"/paper/fastformer-additive-attention-is-all-you-need","title":"Fastformer: Additive Attention Can Be All You Need","date":"2021-08-20","arxiv_id":"2108.09084","repositories_listed":13,"syntology":{"n":4,"n_ran":4,"n_unverified":0,"n_pointer_only":3}},{"url":"/paper/fnet-mixing-tokens-with-fourier-transforms","title":"FNet: Mixing Tokens with Fourier Transforms","date":"2021-05-09","arxiv_id":"2105.03824","repositories_listed":12,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/simple-recurrent-units-for-highly","title":"Simple Recurrent Units for Highly Parallelizable Recurrence","date":"2017-09-08","arxiv_id":"1709.02755","repositories_listed":11,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/a-c-lstm-neural-network-for-text","title":"A C-LSTM Neural Network for Text Classification","date":"2015-11-27","arxiv_id":"1511.08630","repositories_listed":10,"syntology":null},{"url":"/paper/ask-me-anything-dynamic-memory-networks-for","title":"Ask Me Anything: Dynamic Memory Networks for Natural Language Processing","date":"2015-06-24","arxiv_id":"1506.07285","repositories_listed":10,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/graph-convolutional-networks-for-text","title":"Graph Convolutional Networks for Text Classification","date":"2018-09-15","arxiv_id":"1809.05679","repositories_listed":9,"syntology":{"n":16,"n_ran":6,"n_unverified":10,"n_pointer_only":6}},{"url":"/paper/pubmed-200k-rct-a-dataset-for-sequential","title":"PubMed 200k RCT: a Dataset for Sequential Sentence Classification in Medical Abstracts","date":"2017-10-17","arxiv_id":"1710.06071","repositories_listed":9,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/flaubert-unsupervised-language-model-pre","title":"FlauBERT: Unsupervised Language Model Pre-training for French","date":"2019-12-11","arxiv_id":"1912.05372","repositories_listed":7,"syntology":{"n":9,"n_ran":1,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/is-bert-really-robust-natural-language-attack","title":"Is BERT Really Robust? A Strong Baseline for Natural Language Attack on Text Classification and Entailment","date":"2019-07-27","arxiv_id":"1907.11932","repositories_listed":7,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}},{"url":"/paper/simplifying-graph-convolutional-networks","title":"Simplifying Graph Convolutional Networks","date":"2019-02-19","arxiv_id":"1902.07153","repositories_listed":7,"syntology":{"n":8,"n_ran":3,"n_unverified":5,"n_pointer_only":0}},{"url":"/paper/distributed-word-representation-in-tsetlin","title":"Enhancing Interpretable Clauses Semantically using Pretrained Word Representation","date":"2021-04-14","arxiv_id":"2104.06901","repositories_listed":6,"syntology":null},{"url":"/paper/hatexplain-a-benchmark-dataset-for","title":"HateXplain: A Benchmark Dataset for Explainable Hate Speech Detection","date":"2020-12-18","arxiv_id":"2012.10289","repositories_listed":6,"syntology":null}],"syntology_records":26,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}