{"url":"/task/paraphrase-identification","name":"Paraphrase Identification","slug":"paraphrase-identification","description_markdown":"The goal of **Paraphrase Identification** is to determine whether a pair of sentences have the same meaning.\r\n\r\n\r\n<span class=\"description-source\">Source: [Adversarial Examples with Difficult Common Words for Paraphrase Identification ](https://arxiv.org/abs/1909.02560)</span>\r\n\r\nImage source: [On Paraphrase Identification Corpora ](http://www.lrec-conf.org/proceedings/lrec2014/pdf/1000_Paper.pdf)","categories":[{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":172,"papers_with_code":76,"benchmarks":11,"benchmark_tables_in_archive":11,"benchmark_tables_shown":11,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":18,"subtasks":0,"parent_tasks":1},"benchmarks":[{"leaderboard":"/sota/paraphrase-identification-on-quora-question","slug":"paraphrase-identification-on-quora-question","dataset":"Quora Question Pairs","dataset_url":"/dataset/quora-question-pairs","rows_in_archive":31,"metrics":["F1","Accuracy","Direct Intrinsic Dimension","Structure Aware Intrinsic Dimension","Dev Accuracy","Accuarcy","Dev F1"],"first_row_in_archive_order":{"model":"ALICE","paper_title":"SMART: Robust and Efficient Fine-Tuning for Pre-trained Natural Language Models through Principled Regularized Optimization","paper_url":"/paper/smart-robust-and-efficient-fine-tuning-for","paper_date":"2019-11-08","arxiv_id":"1911.03437","code_links":[{"title":"namisan/mt-dnn","url":"https://github.com/namisan/mt-dnn"},{"title":"microsoft/MT-DNN","url":"https://github.com/microsoft/MT-DNN"},{"title":"archinetai/smart-pytorch","url":"https://github.com/archinetai/smart-pytorch"},{"title":"archinetai/vat-pytorch","url":"https://github.com/archinetai/vat-pytorch"},{"title":"cliang1453/camero","url":"https://github.com/cliang1453/camero"},{"title":"chunhuililili/mt_dnn","url":"https://github.com/chunhuililili/mt_dnn"}],"syntology":{"n":8,"n_ran":6,"n_unverified":2,"n_pointer_only":1}}},{"leaderboard":"/sota/paraphrase-identification-on-msrp","slug":"paraphrase-identification-on-msrp","dataset":"MSRP","dataset_url":null,"rows_in_archive":3,"metrics":["Accuracy","F1"],"first_row_in_archive_order":{"model":"FEAT2, TFKLD, SVM, Fine-grained features","paper_title":"Discriminative Improvements to Distributional Sentence Similarity","paper_url":"/paper/discriminative-improvements-to-distributional","paper_date":"2013-10-01","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-quora-question-1","slug":"paraphrase-identification-on-quora-question-1","dataset":"Quora Question Pairs Dev","dataset_url":"/dataset/quora-question-pairs","rows_in_archive":2,"metrics":["Val Accuracy","Val F1 Score"],"first_row_in_archive_order":{"model":"BERT + SCH attm","paper_title":"Memory-efficient Stochastic methods for Memory-based Transformers","paper_url":"/paper/memory-efficient-stochastic-methods-for","paper_date":"2023-11-14","arxiv_id":"2311.08123","code_links":[{"title":"vishwajit-vishnu/memory-efficient-stochastic-methods-for-memory-based-transformers","url":"https://github.com/vishwajit-vishnu/memory-efficient-stochastic-methods-for-memory-based-transformers"}],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-2017-test-set","slug":"paraphrase-identification-on-2017-test-set","dataset":"2017_test set","dataset_url":null,"rows_in_archive":1,"metrics":["10 fold Cross validation"],"first_row_in_archive_order":{"model":"CNN","paper_title":"Neural Network Models for Paraphrase Identification, Semantic Textual Similarity, Natural Language Inference, and Question Answering","paper_url":"/paper/neural-network-models-for-paraphrase","paper_date":"2018-06-12","arxiv_id":"1806.04330","code_links":[{"title":"lanwuwei/SPM_toolkit","url":"https://github.com/lanwuwei/SPM_toolkit"}],"syntology":{"n":2,"n_ran":1,"n_unverified":1,"n_pointer_only":2}}},{"leaderboard":"/sota/paraphrase-identification-on-ap","slug":"paraphrase-identification-on-ap","dataset":"AP","dataset_url":"/dataset/ap","rows_in_archive":1,"metrics":["MCC"],"first_row_in_archive_order":{"model":"RoBETRa base","paper_title":"Improving Paraphrase Detection with the Adversarial Paraphrasing Task","paper_url":"/paper/improving-paraphrase-detection-with-the","paper_date":"2021-06-14","arxiv_id":"2106.07691","code_links":[{"title":"Advancing-Machine-Human-Reasoning-Lab/apt","url":"https://github.com/Advancing-Machine-Human-Reasoning-Lab/apt"}],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-imdb","slug":"paraphrase-identification-on-imdb","dataset":"IMDb","dataset_url":"/dataset/imdb-movie-reviews","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"SplitEE-S","paper_title":"SplitEE: Early Exit in Deep Neural Networks with Split Computing","paper_url":"/paper/splitee-early-exit-in-deep-neural-networks","paper_date":"2023-09-17","arxiv_id":"2309.09195","code_links":[{"title":"Div290/SplitEE","url":"https://github.com/Div290/SplitEE/blob/main/README.md"}],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-pit","slug":"paraphrase-identification-on-pit","dataset":"PIT","dataset_url":"/dataset/pit","rows_in_archive":1,"metrics":["AP"],"first_row_in_archive_order":{"model":"TSDAE","paper_title":"TSDAE: Using Transformer-based Sequential Denoising Auto-Encoder for Unsupervised Sentence Embedding Learning","paper_url":"/paper/tsdae-using-transformer-based-sequential","paper_date":"2021-04-14","arxiv_id":"2104.06979","code_links":[{"title":"kwang2049/pytorch-bertflow","url":"https://github.com/kwang2049/pytorch-bertflow"},{"title":"ukplab/pytorch-bertflow","url":"https://github.com/ukplab/pytorch-bertflow"},{"title":"kwang2049/useb","url":"https://github.com/kwang2049/useb"},{"title":"UKPLab/useb","url":"https://github.com/UKPLab/useb"},{"title":"climsocana/tecb-de","url":"https://github.com/climsocana/tecb-de"},{"title":"exploration-lab/iitk-semeval-2024-task-1","url":"https://github.com/exploration-lab/iitk-semeval-2024-task-1"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/paraphrase-identification-on-translated-snli","slug":"paraphrase-identification-on-translated-snli","dataset":"Translated SNLI Dataset in Marathi","dataset_url":"/dataset/translated-snli-dataset-in-marathi","rows_in_archive":1,"metrics":["1:1 Accuracy"],"first_row_in_archive_order":{"model":"Weighted Ensemble of TF-IDF and BERT Embeddings","paper_title":"Enhancing Plagiarism Detection in Marathi with a Weighted Ensemble of TF-IDF and BERT Embeddings for Low-Resource Language Processing","paper_url":"/paper/enhancing-plagiarism-detection-in-marathi","paper_date":"2025-01-09","arxiv_id":"2501.05260","code_links":[{"title":"aditya-choudhary599/Marathi-Plagiarism-Detection","url":"https://github.com/aditya-choudhary599/Marathi-Plagiarism-Detection"}],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-turl","slug":"paraphrase-identification-on-turl","dataset":"TURL","dataset_url":"/dataset/twitter-news-url-corpus","rows_in_archive":1,"metrics":["AP"],"first_row_in_archive_order":{"model":"TSDAE","paper_title":"TSDAE: Using Transformer-based Sequential Denoising Auto-Encoder for Unsupervised Sentence Embedding Learning","paper_url":"/paper/tsdae-using-transformer-based-sequential","paper_date":"2021-04-14","arxiv_id":"2104.06979","code_links":[{"title":"kwang2049/pytorch-bertflow","url":"https://github.com/kwang2049/pytorch-bertflow"},{"title":"ukplab/pytorch-bertflow","url":"https://github.com/ukplab/pytorch-bertflow"},{"title":"kwang2049/useb","url":"https://github.com/kwang2049/useb"},{"title":"UKPLab/useb","url":"https://github.com/UKPLab/useb"},{"title":"climsocana/tecb-de","url":"https://github.com/climsocana/tecb-de"},{"title":"exploration-lab/iitk-semeval-2024-task-1","url":"https://github.com/exploration-lab/iitk-semeval-2024-task-1"}],"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}}},{"leaderboard":"/sota/paraphrase-identification-on-wikihop","slug":"paraphrase-identification-on-wikihop","dataset":"WikiHop","dataset_url":"/dataset/wikihop","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"StructBERTRoBERTa ensemble","paper_title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","paper_url":"/paper/structbert-incorporating-language-structures","paper_date":"2019-08-13","arxiv_id":"1908.04577","code_links":[],"syntology":null}},{"leaderboard":"/sota/paraphrase-identification-on-yelp","slug":"paraphrase-identification-on-yelp","dataset":"Yelp","dataset_url":"/dataset/yelp","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"SplitEE-S","paper_title":"SplitEE: Early Exit in Deep Neural Networks with Split Computing","paper_url":"/paper/splitee-early-exit-in-deep-neural-networks","paper_date":"2023-09-17","arxiv_id":"2309.09195","code_links":[{"title":"Div290/SplitEE","url":"https://github.com/Div290/SplitEE/blob/main/README.md"}],"syntology":null}}],"datasets":[{"url":"/dataset/imdb-movie-reviews","name":"IMDb Movie Reviews","full_name":"","num_papers_in_archive":1787},{"url":"/dataset/paws-x","name":"PAWS-X","full_name":"PAWS-X","num_papers_in_archive":172},{"url":"/dataset/paws","name":"PAWS","full_name":"Paraphrase Adversaries from Word Scrambling","num_papers_in_archive":159},{"url":"/dataset/yelp","name":"Yelp","full_name":"","num_papers_in_archive":86},{"url":"/dataset/wikihop","name":"WikiHop","full_name":"","num_papers_in_archive":66},{"url":"/dataset/quora-question-pairs","name":"Quora Question Pairs","full_name":"","num_papers_in_archive":55},{"url":"/dataset/pit","name":"PIT","full_name":"Paraphrase and Semantic Similarity in Twitter","num_papers_in_archive":22},{"url":"/dataset/paralex","name":"Paralex","full_name":"","num_papers_in_archive":20},{"url":"/dataset/flue-french-language-understanding-evaluation","name":"FLUE","full_name":"French Language Understanding Evaluation","num_papers_in_archive":12},{"url":"/dataset/twitter-news-url-corpus","name":"TURL","full_name":"Twitter News URL Corpus","num_papers_in_archive":6},{"url":"/dataset/finnish-paraphrase-corpus","name":"Finnish Paraphrase Corpus","full_name":"","num_papers_in_archive":4},{"url":"/dataset/sv-ident","name":"SV-Ident","full_name":"Survey Variable Identification","num_papers_in_archive":4},{"url":"/dataset/parade","name":"PARADE","full_name":"","num_papers_in_archive":3},{"url":"/dataset/ap","name":"AP","full_name":"Adversarial Paraphrase","num_papers_in_archive":1},{"url":"/dataset/benchmark-for-neural-paraphrase-detection","name":"Autoencoder Paraphrase Dataset (AEPD)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/autoregressive-paraphrase-dataset-apd","name":"Autoregressive Paraphrase Dataset (ARPD)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/identifying-machine-paraphrased-plagiarism","name":"Machine Prarphrase Corpus (MPC)","full_name":"","num_papers_in_archive":1},{"url":"/dataset/translated-snli-dataset-in-marathi","name":"Translated SNLI Dataset in Marathi","full_name":"","num_papers_in_archive":1}],"subtasks":[],"parent_tasks":[{"url":"/task/semantic-textual-similarity","name":"Semantic Textual Similarity"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":76,"tagged_in_all":172,"items":[{"url":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","arxiv_id":"1810.04805","repositories_listed":534,"syntology":{"n":659,"n_ran":204,"n_unverified":455,"n_pointer_only":149}},{"url":"/paper/xlnet-generalized-autoregressive-pretraining","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","date":"2019-06-19","arxiv_id":"1906.08237","repositories_listed":27,"syntology":{"n":24,"n_ran":10,"n_unverified":14,"n_pointer_only":3}},{"url":"/paper/data2vec-a-general-framework-for-self-1","title":"data2vec: A General Framework for Self-supervised Learning in Speech, Vision and Language","date":"2022-02-07","arxiv_id":"2202.03555","repositories_listed":12,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/fnet-mixing-tokens-with-fourier-transforms","title":"FNet: Mixing Tokens with Fourier Transforms","date":"2021-05-09","arxiv_id":"2105.03824","repositories_listed":12,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/190910351","title":"TinyBERT: Distilling BERT for Natural Language Understanding","date":"2019-09-23","arxiv_id":"1909.10351","repositories_listed":10,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":4}},{"url":"/paper/bilateral-multi-perspective-matching-for","title":"Bilateral Multi-Perspective Matching for Natural Language Sentences","date":"2017-02-13","arxiv_id":"1702.03814","repositories_listed":10,"syntology":{"n":4,"n_ran":1,"n_unverified":3,"n_pointer_only":1}},{"url":"/paper/scaling-instruction-finetuned-language-models","title":"Scaling Instruction-Finetuned Language Models","date":"2022-10-20","arxiv_id":"2210.11416","repositories_listed":9,"syntology":{"n":17,"n_ran":8,"n_unverified":9,"n_pointer_only":2}},{"url":"/paper/abcnn-attention-based-convolutional-neural","title":"ABCNN: Attention-Based Convolutional Neural Network for Modeling Sentence Pairs","date":"2015-12-16","arxiv_id":"1512.05193","repositories_listed":8,"syntology":null},{"url":"/paper/multi-task-deep-neural-networks-for-natural","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","date":"2019-01-31","arxiv_id":"1901.11504","repositories_listed":7,"syntology":{"n":13,"n_ran":5,"n_unverified":8,"n_pointer_only":2}},{"url":"/paper/tsdae-using-transformer-based-sequential","title":"TSDAE: Using Transformer-based Sequential Denoising Auto-Encoder for Unsupervised Sentence Embedding Learning","date":"2021-04-14","arxiv_id":"2104.06979","repositories_listed":6,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/smart-robust-and-efficient-fine-tuning-for","title":"SMART: Robust and Efficient Fine-Tuning for Pre-trained Natural Language Models through Principled Regularized Optimization","date":"2019-11-08","arxiv_id":"1911.03437","repositories_listed":6,"syntology":{"n":8,"n_ran":6,"n_unverified":2,"n_pointer_only":1}},{"url":"/paper/spanbert-improving-pre-training-by","title":"SpanBERT: Improving Pre-training by Representing and Predicting Spans","date":"2019-07-24","arxiv_id":"1907.10529","repositories_listed":6,"syntology":{"n":15,"n_ran":3,"n_unverified":12,"n_pointer_only":4}},{"url":"/paper/informer-transformer-likes-informed-attention","title":"RealFormer: Transformer Likes Residual Attention","date":"2020-12-21","arxiv_id":"2012.11747","repositories_listed":5,"syntology":null},{"url":"/paper/dice-loss-for-data-imbalanced-nlp-tasks","title":"Dice Loss for Data-imbalanced NLP Tasks","date":"2019-11-07","arxiv_id":"1911.02855","repositories_listed":4,"syntology":{"n":3,"n_ran":0,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/learning-general-purpose-distributed-sentence","title":"Learning General Purpose Distributed Sentence Representations via Large Scale Multi-task Learning","date":"2018-03-30","arxiv_id":"1804.00079","repositories_listed":4,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":3}},{"url":"/paper/entailment-as-few-shot-learner","title":"Entailment as Few-Shot Learner","date":"2021-04-29","arxiv_id":"2104.14690","repositories_listed":3,"syntology":{"n":3,"n_ran":1,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/paws-x-a-cross-lingual-adversarial-dataset","title":"PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification","date":"2019-08-30","arxiv_id":"1908.11828","repositories_listed":3,"syntology":null},{"url":"/paper/simple-and-effective-text-matching-with-1","title":"Simple and Effective Text Matching with Richer Alignment Features","date":"2019-08-01","arxiv_id":"1908.00300","repositories_listed":3,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/a-deep-relevance-matching-model-for-ad-hoc","title":"A Deep Relevance Matching Model for Ad-hoc Retrieval","date":"2017-11-23","arxiv_id":"1711.08611","repositories_listed":3,"syntology":null},{"url":"/paper/charformer-fast-character-transformers-via","title":"Charformer: Fast Character Transformers via Gradient-based Subword Tokenization","date":"2021-06-23","arxiv_id":"2106.12672","repositories_listed":2,"syntology":{"n":10,"n_ran":7,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/intrinsic-dimensionality-explains-the","title":"Intrinsic Dimensionality Explains the Effectiveness of Language Model Fine-Tuning","date":"2020-12-22","arxiv_id":"2012.13255","repositories_listed":2,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/pay-attention-when-required","title":"Pay Attention when Required","date":"2020-09-09","arxiv_id":"2009.04534","repositories_listed":2,"syntology":null},{"url":"/paper/adaptation-of-deep-bidirectional-multilingual","title":"Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language","date":"2019-05-17","arxiv_id":"1905.07213","repositories_listed":2,"syntology":null},{"url":"/paper/ernie-enhanced-language-representation-with","title":"ERNIE: Enhanced Language Representation with Informative Entities","date":"2019-05-17","arxiv_id":"1905.07129","repositories_listed":2,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/paws-paraphrase-adversaries-from-word","title":"PAWS: Paraphrase Adversaries from Word Scrambling","date":"2019-04-01","arxiv_id":"1904.01130","repositories_listed":2,"syntology":null},{"url":"/paper/natural-language-inference-over-interaction-1","title":"Natural Language Inference over Interaction Space","date":"2017-09-13","arxiv_id":"1709.04348","repositories_listed":2,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/enhancing-paraphrase-type-generation-the","title":"Enhancing Paraphrase Type Generation: The Impact of DPO and RLHF Evaluated with Human-Ranked Data","date":"2025-05-28","arxiv_id":"2506.02018","repositories_listed":1,"syntology":null},{"url":"/paper/enhancing-plagiarism-detection-in-marathi","title":"Enhancing Plagiarism Detection in Marathi with a Weighted Ensemble of TF-IDF and BERT Embeddings for Low-Resource Language Processing","date":"2025-01-09","arxiv_id":"2501.05260","repositories_listed":1,"syntology":null},{"url":"/paper/tougher-text-smarter-models-raising-the-bar","title":"Tougher Text, Smarter Models: Raising the Bar for Adversarial Defence Benchmarks","date":"2025-01-05","arxiv_id":"2501.02654","repositories_listed":1,"syntology":null},{"url":"/paper/application-specific-compression-of-deep","title":"Application Specific Compression of Deep Learning Models","date":"2024-09-09","arxiv_id":"2409.05368","repositories_listed":1,"syntology":null}],"syntology_records":19,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}