{"url":"/task/semantic-similarity","name":"Semantic Similarity","slug":"semantic-similarity","description_markdown":"The main objective **Semantic Similarity** is to measure the distance between the semantic meanings of a pair of words, phrases, sentences, or documents. For example, the word “car” is more similar to “bus” than it is to “cat”. The two main approaches to measuring Semantic Similarity are knowledge-based approaches and corpus-based, distributional methods.\n\n\n<span class=\"description-source\">Source: [Visual and Semantic Knowledge Transfer for Large Scale Semi-supervised Object Detection ](https://arxiv.org/abs/1801.03145)</span>","categories":[{"name":"Methodology","url":"/area/methodology"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":1564,"papers_with_code":534,"benchmarks":7,"benchmark_tables_in_archive":27,"benchmark_tables_shown":27,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":17,"subtasks":2,"parent_tasks":1},"benchmarks":[{"leaderboard":"/sota/semantic-similarity-on-sick","slug":"semantic-similarity-on-sick","dataset":"SICK","dataset_url":"/dataset/sick","rows_in_archive":5,"metrics":["MSE","Pearson Correlation","Spearman Correlation"],"first_row_in_archive_order":{"model":"Dependency Tree-LSTM (Tai et al., 2015)","paper_title":"Improved Semantic Representations From Tree-Structured Long Short-Term Memory Networks","paper_url":"/paper/improved-semantic-representations-from-tree","paper_date":"2015-02-28","arxiv_id":"1503.00075","code_links":[{"title":"dmlc/dgl","url":"https://github.com/dmlc/dgl/tree/master/examples/pytorch/tree_lstm"},{"title":"dmlc/dgl","url":"https://github.com/dmlc/dgl/tree/master/examples/mxnet/tree_lstm"},{"title":"tensorflow/fold","url":"https://github.com/tensorflow/fold"},{"title":"stanfordnlp/treelstm","url":"https://github.com/stanfordnlp/treelstm"},{"title":"dasguptar/treelstm.pytorch","url":"https://github.com/dasguptar/treelstm.pytorch"},{"title":"ttpro1995/TreeLSTMSentiment","url":"https://github.com/ttpro1995/TreeLSTMSentiment"},{"title":"inyukwo1/tree-lstm","url":"https://github.com/inyukwo1/tree-lstm"},{"title":"munashe5/SemanticTreeLSTM","url":"https://github.com/munashe5/SemanticTreeLSTM"},{"title":"tomekkorbak/treehopper","url":"https://github.com/tomekkorbak/treehopper"},{"title":"EmilReinert/DeepLearningPipelines","url":"https://github.com/EmilReinert/DeepLearningPipelines"},{"title":"rohitguptacs/ReVal","url":"https://github.com/rohitguptacs/ReVal"},{"title":"vastsak/tree_structured_gru","url":"https://github.com/vastsak/tree_structured_gru"},{"title":"zxk19981227/LSTM-SST","url":"https://github.com/zxk19981227/LSTM-SST"},{"title":"Mind23-2/MindCode-17","url":"https://github.com/Mind23-2/MindCode-17"},{"title":"jayanti-prasad/TreeLSTM","url":"https://github.com/jayanti-prasad/TreeLSTM"},{"title":"Vivswan/Sentiment-Analysis-TreeLSTM","url":"https://github.com/Vivswan/Sentiment-Analysis-TreeLSTM"}],"syntology":{"n":15,"n_ran":6,"n_unverified":9,"n_pointer_only":6}}},{"leaderboard":"/sota/sentence-embeddings-for-biomedical-texts-on-3","slug":"sentence-embeddings-for-biomedical-texts-on-3","dataset":"Annotated corpus for semantic similarity of clinical trial outcomes (original corpus)","dataset_url":null,"rows_in_archive":5,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"BioBERT\n(pre-trained on PubMed abstracts + PMC, fine-tuned on \"Annotated corpus for semantic similarity of clinical trial outcomes, original corpus\")","paper_title":"Measuring semantic similarity of clinical trial outcomes using deep pre-trained language representations","paper_url":"/paper/measuring-semantic-similarity-of-clinical","paper_date":"2019-10-17","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/sentence-embeddings-for-biomedical-texts-on-4","slug":"sentence-embeddings-for-biomedical-texts-on-4","dataset":"Annotated corpus for semantic similarity of clinical trial outcomes (expanded corpus)","dataset_url":null,"rows_in_archive":5,"metrics":["F1","Precision","Recall"],"first_row_in_archive_order":{"model":"BioBERT (pre-trained on PubMed abstracts + PMC, fine-tuned on \"Annotated corpus for semantic similarity of clinical trial outcomes, expanded corpus\")","paper_title":"Measuring semantic similarity of clinical trial outcomes using deep pre-trained language representations","paper_url":"/paper/measuring-semantic-similarity-of-clinical","paper_date":"2019-10-17","arxiv_id":null,"code_links":[],"syntology":null}},{"leaderboard":"/sota/semantic-similarity-on-biosses","slug":"semantic-similarity-on-biosses","dataset":"BIOSSES","dataset_url":"/dataset/biosses","rows_in_archive":3,"metrics":["Pearson Correlation"],"first_row_in_archive_order":{"model":"BioLinkBERT (large)","paper_title":"LinkBERT: Pretraining Language Models with Document Links","paper_url":"/paper/linkbert-pretraining-language-models-with","paper_date":"2022-03-29","arxiv_id":"2203.15827","code_links":[{"title":"michiyasunaga/LinkBERT","url":"https://github.com/michiyasunaga/LinkBERT"}],"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-similarity-on-chip-sts","slug":"semantic-similarity-on-chip-sts","dataset":"CHIP-STS","dataset_url":"/dataset/chip-sts","rows_in_archive":1,"metrics":["Macro F1"],"first_row_in_archive_order":{"model":"MacBERT-large","paper_title":"CBLUE: A Chinese Biomedical Language Understanding Evaluation Benchmark","paper_url":"/paper/cblue-a-chinese-biomedical-language","paper_date":"2021-06-15","arxiv_id":"2106.08087","code_links":[{"title":"cbluebenchmark/cblue","url":"https://github.com/cbluebenchmark/cblue"},{"title":"freedomintelligence/sdak","url":"https://github.com/freedomintelligence/sdak"}],"syntology":{"n":16,"n_ran":4,"n_unverified":12,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-similarity-on-clinicalsts","slug":"semantic-similarity-on-clinicalsts","dataset":"ClinicalSTS","dataset_url":null,"rows_in_archive":1,"metrics":["Pearson Correlation"],"first_row_in_archive_order":{"model":"CharacterBERT (base, medical, ensemble)","paper_title":"CharacterBERT: Reconciling ELMo and BERT for Word-Level Open-Vocabulary Representations From Characters","paper_url":"/paper/characterbert-reconciling-elmo-and-bert-for","paper_date":"2020-10-20","arxiv_id":"2010.10392","code_links":[{"title":"helboukkouri/character-bert","url":"https://github.com/helboukkouri/character-bert"},{"title":"IMPLabUniPr/UniParma-at-semeval-2021-task-5","url":"https://github.com/IMPLabUniPr/UniParma-at-semeval-2021-task-5"}],"syntology":{"n":8,"n_ran":5,"n_unverified":3,"n_pointer_only":0}}},{"leaderboard":"/sota/semantic-similarity-on-medsts","slug":"semantic-similarity-on-medsts","dataset":"MedSTS","dataset_url":null,"rows_in_archive":1,"metrics":["Pearson Correlation"],"first_row_in_archive_order":{"model":"NCBI_BERT(base) (P+M)","paper_title":"Transfer Learning in Biomedical Natural Language Processing: An Evaluation of BERT and ELMo on Ten Benchmarking Datasets","paper_url":"/paper/transfer-learning-in-biomedical-natural","paper_date":"2019-06-13","arxiv_id":"1906.05474","code_links":[{"title":"ncbi-nlp/NCBI_BERT","url":"https://github.com/ncbi-nlp/NCBI_BERT"},{"title":"bigscience-workshop/biomedical","url":"https://github.com/bigscience-workshop/biomedical"},{"title":"ncbi-nlp/BLUE_Benchmark","url":"https://github.com/ncbi-nlp/BLUE_Benchmark"},{"title":"gmpoli/electramed","url":"https://github.com/gmpoli/electramed"}],"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":0}}},{"leaderboard":null,"slug":"semantic-similarity-on-dev-evaluation","dataset":"dev evaluation","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-jsts","dataset":"JSTS","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev","dataset":"sts dev","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Pearson Dot","Pearson Euclidean","Pearson Manhattan","Pearson Max","Spearman Cosine","Spearman Dot","Spearman Euclidean","Spearman Manhattan","Spearman Max"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev-128","dataset":"sts dev 128","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev-256","dataset":"sts dev 256","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev-512","dataset":"sts dev 512","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev-64","dataset":"sts dev 64","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-dev-768","dataset":"sts dev 768","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-test-128","dataset":"sts test 128","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-test-256","dataset":"sts test 256","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-test-512","dataset":"sts test 512","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-test-64","dataset":"sts test 64","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts-test-768","dataset":"sts test 768","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts17-en-ua","dataset":"sts17 en ua","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts17-es-en-test","dataset":"sts17 es en test","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-sts17-ua-ua","dataset":"sts17 ua ua","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-stsb-multi-mt-en","dataset":"stsb multi mt en","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-stsb-tr","dataset":"stsb tr","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-test-t","dataset":"test t","dataset_url":null,"rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null},{"leaderboard":null,"slug":"semantic-similarity-on-unknown","dataset":"Unknown","dataset_url":"/dataset/conll-2003","rows_in_archive":0,"metrics":["Pearson Cosine","Spearman Cosine"],"first_row_in_archive_order":null}],"datasets":[{"url":"/dataset/mnist","name":"MNIST","full_name":"","num_papers_in_archive":7651},{"url":"/dataset/conll-2003","name":"CoNLL 2003","full_name":"","num_papers_in_archive":755},{"url":"/dataset/sick","name":"SICK","full_name":"Sentences Involving Compositional Knowledge","num_papers_in_archive":348},{"url":"/dataset/biosses","name":"BIOSSES","full_name":"Biomedical Semantic Similarity Estimation System","num_papers_in_archive":38},{"url":"/dataset/multifc","name":"MultiFC","full_name":"","num_papers_in_archive":21},{"url":"/dataset/chip-sts","name":"CHIP-STS","full_name":"Semantic Textual Similarity Dataset","num_papers_in_archive":8},{"url":"/dataset/sugarcrepe","name":"SugarCrepe++","full_name":"SugarCrepe++","num_papers_in_archive":5},{"url":"/dataset/sv-ident","name":"SV-Ident","full_name":"Survey Variable Identification","num_papers_in_archive":4},{"url":"/dataset/cos960","name":"COS960","full_name":"","num_papers_in_archive":3},{"url":"/dataset/spokensts","name":"SpokenSTS","full_name":"","num_papers_in_archive":3},{"url":"/dataset/japanese-word-similarity","name":"Japanese Word Similarity","full_name":null,"num_papers_in_archive":2},{"url":"/dataset/latamxix","name":"LatamXIX","full_name":"19th Century Latin American Spanish Newspaper Corpus with LLM OCR Correction","num_papers_in_archive":2},{"url":"/dataset/semantic-question-similarity-in-arabic","name":"Semantic Question Similarity in Arabic","full_name":"NSURL-2019 Shared Task 8: Semantic Question Similarity in Arabic","num_papers_in_archive":2},{"url":"/dataset/names-pairs-dataset","name":"Names pairs dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/phrase-in-context","name":"Phrase-in-Context","full_name":"Phrase-in-Context","num_papers_in_archive":1},{"url":"/dataset/spanish-corpus-xix","name":"Spanish Corpus XIX","full_name":"19th Century Spanish Corpus","num_papers_in_archive":1},{"url":"/dataset/speechbrown","name":"Speech Brown","full_name":"","num_papers_in_archive":1}],"subtasks":[{"url":"/task/semantic-shift-detection","name":"Semantic Shift Detection"},{"url":"/task/similarity-explanation","name":"Similarity Explanation"}],"parent_tasks":[{"url":"/task/sentence-pair-modeling","name":"Sentence Pair Modeling"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":534,"tagged_in_all":1564,"items":[{"url":"/paper/sentence-bert-sentence-embeddings-using","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","date":"2019-08-27","arxiv_id":"1908.10084","repositories_listed":64,"syntology":{"n":58,"n_ran":20,"n_unverified":38,"n_pointer_only":11}},{"url":"/paper/ernie-enhanced-representation-through","title":"ERNIE: Enhanced Representation through Knowledge Integration","date":"2019-04-19","arxiv_id":"1904.09223","repositories_listed":19,"syntology":{"n":7,"n_ran":0,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/improved-semantic-representations-from-tree","title":"Improved Semantic Representations From Tree-Structured Long Short-Term Memory Networks","date":"2015-02-28","arxiv_id":"1503.00075","repositories_listed":16,"syntology":{"n":15,"n_ran":6,"n_unverified":9,"n_pointer_only":6}},{"url":"/paper/improving-language-understanding-by","title":"Improving Language Understanding by Generative Pre-Training","date":"2018-06-11","arxiv_id":null,"repositories_listed":13,"syntology":null},{"url":"/paper/language-agnostic-bert-sentence-embedding","title":"Language-agnostic BERT Sentence Embedding","date":"2020-07-03","arxiv_id":"2007.01852","repositories_listed":6,"syntology":null},{"url":"/paper/medsts-a-resource-for-clinical-semantic","title":"MedSTS: A Resource for Clinical Semantic Textual Similarity","date":"2018-08-28","arxiv_id":"1808.09397","repositories_listed":5,"syntology":null},{"url":"/paper/transfer-learning-in-biomedical-natural","title":"Transfer Learning in Biomedical Natural Language Processing: An Evaluation of BERT and ELMo on Ten Benchmarking Datasets","date":"2019-06-13","arxiv_id":"1906.05474","repositories_listed":4,"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":0}},{"url":"/paper/calculating-the-similarity-between-words-and","title":"Calculating the similarity between words and sentences using a lexical database and corpus statistics","date":"2018-02-15","arxiv_id":"1802.05667","repositories_listed":4,"syntology":null},{"url":"/paper/datasculpt-crafting-data-landscapes-for-llm","title":"DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning","date":"2024-09-02","arxiv_id":"2409.00997","repositories_listed":3,"syntology":null},{"url":"/paper/on-semantic-similarity-in-video-retrieval","title":"On Semantic Similarity in Video Retrieval","date":"2021-03-18","arxiv_id":"2103.10095","repositories_listed":3,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}},{"url":"/paper/generating-natural-language-attacks-in-a-hard","title":"Generating Natural Language Attacks in a Hard Label Black Box Setting","date":"2020-12-29","arxiv_id":"2012.14956","repositories_listed":3,"syntology":{"n":6,"n_ran":6,"n_unverified":0,"n_pointer_only":6}},{"url":"/paper/on-the-sentence-embeddings-from-pre-trained","title":"On the Sentence Embeddings from Pre-trained Language Models","date":"2020-11-02","arxiv_id":"2011.05864","repositories_listed":3,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/semantic-relatedness-based-re-ranker-for-text","title":"Semantic Relatedness Based Re-ranker for Text Spotting","date":"2019-09-17","arxiv_id":"1909.07950","repositories_listed":3,"syntology":null},{"url":"/paper/a-hybrid-neural-network-model-for-commonsense","title":"A Hybrid Neural Network Model for Commonsense Reasoning","date":"2019-07-27","arxiv_id":"1907.11983","repositories_listed":3,"syntology":{"n":1,"n_ran":0,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/deep-metric-learning-by-online-soft-mining","title":"Deep Metric Learning by Online Soft Mining and Class-Aware Attention","date":"2018-11-04","arxiv_id":"1811.01459","repositories_listed":3,"syntology":null},{"url":"/paper/portuguese-word-embeddings-evaluating-on-word","title":"Portuguese Word Embeddings: Evaluating on Word Analogies and Natural Language Tasks","date":"2017-08-20","arxiv_id":"1708.06025","repositories_listed":3,"syntology":null},{"url":"/paper/label-noise-reduction-in-entity-typing-by","title":"Label Noise Reduction in Entity Typing by Heterogeneous Partial-Label Embedding","date":"2016-02-17","arxiv_id":"1602.05307","repositories_listed":3,"syntology":null},{"url":"/paper/demystifying-and-extracting-fault-indicating","title":"Demystifying and Extracting Fault-indicating Information from Logs for Failure Diagnosis","date":"2024-09-20","arxiv_id":"2409.13561","repositories_listed":2,"syntology":null},{"url":"/paper/linguistic-minimal-pairs-elicit-linguistic","title":"Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models","date":"2024-09-19","arxiv_id":"2409.12435","repositories_listed":2,"syntology":null},{"url":"/paper/weakly-supervised-audio-separation-via-bi","title":"Weakly-supervised Audio Separation via Bi-modal Semantic Similarity","date":"2024-04-02","arxiv_id":"2404.01740","repositories_listed":2,"syntology":{"n":18,"n_ran":11,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/semrel2024-a-collection-of-semantic-textual","title":"SemRel2024: A Collection of Semantic Textual Relatedness Datasets for 13 Languages","date":"2024-02-13","arxiv_id":"2402.08638","repositories_listed":2,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}},{"url":"/paper/def2vec-extensible-word-embeddings-from","title":"Def2Vec: Extensible Word Embeddings from Dictionary Definitions","date":"2023-12-16","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/deelm-dependency-enhanced-large-language","title":"BeLLM: Backward Dependency Enhanced Large Language Model for Sentence Embeddings","date":"2023-11-09","arxiv_id":"2311.05296","repositories_listed":2,"syntology":{"n":7,"n_ran":7,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/visual-grounding-helps-learn-word-meanings-in","title":"Visual Grounding Helps Learn Word Meanings in Low-Data Regimes","date":"2023-10-20","arxiv_id":"2310.13257","repositories_listed":2,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}},{"url":"/paper/sentence-embedding-models-for-ancient-greek","title":"Sentence Embedding Models for Ancient Greek Using Multilingual Knowledge Distillation","date":"2023-08-24","arxiv_id":"2308.13116","repositories_listed":2,"syntology":null},{"url":"/paper/class-relation-knowledge-distillation-for","title":"Class-relation Knowledge Distillation for Novel Class Discovery","date":"2023-07-18","arxiv_id":"2307.09158","repositories_listed":2,"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":1}},{"url":"/paper/real-world-image-variation-by-aligning-1","title":"Real-World Image Variation by Aligning Diffusion Inversion Chain","date":"2023-05-30","arxiv_id":"2305.18729","repositories_listed":2,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":0}},{"url":"/paper/alignscore-evaluating-factual-consistency","title":"AlignScore: Evaluating Factual Consistency with a Unified Alignment Function","date":"2023-05-26","arxiv_id":"2305.16739","repositories_listed":2,"syntology":null},{"url":"/paper/focus-effective-embedding-initialization-for","title":"FOCUS: Effective Embedding Initialization for Monolingual Specialization of Multilingual Models","date":"2023-05-23","arxiv_id":"2305.14481","repositories_listed":2,"syntology":null},{"url":"/paper/chain-of-thought-prompting-for-responding-to","title":"Cue-CoT: Chain-of-thought Prompting for Responding to In-depth Dialogue Questions with LLMs","date":"2023-05-19","arxiv_id":"2305.11792","repositories_listed":2,"syntology":null}],"syntology_records":14,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}