{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/word-similarity/papers/4","list_of":"/task/word-similarity","task":"Word Similarity","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":4,"pages_in_order":4,"rows_per_page":100,"rows":[301,378],"of":378,"counts":{"archive_papers_tagged":378,"with_a_code_link":117,"where_syntology_ran_a_sample":15,"not_listed_spam_title":0,"listed":378,"listed_where_code_ran":15,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":10,"every_run_a_failure_of_syntologys_instrument":5,"listed_with_a_run_with_no_instrument_failure":10,"listed_every_run_a_failure_of_syntologys_instrument":5,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/word-similarity","prev":"/task/word-similarity/papers/3","next":null,"papers":[{"url":null,"slug":"learning-rare-word-representations-using","title":"Learning Rare Word Representations using Semantic Bridging","date":"2017-07-24","arxiv_id":"1707.07554","repositories_listed":0,"syntology":null},{"url":null,"slug":"reconstruction-of-word-embeddings-from-sub","title":"Reconstruction of Word Embeddings from Sub-Word Parameters","date":"2017-07-21","arxiv_id":"1707.06957","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-critique-of-a-critique-of-word-similarity","title":"A Critique of a Critique of Word Similarity Datasets: Sanity Check or Unnecessary Confusion?","date":"2017-07-12","arxiv_id":"1707.03819","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-word-clusters-using-signed-spectral","title":"Semantic Word Clusters Using Signed Spectral Clustering","date":"2017-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-embeddings-of-graphs-in-hyperbolic","title":"Neural Embeddings of Graphs in Hyperbolic Space","date":"2017-05-29","arxiv_id":"1705.10359","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-syntactically-informed","title":"Cross-Lingual Syntactically Informed Distributed Word Representations","date":"2017-04-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"predicting-emotional-word-ratings-using","title":"Predicting Emotional Word Ratings using Distributional Representations and Signed Clustering","date":"2017-04-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"reranking-translation-candidates-produced-by","title":"Reranking Translation Candidates Produced by Several Bilingual Word Similarity Sources","date":"2017-04-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"word-similarity-datasets-for-indian-languages","title":"Word Similarity Datasets for Indian Languages: Annotation and Baseline Systems","date":"2017-04-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"implicitly-incorporating-morphological","title":"Implicitly Incorporating Morphological Information into Word Embedding","date":"2017-01-10","arxiv_id":"1701.02481","repositories_listed":0,"syntology":null},{"url":null,"slug":"real-multi-sense-or-pseudo-multi-sense-an","title":"Real Multi-Sense or Pseudo Multi-Sense: An Approach to Improve Word Representation","date":"2017-01-06","arxiv_id":"1701.01574","repositories_listed":0,"syntology":null},{"url":null,"slug":"improved-word-embeddings-with-implicit","title":"Improved Word Embeddings with Implicit Structure Information","date":"2016-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modifications-of-machine-translation","title":"Modifications of Machine Translation Evaluation Metrics by Using Word Embeddings","date":"2016-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"sub-word-similarity-based-search-for","title":"Sub-Word Similarity based Search for Embeddings: Inducing Rare-Word Embeddings for Word Similarity Tasks and Language Modelling","date":"2016-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"identity-sensitive-word-embedding-through","title":"Identity-sensitive Word Embedding through Heterogeneous Networks","date":"2016-11-29","arxiv_id":"1611.09878","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-view-recurrent-neural-acoustic-word","title":"Multi-view Recurrent Neural Acoustic Word Embeddings","date":"2016-11-14","arxiv_id":"1611.04496","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-word-embeddings-from-intrinsic-and","title":"Learning Word Embeddings from Intrinsic and Extrinsic Views","date":"2016-08-20","arxiv_id":"1608.05852","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-selection-of-context-configurations","title":"Automatic Selection of Context Configurations for Improved Class-Specific Word Representations","date":"2016-08-19","arxiv_id":"1608.05528","repositories_listed":0,"syntology":null},{"url":null,"slug":"community-detection-in-political-twitter","title":"Community Detection in Political Twitter Networks using Nonnegative Matrix Factorization Methods","date":"2016-08-05","arxiv_id":"1608.01771","repositories_listed":0,"syntology":null},{"url":null,"slug":"morphological-priors-for-probabilistic-neural","title":"Morphological Priors for Probabilistic Neural Word Embeddings","date":"2016-08-03","arxiv_id":"1608.01056","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-critique-of-word-similarity-as-a-method-for","title":"A critique of word similarity as a method for evaluating distributional semantic models","date":"2016-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"when-hyperparameters-help-beneficial","title":"When Hyperparameters Help: Beneficial Parameter Combinations in Distributional Semantic Models","date":"2016-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"charagram-embedding-words-and-sentences-via","title":"Charagram: Embedding Words and Sentences via Character n-grams","date":"2016-07-10","arxiv_id":"1607.02789","repositories_listed":0,"syntology":null},{"url":null,"slug":"correlation-based-intrinsic-evaluation-of","title":"Correlation-based Intrinsic Evaluation of Word Vector Representations","date":"2016-06-21","arxiv_id":"1606.06710","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-word-sense-embeddings-from-word","title":"Learning Word Sense Embeddings from Word Sense Definitions","date":"2016-06-15","arxiv_id":"1606.04835","repositories_listed":0,"syntology":null},{"url":null,"slug":"psdvec-a-toolbox-for-incremental-and-scalable","title":"PSDVec: a Toolbox for Incremental and Scalable Word Embedding","date":"2016-06-10","arxiv_id":"1606.03192","repositories_listed":0,"syntology":null},{"url":null,"slug":"integrating-distributional-lexical-contrast","title":"Integrating Distributional Lexical Contrast into Word Embeddings for Antonym-Synonym Distinction","date":"2016-05-25","arxiv_id":"1605.07766","repositories_listed":0,"syntology":null},{"url":null,"slug":"evalution-man-a-chinese-dataset-for-the","title":"EVALution-MAN: A Chinese Dataset for the Training and Evaluation of DSMs","date":"2016-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"medical-concept-embeddings-via-labeled","title":"Medical Concept Embeddings via Labeled Background Corpora","date":"2016-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-measure-of-word-similarity-how","title":"Unsupervised Measure of Word Similarity: How to Outperform Co-occurrence and Vector Cosine in VSMs","date":"2016-03-30","arxiv_id":"1603.09054","repositories_listed":0,"syntology":null},{"url":null,"slug":"what-a-nerd-beating-students-and-vector","title":"What a Nerd! Beating Students and Vector Cosine in the ESL and TOEFL Datasets","date":"2016-03-29","arxiv_id":"1603.08701","repositories_listed":0,"syntology":null},{"url":null,"slug":"part-of-speech-relevance-weights-for-learning","title":"Part-of-Speech Relevance Weights for Learning Word Embeddings","date":"2016-03-24","arxiv_id":"1603.07695","repositories_listed":0,"syntology":null},{"url":null,"slug":"embracing-error-to-enable-rapid-crowdsourcing","title":"Embracing Error to Enable Rapid Crowdsourcing","date":"2016-02-14","arxiv_id":"1602.04506","repositories_listed":0,"syntology":null},{"url":null,"slug":"category-enhanced-word-embedding","title":"Category Enhanced Word Embedding","date":"2015-11-27","arxiv_id":"1511.08629","repositories_listed":0,"syntology":null},{"url":null,"slug":"multimodal-skip-gram-using-convolutional","title":"Multimodal Skip-gram Using Convolutional Pseudowords","date":"2015-11-12","arxiv_id":"1511.04024","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-visual-features-from-large-weakly","title":"Learning Visual Features from Large Weakly Supervised Data","date":"2015-11-06","arxiv_id":"1511.02251","repositories_listed":0,"syntology":null},{"url":null,"slug":"component-enhanced-chinese-character","title":"Component-Enhanced Chinese Character Embeddings","date":"2015-08-26","arxiv_id":"1508.06669","repositories_listed":0,"syntology":null},{"url":null,"slug":"autoextend-extending-word-embeddings-to","title":"AutoExtend: Extending Word Embeddings to Embeddings for Synsets and Lexemes","date":"2015-07-04","arxiv_id":"1507.01127","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-framework-for-the-construction-of","title":"A Framework for the Construction of Monolingual and Cross-lingual Word Similarity Datasets","date":"2015-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"symmetric-pattern-based-word-embeddings-for","title":"Symmetric Pattern Based Word Embeddings for Improved Word Similarity Prediction","date":"2015-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"do-multi-sense-embeddings-improve-natural","title":"Do Multi-Sense Embeddings Improve Natural Language Understanding?","date":"2015-06-02","arxiv_id":"1506.01070","repositories_listed":0,"syntology":null},{"url":null,"slug":"relation-extraction-pattern-ranking-using","title":"Relation extraction pattern ranking using word similarity","date":"2015-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparison-of-word-similarity-performance","title":"A Comparison of Word Similarity Performance Using Explanatory and Non-explanatory Texts","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-cognate-identification-with-gap","title":"Automatic cognate identification with gap-weighted string subsequences.","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-multilingual-correlation-for-improved","title":"Deep Multilingual Correlation for Improved Word Embeddings","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"do-supervised-distributional-methods-really","title":"Do Supervised Distributional Methods Really Learn Lexical Inference Relations?","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-word-meaning-in-context-with","title":"Modeling Word Meaning in Context with Substitute Vectors","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"nasari-a-novel-approach-to-a-semantically","title":"NASARI: a Novel Approach to a Semantically-Aware Representation of Items","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"normalized-word-embedding-and-orthogonal","title":"Normalized Word Embedding and Orthogonal Transform for Bilingual Word Translation","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"ontologically-grounded-multi-sense","title":"Ontologically Grounded Multi-sense Representation Learning for Semantic Vector Space Models","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"random-walks-and-neural-network-language","title":"Random Walks and Neural Network Language Models on Knowledge Bases","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-morphology-induction-using-word","title":"Unsupervised Morphology Induction Using Word Embeddings","date":"2015-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-non-parametric-estimation-of","title":"Efficient Non-parametric Estimation of Multiple Embeddings per Word in Vector Space","date":"2015-04-24","arxiv_id":"1504.06654","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-distributional-similarity-with","title":"Improving Distributional Similarity with Lessons Learned from Word Embeddings","date":"2015-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"embedding-word-similarity-with-neural-machine","title":"Embedding Word Similarity with Neural Machine Translation","date":"2014-12-19","arxiv_id":"1412.6448","repositories_listed":0,"syntology":null},{"url":null,"slug":"rehabilitation-of-count-based-models-for-word","title":"Rehabilitation of Count-based Models for Word Vector Representations","date":"2014-12-16","arxiv_id":"1412.4930","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-word-embedding-as-implicit-matrix","title":"Neural Word Embedding as Implicit Matrix Factorization","date":"2014-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-word-alignment-using-word","title":"Improving Word Alignment using Word Similarity","date":"2014-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"knet-a-general-framework-for-learning-word","title":"KNET: A General Framework for Learning Word Embedding using Morphological Knowledge","date":"2014-07-07","arxiv_id":"1407.1687","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multiplicative-model-for-learning","title":"A Multiplicative Model for Learning Distributed Text-Based Attribute Representations","date":"2014-06-10","arxiv_id":"1406.2710","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-word-representations-with","title":"Learning Word Representations with Hierarchical Sparse Coding","date":"2014-06-08","arxiv_id":"1406.2035","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-sparse-word-similarity-models-with","title":"Improving sparse word similarity models with asymmetric measures","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-frame-identification-with","title":"Semantic Frame Identification with Distributed Word Representations","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"using-ellipsis-detection-and-word-similarity","title":"Using Ellipsis Detection and Word Similarity for Transformation of Spoken Language into Grammatically Valid Sentences","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"latent-semantic-analysis-models-on-wikipedia","title":"Latent Semantic Analysis Models on Wikipedia and TASA","date":"2014-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"tvd-a-reproducible-and-multiply-aligned-tv","title":"TVD: A Reproducible and Multiply Aligned TV Series Dataset","date":"2014-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"text-relatedness-based-on-a-word-thesaurus","title":"Text Relatedness Based on a Word Thesaurus","date":"2014-01-15","arxiv_id":"1401.5699","repositories_listed":0,"syntology":null},{"url":null,"slug":"back-to-basics-for-monolingual-alignment","title":"Back to Basics for Monolingual Alignment: Exploiting Word Similarity and Contextual Evidence","date":"2014-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-word-embeddings-efficiently-with","title":"Learning word embeddings efficiently with noise-contrastive estimation","date":"2013-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"word-similarity-using-constructions-as","title":"Word similarity using constructions as contextual features","date":"2013-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"an-approach-of-hybrid-hierarchical-structure","title":"An Approach of Hybrid Hierarchical Structure for Word Similarity Computing by HowNet","date":"2013-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"walk-based-computation-of-contextual-word","title":"Walk-based Computation of Contextual Word Similarity","date":"2012-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fbk-machine-translation-evaluation-and-word","title":"FBK: Machine Translation Evaluation and Word Similarity metrics for Semantic Textual Similarity","date":"2012-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mixcd-system-description-for-evaluating","title":"MIXCD: System Description for Evaluating Chinese Word Similarity at SemEval-2012","date":"2012-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-sentences-in-the-latent-space","title":"Modeling Sentences in the Latent Space","date":"2012-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"semeval-2012-task-4-evaluating-chinese-word","title":"SemEval-2012 Task 4: Evaluating Chinese Word Similarity","date":"2012-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparison-of-greedy-and-optimal-assessment","title":"A Comparison of Greedy and Optimal Assessment of Natural Language Student Input Using Word-to-Word Similarity Metrics","date":"2012-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"phacts-about-activation-based-word-similarity","title":"PHACTS about activation-based word similarity effects","date":"2012-04-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"6111eb3f39f3dae0105006933c60bcef955aeb5e5863abddae2d69e73bc03dbd","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}