{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/xlm-r/papers/2","list_of":"/method/xlm-r","method":"XLM-R","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":2,"pages_in_order":2,"rows_per_page":100,"rows":[101,176],"of":176,"counts":{"archive_papers_tagged":176,"with_a_code_link":80,"where_syntology_ran_a_sample":14,"not_listed_spam_title":0,"listed":176,"listed_where_code_ran":14,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":12,"every_run_a_failure_of_syntologys_instrument":2,"listed_with_a_run_with_no_instrument_failure":12,"listed_every_run_a_failure_of_syntologys_instrument":2,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/xlm-r","prev":"/method/xlm-r","next":null,"papers":[{"paper":null,"slug":"are-pretrained-multilingual-models-equally","title":"Are Pretrained Multilingual Models Equally Fair Across Languages?","date":"2022-01-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"frustratingly-simple-regularization-to","title":"Frustratingly Simple Regularization to Improve Zero-shot Cross-lingual Robustness","date":"2022-01-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lexicon-based-fine-tuning-of-multilingual","title":"Lexicon based Fine-tuning of Multilingual Language Models for Sentiment Analysis of Low-resource Languages","date":"2022-01-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"the-impact-of-cross-lingual-adjustment-of","title":"The Impact of Cross-Lingual Adjustment of Contextual Word Representations on Zero-Shot Transfer","date":"2022-01-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"zeroberto-leveraging-zero-shot-text","title":"ZeroBERTo: Leveraging Zero-Shot Text Classification by Topic Modeling","date":"2022-01-04","arxiv_id":"2201.01337","n_code_links":0,"syntology":null},{"paper":null,"slug":"multilingual-pre-training-with-universal","title":"Multilingual Pre-training with Universal Dependency Learning","date":"2021-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/debertav3-improving-deberta-using-electra","slug":"debertav3-improving-deberta-using-electra","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","date":"2021-11-18","arxiv_id":"2111.09543","n_code_links":3,"syntology":{"ran":6,"of":7,"n_ran_checked":6,"n_instrument":0,"unverified":1,"pointer_only":0,"phrase":"6 ran (of which 0 constructed an object rather than computing a result; 6 with no instrument failure: 0 honoured, 0 violated, 6 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["microsoft/DeBERTa"],"state":"official (archive's flag): 6 ran","n_ran":6,"n_constructed":0,"n_ran_no_instrument_failure":6,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"combining-static-and-contextualised","title":"Combining static and contextualised multilingual embeddings","date":"2021-11-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-stage-distillation-framework-for-cross","title":"Multi-stage Distillation Framework for Cross-Lingual Semantic Similarity Matching","date":"2021-11-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"prix-lm-pretraining-for-multilingual-1","title":"Prix-LM: Pretraining for Multilingual Knowledge Base Construction","date":"2021-11-16","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"nict-kyoto-submission-for-the-wmt21-quality","title":"NICT Kyoto Submission for the WMT’21 Quality Estimation Task: Multimetric Multilingual Pretraining for Critical Error Detection","date":"2021-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"saliency-based-multi-view-mixed-language","title":"Saliency-based Multi-View Mixed Language Training for Zero-shot Cross-lingual Classification","date":"2021-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/indonli-a-natural-language-inference-dataset","slug":"indonli-a-natural-language-inference-dataset","title":"IndoNLI: A Natural Language Inference Dataset for Indonesian","date":"2021-10-27","arxiv_id":"2110.14566","n_code_links":1,"syntology":null},{"paper":"/paper/prix-lm-pretraining-for-multilingual","slug":"prix-lm-pretraining-for-multilingual","title":"Prix-LM: Pretraining for Multilingual Knowledge Base Construction","date":"2021-10-16","arxiv_id":"2110.08443","n_code_links":1,"syntology":null},{"paper":"/paper/towards-making-the-most-of-multilingual","slug":"towards-making-the-most-of-multilingual","title":"Towards Making the Most of Multilingual Pretraining for Zero-Shot Neural Machine Translation","date":"2021-10-16","arxiv_id":"2110.08547","n_code_links":1,"syntology":{"ran":2,"of":2,"n_ran_checked":1,"n_instrument":1,"unverified":0,"pointer_only":2,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":{"repos":["ghchen18/acl22-sixtp"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"teet-tunisian-dataset-for-toxic-speech","title":"TEET! Tunisian Dataset for Toxic Speech Detection","date":"2021-10-11","arxiv_id":"2110.05287","n_code_links":0,"syntology":null},{"paper":null,"slug":"boosting-transformers-for-job-expression","title":"Boosting Transformers for Job Expression Extraction and Classification in a Low-Resource Setting","date":"2021-09-17","arxiv_id":"2109.08597","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-the-universality-of-deep-contextual","title":"On the Universality of Deep Contextual Language Models","date":"2021-09-15","arxiv_id":"2109.07140","n_code_links":0,"syntology":null},{"paper":null,"slug":"fbert-a-neural-transformer-for-identifying","title":"FBERT: A Neural Transformer for Identifying Offensive Content","date":"2021-09-10","arxiv_id":"2109.05074","n_code_links":0,"syntology":null},{"paper":null,"slug":"classification-of-code-mixed-text-using","title":"Classification of Code-Mixed Text Using Capsule Networks","date":"2021-09-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"siamese-networks-for-inference-in-malayalam","title":"Siamese Networks for Inference in Malayalam Language Texts","date":"2021-09-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/cross-lingual-text-classification-of","slug":"cross-lingual-text-classification-of","title":"Cross-Lingual Text Classification of Transliterated Hindi and Malayalam","date":"2021-08-31","arxiv_id":"2108.13620","n_code_links":1,"syntology":null},{"paper":null,"slug":"contributions-of-transformer-attention-heads","title":"Contributions of Transformer Attention Heads in Multi- and Cross-lingual Tasks","date":"2021-08-18","arxiv_id":"2108.08375","n_code_links":0,"syntology":null},{"paper":null,"slug":"applying-occams-razor-to-transformer-based","title":"Applying Occam’s Razor to Transformer-Based Dependency Parsing: What Works, What Doesn’t, and What is Really Necessary","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"arbert-marbert-deep-bidirectional-1","title":"ARBERT \\& MARBERT: Deep Bidirectional Transformers for Arabic","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/cosy-counterfactual-syntax-for-cross-lingual","slug":"cosy-counterfactual-syntax-for-cross-lingual","title":"COSY: COunterfactual SYntax for Cross-Lingual Understanding","date":"2021-08-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"glossreader-at-semeval-2021-task-2-reading","title":"GlossReader at SemEval-2021 Task 2: Reading Definitions Improves Contextualized Word Embeddings","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"liori-at-semeval-2021-task-2-span-prediction","title":"LIORI at SemEval-2021 Task 2: Span Prediction and Binary Classification approaches to Word-in-Context Disambiguation","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"robertnlp-at-the-iwpt-2021-shared-task-simple","title":"RobertNLP at the IWPT 2021 Shared Task: Simple Enhanced UD Parsing for 17 Languages","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"skoltechnlp-at-semeval-2021-task-2-generating","title":"SkoltechNLP at SemEval-2021 Task 2: Generating Cross-Lingual Training Data for the Word-in-Context Task","date":"2021-08-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"emotion-stimulus-detection-in-german-news","title":"Emotion Stimulus Detection in German News Headlines","date":"2021-07-27","arxiv_id":"2107.12920","n_code_links":0,"syntology":null},{"paper":null,"slug":"tgif-tree-graph-integrated-format-parser-for","title":"TGIF: Tree-Graph Integrated-Format Parser for Enhanced UD with Two-Stage Generic- to Individual-Language Finetuning","date":"2021-07-14","arxiv_id":"2107.06907","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-primer-on-pretrained-multilingual-language","title":"A Primer on Pretrained Multilingual Language Models","date":"2021-07-01","arxiv_id":"2107.00676","n_code_links":0,"syntology":null},{"paper":null,"slug":"automatic-sexism-detection-with-multilingual","title":"Automatic Sexism Detection with Multilingual Transformer Models","date":"2021-06-09","arxiv_id":"2106.04908","n_code_links":0,"syntology":null},{"paper":"/paper/investigating-transfer-learning-in","slug":"investigating-transfer-learning-in","title":"Investigating Transfer Learning in Multilingual Pre-trained Language Models through Chinese Natural Language Inference","date":"2021-06-07","arxiv_id":"2106.03983","n_code_links":1,"syntology":null},{"paper":null,"slug":"how-to-adapt-your-pretrained-multilingual","title":"How to Adapt Your Pretrained Multilingual Model to 1600 Languages","date":"2021-06-03","arxiv_id":"2106.02124","n_code_links":0,"syntology":null},{"paper":null,"slug":"diagnosing-transformers-in-task-oriented","title":"Diagnosing Transformers in Task-Oriented Semantic Parsing","date":"2021-05-27","arxiv_id":"2105.13496","n_code_links":0,"syntology":null},{"paper":"/paper/xeroalign-zero-shot-cross-lingual-transformer","slug":"xeroalign-zero-shot-cross-lingual-transformer","title":"XeroAlign: Zero-Shot Cross-lingual Transformer Alignment","date":"2021-05-06","arxiv_id":"2105.02472","n_code_links":2,"syntology":null},{"paper":null,"slug":"larger-scale-transformers-for-multilingual","title":"Larger-Scale Transformers for Multilingual Masked Language Modeling","date":"2021-05-02","arxiv_id":"2105.00572","n_code_links":0,"syntology":null},{"paper":null,"slug":"multilingual-and-zero-shot-is-closing-in-on","title":"Multilingual and Zero-Shot is Closing in on Monolingual Web Register Classification","date":"2021-05-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/xlm-t-a-multilingual-language-model-toolkit","slug":"xlm-t-a-multilingual-language-model-toolkit","title":"XLM-T: Multilingual Language Models in Twitter for Sentiment Analysis and Beyond","date":"2021-04-25","arxiv_id":"2104.12250","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":1,"n_instrument":2,"unverified":0,"pointer_only":0,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 1 honoured, 0 violated, 0 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified","official":{"repos":["cardiffnlp/xlm-t"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/x-metra-ada-cross-lingual-meta-transfer","slug":"x-metra-ada-cross-lingual-meta-transfer","title":"X-METRA-ADA: Cross-lingual Meta-Transfer Learning Adaptation to Natural Language Understanding and Question Answering","date":"2021-04-20","arxiv_id":"2104.09696","n_code_links":1,"syntology":null},{"paper":"/paper/americasnli-evaluating-zero-shot-natural","slug":"americasnli-evaluating-zero-shot-natural","title":"AmericasNLI: Evaluating Zero-shot Natural Language Understanding of Pretrained Multilingual Models in Truly Low-resource Languages","date":"2021-04-18","arxiv_id":"2104.08726","n_code_links":1,"syntology":null},{"paper":"/paper/emotion-classification-in-a-resource","slug":"emotion-classification-in-a-resource","title":"Emotion Classification in a Resource Constrained Language Using Transformer-based Approach","date":"2021-04-17","arxiv_id":"2104.08613","n_code_links":4,"syntology":null},{"paper":"/paper/improving-zero-shot-cross-lingual-transfer","slug":"improving-zero-shot-cross-lingual-transfer","title":"Improving Zero-Shot Cross-Lingual Transfer Learning via Robust Training","date":"2021-04-17","arxiv_id":"2104.08645","n_code_links":1,"syntology":null},{"paper":"/paper/bilingual-alignment-transfers-to-multilingual","slug":"bilingual-alignment-transfers-to-multilingual","title":"Bilingual alignment transfers to multilingual alignment for unsupervised parallel text mining","date":"2021-04-15","arxiv_id":"2104.07642","n_code_links":1,"syntology":null},{"paper":"/paper/covid-19-named-entity-recognition-for","slug":"covid-19-named-entity-recognition-for","title":"COVID-19 Named Entity Recognition for Vietnamese","date":"2021-04-08","arxiv_id":"2104.03879","n_code_links":1,"syntology":null},{"paper":null,"slug":"mcl-iitk-at-semeval-2021-task-2-multilingual","title":"MCL@IITK at SemEval-2021 Task 2: Multilingual and Cross-lingual Word-in-Context Disambiguation using Augmented Data, Signals, and Transformers","date":"2021-04-04","arxiv_id":"2104.01567","n_code_links":0,"syntology":null},{"paper":"/paper/benchmarking-pre-trained-language-models-for","slug":"benchmarking-pre-trained-language-models-for","title":"Benchmarking Pre-trained Language Models for Multilingual NER: TraSpaS at the BSNLP2021 Shared Task","date":"2021-04-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/challenges-in-annotating-and-parsing-spoken","slug":"challenges-in-annotating-and-parsing-spoken","title":"Challenges in Annotating and Parsing Spoken, Code-switched, Frisian-Dutch Data","date":"2021-04-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"priberam-labs-at-the-3rd-shared-task-on","title":"Priberam Labs at the 3rd Shared Task on SlavNER","date":"2021-04-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"automatic-difficulty-classification-of-arabic","title":"Automatic Difficulty Classification of Arabic Sentences","date":"2021-03-07","arxiv_id":"2103.04386","n_code_links":0,"syntology":null},{"paper":null,"slug":"vyakarana-a-colorless-green-benchmark-for","title":"Vyākarana: A Colorless Green Benchmark for Syntactic Evaluation in Indic Languages","date":"2021-03-01","arxiv_id":"2103.00854","n_code_links":0,"syntology":null},{"paper":"/paper/nlp-cuet-dravidianlangtech-eacl2021-offensive","slug":"nlp-cuet-dravidianlangtech-eacl2021-offensive","title":"NLP-CUET@DravidianLangTech-EACL2021: Offensive Language Detection from Multilingual Code-Mixed Text using Transformers","date":"2021-02-28","arxiv_id":"2103.00455","n_code_links":1,"syntology":null},{"paper":null,"slug":"bootstrapping-multilingual-amr-with","title":"Bootstrapping Multilingual AMR with Contextual Word Alignments","date":"2021-02-03","arxiv_id":"2102.02189","n_code_links":0,"syntology":null},{"paper":null,"slug":"lome-large-ontology-multilingual-extraction","title":"LOME: Large Ontology Multilingual Extraction","date":"2021-01-28","arxiv_id":"2101.12175","n_code_links":0,"syntology":null},{"paper":null,"slug":"distilling-large-language-models-into-tiny","title":"Distilling Large Language Models into Tiny and Effective Students using pQRNN","date":"2021-01-21","arxiv_id":"2101.08890","n_code_links":0,"syntology":null},{"paper":"/paper/arbert-marbert-deep-bidirectional","slug":"arbert-marbert-deep-bidirectional","title":"ARBERT & MARBERT: Deep Bidirectional Transformers for Arabic","date":"2020-12-27","arxiv_id":"2101.01785","n_code_links":2,"syntology":null},{"paper":"/paper/cogalex-vi-shared-task-transrelation-a-robust","slug":"cogalex-vi-shared-task-transrelation-a-robust","title":"CogALex-VI Shared Task: Transrelation - A Robust Multilingual Language Model for Multilingual Relation Identification","date":"2020-12-12","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"a-multilingual-reading-comprehension-system","title":"A Multilingual Reading Comprehension System for more than 100 Languages","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/detecting-urgency-status-of-crisis-tweets-a","slug":"detecting-urgency-status-of-crisis-tweets-a","title":"Detecting Urgency Status of Crisis Tweets: A Transfer Learning Approach for Low Resource Languages","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"sensecluster-at-semeval-2020-task-1","title":"SenseCluster at SemEval-2020 Task 1: Unsupervised Lexical Semantic Change Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"xglue-a-new-benchmark-datasetfor-cross","title":"XGLUE: A New Benchmark Datasetfor Cross-lingual Pre-training, Understanding and Generation","date":"2020-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/graph-based-universal-dependency-parsing-in","slug":"graph-based-universal-dependency-parsing-in","title":"Applying Occam's Razor to Transformer-Based Dependency Parsing: What Works, What Doesn't, and What is Really Necessary","date":"2020-10-23","arxiv_id":"2010.12699","n_code_links":2,"syntology":null},{"paper":null,"slug":"galileo-at-semeval-2020-task-12-multi-lingual","title":"Galileo at SemEval-2020 Task 12: Multi-lingual Learning for Offensive Language Identification using Pre-trained Language Models","date":"2020-10-07","arxiv_id":"2010.03542","n_code_links":0,"syntology":null},{"paper":"/paper/a-pilot-study-of-text-to-sql-semantic-parsing","slug":"a-pilot-study-of-text-to-sql-semantic-parsing","title":"A Pilot Study of Text-to-SQL Semantic Parsing for Vietnamese","date":"2020-10-05","arxiv_id":"2010.01891","n_code_links":1,"syntology":null},{"paper":null,"slug":"cross-lingual-transfer-learning-for-semantic","title":"Cross-lingual Transfer Learning for Semantic Role Labeling in Russian","date":"2020-09-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"on-learning-universal-representations-across","title":"On Learning Universal Representations Across Languages","date":"2020-07-31","arxiv_id":"2007.15960","n_code_links":0,"syntology":null},{"paper":null,"slug":"finest-bert-and-crosloengual-bert-less-is","title":"FinEst BERT and CroSloEngual BERT: less is more in multilingual models","date":"2020-06-14","arxiv_id":"2006.07890","n_code_links":0,"syntology":null},{"paper":null,"slug":"english-intermediate-task-training-improves-1","title":"English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too","date":"2020-06-03","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/english-intermediate-task-training-improves","slug":"english-intermediate-task-training-improves","title":"English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too","date":"2020-05-26","arxiv_id":"2005.13013","n_code_links":0,"syntology":null},{"paper":"/paper/mad-x-an-adapter-based-framework-for-multi","slug":"mad-x-an-adapter-based-framework-for-multi","title":"MAD-X: An Adapter-Based Framework for Multi-Task Cross-Lingual Transfer","date":"2020-04-30","arxiv_id":"2005.00052","n_code_links":3,"syntology":null},{"paper":null,"slug":"testing-pre-trained-transformer-models-for","title":"Testing pre-trained Transformer models for Lithuanian news clustering","date":"2020-04-03","arxiv_id":"2004.03461","n_code_links":0,"syntology":null},{"paper":"/paper/xglue-a-new-benchmark-dataset-for-cross","slug":"xglue-a-new-benchmark-dataset-for-cross","title":"XGLUE: A New Benchmark Dataset for Cross-lingual Pre-training, Understanding and Generation","date":"2020-04-03","arxiv_id":"2004.01401","n_code_links":2,"syntology":null},{"paper":"/paper/phobert-pre-trained-language-models-for","slug":"phobert-pre-trained-language-models-for","title":"PhoBERT: Pre-trained language models for Vietnamese","date":"2020-03-02","arxiv_id":"2003.00744","n_code_links":1,"syntology":null},{"paper":"/paper/unsupervised-cross-lingual-representation-1","slug":"unsupervised-cross-lingual-representation-1","title":"Unsupervised Cross-lingual Representation Learning at Scale","date":"2019-11-05","arxiv_id":"1911.02116","n_code_links":35,"syntology":{"ran":40,"of":59,"n_ran_checked":35,"n_instrument":5,"unverified":19,"pointer_only":52,"phrase":"40 ran (of which 13 constructed an object rather than computing a result; 35 with no instrument failure: 4 honoured, 1 violated, 30 with no contract checked; 5 where Syntology's instrument failed) · 19 unverified","official":{"repos":["facebookresearch/cc_net","facebookresearch/XLM"],"state":"official (archive's flag): 12 ran","n_ran":12,"n_constructed":0,"n_ran_no_instrument_failure":12,"n_unverified":3,"ran_from_kinds":["listed","official","unlocated"]}}}],"record_sha256":"9b42b2d23736951f1a8de34671a761f63d195ede6e2bda309931e9f6835cb99f","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}