Browse State-of-the-Art › Masked Language Modeling › Papers, page 5
Masked Language Modeling
Papers archive 2025-07-28
archive papers tagged: 475 · with a code link: 254 · where Syntology ran a sample: 67 (52 with a run with no instrument failure, 15 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (67 of 475 tagged: 52 with a run with no instrument failure, 15 where every run was a failure of Syntology's instrument)
Page 5 of 5: papers 401 to 475 of 475, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Composable Sparse Fine-Tuning for Cross-Lingual Transfer16 Nov 2021 0 repositories listed
-
Contextual Representation Learning beyond Masked Language Modeling16 Nov 2021 0 repositories listed
-
DAWSON: Data Augmentation using Weak Supervision On Natural Language16 Nov 2021 0 repositories listed
-
DS-TOD: Efficient Domain Specialization for Task-Oriented Dialog16 Nov 2021 0 repositories listed
-
Generative Prompt Tuning for Relation Classification16 Nov 2021 0 repositories listed
-
How does the pre-training objective affect what large language models learn about linguistic properties?16 Nov 2021 0 repositories listed
-
"Is Whole Word Masking Always Better for Chinese BERT?": Probing on Chinese Grammatical Error Correction16 Nov 2021 0 repositories listed
-
Knowledgeable Prompt-tuning: Incorporating Knowledge into Prompt Verbalizer for Text Classification16 Nov 2021 0 repositories listed
-
Phrase-aware Unsupervised Constituency Parsing16 Nov 2021 0 repositories listed
-
Predicting Attention Sparsity in Transformers16 Nov 2021 0 repositories listed
-
Probing BERT’s priors with serial reproduction chains16 Nov 2021 0 repositories listed
-
Prompt-Learning for Fine-Grained Entity Typing16 Nov 2021 0 repositories listed
-
TACO: Pre-training of Deep Transformers with Attention Convolution using Disentangled Positional Representation16 Nov 2021 0 repositories listed
-
Temporal Language Modeling for Short Text Document Classification with Transformers16 Nov 2021 0 repositories listed
-
Towards Unified Prompt Tuning for Few-shot Learning16 Nov 2021 0 repositories listed
-
Unsupervised Dependency Graph Network16 Nov 2021 0 repositories listed
-
Joint Unsupervised and Supervised Training for Multilingual ASR15 Nov 2021 0 repositories listed
-
Modeling Mathematical Notation Semantics in Academic Papers1 Nov 2021 0 repositories listed
-
NICT Kyoto Submission for the WMT’21 Quality Estimation Task: Multimetric Multilingual Pretraining for Critical Error Detection1 Nov 2021 0 repositories listed
-
Maximizing Efficiency of Language Model Pre-training for Learning Representation13 Oct 2021 0 repositories listed
-
Multi-Modal Pre-Training for Automated Speech Recognition12 Oct 2021 0 repositories listed
-
Image BERT Pre-training with Online Tokenizer29 Sep 2021 0 repositories listed
-
MLIM: Vision-and-Language Model Pre-training with Masked Language and Image Modeling24 Sep 2021 0 repositories listed
-
Predicting Attention Sparsity in Transformers24 Sep 2021 0 repositories listed
-
Domain-Specific Japanese ELECTRA Model Using a Small Corpus1 Sep 2021 0 repositories listed
-
Split-and-Rephrase in a Cross-Lingual Manner: A Complete Pipeline1 Sep 2021 0 repositories listed
-
Prompt-Learning for Fine-Grained Entity Typing24 Aug 2021 0 repositories listed
-
Noobs at Semeval-2021 Task 4: Masked Language Modeling for abstract answer prediction1 Aug 2021 0 repositories listed
-
Learning to Sample Replacements for ELECTRA Pre-Training25 Jun 2021 0 repositories listed
-
Winner Team Mia at TextVQA Challenge 2021: Vision-and-Language Representation Learning with Pre-trained Sequence-to-Sequence Model24 Jun 2021 0 repositories listed
-
MST: Masked Self-Supervised Transformer for Visual Representation10 Jun 2021 0 repositories listed
-
Bi-Granularity Contrastive Learning for Post-Training in Few-Shot Scene4 Jun 2021 0 repositories listed
-
Exposing the Implicit Energy Networks behind Masked Language Models via Metropolis--Hastings4 Jun 2021 0 repositories listed
-
MG-BERT: Multi-Graph Augmented BERT for Masked Language Modeling1 Jun 2021 0 repositories listed
-
SCRIPT: Self-Critic PreTraining of Transformers1 Jun 2021 0 repositories listed
-
Target-Aware Data Augmentation for Stance Detection1 Jun 2021 0 repositories listed
-
Larger-Scale Transformers for Multilingual Masked Language Modeling2 May 2021 0 repositories listed
-
Understanding Chinese Video and Language via Contrastive Multimodal Pre-Training19 Apr 2021 0 repositories listed
-
On the Influence of Masking Policies in Intermediate Pre-training18 Apr 2021 0 repositories listed
-
Masked Language Modeling and the Distributional Hypothesis: Order Word Matters Pre-training for Little14 Apr 2021 0 repositories listed
-
Pseudo-Label Guided Unsupervised Domain Adaptation of Contextual Embeddings1 Apr 2021 0 repositories listed
-
UC2: Universal Cross-lingual Cross-modal Vision-and-Language Pre-training1 Apr 2021 0 repositories listed
-
Self-supervised Image-text Pre-training With Mixed Data In Chest X-rays30 Mar 2021 0 repositories listed
-
Variable Name Recovery in Decompiled Binary Code using Constrained Masked Language Modeling23 Mar 2021 0 repositories listed
-
A Primer on Contrastive Pretraining in Language Processing: Methods, Lessons Learned and Perspectives25 Feb 2021 0 repositories listed
-
Bilingual Language Modeling, A transfer learning technique for Roman Urdu22 Feb 2021 0 repositories listed
-
MERMAID: Metaphor Generation with Symbolism and Discriminative Decoding23 Jan 2021 0 repositories listed
-
Universal Sentence Representations Learning with Conditional Masked Language Model1 Jan 2021 0 repositories listed
-
Universal Sentence Representation Learning with Conditional Masked Language Model28 Dec 2020 0 repositories listed
-
Profile Prediction: An Alignment-Based Pre-Training Task for Protein Sequence Models1 Dec 2020 0 repositories listed
-
Self-Supervised Relationship Probing1 Dec 2020 0 repositories listed
-
1 Dec 2020 0 repositories listed
-
Self-Supervised learning with cross-modal transformers for emotion recognition20 Nov 2020 0 repositories listed
-
A Hierarchical Multi-Modal Encoder for Moment Localization in Video Corpus18 Nov 2020 0 repositories listed
-
POSTECH-ETRI’s Submission to the WMT2020 APE Shared Task: Automatic Post-Editing with Cross-lingual Language Model1 Nov 2020 0 repositories listed
-
Effective Decoder Masking for Transformer Based End-to-End Speech Recognition27 Oct 2020 0 repositories listed
-
DICT-MLM: Improved Multilingual Pre-Training using Bilingual Dictionaries23 Oct 2020 0 repositories listed
-
ST-BERT: Cross-modal Language Model Pre-training For End-to-end Spoken Language Understanding23 Oct 2020 0 repositories listed
-
Corruption Is Not All Bad: Incorporating Discourse Structure into Pre-training via Corruption for Essay Scoring13 Oct 2020 0 repositories listed
-
VECO: Variable Encoder-decoder Pre-training for Cross-lingual Understanding and Generation28 Sep 2020 0 repositories listed
-
Learning Visual Representations with Caption Annotations4 Aug 2020 0 repositories listed
-
TensorCoder: Dimension-Wise Attention via Tensor Representation for Natural Language Modeling28 Jul 2020 0 repositories listed
-
Position Masking for Language Models2 Jun 2020 0 repositories listed
-
Segatron: Segment-aware Transformer for Language Modeling and Understanding2 Jun 2020 0 repositories listed
-
Pre-training Is (Almost) All You Need: An Application to Commonsense Reasoning29 Apr 2020 0 repositories listed
-
UHH-LT at SemEval-2020 Task 12: Fine-Tuning of Pre-Trained Transformer Networks for Offensive Language Detection23 Apr 2020 0 repositories listed
-
3 Mar 2020 0 repositories listed
-
22 Jan 2020 0 repositories listed
-
Retrieval Augmented Language Model Pre-Training1 Jan 2020 0 repositories listed
-
Emerging Cross-lingual Structure in Pretrained Language Models4 Nov 2019 0 repositories listed
-
UNITER: Learning UNiversal Image-TExt Representations25 Sep 2019 0 repositories listed
-
The Bottom-up Evolution of Representations in the Transformer: A Study with Machine Translation and Language Modeling Objectives3 Sep 2019 0 repositories listed
-
16 Aug 2019 0 repositories listed
-
BERT Masked Language Modeling for Co-reference Resolution1 Aug 2019 0 repositories listed
-
Adversarial Generation and Encoding of Nested Texts1 Jun 2019 0 repositories listed