Browse State-of-the-Art › Language Modelling › Papers, page 143
Language Modelling
Papers archive 2025-07-28
archive papers tagged: 17,610 · with a code link: 7,012 · where Syntology ran a sample: 2,428 (2,027 with a run with no instrument failure, 401 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (2,428 of 17,610 tagged: 2,027 with a run with no instrument failure, 401 where every run was a failure of Syntology's instrument)
Page 143 of 177: papers 14,201 to 14,300 of 17,610, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Evaluating the Text-to-SQL Capabilities of Large Language Models16 Nov 2021 0 repositories listed
-
Extracting and Inferring Personal Attributes from Dialogue16 Nov 2021 0 repositories listed
-
Freezing the Pivot for Triangular Machine Translation16 Nov 2021 0 repositories listed
-
gaBERT — an Irish Language Model16 Nov 2021 0 repositories listed
-
Generated Knowledge Prompting for Commonsense Reasoning16 Nov 2021 0 repositories listed
-
Generative Prompt Tuning for Relation Classification16 Nov 2021 0 repositories listed
-
GLM: General Language Model Pretraining with Autoregressive Blank Infilling16 Nov 2021 0 repositories listed
-
Heterogeneous Language Model Optimization in Automatic Speech Recognition16 Nov 2021 0 repositories listed
-
HiStruct+: Improving Extractive Text Summarization with Hierarchical Structure Information16 Nov 2021 0 repositories listed
-
How does the pre-training objective affect what large language models learn about linguistic properties?16 Nov 2021 0 repositories listed
-
Human Language Modeling16 Nov 2021 0 repositories listed
-
IDPG: An Instance-Dependent Prompt Generation Method16 Nov 2021 0 repositories listed
-
Improving Controllable Text Generation with Position-Aware Weighted Decoding16 Nov 2021 0 repositories listed
-
Improving Unsupervised Sentence Simplification Using Fine-Tuned Masked Language Models16 Nov 2021 0 repositories listed
-
16 Nov 2021 0 repositories listed
-
Invariant Language Modeling16 Nov 2021 0 repositories listed
-
"Is Whole Word Masking Always Better for Chinese BERT?": Probing on Chinese Grammatical Error Correction16 Nov 2021 0 repositories listed
-
KALA: Knowledge-Augmented Language Model Adaptation16 Nov 2021 0 repositories listed
-
KinyaBERT: a Morphology-aware Kinyarwanda Language Model16 Nov 2021 0 repositories listed
-
Knowledgeable Prompt-tuning: Incorporating Knowledge into Prompt Verbalizer for Text Classification16 Nov 2021 0 repositories listed
-
Language Model-Guided Knowledge Subgraphs for Question Answering16 Nov 2021 0 repositories listed
-
Learning Tokenization in Private Federated Learning with Sub-Word Model Sampling16 Nov 2021 0 repositories listed
-
Leveraging Uni-Modal Self-Supervised Learning for Multimodal Audio-visual Speech Recognition16 Nov 2021 0 repositories listed
-
Leveraging Visual Knowledge in Language Tasks: An Empirical Study on Intermediate Pre-training for Cross-Modal Knowledge Transfer16 Nov 2021 0 repositories listed
-
MATHion: Solving Math Word Problems with Logically Consistent Problems16 Nov 2021 0 repositories listed
-
Meta-learning via Language Model In-context Tuning16 Nov 2021 0 repositories listed
-
MIMICause: Representation and automatic extraction of causal relation types from clinical notes16 Nov 2021 0 repositories listed
-
Mix and Match: Learning-free Controllable Text Generationusing Energy Language Models16 Nov 2021 0 repositories listed
-
Mukayese: Turkish NLP Strikes Back16 Nov 2021 0 repositories listed
-
Multi-Stage Prompting for Knowledgeable Dialogue Generation16 Nov 2021 0 repositories listed
-
Multilingual Syntax-aware Language Modeling through Dependency Tree Conversion16 Nov 2021 0 repositories listed
-
Multilingual unsupervised sequence segmentation transfers to extremely low-resource languages16 Nov 2021 0 repositories listed
-
N-grammer: Augmenting Transformers with latent n-grams16 Nov 2021 0 repositories listed
-
Neighborhood Contrastive Learning for Scientific Document Representations with Citation Embeddings16 Nov 2021 0 repositories listed
-
NSP-BERT: A Prompt-based Zero-Shot Learner Through an Original Pre-training Task —— Next Sentence Prediction16 Nov 2021 0 repositories listed
-
NSP-NER: A Prompt-based Learner for Few-shot NER Driven by Next Sentence Prediction16 Nov 2021 0 repositories listed
-
On a Benefit of Masked Language Model Pretraining: Robustness to Simplicity Bias16 Nov 2021 0 repositories listed
-
On the Multilingual Capabilities of Very Large-Scale English Language Models16 Nov 2021 0 repositories listed
-
On the Use of Entity Embeddings from Pre-Trained Language Models for Knowledge Graph Completion16 Nov 2021 0 repositories listed
-
Phone-ing it in: Towards Flexible Multi-Modal Language Model Training by Phonetic Representations of Data16 Nov 2021 0 repositories listed
-
Phrase-aware Unsupervised Constituency Parsing16 Nov 2021 0 repositories listed
-
Pinyin-bert: A new solution to Chinese pinyin to character conversion task16 Nov 2021 0 repositories listed
-
Plug-Tagger: A Pluggable Sequence Labeling Framework with Pre-trained Language Models16 Nov 2021 0 repositories listed
-
Predicting Attention Sparsity in Transformers16 Nov 2021 0 repositories listed
-
Predictive text for agglutinative and polysynthetic languages16 Nov 2021 0 repositories listed
-
Prix-LM: Pretraining for Multilingual Knowledge Base Construction16 Nov 2021 0 repositories listed
-
Probing BERT’s priors with serial reproduction chains16 Nov 2021 0 repositories listed
-
Prompt-Learning for Fine-Grained Entity Typing16 Nov 2021 0 repositories listed
-
Prompting as Multimodal Fusing16 Nov 2021 0 repositories listed
-
Psych-E: Configurable Response Generation using Personality Traits and Pragmatics16 Nov 2021 0 repositories listed
-
Rare Tokens Degenerate All Tokens: Improving Neural Text Generation via Adaptive Gradient Gating for Rare Token Embeddings16 Nov 2021 0 repositories listed
-
RE: A Study for Restorable Embeddings16 Nov 2021 0 repositories listed
-
Repetition Facilitates Processing: The Processing Advantage of Construction Repetition in Dialogue16 Nov 2021 0 repositories listed
-
Schema-Free Dependency Parsing via Sequence Generation16 Nov 2021 0 repositories listed
-
Self-Distilled Pruning of Neural Networks16 Nov 2021 0 repositories listed
-
Sentence-level Privacy for Document Embeddings16 Nov 2021 0 repositories listed
-
StableMoE: Stable Routing Strategy for Mixture of Experts16 Nov 2021 0 repositories listed
-
TACO: Pre-training of Deep Transformers with Attention Convolution using Disentangled Positional Representation16 Nov 2021 0 repositories listed
-
Temporal Language Modeling for Short Text Document Classification with Transformers16 Nov 2021 0 repositories listed
-
Text Smoothing: Enhance Various Data Augmentation Methods on Text Classification Tasks16 Nov 2021 0 repositories listed
-
Text-to-Table: A New Way of Information Extraction16 Nov 2021 0 repositories listed
-
Tokenization on the Number Line is All You Need16 Nov 2021 0 repositories listed
-
Towards a Progression-Aware Autonomous Dialogue Agent16 Nov 2021 0 repositories listed
-
Towards Unified Prompt Tuning for Few-shot Learning16 Nov 2021 0 repositories listed
-
Training Data is More Valuable than You Think: A Simple and Effective Method by Retrieving from Training Data16 Nov 2021 0 repositories listed
-
UniPELT: A Unified Framework for Parameter-Efficient Language Model Tuning16 Nov 2021 0 repositories listed
-
UniSAr: A Unified Structure-Aware Autoregressive Language Model for Text-to-SQL16 Nov 2021 0 repositories listed
-
Unsupervised Dependency Graph Network16 Nov 2021 0 repositories listed
-
Using Structured Content Plans for Fine-grained Syntactic Control in Pretrained Language Model Generation16 Nov 2021 0 repositories listed
-
What Works and Doesn't Work, A Deep Decoder for Neural Machine Translation16 Nov 2021 0 repositories listed
-
Your fairness may vary: Pretrained language model fairness in toxic text classification16 Nov 2021 0 repositories listed
-
Calculating Question Similarity is Enough: A New Method for KBQA Tasks15 Nov 2021 0 repositories listed
-
Choose Your Programming Copilot: A Comparison of the Program Synthesis Performance of GitHub Copilot and Genetic Programming15 Nov 2021 0 repositories listed
-
Analysis of Data Augmentation Methods for Low-Resource Maltese ASR15 Nov 2021 0 repositories listed
-
Joint Unsupervised and Supervised Training for Multilingual ASR15 Nov 2021 0 repositories listed
-
Explainable Semantic Space by Grounding Language to Vision with Cross-Modal Contrastive Learning13 Nov 2021 0 repositories listed
-
SocialBERT -- Transformers for Online SocialNetwork Language Modelling13 Nov 2021 0 repositories listed
-
HMD-AMP: Protein Language-Powered Hierarchical Multi-label Deep Forest for Annotating Antimicrobial Peptides11 Nov 2021 0 repositories listed
-
Self-Normalized Importance Sampling for Neural Language Modeling11 Nov 2021 0 repositories listed
-
SynthBio: A Case Study in Human-AI Collaborative Curation of Text Datasets11 Nov 2021 0 repositories listed
-
FPM: A Collection of Large-scale Foundation Pre-trained Language Models9 Nov 2021 0 repositories listed
-
Explaining Face Presentation Attack Detection Using Natural Language8 Nov 2021 0 repositories listed
-
Effective Cross-Utterance Language Modeling for Conversational Speech Recognition5 Nov 2021 0 repositories listed
-
A text autoencoder from transformer for fast encoding language representation4 Nov 2021 0 repositories listed
-
CoreLM: Coreference-aware Language Model Fine-Tuning4 Nov 2021 0 repositories listed
-
Leveraging Advantages of Interactive and Non-Interactive Models for Vector-Based Cross-Lingual Information Retrieval3 Nov 2021 0 repositories listed
-
PhyloTransformer: A Discriminative Model for Mutation Prediction Based on a Multi-head Self-attention Mechanism3 Nov 2021 0 repositories listed
-
Detection of Hate Speech using BERT and Hate Speech Word Embedding with Deep Model2 Nov 2021 0 repositories listed
-
Integrating Pretrained Language Model for Dialogue Policy Learning2 Nov 2021 0 repositories listed
-
A Fine-Grained Analysis of BERTScore1 Nov 2021 0 repositories listed
-
A Language Model-based Generative Classifier for Sentence-level Discourse Parsing1 Nov 2021 0 repositories listed
-
A practical perspective on connective generation1 Nov 2021 0 repositories listed
-
APGN: Adversarial and Parameter Generation Networks for Multi-Source Cross-Domain Dependency Parsing1 Nov 2021 0 repositories listed
-
APIRecX: Cross-Library API Recommendation via Pre-Trained Language Model1 Nov 2021 0 repositories listed
-
BART for Post-Correction of OCR Newspaper Text1 Nov 2021 0 repositories listed
-
BPM_MT: Enhanced Backchannel Prediction Model using Multi-Task Learning1 Nov 2021 0 repositories listed
-
Can Character-based Language Models Improve Downstream Task Performances In Low-Resource And Noisy Language Scenarios?1 Nov 2021 0 repositories listed
-
Chinese WPLC: A Chinese Dataset for Evaluating Pretrained Language Models on Word Prediction Given Long-Range Context1 Nov 2021 0 repositories listed
-
Compressive Performers in Language Modelling1 Nov 2021 0 repositories listed
-
Corporate Bankruptcy Prediction with BERT Model1 Nov 2021 0 repositories listed