{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modelling/papers/143","list_of":"/task/language-modelling","task":"Language Modelling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":143,"pages_in_order":177,"rows_per_page":100,"rows":[14201,14300],"of":17610,"counts":{"archive_papers_tagged":17610,"with_a_code_link":7012,"where_syntology_ran_a_sample":2428,"not_listed_spam_title":0,"listed":17610,"listed_where_code_ran":2428,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":2027,"every_run_a_failure_of_syntologys_instrument":401,"listed_with_a_run_with_no_instrument_failure":2027,"listed_every_run_a_failure_of_syntologys_instrument":401,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modelling","prev":"/task/language-modelling/papers/142","next":"/task/language-modelling/papers/144","papers":[{"url":null,"slug":"evaluating-the-text-to-sql-capabilities-of","title":"Evaluating the Text-to-SQL Capabilities of Large Language Models","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"extracting-and-inferring-personal-attributes-1","title":"Extracting and Inferring Personal Attributes from Dialogue","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"freezing-the-pivot-for-triangular-machine","title":"Freezing the Pivot for Triangular Machine Translation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"gabert-an-irish-language-model-1","title":"gaBERT — an Irish Language Model","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generated-knowledge-prompting-for-commonsense-1","title":"Generated Knowledge Prompting for Commonsense Reasoning","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-prompt-tuning-for-relation","title":"Generative Prompt Tuning for Relation Classification","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"glm-general-language-model-pretraining-with","title":"GLM: General Language Model Pretraining with Autoregressive Blank Infilling","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"heterogeneous-language-model-optimization-in","title":"Heterogeneous Language Model Optimization in Automatic Speech Recognition","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"histruct-improving-extractive-text","title":"HiStruct+: Improving Extractive Text Summarization with Hierarchical Structure Information","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"how-does-the-pre-training-objective-affect","title":"How does the pre-training objective affect what large language models learn about linguistic properties?","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"human-language-modeling","title":"Human Language Modeling","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"idpg-an-instance-dependent-prompt-generation","title":"IDPG: An Instance-Dependent Prompt Generation Method","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-controllable-text-generation-with","title":"Improving Controllable Text Generation with Position-Aware Weighted Decoding","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-unsupervised-sentence","title":"Improving Unsupervised Sentence Simplification Using Fine-Tuned Masked Language Models","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/incorporating-multiple-knowledge-sources-for","slug":"incorporating-multiple-knowledge-sources-for","title":"Incorporating Multiple Knowledge Sources for Targeted Aspect-based Financial Sentiment Analysis","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"invariant-language-modeling-1","title":"Invariant Language Modeling","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"is-whole-word-masking-always-better-for","title":"\"Is Whole Word Masking Always Better for Chinese BERT?\": Probing on Chinese Grammatical Error Correction","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"kala-knowledge-augmented-language-model","title":"KALA: Knowledge-Augmented Language Model Adaptation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"kinyabert-a-morphology-aware-kinyarwanda","title":"KinyaBERT: a Morphology-aware Kinyarwanda Language Model","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledgeable-prompt-tuning-incorporating-1","title":"Knowledgeable Prompt-tuning: Incorporating Knowledge into Prompt Verbalizer for Text Classification","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-guided-knowledge-subgraphs-for","title":"Language Model-Guided Knowledge Subgraphs for Question Answering","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-tokenization-in-private-federated","title":"Learning Tokenization in Private Federated Learning with Sub-Word Model Sampling","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-uni-modal-self-supervised-learning","title":"Leveraging Uni-Modal Self-Supervised Learning for Multimodal Audio-visual Speech Recognition","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-visual-knowledge-in-language-tasks","title":"Leveraging Visual Knowledge in Language Tasks: An Empirical Study on Intermediate Pre-training for Cross-Modal Knowledge Transfer","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mathion-solving-math-word-problems-with","title":"MATHion: Solving Math Word Problems with Logically Consistent Problems","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"meta-learning-via-language-model-in-context-1","title":"Meta-learning via Language Model In-context Tuning","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mimicause-representation-and-automatic","title":"MIMICause: Representation and automatic extraction of causal relation types from clinical notes","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mix-and-match-learning-free-controllable-text","title":"Mix and Match: Learning-free Controllable Text Generationusing Energy Language Models","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mukayese-turkish-nlp-strikes-back","title":"Mukayese: Turkish NLP Strikes Back","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-stage-prompting-for-knowledgeable","title":"Multi-Stage Prompting for Knowledgeable Dialogue Generation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-syntax-aware-language-modeling","title":"Multilingual Syntax-aware Language Modeling through Dependency Tree Conversion","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-unsupervised-sequence-1","title":"Multilingual unsupervised sequence segmentation transfers to extremely low-resource languages","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"n-grammer-augmenting-transformers-with-latent","title":"N-grammer: Augmenting Transformers with latent n-grams","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"neighborhood-contrastive-learning-for","title":"Neighborhood Contrastive Learning for Scientific Document Representations with Citation Embeddings","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"nsp-bert-a-prompt-based-zero-shot-learner-1","title":"NSP-BERT: A Prompt-based Zero-Shot Learner Through an Original Pre-training Task —— Next Sentence Prediction","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"nsp-ner-a-prompt-based-learner-for-few-shot","title":"NSP-NER: A Prompt-based Learner for Few-shot NER Driven by Next Sentence Prediction","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-a-benefit-of-masked-language-model","title":"On a Benefit of Masked Language Model Pretraining: Robustness to Simplicity Bias","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-multilingual-capabilities-of-very-1","title":"On the Multilingual Capabilities of Very Large-Scale English Language Models","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-use-of-entity-embeddings-from-pre","title":"On the Use of Entity Embeddings from Pre-Trained Language Models for Knowledge Graph Completion","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"phone-ing-it-in-towards-flexible-multi-modal","title":"Phone-ing it in: Towards Flexible Multi-Modal Language Model Training by Phonetic Representations of Data","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"phrase-aware-unsupervised-constituency","title":"Phrase-aware Unsupervised Constituency Parsing","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"pinyin-bert-a-new-solution-to-chinese-pinyin","title":"Pinyin-bert: A new solution to Chinese pinyin to character conversion task","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"plug-tagger-a-pluggable-sequence-labeling-1","title":"Plug-Tagger: A Pluggable Sequence Labeling Framework with Pre-trained Language Models","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"predicting-attention-sparsity-in-transformers-1","title":"Predicting Attention Sparsity in Transformers","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"predictive-text-for-agglutinative-and","title":"Predictive text for agglutinative and polysynthetic languages","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"prix-lm-pretraining-for-multilingual-1","title":"Prix-LM: Pretraining for Multilingual Knowledge Base Construction","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"probing-berts-priors-with-serial-reproduction","title":"Probing BERT’s priors with serial reproduction chains","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-learning-for-fine-grained-entity-1","title":"Prompt-Learning for Fine-Grained Entity Typing","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"prompting-as-multimodal-fusing","title":"Prompting as Multimodal Fusing","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"psych-e-configurable-response-generation","title":"Psych-E: Configurable Response Generation using Personality Traits and Pragmatics","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"rare-tokens-degenerate-all-tokens-improving","title":"Rare Tokens Degenerate All Tokens: Improving Neural Text Generation via Adaptive Gradient Gating for Rare Token Embeddings","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"re-a-study-for-restorable-embeddings","title":"RE: A Study for Restorable Embeddings","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"repetition-facilitates-processing-the","title":"Repetition Facilitates Processing: The Processing Advantage of Construction Repetition in Dialogue","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"schema-free-dependency-parsing-via-sequence","title":"Schema-Free Dependency Parsing via Sequence Generation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"self-distilled-pruning-of-neural-networks-1","title":"Self-Distilled Pruning of Neural Networks","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"sentence-level-privacy-for-document","title":"Sentence-level Privacy for Document Embeddings","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"stablemoe-stable-routing-strategy-for-mixture","title":"StableMoE: Stable Routing Strategy for Mixture of Experts","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"taco-pre-training-of-deep-transformers-with","title":"TACO: Pre-training of Deep Transformers with Attention Convolution using Disentangled Positional Representation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"temporal-language-modeling-for-short-text","title":"Temporal Language Modeling for Short Text Document Classification with Transformers","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"text-smoothing-enhance-various-data","title":"Text Smoothing: Enhance Various Data Augmentation Methods on Text Classification Tasks","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"text-to-table-a-new-way-of-information-1","title":"Text-to-Table: A New Way of Information Extraction","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"tokenization-on-the-number-line-is-all-you","title":"Tokenization on the Number Line is All You Need","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-a-progression-aware-autonomous","title":"Towards a Progression-Aware Autonomous Dialogue Agent","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-unified-prompt-tuning-for-few-shot","title":"Towards Unified Prompt Tuning for Few-shot Learning","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"training-data-is-more-valuable-than-you-think","title":"Training Data is More Valuable than You Think: A Simple and Effective Method by Retrieving from Training Data","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unipelt-a-unified-framework-for-parameter-1","title":"UniPELT: A Unified Framework for Parameter-Efficient Language Model Tuning","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unisar-a-unified-structure-aware","title":"UniSAr: A Unified Structure-Aware Autoregressive Language Model for Text-to-SQL","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-dependency-graph-network","title":"Unsupervised Dependency Graph Network","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"using-structured-content-plans-for-fine","title":"Using Structured Content Plans for Fine-grained Syntactic Control in Pretrained Language Model Generation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"what-works-and-doesn-t-work-a-deep-decoder","title":"What Works and Doesn't Work, A Deep Decoder for Neural Machine Translation","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"your-fairness-may-vary-pretrained-language-1","title":"Your fairness may vary: Pretrained language model fairness in toxic text classification","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"calculating-question-similarity-is-enough-a","title":"Calculating Question Similarity is Enough: A New Method for KBQA Tasks","date":"2021-11-15","arxiv_id":"2111.07658","repositories_listed":0,"syntology":null},{"url":null,"slug":"choose-your-programming-copilot-a-comparison","title":"Choose Your Programming Copilot: A Comparison of the Program Synthesis Performance of GitHub Copilot and Genetic Programming","date":"2021-11-15","arxiv_id":"2111.07875","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-augmentation-for-speech-recognition-in","title":"Analysis of Data Augmentation Methods for Low-Resource Maltese ASR","date":"2021-11-15","arxiv_id":"2111.07793","repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-unsupervised-and-supervised-training","title":"Joint Unsupervised and Supervised Training for Multilingual ASR","date":"2021-11-15","arxiv_id":"2111.08137","repositories_listed":0,"syntology":null},{"url":null,"slug":"explainable-semantic-space-by-grounding","title":"Explainable Semantic Space by Grounding Language to Vision with Cross-Modal Contrastive Learning","date":"2021-11-13","arxiv_id":"2111.07180","repositories_listed":0,"syntology":null},{"url":null,"slug":"socialbert-transformers-for-online","title":"SocialBERT -- Transformers for Online SocialNetwork Language Modelling","date":"2021-11-13","arxiv_id":"2111.07148","repositories_listed":0,"syntology":null},{"url":null,"slug":"hmd-amp-protein-language-powered-hierarchical","title":"HMD-AMP: Protein Language-Powered Hierarchical Multi-label Deep Forest for Annotating Antimicrobial Peptides","date":"2021-11-11","arxiv_id":"2111.06023","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-normalized-importance-sampling-for","title":"Self-Normalized Importance Sampling for Neural Language Modeling","date":"2021-11-11","arxiv_id":"2111.06310","repositories_listed":0,"syntology":null},{"url":null,"slug":"synthbio-a-case-study-in-human-ai","title":"SynthBio: A Case Study in Human-AI Collaborative Curation of Text Datasets","date":"2021-11-11","arxiv_id":"2111.06467","repositories_listed":0,"syntology":null},{"url":null,"slug":"fpm-a-collection-of-large-scale-foundation","title":"FPM: A Collection of Large-scale Foundation Pre-trained Language Models","date":"2021-11-09","arxiv_id":"2111.04909","repositories_listed":0,"syntology":null},{"url":null,"slug":"explaining-face-presentation-attack-detection","title":"Explaining Face Presentation Attack Detection Using Natural Language","date":"2021-11-08","arxiv_id":"2111.04862","repositories_listed":0,"syntology":null},{"url":null,"slug":"conversational-speech-recognition-leveraging","title":"Effective Cross-Utterance Language Modeling for Conversational Speech Recognition","date":"2021-11-05","arxiv_id":"2111.03333","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-text-autoencoder-from-transformer-for-fast","title":"A text autoencoder from transformer for fast encoding language representation","date":"2021-11-04","arxiv_id":"2111.02844","repositories_listed":0,"syntology":null},{"url":null,"slug":"corelm-coreference-aware-language-model-fine-1","title":"CoreLM: Coreference-aware Language Model Fine-Tuning","date":"2021-11-04","arxiv_id":"2111.02687","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-advantages-of-interactive-and-non","title":"Leveraging Advantages of Interactive and Non-Interactive Models for Vector-Based Cross-Lingual Information Retrieval","date":"2021-11-03","arxiv_id":"2111.01992","repositories_listed":0,"syntology":null},{"url":null,"slug":"phylotransformer-a-discriminative-model-for","title":"PhyloTransformer: A Discriminative Model for Mutation Prediction Based on a Multi-head Self-attention Mechanism","date":"2021-11-03","arxiv_id":"2111.01969","repositories_listed":0,"syntology":null},{"url":null,"slug":"detection-of-hate-speech-using-bert-and-hate","title":"Detection of Hate Speech using BERT and Hate Speech Word Embedding with Deep Model","date":"2021-11-02","arxiv_id":"2111.01515","repositories_listed":0,"syntology":null},{"url":null,"slug":"integrating-pretrained-language-model-for","title":"Integrating Pretrained Language Model for Dialogue Policy Learning","date":"2021-11-02","arxiv_id":"2111.01398","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-fine-grained-analysis-of-bertscore","title":"A Fine-Grained Analysis of BERTScore","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-language-model-based-generative-classifier","title":"A Language Model-based Generative Classifier for Sentence-level Discourse Parsing","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-practical-perspective-on-connective","title":"A practical perspective on connective generation","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"apgn-adversarial-and-parameter-generation","title":"APGN: Adversarial and Parameter Generation Networks for Multi-Source Cross-Domain Dependency Parsing","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"apirecx-cross-library-api-recommendation-via","title":"APIRecX: Cross-Library API Recommendation via Pre-Trained Language Model","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"bart-for-post-correction-of-ocr-newspaper","title":"BART for Post-Correction of OCR Newspaper Text","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"bpm-mt-enhanced-backchannel-prediction-model","title":"BPM_MT: Enhanced Backchannel Prediction Model using Multi-Task Learning","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"can-character-based-language-models-improve-1","title":"Can Character-based Language Models Improve Downstream Task Performances In Low-Resource And Noisy Language Scenarios?","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"chinese-wplc-a-chinese-dataset-for-evaluating","title":"Chinese WPLC: A Chinese Dataset for Evaluating Pretrained Language Models on Word Prediction Given Long-Range Context","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"compressive-performers-in-language-modelling","title":"Compressive Performers in Language Modelling","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"corporate-bankruptcy-prediction-with-bert","title":"Corporate Bankruptcy Prediction with BERT Model","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"8a26940f996dfcb2cbdde7e97ab963eb0fd3dc66a4c98f7e1d73acb3b0ac5d37","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}