{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/129","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":129,"pages_in_order":142,"rows_per_page":100,"rows":[12801,12900],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/128","next":"/task/language-modeling/papers/130","papers":[{"url":null,"slug":"cbag-conditional-biomedical-abstract","title":"CBAG: Conditional Biomedical Abstract Generation","date":"2020-02-13","arxiv_id":"2002.05637","repositories_listed":0,"syntology":null},{"url":null,"slug":"comparison-of-turkish-word-representations","title":"Comparison of Turkish Word Representations Trained on Different Morphological Forms","date":"2020-02-13","arxiv_id":"2002.05417","repositories_listed":0,"syntology":null},{"url":null,"slug":"pre-training-for-query-rewriting-in-a-spoken","title":"Pre-Training for Query Rewriting in A Spoken Language Understanding System","date":"2020-02-13","arxiv_id":"2002.05607","repositories_listed":0,"syntology":null},{"url":null,"slug":"regularizing-activations-in-neural-networks-1","title":"Regularizing activations in neural networks via distribution matching with the Wasserstein metric","date":"2020-02-13","arxiv_id":"2002.05366","repositories_listed":0,"syntology":null},{"url":null,"slug":"localized-flood-detectionwith-minimal-labeled","title":"Localized Flood DetectionWith Minimal Labeled Social Media Data Using Transfer Learning","date":"2020-02-10","arxiv_id":"2003.04973","repositories_listed":0,"syntology":null},{"url":null,"slug":"fastwave-accelerating-autoregressive","title":"FastWave: Accelerating Autoregressive Convolutional Neural Networks on FPGA","date":"2020-02-09","arxiv_id":"2002.04971","repositories_listed":0,"syntology":null},{"url":null,"slug":"limits-of-detecting-text-generated-by-large","title":"Limits of Detecting Text Generated by Large-Scale Language Models","date":"2020-02-09","arxiv_id":"2002.03438","repositories_listed":0,"syntology":null},{"url":null,"slug":"aligning-the-pretraining-and-finetuning","title":"Aligning the Pretraining and Finetuning Objectives of Language Models","date":"2020-02-05","arxiv_id":"2002.02000","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-difference-of-convex-programming-approach","title":"A Difference-of-Convex Programming Approach With Parallel Branch-and-Bound For Sentence Compression Via A Hybrid Extractive Model","date":"2020-02-02","arxiv_id":"2002.01352","repositories_listed":0,"syntology":null},{"url":null,"slug":"aspect-based-academic-search-using-domain","title":"Aspect-based Academic Search using Domain-specific KB","date":"2020-01-29","arxiv_id":"2001.10781","repositories_listed":0,"syntology":null},{"url":null,"slug":"pel-bert-a-joint-model-for-protocol-entity","title":"PEL-BERT: A Joint Model for Protocol Entity Linking","date":"2020-01-28","arxiv_id":"2002.00744","repositories_listed":0,"syntology":null},{"url":null,"slug":"compressing-language-models-using-doped","title":"Compressing Language Models using Doped Kronecker Products","date":"2020-01-24","arxiv_id":"2001.08896","repositories_listed":0,"syntology":null},{"url":"/paper/imagebert-cross-modal-pre-training-with-large","slug":"imagebert-cross-modal-pre-training-with-large","title":"ImageBERT: Cross-modal Pre-training with Large-scale Weak-supervised Image-Text Data","date":"2020-01-22","arxiv_id":"2001.07966","repositories_listed":0,"syntology":null},{"url":"/paper/single-headed-attention-based-sequence-to","slug":"single-headed-attention-based-sequence-to","title":"Single headed attention based sequence-to-sequence model for state-of-the-art results on Switchboard","date":"2020-01-20","arxiv_id":"2001.07263","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-continuous-space-neural-language-model-for","title":"A Continuous Space Neural Language Model for Bengali Language","date":"2020-01-11","arxiv_id":"2001.05315","repositories_listed":0,"syntology":null},{"url":"/paper/learning-cross-context-entity-representations-1","slug":"learning-cross-context-entity-representations-1","title":"Learning Cross-Context Entity Representations from Text","date":"2020-01-11","arxiv_id":"2001.03765","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-minimal-supervision-bert-based","title":"Towards Minimal Supervision BERT-based Grammar Error Correction","date":"2020-01-10","arxiv_id":"2001.03521","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-business-process-structure","title":"Automatic Business Process Structure Discovery using Ordered Neurons LSTM: A Preliminary Study","date":"2020-01-05","arxiv_id":"2001.01243","repositories_listed":0,"syntology":null},{"url":null,"slug":"transformer-based-language-modeling-and","title":"Transformer-based language modeling and decoding for conversational speech recognition","date":"2020-01-04","arxiv_id":"2001.01140","repositories_listed":0,"syntology":null},{"url":null,"slug":"incremental-monoidal-grammars","title":"Incremental Monoidal Grammars","date":"2020-01-02","arxiv_id":"2001.02296","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-multi-head-co-attention-for-multi-choice-1","title":"Dual Multi-head Co-attention for Multi-choice Reading Comprehension","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fedboost-a-communication-efficient-algorithm","title":"FedBoost: A Communication-Efficient Algorithm for Federated Learning","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"poked-a-semi-supervised-system-for-word-sense","title":"PoKED: A Semi-Supervised System for Word Sense Disambiguation","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"retrieval-augmented-language-model-pre","title":"Retrieval Augmented Language Model Pre-Training","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"script-knowledge-constrains-ellipses-in","title":"Script knowledge constrains ellipses in fragments – Evidence from production data and language modeling","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"training-deep-networks-with-stochastic","title":"Training Deep Networks with Stochastic Gradient Normalized by Layerwise Adaptive Second Moments","date":"2020-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"hinglish-language-modeling-a-messy-code-mixed","title":"\"Hinglish\" Language -- Modeling a Messy Code-Mixed Language","date":"2019-12-30","arxiv_id":"1912.13109","repositories_listed":0,"syntology":null},{"url":null,"slug":"improved-multi-stage-training-of-online","title":"Improved Multi-Stage Training of Online Attention-based Encoder-Decoder Models","date":"2019-12-28","arxiv_id":"1912.12384","repositories_listed":0,"syntology":null},{"url":null,"slug":"convolutional-quantum-like-language-model","title":"Convolutional Quantum-Like Language Model with Mutual-Attention for Product Rating Prediction","date":"2019-12-25","arxiv_id":"1912.11720","repositories_listed":0,"syntology":null},{"url":null,"slug":"candidate-fusion-integrating-language","title":"Candidate Fusion: Integrating Language Modelling into a Sequence-to-Sequence Handwritten Word Recognition Architecture","date":"2019-12-21","arxiv_id":"1912.10308","repositories_listed":0,"syntology":null},{"url":null,"slug":"pretrained-encyclopedia-weakly-supervised-1","title":"Pretrained Encyclopedia: Weakly Supervised Knowledge-Pretrained Language Model","date":"2019-12-20","arxiv_id":"1912.09637","repositories_listed":0,"syntology":null},{"url":null,"slug":"analyzing-privacy-loss-in-updates-of-natural-1","title":"Analyzing Information Leakage of Updates to Natural Language Models","date":"2019-12-17","arxiv_id":"1912.07942","repositories_listed":0,"syntology":null},{"url":null,"slug":"karl-knowledge-aware-reasoning-memory","title":"KARL: Knowledge-Aware Reasoning Memory Modeling with Reinforcement Learning of Vector Space","date":"2019-12-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"waldorf-wasteless-language-model-distillation","title":"WaLDORf: Wasteless Language-model Distillation On Reading-comprehension","date":"2019-12-13","arxiv_id":"1912.06638","repositories_listed":0,"syntology":null},{"url":null,"slug":"just-add-functions-a-neural-symbolic-language","title":"Just Add Functions: A Neural-Symbolic Language Model","date":"2019-12-11","arxiv_id":"1912.05421","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-text-classification-with-generative","title":"Zero-shot Text Classification With Generative Language Models","date":"2019-12-10","arxiv_id":"1912.10165","repositories_listed":0,"syntology":null},{"url":null,"slug":"audio-attention-discriminative-language-model","title":"Audio-attention discriminative language model for ASR rescoring","date":"2019-12-06","arxiv_id":"1912.03363","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparative-study-of-pretrained-language","title":"A Comparative Study of Pretrained Language Models on Thai Social Text Categorization","date":"2019-12-03","arxiv_id":"1912.01580","repositories_listed":0,"syntology":null},{"url":null,"slug":"multiscale-self-attentive-convolutions-for","title":"Multiscale Self Attentive Convolutions for Vision and Language Modeling","date":"2019-12-03","arxiv_id":"1912.01521","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-inflection-generation-using","title":"Unsupervised Inflection Generation Using Neural Language Modeling","date":"2019-12-03","arxiv_id":"1912.01156","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-bootstrapping-using-neural","title":"Language Model Bootstrapping Using Neural Machine Translation For Conversational Speech Recognition","date":"2019-12-02","arxiv_id":"1912.00958","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-modelling-with-nmt-query-translation","title":"Language Modelling with NMT Query Translation for Amharic-Arabic Cross-Language Information Retrieval","date":"2019-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mixtape-breaking-the-softmax-bottleneck","title":"Mixtape: Breaking the Softmax Bottleneck Efficiently","date":"2019-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-german-verb-argument-structures","title":"Neural language modeling of free word order argument structure","date":"2019-11-30","arxiv_id":"1912.00239","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-iterative-polishing-framework-based-on","title":"An Iterative Polishing Framework based on Quality Aware Masked Language Model for Chinese Poetry Generation","date":"2019-11-29","arxiv_id":"1911.13182","repositories_listed":0,"syntology":null},{"url":null,"slug":"inducing-relational-knowledge-from-bert","title":"Inducing Relational Knowledge from BERT","date":"2019-11-28","arxiv_id":"1911.12753","repositories_listed":0,"syntology":null},{"url":null,"slug":"minimum-bayes-risk-training-of-rnn-transducer","title":"Minimum Bayes Risk Training of RNN-Transducer for End-to-End Speech Recognition","date":"2019-11-28","arxiv_id":"1911.12487","repositories_listed":0,"syntology":null},{"url":null,"slug":"findings-of-the-2016-wmt-shared-task-on-cross-1","title":"Findings of the 2016 WMT Shared Task on Cross-lingual Pronoun Prediction","date":"2019-11-27","arxiv_id":"1911.12091","repositories_listed":0,"syntology":null},{"url":null,"slug":"simplebooks-long-term-dependency-book-dataset","title":"SimpleBooks: Long-term dependency book dataset with simplified English vocabulary for word-level language modeling","date":"2019-11-27","arxiv_id":"1911.12391","repositories_listed":0,"syntology":null},{"url":null,"slug":"taking-a-stance-on-fake-news-towards","title":"Taking a Stance on Fake News: Towards Automatic Disinformation Assessment via Deep Bidirectional Transformer Language Models for Stance Detection","date":"2019-11-27","arxiv_id":"1911.11951","repositories_listed":0,"syntology":null},{"url":null,"slug":"relevance-promoting-language-model-for-short","title":"Relevance-Promoting Language Model for Short-Text Conversation","date":"2019-11-26","arxiv_id":"1911.11489","repositories_listed":0,"syntology":null},{"url":null,"slug":"independent-language-modeling-architecture","title":"Independent language modeling architecture for end-to-end ASR","date":"2019-11-25","arxiv_id":"1912.00863","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-domain-adaptation-of-language","title":"Unsupervised Domain Adaptation of Language Models for Reading Comprehension","date":"2019-11-25","arxiv_id":"1911.10768","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-eeg-based-continuous-speech","title":"Improving EEG based Continuous Speech Recognition","date":"2019-11-24","arxiv_id":"1911.11610","repositories_listed":0,"syntology":null},{"url":null,"slug":"paraphrasing-with-large-language-models-1","title":"Paraphrasing with Large Language Models","date":"2019-11-21","arxiv_id":"1911.09661","repositories_listed":0,"syntology":null},{"url":null,"slug":"thick-net-parallel-network-structure-for","title":"Thick-Net: Parallel Network Structure for Sequential Modeling","date":"2019-11-19","arxiv_id":"1911.08074","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-natural-question-answering-with-1","title":"Unsupervised Natural Question Answering with a Small Model","date":"2019-11-19","arxiv_id":"1911.08340","repositories_listed":0,"syntology":null},{"url":null,"slug":"drug-repurposing-for-cancer-an-nlp-approach","title":"Drug Repurposing for Cancer: An NLP Approach to Identify Low-Cost Therapies","date":"2019-11-18","arxiv_id":"1911.07819","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-zone-unit-for-recurrent-neural-networks","title":"Multi-Zone Unit for Recurrent Neural Networks","date":"2019-11-17","arxiv_id":"1911.07184","repositories_listed":0,"syntology":null},{"url":null,"slug":"classification-as-decoder-trading-flexibility-1","title":"Classification as Decoder: Trading Flexibility for Control in Medical Dialogue","date":"2019-11-16","arxiv_id":"1911.08554","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-subword-level-language-model-for-bangla","title":"A Subword Level Language Model for Bangla Language","date":"2019-11-15","arxiv_id":"1911.07613","repositories_listed":0,"syntology":null},{"url":null,"slug":"sparse-associative-memory-based-on-contextual","title":"Sparse associative memory based on contextual code learning for disambiguating word senses","date":"2019-11-14","arxiv_id":"1911.06415","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-a-code-switching-language-model-with","title":"Training a code-switching language model with monolingual data","date":"2019-11-14","arxiv_id":"1911.06003","repositories_listed":0,"syntology":null},{"url":null,"slug":"adapting-and-evaluating-a-deep-learning","title":"Adapting and evaluating a deep learning language model for clinical why-question answering","date":"2019-11-13","arxiv_id":"1911.05604","repositories_listed":0,"syntology":null},{"url":null,"slug":"structured-sparsification-of-gated-recurrent","title":"Structured Sparsification of Gated Recurrent Neural Networks","date":"2019-11-13","arxiv_id":"1911.05585","repositories_listed":0,"syntology":null},{"url":null,"slug":"long-span-language-modeling-for-speech","title":"Long-span language modeling for speech recognition","date":"2019-11-11","arxiv_id":"1911.04571","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-architecture-search-for-natural","title":"Neural Architecture Search for Natural Language Understanding","date":"2019-11-11","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-driven-unsupervised-neural","title":"Language Model-Driven Unsupervised Neural Machine Translation","date":"2019-11-10","arxiv_id":"1911.03937","repositories_listed":0,"syntology":null},{"url":null,"slug":"preventing-posterior-collapse-in-sequence","title":"On Posterior Collapse and Encoder Feature Dispersion in Sequence VAEs","date":"2019-11-10","arxiv_id":"1911.03976","repositories_listed":0,"syntology":null},{"url":null,"slug":"code-mixed-to-monolingual-translation","title":"Code-Mixed to Monolingual Translation Framework","date":"2019-11-09","arxiv_id":"1911.03772","repositories_listed":0,"syntology":null},{"url":null,"slug":"reducing-sentiment-bias-in-language-models-1","title":"Reducing Sentiment Bias in Language Models via Counterfactual Evaluation","date":"2019-11-08","arxiv_id":"1911.03064","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-lig-system-for-the-english-czech-text","title":"The LIG system for the English-Czech Text Translation Task of IWSLT 2019","date":"2019-11-07","arxiv_id":"1911.02898","repositories_listed":0,"syntology":null},{"url":null,"slug":"rnn-t-for-latency-controlled-asr-with","title":"RNN-T For Latency Controlled ASR With Improved Beam Search","date":"2019-11-05","arxiv_id":"1911.01629","repositories_listed":0,"syntology":null},{"url":null,"slug":"bas-an-answer-selection-method-using-bert","title":"BAS: An Answer Selection Method Using BERT Language Model","date":"2019-11-04","arxiv_id":"1911.01528","repositories_listed":0,"syntology":null},{"url":null,"slug":"emerging-cross-lingual-structure-in","title":"Emerging Cross-lingual Structure in Pretrained Language Models","date":"2019-11-04","arxiv_id":"1911.01464","repositories_listed":0,"syntology":null},{"url":null,"slug":"bert-cnn-a-hierarchical-patent-classifier","title":"BERT-CNN: a Hierarchical Patent Classifier Based on a Pre-Trained Language Model","date":"2019-11-03","arxiv_id":"1911.06241","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-simple-and-effective-method-for-injecting","title":"A Simple and Effective Method for Injecting Word-Level Information into Character-Aware Neural Language Models","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-argument-quality-assessment-new-1","title":"Automatic Argument Quality Assessment - New Datasets and Methods","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"beamseg-a-joint-model-for-multi-document","title":"BeamSeg: A Joint Model for Multi-Document Segmentation and Topic Identification","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"chameleon-a-language-model-adaptation-toolkit","title":"Chameleon: A Language Model Adaptation Toolkit for Automatic Speech Recognition of Conversational Speech","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"character-based-models-for-adversarial-phone","title":"Character-Based Models for Adversarial Phone Extraction: Preventing Human Sex Trafficking","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"comparing-top-down-and-bottom-up-neural","title":"Comparing Top-Down and Bottom-Up Neural Generative Dependency Models","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"context-aware-neural-machine-translation-2","title":"Context-Aware Neural Machine Translation Decoding","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"contextual-text-denoising-with-masked-1","title":"Contextual Text Denoising with Masked Language Model","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"coreference-resolution-in-full-text-articles","title":"Coreference Resolution in Full Text Articles with BERT and Syntax-based Mention Filtering","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-transfer-learning-with-data","title":"Cross-lingual Transfer Learning with Data Selection for Large-Scale Spoken Language Understanding","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-bidirectional-transformers-for-relation-1","title":"Deep Bidirectional Transformers for Relation Extraction without Supervision","date":"2019-11-01","arxiv_id":"1911.00313","repositories_listed":0,"syntology":null},{"url":null,"slug":"english-myanmar-supervised-and-unsupervised","title":"English-Myanmar Supervised and Unsupervised NMT: NICT's Machine Translation Systems at WAT-2019","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-bert-for-lexical-normalization","title":"Enhancing BERT for Lexical Normalization","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-variational-autoencoders-with","title":"Enhancing Variational Autoencoders with Mutual Information Neural Estimation for Text Generation","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"experimenting-with-power-divergences-for","title":"Experimenting with Power Divergences for Language Modeling","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-grained-propaganda-detection-with-fine","title":"Fine-Grained Propaganda Detection with Fine-Tuned BERT","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"gem-generative-enhanced-model-for-adversarial","title":"GEM: Generative Enhanced Model for adversarial attacks","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generalizing-question-answering-system-with","title":"Generalizing Question Answering System with Pre-trained Language Model Fine-tuning","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"hello-its-gpt-2-how-can-i-help-you-towards-1","title":"Hello, It's GPT-2 - How Can I Help You? Towards the Use of Pretrained Language Models for Task-Oriented Dialogue Systems","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/improving-multi-label-emotion-classification-1","slug":"improving-multi-label-emotion-classification-1","title":"Improving Multi-label Emotion Classification by Integrating both General and Domain-specific Knowledge","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-pre-trained-multilingual-model-with","title":"Improving Pre-Trained Multilingual Model with Vocabulary Expansion","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"jeff-da-at-coin-shared-task","title":"Jeff Da at COIN - Shared Task: BIG MOOD: Relating Transformers to Explicit Commonsense Knowledge","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"justifying-recommendations-using-distantly","title":"Justifying Recommendations using Distantly-Labeled Reviews and Fine-Grained Aspects","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"knowsemlm-a-knowledge-infused-semantic","title":"KnowSemLM: A Knowledge Infused Semantic Language Model","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"a1612277efbad3c3268df6f20cd744ed7cd1f1ad81bb4655074dcd72cfb82a0f","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}