{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/131","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":131,"pages_in_order":142,"rows_per_page":100,"rows":[13001,13100],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/130","next":"/task/language-modeling/papers/132","papers":[{"url":null,"slug":"aspect-based-sentiment-analysis-using-bert-1","title":"Aspect-Based Sentiment Analysis using BERT","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"comparing-mt-approaches-for-text","title":"Comparing MT Approaches for Text Normalization","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-phrase-based-statistical-machine","title":"Enhancing Phrase-Based Statistical Machine Translation by Learning Phrase Representations Using Long Short-Term Memory Network","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"jointly-learning-author-and-annotated","title":"Jointly Learning Author and Annotated Character N-gram Embeddings: A Case Study in Literary Text","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-lingual-wikipedia-summarization-and","title":"Multi-lingual Wikipedia Summarization and Title Generation On Low Resource Corpus","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-language-models-for-named-entity","title":"Multilingual Language Models for Named Entity Recognition in German and English","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"persistence-pays-off-paying-attention-to-what-1","title":"Persistence pays off: Paying Attention to What the LSTM Gating Mechanism Persists","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"real-life-application-of-a-question-answering","title":"Real Life Application of a Question Answering System Using BERT Language Model","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"repurposing-decoder-transformer-language","title":"Repurposing Decoder-Transformer Language Models for Abstractive Summarization","date":"2019-09-01","arxiv_id":"1909.00325","repositories_listed":0,"syntology":null},{"url":null,"slug":"resolving-pronouns-for-a-resource-poor","title":"Resolving Pronouns for a Resource-Poor Language, Malayalam Using Resource-Rich Language, Tamil.","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-language-model-for-tunisian-dialect","title":"Semantic Language Model for Tunisian Dialect","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-seemingly-un-systematic-linking-element","title":"The Seemingly (Un)systematic Linking Element in Danish","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-accurate-text-verbalization-for-asr","title":"Towards Accurate Text Verbalization for ASR Based on Audio Alignment","date":"2019-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"behavior-gated-language-models","title":"Behavior Gated Language Models","date":"2019-08-31","arxiv_id":"1909.00107","repositories_listed":0,"syntology":null},{"url":null,"slug":"explicit-cross-lingual-pre-training-for","title":"Explicit Cross-lingual Pre-training for Unsupervised Machine Translation","date":"2019-08-31","arxiv_id":"1909.00180","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-task-learning-with-language-modeling","title":"Multi-Task Learning with Language Modeling for Question Generation","date":"2019-08-30","arxiv_id":"1908.11813","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-language-model-for-automated","title":"Pre-training A Neural Language Model Improves The Sample Efficiency of an Emergency Room Classification Model","date":"2019-08-30","arxiv_id":"1909.01136","repositories_listed":0,"syntology":null},{"url":null,"slug":"probing-representations-learned-by-multimodal","title":"Probing Representations Learned by Multimodal Recurrent and Transformer Models","date":"2019-08-29","arxiv_id":"1908.11125","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-representation-learning-for-text","title":"Adversarial Representation Learning for Text-to-Image Matching","date":"2019-08-28","arxiv_id":"1908.10534","repositories_listed":0,"syntology":null},{"url":null,"slug":"investigating-meta-learning-algorithms-for","title":"Investigating Meta-Learning Algorithms for Low-Resource Natural Language Understanding Tasks","date":"2019-08-27","arxiv_id":"1908.10423","repositories_listed":0,"syntology":null},{"url":null,"slug":"connecting-and-comparing-language-model","title":"Connecting and Comparing Language Model Interpolation Techniques","date":"2019-08-26","arxiv_id":"1908.09738","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-unsupervised-image-captioning-with","title":"Towards Unsupervised Image Captioning with Shared Multimodal Embeddings","date":"2019-08-25","arxiv_id":"1908.09317","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-framework-for-anomaly-detection-using","title":"A framework for anomaly detection using language modeling, and its applications to finance","date":"2019-08-24","arxiv_id":"1908.09156","repositories_listed":0,"syntology":null},{"url":null,"slug":"release-strategies-and-the-social-impacts-of","title":"Release Strategies and the Social Impacts of Language Models","date":"2019-08-24","arxiv_id":"1908.09203","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-optimus-prime-md-generating-medical","title":"Training Optimus Prime, M.D.: Generating Medical Certification Items by Fine-Tuning OpenAI's gpt2 Transformer Model","date":"2019-08-23","arxiv_id":"1908.08594","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-few-shot-text-classification-via","title":"When Low Resource NLP Meets Unsupervised Language Model: Meta-pretraining Then Meta-learning for Few-shot Text Classification","date":"2019-08-22","arxiv_id":"1908.08788","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequential-latent-spaces-for-modeling-the","title":"Sequential Latent Spaces for Modeling the Intention During Diverse Image Captioning","date":"2019-08-22","arxiv_id":"1908.08529","repositories_listed":0,"syntology":null},{"url":null,"slug":"190807690","title":"Latent Relation Language Models","date":"2019-08-21","arxiv_id":"1908.07690","repositories_listed":0,"syntology":null},{"url":null,"slug":"mask-and-infill-applying-masked-language","title":"\"Mask and Infill\" : Applying Masked Language Model to Sentiment Transfer","date":"2019-08-21","arxiv_id":"1908.08039","repositories_listed":0,"syntology":null},{"url":null,"slug":"question-answering-based-clinical-text","title":"Question Answering based Clinical Text Structuring Using Pre-trained Language Model","date":"2019-08-19","arxiv_id":"1908.06606","repositories_listed":0,"syntology":null},{"url":null,"slug":"190807832","title":"Parsimonious Morpheme Segmentation with an Application to Enriching Word Embeddings","date":"2019-08-18","arxiv_id":"1908.07832","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-sentence-similarity-in-natural","title":"Leveraging Sentence Similarity in Natural Language Generation: Improving Beam Search using Range Voting","date":"2019-08-17","arxiv_id":"1908.06288","repositories_listed":0,"syntology":null},{"url":null,"slug":"incorporating-word-and-subword-units-in","title":"Incorporating Word and Subword Units in Unsupervised Machine Translation Using Language Model Rescoring","date":"2019-08-16","arxiv_id":"1908.05925","repositories_listed":0,"syntology":null},{"url":"/paper/unicoder-vl-a-universal-encoder-for-vision","slug":"unicoder-vl-a-universal-encoder-for-vision","title":"Unicoder-VL: A Universal Encoder for Vision and Language by Cross-modal Pre-training","date":"2019-08-16","arxiv_id":"1908.06066","repositories_listed":0,"syntology":null},{"url":"/paper/sensebert-driving-some-sense-into-bert","slug":"sensebert-driving-some-sense-into-bert","title":"SenseBERT: Driving Some Sense into BERT","date":"2019-08-15","arxiv_id":"1908.05646","repositories_listed":0,"syntology":null},{"url":null,"slug":"visualizing-and-understanding-the","title":"Visualizing and Understanding the Effectiveness of BERT","date":"2019-08-15","arxiv_id":"1908.05620","repositories_listed":0,"syntology":null},{"url":null,"slug":"entity-aware-elmo-learning-contextual-entity","title":"Entity-aware ELMo: Learning Contextual Entity Representation for Entity Disambiguation","date":"2019-08-14","arxiv_id":"1908.05762","repositories_listed":0,"syntology":null},{"url":null,"slug":"incorporating-relation-knowledge-into","title":"Incorporating Relation Knowledge into Commonsense Reading Comprehension with Multi-task Learning","date":"2019-08-13","arxiv_id":"1908.04530","repositories_listed":0,"syntology":null},{"url":"/paper/structbert-incorporating-language-structures","slug":"structbert-incorporating-language-structures","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","date":"2019-08-13","arxiv_id":"1908.04577","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modality-latent-interaction-network-for","title":"Multi-modality Latent Interaction Network for Visual Question Answering","date":"2019-08-10","arxiv_id":"1908.04289","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-stemming-based-language-model","title":"Unsupervised Stemming based Language Model for Telugu Broadcast News Transcription","date":"2019-08-10","arxiv_id":"1908.03734","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-neural-net-augmentation-to-bert-for","title":"Exploring Neural Net Augmentation to BERT for Question Answering on SQUAD 2.0","date":"2019-08-04","arxiv_id":"1908.01767","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-learning-languages-a-key-fundamental","title":"Deep learning languages: a key fundamental shift from probabilities to weights?","date":"2019-08-02","arxiv_id":"1908.00785","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-knowledge-distillation-in-natural","title":"Self-Knowledge Distillation in Natural Language Processing","date":"2019-08-02","arxiv_id":"1908.01851","repositories_listed":0,"syntology":null},{"url":null,"slug":"amharic-word-sequence-prediction","title":"Amharic Word Sequence Prediction","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"arabic-dialect-identification-for-travel-and","title":"Arabic Dialect Identification for Travel and Twitter Text","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"bert-masked-language-modeling-for-co","title":"BERT Masked Language Modeling for Co-reference Resolution","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"constrained-sequence-to-sequence-semitic-root","title":"Constrained Sequence-to-sequence Semitic Root Extraction for Enriching Word Embeddings","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dbms-ku-interpolation-for-wmt19-news","title":"DBMS-KU Interpolation for WMT19 News Translation Task","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"detecting-and-extracting-of-adverse-drug","title":"Detecting and Extracting of Adverse Drug Reaction Mentioning Tweets with Multi-Head Self Attention","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-language-modeling-with-automatic","title":"Efficient Language Modeling with Automatic Relevance Determination in Recurrent Neural Networks","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"equipping-educational-applications-with","title":"Equipping Educational Applications with Domain Knowledge","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"gtcom-neural-machine-translation-systems-for","title":"GTCOM Neural Machine Translation Systems for WMT19","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"jhu-system-description-for-the-madar-arabic","title":"JHU System Description for the MADAR Arabic Dialect Identification Shared Task","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"ku_ai-at-mediqa-2019-domain-specific-pre","title":"KU\\_ai at MEDIQA 2019: Domain-specific Pre-training and Transfer Learning for Medical NLI","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"noisy-channel-for-low-resource-grammatical","title":"Noisy Channel for Low Resource Grammatical Error Correction","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"simple-construction-of-mixed-language-texts","title":"Simple Construction of Mixed-Language Texts for Vocabulary Learning","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"team-just-at-the-madar-shared-task-on-arabic","title":"Team JUST at the MADAR Shared Task on Arabic Fine-Grained Dialect Identification","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-lmu-munich-unsupervised-machine-1","title":"The LMU Munich Unsupervised Machine Translation System for WMT19","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-rwth-aachen-university-machine","title":"The RWTH Aachen University Machine Translation Systems for WMT 2019","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-smart-classifier-for-arabic-fine-grained","title":"The SMarT Classifier for Arabic Fine-Grained Dialect Identification","date":"2019-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"viana-visual-interactive-annotation-of","title":"VIANA: Visual Interactive Annotation of Argumentation","date":"2019-07-29","arxiv_id":"1907.12413","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-turn-dialogue-response-generation-with","title":"DLGNet: A Transformer-based Model for Dialogue Response Generation","date":"2019-07-26","arxiv_id":"1908.01841","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptive-noise-injection-a-structure","title":"Adaptive Noise Injection: A Structure-Expanding Regularization for RNN","date":"2019-07-25","arxiv_id":"1907.10885","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-transfer-for-distantly","title":"Cross-Lingual Transfer for Distantly Supervised and Low-resources Indonesian NER","date":"2019-07-25","arxiv_id":"1907.11158","repositories_listed":0,"syntology":null},{"url":null,"slug":"structured-knowledge-discovery-from-massive","title":"Structured Knowledge Discovery from Massive Text Corpus","date":"2019-07-23","arxiv_id":"1908.01837","repositories_listed":0,"syntology":null},{"url":null,"slug":"investigation-on-n-gram-approximated-rnnlms","title":"Investigation on N-gram Approximated RNNLMs for Recognition of Morphologically Rich Speech","date":"2019-07-15","arxiv_id":"1907.06407","repositories_listed":0,"syntology":null},{"url":null,"slug":"learn-spelling-from-teachers-transferring","title":"Learn Spelling from Teachers: Transferring Knowledge from Language Models to Sequence-to-Sequence Speech Recognition","date":"2019-07-13","arxiv_id":"1907.06017","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-university-of-edinburghs-submissions-to","title":"The University of Edinburgh's Submissions to the WMT19 News Translation Task","date":"2019-07-12","arxiv_id":"1907.05854","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-unconditional-language-models-recover","title":"Can Unconditional Language Models Recover Arbitrary Sentences?","date":"2019-07-10","arxiv_id":"1907.04944","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-conditioning-for-generative-music","title":"Exploring Conditioning for Generative Music Systems with Human-Interpretable Controls","date":"2019-07-09","arxiv_id":"1907.04352","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-or-statistical-an-empirical-study-on","title":"Neural or Statistical: An Empirical Study on Language Models for Chinese Input Recommendation on Mobile","date":"2019-07-09","arxiv_id":"1907.05340","repositories_listed":0,"syntology":null},{"url":null,"slug":"uw-bhi-at-mediqa-2019-an-analysis-of","title":"UW-BHI at MEDIQA 2019: An Analysis of Representation Methods for Medical Natural Language Inference","date":"2019-07-09","arxiv_id":"1907.04286","repositories_listed":0,"syntology":null},{"url":null,"slug":"improved-low-resource-somali-speech","title":"Improved low-resource Somali speech recognition by semi-supervised acoustic and language model training","date":"2019-07-06","arxiv_id":"1907.03064","repositories_listed":0,"syntology":null},{"url":"/paper/kite-automatic-speech-recognition-for","slug":"kite-automatic-speech-recognition-for","title":"Kite: Automatic speech recognition for unmanned aerial vehicles","date":"2019-07-02","arxiv_id":"1907.01195","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-surprisingly-robust-trick-for-the-winograd","title":"A Surprisingly Robust Trick for the Winograd Schema Challenge","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"combining-knowledge-hunting-and-neural","title":"Combining Knowledge Hunting and Neural Language Models to Solve the Winograd Schema Challenge","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"comparison-of-lattice-free-and-lattice-based","title":"Comparison of Lattice-Free and Lattice-Based Sequence Discriminative Training Criteria for LVCSR","date":"2019-07-01","arxiv_id":"1907.01409","repositories_listed":0,"syntology":null},{"url":null,"slug":"context-specific-language-modeling-for-human","title":"Context-specific Language Modeling for Human Trafficking Detection from Online Advertisements","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-adversarial-neural-transfer-for-low","title":"Dual Adversarial Neural Transfer for Low-Resource Named Entity Recognition","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"estimating-senses-with-sets-of-lexically","title":"Estimating senses with sets of lexically related words for Polish word sense disambiguation","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"flambe-a-customizable-framework-for-machine","title":"Flamb\\'e: A Customizable Framework for Machine Learning Experiments","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"interpolated-spectral-ngram-language-models","title":"Interpolated Spectral NGram Language Models","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-modeling-with-shared-grammar","title":"Language Modeling with Shared Grammar","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"large-dataset-and-language-model-fun-tuning","title":"Large Dataset and Language Model Fun-Tuning for Humor Recognition","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"latent-structure-models-for-natural-language","title":"Latent Structure Models for Natural Language Processing","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"maam-a-morphology-aware-alignment-model-for","title":"MAAM: A Morphology-Aware Alignment Model for Unsupervised Bilingual Lexicon Induction","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"microsoft-icecaps-an-open-source-toolkit-for","title":"Microsoft Icecaps: An Open-Source Toolkit for Conversation Modeling","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"online-infix-probability-computation-for","title":"Online Infix Probability Computation for Probabilistic Finite Automata","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"stochastic-tokenization-with-a-language-model","title":"Stochastic Tokenization with a Language Model for Neural Text Classification","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"training-hybrid-language-models-by","title":"Training Hybrid Language Models by Marginalizing over Segmentations","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-pretraining-for-neural-machine","title":"Unsupervised Pretraining for Neural Machine Translation Using Elastic Weight Consolidation","date":"2019-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multiplicative-models-for-recurrent-language","title":"Multiplicative Models for Recurrent Language Modeling","date":"2019-06-30","arxiv_id":"1907.00455","repositories_listed":0,"syntology":null},{"url":null,"slug":"inducing-syntactic-trees-from-bert","title":"Inducing Syntactic Trees from BERT Representations","date":"2019-06-27","arxiv_id":"1906.11511","repositories_listed":0,"syntology":null},{"url":null,"slug":"semi-supervised-acoustic-model-training-for-1","title":"Semi-supervised acoustic model training for five-lingual code-switched ASR","date":"2019-06-20","arxiv_id":"1906.08647","repositories_listed":0,"syntology":null},{"url":null,"slug":"surf-at-mediqa-2019-improving-performance-of","title":"Surf at MEDIQA 2019: Improving Performance of Natural Language Inference in the Clinical Domain by Adopting Pre-trained Language Model","date":"2019-06-19","arxiv_id":"1906.07854","repositories_listed":0,"syntology":null},{"url":null,"slug":"structured-pruning-of-recurrent-neural","title":"Structured Pruning of Recurrent Neural Networks through Neuron Selection","date":"2019-06-17","arxiv_id":"1906.06847","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-conditional-generation-of","title":"Automatic Conditional Generation of Personalized Social Media Short Texts","date":"2019-06-15","arxiv_id":"1906.09324","repositories_listed":0,"syntology":null},{"url":null,"slug":"scalable-syntax-aware-language-models-using","title":"Scalable Syntax-Aware Language Models Using Knowledge Distillation","date":"2019-06-14","arxiv_id":"1906.06438","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparison-of-word-based-and-context-based","title":"A Comparison of Word-based and Context-based Representations for Classification Problems in Health Informatics","date":"2019-06-13","arxiv_id":"1906.05468","repositories_listed":0,"syntology":null}],"record_sha256":"2b257229da865ddefab460f7b6c60f3eb12ec8fa3afd9d37a8452ca50d916eda","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}