{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/128","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":128,"pages_in_order":142,"rows_per_page":100,"rows":[12701,12800],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/127","next":"/task/language-modeling/papers/129","papers":[{"url":null,"slug":"how-context-affects-language-models-factual","title":"How Context Affects Language Models' Factual Predictions","date":"2020-05-10","arxiv_id":"2005.04611","repositories_listed":0,"syntology":null},{"url":null,"slug":"distilling-knowledge-from-pre-trained","title":"Distilling Knowledge from Pre-trained Language Models via Text Smoothing","date":"2020-05-08","arxiv_id":"2005.03848","repositories_listed":0,"syntology":null},{"url":null,"slug":"temporal-common-sense-acquisition-with","title":"Temporal Common Sense Acquisition with Minimal Supervision","date":"2020-05-08","arxiv_id":"2005.04304","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-architectures-from-an-extended","title":"Learning Architectures from an Extended Search Space for Language Modeling","date":"2020-05-06","arxiv_id":"2005.02593","repositories_listed":0,"syntology":null},{"url":null,"slug":"fast-and-robust-unsupervised-contextual","title":"Fast and Robust Unsupervised Contextual Biasing for Speech Recognition","date":"2020-05-04","arxiv_id":"2005.01677","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multimodal-educational-corpus-of-oral","title":"A Multimodal Educational Corpus of Oral Courses: Annotation, Analysis and Case Study","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptation-of-deep-bidirectional-transformers","title":"Adaptation of Deep Bidirectional Transformers for Afrikaans Language","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"adapting-bert-to-implicit-discourse-relation","title":"Adapting BERT to Implicit Discourse Relation Classification with a Focus on Discourse Connectives","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"aggression-identification-in-social-media-a","title":"Aggression Identification in Social Media: a Transfer Learning Based Approach","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-myanmar-image-captioning-using-cnn","title":"Automatic Myanmar Image Captioning using CNN and LSTM-Based Language Model","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"building-language-models-for-morphological","title":"Building Language Models for Morphological Rich Low-Resource Languages using Data from Related Donor Languages: the Case of Uyghur","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"class-based-lstm-russian-language-model-with","title":"Class-based LSTM Russian Language Model with Linguistic Information","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-sentence-pre-trained-model-for","title":"Cross-sentence Pre-trained Model for Interactive QA matching","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dnn-based-multilingual-automatic-speech","title":"DNN-Based Multilingual Automatic Speech Recognition for Wolaytta using Oromo Speech","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"embeddings-for-named-entity-recognition-in","title":"Embeddings for Named Entity Recognition in Geoscience Portuguese Literature","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-approaches-to-personalizing","title":"Evaluating Approaches to Personalizing Language Models","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-the-impact-of-sub-word-information","title":"Evaluating the Impact of Sub-word Information and Cross-lingual Word Embeddings on Mi'kmaq Language Modelling","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-pre-training-with-alignments-for","title":"Exploring Pre-training with Alignments for RNN Transducer based End-to-End Speech Recognition","date":"2020-05-01","arxiv_id":"2005.00572","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-zero-to-hero-on-the-limitations-of-zero","title":"From Zero to Hero: On the Limitations of Zero-Shot Cross-Lingual Transfer with Multilingual Transformers","date":"2020-05-01","arxiv_id":"2005.00633","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-neural-language-generation-with","title":"Improving Neural Language Generation with Spectrum Control","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-the-language-model-for-low-resource","title":"Improving the Language Model for Low-Resource ASR with Online Text Corpora","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"irit-at-trac-2020","title":"IRIT at TRAC 2020","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"is-language-modeling-enough-evaluating","title":"Is Language Modeling Enough? Evaluating Effective Embedding Combinations","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"jamo-pair-encoding-subcharacter","title":"Jamo Pair Encoding: Subcharacter Representation-based Extreme Korean Vocabulary Compression for Efficient Subword Tokenization","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"japanese-realistic-textual-entailment-corpus","title":"Japanese Realistic Textual Entailment Corpus","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-modeling-with-a-general-second-order","title":"Language Modeling with a General Second-Order RNN","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-models-for-cloze-task-answer","title":"Language Models for Cloze Task Answer Generation in Russian","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"machine-translation-from-spoken-language-to","title":"Machine Translation from Spoken Language to Sign Language using Pre-trained Language Model as Encoder","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"minority-positive-sampling-for-switching","title":"Minority Positive Sampling for Switching Points - an Anecdote for the Code-Mixing Language Modeling","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-scale-transformer-language-models","title":"Multi-scale Transformer Language Models","date":"2020-05-01","arxiv_id":"2005.00581","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-task-learning-using-arabert-for","title":"Multi-Task Learning using AraBert for Offensive Language Detection","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-models-for-predicting-celtic-mutations","title":"Neural Models for Predicting Celtic Mutations","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-exploration-of-english-to-urdu-machine","title":"On the Exploration of English to Urdu Machine Translation","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"recognizing-semantic-relations-by-combining","title":"Recognizing Semantic Relations by Combining Transformers and Fully Connected Models","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"semi-supervised-acoustic-and-language-model-1","title":"Semi-supervised acoustic and language model training for English-isiZulu code-switched speech recognition","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"speech-transcription-challenges-for-resource","title":"Speech Transcription Challenges for Resource Constrained Indigenous Language Cree","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"style-variation-as-a-vantage-point-for-code","title":"Style Variation as a Vantage Point for Code-Switching","date":"2020-05-01","arxiv_id":"2005.00458","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-incomslav-platform-experimental-website","title":"The INCOMSLAV Platform: Experimental Website with Integrated Methods for Measuring Linguistic Distances and Asymmetries in Receptive Multilingualism","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/wiki-40b-multilingual-language-model-dataset","slug":"wiki-40b-multilingual-language-model-dataset","title":"Wiki-40B: Multilingual Language Model Dataset","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"apo-vae-text-generation-in-hyperbolic-space","title":"APo-VAE: Text Generation in Hyperbolic Space","date":"2020-04-30","arxiv_id":"2005.00054","repositories_listed":0,"syntology":null},{"url":null,"slug":"ensemblegan-adversarial-learning-for","title":"EnsembleGAN: Adversarial Learning for Retrieval-Generation Ensemble Model on Short-Text Conversation","date":"2020-04-30","arxiv_id":"2004.14592","repositories_listed":0,"syntology":null},{"url":"/paper/few-shot-natural-language-generation-by","slug":"few-shot-natural-language-generation-by","title":"Template Guided Text Generation for Task-Oriented Dialogue","date":"2020-04-30","arxiv_id":"2004.15006","repositories_listed":0,"syntology":null},{"url":null,"slug":"semi-supervised-text-simplification-with-back","title":"Semi-Supervised Text Simplification with Back-Translation and Asymmetric Denoising Autoencoders","date":"2020-04-30","arxiv_id":"2004.14693","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-injection-of-knowledge-into","title":"Knowledge Injection into Dialogue Generation via Language Models","date":"2020-04-30","arxiv_id":"2004.14614","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-the-role-of-language-typology-in","title":"Evaluating Transformer-Based Multilingual Text Classification","date":"2020-04-29","arxiv_id":"2004.13939","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploiting-structured-knowledge-in-text-via","title":"Exploiting Structured Knowledge in Text via Graph-Guided Representation Learning","date":"2020-04-29","arxiv_id":"2004.14224","repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-long-context-for-task-oriented","title":"Modeling Long Context for Task-Oriented Dialogue State Generation","date":"2020-04-29","arxiv_id":"2004.14080","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-choice-dialogue-based-reading","title":"Knowledgeable Dialogue Reading Comprehension on Key Turns","date":"2020-04-29","arxiv_id":"2004.13988","repositories_listed":0,"syntology":null},{"url":null,"slug":"pre-training-is-almost-all-you-need-an","title":"Pre-training Is (Almost) All You Need: An Application to Commonsense Reasoning","date":"2020-04-29","arxiv_id":"2004.14074","repositories_listed":0,"syntology":null},{"url":null,"slug":"lightpaff-a-two-stage-distillation-framework-1","title":"LightPAFF: A Two-Stage Distillation Framework for Pre-training and Fine-tuning","date":"2020-04-27","arxiv_id":"2004.12817","repositories_listed":0,"syntology":null},{"url":null,"slug":"assessing-discourse-relations-in-language","title":"Assessing Discourse Relations in Language Generation from GPT-2","date":"2020-04-26","arxiv_id":"2004.12506","repositories_listed":0,"syntology":null},{"url":null,"slug":"challenge-closed-book-science-exam-a-meta","title":"Challenge Closed-book Science Exam: A Meta-learning Based Question Answering System","date":"2020-04-26","arxiv_id":"2004.12303","repositories_listed":0,"syntology":null},{"url":null,"slug":"contextualized-representations-using-textual","title":"Contextualized Representations Using Textual Encyclopedic Knowledge","date":"2020-04-24","arxiv_id":"2004.12006","repositories_listed":0,"syntology":null},{"url":null,"slug":"coupled-intrinsic-and-extrinsic-human","title":"Coupled intrinsic and extrinsic human language resource-based query expansion","date":"2020-04-23","arxiv_id":"2004.11083","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-adversarial-examples-for-biomedical-nlp","title":"On Adversarial Examples for Biomedical NLP Tasks","date":"2020-04-23","arxiv_id":"2004.11157","repositories_listed":0,"syntology":null},{"url":null,"slug":"qurious-question-generation-pretraining-for","title":"QURIOUS: Question Generation Pretraining for Text Generation","date":"2020-04-23","arxiv_id":"2004.11026","repositories_listed":0,"syntology":null},{"url":null,"slug":"uhh-lt-lt2-at-semeval-2020-task-12-fine","title":"UHH-LT at SemEval-2020 Task 12: Fine-Tuning of Pre-Trained Transformer Networks for Offensive Language Detection","date":"2020-04-23","arxiv_id":"2004.11493","repositories_listed":0,"syntology":null},{"url":null,"slug":"discretized-bottleneck-in-vae-posterior","title":"Improve Variational Autoencoder for Text Generationwith Discrete Latent Bottleneck","date":"2020-04-22","arxiv_id":"2004.10603","repositories_listed":0,"syntology":null},{"url":null,"slug":"keyphrase-prediction-with-pre-trained","title":"Keyphrase Prediction With Pre-trained Language Model","date":"2020-04-22","arxiv_id":"2004.10462","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-tuning-multi-hop-question-answering-with","title":"Fine-tuning Multi-hop Question Answering with Hierarchical Graph Network","date":"2020-04-20","arxiv_id":"2004.13821","repositories_listed":0,"syntology":null},{"url":null,"slug":"do-sequence-to-sequence-vaes-learn-global","title":"Do sequence-to-sequence VAEs learn global features of sentences?","date":"2020-04-16","arxiv_id":"2004.07683","repositories_listed":0,"syntology":null},{"url":null,"slug":"extending-text-informativeness-measures-to","title":"Extending Text Informativeness Measures to Passage Interestingness Evaluation (Language Model vs. Word Embedding)","date":"2020-04-14","arxiv_id":"2004.06747","repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-variational-autoencoder","title":"ControlVAE: Controllable Variational Autoencoder","date":"2020-04-13","arxiv_id":"2004.05988","repositories_listed":0,"syntology":null},{"url":null,"slug":"robustly-pre-trained-neural-model-for-direct","title":"Robustly Pre-trained Neural Model for Direct Temporal Relation Extraction","date":"2020-04-13","arxiv_id":"2004.06216","repositories_listed":0,"syntology":null},{"url":null,"slug":"unified-multi-criteria-chinese-word","title":"Unified Multi-Criteria Chinese Word Segmentation with BERT","date":"2020-04-13","arxiv_id":"2004.05808","repositories_listed":0,"syntology":null},{"url":null,"slug":"pre-training-text-representations-as-meta","title":"Pre-training Text Representations as Meta Learning","date":"2020-04-12","arxiv_id":"2004.05568","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequence-model-design-for-code-completion-in","title":"Sequence Model Design for Code Completion in the Modern IDE","date":"2020-04-10","arxiv_id":"2004.05249","repositories_listed":0,"syntology":null},{"url":null,"slug":"stacked-convolutional-deep-encoding-network","title":"Stacked Convolutional Deep Encoding Network for Video-Text Retrieval","date":"2020-04-10","arxiv_id":"2004.04959","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-scale-multilingual","title":"Learning to Scale Multilingual Representations for Vision-Language Tasks","date":"2020-04-09","arxiv_id":"2004.04312","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-investigation-of-phone-based-subword-units","title":"An investigation of phone-based subword units for end-to-end speech recognition","date":"2020-04-08","arxiv_id":"2004.04290","repositories_listed":0,"syntology":null},{"url":null,"slug":"calm-continuous-adaptive-learning-for","title":"CALM: Continuous Adaptive Learning for Language Modeling","date":"2020-04-08","arxiv_id":"2004.03794","repositories_listed":0,"syntology":null},{"url":"/paper/efficient-long-distance-relation-extraction","slug":"efficient-long-distance-relation-extraction","title":"Efficient long-distance relation extraction with DG-SpanBERT","date":"2020-04-07","arxiv_id":"2004.03636","repositories_listed":0,"syntology":null},{"url":null,"slug":"homophone-based-label-smoothing-in-end-to-end","title":"Homophone-based Label Smoothing in End-to-End Automatic Speech Recognition","date":"2020-04-07","arxiv_id":"2004.03437","repositories_listed":0,"syntology":null},{"url":null,"slug":"bert-in-negotiations-early-prediction-of","title":"Exploring Early Prediction of Buyer-Seller Negotiation Outcomes","date":"2020-04-06","arxiv_id":"2004.02363","repositories_listed":0,"syntology":null},{"url":null,"slug":"semi-supervised-acoustic-and-language-model","title":"Semi-supervised acoustic and language model training for English-isiZulu code-switched speech recognition","date":"2020-04-05","arxiv_id":"2004.04054","repositories_listed":0,"syntology":null},{"url":null,"slug":"syntax-driven-iterative-expansion-language","title":"Syntax-driven Iterative Expansion Language Models for Controllable Text Generation","date":"2020-04-05","arxiv_id":"2004.02211","repositories_listed":0,"syntology":null},{"url":null,"slug":"cg-bert-conditional-text-generation-with-bert","title":"CG-BERT: Conditional Text Generation with BERT for Generalized Few-shot Intent Detection","date":"2020-04-04","arxiv_id":"2004.01881","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-transfer-learning-for-punctuation","title":"Adversarial Transfer Learning for Punctuation Restoration","date":"2020-04-01","arxiv_id":"2004.00248","repositories_listed":0,"syntology":null},{"url":null,"slug":"sac-accelerating-and-structuring-self","title":"SAC: Accelerating and Structuring Self-Attention via Sparse Adaptive Connection","date":"2020-03-22","arxiv_id":"2003.09833","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-sampling-and-selective-masking-for","title":"Dynamic Sampling and Selective Masking for Communication-Efficient Federated Learning","date":"2020-03-21","arxiv_id":"2003.09603","repositories_listed":0,"syntology":null},{"url":null,"slug":"anchor-transform-learning-sparse-1","title":"Anchor & Transform: Learning Sparse Embeddings for Large Vocabularies","date":"2020-03-18","arxiv_id":"2003.08197","repositories_listed":0,"syntology":null},{"url":null,"slug":"key-phrase-classification-in-complex","title":"Key Phrase Classification in Complex Assignments","date":"2020-03-16","arxiv_id":"2003.07019","repositories_listed":0,"syntology":null},{"url":null,"slug":"finnish-language-modeling-with-deep","title":"Finnish Language Modeling with Deep Transformer Models","date":"2020-03-14","arxiv_id":"2003.11562","repositories_listed":0,"syntology":null},{"url":null,"slug":"hybrid-autoregressive-transducer-hat","title":"Hybrid Autoregressive Transducer (hat)","date":"2020-03-12","arxiv_id":"2003.07705","repositories_listed":0,"syntology":null},{"url":null,"slug":"meta-cotgan-a-meta-cooperative-training","title":"Meta-CoTGAN: A Meta Cooperative Training Paradigm for Improving Adversarial Text Generation","date":"2020-03-12","arxiv_id":"2003.11530","repositories_listed":0,"syntology":null},{"url":null,"slug":"what-the-mask-making-sense-of-language","title":"What the [MASK]? Making Sense of Language-Specific BERT Models","date":"2020-03-05","arxiv_id":"2003.02912","repositories_listed":0,"syntology":null},{"url":"/paper/xgpt-cross-modal-generative-pre-training-for","slug":"xgpt-cross-modal-generative-pre-training-for","title":"XGPT: Cross-modal Generative Pre-Training for Image Captioning","date":"2020-03-03","arxiv_id":"2003.01473","repositories_listed":0,"syntology":null},{"url":null,"slug":"using-a-thousand-optimization-tasks-to-learn","title":"Using a thousand optimization tasks to learn hyperparameter search strategies","date":"2020-02-27","arxiv_id":"2002.11887","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-density-ratio-approach-to-language-model","title":"A Density Ratio Approach to Language Model Fusion in End-To-End Automatic Speech Recognition","date":"2020-02-26","arxiv_id":"2002.11268","repositories_listed":0,"syntology":null},{"url":"/paper/object-relational-graph-with-teacher","slug":"object-relational-graph-with-teacher","title":"Object Relational Graph with Teacher-Recommended Learning for Video Captioning","date":"2020-02-26","arxiv_id":"2002.11566","repositories_listed":0,"syntology":null},{"url":null,"slug":"quantized-neural-network-inference-with","title":"Quantized Neural Network Inference with Precision Batching","date":"2020-02-26","arxiv_id":"2003.00822","repositories_listed":0,"syntology":null},{"url":null,"slug":"refined-gate-a-simple-and-effective-gating","title":"Refined Gate: A Simple and Effective Gating Mechanism for Recurrent Units","date":"2020-02-26","arxiv_id":"2002.11338","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-more-abstractive-summarization-model","title":"A more abstractive summarization model","date":"2020-02-25","arxiv_id":"2002.10959","repositories_listed":0,"syntology":null},{"url":null,"slug":"backpropamine-training-self-modifying-neural-1","title":"Backpropamine: training self-modifying neural networks with differentiable neuromodulated plasticity","date":"2020-02-24","arxiv_id":"2002.10585","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequence-preserving-network-traffic","title":"Sequence Preserving Network Traffic Generation","date":"2020-02-23","arxiv_id":"2002.09832","repositories_listed":0,"syntology":null},{"url":null,"slug":"studying-the-effects-of-cognitive-biases-in","title":"Studying the Effects of Cognitive Biases in Evaluation of Conversational Agents","date":"2020-02-18","arxiv_id":"2002.07927","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-financial-service-chatbot-based-on-deep","title":"A Financial Service Chatbot based on Deep Bidirectional Transformers","date":"2020-02-17","arxiv_id":"2003.04987","repositories_listed":0,"syntology":null},{"url":null,"slug":"global-and-local-feature-learning-for-ego","title":"Global and Local Feature Learning for Ego-Network Analysis","date":"2020-02-16","arxiv_id":"2002.06685","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-data-efficient-end-to-end-spoken-language","title":"A Data Efficient End-To-End Spoken Language Understanding Architecture","date":"2020-02-14","arxiv_id":"2002.05955","repositories_listed":0,"syntology":null},{"url":"/paper/fquad-french-question-answering-dataset","slug":"fquad-french-question-answering-dataset","title":"FQuAD: French Question Answering Dataset","date":"2020-02-14","arxiv_id":"2002.06071","repositories_listed":0,"syntology":null}],"record_sha256":"746d25bc0afaf8f599b567e0ebb92c98fea3495afc45ac8bb084a7ca2337465d","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}