{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modelling/papers/144","list_of":"/task/language-modelling","task":"Language Modelling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":144,"pages_in_order":177,"rows_per_page":100,"rows":[14301,14400],"of":17610,"counts":{"archive_papers_tagged":17610,"with_a_code_link":7012,"where_syntology_ran_a_sample":2428,"not_listed_spam_title":0,"listed":17610,"listed_where_code_ran":2428,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":2027,"every_run_a_failure_of_syntologys_instrument":401,"listed_with_a_run_with_no_instrument_failure":2027,"listed_every_run_a_failure_of_syntologys_instrument":401,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modelling","prev":"/task/language-modelling/papers/143","next":"/task/language-modelling/papers/145","papers":[{"url":null,"slug":"cryptocurrency-day-trading-and-framing","title":"Cryptocurrency Day Trading and Framing Prediction in Microblog Discourse","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"domain-adaptation-of-spherical-embeddings","title":"Domain-adaptation of spherical embeddings","date":"2021-11-01","arxiv_id":"2111.00677","repositories_listed":0,"syntology":null},{"url":null,"slug":"effective-fine-tuning-methods-for-cross","title":"Effective Fine-Tuning Methods for Cross-lingual Adaptation","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"gtcom-neural-machine-translation-systems-for-2","title":"GTCOM Neural Machine Translation Systems for WMT21","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"how-length-prediction-influence-the","title":"How Length Prediction Influence the Performance of Non-Autoregressive Translation?","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"iga-an-intent-guided-authoring-assistant-1","title":"IGA: An Intent-Guided Authoring Assistant","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-synonym-recommendation-using","title":"Improving Synonym Recommendation Using Sentence Context","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"japanese-zero-anaphora-resolution-can-benefit","title":"Japanese Zero Anaphora Resolution Can Benefit from Parallel Texts Through Neural Transfer Learning","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"label-enhanced-hierarchical-contextualized","title":"Label-Enhanced Hierarchical Contextualized Representation for Sequential Metaphor Identification","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-clustering-for-multilingual-named","title":"Language Clustering for Multilingual Named Entity Recognition","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-pretraining-and-transfer","title":"Language Model Pretraining and Transfer Learning for Very Low Resource Languages","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-cross-lingual-representations-for","title":"Learning Cross-lingual Representations for Event Coreference Resolution with Multi-view Alignment and Optimal Transport","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-mathematical-notation-semantics-in","title":"Modeling Mathematical Notation Semantics in Academic Papers","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-task-learning-in-argument-mining-for","title":"Multi-task Learning in Argument Mining for Persuasive Online Discussions","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-sequence-labeling-approach-to","title":"Multilingual Sequence Labeling Approach to solve Lexical Normalization","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"named-entity-recognition-in-historic-legal","title":"Named Entity Recognition in Historic Legal Text: A Transformer and State Machine Ensemble Method","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"nict-kyoto-submission-for-the-wmt21-quality","title":"NICT Kyoto Submission for the WMT’21 Quality Estimation Task: Multimetric Multilingual Pretraining for Critical Error Detection","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"novel-natural-language-summarization-of","title":"Novel Natural Language Summarization of Program Code via Leveraging Multiple Input Representations","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"odist-open-world-classification-via","title":"ODIST: Open World Classification via Distributionally Shifted Instances","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-role-of-corpus-ordering-in-language","title":"On the Role of Corpus Ordering in Language Modeling","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"paraphrasing-compound-nominalizations","title":"Paraphrasing Compound Nominalizations","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"segment-mask-and-predict-augmenting-chinese","title":"Segment, Mask, and Predict: Augmenting Chinese Word Segmentation with Self-Supervision","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"small-model-and-in-domain-data-are-all-you","title":"Small Model and In-Domain Data Are All You Need","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"spellbert-a-lightweight-pretrained-model-for","title":"SpellBERT: A Lightweight Pretrained Model for Chinese Spelling Check","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-acceptability-delta-criterion-testing","title":"The Acceptability Delta Criterion: Testing Knowledge of Language using the Gradience of Sentence Acceptability","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"uncle-explicitly-leveraging-semantic","title":"UnClE: Explicitly Leveraging Semantic Similarity to Reduce the Parameters of Word Embeddings","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-adverbial-identification-in","title":"Unsupervised Adverbial Identification in Modern Chinese Literature","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-discovery-of-unaccusative-and","title":"Unsupervised Discovery of Unaccusative and Unergative Verbs","date":"2021-11-01","arxiv_id":"2111.00808","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-multi-view-post-ocr-error","title":"Unsupervised Multi-View Post-OCR Error Correction With Language Models","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"what-bert-based-language-model-learns-in","title":"What BERT Based Language Model Learns in Spoken Transcripts: An Empirical Study","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"what-can-a-generative-language-model-answer","title":"What Can a Generative Language Model Answer About a Passage?","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"whats-in-your-head-emergent-behaviour-in","title":"What’s in Your Head? Emergent Behaviour in Multi-Task Transformer Models","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-cross-lingual-meaning","title":"Zero-shot cross-lingual Meaning Representation Transfer: Annotation of Hungarian using the Prague Functional Generative Description","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"pnpood-out-of-distribution-detection-for-text","title":"PnPOOD : Out-Of-Distribution Detection for Text Classification via Plug andPlay Data Augmentation","date":"2021-10-31","arxiv_id":"2111.00506","repositories_listed":0,"syntology":null},{"url":"/paper/r-bert-cnn-drug-target-interactions","slug":"r-bert-cnn-drug-target-interactions","title":"R-BERT-CNN: Drug-target interactions extraction from biomedical literature","date":"2021-10-31","arxiv_id":"2111.00611","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-language-modelling-in-the-speech","title":"Towards Language Modelling in the Speech Domain Using Sub-word Linguistic Units","date":"2021-10-31","arxiv_id":"2111.00610","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-knowledge-augmentation-for","title":"Automatic Knowledge Augmentation for Generative Commonsense Reasoning","date":"2021-10-30","arxiv_id":"2111.00192","repositories_listed":0,"syntology":null},{"url":null,"slug":"empbot-a-t5-based-empathetic-chatbot-focusing","title":"EmpBot: A T5-based Empathetic Chatbot focusing on Sentiments","date":"2021-10-30","arxiv_id":"2111.00310","repositories_listed":0,"syntology":null},{"url":null,"slug":"combining-unsupervised-and-text-augmented","title":"Combining Unsupervised and Text Augmented Semi-Supervised Learning for Low Resourced Autoregressive Speech Recognition","date":"2021-10-29","arxiv_id":"2110.15836","repositories_listed":0,"syntology":null},{"url":null,"slug":"pre-training-co-evolutionary-protein","title":"Pre-training Co-evolutionary Protein Representation via A Pairwise Masked Language Model","date":"2021-10-29","arxiv_id":"2110.15527","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-character-based-language-models-improve","title":"Can Character-based Language Models Improve Downstream Task Performance in Low-Resource and Noisy Language Scenarios?","date":"2021-10-26","arxiv_id":"2110.13658","repositories_listed":0,"syntology":null},{"url":null,"slug":"distributionally-robust-recurrent-decoders","title":"Distributionally Robust Recurrent Decoders with Random Network Distillation","date":"2021-10-25","arxiv_id":"2110.13229","repositories_listed":0,"syntology":null},{"url":null,"slug":"no-news-is-good-news-a-critique-of-the-one","title":"No News is Good News: A Critique of the One Billion Word Benchmark","date":"2021-10-25","arxiv_id":"2110.12609","repositories_listed":0,"syntology":null},{"url":null,"slug":"revisiting-cnn-for-highly-inflected-bengali","title":"Paradigm Shift in Language Modeling: Revisiting CNN for Modeling Sanskrit Originated Bengali and Hindi Language","date":"2021-10-25","arxiv_id":"2110.13032","repositories_listed":0,"syntology":null},{"url":null,"slug":"sentence-punctuation-for-collaborative","title":"Sentence Punctuation for Collaborative Commentary Generation in Esports Live-Streaming","date":"2021-10-24","arxiv_id":"2110.12416","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-distillation-from-language-model-to","title":"Knowledge distillation from language model to acoustic model: a hierarchical multi-task learning approach","date":"2021-10-20","arxiv_id":"2110.10429","repositories_listed":0,"syntology":null},{"url":null,"slug":"slam-a-unified-encoder-for-speech-and","title":"SLAM: A Unified Encoder for Speech and Language Modeling via Speech-Text Joint Pre-Training","date":"2021-10-20","arxiv_id":"2110.10329","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-learning-of-subword-dependent-model","title":"Automatic Learning of Subword Dependent Model Scales","date":"2021-10-18","arxiv_id":"2110.09324","repositories_listed":0,"syntology":null},{"url":null,"slug":"deconfounded-and-explainable-interactive","title":"Deconfounded and Explainable Interactive Vision-Language Retrieval of Complex Scenes","date":"2021-10-17","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"reminding-the-incremental-language-model-via","title":"Reminding the Incremental Language Model via Data-Free Self-Distillation","date":"2021-10-17","arxiv_id":"2110.08745","repositories_listed":0,"syntology":null},{"url":null,"slug":"asr4real-an-extended-benchmark-for-speech","title":"ASR4REAL: An extended benchmark for speech models","date":"2021-10-16","arxiv_id":"2110.08583","repositories_listed":0,"syntology":null},{"url":null,"slug":"bitfit-simple-parameter-efficient-fine-tuning-1","title":"BitFit: Simple Parameter-efficient Fine-tuning for Transformer-based Masked Language-models","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"demix-layers-disentangling-domains-for-1","title":"DEMix Layers: Disentangling Domains for Modular Language Modeling","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"echo-attention-attend-once-and-get-n","title":"Echo-Attention: Attend Once and Get $N$ Attentions for Free","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-knowledge-in-multilingual","title":"Leveraging Knowledge in Multilingual Commonsense Reasoning","date":"2021-10-16","arxiv_id":"2110.08462","repositories_listed":0,"syntology":null},{"url":null,"slug":"lifelong-pretraining-continually-adapting","title":"Lifelong Pretraining: Continually Adapting Language Models to Emerging Corpora","date":"2021-10-16","arxiv_id":"2110.08534","repositories_listed":0,"syntology":null},{"url":null,"slug":"models-in-a-spelling-bee-language-models-1","title":"Models In a Spelling Bee: Language Models Implicitly Learn the Character Composition of Tokens","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"n-shot-learning-for-augmenting-task-oriented","title":"N-Shot Learning for Augmenting Task-Oriented Dialogue State Tracking","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-complementarity-of-data-selection-and-1","title":"On the Complementarity of Data Selection and Fine Tuning for Domain Adaptation","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"sharpness-aware-minimization-improves","title":"Sharpness-Aware Minimization Improves Language Model Generalization","date":"2021-10-16","arxiv_id":"2110.08529","repositories_listed":0,"syntology":null},{"url":null,"slug":"xgqa-cross-lingual-visual-question-answering-1","title":"xGQA: Cross-Lingual Visual Question Answering","date":"2021-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multilingual-bag-of-entities-model-for-zero","title":"A Multilingual Bag-of-Entities Model for Zero-Shot Cross-Lingual Text Classification","date":"2021-10-15","arxiv_id":"2110.07792","repositories_listed":0,"syntology":null},{"url":null,"slug":"intent-based-product-collections-for-e","title":"Intent-based Product Collections for E-commerce using Pretrained Language Models","date":"2021-10-15","arxiv_id":"2110.08241","repositories_listed":0,"syntology":null},{"url":null,"slug":"jurassic-is-almost-all-you-need-few-shot","title":"Jurassic is (almost) All You Need: Few-Shot Meaning-to-Text Generation for Open-Domain Dialogue","date":"2021-10-15","arxiv_id":"2110.08094","repositories_listed":0,"syntology":null},{"url":null,"slug":"kronecker-decomposition-for-gpt-compression","title":"Kronecker Decomposition for GPT Compression","date":"2021-10-15","arxiv_id":"2110.08152","repositories_listed":0,"syntology":null},{"url":null,"slug":"spot-better-frozen-model-adaptation-through","title":"SPoT: Better Frozen Model Adaptation through Soft Prompt Transfer","date":"2021-10-15","arxiv_id":"2110.07904","repositories_listed":0,"syntology":null},{"url":null,"slug":"bert2bert-towards-reusable-pretrained","title":"bert2BERT: Towards Reusable Pretrained Language Models","date":"2021-10-14","arxiv_id":"2110.07143","repositories_listed":0,"syntology":null},{"url":null,"slug":"finetuning-large-scale-pre-trained-language","title":"RecInDial: A Unified Framework for Conversational Recommendation with Pretrained Language Models","date":"2021-10-14","arxiv_id":"2110.07477","repositories_listed":0,"syntology":null},{"url":null,"slug":"mimicause-defining-identifying-and-predicting","title":"MIMICause: Representation and automatic extraction of causal relation types from clinical notes","date":"2021-10-14","arxiv_id":"2110.07090","repositories_listed":0,"syntology":null},{"url":null,"slug":"plug-tagger-a-pluggable-sequence-labeling","title":"Plug-Tagger: A Pluggable Sequence Labeling Framework Using Language Models","date":"2021-10-14","arxiv_id":"2110.07331","repositories_listed":0,"syntology":null},{"url":null,"slug":"sparks-inspiration-for-science-writing-using","title":"Sparks: Inspiration for Science Writing using Language Models","date":"2021-10-14","arxiv_id":"2110.07640","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-modelling-via-learning-to-rank","title":"Language Modelling via Learning to Rank","date":"2021-10-13","arxiv_id":"2110.06961","repositories_listed":0,"syntology":null},{"url":null,"slug":"maximizing-efficiency-of-language-model-pre","title":"Maximizing Efficiency of Language Model Pre-training for Learning Representation","date":"2021-10-13","arxiv_id":"2110.06620","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-language-model-integration-for-rnn","title":"On Language Model Integration for RNN Transducer based Speech Recognition","date":"2021-10-13","arxiv_id":"2110.06841","repositories_listed":0,"syntology":null},{"url":null,"slug":"balancing-average-and-worst-case-accuracy-in-1","title":"Balancing Average and Worst-case Accuracy in Multitask Learning","date":"2021-10-12","arxiv_id":"2110.05838","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-learning-for-bias-detection-from","title":"Deep Learning for Bias Detection: From Inception to Deployment","date":"2021-10-12","arxiv_id":"2110.15728","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modal-pre-training-for-automated-speech","title":"Multi-Modal Pre-Training for Automated Speech Recognition","date":"2021-10-12","arxiv_id":"2110.09890","repositories_listed":0,"syntology":null},{"url":null,"slug":"smaprat-dialogpt-for-natural-language","title":"Småprat: DialoGPT for Natural Language Generation of Swedish Dialogue by Transfer Learning","date":"2021-10-12","arxiv_id":"2110.06273","repositories_listed":0,"syntology":null},{"url":null,"slug":"advancing-momentum-pseudo-labeling-with","title":"Advancing Momentum Pseudo-Labeling with Conformer and Initialization Strategy","date":"2021-10-11","arxiv_id":"2110.04948","repositories_listed":0,"syntology":null},{"url":null,"slug":"breaking-the-softmax-bottleneck-for","title":"Breaking the Softmax Bottleneck for Sequential Recommender Systems with Dropout and Decoupling","date":"2021-10-11","arxiv_id":"2110.05409","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-user-perception-of-speech","title":"Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric","date":"2021-10-11","arxiv_id":"2110.05376","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-task-learning-for-situated-multi-domain","title":"Multi-Task Learning for Situated Multi-Domain End-to-End Dialogue Systems","date":"2021-10-11","arxiv_id":"2110.05221","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-a-benefit-of-mask-language-modeling","title":"On a Benefit of Mask Language Modeling: Robustness to Simplicity Bias","date":"2021-10-11","arxiv_id":"2110.05301","repositories_listed":0,"syntology":null},{"url":null,"slug":"sru-pioneering-fast-recurrence-with-attention","title":"SRU++: Pioneering Fast Recurrence with Attention for Speech Recognition","date":"2021-10-11","arxiv_id":"2110.05571","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-neural-machine-translation-with-5","title":"Unsupervised Neural Machine Translation with Generative Language Models Only","date":"2021-10-11","arxiv_id":"2110.05448","repositories_listed":0,"syntology":null},{"url":null,"slug":"wav2vec-switch-contrastive-learning-from","title":"Wav2vec-Switch: Contrastive Learning from Original-noisy Speech Pairs for Robust Speech Recognition","date":"2021-10-11","arxiv_id":"2110.04934","repositories_listed":0,"syntology":null},{"url":null,"slug":"frequency-aware-sgd-for-efficient-embedding-1","title":"Frequency-aware SGD for Efficient Embedding Learning with Provable Benefits","date":"2021-10-10","arxiv_id":"2110.04844","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-automatic-text-extractive-summarization","title":"Automatic Text Extractive Summarization Based on Graph and Pre-trained Language Model Attention","date":"2021-10-10","arxiv_id":"2110.04878","repositories_listed":0,"syntology":null},{"url":null,"slug":"contrastive-learning-for-source-code-with","title":"Towards Learning (Dis)-Similarity of Source Code from Program Contrasts","date":"2021-10-08","arxiv_id":"2110.03868","repositories_listed":0,"syntology":null},{"url":null,"slug":"karasinger-score-free-singing-voice-synthesis","title":"KaraSinger: Score-Free Singing Voice Synthesis with VQ-VAE using Mel-spectrograms","date":"2021-10-08","arxiv_id":"2110.04005","repositories_listed":0,"syntology":null},{"url":null,"slug":"back-from-the-future-bidirectional-ctc","title":"Back from the future: bidirectional CTC decoding using future information in speech recognition","date":"2021-10-07","arxiv_id":"2110.03326","repositories_listed":0,"syntology":null},{"url":null,"slug":"beam-search-with-bidirectional-strategies-for","title":"Beam Search with Bidirectional Strategies for Neural Response Generation","date":"2021-10-07","arxiv_id":"2110.03389","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-confidence-estimation-on-out-of","title":"Improving Confidence Estimation on Out-of-Domain Data for End-to-End Speech Recognition","date":"2021-10-07","arxiv_id":"2110.03327","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-distillation-for-neural-transducers","title":"Knowledge Distillation for Neural Transducers from Large Self-Supervised Pre-trained Models","date":"2021-10-07","arxiv_id":"2110.03334","repositories_listed":0,"syntology":null},{"url":null,"slug":"abc-attention-with-bounded-memory-control","title":"ABC: Attention with Bounded-memory Control","date":"2021-10-06","arxiv_id":"2110.02488","repositories_listed":0,"syntology":null},{"url":null,"slug":"cut-the-carp-fishing-for-zero-shot-story","title":"Cut the CARP: Fishing for zero-shot story evaluation","date":"2021-10-06","arxiv_id":"2110.03111","repositories_listed":0,"syntology":null},{"url":null,"slug":"internal-language-model-adaptation-with-text","title":"Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition","date":"2021-10-06","arxiv_id":"2110.05354","repositories_listed":0,"syntology":null},{"url":null,"slug":"objects-in-semantic-topology","title":"Objects in Semantic Topology","date":"2021-10-06","arxiv_id":"2110.02687","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-neural-word-embeddings","title":"A Survey On Neural Word Embeddings","date":"2021-10-05","arxiv_id":"2110.01804","repositories_listed":0,"syntology":null},{"url":null,"slug":"asr-rescoring-and-confidence-estimation-with","title":"ASR Rescoring and Confidence Estimation with ELECTRA","date":"2021-10-05","arxiv_id":"2110.01857","repositories_listed":0,"syntology":null}],"record_sha256":"f22d697b27c3d4b6d23323a528ee9c6e469278a6b7cd48dd0e5750c632c094a8","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}