{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/speech-recognition-1/papers/50","list_of":"/task/speech-recognition-1","task":"speech-recognition","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":50,"pages_in_order":58,"rows_per_page":100,"rows":[4901,5000],"of":5715,"counts":{"archive_papers_tagged":5715,"with_a_code_link":1277,"where_syntology_ran_a_sample":162,"not_listed_spam_title":0,"listed":5715,"listed_where_code_ran":162,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":134,"every_run_a_failure_of_syntologys_instrument":28,"listed_with_a_run_with_no_instrument_failure":134,"listed_every_run_a_failure_of_syntologys_instrument":28,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/speech-recognition-1","prev":"/task/speech-recognition-1/papers/49","next":"/task/speech-recognition-1/papers/51","papers":[{"url":null,"slug":"targeted-adversarial-examples-for-black-box-1","title":"Targeted Adversarial Examples for Black Box Audio Systems","date":"2018-10-22","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"training-neural-speech-recognition-systems-1","title":"Training Neural Speech Recognition Systems with Synthetic Speech Augmentation","date":"2018-10-22","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"transferable-and-configurable-audio","title":"Transferable and Configurable Audio Adversarial Attack from Low-Level Features","date":"2018-10-22","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"edgespeechnets-highly-efficient-deep-neural","title":"EdgeSpeechNets: Highly Efficient Deep Neural Networks for Speech Recognition on the Edge","date":"2018-10-18","arxiv_id":"1810.08559","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-textual-and-speech-information-in","title":"Exploring Textual and Speech information in Dialogue Act Classification with Speaker Domain Adaptation","date":"2018-10-17","arxiv_id":"1810.07455","repositories_listed":0,"syntology":null},{"url":null,"slug":"3d-feature-pyramid-attention-module-for","title":"3D Feature Pyramid Attention Module for Robust Visual Speech Recognition","date":"2018-10-15","arxiv_id":"1810.06178","repositories_listed":0,"syntology":null},{"url":null,"slug":"speech-recognition-with-quaternion-neural-1","title":"Speech Recognition with Quaternion Neural Networks","date":"2018-10-15","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dense-multimodal-fusion-for-hierarchically","title":"Dense Multimodal Fusion for Hierarchically Joint Representation","date":"2018-10-08","arxiv_id":"1810.03414","repositories_listed":0,"syntology":null},{"url":null,"slug":"recognizing-overlapped-speech-in-meetings-a","title":"Recognizing Overlapped Speech in Meetings: A Multichannel Separation Approach Using Neural Networks","date":"2018-10-08","arxiv_id":"1810.03655","repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-sequence-to-sequence-speech","title":"Multilingual sequence-to-sequence speech recognition: architecture, transfer learning, and language modeling","date":"2018-10-04","arxiv_id":"1810.03459","repositories_listed":0,"syntology":null},{"url":null,"slug":"combining-natural-gradient-with-hessian-free","title":"Combining Natural Gradient with Hessian Free Methods for Sequence Training","date":"2018-10-03","arxiv_id":"1810.01873","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-noise-invariant-representations-for-1","title":"Learning Noise-Invariant Representations for Robust Speech Recognition","date":"2018-10-02","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a12c-ece-eccc2e-aoa-eae3e34-ea-a1c-c-a-study","title":"使用長短期記憶類神經網路建構中文語音辨識器之研究 (A study on Mandarin speech recognition using Long Short-Term Memory neural network) [In Chinese]","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"acoustic-word-disambiguation-with-phonogical","title":"Acoustic Word Disambiguation with Phonogical Features in Danish ASR","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"e-e2a-acaa12eeacceaa14e-c-14eeae3e34-ea1c-c","title":"探討聲學模型的合併技術與半監督鑑別式訓練於會議語音辨識之研究 (Investigating acoustic model combination and semi-supervised discriminative training for meeting speech recognition) [In Chinese]","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"eeae3e34-ea12c-eaee3e-a1eae-aeaee-on-the-use","title":"會議語音辨識使用語者資訊之語言模型調適技術 (On the Use of Speaker-Aware Language Model Adaptation Techniques for Meeting Speech Recognition ) [In Chinese]","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-on-line-learning-of-a-zero-shot-spoken","title":"Joint On-line Learning of a Zero-shot Spoken Semantic Parser and a Reinforcement Learning Dialogue Manager","date":"2018-10-01","arxiv_id":"1810.00924","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-speech-translation-at-apptek","title":"Neural Speech Translation at AppTek","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"research-challenges-in-building-a-voice-based","title":"Research Challenges in Building a Voice-based Artificial Personal Shopper - Position Paper","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"session-level-language-modeling-for","title":"Session-level Language Modeling for Conversational Speech","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-afrl-iwslt-2018-systems-what-worked-what","title":"The AFRL IWSLT 2018 Systems: What Worked, What Didn’t","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-sogou-tiic-speech-translation-system-for","title":"The Sogou-TIIC Speech Translation System for IWSLT 2018","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"using-spoken-word-posterior-features-in","title":"Using Spoken Word Posterior Features in Neural Machine Translation","date":"2018-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/audio-visual-speech-recognition-with-a-hybrid","slug":"audio-visual-speech-recognition-with-a-hybrid","title":"Audio-Visual Speech Recognition With A Hybrid CTC/Attention Architecture","date":"2018-09-28","arxiv_id":"1810.00108","repositories_listed":0,"syntology":null},{"url":null,"slug":"characterizing-audio-adversarial-examples","title":"Characterizing Audio Adversarial Examples Using Temporal Dependency","date":"2018-09-28","arxiv_id":"1809.10875","repositories_listed":0,"syntology":null},{"url":null,"slug":"end-to-end-multi-lingual-multi-speaker-speech","title":"End-to-End Multi-Lingual Multi-Speaker Speech Recognition","date":"2018-09-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"exploration-of-efficient-on-device-acoustic","title":"EXPLORATION OF EFFICIENT ON-DEVICE ACOUSTIC MODELING WITH NEURAL NETWORKS","date":"2018-09-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-learning-for-speech-recognition","title":"Zero-shot Learning for Speech Recognition with Universal Phonetic Model","date":"2018-09-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"non-native-children-speech-recognition","title":"Non-native children speech recognition through transfer learning","date":"2018-09-25","arxiv_id":"1809.09658","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-audio-to-semantics-approaches-to-end-to","title":"From Audio to Semantics: Approaches to end-to-end spoken language understanding","date":"2018-09-24","arxiv_id":"1809.09190","repositories_listed":0,"syntology":null},{"url":null,"slug":"hindi-english-code-switching-speech-corpus","title":"Hindi-English Code-Switching Speech Corpus","date":"2018-09-24","arxiv_id":"1810.00662","repositories_listed":0,"syntology":null},{"url":null,"slug":"perfect-match-improved-cross-modal-embeddings","title":"Perfect match: Improved cross-modal embeddings for audio-visual synchronisation","date":"2018-09-21","arxiv_id":"1809.08001","repositories_listed":0,"syntology":null},{"url":"/paper/scene-text-recognition-from-two-dimensional","slug":"scene-text-recognition-from-two-dimensional","title":"Scene Text Recognition from Two-Dimensional Perspective","date":"2018-09-18","arxiv_id":"1809.06508","repositories_listed":0,"syntology":null},{"url":null,"slug":"study-and-observation-of-the-variations-of","title":"Study and Observation of the Variations of Accuracies for Handwritten Digits Recognition with Various Hidden Layers and Epochs using Neural Network Algorithm","date":"2018-09-17","arxiv_id":"1809.06188","repositories_listed":0,"syntology":null},{"url":null,"slug":"study-and-observation-of-the-variations-of-1","title":"Study and Observation of the Variations of Accuracies for Handwritten Digits Recognition with Various Hidden Layers and Epochs using Convolutional Neural Network","date":"2018-09-17","arxiv_id":"1809.06187","repositories_listed":0,"syntology":null},{"url":null,"slug":"end-to-end-audiovisual-speech-activity","title":"End-to-end Audiovisual Speech Activity Detection with Bimodal Recurrent Neural Models","date":"2018-09-12","arxiv_id":"1809.04553","repositories_listed":0,"syntology":null},{"url":null,"slug":"isolated-and-ensemble-audio-preprocessing","title":"Isolated and Ensemble Audio Preprocessing Methods for Detecting Adversarial Examples against Automatic Speech Recognition","date":"2018-09-11","arxiv_id":"1809.04397","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-proof-that-artificial-neural-networks","title":"A proof that artificial neural networks overcome the curse of dimensionality in the numerical approximation of Black-Scholes partial differential equations","date":"2018-09-07","arxiv_id":"1809.02362","repositories_listed":0,"syntology":null},{"url":"/paper/end-to-end-speech-recognition-using-lattice","slug":"end-to-end-speech-recognition-using-lattice","title":"End-to-end speech recognition using lattice-free MMI","date":"2018-09-06","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"etude-de-linformativite-des-transcriptions","title":"Étude de l'informativité des transcriptions : une approche basée sur le résumé automatique","date":"2018-09-04","arxiv_id":"1809.00994","repositories_listed":0,"syntology":null},{"url":null,"slug":"hasp-a-high-performance-adaptive-mobile","title":"HASP: A High-Performance Adaptive Mobile Security Enhancement Against Malicious Speech Recognition","date":"2018-09-04","arxiv_id":"1809.01697","repositories_listed":0,"syntology":null},{"url":"/paper/aishell-2-transforming-mandarin-asr-research","slug":"aishell-2-transforming-mandarin-asr-research","title":"AISHELL-2: Transforming Mandarin ASR Research Into Industrial Scale","date":"2018-08-31","arxiv_id":"1808.10583","repositories_listed":0,"syntology":null},{"url":"/paper/end-to-end-speech-recognition-with-adaptive","slug":"end-to-end-speech-recognition-with-adaptive","title":"End-to-end Speech Recognition with Adaptive Computation Steps","date":"2018-08-30","arxiv_id":"1808.10088","repositories_listed":0,"syntology":null},{"url":null,"slug":"augmenting-bottleneck-features-of-deep-neural","title":"Augmenting Bottleneck Features of Deep Neural Network Employing Motor State for Speech Recognition at Humanoid Robots","date":"2018-08-27","arxiv_id":"1808.08702","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-margin-neural-language-model","title":"Large Margin Neural Language Model","date":"2018-08-27","arxiv_id":"1808.08987","repositories_listed":0,"syntology":null},{"url":null,"slug":"role-of-intonation-in-scoring-spoken-english","title":"Role of Intonation in Scoring Spoken English","date":"2018-08-23","arxiv_id":"1808.07688","repositories_listed":0,"syntology":null},{"url":null,"slug":"fast-spectrogram-inversion-using-multi-head","title":"Fast Spectrogram Inversion using Multi-head Convolutional Neural Networks","date":"2018-08-20","arxiv_id":"1808.06719","repositories_listed":0,"syntology":null},{"url":null,"slug":"linked-recurrent-neural-networks","title":"Linked Recurrent Neural Networks","date":"2018-08-19","arxiv_id":"1808.06170","repositories_listed":0,"syntology":null},{"url":null,"slug":"computing-word-classes-using-spectral","title":"Computing Word Classes Using Spectral Clustering","date":"2018-08-16","arxiv_id":"1808.05374","repositories_listed":0,"syntology":null},{"url":null,"slug":"identifying-implementation-bugs-in-machine","title":"Identifying Implementation Bugs in Machine Learning based Image Classifiers using Metamorphic Testing","date":"2018-08-16","arxiv_id":"1808.05353","repositories_listed":0,"syntology":null},{"url":null,"slug":"toward-domain-invariant-speech-recognition","title":"Toward domain-invariant speech recognition via large scale training","date":"2018-08-16","arxiv_id":"1808.05312","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-collaborative-ranking","title":"Neural Collaborative Ranking","date":"2018-08-15","arxiv_id":"1808.04957","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-methods-and-theories-of-quantized","title":"A Survey on Methods and Theories of Quantized Neural Networks","date":"2018-08-13","arxiv_id":"1808.04752","repositories_listed":0,"syntology":null},{"url":null,"slug":"densely-connected-convolutional-networks-for","title":"Densely Connected Convolutional Networks for Speech Recognition","date":"2018-08-10","arxiv_id":"1808.03570","repositories_listed":0,"syntology":null},{"url":null,"slug":"end-to-end-speech-recognition-with-word-based","title":"End-to-end Speech Recognition with Word-based RNN Language Models","date":"2018-08-08","arxiv_id":"1808.02608","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-context-end-to-end-contextual-speech","title":"Deep context: end-to-end contextual speech recognition","date":"2018-08-07","arxiv_id":"1808.02480","repositories_listed":0,"syntology":null},{"url":null,"slug":"device-directed-utterance-detection","title":"Device-directed Utterance Detection","date":"2018-08-07","arxiv_id":"1808.02504","repositories_listed":0,"syntology":null},{"url":null,"slug":"dialog-context-aware-end-to-end-speech","title":"Dialog-context aware end-to-end speech recognition","date":"2018-08-07","arxiv_id":"1808.02171","repositories_listed":0,"syntology":null},{"url":null,"slug":"generalization-error-in-deep-learning","title":"Generalization Error in Deep Learning","date":"2018-08-03","arxiv_id":"1808.01174","repositories_listed":0,"syntology":null},{"url":null,"slug":"genesys-enabling-continuous-learning-through","title":"GeneSys: Enabling Continuous Learning through Neural Network Evolution in Hardware","date":"2018-08-03","arxiv_id":"1808.01363","repositories_listed":0,"syntology":null},{"url":null,"slug":"linguistic-search-optimization-for-deep","title":"Linguistic Search Optimization for Deep Learning Based LVCSR","date":"2018-08-02","arxiv_id":"1808.00687","repositories_listed":0,"syntology":null},{"url":null,"slug":"mobile-big-data-analysis-with-machine","title":"Mobile big data analysis with machine learning","date":"2018-08-02","arxiv_id":"1808.00803","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequence-discriminative-training-for-deep","title":"Sequence Discriminative Training for Deep Learning based Acoustic Keyword Spotting","date":"2018-08-02","arxiv_id":"1808.00639","repositories_listed":0,"syntology":null},{"url":null,"slug":"design-of-a-tigrinya-language-speech-corpus","title":"Design of a Tigrinya Language Speech Corpus for Speech Recognition","date":"2018-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"indigenous-language-technologies-in-canada","title":"Indigenous language technologies in Canada: Assessment, challenges, and successes","date":"2018-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"word-embedding-based-content-features-for","title":"Word-Embedding based Content Features for Automated Oral Proficiency Scoring","date":"2018-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-domain-adaptation-by-adversarial","title":"Unsupervised Domain Adaptation by Adversarial Learning for Robust Speech Recognition","date":"2018-07-30","arxiv_id":"1807.11284","repositories_listed":0,"syntology":null},{"url":null,"slug":"acoustic-and-textual-data-augmentation-for","title":"Acoustic and Textual Data Augmentation for Improved ASR of Code-Switching Speech","date":"2018-07-28","arxiv_id":"1807.10945","repositories_listed":0,"syntology":null},{"url":null,"slug":"articulatory-features-for-asr-of-pathological","title":"Articulatory Features for ASR of Pathological Speech","date":"2018-07-28","arxiv_id":"1807.10948","repositories_listed":0,"syntology":null},{"url":null,"slug":"back-translation-style-data-augmentation-for","title":"Back-Translation-Style Data Augmentation for End-to-End ASR","date":"2018-07-28","arxiv_id":"1807.10893","repositories_listed":0,"syntology":null},{"url":null,"slug":"building-a-unified-code-switching-asr-system","title":"Building a Unified Code-Switching ASR System for South African Languages","date":"2018-07-28","arxiv_id":"1807.10949","repositories_listed":0,"syntology":null},{"url":null,"slug":"code-switching-detection-with-data-augmented","title":"Code-Switching Detection with Data-Augmented Acoustic and Language Models","date":"2018-07-28","arxiv_id":"1808.00521","repositories_listed":0,"syntology":null},{"url":null,"slug":"acoustic-to-word-recognition-with-sequence-to","title":"Acoustic-to-Word Recognition with Sequence-to-Sequence Models","date":"2018-07-23","arxiv_id":"1807.09597","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-speech-recognition-for-humanitarian","title":"Automatic Speech Recognition for Humanitarian Applications in Somali","date":"2018-07-23","arxiv_id":"1807.08669","repositories_listed":0,"syntology":null},{"url":null,"slug":"nullanet-training-deep-neural-networks-for","title":"NullaNet: Training Deep Neural Networks for Reduced-Memory-Access Inference","date":"2018-07-23","arxiv_id":"1807.08716","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-scale-alignment-and-contextual-history","title":"Multi-scale Alignment and Contextual History for Attention Mechanism in Sequence-to-sequence Model","date":"2018-07-22","arxiv_id":"1807.08280","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatial-correlation-and-value-prediction-in","title":"Spatial Correlation and Value Prediction in Convolutional Neural Networks","date":"2018-07-21","arxiv_id":"1807.10598","repositories_listed":0,"syntology":null},{"url":null,"slug":"hierarchical-multi-task-learning-with-ctc","title":"Hierarchical Multi Task Learning With CTC","date":"2018-07-18","arxiv_id":"1807.07104","repositories_listed":0,"syntology":null},{"url":null,"slug":"hierarchical-multitask-learning-for-ctc-based","title":"Hierarchical Multitask Learning for CTC-based Speech Recognition","date":"2018-07-17","arxiv_id":"1807.06234","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-noise-invariant-representations-for","title":"Learning Noise-Invariant Representations for Robust Speech Recognition","date":"2018-07-17","arxiv_id":"1807.06610","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-recurrent-neural-networks-against","title":"Training Recurrent Neural Networks against Noisy Computations during Inference","date":"2018-07-17","arxiv_id":"1807.06555","repositories_listed":0,"syntology":null},{"url":null,"slug":"concept-based-embeddings-for-natural-language","title":"Concept-Based Embeddings for Natural Language Processing","date":"2018-07-15","arxiv_id":"1807.05519","repositories_listed":0,"syntology":null},{"url":null,"slug":"syllabification-by-phone-categorization","title":"Syllabification by Phone Categorization","date":"2018-07-15","arxiv_id":"1807.05518","repositories_listed":0,"syntology":null},{"url":null,"slug":"hybrid-ctc-attention-based-end-to-end-speech","title":"Hybrid CTC-Attention based End-to-End Speech Recognition using Subword Units","date":"2018-07-13","arxiv_id":"1807.04978","repositories_listed":0,"syntology":null},{"url":"/paper/large-scale-visual-speech-recognition","slug":"large-scale-visual-speech-recognition","title":"Large-Scale Visual Speech Recognition","date":"2018-07-13","arxiv_id":"1807.05162","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-fast-converged-acoustic-modeling-for-korean","title":"A Fast-Converged Acoustic Modeling for Korean Speech Recognition: A Preliminary Study on Time Delay Neural Network","date":"2018-07-11","arxiv_id":"1807.05855","repositories_listed":0,"syntology":null},{"url":null,"slug":"foreign-english-accent-adjustment-by-learning","title":"Foreign English Accent Adjustment by Learning Phonetic Patterns","date":"2018-07-09","arxiv_id":"1807.03625","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-training-recurrent-networks-with-truncated","title":"On Training Recurrent Networks with Truncated Backpropagation Through Time in Speech Recognition","date":"2018-07-09","arxiv_id":"1807.03396","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-deep-learning-through-automatic","title":"Improving Deep Learning through Automatic Programming","date":"2018-07-08","arxiv_id":"1807.02816","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-the-sequential-temporal-information","title":"Learning The Sequential Temporal Information with Recurrent Neural Networks","date":"2018-07-08","arxiv_id":"1807.02857","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-language-codes-for-multilingual","title":"Neural Language Codes for Multilingual Acoustic Models","date":"2018-07-05","arxiv_id":"1807.01956","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-end-to-end-techniques-for-low","title":"Exploring End-to-End Techniques for Low-Resource Speech Recognition","date":"2018-07-02","arxiv_id":"1807.00868","repositories_listed":0,"syntology":null},{"url":null,"slug":"weight-importance-sparse-training-in-keyword","title":"Weight-importance sparse training in keyword spotting","date":"2018-07-02","arxiv_id":"1807.00560","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-unified-neural-architecture-for-joint","title":"A Unified Neural Architecture for Joint Dialog Act Segmentation and Recognition in Spoken Dialog System","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-detection-of-code-switching-style","title":"Automatic Detection of Code-switching Style from Acoustics","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"low-resource-machine-transliteration-using","title":"Low-Resource Machine Transliteration Using Recurrent Neural Networks of Asian Languages","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"openseq2seq-extensible-toolkit-for","title":"OpenSeq2Seq: Extensible Toolkit for Distributed and Mixed Precision Training of Sequence-to-Sequence Models","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"phone-merging-for-code-switched-speech","title":"Phone Merging For Code-Switched Speech Recognition","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-importance-of-recommender-and-feedback","title":"The Importance of Recommender and Feedback Features in a Pronunciation Learning Aid","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-and-efficient-vocabulary","title":"Unsupervised and Efficient Vocabulary Expansion for Recurrent Neural Network Language Models in ASR","date":"2018-06-27","arxiv_id":"1806.10306","repositories_listed":0,"syntology":null}],"record_sha256":"ca9922fbcf3a716363b0b3a439ec69804c7976c0122ea26f6ca9b1e114a5b476","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}