Browse State-of-the-Art › Automatic Speech Recognition › Papers, page 25
Automatic Speech Recognition
Papers archive 2025-07-28
archive papers tagged: 3,174 · with a code link: 677 · where Syntology ran a sample: 79 (62 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (79 of 3,174 tagged: 62 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 25 of 32: papers 2,401 to 2,500 of 3,174, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Improving accuracy of rare words for RNN-Transducer through unigram shallow fusion30 Nov 2020 0 repositories listed
-
Transformer-Transducers for Code-Switched Speech Recognition30 Nov 2020 0 repositories listed
-
Unsupervised Domain Adaptation for Speech Recognition via Uncertainty Driven Self-Training26 Nov 2020 0 repositories listed
-
Bootstrap an end-to-end ASR system by multilingual training, transfer learning, text-to-text mapping and synthetic audio25 Nov 2020 0 repositories listed
-
Adam^+: A Stochastic Method with Adaptive Variance Reduction24 Nov 2020 0 repositories listed
-
Multi-task Language Modeling for Improving Speech Recognition of Rare Words23 Nov 2020 0 repositories listed
-
Using Synthetic Audio to Improve The Recognition of Out-Of-Vocabulary Words in End-To-End ASR Systems23 Nov 2020 0 repositories listed
-
Improving RNN-T ASR Accuracy Using Context Audio20 Nov 2020 0 repositories listed
-
Cascade RNN-Transducer: Syllable Based Streaming On-device Mandarin Speech Recognition with a Syllable-to-Character Converter17 Nov 2020 0 repositories listed
-
Refining Automatic Speech Recognition System for older adults17 Nov 2020 0 repositories listed
-
Audio-visual Multi-channel Integration and Recognition of Overlapped Speech16 Nov 2020 0 repositories listed
-
Deep Shallow Fusion for RNN-T Personalization16 Nov 2020 0 repositories listed
-
Improving Speech Enhancement Performance by Leveraging Contextual Broad Phonetic Class Information15 Nov 2020 0 repositories listed
-
Self-supervised reinforcement learning for speaker localisation with the iCub humanoid robot12 Nov 2020 0 repositories listed
-
Simultaneous Speech-to-Speech Translation System with Neural Incremental ASR, MT, and TTS10 Nov 2020 0 repositories listed
-
Benchmarking LF-MMI, CTC and RNN-T Criteria for Streaming ASR9 Nov 2020 0 repositories listed
-
Gated Recurrent Fusion with Joint Training Framework for Robust End-to-End Speech Recognition9 Nov 2020 0 repositories listed
-
Personalized Query Rewriting in Conversational AI Agents9 Nov 2020 0 repositories listed
-
On the Usefulness of Self-Attention for Automatic Speech Recognition with Transformers8 Nov 2020 0 repositories listed
-
Acoustics Based Intent Recognition Using Discovered Phonetic Units for Low Resource Languages7 Nov 2020 0 repositories listed
-
ESPnet-se: end-to-end speech enhancement and separation toolkit designed for asr integration7 Nov 2020 0 repositories listed
-
Alignment Restricted Streaming Recurrent Neural Network Transducer5 Nov 2020 0 repositories listed
-
Augmenting Images for ASR and TTS through Single-loop and Dual-loop Multimodal Chain Framework4 Nov 2020 0 repositories listed
-
Data Augmentation for End-to-end Code-switching Speech Recognition4 Nov 2020 0 repositories listed
-
Incremental Machine Speech Chain Towards Enabling Listening while Speaking in Real-time4 Nov 2020 0 repositories listed
-
Sequence-to-Sequence Learning via Attention Transfer for Incremental Speech Recognition4 Nov 2020 0 repositories listed
-
Improving RNN transducer with normalized jointer network3 Nov 2020 0 repositories listed
-
Integration of speech separation, diarization, and recognition for multi-speaker meetings: System description, comparison, and analysis3 Nov 2020 0 repositories listed
-
Internal Language Model Estimation for Domain-Adaptive End-to-End Speech Recognition3 Nov 2020 0 repositories listed
-
Streaming Attention-Based Models with Augmented Memory for End-to-End Speech Recognition3 Nov 2020 0 repositories listed
-
Unsupervised Pattern Discovery from Thematic Speech Archives Based on Multilingual Bottleneck Features3 Nov 2020 0 repositories listed
-
Warped Language Models for Noise Robust Language Understanding3 Nov 2020 0 repositories listed
-
DNN-Based Semantic Model for Rescoring N-best Speech Recognition List2 Nov 2020 0 repositories listed
-
SapAugment: Learning A Sample Adaptive Policy for Data Augmentation2 Nov 2020 0 repositories listed
-
Effectively pretraining a speech translation decoder with Machine Translation data1 Nov 2020 0 repositories listed
-
ELITR: European Live Translator1 Nov 2020 0 repositories listed
-
Impact of ASR on Alzheimer’s Disease Detection: All Errors are Equal, but Deletions are More Equal than Others1 Nov 2020 0 repositories listed
-
Improving End-to-End Bangla Speech Recognition with Semi-supervised Training1 Nov 2020 0 repositories listed
-
Directional ASR: A New Paradigm for E2E Multi-Speaker Speech Recognition with Source Localization30 Oct 2020 0 repositories listed
-
Streaming Simultaneous Speech Translation with Augmented Memory Transformer30 Oct 2020 0 repositories listed
-
Semi-Supervised Speech Recognition via Graph-based Temporal Classification29 Oct 2020 0 repositories listed
-
Decoupling Pronunciation and Language for End-to-end Code-switching Automatic Speech Recognition28 Oct 2020 0 repositories listed
-
Fusion Models for Improved Visual Captioning28 Oct 2020 0 repositories listed
-
INT8 Winograd Acceleration for Conv1D Equipped ASR Models Deployed on Mobile Devices28 Oct 2020 0 repositories listed
-
Non-Autoregressive Transformer ASR with CTC-Enhanced Decoder Input28 Oct 2020 0 repositories listed
-
Cascaded encoders for unifying streaming and non-streaming ASR27 Oct 2020 0 repositories listed
-
Effective Decoder Masking for Transformer Based End-to-End Speech Recognition27 Oct 2020 0 repositories listed
-
Emotion recognition by fusing time synchronous and time asynchronous representations27 Oct 2020 0 repositories listed
-
Improved Mask-CTC for Non-Autoregressive End-to-End ASR26 Oct 2020 0 repositories listed
-
Improving Noise Robustness of an End-to-End Neural Model for Automatic Speech Recognition23 Oct 2020 0 repositories listed
-
Improving Streaming Automatic Speech Recognition With Non-Streaming Model Distillation On Unsupervised Data22 Oct 2020 0 repositories listed
-
MAM: Masked Acoustic Modeling for End-to-End Speech-to-Text Translation22 Oct 2020 0 repositories listed
-
SlimIPL: Language-Model-Free Iterative Pseudo-Labeling22 Oct 2020 0 repositories listed
-
A General Multi-Task Learning Framework to Leverage Text Data for Speech to Text Tasks21 Oct 2020 0 repositories listed
-
Cascaded Models With Cyclic Feedback For Direct Speech Translation21 Oct 2020 0 repositories listed
-
Knowledge Distillation for Improved Accuracy in Spoken Question Answering21 Oct 2020 0 repositories listed
-
Sentence Boundary Augmentation For Neural Machine Translation Robustness21 Oct 2020 0 repositories listed
-
Knowledge Transfer for Efficient On-device False Trigger Mitigation20 Oct 2020 0 repositories listed
-
Replacing Human Audio with Synthetic Audio for On-device Unspoken Punctuation Prediction20 Oct 2020 0 repositories listed
-
Ensemble Chinese End-to-End Spoken Language Understanding for Abnormal Event Detection from audio stream19 Oct 2020 0 repositories listed
-
Towards Data Distillation for End-to-end Spoken Conversational Question Answering18 Oct 2020 0 repositories listed
-
Studying the Similarity of COVID-19 Sounds based on Correlation Analysis of MFCC17 Oct 2020 0 repositories listed
-
Multimodal Speech Recognition with Unstructured Audio Masking16 Oct 2020 0 repositories listed
-
Non-intrusive speech intelligibility prediction using automatic speech recognition derived measures16 Oct 2020 0 repositories listed
-
Lightweight End-to-End Speech Recognition from Raw Audio Data Using Sinc-Convolutions15 Oct 2020 0 repositories listed
-
Exploiting Spectral Augmentation for Code-Switched Spoken Language Identification14 Oct 2020 0 repositories listed
-
Improving Low Resource Code-switched ASR using Augmented Code-switched TTS12 Oct 2020 0 repositories listed
-
Dual-mode ASR: Unify and Improve Streaming ASR with Full-context Modeling12 Oct 2020 0 repositories listed
-
WER we are and WER we think we are7 Oct 2020 0 repositories listed
-
A Study on Lip Localization Techniques used for Lip reading from a Video28 Sep 2020 0 repositories listed
-
FluentNet: End-to-End Detection of Speech Disfluency with Deep Learning23 Sep 2020 0 repositories listed
-
EasyASR: A Distributed Machine Learning Platform for End-to-end Automatic Speech Recognition14 Sep 2020 0 repositories listed
-
Multi-modal embeddings using multi-task learning for emotion recognition10 Sep 2020 0 repositories listed
-
Unmanned Aerial Vehicle Control Through Domain-based Automatic Speech Recognition9 Sep 2020 0 repositories listed
-
Robust Spoken Language Understanding with RL-based Value Error Recovery7 Sep 2020 0 repositories listed
-
Silent Speech Interfaces for Speech Restoration: A Review4 Sep 2020 0 repositories listed
-
Voice Conversion by Cascading Automatic Speech Recognition and Text-to-Speech Synthesis with Prosody Transfer3 Sep 2020 0 repositories listed
-
Convolutional Speech Recognition with Pitch and Voice Quality Features2 Sep 2020 0 repositories listed
-
Multi-view Attention-based Speech Enhancement Model for Noise-robust Automatic Speech Recognition1 Sep 2020 0 repositories listed
-
Aphasic Speech Recognition using a Mixture of Speech Intelligibility Experts25 Aug 2020 0 repositories listed
-
Learned Transferable Architectures Can Surpass Hand-Designed Architectures for Large Scale Speech Recognition25 Aug 2020 0 repositories listed
-
Improving Tail Performance of a Deliberation E2E ASR Model Using a Large Text Corpus24 Aug 2020 0 repositories listed
-
Cross-Utterance Language Models with Acoustic Error Sampling19 Aug 2020 0 repositories listed
-
Speech To Semantics: Improve ASR and NLU Jointly via All-Neural Interfaces14 Aug 2020 0 repositories listed
-
Conv-Transformer Transducer: Low Latency, Low Frame Rate, Streamable End-to-End Speech Recognition13 Aug 2020 0 repositories listed
-
Large-scale Transfer Learning for Low-resource Spoken Language Understanding13 Aug 2020 0 repositories listed
-
13 Aug 2020 0 repositories listed
-
Online Automatic Speech Recognition with Listen, Attend and Spell Model12 Aug 2020 0 repositories listed
-
Transfer Learning Approaches for Streaming End-to-End Speech Recognition System12 Aug 2020 0 repositories listed
-
Transformer with Bidirectional Decoder for Speech Recognition11 Aug 2020 0 repositories listed
-
Subword Regularization: An Analysis of Scalability and Generalization for End-to-End Automatic Speech Recognition10 Aug 2020 0 repositories listed
-
LRSpeech: Extremely Low-Resource Speech Synthesis and Recognition9 Aug 2020 0 repositories listed
-
Deep Learning Based Dereverberation of Temporal Envelopesfor Robust Speech Recognition7 Aug 2020 0 repositories listed
-
Investigation of Speaker-adaptation methods in Transformer based ASR7 Aug 2020 0 repositories listed
-
A Transfer Learning Method for Speech Emotion Recognition from Automatic Speech Recognition6 Aug 2020 0 repositories listed
-
Iterative Compression of End-to-End ASR Model using AutoML6 Aug 2020 0 repositories listed
-
Shouted Speech Compensation for Speaker Verification Robust to Vocal Effort Conditions6 Aug 2020 0 repositories listed
-
Unsupervised Cross-Domain Singing Voice Conversion6 Aug 2020 0 repositories listed
-
"This is Houston. Say again, please". The Behavox system for the Apollo-11 Fearless Steps Challenge (phase II)4 Aug 2020 0 repositories listed
-
Weakly Supervised Construction of ASR Systems with Massive Video Data4 Aug 2020 0 repositories listed