Browse State-of-the-Art › Automatic Speech Recognition (ASR) › Papers, page 20
Automatic Speech Recognition (ASR)
Papers archive 2025-07-28
archive papers tagged: 3,012 · with a code link: 622 · where Syntology ran a sample: 77 (64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (77 of 3,012 tagged: 64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument)
Page 20 of 31: papers 1,901 to 2,000 of 3,012, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Improving Distinction between ASR Errors and Speech Disfluencies with Feature Space Interpolation4 Aug 2021 0 repositories listed
-
Unsupervised Domain Adaptation in Speech Recognition using Phonetic Features4 Aug 2021 0 repositories listed
-
3 Aug 2021 0 repositories listed
-
Learning a Neural Diff for Speech Models3 Aug 2021 0 repositories listed
-
Automatic recognition of suprasegmentals in speech2 Aug 2021 0 repositories listed
-
Decoupling recognition and transcription in Mandarin ASR2 Aug 2021 0 repositories listed
-
BTS: Back TranScription for Speech-to-Text Post-Processor using Text-to-Speech-to-Text1 Aug 2021 0 repositories listed
-
How Might We Create Better Benchmarks for Speech Recognition?1 Aug 2021 0 repositories listed
-
IMS’ Systems for the IWSLT 2021 Low-Resource Speech Translation Task1 Aug 2021 0 repositories listed
-
Interactive Reinforcement Learning for Table Balancing Robot1 Aug 2021 0 repositories listed
-
On Knowledge Distillation for Translating Erroneous Speech Transcriptions1 Aug 2021 0 repositories listed
-
ON-TRAC’ systems for the IWSLT 2021 low-resource speech translation and multilingual speech translation shared tasks1 Aug 2021 0 repositories listed
-
QASR: QCRI Aljazeera Speech Resource A Large Scale Annotated Arabic Speech Corpus1 Aug 2021 0 repositories listed
-
Technology-Augmented Multilingual Communication Models: New Interaction Paradigms, Shifts in the Language Services Industry, and Implications for Training Programs1 Aug 2021 0 repositories listed
-
Without Further Ado: Direct and Simultaneous Speech Translation by AppTek in 20211 Aug 2021 0 repositories listed
-
ZJU’s IWSLT 2021 Speech Translation System1 Aug 2021 0 repositories listed
-
Can You Hear It? Backdoor Attacks via Ultrasonic Triggers30 Jul 2021 0 repositories listed
-
Adapting GPT, GPT-2 and BERT Language Models for Speech Recognition29 Jul 2021 0 repositories listed
-
An Adapter Based Pre-Training for Efficient and Scalable Self-Supervised Speech Representation Learning26 Jul 2021 0 repositories listed
-
Facetron: A Multi-speaker Face-to-Speech Model based on Cross-modal Latent Representations26 Jul 2021 0 repositories listed
-
23 Jul 2021 0 repositories listed
-
CarneliNet: Neural Mixture Model for Automatic Speech Recognition22 Jul 2021 0 repositories listed
-
Multitask-Based Joint Learning Approach To Robust ASR For Radio Communication Speech22 Jul 2021 0 repositories listed
-
On Prosody Modeling for ASR+TTS based Voice Conversion20 Jul 2021 0 repositories listed
-
A baseline model for computationally inexpensive speech recognition for Kazakh using the Coqui STT framework19 Jul 2021 0 repositories listed
-
Multi-task Learning with Cross Attention for Keyword Spotting15 Jul 2021 0 repositories listed
-
VAD-free Streaming Hybrid CTC/Attention ASR for Unsegmented Recording15 Jul 2021 0 repositories listed
-
A Configurable Multilingual Model is All You Need to Recognize All Languages13 Jul 2021 0 repositories listed
-
The IWSLT 2021 BUT Speech Translation Systems13 Jul 2021 0 repositories listed
-
Zero-shot Speech Translation13 Jul 2021 0 repositories listed
-
Perceptual-based deep-learning denoiser as a defense against adversarial attacks on ASR systems12 Jul 2021 0 repositories listed
-
Loss Prediction: End-to-End Active Learning Approach For Speech Recognition9 Jul 2021 0 repositories listed
-
Noisy Training Improves E2E ASR for the Edge9 Jul 2021 0 repositories listed
-
On lattice-free boosted MMI training of HMM and CTC-based full-context ASR models9 Jul 2021 0 repositories listed
-
Improved Language Identification Through Cross-Lingual Self-Supervised Learning8 Jul 2021 0 repositories listed
-
End-to-End Rich Transcription-Style Automatic Speech Recognition with Semi-Supervised Learning7 Jul 2021 0 repositories listed
-
A Comparative Study of Modular and Joint Approaches for Speaker-Attributed ASR on Monaural Long-Form Audio6 Jul 2021 0 repositories listed
-
Investigation of Practical Aspects of Single Channel Speech Separation for ASR5 Jul 2021 0 repositories listed
-
Arabic Code-Switching Speech Recognition using Monolingual Data4 Jul 2021 0 repositories listed
-
Cross-Modal Transformer-Based Neural Correction Models for Automatic Speech Recognition4 Jul 2021 0 repositories listed
-
Unified Autoregressive Modeling for Joint End-to-End Multi-Talker Overlapped Speech Recognition and Speaker Attribute Estimation4 Jul 2021 0 repositories listed
-
Dual Causal/Non-Causal Self-Attention for Streaming End-to-End Speech Recognition2 Jul 2021 0 repositories listed
-
Multi-user VoiceFilter-Lite via Attentive Speaker Embedding2 Jul 2021 0 repositories listed
-
Improving Named Entity Recognition in Spoken Dialog Systems by Context and Speech Pattern Modeling1 Jul 2021 0 repositories listed
-
SmarTerp: A CAI System to Support Simultaneous Interpreters in Real-Time1 Jul 2021 0 repositories listed
-
StableEmit: Selection Probability Discount for Reducing Emission Latency of Streaming Monotonic Attention ASR1 Jul 2021 0 repositories listed
-
Word-Free Spoken Language Understanding for Mandarin-Chinese1 Jul 2021 0 repositories listed
-
On joint training with interfaces for spoken language understanding30 Jun 2021 0 repositories listed
-
IMS' Systems for the IWSLT 2021 Low-Resource Speech Translation Task30 Jun 2021 0 repositories listed
-
Sequence-level Confidence Classifier for ASR Utterance Accuracy and Application to Acoustic Models30 Jun 2021 0 repositories listed
-
Rethinking End-to-End Evaluation of Decomposable Tasks: A Case Study on Spoken Language Understanding29 Jun 2021 0 repositories listed
-
QASR: QCRI Aljazeera Speech Resource -- A Large Scale Annotated Arabic Speech Corpus24 Jun 2021 0 repositories listed
-
Where are we in semantic concept extraction for Spoken Language Understanding?24 Jun 2021 0 repositories listed
-
Mixtures of Deep Neural Experts for Automated Speech Scoring23 Jun 2021 0 repositories listed
-
Zero-Shot Joint Modeling of Multiple Spoken-Text-Style Conversion Tasks using Switching Tokens23 Jun 2021 0 repositories listed
-
A Discriminative Entity-Aware Language Model for Virtual Assistants21 Jun 2021 0 repositories listed
-
An Improved Single Step Non-autoregressive Transformer for Automatic Speech Recognition18 Jun 2021 0 repositories listed
-
Low Resource German ASR with Untranscribed Data Spoken by Non-native Children -- INTERSPEECH 2021 Shared Task SPAPL System18 Jun 2021 0 repositories listed
-
On-Device Personalization of Automatic Speech Recognition Models for Disordered Speech18 Jun 2021 0 repositories listed
-
Layer Pruning on Demand with Intermediate CTC17 Jun 2021 0 repositories listed
-
Multi-mode Transformer Transducer with Stochastic Future Context17 Jun 2021 0 repositories listed
-
Topic Classification on Spoken Documents Using Deep Acoustic and Linguistic Features16 Jun 2021 0 repositories listed
-
A Study into Pre-training Strategies for Spoken Language Understanding on Dysarthric Speech15 Jun 2021 0 repositories listed
-
ASR Adaptation for E-commerce Chatbots using Cross-Utterance Context and Multi-Task Language Modeling15 Jun 2021 0 repositories listed
-
Dialectal Speech Recognition and Translation of Swiss German Speech to Standard German Text: Microsoft's Submission to SwissText 202115 Jun 2021 0 repositories listed
-
Multi-channel Opus compression for far-field automatic speech recognition with a fixed bitrate budget15 Jun 2021 0 repositories listed
-
Overcoming Domain Mismatch in Low Resource Sequence-to-Sequence ASR Models using Hybrid Generated Pseudotranscripts14 Jun 2021 0 repositories listed
-
SynthASR: Unlocking Synthetic Data for Speech Recognition14 Jun 2021 0 repositories listed
-
Using heterogeneity in semi-supervised transcription hypotheses to improve code-switched speech recognition14 Jun 2021 0 repositories listed
-
Cross-utterance Reranking Models with BERT and Graph Convolutional Networks for Conversational Speech Recognition13 Jun 2021 0 repositories listed
-
Improving RNN-T ASR Performance with Date-Time and Location Awareness11 Jun 2021 0 repositories listed
-
Leveraging Pre-trained Language Model for Speech Sentiment Analysis11 Jun 2021 0 repositories listed
-
PARP: Prune, Adjust and Re-Prune for Self-Supervised Speech Recognition10 Jun 2021 0 repositories listed
-
10 Jun 2021 0 repositories listed
-
A Comparative Study on Neural Architectures and Training Methods for Japanese Speech Recognition9 Jun 2021 0 repositories listed
-
Unsupervised Automatic Speech Recognition: A Review9 Jun 2021 0 repositories listed
-
8 Jun 2021 0 repositories listed
-
Data Augmentation Methods for End-to-end Speech Recognition on Distant-Talk Scenarios7 Jun 2021 0 repositories listed
-
Human Listening and Live Captioning: Multi-Task Training for Speech Enhancement5 Jun 2021 0 repositories listed
-
Do You Listen with One or Two Microphones? A Unified ASR Model for Single and Multi-Channel Audio4 Jun 2021 0 repositories listed
-
Semantic-WER: A Unified Metric for the Evaluation of ASR Transcript for End Usability3 Jun 2021 0 repositories listed
-
Dual Script E2E framework for Multilingual and Code-Switching ASR2 Jun 2021 0 repositories listed
-
Improving low-resource ASR performance with untranscribed out-of-domain data2 Jun 2021 0 repositories listed
-
Should We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition2 Jun 2021 0 repositories listed
-
A Neural Acoustic Echo Canceller Optimized Using An Automatic Speech Recognizer And Large Scale Synthetic Data1 Jun 2021 0 repositories listed
-
Developing ASR for Indonesian-English Bilingual Language Teaching1 Jun 2021 0 repositories listed
-
End-to-end ASR to jointly predict transcriptions and linguistic annotations1 Jun 2021 0 repositories listed
-
End-to-End Automatic Speech Recognition: Its Impact on the Workflowin Documenting Yoloxóchitl Mixtec1 Jun 2021 0 repositories listed
-
Evaluating Automatic Speech Recognition Quality and Its Impact on Counselor Utterance Coding1 Jun 2021 0 repositories listed
-
Highland Puebla Nahuatl Speech Translation Corpus for Endangered Language Documentation1 Jun 2021 0 repositories listed
-
Towards One Model to Rule All: Multilingual Strategy for Dialectal Code-Switching Arabic ASR31 May 2021 0 repositories listed
-
Training Speech Enhancement Systems with Noisy Speech Datasets26 May 2021 0 repositories listed
-
Mondegreen: A Post-Processing Solution to Speech Recognition Error Correction for Voice Search Queries20 May 2021 0 repositories listed
-
LiSTra, Automatic Speech Translation: English to Lingala case study16 May 2021 0 repositories listed
-
Listen with Intent: Improving Speech Recognition with Audio-to-Intent Front-End14 May 2021 0 repositories listed
-
Streaming Transformer for Hardware Efficient Voice Trigger Detection and False Trigger Mitigation14 May 2021 0 repositories listed
-
Exploring CTC Based End-to-End Techniques for Myanmar Speech Recognition13 May 2021 0 repositories listed
-
Stacked Acoustic-and-Textual Encoding: Integrating the Pre-trained Models into Speech Translation Encoders12 May 2021 0 repositories listed
-
StutterNet: Stuttering Detection Using Time Delay Neural Network12 May 2021 0 repositories listed
-
10 May 2021 0 repositories listed