Browse State-of-the-Art › Automatic Speech Recognition (ASR) › Papers, page 19
Automatic Speech Recognition (ASR)
Papers archive 2025-07-28
archive papers tagged: 3,012 · with a code link: 622 · where Syntology ran a sample: 77 (64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (77 of 3,012 tagged: 64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument)
Page 19 of 31: papers 1,801 to 1,900 of 3,012, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Synt++: Utilizing Imperfect Synthetic Data to Improve Speech Recognition21 Oct 2021 0 repositories listed
-
An Investigation of Enhancing CTC Model for Triggered Attention-based Streaming ASR20 Oct 2021 0 repositories listed
-
One model to enhance them all: array geometry agnostic multi-channel personalized speech enhancement20 Oct 2021 0 repositories listed
-
Speech Pattern based Black-box Model Watermarking for Automatic Speech Recognition19 Oct 2021 0 repositories listed
-
Automatic Learning of Subword Dependent Model Scales18 Oct 2021 0 repositories listed
-
Efficient Sequence Training of Attention Models using Approximative Recombination18 Oct 2021 0 repositories listed
-
Intent Classification Using Pre-trained Language Agnostic Embeddings For Low Resource Languages18 Oct 2021 0 repositories listed
-
ViraPart: A Text Refinement Framework for Automatic Speech Recognition and Natural Language Processing Tasks in Persian18 Oct 2021 0 repositories listed
-
Multilingual Speech Recognition using Knowledge Transfer across Learning Processes15 Oct 2021 0 repositories listed
-
Omni-sparsity DNN: Fast Sparsity Optimization for On-Device Streaming E2E ASR via Supernet15 Oct 2021 0 repositories listed
-
14 Oct 2021 0 repositories listed
-
All-neural beamformer for continuous speech separation13 Oct 2021 0 repositories listed
-
Continual learning using lattice-free MMI for speech recognition13 Oct 2021 0 repositories listed
-
Prompt-tuning in ASR systems for efficient domain-adaptation13 Oct 2021 0 repositories listed
-
Improving Character Error Rate Is Not Equal to Having Clean Speech: Speech Enhancement for ASR Systems with Black-box Acoustic Models12 Oct 2021 0 repositories listed
-
Word Order Does Not Matter For Speech Recognition12 Oct 2021 0 repositories listed
-
A Comparative Study on Non-Autoregressive Modelings for Speech-to-Text Generation11 Oct 2021 0 repositories listed
-
Advancing Momentum Pseudo-Labeling with Conformer and Initialization Strategy11 Oct 2021 0 repositories listed
-
Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric11 Oct 2021 0 repositories listed
-
SRU++: Pioneering Fast Recurrence with Attention for Speech Recognition11 Oct 2021 0 repositories listed
-
Wav2vec-Switch: Contrastive Learning from Original-noisy Speech Pairs for Robust Speech Recognition11 Oct 2021 0 repositories listed
-
DITTO: Data-efficient and Fair Targeted Subset Selection for ASR Accent Adaptation10 Oct 2021 0 repositories listed
-
Towards High-fidelity Singing Voice Conversion with Acoustic Reference and Contrastive Predictive Coding10 Oct 2021 0 repositories listed
-
An Exploration of Self-Supervised Pretrained Representations for End-to-End Speech Recognition9 Oct 2021 0 repositories listed
-
Data Augmentation with Locally-time Reversed Speech for Automatic Speech Recognition9 Oct 2021 0 repositories listed
-
Personalized Automatic Speech Recognition Trained on Small Disordered Speech Datasets9 Oct 2021 0 repositories listed
-
Wav2vec-S: Semi-Supervised Pre-Training for Low-Resource ASR9 Oct 2021 0 repositories listed
-
A Genetic Programming Approach To Zero-Shot Neural Architecture Ranking8 Oct 2021 0 repositories listed
-
Exploring Heterogeneous Characteristics of Layers in ASR Models for More Efficient Training8 Oct 2021 0 repositories listed
-
Input Length Matters: Improving RNN-T and MWER Training for Long-form Telephony Speech Recognition8 Oct 2021 0 repositories listed
-
SCaLa: Supervised Contrastive Learning for End-to-End Speech Recognition8 Oct 2021 0 repositories listed
-
Accent-Robust Automatic Speech Recognition Using Supervised and Unsupervised Wav2vec Embeddings7 Oct 2021 0 repositories listed
-
Enabling On-Device Training of Speech Recognition Models with Federated Dropout7 Oct 2021 0 repositories listed
-
Improving Confidence Estimation on Out-of-Domain Data for End-to-End Speech Recognition7 Oct 2021 0 repositories listed
-
Knowledge Distillation for Neural Transducers from Large Self-Supervised Pre-trained Models7 Oct 2021 0 repositories listed
-
Magic dust for cross-lingual adaptation of monolingual wav2vec-2.07 Oct 2021 0 repositories listed
-
Transcribe-to-Diarize: Neural Speaker Diarization for Unlimited Number of Speakers using End-to-End Speaker-Attributed ASR7 Oct 2021 0 repositories listed
-
CTC Variations Through New WFST Topologies6 Oct 2021 0 repositories listed
-
Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition6 Oct 2021 0 repositories listed
-
Spell my name: keyword boosted speech recognition6 Oct 2021 0 repositories listed
-
ASR Rescoring and Confidence Estimation with ELECTRA5 Oct 2021 0 repositories listed
-
Fast Contextual Adaptation with Neural Associative Memory for On-Device Personalized Speech Recognition5 Oct 2021 0 repositories listed
-
5 Oct 2021 0 repositories listed
-
Building a Noisy Audio Dataset to Evaluate Machine Learning Approaches for Automatic Speech Recognition Systems4 Oct 2021 0 repositories listed
-
Exploiting Pre-Trained ASR Models for Alzheimer's Disease Recognition Through Spontaneous Speech4 Oct 2021 0 repositories listed
-
Towards efficient end-to-end speech recognition with biologically-inspired neural networks4 Oct 2021 0 repositories listed
-
Chinese Medical Speech Recognition with Punctuated Hypothesis1 Oct 2021 0 repositories listed
-
Employing low-pass filtered temporal speech features for the training of ideal ratio mask in speech enhancement1 Oct 2021 0 repositories listed
-
Exploring the Integration of E2E ASR and Pronunciation Modeling for English Mispronunciation Detection1 Oct 2021 0 repositories listed
-
Improving Punctuation Restoration for Speech Transcripts via External Data1 Oct 2021 0 repositories listed
-
Speech Technology for Everyone: Automatic Speech Recognition for Non-Native English with Transfer Learning1 Oct 2021 0 repositories listed
-
SpliceOut: A Simple and Efficient Audio Augmentation Method30 Sep 2021 0 repositories listed
-
Comparison of Self-Supervised Speech Pre-Training Methods on Flemish Dutch29 Sep 2021 0 repositories listed
-
Conditioning Sequence-to-sequence Networks with Learned Activations29 Sep 2021 0 repositories listed
-
Demystifying Limited Adversarial Transferability in Automatic Speech Recognition Systems29 Sep 2021 0 repositories listed
-
MLP-based architecture with variable length input for automatic speech recognition29 Sep 2021 0 repositories listed
-
PhaseFool: Phase-oriented Audio Adversarial Examples via Energy Dissipation29 Sep 2021 0 repositories listed
-
Synthesising Audio Adversarial Examples for Automatic Speech Recognition29 Sep 2021 0 repositories listed
-
Understanding the Role of Self Attention for Efficient Speech Recognition29 Sep 2021 0 repositories listed
-
W-CTC: a Connectionist Temporal Classification Loss with Wild Cards29 Sep 2021 0 repositories listed
-
Private Language Model Adaptation for Speech Recognition28 Sep 2021 0 repositories listed
-
Word-level confidence estimation for RNN transducers28 Sep 2021 0 repositories listed
-
27 Sep 2021 0 repositories listed
-
Challenges and Opportunities of Speech Recognition for Bengali Language27 Sep 2021 0 repositories listed
-
Topic Model Robustness to Automatic Speech Recognition Errors in Podcast Transcripts25 Sep 2021 0 repositories listed
-
Learning Domain Specific Language Models for Automatic Speech Recognition through Machine Translation21 Sep 2021 0 repositories listed
-
Audio-Visual Speech Recognition is Worth 32×32×8 Voxels20 Sep 2021 0 repositories listed
-
iRNN: Integer-only Recurrent Neural Network20 Sep 2021 0 repositories listed
-
MeetDot: Videoconferencing with Live Translation Captions20 Sep 2021 0 repositories listed
-
Model-Based Approach for Measuring the Fairness in ASR19 Sep 2021 0 repositories listed
-
Multimodal Audio-textual Architecture for Robust Spoken Language Understanding17 Sep 2021 0 repositories listed
-
PDAugment: Data Augmentation by Pitch and Duration Adjustments for Automatic Lyrics Transcription16 Sep 2021 0 repositories listed
-
Utterance-level neural confidence measure for end-to-end children speech recognition16 Sep 2021 0 repositories listed
-
Improving Accent Identification and Accented Speech Recognition Under a Framework of Self-supervised Learning15 Sep 2021 0 repositories listed
-
Improving Streaming Transformer Based ASR Under a Framework of Self-supervised Learning15 Sep 2021 0 repositories listed
-
Non-autoregressive Transformer with Unified Bidirectional Decoder for Automatic Speech Recognition14 Sep 2021 0 repositories listed
-
Residual Adapters for Parameter-Efficient ASR Adaptation to Atypical and Accented Speech14 Sep 2021 0 repositories listed
-
Unsupervised Domain Adaptation Schemes for Building ASR in Low-resource Languages12 Sep 2021 0 repositories listed
-
Remember the context! ASR slot error correction through memorization10 Sep 2021 0 repositories listed
-
Self-Attention Channel Combinator Frontend for End-to-End Multichannel Far-field Speech Recognition10 Sep 2021 0 repositories listed
-
Coarse-To-Fine And Cross-Lingual ASR Transfer2 Sep 2021 0 repositories listed
-
Robustness of end-to-end Automatic Speech Recognition Models – A Case Study using Mozilla DeepSpeech1 Sep 2021 0 repositories listed
-
Tree-constrained Pointer Generator for End-to-end Contextual Speech Recognition1 Sep 2021 0 repositories listed
-
30 Aug 2021 0 repositories listed
-
Investigations on Speech Recognition Systems for Low-Resource Dialectal Arabic-English Code-Switching Speech29 Aug 2021 0 repositories listed
-
4-bit Quantization of LSTM-based Speech Recognition Models27 Aug 2021 0 repositories listed
-
Grammar Based Speaker Role Identification for Air Traffic Control Speech Recognition27 Aug 2021 0 repositories listed
-
Improving callsign recognition with air-surveillance data in air-traffic communication27 Aug 2021 0 repositories listed
-
Task-aware Warping Factors in Mask-based Speech Enhancement27 Aug 2021 0 repositories listed
-
Cross-domain Single-channel Speech Enhancement Model with Bi-projection Fusion Module for Noise-robust ASR26 Aug 2021 0 repositories listed
-
Reducing Exposure Bias in Training Recurrent Neural Network Transducers24 Aug 2021 0 repositories listed
-
A Unified Transformer-based Framework for Duplex Text Normalization23 Aug 2021 0 repositories listed
-
Automatic Speech Recognition And Limited Vocabulary: A Survey23 Aug 2021 0 repositories listed
-
Hierarchical Summarization for Longform Spoken Dialog21 Aug 2021 0 repositories listed
-
A Multi-level Acoustic Feature Extraction Framework for Transformer Based End-to-End Speech Recognition18 Aug 2021 0 repositories listed
-
A Light-weight contextual spelling correction model for customizing transducer-based speech recognition systems17 Aug 2021 0 repositories listed
-
StarGAN-VC+ASR: StarGAN-based Non-Parallel Voice Conversion Regularized by Automatic Speech Recognition10 Aug 2021 0 repositories listed
-
The HW-TSC's Offline Speech Translation Systems for IWSLT 2021 Evaluation9 Aug 2021 0 repositories listed
-
Blind and neural network-guided convolutional beamformer for joint denoising, dereverberation, and source separation4 Aug 2021 0 repositories listed
-
Dyn-ASR: Compact, Multilingual Speech Recognition via Spoken Language and Accent Identification4 Aug 2021 0 repositories listed