Browse State-of-the-Art › Speech Recognition › Papers, page 31
Speech Recognition
Papers archive 2025-07-28
archive papers tagged: 6,433 · with a code link: 1,373 · where Syntology ran a sample: 196 (162 with a run with no instrument failure, 34 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (196 of 6,433 tagged: 162 with a run with no instrument failure, 34 where every run was a failure of Syntology's instrument)
Page 31 of 65: papers 3,001 to 3,100 of 6,433, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Wavelet Transform Based Scheme to Extract Speech Pitch and Formant Frequencies1 Sep 2022 0 repositories listed
-
Attention Enhanced Citrinet for Speech Recognition1 Sep 2022 0 repositories listed
-
DeepCon: An End-to-End Multilingual Toolkit for Automatic Minuting of Multi-Party Dialogues1 Sep 2022 0 repositories listed
-
Evaluation of Automatic Speech Recognition for Conversational Speech in Dutch, English and German: What Goes Missing?1 Sep 2022 0 repositories listed
-
Robust Translation of French Live Speech Transcripts1 Sep 2022 0 repositories listed
-
RecLight: A Recurrent Neural Network Accelerator with Integrated Silicon Photonics31 Aug 2022 0 repositories listed
-
A Language Agnostic Multilingual Streaming On-Device ASR System29 Aug 2022 0 repositories listed
-
Turn-Taking Prediction for Natural Conversational Speech29 Aug 2022 0 repositories listed
-
29 Aug 2022 0 repositories listed
-
Minimal Feature Analysis for Isolated Digit Recognition for varying encoding rates in noisy environments27 Aug 2022 0 repositories listed
-
Effectiveness of Mining Audio and Text Pairs from Public Data for Improving ASR Systems for Low-Resource Languages26 Aug 2022 0 repositories listed
-
Investigating data partitioning strategies for crosslinguistic low-resource ASR evaluation26 Aug 2022 0 repositories listed
-
Are disentangled representations all you need to build speaker anonymization systems?22 Aug 2022 0 repositories listed
-
DualVoice: Speech Interaction that Discriminates between Normal and Whispered Voice Input22 Aug 2022 0 repositories listed
-
Low-Level Physiological Implications of End-to-End Learning of Speech Recognition22 Aug 2022 0 repositories listed
-
16 Aug 2022 0 repositories listed
-
Uconv-Conformer: High Reduction of Input Sequence Length for End-to-End Speech Recognition16 Aug 2022 0 repositories listed
-
Improving Hypernasality Estimation with Automatic Speech Recognition in Cleft Palate Speech10 Aug 2022 0 repositories listed
-
Large vocabulary speech recognition for languages of Africa: multilingual modeling and self-supervised learning5 Aug 2022 0 repositories listed
-
Model Blending for Text Classification5 Aug 2022 0 repositories listed
-
Adversarial Attacks on ASR Systems: An Overview3 Aug 2022 0 repositories listed
-
3 Aug 2022 0 repositories listed
-
Multiclass ASMA vs Targeted PGD Attack in Image Segmentation3 Aug 2022 0 repositories listed
-
Global Performance Disparities Between English-Language Accents in Automatic Speech Recognition1 Aug 2022 0 repositories listed
-
Multiple-hypothesis RNN-T Loss for Unsupervised Fine-tuning and Self-training of Neural Transducer29 Jul 2022 0 repositories listed
-
Pronunciation-aware unique character encoding for RNN Transducer-based Mandarin speech recognition29 Jul 2022 0 repositories listed
-
Thutmose Tagger: Single-pass neural model for Inverse Text Normalization29 Jul 2022 0 repositories listed
-
Extending RNN-T-based speech recognition systems with emotion and language classification28 Jul 2022 0 repositories listed
-
Knowledge-driven Subword Grammar Modeling for Automatic Speech Recognition in Tamil and Kannada27 Jul 2022 0 repositories listed
-
Subword Dictionary Learning and Segmentation Techniques for Automatic Speech Recognition in Tamil and Kannada27 Jul 2022 0 repositories listed
-
Perception-Aware Attack: Creating Adversarial Music via Reverse-Engineering Human Perception26 Jul 2022 0 repositories listed
-
Learning a Dual-Mode Speech Recognition Model via Self-Pruning25 Jul 2022 0 repositories listed
-
Unsupervised data selection for Speech Recognition with contrastive loss ratios25 Jul 2022 0 repositories listed
-
A Deep Dive into Deep Cluster24 Jul 2022 0 repositories listed
-
Implementation Of Tiny Machine Learning Models On Arduino 33 BLE For Gesture And Speech Recognition23 Jul 2022 0 repositories listed
-
ASR Error Detection via Audio-Transcript entailment22 Jul 2022 0 repositories listed
-
Toward Fairness in Speech Recognition: Discovery and mitigation of performance disparities22 Jul 2022 0 repositories listed
-
Improving Data Driven Inverse Text Normalization using Data Augmentation20 Jul 2022 0 repositories listed
-
ILASR: Privacy-Preserving Incremental Learning for Automatic Speech Recognition at Production Scale19 Jul 2022 0 repositories listed
-
18 Jul 2022 0 repositories listed
-
End-to-End Spoken Language Understanding: Performance analyses of a voice command task in a low resource setting17 Jul 2022 0 repositories listed
-
MAC-DO: An Efficient Output-Stationary GEMM Accelerator for CNNs Using DRAM Technology16 Jul 2022 0 repositories listed
-
Reducing Geographic Disparities in Automatic Speech Recognition via Elastic Weight Consolidation16 Jul 2022 0 repositories listed
-
Sotto Voce: Federated Speech Recognition with Differential Privacy Guarantees16 Jul 2022 0 repositories listed
-
15 Jul 2022 0 repositories listed
-
Data Augmentation for Low-Resource Quechua ASR Improvement14 Jul 2022 0 repositories listed
-
Deep versus Wide: An Analysis of Student Architectures for Task-Agnostic Knowledge Distillation of Self-Supervised Speech Models14 Jul 2022 0 repositories listed
-
Efficient spike encoding algorithms for neuromorphic speech recognition14 Jul 2022 0 repositories listed
-
Open Terminology Management and Sharing Toolkit for Federation of Terminology Databases14 Jul 2022 0 repositories listed
-
Two-Pass Low Latency End-to-End Spoken Language Understanding14 Jul 2022 0 repositories listed
-
End-to-end speech recognition modeling from de-identified data12 Jul 2022 0 repositories listed
-
Huqariq: A Multilingual Speech Corpus of Native Languages of Peru for Speech Recognition12 Jul 2022 0 repositories listed
-
Online Continual Learning of End-to-End Speech Recognition Models11 Jul 2022 0 repositories listed
-
pMCT: Patched Multi-Condition Training for Robust Speech Recognition11 Jul 2022 0 repositories listed
-
Intermediate-layer output Regularization for Attention-based Speech Recognition with Shared Decoder9 Jul 2022 0 repositories listed
-
Internal Language Model Estimation based Language Model Fusion for Cross-Domain Code-Switching Speech Recognition9 Jul 2022 0 repositories listed
-
Tandem Multitask Training of Speaker Diarisation and Speech Recognition for Meeting Transcription8 Jul 2022 0 repositories listed
-
End-to-end Speech-to-Punctuated-Text Recognition7 Jul 2022 0 repositories listed
-
Investigating the Impact of Cross-lingual Acoustic-Phonetic Similarities on Multilingual Speech Recognition7 Jul 2022 0 repositories listed
-
Non-Linear Pairwise Language Mappings for Low-Resource Multilingual Acoustic Model Fusion7 Jul 2022 0 repositories listed
-
Improving Streaming End-to-End ASR on Transformer-based Causal Models with Encoder States Revision Strategies6 Jul 2022 0 repositories listed
-
Kaggle Competition: Cantonese Audio-Visual Speech Recognition for In-car Commands6 Jul 2022 0 repositories listed
-
Low-resource Low-footprint Wake-word Detection using Knowledge Distillation6 Jul 2022 0 repositories listed
-
Compute Cost Amortized Transformer for Streaming ASR5 Jul 2022 0 repositories listed
-
DEFORMER: Coupling Deformed Localized Patterns with Global Context for Robust End-to-end Speech Recognition4 Jul 2022 0 repositories listed
-
Vietnamese Capitalization and Punctuation Recovery Models4 Jul 2022 0 repositories listed
-
Leveraging Acoustic Contextual Representation by Audio-textual Cross-modal Learning for Conversational ASR3 Jul 2022 0 repositories listed
-
Improving Transformer-based Conversational ASR by Inter-Sentential Attention Mechanism2 Jul 2022 0 repositories listed
-
Tree-constrained Pointer Generator with Graph Neural Network Encodings for Contextual Speech Recognition2 Jul 2022 0 repositories listed
-
UserLibri: A Dataset for ASR Personalization Using Only Text2 Jul 2022 0 repositories listed
-
Activity focused Speech Recognition of Preschool Children in Early Childhood Classrooms1 Jul 2022 0 repositories listed
-
Domain-Informed Probing of wav2vec 2.0 Embeddings for Phonetic Features1 Jul 2022 0 repositories listed
-
Exploring the Effect of Dialect Mismatched Language Models in Telugu Automatic Speech Recognition1 Jul 2022 0 repositories listed
-
FPI: Failure Point Isolation in Large-scale Conversational Assistants1 Jul 2022 0 repositories listed
-
Improving Low-Resource Speech Recognition with Pretrained Speech Models: Continued Pretraining vs. Semi-Supervised Training1 Jul 2022 0 repositories listed
-
Non-Autoregressive Chinese ASR Error Correction with Phonological Training1 Jul 2022 0 repositories listed
-
On Assessing and Developing Spoken ’Grammatical Error Correction’ Systems1 Jul 2022 0 repositories listed
-
Updating Only Encoders Prevents Catastrophic Forgetting of End-to-End ASR Models1 Jul 2022 0 repositories listed
-
FeaRLESS: Feature Refinement Loss for Ensembling Self-Supervised Learning Features in Robust End-to-end Speech Recognition30 Jun 2022 0 repositories listed
-
Sub-8-Bit Quantization Aware Training for 8-Bit Neural Network Accelerator with On-Device Speech Recognition30 Jun 2022 0 repositories listed
-
Language-specific Characteristic Assistance for Code-switching Speech Recognition29 Jun 2022 0 repositories listed
-
Space-Efficient Representation of Entity-centric Query Language Models29 Jun 2022 0 repositories listed
-
The THUEE System Description for the IARPA OpenASR21 Challenge29 Jun 2022 0 repositories listed
-
Bengali Common Voice Speech Dataset for Automatic Speech Recognition28 Jun 2022 0 repositories listed
-
Exploring linguistic feature and model combination for speech recognition based automatic AD detection28 Jun 2022 0 repositories listed
-
Challenges and Opportunities in Multi-device Speech Processing27 Jun 2022 0 repositories listed
-
TALCS: An Open-Source Mandarin-English Code-Switching Corpus and a Speech Recognition Baseline27 Jun 2022 0 repositories listed
-
Annotated Speech Corpus for Low Resource Indian Languages: Awadhi, Bhojpuri, Braj and Magahi26 Jun 2022 0 repositories listed
-
Improving the Training Recipe for a Robust Conformer-based Hybrid Model26 Jun 2022 0 repositories listed
-
Low-resource Accent Classification in Geographically-proximate Settings: A Forensic and Sociophonetics Perspective26 Jun 2022 0 repositories listed
-
Meta Auxiliary Learning for Low-resource Spoken Language Understanding26 Jun 2022 0 repositories listed
-
On Comparison of Encoders for Attention based End to End Speech Recognition in Standalone and Rescoring Mode26 Jun 2022 0 repositories listed
-
Confidence Score Based Conformer Speaker Adaptation for Speech Recognition24 Jun 2022 0 repositories listed
-
PoCaP Corpus: A Multimodal Dataset for Smart Operating Room Speech Assistant using Interventional Radiology Workflow Analysis24 Jun 2022 0 repositories listed
-
Conformer Based Elderly Speech Recognition System for Alzheimer's Disease Detection23 Jun 2022 0 repositories listed
-
Pruned RNN-T for fast, memory-efficient ASR training23 Jun 2022 0 repositories listed
-
Two-pass Decoding and Cross-adaptation Based System Combination of End-to-end Conformer and Hybrid TDNN ASR Systems23 Jun 2022 0 repositories listed
-
A Simple Baseline for Domain Adaptation in End to End ASR Systems Using Synthetic Data22 Jun 2022 0 repositories listed
-
Answer Fast: Accelerating BERT on the Tensor Streaming Processor22 Jun 2022 0 repositories listed
-
Supervision-Guided Codebooks for Masked Prediction in Speech Pre-training21 Jun 2022 0 repositories listed