Browse State-of-the-Art › Automatic Speech Recognition › Papers, page 11
Automatic Speech Recognition
Papers archive 2025-07-28
archive papers tagged: 3,174 · with a code link: 677 · where Syntology ran a sample: 79 (62 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (79 of 3,174 tagged: 62 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 11 of 32: papers 1,001 to 1,100 of 3,174, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues26 Aug 2024 0 repositories listed
-
Research Advances and New Paradigms for Biology-inspired Spiking Neural Networks26 Aug 2024 0 repositories listed
-
Focused Discriminative Training For Streaming CTC-Trained Automatic Speech Recognition Models23 Aug 2024 0 repositories listed
-
Developing vocal system impaired patient-aimed voice quality assessment approach using ASR representation-included multiple features22 Aug 2024 0 repositories listed
-
The State of Commercial Automatic French Legal Speech Recognition Systems and their Impact on Court Reporters et al21 Aug 2024 0 repositories listed
-
Parameter-Efficient Transfer Learning under Federated Learning for Automatic Speech Recognition19 Aug 2024 0 repositories listed
-
Recording for Eyes, Not Echoing to Ears: Contextualized Spoken-to-Written Conversion of ASR Transcripts19 Aug 2024 0 repositories listed
-
Enhancing Large Language Model-based Speech Recognition by Contextualization for Rare and Ambiguous Words15 Aug 2024 0 repositories listed
-
DPSNN: Spiking Neural Network for Low-Latency Streaming Speech Enhancement14 Aug 2024 0 repositories listed
-
Style-Talker: Finetuning Audio Language Model and Style-Based Text-to-Speech Model for Fast Spoken Dialogue Generation13 Aug 2024 0 repositories listed
-
Audio Enhancement for Computer Audition -- An Iterative Training Paradigm Using Sample Importance12 Aug 2024 0 repositories listed
-
Enhancing Dialogue Speech Recognition with Robust Contextual Awareness via Noise Representation Learning12 Aug 2024 0 repositories listed
-
VQ-CTAP: Cross-Modal Fine-Grained Sequence Representation Learning for Speech Processing11 Aug 2024 0 repositories listed
-
Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text10 Aug 2024 0 repositories listed
-
7 Aug 2024 0 repositories listed
-
Self-Supervised Learning for Multi-Channel Neural Transducer6 Aug 2024 0 repositories listed
-
ASR-enhanced Multimodal Representation Learning for Cross-Domain Product Retrieval6 Aug 2024 0 repositories listed
-
StreamVoice+: Evolving into End-to-end Streaming Zero-shot Voice Conversion5 Aug 2024 0 repositories listed
-
Sentence-wise Speech Summarization: Task, Datasets, and End-to-End Modeling with LM Knowledge Distillation1 Aug 2024 0 repositories listed
-
Towards interfacing large language models with ASR systems using confidence measures and prompting31 Jul 2024 0 repositories listed
-
On the Problem of Text-To-Speech Model Selection for Synthetic Data Generation in Automatic Speech Recognition31 Jul 2024 0 repositories listed
-
Improving noisy student training for low-resource languages in End-to-End ASR using CycleGAN and inter-domain losses26 Jul 2024 0 repositories listed
-
Improving Domain-Specific ASR with LLM-Generated Contextual Descriptions25 Jul 2024 0 repositories listed
-
On the Effect of Purely Synthetic Training Data for Different Automatic Speech Recognition Architectures25 Jul 2024 0 repositories listed
-
A Comparative Analysis of Bilingual and Trilingual Wav2Vec Models for Automatic Speech Recognition in Multilingual Oral History Archives24 Jul 2024 0 repositories listed
-
Quantifying the Role of Textual Predictability in Automatic Speech Recognition23 Jul 2024 0 repositories listed
-
The CHiME-8 DASR Challenge for Generalizable and Array Agnostic Distant Automatic Speech Recognition and Diarization23 Jul 2024 0 repositories listed
-
Trading Devil Final: Backdoor attack via Stock market and Bayesian Optimization21 Jul 2024 0 repositories listed
-
Reexamining Racial Disparities in Automatic Speech Recognition Performance: The Role of Confounding by Provenance19 Jul 2024 0 repositories listed
-
Handling Numeric Expressions in Automatic Speech Recognition18 Jul 2024 0 repositories listed
-
A light-weight and efficient punctuation and word casing prediction model for on-device streaming ASR18 Jul 2024 0 repositories listed
-
Low-Resourced Speech Recognition for Iu Mien Language via Weakly-Supervised Phoneme-based Multilingual Pre-training18 Jul 2024 0 repositories listed
-
Robust ASR Error Correction with Conservative Data Filtering18 Jul 2024 0 repositories listed
-
Morphosyntactic Analysis for CHILDES17 Jul 2024 0 repositories listed
-
Beyond Binary: Multiclass Paraphasia Detection with Generative Pretrained Transformers and End-to-End Models16 Jul 2024 0 repositories listed
-
The VoicePrivacy 2022 Challenge: Progress and Perspectives in Voice Anonymisation16 Jul 2024 0 repositories listed
-
Leave No Knowledge Behind During Knowledge Distillation: Towards Practical and Effective Knowledge Distillation for Code-Switching ASR Using Realistic Data15 Jul 2024 0 repositories listed
-
Improving Neural Biasing for Contextual Speech Recognition by Early Context Injection and Text Perturbation14 Jul 2024 0 repositories listed
-
HebDB: a Weakly Supervised Dataset for Hebrew Speech Processing10 Jul 2024 0 repositories listed
-
Analyzing Speech Unit Selection for Textless Speech-to-Speech Translation8 Jul 2024 0 repositories listed
-
Homogeneous Speaker Features for On-the-Fly Dysarthric and Elderly Speaker Adaptation8 Jul 2024 0 repositories listed
-
LearnerVoice: A Dataset of Non-Native English Learners' Spontaneous Speech5 Jul 2024 0 repositories listed
-
Romanization Encoding For Multilingual ASR5 Jul 2024 0 repositories listed
-
5 Jul 2024 0 repositories listed
-
Semi-supervised Learning for Code-Switching ASR with Large Language Model Filter5 Jul 2024 0 repositories listed
-
Speculative Speech Recognition by Audio-Prefixed Low-Rank Adaptation of Language Models5 Jul 2024 0 repositories listed
-
XLSR-Transducer: Streaming ASR for Self-Supervised Pretrained Models5 Jul 2024 0 repositories listed
-
Improving Accented Speech Recognition using Data Augmentation based on Unsupervised Text-to-Speech Synthesis4 Jul 2024 0 repositories listed
-
Codec-ASR: Training Performant Automatic Speech Recognition Systems with Discrete Speech Representations3 Jul 2024 0 repositories listed
-
The USTC-NERCSLIP Systems for The ICMC-ASR Challenge2 Jul 2024 0 repositories listed
-
Error Correction by Paying Attention to Both Acoustic and Confidence References for Automatic Speech Recognition29 Jun 2024 0 repositories listed
-
Applying LLMs for Rescoring N-best ASR Hypotheses of Casual Conversations: Effects of Domain Adaptation and Context Carry-over27 Jun 2024 0 repositories listed
-
Tradition or Innovation: A Comparison of Modern ASR Methods for Forced Alignment27 Jun 2024 0 repositories listed
-
Automatic Speech Recognition for Hindi26 Jun 2024 0 repositories listed
-
Dynamic Data Pruning for Automatic Speech Recognition26 Jun 2024 0 repositories listed
-
MSR-86K: An Evolving, Multilingual Corpus with 86,300 Hours of Transcribed Audio for Speech Recognition Research26 Jun 2024 0 repositories listed
-
SC-MoE: Switch Conformer Mixture of Experts for Unified Streaming and Non-streaming Code-Switching ASR26 Jun 2024 0 repositories listed
-
Sequential Editing for Lifelong Training of Speech Recognition Models25 Jun 2024 0 repositories listed
-
Blending LLMs into Cascaded Speech Translation: KIT's Offline Speech Translation System for IWSLT 202424 Jun 2024 0 repositories listed
-
Contextualized End-to-end Automatic Speech Recognition with Intermediate Biasing Loss23 Jun 2024 0 repositories listed
-
Decoder-only Architecture for Streaming End-to-end Speech Recognition23 Jun 2024 0 repositories listed
-
Perception of Phonological Assimilation by Neural Speech Recognition Models21 Jun 2024 0 repositories listed
-
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices21 Jun 2024 0 repositories listed
-
An Adapter-Based Unified Model for Multiple Spoken Language Processing Tasks20 Jun 2024 0 repositories listed
-
Intelligent Interface: Enhancing Lecture Engagement with Didactic Activity Summaries20 Jun 2024 0 repositories listed
-
Joint vs Sequential Speaker-Role Detection and Automatic Speech Recognition for Air-traffic Control19 Jun 2024 0 repositories listed
-
ManWav: The First Manchu ASR Model19 Jun 2024 0 repositories listed
-
Finding Task-specific Subnetworks in Multi-task Spoken Language Understanding Model18 Jun 2024 0 repositories listed
-
Performant ASR Models for Medical Entities in Accented Speech18 Jun 2024 0 repositories listed
-
Transcribe, Align and Segment: Creating speech datasets for low-resource languages18 Jun 2024 0 repositories listed
-
Automatic Speech Recognition for Biomedical Data in Bengali Language16 Jun 2024 0 repositories listed
-
CoSTA: Code-Switched Speech Translation using Aligned Speech-Text Interleaving16 Jun 2024 0 repositories listed
-
Imperceptible Rhythm Backdoor Attacks: Exploring Rhythm Transformation for Embedding Undetectable Vulnerabilities on Speech Recognition16 Jun 2024 0 repositories listed
-
Large Language Models for Dysfluency Detection in Stuttered Speech16 Jun 2024 0 repositories listed
-
An efficient text augmentation approach for contextualized Mandarin speech recognition14 Jun 2024 0 repositories listed
-
Inclusive ASR for Disfluent Speech: Cascaded Large-Scale Self-Supervised Learning with Targeted Fine-Tuning and Data Augmentation14 Jun 2024 0 repositories listed
-
Learning Language Structures through Grounding14 Jun 2024 0 repositories listed
-
Optimizing Byte-level Representation for End-to-end ASR14 Jun 2024 0 repositories listed
-
ROAR: Reinforcing Original to Augmented Data Ratio Dynamics for Wav2Vec2.0 Based ASR14 Jun 2024 0 repositories listed
-
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment13 Jun 2024 0 repositories listed
-
Multi-Modal Retrieval For Large Language Model Based Speech Recognition13 Jun 2024 0 repositories listed
-
The Second DISPLACE Challenge : DIarization of SPeaker and LAnguage in Conversational Environments13 Jun 2024 0 repositories listed
-
Transcription-Free Fine-Tuning of Speech Separation Models for Noisy and Reverberant Multi-Speaker Automatic Speech Recognition13 Jun 2024 0 repositories listed
-
Audio-conditioned phonemic and prosodic annotation for building text-to-speech models from unlabeled speech data12 Jun 2024 0 repositories listed
-
Dual-Pipeline with Low-Rank Adaptation for New Language Integration in Multilingual ASR12 Jun 2024 0 repositories listed
-
DualVC 3: Leveraging Language Model Generated Pseudo Context for End-to-end Low Latency Streaming Voice Conversion12 Jun 2024 0 repositories listed
-
ML-SUPERB 2.0: Benchmarking Multilingual Speech Models Across Modeling Constraints, Languages, and Datasets12 Jun 2024 0 repositories listed
-
PRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understanding12 Jun 2024 0 repositories listed
-
Refining Self-Supervised Learnt Speech Representation using Brain Activations12 Jun 2024 0 repositories listed
-
Transformer-based Model for ASR N-Best Rescoring and Rewriting12 Jun 2024 0 repositories listed
-
AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection11 Jun 2024 0 repositories listed
-
Fast Context-Biasing for CTC and Transducer ASR models with CTC-based Word Spotter11 Jun 2024 0 repositories listed
-
Reading Miscue Detection in Primary School through Automatic Speech Recognition11 Jun 2024 0 repositories listed
-
Tag and correct: high precision post-editing approach to correction of speech recognition errors11 Jun 2024 0 repositories listed
-
ASTRA: Aligning Speech and Text Representations for Asr without Sampling10 Jun 2024 0 repositories listed
-
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations9 Jun 2024 0 repositories listed
-
LoRA-Whisper: Parameter-Efficient and Extensible Multilingual ASR7 Jun 2024 0 repositories listed
-
Pitch-Aware RNN-T for Mandarin Chinese Mispronunciation Detection and Diagnosis7 Jun 2024 0 repositories listed
-
Flexible Multichannel Speech Enhancement for Noise-Robust Frontend6 Jun 2024 0 repositories listed
-
Hypernetworks for Personalizing ASR to Atypical Speech6 Jun 2024 0 repositories listed