Browse State-of-the-Art › Automatic Speech Recognition (ASR) › Papers, page 17
Automatic Speech Recognition (ASR)
Papers archive 2025-07-28
archive papers tagged: 3,012 · with a code link: 622 · where Syntology ran a sample: 77 (64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (77 of 3,012 tagged: 64 with a run with no instrument failure, 13 where every run was a failure of Syntology's instrument)
Page 17 of 31: papers 1,601 to 1,700 of 3,012, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
JHU IWSLT 2022 Dialect Speech Translation System Description1 May 2022 0 repositories listed
-
MTL-SLT: Multi-Task Learning for Spoken Language Tasks1 May 2022 0 repositories listed
-
NVIDIA NeMo Offline Speech Translation Systems for IWSLT 20221 May 2022 0 repositories listed
-
Phoneme transcription of endangered languages: an evaluation of recent ASR architectures in the single speaker scenario1 May 2022 0 repositories listed
-
SSNCSE_NLP@LT-EDI-ACL2022: Speech Recognition for Vulnerable Individuals in Tamil using pre-trained XLSR models1 May 2022 0 repositories listed
-
SUH_ASR@LT-EDI-ACL2022: Transformer based Approach for Speech Recognition for Vulnerable Individuals in Tamil1 May 2022 0 repositories listed
-
The HW-TSC’s Offline Speech Translation System for IWSLT 2022 Evaluation1 May 2022 0 repositories listed
-
The Xiaomi Text-to-Text Simultaneous Speech Translation System for IWSLT 20221 May 2022 0 repositories listed
-
Mask scalar prediction for improving robust automatic speech recognition26 Apr 2022 0 repositories listed
-
Cleanformer: A multichannel array configuration-invariant neural enhancement frontend for ASR in smart speakers25 Apr 2022 0 repositories listed
-
Improved far-field speech recognition using Joint Variational Autoencoder24 Apr 2022 0 repositories listed
-
WaBERT: A Low-resource End-to-end Model for Spoken Language Understanding and Speech-to-BERT Alignment22 Apr 2022 0 repositories listed
-
An Investigation of Monotonic Transducers for Large-Scale Automatic Speech Recognition19 Apr 2022 0 repositories listed
-
Blockwise Streaming Transformer for Spoken Language Understanding and Simultaneous Speech Translation19 Apr 2022 0 repositories listed
-
Disappeared Command: Spoofing Attack On Automatic Speech Recognition Systems with Sound Masking19 Apr 2022 0 repositories listed
-
Automated speech tools for helping communities process restricted-access corpora for language revival efforts15 Apr 2022 0 repositories listed
-
Lombard Effect for Bilingual Speakers in Cantonese and English: importance of spectro-temporal features14 Apr 2022 0 repositories listed
-
A Unified Cascaded Encoder ASR Model for Dynamic Model Sizes13 Apr 2022 0 repositories listed
-
Self-critical Sequence Training for Automatic Speech Recognition13 Apr 2022 0 repositories listed
-
Study of Indian English Pronunciation Variabilities relative to Received Pronunciation13 Apr 2022 0 repositories listed
-
ASR in German: A Detailed Error Analysis12 Apr 2022 0 repositories listed
-
Building an ASR Error Robust Spoken Virtual Patient System in a Highly Class-Imbalanced Scenario Without Speech Data11 Apr 2022 0 repositories listed
-
Auditory-Based Data Augmentation for End-to-End Automatic Speech Recognition8 Apr 2022 0 repositories listed
-
Defense against Adversarial Attacks on Hybrid Speech Recognition using Joint Adversarial Fine-tuning with Denoiser8 Apr 2022 0 repositories listed
-
Three-Module Modeling For End-to-End Spoken Language Understanding Using Pre-trained DNN-HMM-Based Acoustic-Phonetic Model7 Apr 2022 0 repositories listed
-
A Wav2vec2-Based Experimental Study on Self-Supervised Learning Methods to Improve Child Speech Recognition6 Apr 2022 0 repositories listed
-
Enhanced Direct Speech-to-Speech Translation Using Self-supervised Pre-training and Data Augmentation6 Apr 2022 0 repositories listed
-
A Complementary Joint Training Approach Using Unpaired Speech and Text for Low-Resource Automatic Speech Recognition5 Apr 2022 0 repositories listed
-
Audio-visual multi-channel speech separation, dereverberation and recognition5 Apr 2022 0 repositories listed
-
Hear No Evil: Towards Adversarial Robustness of Automatic Speech Recognition via Multi-Task Learning5 Apr 2022 0 repositories listed
-
Unsupervised Data Selection via Discrete Speech Representation for ASR5 Apr 2022 0 repositories listed
-
A Study of Gender Impact in Self-supervised Models for Speech-to-Text Systems4 Apr 2022 0 repositories listed
-
An Analysis of Semantically-Aligned Speech-Text Embeddings4 Apr 2022 0 repositories listed
-
Cross-lingual Self-Supervised Speech Representations for Improved Dysarthric Speech Recognition4 Apr 2022 0 repositories listed
-
Deliberation Model for On-Device Spoken Language Understanding4 Apr 2022 0 repositories listed
-
End-to-end model for named entity recognition from speech without paired training data2 Apr 2022 0 repositories listed
-
Fast Real-time Personalized Speech Enhancement: End-to-End Enhancement Network (E3Net) and Knowledge Distillation2 Apr 2022 0 repositories listed
-
End-to-End Integration of Speech Recognition, Speech Enhancement, and Self-Supervised Learning Representation1 Apr 2022 0 repositories listed
-
End-to-End Multi-speaker ASR with Independent Vector Analysis1 Apr 2022 0 repositories listed
-
Alternate Intermediate Conditioning with Syllable-level and Character-level Targets for Japanese ASR1 Apr 2022 0 repositories listed
-
Multi-task RNN-T with Semantic Decoder for Streamable Spoken Language Understanding1 Apr 2022 0 repositories listed
-
Probing Speech Emotion Recognition Transformers for Linguistic Knowledge1 Apr 2022 0 repositories listed
-
Text-To-Speech Data Augmentation for Low Resource Speech Recognition1 Apr 2022 0 repositories listed
-
Zero-Shot Cross-lingual Aphasia Detection using Automatic Speech Recognition1 Apr 2022 0 repositories listed
-
A Comparative Study on Speaker-attributed Automatic Speech Recognition in Multi-party Meetings31 Mar 2022 0 repositories listed
-
Analyzing the factors affecting usefulness of Self-Supervised Pre-trained Representations for Speech Recognition31 Mar 2022 0 repositories listed
-
Effectiveness of text to speech pseudo labels for forced alignment and cross lingual pretrained models for low resource speech recognition31 Mar 2022 0 repositories listed
-
Importance of Different Temporal Modulations of Speech: A Tale of Two Perspectives31 Mar 2022 0 repositories listed
-
Memory-Efficient Training of RNN-Transducer with Sampled Softmax31 Mar 2022 0 repositories listed
-
31 Mar 2022 0 repositories listed
-
Code Switched and Code Mixed Speech Recognition for Indic languages30 Mar 2022 0 repositories listed
-
Federated Domain Adaptation for ASR with Full Self-Supervision30 Mar 2022 0 repositories listed
-
Improving Speech Recognition for Indic Languages using Language Model30 Mar 2022 0 repositories listed
-
Is Word Error Rate a good evaluation metric for Speech Recognition in Indic Languages?30 Mar 2022 0 repositories listed
-
Dynamic Latency for CTC-Based Streaming Automatic Speech Recognition With Emformer29 Mar 2022 0 repositories listed
-
Frequency-Directional Attention Model for Multilingual Automatic Speech Recognition29 Mar 2022 0 repositories listed
-
Improving Generalization of Deep Neural Network Acoustic Models with Length Perturbation and N-best Based Label Smoothing29 Mar 2022 0 repositories listed
-
Mel Frequency Spectral Domain Defenses against Adversarial Attacks on Speech Recognition Systems29 Mar 2022 0 repositories listed
-
Short-Term Word-Learning in a Dynamically Changing Environment29 Mar 2022 0 repositories listed
-
Impact of Dataset on Acoustic Models for Automatic Speech Recognition25 Mar 2022 0 repositories listed
-
Computing Optimal Location of Microphone for Improved Speech Recognition24 Mar 2022 0 repositories listed
-
Disentangleing Content and Fine-grained Prosody Information via Hybrid ASR Bottleneck Features for Voice Conversion24 Mar 2022 0 repositories listed
-
Lahjoita puhetta -- a large-scale corpus of spoken Finnish with some benchmarks24 Mar 2022 0 repositories listed
-
A Text-to-Speech Pipeline, Evaluation Methodology, and Initial Fine-Tuning Results for Child Speech Synthesis22 Mar 2022 0 repositories listed
-
Building Robust Spoken Language Understanding by Cross Attention between Phoneme Sequence and ASR Hypothesis22 Mar 2022 0 repositories listed
-
Pseudo Label Is Better Than Human Label22 Mar 2022 0 repositories listed
-
Exploiting Cross Domain Acoustic-to-articulatory Inverted Features For Disordered Speech Recognition19 Mar 2022 0 repositories listed
-
Representative Subset Selection for Efficient Fine-Tuning in Self-Supervised Speech Recognition18 Mar 2022 0 repositories listed
-
Prediction of speech intelligibility with DNN-based performance measures17 Mar 2022 0 repositories listed
-
Whither the Priors for (Vocal) Interactivity?16 Mar 2022 0 repositories listed
-
Spectral Modification Based Data Augmentation For Improving End-to-End ASR For Children's Speech13 Mar 2022 0 repositories listed
-
Transformer-based Streaming ASR with Cumulative Attention11 Mar 2022 0 repositories listed
-
Attacks as Defenses: Designing Robust Audio CAPTCHAs Using Attacks on Automatic Speech Recognition Systems10 Mar 2022 0 repositories listed
-
A practical framework for multi-domain speech recognition and an instance sampling method to neural language modeling9 Mar 2022 0 repositories listed
-
Which French speech recognition system for assistant robots?4 Mar 2022 0 repositories listed
-
A Conformer Based Acoustic Model for Robust Automatic Speech Recognition1 Mar 2022 0 repositories listed
-
Extended Graph Temporal Classification for Multi-Speaker End-to-End ASR1 Mar 2022 0 repositories listed
-
Measuring the Impact of Individual Domain Factors in Self-Supervised Pre-Training1 Mar 2022 0 repositories listed
-
Integrating Text Inputs For Training and Adapting RNN Transducer ASR Models26 Feb 2022 0 repositories listed
-
A Survey of Multilingual Models for Automatic Speech Recognition25 Feb 2022 0 repositories listed
-
Language technology practitioners as language managers: arbitrating data bias and predictive bias in ASR25 Feb 2022 0 repositories listed
-
Ask2Mask: Guided Data Selection for Masked Speech Modeling24 Feb 2022 0 repositories listed
-
Towards Better Meta-Initialization with Task Augmentation for Kindergarten-aged Speech Recognition24 Feb 2022 0 repositories listed
-
Differentially Private Speaker Anonymization23 Feb 2022 0 repositories listed
-
Korean Tokenization for Beam Search Rescoring in Speech Recognition22 Feb 2022 0 repositories listed
-
VADOI:Voice-Activity-Detection Overlapping Inference For End-to-end Long-form Speech Recognition22 Feb 2022 0 repositories listed
-
r-G2P: Evaluating and Enhancing Robustness of Grapheme to Phoneme Conversion by Controlled noise introducing and Contextual information incorporation21 Feb 2022 0 repositories listed
-
Speaker Adaptation Using Spectro-Temporal Deep Features for Dysarthric and Elderly Speech Recognition21 Feb 2022 0 repositories listed
-
19 Feb 2022 0 repositories listed
-
Domain Adaptation of low-resource Target-Domain models using well-trained ASR Conformer Models18 Feb 2022 0 repositories listed
-
'Beach' to 'Bitch': Inadvertent Unsafe Transcription of Kids' Content on YouTube17 Feb 2022 0 repositories listed
-
Mitigating Closed-model Adversarial Examples with Bayesian Neural Modeling for Enhanced End-to-End Speech Recognition17 Feb 2022 0 repositories listed
-
MLP-ASR: Sequence-length agnostic all-MLP architectures for speech recognition17 Feb 2022 0 repositories listed
-
Conversational Speech Recognition By Learning Conversation-level Characteristics16 Feb 2022 0 repositories listed
-
Knowledge Transfer from Large-scale Pretrained Language Models to End-to-end Speech Recognizers16 Feb 2022 0 repositories listed
-
Multi-style Training for South African Call Centre Audio15 Feb 2022 0 repositories listed
-
Saving RNN Computations with a Neuron-Level Fuzzy Memoization Scheme14 Feb 2022 0 repositories listed
-
Multimodal Depression Classification Using Articulatory Coordination Features And Hierarchical Attention Based Text Embeddings13 Feb 2022 0 repositories listed
-
A two-step approach to leverage contextual data: speech recognition in air-traffic communications8 Feb 2022 0 repositories listed
-
Enhancing ASR for Stuttered Speech with Limited Data Using Detect and Pass8 Feb 2022 0 repositories listed