Browse State-of-the-Art › speech-recognition › Papers, page 28
speech-recognition
Papers archive 2025-07-28
archive papers tagged: 5,715 · with a code link: 1,277 · where Syntology ran a sample: 162 (134 with a run with no instrument failure, 28 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (162 of 5,715 tagged: 134 with a run with no instrument failure, 28 where every run was a failure of Syntology's instrument)
Page 28 of 58: papers 2,701 to 2,800 of 5,715, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Context-aware Fine-tuning of Self-supervised Speech Models16 Dec 2022 0 repositories listed
-
Fast Entropy-Based Methods of Word-Level Confidence Estimation for End-To-End Automatic Speech Recognition16 Dec 2022 0 repositories listed
-
Speech Aware Dialog System Technology Challenge (DSTC11)16 Dec 2022 0 repositories listed
-
Improving Fast-slow Encoder based Transducer with Streaming Deliberation15 Dec 2022 0 repositories listed
-
Disentangling Prosody Representations with Unsupervised Speech Reconstruction14 Dec 2022 0 repositories listed
-
Speech and Natural Language Processing Technologies for Pseudo-Pilot Simulator14 Dec 2022 0 repositories listed
-
Tackling the Cocktail Fork Problem for Separation and Transcription of Real-World Soundtracks14 Dec 2022 0 repositories listed
-
End-to-End Speech Translation of Arabic to English Broadcast News11 Dec 2022 0 repositories listed
-
Leveraging Modality-specific Representations for Audio-visual Speech Recognition via Reinforcement Learning10 Dec 2022 0 repositories listed
-
Improved Self-Supervised Multilingual Speech Representation Learning Combined with Auxiliary Language Information7 Dec 2022 0 repositories listed
-
Improved Speech Pre-Training with Supervision-Enhanced Acoustic Unit7 Dec 2022 0 repositories listed
-
Lattice-Free Sequence Discriminative Training for Phoneme-Based Neural Transducers7 Dec 2022 0 repositories listed
-
Progressive Multi-Scale Self-Supervised Learning for Speech Recognition7 Dec 2022 0 repositories listed
-
Fast and accurate factorized neural transducer for text adaption of end-to-end speech recognition models5 Dec 2022 0 repositories listed
-
Unsupervised Fine-Tuning Data Selection for ASR Using Self-Supervised Speech Models3 Dec 2022 0 repositories listed
-
Continual Learning for On-Device Speech Recognition using Disentangled Conformers2 Dec 2022 0 repositories listed
-
Cross-Modal Mutual Learning for Cued Speech Recognition2 Dec 2022 0 repositories listed
-
Fuse and Adapt: Investigating the Use of Pre-Trained Self-Supervising Learning Models in Limited Data NLU problems2 Dec 2022 0 repositories listed
-
Gated Recurrent Neural Networks with Weighted Time-Delay Feedback1 Dec 2022 0 repositories listed
-
Surrogate Gradient Spiking Neural Networks as Encoders for Large Vocabulary Continuous Speech Recognition1 Dec 2022 0 repositories listed
-
Preliminary Study on SSCF-derived Polar Coordinate for ASR30 Nov 2022 0 repositories listed
-
Better Transcription of UK Supreme Court Hearings29 Nov 2022 0 repositories listed
-
Evaluating and reducing the distance between synthetic and real speech distributions29 Nov 2022 0 repositories listed
-
Neural Transducer Training: Reduced Memory Consumption with Sample-wise Computation29 Nov 2022 0 repositories listed
-
Handling and extracting key entities from customer conversations using Speech recognition and Named Entity recognition28 Nov 2022 0 repositories listed
-
Inter-KD: Intermediate Knowledge Distillation for CTC-Based Automatic Speech Recognition28 Nov 2022 0 repositories listed
-
Bidirectional Representations for Low Resource Spoken Language Understanding24 Nov 2022 0 repositories listed
-
Improving Multi-task Learning via Seeking Task-based Flat Regions24 Nov 2022 0 repositories listed
-
Multitask Learning for Low Resource Spoken Language Understanding24 Nov 2022 0 repositories listed
-
Device Directedness with Contextual Cues for Spoken Dialog Systems23 Nov 2022 0 repositories listed
-
22 Nov 2022 0 repositories listed
-
Complex-Valued Time-Frequency Self-Attention for Speech Dereverberation22 Nov 2022 0 repositories listed
-
Constructing Effective Machine Learning Models for the Sciences: A Multidisciplinary Perspective21 Nov 2022 0 repositories listed
-
Towards continually learning new languages21 Nov 2022 0 repositories listed
-
SSCFormer: Push the Limit of Chunk-wise Conformer for Streaming ASR Using Sequentially Sampled Chunks and Chunked Causal Convolution21 Nov 2022 0 repositories listed
-
SpeechNet: Weakly Supervised, End-to-End Speech Recognition at Industrial Scale21 Nov 2022 0 repositories listed
-
VATLM: Visual-Audio-Text Pre-Training with Unified Masked Prediction for Speech Representation Learning21 Nov 2022 0 repositories listed
-
Exploring WavLM on Speech Enhancement18 Nov 2022 0 repositories listed
-
Hey ASR System! Why Aren't You More Inclusive? Automatic Speech Recognition Systems' Bias and Proposed Bias Mitigation Techniques. A Literature Review17 Nov 2022 0 repositories listed
-
LongFNT: Long-form Speech Recognition with Factorized Neural Transducer17 Nov 2022 0 repositories listed
-
Unsupervised Model-based speaker adaptation of end-to-end lattice-free MMI model for speech recognition17 Nov 2022 0 repositories listed
-
Improving Speech Emotion Recognition with Unsupervised Speaking Style Transfer16 Nov 2022 0 repositories listed
-
L2 proficiency assessment using self-supervised speech representations16 Nov 2022 0 repositories listed
-
On using the UA-Speech and TORGO databases to validate automatic dysarthric speech classification approaches16 Nov 2022 0 repositories listed
-
Improved disentangled speech representations using contrastive learning in factorized hierarchical variational autoencoder15 Nov 2022 0 repositories listed
-
Introducing Semantics into Speech Encoders15 Nov 2022 0 repositories listed
-
FullPack: Full Vector Utilization for Sub-Byte Quantized Inference on General Purpose CPUs13 Nov 2022 0 repositories listed
-
Align, Write, Re-order: Explainable End-to-End Speech Translation via Operation Sequence Generation11 Nov 2022 0 repositories listed
-
An Adapter based Multi-label Pre-training for Speech Separation and Enhancement11 Nov 2022 0 repositories listed
-
Handling Trade-Offs in Speech Separation with Sparsely-Gated Mixture of Experts11 Nov 2022 0 repositories listed
-
Continuous Soft Pseudo-Labeling in ASR11 Nov 2022 0 repositories listed
-
A Study on the Integration of Pre-trained SSL, ASR, LM and SLU Models for Spoken Language Understanding10 Nov 2022 0 repositories listed
-
Self-supervised learning with bi-label masked speech prediction for streaming multi-talker speech recognition10 Nov 2022 0 repositories listed
-
Adaptive Multi-Corpora Language Model Training for Speech Recognition9 Nov 2022 0 repositories listed
-
Improving Noisy Student Training on Non-target Domain Data for Automatic Speech Recognition9 Nov 2022 0 repositories listed
-
8 Nov 2022 0 repositories listed
-
End-to-End Evaluation of a Spoken Dialogue System for Learning Basic Mathematics7 Nov 2022 0 repositories listed
-
Streaming, fast and accurate on-device Inverse Text Normalization for Automatic Speech Recognition7 Nov 2022 0 repositories listed
-
Bridging Speech and Textual Pre-trained Models with Unsupervised ASR6 Nov 2022 0 repositories listed
-
Evaluation of Automated Speech Recognition Systems for Conversational Speech: A Linguistic Perspective5 Nov 2022 0 repositories listed
-
LAMASSU: Streaming Language-Agnostic Multilingual Speech Recognition and Translation Using Neural Transducers5 Nov 2022 0 repositories listed
-
A Weakly-Supervised Streaming Multilingual Speech Model with Truly Zero-Shot Capability4 Nov 2022 0 repositories listed
-
Biased Self-supervised learning for ASR4 Nov 2022 0 repositories listed
-
Minimum Latency Training of Sequence Transducers for Streaming End-to-End Speech Recognition4 Nov 2022 0 repositories listed
-
Resource-Efficient Transfer Learning From Speech Foundation Model Using Hierarchical Feature Fusion4 Nov 2022 0 repositories listed
-
Stutter-TTS: Controlled Synthesis and Improved Recognition of Stuttered Speech4 Nov 2022 0 repositories listed
-
Adversarial Data Augmentation Using VAE-GAN for Disordered Speech Recognition3 Nov 2022 0 repositories listed
-
H_eval: A new hybrid evaluation metric for automatic speech recognition tasks3 Nov 2022 0 repositories listed
-
Leveraging Domain Features for Detecting Adversarial Attacks Against Deep Speech Recognition in Noise3 Nov 2022 0 repositories listed
-
Phonetic-assisted Multi-Target Units Modeling for Improving Conformer-Transducer ASR system3 Nov 2022 0 repositories listed
-
Probing Statistical Representations For End-To-End ASR3 Nov 2022 0 repositories listed
-
Streaming Audio-Visual Speech Recognition with Alignment Regularization3 Nov 2022 0 repositories listed
-
BECTRA: Transducer-based End-to-End ASR with BERT-Enhanced Encoder2 Nov 2022 0 repositories listed
-
Improving Named Entity Recognition in Telephone Conversations via Effective Active Learning with Human in the Loop2 Nov 2022 0 repositories listed
-
Monolingual Recognizers Fusion for Code-switching Speech Recognition2 Nov 2022 0 repositories listed
-
More Speaking or More Speakers?2 Nov 2022 0 repositories listed
-
Towards Zero-Shot Code-Switched Speech Recognition2 Nov 2022 0 repositories listed
-
Variable Attention Masking for Configurable Transformer Transducer Speech Recognition2 Nov 2022 0 repositories listed
-
A Comparative Study on Multichannel Speaker-Attributed Automatic Speech Recognition in Multi-party Meetings1 Nov 2022 0 repositories listed
-
A Preliminary Study on Automated Speaking Assessment of English as a Second Language (ESL) Students1 Nov 2022 0 repositories listed
-
Adapting self-supervised models to multi-talker speech recognition using speaker embeddings1 Nov 2022 0 repositories listed
-
Avoid Overthinking in Self-Supervised Models for Speech Recognition1 Nov 2022 0 repositories listed
-
Mandarin-English Code-Switching Speech Recognition System for Specific Domain1 Nov 2022 0 repositories listed
-
Unified End-to-End Speech Recognition and Endpointing for Fast and Efficient Speech Systems1 Nov 2022 0 repositories listed
-
An analysis of degenerating speech due to progressive dysarthria on ASR performance31 Oct 2022 0 repositories listed
-
Audio-Visual Speech Enhancement and Separation by Utilizing Multi-Modal Self-Supervised Embeddings31 Oct 2022 0 repositories listed
-
DiaCorrect: End-to-end error correction for speaker diarization31 Oct 2022 0 repositories listed
-
FusionFormer: Fusing Operations in Transformer for Efficient Streaming Speech Recognition31 Oct 2022 0 repositories listed
-
Joint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition31 Oct 2022 0 repositories listed
-
Modular Hybrid Autoregressive Transducer31 Oct 2022 0 repositories listed
-
Structured State Space Decoder for Speech Recognition and Synthesis31 Oct 2022 0 repositories listed
-
DuDe: Dual-Decoder Multilingual ASR for Indian Languages using Common Label Set30 Oct 2022 0 repositories listed
-
Application of Knowledge Distillation to Multi-task Speech Representation Learning29 Oct 2022 0 repositories listed
-
BERT Meets CTC: New Formulation of End-to-End Speech Recognition with Pre-trained Masked Language Model29 Oct 2022 0 repositories listed
-
Phonemic Representation and Transcription for Speech to Text Applications for Under-resourced Indigenous African Languages: The Case of Kiswahili29 Oct 2022 0 repositories listed
-
XNOR-FORMER: Learning Accurate Approximations in Long Speech Transformers29 Oct 2022 0 repositories listed
-
Dysfluencies Seldom Come Alone -- Detection as a Multi-Label Problem28 Oct 2022 0 repositories listed
-
Filter and evolve: progressive pseudo label refining for semi-supervised automatic speech recognition28 Oct 2022 0 repositories listed
-
Random Utterance Concatenation Based Data Augmentation for Improving Short-video Speech Recognition28 Oct 2022 0 repositories listed
-
Contextual-Utterance Training for Automatic Speech Recognition27 Oct 2022 0 repositories listed