Browse State-of-the-Art › speech-recognition › Papers, page 40
speech-recognition
Papers archive 2025-07-28
archive papers tagged: 5,715 · with a code link: 1,277 · where Syntology ran a sample: 162 (134 with a run with no instrument failure, 28 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (162 of 5,715 tagged: 134 with a run with no instrument failure, 28 where every run was a failure of Syntology's instrument)
Page 40 of 58: papers 3,901 to 4,000 of 5,715, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Leveraging Acoustic and Linguistic Embeddings from Pretrained speech and language Models for Intent Classification15 Feb 2021 0 repositories listed
-
Personalization Strategies for End-to-End Speech Recognition Systems15 Feb 2021 0 repositories listed
-
Robust Classification using Hidden Markov Models and Mixtures of Normalizing Flows15 Feb 2021 0 repositories listed
-
Thank you for Attention: A survey on Attention-based Artificial Neural Networks for Automatic Speech Recognition14 Feb 2021 0 repositories listed
-
Bi-APC: Bidirectional Autoregressive Predictive Coding for Unsupervised Pre-training and Its Application to Children's ASR12 Feb 2021 0 repositories listed
-
Content-Aware Speaker Embeddings for Speaker Diarisation12 Feb 2021 0 repositories listed
-
Do as I mean, not as I say: Sequence Loss Training for Spoken Language Understanding12 Feb 2021 0 repositories listed
-
Multimodal Punctuation Prediction with Contextual Dropout12 Feb 2021 0 repositories listed
-
Fast Classification Learning with Neural Networks and Conceptors for Speech Recognition and Car Driving Maneuvers10 Feb 2021 0 repositories listed
-
Fused Acoustic and Text Encoding for Multimodal Bilingual Pretraining and Speech Translation10 Feb 2021 0 repositories listed
-
NUVA: A Naming Utterance Verifier for Aphasia Treatment10 Feb 2021 0 repositories listed
-
Bayesian Transformer Language Models for Speech Recognition9 Feb 2021 0 repositories listed
-
Sparsification via Compressed Sensing for Automatic Speech Recognition9 Feb 2021 0 repositories listed
-
Train your classifier first: Cascade Neural Networks Training from upper layers to lower layers9 Feb 2021 0 repositories listed
-
End-to-End Multi-Channel Transformer for Speech Recognition8 Feb 2021 0 repositories listed
-
Time-Domain Speech Extraction with Spatial Information and Multi Speaker Conditioning Mechanism7 Feb 2021 0 repositories listed
-
A bandit approach to curriculum generation for automatic speech recognition6 Feb 2021 0 repositories listed
-
Intermediate Loss Regularization for CTC-based Speech Recognition5 Feb 2021 0 repositories listed
-
Multi-Task Self-Supervised Pre-Training for Music Classification5 Feb 2021 0 repositories listed
-
Two-Stage Augmentation and Adaptive CTC Fusion for Improved Robustness of Multi-Stream End-to-End ASR5 Feb 2021 0 repositories listed
-
Effects of Number of Filters of Convolutional Layers on Speech Recognition Model Accuracy3 Feb 2021 0 repositories listed
-
General-Purpose Speech Representation Learning through a Self-Supervised Multi-Granularity Framework3 Feb 2021 0 repositories listed
-
Internal Language Model Training for Domain-Adaptive End-to-End Speech Recognition2 Feb 2021 0 repositories listed
-
The Multilingual TEDx Corpus for Speech Recognition and Translation2 Feb 2021 0 repositories listed
-
On Scaling Contrastive Representations for Low-Resource Speech Recognition1 Feb 2021 0 repositories listed
-
Robust Attack Detection Approach for IIoT Using Ensemble Classifier30 Jan 2021 0 repositories listed
-
Speech Recognition by Simply Fine-tuning BERT30 Jan 2021 0 repositories listed
-
BCN2BRNO: ASR System Fusion for Albayzin 2020 Speech to Text Challenge29 Jan 2021 0 repositories listed
-
Bounds on mutual information of mixture data for classification tasks27 Jan 2021 0 repositories listed
-
Transformer Based Deliberation for Two-Pass Speech Recognition27 Jan 2021 0 repositories listed
-
Leveraging End-to-End ASR for Endangered Language Documentation: An Empirical Study on Yoloxóchitl Mixtec26 Jan 2021 0 repositories listed
-
A Review of Speaker Diarization: Recent Advances with Deep Learning24 Jan 2021 0 repositories listed
-
Exploiting Beam Search Confidence for Energy-Efficient Speech Recognition22 Jan 2021 0 repositories listed
-
Streaming Models for Joint Speech Recognition and Translation22 Jan 2021 0 repositories listed
-
Noisy-target Training: A Training Strategy for DNN-based Speech Enhancement without Clean Speech21 Jan 2021 0 repositories listed
-
VOTE400(Voide Of The Elderly 400 Hours): A Speech Dataset to Study Voice Interface for Elderly-Care20 Jan 2021 0 repositories listed
-
Efficiently Fusing Pretrained Acoustic and Linguistic Encoders for Low-resource Speech Recognition17 Jan 2021 0 repositories listed
-
An evaluation of word-level confidence estimation for end-to-end automatic speech recognition14 Jan 2021 0 repositories listed
-
Fast offline Transformer-based end-to-end automatic speech recognition for real-world applications14 Jan 2021 0 repositories listed
-
WER-BERT: Automatic WER Estimation with BERT in a Balanced Ordinal Classification Paradigm14 Jan 2021 0 repositories listed
-
BRDS: An FPGA-based LSTM Accelerator with Row-Balanced Dual-Ratio Sparsification7 Jan 2021 0 repositories listed
-
Hypothesis Stitcher for End-to-End Speaker-attributed ASR on Long-form Multi-talker Recordings6 Jan 2021 0 repositories listed
-
Domain-aware Neural Language Models for Speech Recognition5 Jan 2021 0 repositories listed
-
HMM-based phoneme speech recognition system for the control and command of industrial robots1 Jan 2021 0 repositories listed
-
Learning Monotonic Alignments with Source-Aware GMM Attention1 Jan 2021 0 repositories listed
-
Learning without Forgetting: Task Aware Multitask Learning for Multi-Modality Tasks1 Jan 2021 0 repositories listed
-
NAS-Bench-ASR: Reproducible Neural Architecture Search for Speech Recognition1 Jan 2021 0 repositories listed
-
Sparsifying Networks via Subdifferential Inclusion1 Jan 2021 0 repositories listed
-
The simpler the better: vanilla sgd revisited1 Jan 2021 0 repositories listed
-
Uncertain Out-of-Domain Generalization1 Jan 2021 0 repositories listed
-
Why Does Decentralized Training Outperform Synchronous Training In The Large Batch Setting?1 Jan 2021 0 repositories listed
-
Multi-channel Multi-frame ADL-MVDR for Target Speech Separation24 Dec 2020 0 repositories listed
-
Speech Synthesis as Augmentation for Low-Resource ASR23 Dec 2020 0 repositories listed
-
A Hierarchical Reasoning Graph Neural Network for The Automatic Scoring of Answer Transcriptions in Video Job Interviews22 Dec 2020 0 repositories listed
-
Adversarial Meta Sampling for Multilingual Low-Resource Speech Recognition22 Dec 2020 0 repositories listed
-
Applying Wav2vec2.0 to Speech Recognition in Various Low-resource Languages22 Dec 2020 0 repositories listed
-
Limitations of Deep Neural Networks: a discussion of G. Marcus' critical appraisal of deep learning22 Dec 2020 0 repositories listed
-
Adjust-free adversarial example generation in speech recognition using evolutionary multi-objective optimization under black-box condition21 Dec 2020 0 repositories listed
-
Neural Methods for Effective, Efficient, and Exposure-Aware Information Retrieval21 Dec 2020 0 repositories listed
-
Toward Streaming ASR with Non-Autoregressive Insertion-based Model18 Dec 2020 0 repositories listed
-
CIF-based Collaborative Decoding for End-to-end Contextual Speech Recognition17 Dec 2020 0 repositories listed
-
15 Dec 2020 0 repositories listed
-
User-friendly automatic transcription of low-resource languages: Plugging ESPnet into Elpis15 Dec 2020 0 repositories listed
-
A review of on-device fully neural end-to-end automatic speech recognition algorithms14 Dec 2020 0 repositories listed
-
14 Dec 2020 0 repositories listed
-
Less Is More: Improved RNN-T Decoding Using Limited Label Context and Path Merging12 Dec 2020 0 repositories listed
-
Exploring wav2vec 2.0 on speaker verification and language identification11 Dec 2020 0 repositories listed
-
Improved Robustness to Disfluencies in RNN-Transducer Based Speech Recognition11 Dec 2020 0 repositories listed
-
Next Wave Artificial Intelligence: Robust, Explainable, Adaptable, Ethical, and Accountable11 Dec 2020 0 repositories listed
-
Multi-Classifier Interactive Learning for Ambiguous Speech Emotion Recognition10 Dec 2020 0 repositories listed
-
Speech Recognition for Endangered and Extinct Samoyedic languages9 Dec 2020 0 repositories listed
-
Bayesian Learning of LF-MMI Trained Time Delay Neural Networks for Speech Recognition8 Dec 2020 0 repositories listed
-
Using multiple ASR hypotheses to boost i18n NLU performance7 Dec 2020 0 repositories listed
-
Adapt-and-Adjust: Overcoming the Long-Tail Problem of Multilingual Speech Recognition3 Dec 2020 0 repositories listed
-
1 Dec 2020 0 repositories listed
-
ASR for Non-standardised Languages with Dialectal Variation: the case of Swiss German1 Dec 2020 0 repositories listed
-
Development of Hybrid Algorithm for Automatic Extraction of Multiword Expressions from Monolingual and Parallel Corpus of English and Punjabi1 Dec 2020 0 repositories listed
-
Federated Marginal Personalization for ASR Rescoring1 Dec 2020 0 repositories listed
-
German-Arabic Speech-to-Speech Translation for Psychiatric Diagnosis1 Dec 2020 0 repositories listed
-
Multi-task Learning of Spoken Language Understanding by Integrating N-Best Hypotheses with Hierarchical Attention1 Dec 2020 0 repositories listed
-
On-Device detection of sentence completion for voice assistants with low-memory footprint1 Dec 2020 0 repositories listed
-
Sparse Transcription1 Dec 2020 0 repositories listed
-
Supervised Adaptation of Sequence-to-Sequence Speech Recognition Systems using Batch-Weighting1 Dec 2020 0 repositories listed
-
The Indigenous Languages Technology project at NRC Canada: An empowerment-oriented approach to developing language software1 Dec 2020 0 repositories listed
-
Improving accuracy of rare words for RNN-Transducer through unigram shallow fusion30 Nov 2020 0 repositories listed
-
Multi-Modal Detection of Alzheimer's Disease from Speech and Text30 Nov 2020 0 repositories listed
-
Transformer-Transducers for Code-Switched Speech Recognition30 Nov 2020 0 repositories listed
-
Streaming end-to-end multi-talker speech recognition26 Nov 2020 0 repositories listed
-
Unsupervised Domain Adaptation for Speech Recognition via Uncertainty Driven Self-Training26 Nov 2020 0 repositories listed
-
A Panoramic Survey of Natural Language Processing in the Arab World25 Nov 2020 0 repositories listed
-
Bootstrap an end-to-end ASR system by multilingual training, transfer learning, text-to-text mapping and synthetic audio25 Nov 2020 0 repositories listed
-
A Review of Recent Advances of Binary Neural Networks for Edge Computing24 Nov 2020 0 repositories listed
-
Adam^+: A Stochastic Method with Adaptive Variance Reduction24 Nov 2020 0 repositories listed
-
Synth2Aug: Cross-domain speaker recognition with TTS synthesized speech24 Nov 2020 0 repositories listed
-
Multi-task Language Modeling for Improving Speech Recognition of Rare Words23 Nov 2020 0 repositories listed
-
Streaming Multi-speaker ASR with RNN-T23 Nov 2020 0 repositories listed
-
Using Synthetic Audio to Improve The Recognition of Out-Of-Vocabulary Words in End-To-End ASR Systems23 Nov 2020 0 repositories listed
-
Deep Learning in EEG: Advance of the Last Ten-Year Critical Period22 Nov 2020 0 repositories listed
-
Improving RNN-T ASR Accuracy Using Context Audio20 Nov 2020 0 repositories listed
-
TaL: a synchronised multi-speaker corpus of ultrasound tongue imaging, audio, and lip videos19 Nov 2020 0 repositories listed