Browse State-of-the-Art › Speech Enhancement › Papers, page 6
Speech Enhancement
Papers archive 2025-07-28
archive papers tagged: 982 · with a code link: 280 · where Syntology ran a sample: 54 (45 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (54 of 982 tagged: 45 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument)
Page 6 of 10: papers 501 to 600 of 982, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Rep2wav: Noise Robust text-to-speech Using self-supervised representations28 Aug 2023 0 repositories listed
-
Exploiting Time-Frequency Conformers for Music Audio Enhancement24 Aug 2023 0 repositories listed
-
AdVerb: Visually Guided Audio Dereverberation23 Aug 2023 0 repositories listed
-
Convoifilter: A case study of doing cocktail party speech recognition22 Aug 2023 0 repositories listed
-
SpeechX: Neural Codec Language Model as a Versatile Speech Transformer14 Aug 2023 0 repositories listed
-
Target Speech Extraction with Conditional Diffusion Model8 Aug 2023 0 repositories listed
-
Efficient Monaural Speech Enhancement using Spectrum Attention Fusion4 Aug 2023 0 repositories listed
-
SAMbA: Speech enhancement with Asynchronous ad-hoc Microphone Arrays31 Jul 2023 0 repositories listed
-
PCNN: A Lightweight Parallel Conformer Neural Network for Efficient Monaural Speech Enhancement28 Jul 2023 0 repositories listed
-
Non Intrusive Intelligibility Predictor for Hearing Impaired Individuals using Self Supervised Speech Representations25 Jul 2023 0 repositories listed
-
SLMGAN: Exploiting Speech Language Model Representations for Unsupervised Zero-Shot Voice Conversion in GANs18 Jul 2023 0 repositories listed
-
Low bit rate binaural link for improved ultra low-latency low-complexity multichannel speech enhancement in Hearing Aids17 Jul 2023 0 repositories listed
-
Audio-Visual Speech Enhancement Using Self-supervised Learning to Improve Speech Intelligibility in Cochlear Implant Simulations15 Jul 2023 0 repositories listed
-
Audio-visual End-to-end Multi-channel Speech Separation, Dereverberation and Recognition6 Jul 2023 0 repositories listed
-
Multi-Loss Convolutional Network with Time-Frequency Attention for Speech Enhancement15 Jun 2023 0 repositories listed
-
Feature Normalization for Fine-tuning Self-Supervised Models in Speech Enhancement14 Jun 2023 0 repositories listed
-
Unsupervised speech enhancement with deep dynamical generative speech and noise models13 Jun 2023 0 repositories listed
-
Audio-Visual Speech Enhancement With Selective Off-Screen Speech Extraction10 Jun 2023 0 repositories listed
-
Efficient Encoder-Decoder and Dual-Path Conformer for Comprehensive Feature Learning in Speech Enhancement9 Jun 2023 0 repositories listed
-
Convolutional Recurrent Neural Network with Attention for 3D Speech Enhancement8 Jun 2023 0 repositories listed
-
EffCRN: An Efficient Convolutional Recurrent Network for High-Performance Speech Enhancement5 Jun 2023 0 repositories listed
-
On the Behavior of Intrusive and Non-intrusive Speech Enhancement Metrics in Predictive and Generative Settings5 Jun 2023 0 repositories listed
-
Influence of Lossy Speech Codecs on Hearing-aid, Binaural Sound Source Localisation using DNNs4 Jun 2023 0 repositories listed
-
Audio-Visual Speech Enhancement with Score-Based Generative Models2 Jun 2023 0 repositories listed
-
On Crowdsourcing-design with Comparison Category Rating for Evaluating Speech Enhancement Algorithms2 Jun 2023 0 repositories listed
-
Harmonic enhancement using learnable comb filter for light-weight full-band speech enhancement model1 Jun 2023 0 repositories listed
-
Downstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss24 May 2023 0 repositories listed
-
Incorporating Ultrasound Tongue Images for Audio-Visual Speech Enhancement through Knowledge Distillation24 May 2023 0 repositories listed
-
SE-Bridge: Speech Enhancement with Consistent Brownian Bridge23 May 2023 0 repositories listed
-
DCCRN-KWS: an audio bias based model for noise robust small-footprint keyword spotting21 May 2023 0 repositories listed
-
Diffusion-Based Speech Enhancement with Joint Generative and Predictive Decoders18 May 2023 0 repositories listed
-
Diffusion-based Signal Refiner for Speech Separation10 May 2023 0 repositories listed
-
All Information is Necessary: Integrating Speech Positive and Negative Information by Contrastive Learning for Speech Enhancement26 Apr 2023 0 repositories listed
-
Array Configuration-Agnostic Personal Voice Activity Detection Based on Spatial Coherence18 Apr 2023 0 repositories listed
-
Neural Speech Enhancement with Very Low Algorithmic Latency and Complexity via Integrated Full- and Sub-Band Modeling18 Apr 2023 0 repositories listed
-
The future of hearing aid technology13 Apr 2023 0 repositories listed
-
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR11 Apr 2023 0 repositories listed
-
Attention-based Speech Enhancement Using Human Quality Perception Modelling23 Mar 2023 0 repositories listed
-
A Survey on Audio Diffusion Models: Text To Speech Synthesis and Enhancement in Generative AI23 Mar 2023 0 repositories listed
-
Transformers in Speech Processing: A Survey21 Mar 2023 0 repositories listed
-
Improving Perceptual Quality, Intelligibility, and Acoustics on VoIP Platforms16 Mar 2023 0 repositories listed
-
Subspace Hybrid Beamforming for Head-worn Microphone Arrays15 Mar 2023 0 repositories listed
-
Localizing Spatial Information in Neural Spatiospectral Filters14 Mar 2023 0 repositories listed
-
TEA-PSE 3.0: Tencent-Ethereal-Audio-Lab Personalized Speech Enhancement System For ICASSP 2023 DNS Challenge14 Mar 2023 0 repositories listed
-
Adaptive Dereverberation, Noise and Interferer Reduction Using Sparse Weighted Linearly Constrained Minimum Power Beamforming13 Mar 2023 0 repositories listed
-
Blind Acoustic Room Parameter Estimation Using Phase Features13 Mar 2023 0 repositories listed
-
Guided Speech Enhancement Network13 Mar 2023 0 repositories listed
-
Real-Time Audio-Visual End-to-End Speech Enhancement13 Mar 2023 0 repositories listed
-
Improving the Intent Classification accuracy in Noisy Environment12 Mar 2023 0 repositories listed
-
Speech Modeling with a Hierarchical Transformer Dynamical VAE7 Mar 2023 0 repositories listed
-
Real-time Audio Video Enhancement with a Microphone Array and Headphones2 Mar 2023 0 repositories listed
-
DFSNet: A Steerable Neural Beamformer Invariant to Microphone Array Configuration for Real-Time, Low-Latency Speech Enhancement26 Feb 2023 0 repositories listed
-
Time-Variance Aware Real-Time Speech Enhancement25 Feb 2023 0 repositories listed
-
A Framework for Unified Real-time Personalized and Non-Personalized Speech Enhancement23 Feb 2023 0 repositories listed
-
Metric-oriented Speech Enhancement using Diffusion Probabilistic Model23 Feb 2023 0 repositories listed
-
Unsupervised Noise adaptation using Data Simulation23 Feb 2023 0 repositories listed
-
Real-time speech enhancement with dynamic attention span21 Feb 2023 0 repositories listed
-
Personalized speech enhancement combining band-split RNN and speaker attentive module20 Feb 2023 0 repositories listed
-
Real-Time Speech Enhancement Using Spectral Subtraction with Minimum Statistics and Spectral Floor20 Feb 2023 0 repositories listed
-
Speech Enhancement with Multi-granularity Vector Quantization16 Feb 2023 0 repositories listed
-
Multi-Channel Target Speaker Extraction with Refinement: The WavLab Submission to the Second Clarity Enhancement Challenge15 Feb 2023 0 repositories listed
-
On Batching Variable Size Inputs for Training End-to-End Speech Enhancement Systems25 Jan 2023 0 repositories listed
-
Cellular Network Speech Enhancement: Removing Background and Transmission Noise22 Jan 2023 0 repositories listed
-
Perceive and predict: self-supervised speech representation based loss functions for speech enhancement11 Jan 2023 0 repositories listed
-
Rethinking complex-valued deep neural networks for monaural speech enhancement11 Jan 2023 0 repositories listed
-
21 Dec 2022 0 repositories listed
-
Uncertainty Estimation in Deep Speech Enhancement Using Complex Gaussian Mixture Models9 Dec 2022 0 repositories listed
-
Selector-Enhancer: Learning Dynamic Selection of Local and Non-local Attention Operation for Speech Enhancement7 Dec 2022 0 repositories listed
-
Injecting Spatial Information for Monaural Speech Enhancement via Knowledge Distillation2 Dec 2022 0 repositories listed
-
Deep neural network techniques for monaural speech enhancement: state of the art analysis1 Dec 2022 0 repositories listed
-
Stereo Speech Enhancement Using Custom Mid-Side Signals and Monaural Processing25 Nov 2022 0 repositories listed
-
Dynamic Acoustic Compensation and Adaptive Focal Training for Personalized Speech Enhancement22 Nov 2022 0 repositories listed
-
D²Net: A Denoising and Dereverberation Network Based on Two-branch Encoder and Dual-path Transformer21 Nov 2022 0 repositories listed
-
LA-VocE: Low-SNR Audio-visual Speech Enhancement using Neural Vocoders20 Nov 2022 0 repositories listed
-
Exploring WavLM on Speech Enhancement18 Nov 2022 0 repositories listed
-
A Two-Stage Deep Representation Learning-Based Speech Enhancement Method Using Variational Autoencoder and Adversarial Training16 Nov 2022 0 repositories listed
-
Array Configuration-Agnostic Personalized Speech Enhancement using Long-Short-Term Spatial Coherence16 Nov 2022 0 repositories listed
-
Leveraging Heteroscedastic Uncertainty in Learning Complex Spectral Mapping for Single-channel Speech Enhancement16 Nov 2022 0 repositories listed
-
Multi-Label Training for Text-Independent Speaker Identification14 Nov 2022 0 repositories listed
-
The Potential of Neural Speech Synthesis-based Data Augmentation for Personalized Speech Enhancement14 Nov 2022 0 repositories listed
-
Cross-Attention is all you need: Real-Time Streaming Transformers for Personalised Speech Enhancement8 Nov 2022 0 repositories listed
-
DiffPhase: Generative Diffusion-based STFT Phase Retrieval8 Nov 2022 0 repositories listed
-
Egocentric Audio-Visual Noise Suppression7 Nov 2022 0 repositories listed
-
Breaking the trade-off in personalized speech enhancement with cross-task knowledge distillation5 Nov 2022 0 repositories listed
-
Cold Diffusion for Speech Enhancement4 Nov 2022 0 repositories listed
-
Real-Time Joint Personalized Speech Enhancement and Acoustic Echo Cancellation4 Nov 2022 0 repositories listed
-
Speech enhancement using ego-noise references with a microphone array embedded in an unmanned aerial vehicle4 Nov 2022 0 repositories listed
-
Dynamic Kernels and Channel Attention for Low Resource Speaker Verification3 Nov 2022 0 repositories listed
-
Iterative autoregression: a novel trick to improve your low-latency speech enhancement model3 Nov 2022 0 repositories listed
-
Analysis of Noisy-target Training for DNN-based speech enhancement2 Nov 2022 0 repositories listed
-
Audio-visual speech enhancement with a deep Kalman filter generative model2 Nov 2022 0 repositories listed
-
Fast and efficient speech enhancement with variational autoencoders2 Nov 2022 0 repositories listed
-
A weighted-variance variational autoencoder model for speech enhancement2 Nov 2022 0 repositories listed
-
A Preliminary Study of the Application of Discrete Wavelet Transform Features in Conv-TasNet Speech Enhancement Model1 Nov 2022 0 repositories listed
-
Exploiting the compressed spectral loss for the learning of the DEMUCS speech enhancement network1 Nov 2022 0 repositories listed
-
SCA: Streaming Cross-attention Alignment for Echo Cancellation1 Nov 2022 0 repositories listed
-
Audio-Visual Speech Enhancement and Separation by Utilizing Multi-Modal Self-Supervised Embeddings31 Oct 2022 0 repositories listed
-
Parallel Gated Neural Network With Attention Mechanism For Speech Enhancement26 Oct 2022 0 repositories listed
-
26 Oct 2022 0 repositories listed
-
A Novel Frame Structure for Cloud-Based Audio-Visual Speech Enhancement in Multimodal Hearing-aids24 Oct 2022 0 repositories listed