Browse State-of-the-Art › Speech Enhancement › Papers, page 4
Speech Enhancement
Papers archive 2025-07-28
archive papers tagged: 982 · with a code link: 280 · where Syntology ran a sample: 54 (45 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (54 of 982 tagged: 45 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument)
Page 4 of 10: papers 301 to 400 of 982, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model20 May 2025 0 repositories listed
-
Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising20 May 2025 0 repositories listed
-
MDDM: A Multi-view Discriminative Enhanced Diffusion-based Model for Speech Enhancement19 May 2025 0 repositories listed
-
RoVo: Robust Voice Protection Against Unauthorized Speech Synthesis with Embedding-Level Perturbations19 May 2025 0 repositories listed
-
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement18 May 2025 0 repositories listed
-
A Survey of Deep Learning for Complex Speech Spectrograms13 May 2025 0 repositories listed
-
Normalize Everything: A Preconditioned Magnitude-Preserving Architecture for Diffusion-Based Speech Enhancement8 May 2025 0 repositories listed
-
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement7 May 2025 0 repositories listed
-
SwinLip: An Efficient Visual Speech Encoder for Lip Reading Using Swin Transformer7 May 2025 0 repositories listed
-
How much to Dereverberate? Low-Latency Single-Channel Speech Enhancement in Distant Microphone Scenarios2 May 2025 0 repositories listed
-
Predicting speech intelligibility in older adults using the Gammachirp Envelope Similarity Index, GESI20 Apr 2025 0 repositories listed
-
DiTSE: High-Fidelity Generative Speech Enhancement via Latent Diffusion Transformers13 Apr 2025 0 repositories listed
-
Spatial-Filter-Bank-Based Neural Method for Multichannel Speech Enhancement2 Apr 2025 0 repositories listed
-
A Low-Power Streaming Speech Enhancement Accelerator For Edge Devices27 Mar 2025 0 repositories listed
-
Magnitude-Phase Dual-Path Speech Enhancement Network based on Self-Supervised Embedding and Perceptual Contrast Stretch Boosting27 Mar 2025 0 repositories listed
-
Joint Spectrogram Separation and TDOA Estimation using Optimal Transport24 Mar 2025 0 repositories listed
-
A Speech Production Model for Radar: Connecting Speech Acoustics with Radar-Measured Vibrations19 Mar 2025 0 repositories listed
-
Variational Autoencoder for Personalized Pathological Speech Enhancement18 Mar 2025 0 repositories listed
-
Linguistic Knowledge Transfer Learning for Speech Enhancement10 Mar 2025 0 repositories listed
-
ProSE: Diffusion Priors for Speech Enhancement9 Mar 2025 0 repositories listed
-
Enhancing Speech Quality through the Integration of BGRU and Transformer Architectures25 Feb 2025 0 repositories listed
-
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec22 Feb 2025 0 repositories listed
-
LMFCA-Net: A Lightweight Model for Multi-Channel Speech Enhancement with Efficient Narrow-Band and Cross-Band Attention17 Feb 2025 0 repositories listed
-
TAPS: Throat and Acoustic Paired Speech Dataset for Deep Learning-Based Speech Enhancement17 Feb 2025 0 repositories listed
-
Microphone Array Geometry Independent Multi-Talker Distant ASR: NTT System for the DASR Task of the CHiME-8 Challenge14 Feb 2025 0 repositories listed
-
Advances in Microphone Array Processing and Multichannel Speech Enhancement13 Feb 2025 0 repositories listed
-
GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling5 Feb 2025 0 repositories listed
-
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement23 Jan 2025 0 repositories listed
-
Generative Data Augmentation Challenge: Zero-Shot Speech Synthesis for Personalized Speech Enhancement23 Jan 2025 0 repositories listed
-
Learning-based A Posteriori Speech Presence Probability Estimation and Applications23 Jan 2025 0 repositories listed
-
22 Jan 2025 0 repositories listed
-
UP-Cycle-SENet: Unpaired Phase-aware Speech Enhancement Using Deep Complex Cycle Adversarial Networks22 Jan 2025 0 repositories listed
-
DFingerNet: Noise-Adaptive Speech Enhancement for Hearing Aids17 Jan 2025 0 repositories listed
-
Microphone Array Signal Processing and Deep Learning for Speech Enhancement13 Jan 2025 0 repositories listed
-
Multi-modal Speech Enhancement with Limited Electromyography Channels11 Jan 2025 0 repositories listed
-
Artifact-free Sound Quality in DNN-based Closed-loop Systems for Audio Processing7 Jan 2025 0 repositories listed
-
Causal Speech Enhancement with Predicting Semantics based on Quantized Self-supervised Learning Features26 Dec 2024 0 repositories listed
-
Neural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario24 Dec 2024 0 repositories listed
-
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology23 Dec 2024 0 repositories listed
-
Scalable Speech Enhancement with Dynamic Channel Pruning22 Dec 2024 0 repositories listed
-
Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling19 Dec 2024 0 repositories listed
-
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech18 Dec 2024 0 repositories listed
-
Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation11 Dec 2024 0 repositories listed
-
TouchTTS: An Embarrassingly Simple TTS Framework that Everyone Can Touch11 Dec 2024 0 repositories listed
-
SALMONN-omni: A Codec-free LLM for Full-duplex Speech Understanding and Generation27 Nov 2024 0 repositories listed
-
GhostRNN: Reducing State Redundancy in RNN with Cheap Operations20 Nov 2024 0 repositories listed
-
Towards Advanced Speech Signal Processing: A Statistical Perspective on Convolution-Based Architectures and its Applications20 Nov 2024 0 repositories listed
-
A Neural Denoising Vocoder for Clean Waveform Generation from Noisy Mel-Spectrogram based on Amplitude and Phase Predictions19 Nov 2024 0 repositories listed
-
SAV-SE: Scene-aware Audio-Visual Speech Enhancement with Selective State Space Model12 Nov 2024 0 repositories listed
-
DCF-DS: Deep Cascade Fusion of Diarization and Separation for Speech Recognition under Realistic Single-Channel Conditions11 Nov 2024 0 repositories listed
-
Selective State Space Model for Monaural Speech Enhancement9 Nov 2024 0 repositories listed
-
Modulating State Space Model with SlowFast Framework for Compute-Efficient Ultra Low-Latency Speech Enhancement4 Nov 2024 0 repositories listed
-
Task-Aware Unified Source Separation31 Oct 2024 0 repositories listed
-
Run-Time Adaptation of Neural Beamforming for Robust Speech Dereverberation and Denoising30 Oct 2024 0 repositories listed
-
Simultaneous Diarization and Separation of Meetings through the Integration of Statistical Mixture Models28 Oct 2024 0 repositories listed
-
ELAICHI: Enhancing Low-resource TTS by Addressing Infrequent and Low-frequency Character Bigrams23 Oct 2024 0 repositories listed
-
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning17 Oct 2024 0 repositories listed
-
Using RLHF to align speech enhancement approaches to mean-opinion quality scores17 Oct 2024 0 repositories listed
-
FINALLY: fast and universal speech enhancement with studio-like quality8 Oct 2024 0 repositories listed
-
RelUNet: Relative Channel Fusion U-Net for Multichannel Speech Enhancement7 Oct 2024 0 repositories listed
-
Diffusion-based Unsupervised Audio-visual Speech Enhancement4 Oct 2024 0 repositories listed
-
Restorative Speech Enhancement: A Progressive Approach Using SE and Codec Modules2 Oct 2024 0 repositories listed
-
Advanced Clustering Techniques for Speech Signal Enhancement: A Review and Metanalysis of Fuzzy C-Means, K-Means, and Kernel Fuzzy C-Means Methods28 Sep 2024 0 repositories listed
-
Speech Boosting: Low-Latency Live Speech Enhancement for TWS Earbuds27 Sep 2024 0 repositories listed
-
MC-SEMamba: A Simple Multi-channel Extension of SEMamba26 Sep 2024 0 repositories listed
-
Towards Sub-millisecond Latency Real-Time Speech Enhancement Models on Hearables26 Sep 2024 0 repositories listed
-
An Explicit Consistency-Preserving Loss Function for Phase Reconstruction and Speech Enhancement24 Sep 2024 0 repositories listed
-
Robust Audio-Visual Speech Enhancement: Correcting Misassignments in Complex Environments with Advanced Post-Processing22 Sep 2024 0 repositories listed
-
Self-Supervised Audio-Visual Soundscape Stylization22 Sep 2024 0 repositories listed
-
Geometry-Constrained EEG Channel Selection for Brain-Assisted Speech Enhancement19 Sep 2024 0 repositories listed
-
Speech-Declipping Transformer with Complex Spectrogram and Learnerble Temporal Features19 Sep 2024 0 repositories listed
-
18 Sep 2024 0 repositories listed
-
Leveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement16 Sep 2024 0 repositories listed
-
TCG CREST System Description for the Second DISPLACE Challenge16 Sep 2024 0 repositories listed
-
Ultra-Low Latency Speech Enhancement - A Comprehensive Study16 Sep 2024 0 repositories listed
-
Rethinking Mamba in Speech Processing by Self-Supervised Models11 Sep 2024 0 repositories listed
-
DeWinder: Single-Channel Wind Noise Reduction using Ultrasound Sensing10 Sep 2024 0 repositories listed
-
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule8 Sep 2024 0 repositories listed
-
TF-Mamba: A Time-Frequency Network for Sound Source Localization8 Sep 2024 0 repositories listed
-
5 Sep 2024 0 repositories listed
-
Progressive Residual Extraction based Pre-training for Speech Representation Learning31 Aug 2024 0 repositories listed
-
Spectral Masking with Explicit Time-Context Windowing for Neural Network-Based Monaural Speech Enhancement28 Aug 2024 0 repositories listed
-
Dynamic Gated Recurrent Neural Network for Compute-efficient Speech Enhancement22 Aug 2024 0 repositories listed
-
DPSNN: Spiking Neural Network for Low-Latency Streaming Speech Enhancement14 Aug 2024 0 repositories listed
-
Heterogeneous Space Fusion and Dual-Dimension Attention: A New Paradigm for Speech Enhancement13 Aug 2024 0 repositories listed
-
One-Shot Distributed Node-Specific Signal Estimation with Non-Overlapping Latent Subspaces in Acoustic Sensor Networks7 Aug 2024 0 repositories listed
-
ctPuLSE: Close-Talk, and Pseudo-Label Based Far-Field, Speech Enhancement28 Jul 2024 0 repositories listed
-
Speech Bandwidth Expansion Via High Fidelity Generative Adversarial Networks26 Jul 2024 0 repositories listed
-
22 Jul 2024 0 repositories listed
-
RT-LA-VocE: Real-Time Low-SNR Audio-Visual Speech Enhancement10 Jul 2024 0 repositories listed
-
Unsupervised Face-Masked Speech Enhancement Using Generative Adversarial Networks With Human-in-the-Loop Assessment Metrics2 Jul 2024 0 repositories listed
-
Open-Source Conversational AI with SpeechBrain 1.029 Jun 2024 0 repositories listed
-
DASB -- Discrete Audio and Speech Benchmark20 Jun 2024 0 repositories listed
-
Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement19 Jun 2024 0 repositories listed
-
An Exploration of Length Generalization in Transformer-Based Speech Enhancement17 Jun 2024 0 repositories listed
-
Spatially constrained vs. unconstrained filtering in neural spatiospectral filters for multichannel speech enhancement17 Jun 2024 0 repositories listed
-
Personalized Speech Enhancement Without a Separate Speaker Embedding Model14 Jun 2024 0 repositories listed
-
FlowAVSE: Efficient Audio-Visual Speech Enhancement with Conditional Flow Matching13 Jun 2024 0 repositories listed
-
Comparative Analysis of Personalized Voice Activity Detection Systems: Assessing Real-World Effectiveness12 Jun 2024 0 repositories listed
-
Pre-training Feature Guided Diffusion Model for Speech Enhancement11 Jun 2024 0 repositories listed