{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/dynamic-range-compression","entry":"dynamic_range_compression","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":31,"n_papers_ran":13,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":4,"n_samples_ran":1,"n_samples_fingerprinted":1,"n_places":31,"n_places_pointer_only":10,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":1,"ran_fixture":0,"ran":0,"unverified":3},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2507.20731","paper":null,"title":"arXiv:2507.20731","date":null,"month_inferred_from_arxiv_id":"2025-07","title_source":null,"repo":"Andong-Li-speech/RNDVoC","path":"dataset_libritts.py","file_url":"https://github.com/Andong-Li-speech/RNDVoC/blob/HEAD/dataset_libritts.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2506.08967","paper":"/paper/2506-08967","title":"Step-Audio-AQAA: a Fully End-to-End Expressive Large Audio Language Model","date":"2025-06-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"stepfun-ai/step-audio","path":"cosyvoice/matcha/audio.py","file_url":"https://github.com/stepfun-ai/step-audio/blob/HEAD/cosyvoice/matcha/audio.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2412.01169","paper":"/paper/omniflow-any-to-any-generation-with-multi","title":"OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows","date":"2024-12-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jacklishufan/omniflows","path":"omniflow/models/audio_vae.py","file_url":"https://github.com/jacklishufan/omniflows/blob/HEAD/omniflow/models/audio_vae.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0b80ec09e3ba47ae","mcp_get_code":{"code_sha256":"0b80ec09e3ba47ae"}},{"arxiv_id":"2409.13382","paper":"/paper/audio-codec-augmentation-for-robust","title":"Audio Codec Augmentation for Robust Collaborative Watermarking of Speech Synthesis","date":"2024-09-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ljuvela/collaborative-watermarking-with-codecs","path":"src/collaborative_watermarking/meldataset.py","file_url":"https://github.com/ljuvela/collaborative-watermarking-with-codecs/blob/HEAD/src/collaborative_watermarking/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2409.12466","paper":"/paper/audioeditor-a-training-free-diffusion-based","title":"AudioEditor: A Training-Free Diffusion-Based Audio Editing Framework","date":null,"month_inferred_from_arxiv_id":"2024-09","title_source":"archive","repo":"nku-hlt/audioeditor","path":"utils/converter.py","file_url":"https://github.com/nku-hlt/audioeditor/blob/HEAD/utils/converter.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2409.12121","paper":"/paper/wmcodec-end-to-end-neural-speech-codec-with","title":"WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification","date":null,"month_inferred_from_arxiv_id":"2024-09","title_source":"archive","repo":"zjzser/wmcodec","path":"meldataset.py","file_url":"https://github.com/zjzser/wmcodec/blob/HEAD/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2406.04350","paper":"/paper/prompt-guided-precise-audio-editing-with","title":"Prompt-guided Precise Audio Editing with Diffusion Models","date":"2024-05-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"haoheliu/audioldm","path":"audioldm/audio/audio_processing.py","file_url":"https://github.com/haoheliu/audioldm/blob/HEAD/audioldm/audio/audio_processing.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0b80ec09e3ba47ae","mcp_get_code":{"code_sha256":"0b80ec09e3ba47ae"}},{"arxiv_id":"2404.18398","paper":"/paper/mm-tts-a-unified-framework-for-multimodal","title":"UMETTS: A Unified Framework for Emotional Text-to-Speech Synthesis with Multimodal Prompts","date":"2024-04-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"kttrcdl/umetts","path":"EMITTS/Tacotron2/audio_processing.py","file_url":"https://github.com/kttrcdl/umetts/blob/HEAD/EMITTS/Tacotron2/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"GPL-2.0","inline_ok":false,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"2311.14957","paper":"/paper/multi-scale-sub-band-constant-q-transform","title":"Multi-Scale Sub-Band Constant-Q Transform Discriminator for High-Fidelity Vocoder","date":null,"month_inferred_from_arxiv_id":"2023-11","title_source":"archive","repo":"nvidia/bigvgan","path":"meldataset.py","file_url":"https://github.com/nvidia/bigvgan/blob/HEAD/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2310.00014","paper":"/paper/fewer-token-neural-speech-codec-with-time","title":"Fewer-token Neural Speech Codec with Time-invariant Codes","date":null,"month_inferred_from_arxiv_id":"2023-10","title_source":"archive","repo":"y-ren16/ticodec","path":"academicodec/models/ticodec/meldataset.py","file_url":"https://github.com/y-ren16/ticodec/blob/HEAD/academicodec/models/ticodec/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2301.12503","paper":"/paper/audioldm-text-to-audio-generation-with-latent","title":"AudioLDM: Text-to-Audio Generation with Latent Diffusion Models","date":"2023-01-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"haoheliu/audioldm_eval","path":"audioldm_eval/audio/audio_processing.py","file_url":"https://github.com/haoheliu/audioldm_eval/blob/HEAD/audioldm_eval/audio/audio_processing.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0b80ec09e3ba47ae","mcp_get_code":{"code_sha256":"0b80ec09e3ba47ae"}},{"arxiv_id":"2203.13086","paper":"/paper/hifi-a-unified-framework-for-neural-vocoding","title":"HiFi++: a Unified Framework for Bandwidth Extension and Speech Enhancement","date":"2022-03-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"rishikksh20/HiFiplusplus-pytorch","path":"meldataset.py","file_url":"https://github.com/rishikksh20/HiFiplusplus-pytorch/blob/HEAD/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2203.02395","paper":"/paper/istftnet-fast-and-lightweight-mel-spectrogram","title":"iSTFTNet: Fast and Lightweight Mel-Spectrogram Vocoder Incorporating Inverse Short-Time Fourier Transform","date":"2022-03-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hcy71o/autovocoder","path":"complexdataset.py","file_url":"https://github.com/hcy71o/autovocoder/blob/HEAD/complexdataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2202.13277","paper":"/paper/learning-the-beauty-in-songs-neural-singing","title":"Learning the Beauty in Songs: Neural Singing Voice Beautifier","date":"2022-02-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"MoonInTheRiver/DiffSinger","path":"modules/hifigan/mel_utils.py","file_url":"https://github.com/MoonInTheRiver/DiffSinger/blob/HEAD/modules/hifigan/mel_utils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2110.12676","paper":"/paper/controllable-and-interpretable-singing-voice","title":"Controllable and Interpretable Singing Voice Decomposition via Assem-VC","date":"2021-10-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mindslab-ai/assem-vc","path":"modules/mel.py","file_url":"https://github.com/mindslab-ai/assem-vc/blob/HEAD/modules/mel.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2106.07889","paper":"/paper/univnet-a-neural-vocoder-with-multi","title":"UnivNet: A Neural Vocoder with Multi-Resolution Spectrogram Discriminators for High-Fidelity Waveform Generation","date":"2021-06-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"rishikksh20/UnivNet-pytorch","path":"meldataset.py","file_url":"https://github.com/rishikksh20/UnivNet-pytorch/blob/HEAD/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2106.06103","paper":"/paper/conditional-variational-autoencoder-with","title":"Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech","date":null,"month_inferred_from_arxiv_id":"2021-06","title_source":"archive","repo":"NVIDIA/tacotron2","path":"audio_processing.py","file_url":"https://github.com/NVIDIA/tacotron2/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"2105.06337","paper":"/paper/grad-tts-a-diffusion-probabilistic-model-for","title":"Grad-TTS: A Diffusion Probabilistic Model for Text-to-Speech","date":"2021-05-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"WelkinYang/GradTTS","path":"audio_processing.py","file_url":"https://github.com/WelkinYang/GradTTS/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"2006.04558","paper":"/paper/fastspeech-2-fast-and-high-quality-end-to-end","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","date":"2020-06-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"shivammehta25/BetterFastSpeech2","path":"fs2/hifigan/meldataset.py","file_url":"https://github.com/shivammehta25/BetterFastSpeech2/blob/HEAD/fs2/hifigan/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}},{"arxiv_id":"2005.11129","paper":"/paper/glow-tts-a-generative-flow-for-text-to-speech","title":"Glow-TTS: A Generative Flow for Text-to-Speech via Monotonic Alignment Search","date":"2020-05-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ankurdhuriya/multispeaker-glow-tts","path":"audio_processing.py","file_url":"https://github.com/ankurdhuriya/multispeaker-glow-tts/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"2005.05957","paper":"/paper/flowtron-an-autoregressive-flow-based","title":"Flowtron: an Autoregressive Flow-based Generative Network for Text-to-Speech Synthesis","date":"2020-05-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"NVIDIA/flowtron","path":"audio_processing.py","file_url":"https://github.com/NVIDIA/flowtron/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"2005.05106","paper":"/paper/multi-band-melgan-faster-waveform-generation","title":"Multi-band MelGAN: Faster Waveform Generation for High-Quality Text-to-Speech","date":null,"month_inferred_from_arxiv_id":"2020-05","title_source":"archive","repo":"rishikksh20/melgan","path":"utils/audio_processing.py","file_url":"https://github.com/rishikksh20/melgan/blob/HEAD/utils/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1912.01219","paper":"/paper/waveflow-a-compact-flow-based-model-for-raw-1","title":"WaveFlow: A Compact Flow-based Model for Raw Audio","date":"2019-12-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"L0SG/WaveFlow","path":"tacotron2_custom/audio_processing.py","file_url":"https://github.com/L0SG/WaveFlow/blob/HEAD/tacotron2_custom/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1910.06711","paper":"/paper/melgan-generative-adversarial-networks-for","title":"MelGAN: Generative Adversarial Networks for Conditional Waveform Synthesis","date":"2019-10-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"seungwonpark/melgan","path":"utils/audio_processing.py","file_url":"https://github.com/seungwonpark/melgan/blob/HEAD/utils/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1909.11646","paper":"/paper/high-fidelity-speech-synthesis-with-1","title":"High Fidelity Speech Synthesis with Adversarial Networks","date":"2019-09-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"izzajalandoni/tts_models","path":"audio_processing.py","file_url":"https://github.com/izzajalandoni/tts_models/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1907.04448","paper":"/paper/learning-to-speak-fluently-in-a-foreign","title":"Learning to Speak Fluently in a Foreign Language: Multilingual Speech Synthesis and Cross-Language Voice Cloning","date":"2019-07-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Jeevesh8/Cross-Lingual-Voice-Cloning","path":"audio_processing.py","file_url":"https://github.com/Jeevesh8/Cross-Lingual-Voice-Cloning/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1905.11286","paper":"/paper/stochastic-gradient-methods-with-layer-wise","title":"Stochastic Gradient Methods with Layer-wise Adaptive Moments for Training of Deep Networks","date":"2019-05-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Edresson/VoiceSplit","path":"utils/audio.py","file_url":"https://github.com/Edresson/VoiceSplit/blob/HEAD/utils/audio.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e2be51dbbe1b0417","mcp_get_code":{"code_sha256":"e2be51dbbe1b0417"}},{"arxiv_id":"1812.04342","paper":"/paper/learning-latent-representations-for-style","title":"Learning latent representations for style control and transfer in end-to-end speech synthesis","date":"2018-12-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jinhan/tacotron2-vae","path":"audio_processing.py","file_url":"https://github.com/jinhan/tacotron2-vae/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1811.02122","paper":"/paper/robust-and-fine-grained-prosody-control-of","title":"Robust and fine-grained prosody control of end-to-end speech synthesis","date":"2018-11-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"keonlee9420/Robust_Fine_Grained_Prosody_Control","path":"audio_processing.py","file_url":"https://github.com/keonlee9420/Robust_Fine_Grained_Prosody_Control/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"1803.09017","paper":"/paper/style-tokens-unsupervised-style-modeling","title":"Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis","date":"2018-03-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"foamliu/GST-Tacotron-v2","path":"audio_processing.py","file_url":"https://github.com/foamliu/GST-Tacotron-v2/blob/HEAD/audio_processing.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"83e2c862f7374ac7","mcp_get_code":{"code_sha256":"83e2c862f7374ac7"}},{"arxiv_id":"Cong_EmoDubber_Towards_High_Quality_and_Emotion_Controllable_Movie_Dubbing__CVPR_2025_paper","paper":null,"title":"arXiv:Cong_EmoDubber_Towards_High_Quality_and_Emotion_Controllable_Movie_Dubbing__CVPR_2025_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"GalaxyCong/DubFlow","path":"EmoDubber_Networks/hifigan/meldataset.py","file_url":"https://github.com/GalaxyCong/DubFlow/blob/HEAD/EmoDubber_Networks/hifigan/meldataset.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"be031b15a988a556","mcp_get_code":{"code_sha256":"be031b15a988a556"}}]}