{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/diffusion/papers/78","list_of":"/method/diffusion","method":"Diffusion","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":78,"pages_in_order":139,"rows_per_page":100,"rows":[7701,7800],"of":13848,"counts":{"archive_papers_tagged":13848,"with_a_code_link":5365,"where_syntology_ran_a_sample":2249,"not_listed_spam_title":0,"listed":13848,"listed_where_code_ran":2249,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1969,"every_run_a_failure_of_syntologys_instrument":280,"listed_with_a_run_with_no_instrument_failure":1969,"listed_every_run_a_failure_of_syntologys_instrument":280,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/diffusion","prev":"/method/diffusion/papers/77","next":"/method/diffusion/papers/79","papers":[{"paper":"/paper/diffusion-time-step-curriculum-for-one-image","slug":"diffusion-time-step-curriculum-for-one-image","title":"Diffusion Time-step Curriculum for One Image to 3D Generation","date":"2024-04-06","arxiv_id":"2404.04562","n_code_links":1,"syntology":null},{"paper":"/paper/initno-boosting-text-to-image-diffusion","slug":"initno-boosting-text-to-image-diffusion","title":"InitNO: Boosting Text-to-Image Diffusion Models via Initial Noise Optimization","date":"2024-04-06","arxiv_id":"2404.04650","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["xiefan-guo/initno"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/latent-based-diffusion-model-for-long-tailed","slug":"latent-based-diffusion-model-for-long-tailed","title":"Latent-based Diffusion Model for Long-tailed Recognition","date":"2024-04-06","arxiv_id":"2404.04517","n_code_links":1,"syntology":null},{"paper":null,"slug":"a-first-passage-model-of-intravitreal-drug","title":"A first passage model of intravitreal drug delivery and residence time, in relation to ocular geometry, individual variability, and injection location","date":"2024-04-05","arxiv_id":"2404.04086","n_code_links":0,"syntology":null},{"paper":null,"slug":"concept-weaver-enabling-multi-concept-fusion","title":"Concept Weaver: Enabling Multi-Concept Fusion in Text-to-Image Models","date":"2024-04-05","arxiv_id":"2404.03913","n_code_links":0,"syntology":null},{"paper":null,"slug":"conditional-diffusion-models-for-downscaling","title":"Conditional diffusion models for downscaling & bias correction of Earth system model precipitation","date":"2024-04-05","arxiv_id":"2404.14416","n_code_links":0,"syntology":null},{"paper":null,"slug":"diffusemix-label-preserving-data-augmentation-1","title":"DiffuseMix: Label-Preserving Data Augmentation with Diffusion Models","date":"2024-04-05","arxiv_id":"2405.14881","n_code_links":0,"syntology":null},{"paper":"/paper/dynamic-prompt-optimizing-for-text-to-image","slug":"dynamic-prompt-optimizing-for-text-to-image","title":"Dynamic Prompt Optimizing for Text-to-Image Generation","date":"2024-04-05","arxiv_id":"2404.04095","n_code_links":1,"syntology":{"ran":2,"of":2,"n_ran_checked":2,"n_instrument":0,"unverified":0,"pointer_only":2,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["mowenyii/pae"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":2,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/idea-2-3d-collaborative-lmm-agents-enable-3d","slug":"idea-2-3d-collaborative-lmm-agents-enable-3d","title":"Idea23D: Collaborative LMM Agents Enable 3D Model Generation from Interleaved Multimodal Inputs","date":"2024-04-05","arxiv_id":"2404.04363","n_code_links":1,"syntology":null},{"paper":"/paper/identity-decoupling-for-multi-subject","slug":"identity-decoupling-for-multi-subject","title":"Identity Decoupling for Multi-Subject Personalization of Text-to-Image Models","date":"2024-04-05","arxiv_id":"2404.04243","n_code_links":1,"syntology":{"ran":0,"of":1,"n_ran_checked":0,"n_instrument":0,"unverified":1,"pointer_only":1,"phrase":"0 ran · 1 unverified","official":null}},{"paper":null,"slug":"instructhumans-editing-animated-3d-human","title":"InstructHumans: Editing Animated 3D Human Textures with Instructions","date":"2024-04-05","arxiv_id":"2404.04037","n_code_links":0,"syntology":null},{"paper":null,"slug":"pixel-wise-rl-on-diffusion-models","title":"Pixel-wise RL on Diffusion Models: Reinforcement Learning from Rich Feedback","date":"2024-04-05","arxiv_id":"2404.04356","n_code_links":0,"syntology":null},{"paper":"/paper/score-identity-distillation-exponentially","slug":"score-identity-distillation-exponentially","title":"Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation","date":"2024-04-05","arxiv_id":"2404.04057","n_code_links":2,"syntology":{"ran":10,"of":15,"n_ran_checked":9,"n_instrument":1,"unverified":5,"pointer_only":4,"phrase":"10 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 3 honoured, 0 violated, 6 with no contract checked; 1 where Syntology's instrument failed) · 5 unverified","official":{"repos":["mingyuanzhou/sid"],"state":"official (archive's flag): 10 ran","n_ran":10,"n_constructed":0,"n_ran_no_instrument_failure":9,"n_unverified":5,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"a-directional-diffusion-graph-transformer-for","title":"A Directional Diffusion Graph Transformer for Recommendation","date":"2024-04-04","arxiv_id":"2404.03326","n_code_links":0,"syntology":null},{"paper":null,"slug":"bi-level-guided-diffusion-models-for-zero","title":"Bi-level Guided Diffusion Models for Zero-Shot Medical Imaging Inverse Problems","date":"2024-04-04","arxiv_id":"2404.03706","n_code_links":0,"syntology":null},{"paper":"/paper/comat-aligning-text-to-image-diffusion-model","slug":"comat-aligning-text-to-image-diffusion-model","title":"CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching","date":"2024-04-04","arxiv_id":"2404.03653","n_code_links":2,"syntology":{"ran":5,"of":9,"n_ran_checked":5,"n_instrument":0,"unverified":4,"pointer_only":9,"phrase":"5 ran (of which 0 constructed an object rather than computing a result; 5 with no instrument failure: 0 honoured, 0 violated, 5 with no contract checked; 0 where Syntology's instrument failed) · 4 unverified","official":{"repos":["caraj7/comat"],"state":"official (archive's flag): 5 ran","n_ran":5,"n_constructed":0,"n_ran_no_instrument_failure":5,"n_unverified":4,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"diffbody-human-body-restoration-by-imagining","title":"DiffBody: Human Body Restoration by Imagining with Generative Diffusion Prior","date":"2024-04-04","arxiv_id":"2404.03642","n_code_links":0,"syntology":null},{"paper":"/paper/diffdet4sar-diffusion-based-aircraft-target","slug":"diffdet4sar-diffusion-based-aircraft-target","title":"DiffDet4SAR: Diffusion-based Aircraft Target Detection Network for SAR Images","date":"2024-04-04","arxiv_id":"2404.03595","n_code_links":1,"syntology":null},{"paper":null,"slug":"diffobs-generative-diffusion-for-global","title":"DiffObs: Generative Diffusion for Global Forecasting of Satellite Observations","date":"2024-04-04","arxiv_id":"2404.06517","n_code_links":0,"syntology":null},{"paper":null,"slug":"diverse-and-tailored-image-generation-for","title":"Diverse and Tailored Image Generation for Zero-shot Multi-label Classification","date":"2024-04-04","arxiv_id":"2404.03144","n_code_links":0,"syntology":null},{"paper":null,"slug":"dreamwalk-style-space-exploration-using","title":"DreamWalk: Style Space Exploration using Diffusion Guidance","date":"2024-04-04","arxiv_id":"2404.03145","n_code_links":0,"syntology":null},{"paper":null,"slug":"future-proofing-class-incremental-learning","title":"Future-Proofing Class Incremental Learning","date":"2024-04-04","arxiv_id":"2404.03200","n_code_links":0,"syntology":null},{"paper":"/paper/handdiff-3d-hand-pose-estimation-with","slug":"handdiff-3d-hand-pose-estimation-with","title":"HandDiff: 3D Hand Pose Estimation with Diffusion on Image-Point Cloud","date":"2024-04-04","arxiv_id":"2404.03159","n_code_links":1,"syntology":{"ran":2,"of":3,"n_ran_checked":1,"n_instrument":1,"unverified":1,"pointer_only":0,"phrase":"2 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 1 unverified","official":{"repos":["cwc1260/handdiff"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":1,"n_ran_no_instrument_failure":1,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"lcm-lookahead-for-encoder-based-text-to-image","title":"LCM-Lookahead for Encoder-based Text-to-Image Personalization","date":"2024-04-04","arxiv_id":"2404.03620","n_code_links":0,"syntology":null},{"paper":null,"slug":"mitigating-analytical-variability-in-fmri","title":"Mitigating analytical variability in fMRI results with style transfer","date":"2024-04-04","arxiv_id":"2404.03703","n_code_links":0,"syntology":null},{"paper":null,"slug":"mvd-fusion-single-view-3d-via-depth","title":"MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation","date":"2024-04-04","arxiv_id":"2404.03656","n_code_links":0,"syntology":null},{"paper":null,"slug":"pointinfinity-resolution-invariant-point","title":"PointInfinity: Resolution-Invariant Point Diffusion Models","date":"2024-04-04","arxiv_id":"2404.03566","n_code_links":0,"syntology":null},{"paper":null,"slug":"reference-based-3d-aware-image-editing-with","title":"Reference-Based 3D-Aware Image Editing with Triplanes","date":"2024-04-04","arxiv_id":"2404.03632","n_code_links":0,"syntology":null},{"paper":"/paper/riemannian-l-systems-modeling-growing-forms","slug":"riemannian-l-systems-modeling-growing-forms","title":"Riemannian L-systems: Modeling growing forms in curved spaces","date":"2024-04-04","arxiv_id":"2404.03270","n_code_links":1,"syntology":null},{"paper":null,"slug":"segmentation-guided-knee-radiograph","title":"Segmentation-Guided Knee Radiograph Generation using Conditional Diffusion Models","date":"2024-04-04","arxiv_id":"2404.03541","n_code_links":0,"syntology":null},{"paper":null,"slug":"silofuse-cross-silo-synthetic-data-generation","title":"SiloFuse: Cross-silo Synthetic Data Generation with Latent Tabular Diffusion Models","date":"2024-04-04","arxiv_id":"2404.03299","n_code_links":0,"syntology":null},{"paper":"/paper/the-more-you-see-in-2d-the-more-you-perceive","slug":"the-more-you-see-in-2d-the-more-you-perceive","title":"The More You See in 2D, the More You Perceive in 3D","date":"2024-04-04","arxiv_id":"2404.03652","n_code_links":1,"syntology":null},{"paper":null,"slug":"would-deep-generative-models-amplify-bias-in","title":"Would Deep Generative Models Amplify Bias in Future Models?","date":"2024-04-04","arxiv_id":"2404.03242","n_code_links":0,"syntology":null},{"paper":null,"slug":"asap-interpretable-analysis-and-summarization","title":"ASAP: Interpretable Analysis and Summarization of AI-generated Image Patterns at Scale","date":"2024-04-03","arxiv_id":"2404.02990","n_code_links":0,"syntology":null},{"paper":"/paper/cross-attention-makes-inference-cumbersome-in","slug":"cross-attention-makes-inference-cumbersome-in","title":"Faster Diffusion via Temporal Attention Decomposition","date":"2024-04-03","arxiv_id":"2404.02747","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":0,"n_instrument":1,"unverified":0,"pointer_only":1,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":{"repos":["haozheliu-st/t-gate"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/deep-generative-models-through-the-lens-of","slug":"deep-generative-models-through-the-lens-of","title":"Deep Generative Models through the Lens of the Manifold Hypothesis: A Survey and New Connections","date":"2024-04-03","arxiv_id":"2404.02954","n_code_links":1,"syntology":{"ran":11,"of":14,"n_ran_checked":11,"n_instrument":0,"unverified":3,"pointer_only":14,"phrase":"11 ran (of which 0 constructed an object rather than computing a result; 11 with no instrument failure: 0 honoured, 0 violated, 11 with no contract checked; 0 where Syntology's instrument failed) · 3 unverified","official":{"repos":["layer6ai-labs/dgm_manifold_survey"],"state":"official (archive's flag): 11 ran","n_ran":11,"n_constructed":0,"n_ran_no_instrument_failure":11,"n_unverified":3,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"deep-privacy-funnel-model-from-a","title":"Deep Privacy Funnel Model: From a Discriminative to a Generative Approach with an Application to Face Recognition","date":"2024-04-03","arxiv_id":"2404.02696","n_code_links":0,"syntology":null},{"paper":null,"slug":"diffexplainer-towards-cross-modal-global","title":"Diffexplainer: Towards Cross-modal Global Explanations with Diffusion Models","date":"2024-04-03","arxiv_id":"2404.02618","n_code_links":0,"syntology":null},{"paper":null,"slug":"enhancing-diffusion-based-point-cloud","title":"Enhancing Diffusion-based Point Cloud Generation with Smoothness Constraint","date":"2024-04-03","arxiv_id":"2404.02396","n_code_links":0,"syntology":null},{"paper":"/paper/lidardm-generative-lidar-simulation-in-a","slug":"lidardm-generative-lidar-simulation-in-a","title":"LidarDM: Generative LiDAR Simulation in a Generated World","date":"2024-04-03","arxiv_id":"2404.02903","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":3,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["vzyrianov/LidarDM"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":3,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"many-to-many-image-generation-with-auto","title":"Many-to-many Image Generation with Auto-regressive Diffusion Models","date":"2024-04-03","arxiv_id":"2404.03109","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-the-scalability-of-diffusion-based-text-to","title":"On the Scalability of Diffusion-based Text-to-Image Generation","date":"2024-04-03","arxiv_id":"2404.02883","n_code_links":0,"syntology":null},{"paper":null,"slug":"solar-synthetic-imaging-introducing-denoising","title":"Solar synthetic imaging: Introducing denoising diffusion probabilistic models on SDO/AIA data","date":"2024-04-03","arxiv_id":"2404.02552","n_code_links":0,"syntology":null},{"paper":"/paper/visual-autoregressive-modeling-scalable-image","slug":"visual-autoregressive-modeling-scalable-image","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","date":"2024-04-03","arxiv_id":"2404.02905","n_code_links":3,"syntology":{"ran":7,"of":11,"n_ran_checked":2,"n_instrument":5,"unverified":4,"pointer_only":0,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 5 where Syntology's instrument failed) · 4 unverified","official":{"repos":["FoundationVision/VAR"],"state":"community repositories only","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["listed"]}}},{"paper":"/paper/addsr-accelerating-diffusion-based-blind","slug":"addsr-accelerating-diffusion-based-blind","title":"AddSR: Accelerating Diffusion-based Blind Super-Resolution with Adversarial Diffusion Distillation","date":"2024-04-02","arxiv_id":"2404.01717","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":1,"n_instrument":2,"unverified":0,"pointer_only":3,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 1 honoured, 0 violated, 0 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified","official":null}},{"paper":null,"slug":"autodiff-autoregressive-diffusion-modeling","title":"AUTODIFF: Autoregressive Diffusion Modeling for Structure-based Drug Design","date":"2024-04-02","arxiv_id":"2404.02003","n_code_links":0,"syntology":null},{"paper":"/paper/bi-lora-a-vision-language-approach-for","slug":"bi-lora-a-vision-language-approach-for","title":"Bi-LORA: A Vision-Language Approach for Synthetic Image Detection","date":"2024-04-02","arxiv_id":"2404.01959","n_code_links":1,"syntology":null},{"paper":"/paper/co-speech-gesture-video-generation-via-motion","slug":"co-speech-gesture-video-generation-via-motion","title":"Co-Speech Gesture Video Generation via Motion-Decoupled Diffusion Model","date":"2024-04-02","arxiv_id":"2404.01862","n_code_links":1,"syntology":{"ran":4,"of":5,"n_ran_checked":4,"n_instrument":0,"unverified":1,"pointer_only":2,"phrase":"4 ran (of which 2 constructed an object rather than computing a result; 4 with no instrument failure: 2 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["thuhcsi/s2g-mddiffusion"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":2,"n_ran_no_instrument_failure":3,"n_unverified":0,"ran_from_kinds":["official","unlocated"]}}},{"paper":"/paper/diffusion-2-dynamic-3d-content-generation-via","slug":"diffusion-2-dynamic-3d-content-generation-via","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","date":"2024-04-02","arxiv_id":"2404.02148","n_code_links":1,"syntology":{"ran":14,"of":14,"n_ran_checked":10,"n_instrument":4,"unverified":0,"pointer_only":5,"phrase":"14 ran (of which 0 constructed an object rather than computing a result; 10 with no instrument failure: 0 honoured, 3 violated, 7 with no contract checked; 4 where Syntology's instrument failed) · 0 unverified","official":{"repos":["fudan-zvg/diffusion-square"],"state":"official (archive's flag): 11 ran","n_ran":11,"n_constructed":0,"n_ran_no_instrument_failure":10,"n_unverified":0,"ran_from_kinds":["official","unlocated"]}}},{"paper":"/paper/diffusion-deepfake","slug":"diffusion-deepfake","title":"Diffusion Deepfake","date":"2024-04-02","arxiv_id":"2404.01579","n_code_links":0,"syntology":null},{"paper":null,"slug":"fashionengine-interactive-generation-and","title":"FashionEngine: Interactive 3D Human Generation and Editing via Multimodal Controls","date":"2024-04-02","arxiv_id":"2404.01655","n_code_links":0,"syntology":null},{"paper":null,"slug":"heat-death-of-generative-models-in-closed","title":"Heat Death of Generative Models in Closed-Loop Learning","date":"2024-04-02","arxiv_id":"2404.02325","n_code_links":0,"syntology":null},{"paper":null,"slug":"jailbreaking-prompt-attack-a-controllable","title":"Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models","date":"2024-04-02","arxiv_id":"2404.02928","n_code_links":0,"syntology":null},{"paper":null,"slug":"release-of-pre-trained-models-for-the","title":"Release of Pre-Trained Models for the Japanese Language","date":"2024-04-02","arxiv_id":"2404.01657","n_code_links":0,"syntology":null},{"paper":null,"slug":"semantic-augmentation-in-images-using","title":"Semantic Augmentation in Images using Language","date":"2024-04-02","arxiv_id":"2404.02353","n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-enhanced-analysis-of-lung-cancer","title":"Towards Enhanced Analysis of Lung Cancer Lesions in EBUS-TBNA -- A Semi-Supervised Video Object Detection Method","date":"2024-04-02","arxiv_id":"2404.01929","n_code_links":0,"syntology":null},{"paper":null,"slug":"upsample-guidance-scale-up-diffusion-models","title":"Upsample Guidance: Scale Up Diffusion Models without Training","date":"2024-04-02","arxiv_id":"2404.01709","n_code_links":0,"syntology":null},{"paper":"/paper/wcdt-world-centric-diffusion-transformer-for","slug":"wcdt-world-centric-diffusion-transformer-for","title":"WcDT: World-centric Diffusion Transformer for Traffic Scene Generation","date":"2024-04-02","arxiv_id":"2404.02082","n_code_links":1,"syntology":{"ran":4,"of":5,"n_ran_checked":4,"n_instrument":0,"unverified":1,"pointer_only":0,"phrase":"4 ran (of which 0 constructed an object rather than computing a result; 4 with no instrument failure: 0 honoured, 0 violated, 4 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["yangchen1997/wcdt"],"state":"official (archive's flag): 4 ran","n_ran":4,"n_constructed":0,"n_ran_no_instrument_failure":4,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"a-unified-and-interpretable-emotion","title":"A Unified and Interpretable Emotion Representation and Expression Generation","date":"2024-04-01","arxiv_id":"2404.01243","n_code_links":0,"syntology":null},{"paper":null,"slug":"action-detection-via-an-image-diffusion","title":"Action Detection via an Image Diffusion Process","date":"2024-04-01","arxiv_id":"2404.01051","n_code_links":0,"syntology":null},{"paper":null,"slug":"bigger-is-not-always-better-scaling","title":"Bigger is not Always Better: Scaling Properties of Latent Diffusion Models","date":"2024-04-01","arxiv_id":"2404.01367","n_code_links":0,"syntology":null},{"paper":null,"slug":"condition-aware-neural-network-for-controlled","title":"Condition-Aware Neural Network for Controlled Image Generation","date":"2024-04-01","arxiv_id":"2404.01143","n_code_links":0,"syntology":null},{"paper":null,"slug":"cosmicman-a-text-to-image-foundation-model","title":"CosmicMan: A Text-to-Image Foundation Model for Humans","date":"2024-04-01","arxiv_id":"2404.01294","n_code_links":0,"syntology":null},{"paper":null,"slug":"diffusion-based-zero-shot-medical-image-to","title":"Diffusion based Zero-shot Medical Image-to-Image Translation for Cross Modality Segmentation","date":"2024-04-01","arxiv_id":"2404.01102","n_code_links":0,"syntology":null},{"paper":"/paper/disr-nerf-diffusion-guided-view-consistent","slug":"disr-nerf-diffusion-guided-view-consistent","title":"DiSR-NeRF: Diffusion-Guided View-Consistent Super-Resolution NeRF","date":"2024-04-01","arxiv_id":"2404.00874","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":0,"n_instrument":1,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":{"repos":["leejielong/disr-nerf"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/dpmesh-exploiting-diffusion-prior-for","slug":"dpmesh-exploiting-diffusion-prior-for","title":"DPMesh: Exploiting Diffusion Prior for Occluded Human Mesh Recovery","date":"2024-04-01","arxiv_id":"2404.01424","n_code_links":1,"syntology":null},{"paper":"/paper/drag-your-noise-interactive-point-based","slug":"drag-your-noise-interactive-point-based","title":"Drag Your Noise: Interactive Point-based Editing via Diffusion Semantic Propagation","date":"2024-04-01","arxiv_id":"2404.01050","n_code_links":1,"syntology":{"ran":12,"of":17,"n_ran_checked":8,"n_instrument":4,"unverified":5,"pointer_only":17,"phrase":"12 ran (of which 0 constructed an object rather than computing a result; 8 with no instrument failure: 0 honoured, 1 violated, 7 with no contract checked; 4 where Syntology's instrument failed) · 5 unverified","official":{"repos":["haofengl/dragnoise"],"state":"official (archive's flag): 12 ran","n_ran":12,"n_constructed":0,"n_ran_no_instrument_failure":8,"n_unverified":5,"ran_from_kinds":["official"]}}},{"paper":"/paper/evaluating-text-to-visual-generation-with","slug":"evaluating-text-to-visual-generation-with","title":"Evaluating Text-to-Visual Generation with Image-to-Text Generation","date":"2024-04-01","arxiv_id":"2404.01291","n_code_links":3,"syntology":null},{"paper":"/paper/few-shot-point-cloud-reconstruction-and","slug":"few-shot-point-cloud-reconstruction-and","title":"Few-shot point cloud reconstruction and denoising via learned Guassian splats renderings and fine-tuned diffusion features","date":"2024-04-01","arxiv_id":"2404.01112","n_code_links":1,"syntology":null},{"paper":"/paper/flexidreamer-single-image-to-3d-generation","slug":"flexidreamer-single-image-to-3d-generation","title":"FlexiDreamer: Single Image-to-3D Generation with FlexiCubes","date":"2024-04-01","arxiv_id":"2404.00987","n_code_links":1,"syntology":null},{"paper":null,"slug":"generating-content-for-hdr-deghosting-from","title":"Generating Content for HDR Deghosting from Frequency View","date":"2024-04-01","arxiv_id":"2404.00849","n_code_links":0,"syntology":null},{"paper":"/paper/image-reconstruction-from","slug":"image-reconstruction-from","title":"Perceptogram: Reconstructing Visual Percepts from EEG","date":"2024-04-01","arxiv_id":"2404.01250","n_code_links":1,"syntology":null},{"paper":null,"slug":"is-model-collapse-inevitable-breaking-the","title":"Is Model Collapse Inevitable? Breaking the Curse of Recursion by Accumulating Real and Synthetic Data","date":"2024-04-01","arxiv_id":"2404.01413","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-motion-model-for-unified-multi-modal","title":"Large Motion Model for Unified Multi-Modal Motion Generation","date":"2024-04-01","arxiv_id":"2404.01284","n_code_links":0,"syntology":null},{"paper":null,"slug":"magicmirror-fast-and-high-quality-avatar","title":"MagicMirror: Fast and High-Quality Avatar Generation with a Constrained Search Space","date":"2024-04-01","arxiv_id":"2404.01296","n_code_links":0,"syntology":null},{"paper":"/paper/measuring-style-similarity-in-diffusion","slug":"measuring-style-similarity-in-diffusion","title":"Measuring Style Similarity in Diffusion Models","date":"2024-04-01","arxiv_id":"2404.01292","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["learn2phoenix/csd"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"model-agnostic-human-preference-inversion-in","title":"Model-Agnostic Human Preference Inversion in Diffusion Models","date":"2024-04-01","arxiv_id":"2404.00879","n_code_links":0,"syntology":null},{"paper":null,"slug":"physreaction-physically-plausible-real-time","title":"PhysReaction: Physically Plausible Real-Time Humanoid Reaction Synthesis via Forward Dynamics Guided 4D Imitation","date":"2024-04-01","arxiv_id":"2404.01081","n_code_links":0,"syntology":null},{"paper":null,"slug":"prior-frequency-guided-diffusion-model-for","title":"Prior Frequency Guided Diffusion Model for Limited Angle (LA)-CBCT Reconstruction","date":"2024-04-01","arxiv_id":"2404.01448","n_code_links":0,"syntology":null},{"paper":null,"slug":"stale-diffusion-hyper-realistic-5d-movie","title":"Stale Diffusion: Hyper-realistic 5D Movie Generation Using Old-school Methods","date":"2024-04-01","arxiv_id":"2404.01079","n_code_links":0,"syntology":null},{"paper":null,"slug":"structldm-structured-latent-diffusion-for-3d","title":"StructLDM: Structured Latent Diffusion for 3D Human Generation","date":"2024-04-01","arxiv_id":"2404.01241","n_code_links":0,"syntology":null},{"paper":"/paper/texture-preserving-diffusion-models-for-high","slug":"texture-preserving-diffusion-models-for-high","title":"Texture-Preserving Diffusion Models for High-Fidelity Virtual Try-On","date":"2024-04-01","arxiv_id":"2404.01089","n_code_links":1,"syntology":null},{"paper":null,"slug":"towards-memorization-free-diffusion-models","title":"Towards Memorization-Free Diffusion Models","date":"2024-04-01","arxiv_id":"2404.00922","n_code_links":0,"syntology":null},{"paper":"/paper/tryon-adapter-efficient-fine-grained-clothing","slug":"tryon-adapter-efficient-fine-grained-clothing","title":"TryOn-Adapter: Efficient Fine-Grained Clothing Identity Adaptation for High-Fidelity Virtual Try-On","date":"2024-04-01","arxiv_id":"2404.00878","n_code_links":1,"syntology":null},{"paper":"/paper/ufid-a-unified-framework-for-input-level","slug":"ufid-a-unified-framework-for-input-level","title":"UFID: A Unified Framework for Input-level Backdoor Detection on Diffusion Models","date":"2024-04-01","arxiv_id":"2404.01101","n_code_links":1,"syntology":null},{"paper":null,"slug":"uncovering-the-text-embedding-in-text-to","title":"Uncovering the Text Embedding in Text-to-Image Diffusion Models","date":"2024-04-01","arxiv_id":"2404.01154","n_code_links":0,"syntology":null},{"paper":null,"slug":"versatile-navigation-under-partial","title":"Versatile Navigation under Partial Observability via Value-guided Diffusion Policy","date":"2024-04-01","arxiv_id":"2404.02176","n_code_links":0,"syntology":null},{"paper":null,"slug":"video-interpolation-with-diffusion-models","title":"Video Interpolation with Diffusion Models","date":"2024-04-01","arxiv_id":"2404.01203","n_code_links":0,"syntology":null},{"paper":"/paper/cm-tts-enhancing-real-time-text-to-speech","slug":"cm-tts-enhancing-real-time-text-to-speech","title":"CM-TTS: Enhancing Real Time Text-to-Speech Synthesis Efficiency through Weighted Samplers and Consistency Models","date":"2024-03-31","arxiv_id":"2404.00569","n_code_links":1,"syntology":null},{"paper":"/paper/creating-synthetic-energy-meter-data-using","slug":"creating-synthetic-energy-meter-data-using","title":"Creating synthetic energy meter data using conditional diffusion and building metadata","date":"2024-03-31","arxiv_id":"2404.00525","n_code_links":1,"syntology":null},{"paper":"/paper/deedsr-towards-real-world-image-super","slug":"deedsr-towards-real-world-image-super","title":"DeeDSR: Towards Real-World Image Super-Resolution via Degradation-Aware Stable Diffusion","date":"2024-03-31","arxiv_id":"2404.00661","n_code_links":1,"syntology":null},{"paper":"/paper/denoising-distillation-makes-event-frame","slug":"denoising-distillation-makes-event-frame","title":"Modeling State Shifting via Local-Global Distillation for Event-Frame Gaze Tracking","date":"2024-03-31","arxiv_id":"2404.00548","n_code_links":1,"syntology":null},{"paper":"/paper/disentangling-hippocampal-shape-variations-a","slug":"disentangling-hippocampal-shape-variations-a","title":"Disentangling Hippocampal Shape Variations: A Study of Neurological Disorders Using Mesh Variational Autoencoder with Contrastive Learning","date":"2024-03-31","arxiv_id":"2404.00785","n_code_links":1,"syntology":null},{"paper":null,"slug":"ipt-v2-efficient-image-processing-transformer","title":"IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions","date":"2024-03-31","arxiv_id":"2404.00633","n_code_links":0,"syntology":null},{"paper":"/paper/text2hoi-text-guided-3d-motion-generation-for","slug":"text2hoi-text-guided-3d-motion-generation-for","title":"Text2HOI: Text-guided 3D Motion Generation for Hand-Object Interaction","date":"2024-03-31","arxiv_id":"2404.00562","n_code_links":1,"syntology":{"ran":3,"of":7,"n_ran_checked":3,"n_instrument":0,"unverified":4,"pointer_only":0,"phrase":"3 ran (of which 3 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 4 unverified; every one of the 3 samples that ran constructed an object rather than computing a result","official":{"repos":["junukcha/text2hoi"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":3,"n_ran_no_instrument_failure":3,"n_unverified":4,"ran_from_kinds":["official"]}}},{"paper":"/paper/towards-realistic-scene-generation-with-lidar","slug":"towards-realistic-scene-generation-with-lidar","title":"Towards Realistic Scene Generation with LiDAR Diffusion Models","date":"2024-03-31","arxiv_id":"2404.00815","n_code_links":1,"syntology":{"ran":5,"of":8,"n_ran_checked":5,"n_instrument":0,"unverified":3,"pointer_only":0,"phrase":"5 ran (of which 4 constructed an object rather than computing a result; 5 with no instrument failure: 0 honoured, 0 violated, 5 with no contract checked; 0 where Syntology's instrument failed) · 3 unverified","official":{"repos":["hancyran/lidar-diffusion"],"state":"official (archive's flag): 5 ran","n_ran":5,"n_constructed":4,"n_ran_no_instrument_failure":5,"n_unverified":3,"ran_from_kinds":["official"]}}},{"paper":"/paper/unknown-prompt-the-only-lacuna-unveiling-clip","slug":"unknown-prompt-the-only-lacuna-unveiling-clip","title":"Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization","date":"2024-03-31","arxiv_id":"2404.00710","n_code_links":1,"syntology":null},{"paper":"/paper/denoising-monte-carlo-renders-with-diffusion","slug":"denoising-monte-carlo-renders-with-diffusion","title":"Denoising Monte Carlo Renders with Diffusion Models","date":"2024-03-30","arxiv_id":"2404.00491","n_code_links":1,"syntology":{"ran":16,"of":18,"n_ran_checked":12,"n_instrument":4,"unverified":2,"pointer_only":18,"phrase":"16 ran (of which 0 constructed an object rather than computing a result; 12 with no instrument failure: 3 honoured, 0 violated, 9 with no contract checked; 4 where Syntology's instrument failed) · 2 unverified","official":{"repos":["vibe007/Denoising_MC_Renders_Diffusion"],"state":"official (archive's flag): 16 ran","n_ran":16,"n_constructed":0,"n_ran_no_instrument_failure":12,"n_unverified":2,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"dependability-evaluation-of-stable-diffusion","title":"Dependability Evaluation of Stable Diffusion with Soft Errors on the Model Parameters","date":"2024-03-30","arxiv_id":"2404.00352","n_code_links":0,"syntology":null},{"paper":null,"slug":"generative-ai-for-architectural-design-a","title":"Generative AI Models for Different Steps in Architectural Design: A Literature Review","date":"2024-03-30","arxiv_id":"2404.01335","n_code_links":0,"syntology":null}],"record_sha256":"1fe90af10e78d2afa818fed5e2998b64a36c793cdd269db177ee98dc779e2a4f","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}