{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/diffusion/papers/32","list_of":"/method/diffusion","method":"Diffusion","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":32,"pages_in_order":139,"rows_per_page":100,"rows":[3101,3200],"of":13848,"counts":{"archive_papers_tagged":13848,"with_a_code_link":5365,"where_syntology_ran_a_sample":2249,"not_listed_spam_title":0,"listed":13848,"listed_where_code_ran":2249,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1969,"every_run_a_failure_of_syntologys_instrument":280,"listed_with_a_run_with_no_instrument_failure":1969,"listed_every_run_a_failure_of_syntologys_instrument":280,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/diffusion","prev":"/method/diffusion/papers/31","next":"/method/diffusion/papers/33","papers":[{"paper":null,"slug":"diffusion-prism-enhancing-diversity-and","title":"Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image Diffusion","date":"2025-01-01","arxiv_id":"2501.00944","n_code_links":0,"syntology":null},{"paper":null,"slug":"diffusion-renderer-neural-inverse-and-forward","title":"Diffusion Renderer: Neural Inverse and Forward Rendering with Video Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/directional-label-diffusion-model-for","slug":"directional-label-diffusion-model-for","title":"Directional Label Diffusion Model for Learning from Noisy Labels","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"discrete-to-continuous-generating-smooth-1","title":"Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observations","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"disentangled-pose-and-appearance-guidance-for","title":"Disentangled Pose and Appearance Guidance for Multi-Pose Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"distribution-prototype-diffusion-learning-for","title":"Distribution Prototype Diffusion Learning for Open-set Supervised Anomaly Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"divide-and-conquer-heterogeneous-noise","title":"Divide and Conquer: Heterogeneous Noise Integration for Diffusion-based Adversarial Purification","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"dl2g-degradation-guided-local-to-global","title":"DL2G: Degradation-guided Local-to-Global Restoration for Eyeglass Reflection Removal","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"dreamrelation-bridging-customization-and","title":"DreamRelation: Bridging Customization and Relation Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"drivescape-high-resolution-driving-video","title":"DriveScape: High-Resolution Driving Video Generation by Multi-View Feature Fusion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/dual-granularity-semantic-guided-sparse","slug":"dual-granularity-semantic-guided-sparse","title":"Dual-Granularity Semantic Guided Sparse Routing Diffusion Model for General Pansharpening","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"dual-interrelated-diffusion-model-for-few","title":"Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"dual-prompting-image-restoration-with","title":"Dual Prompting Image Restoration with Diffusion Transformers","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/early-bird-diffusion-investigating-and","slug":"early-bird-diffusion-investigating-and","title":"Early-Bird Diffusion: Investigating and Leveraging Timestep-Aware Early-Bird Tickets in Diffusion Models for Efficient Training","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"edgediff-edge-aware-diffusion-network-for","title":"EdgeDiff: Edge-aware Diffusion Network for Building Reconstruction from Point Clouds","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"eidt-v-exploiting-intersections-in-diffusion","title":"EIDT-V: Exploiting Intersections in Diffusion Trajectories for Model-Agnostic, Zero-Shot, Training-Free Text-to-Video Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"explaining-in-diffusion-explaining-a-1","title":"Explaining in Diffusion: Explaining a Classifier with Diffusion Semantics","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/exploring-structured-semantic-priors","slug":"exploring-structured-semantic-priors","title":"Exploring Structured Semantic Priors Underlying Diffusion Score for Test-time Adaptation","date":"2025-01-01","arxiv_id":"2501.00873","n_code_links":1,"syntology":null},{"paper":null,"slug":"feededit-text-based-image-editing-with","title":"FeedEdit: Text-Based Image Editing with Dynamic Feedback Regulation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/finding-local-diffusion-schrodinger-bridge-1","slug":"finding-local-diffusion-schrodinger-bridge-1","title":"Finding Local Diffusion Schrodinger Bridge using Kolmogorov-Arnold Network","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"fingerprinting-denoising-diffusion","title":"Fingerprinting Denoising Diffusion Probabilistic Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"flowing-from-words-to-pixels-a-noise-free","title":"Flowing from Words to Pixels: A Noise-Free Framework for Cross-Modality Evolution","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"genassets-generating-in-the-wild-3d-assets-in","title":"GenAssets: Generating in-the-wild 3D Assets in Latent Space","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"generative-map-priors-for-collaborative-bev","title":"Generative Map Priors for Collaborative BEV Semantic Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"generative-sparse-view-gaussian-splatting","title":"Generative Sparse-View Gaussian Splatting","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"glass-guided-latent-slot-diffusion-for-object","title":"GLASS: Guided Latent Slot Diffusion for Object-Centric Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"gs-dit-advancing-video-generation-with","title":"GS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"harnessing-global-local-collaborative","title":"Harnessing Global-Local Collaborative Adversarial Perturbation for Anti-Customization","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-features-matter-a-deep-1","title":"Hierarchical Features Matter: A Deep Exploration of Progressive Parameterization Method for Dataset Distillation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-flow-diffusion-for-efficient","title":"Hierarchical Flow Diffusion for Efficient Frame Interpolation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-gaussian-mixture-model-splatting","title":"Hierarchical Gaussian Mixture Model Splatting for Efficient and Part Controllable 3D Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-vision-language-alignment-for","title":"Hierarchical Vision-Language Alignment for Text-to-Image Generation via Diffusion Models","date":"2025-01-01","arxiv_id":"2501.00917","n_code_links":0,"syntology":null},{"paper":null,"slug":"homogen-enhanced-video-inpainting-via","title":"HomoGen: Enhanced Video Inpainting via Homography Propagation and Diffusion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hsi-gpt-a-general-purpose-large-scene-motion","title":"HSI-GPT: A General-Purpose Large Scene-Motion-Language Model for Human Scene Interaction","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/hyperspectral-pansharpening-via-diffusion","slug":"hyperspectral-pansharpening-via-diffusion","title":"Hyperspectral Pansharpening via Diffusion Models with Iteratively Zero-Shot Guidance","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"i2vguard-safeguarding-images-against-misuse","title":"I2VGuard: Safeguarding Images against Misuse in Diffusion-based Image-to-Video Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"icediff-high-resolution-and-high-quality","title":"IceDiff: High Resolution and High-Quality Arctic Sea Ice Forecasting with Generative Diffusion Prior","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"latenthoi-on-the-generalizable-hand-object","title":"LatentHOI: On the Generalizable Hand Object Motion Generation with Latent Hand Diffusion.","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"learning-conditional-space-time-prompt","title":"Learning Conditional Space-Time Prompt Distributions for Video Class-Incremental Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/let-s-verify-and-reinforce-image-generation","slug":"let-s-verify-and-reinforce-image-generation","title":"Let's Verify and Reinforce Image Generation Step by Step","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"low-biased-general-annotated-dataset","title":"Low-Biased General Annotated Dataset Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mage-single-image-to-material-aware-3d-via","title":"MAGE : Single Image to Material-Aware 3D via the Multi-View G-Buffer Estimation Model","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mask-2dit-dual-mask-based-diffusion","title":"Mask^2DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/matcha-towards-matching-anything-1","slug":"matcha-towards-matching-anything-1","title":"MATCHA: Towards Matching Anything","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"medusa-a-multi-scale-high-order-contrastive","title":"Medusa: A Multi-Scale High-order Contrastive Dual-Diffusion Approach for Multi-View Clustering","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mexd-an-expert-infused-diffusion-model-for","title":"MExD: An Expert-Infused Diffusion Model for Whole-Slide Image Classification","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mixsa-training-free-reference-based-sketch","title":"MixSA: Training-free Reference-based Sketch Extraction via Mixture-of-Self-Attention","date":"2025-01-01","arxiv_id":"2501.00816","n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-modal-contrastive-masked-autoencoders-a","title":"Multi-Modal Contrastive Masked Autoencoders: A Two-Stage Progressive Pre-training Approach for RGBD Datasets","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-party-collaborative-attention-control","title":"Multi-party Collaborative Attention Control for Image Customization","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mvportrait-text-guided-motion-and-emotion","title":"MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/navigating-image-restoration-with-var-s","slug":"navigating-image-restoration-with-var-s","title":"Navigating Image Restoration with VAR's Distribution Alignment Prior","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"noisectrl-a-sampling-algorithm-agnostic","title":"NoiseCtrl: A Sampling-Algorithm-Agnostic Conditional Generation Method for Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"one-way-ticket-time-independent-unified","title":"One-Way Ticket: Time-Independent Unified Encoder for Distilling Text-to-Image Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"patchvsr-breaking-video-diffusion-resolution","title":"PatchVSR: Breaking Video Diffusion Resolution Limits with Patch-wise Video Super-Resolution","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"pdfactor-learning-tri-perspective-view-policy","title":"PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic Manipulation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"personahoi-effortlessly-improving-face","title":"PersonaHOI: Effortlessly Improving Face Personalization in Human-Object Interaction Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"pioneering-4-bit-fp-quantization-for","title":"Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/point-cloud-upsampling-using-conditional","slug":"point-cloud-upsampling-using-conditional","title":"Point Cloud Upsampling Using Conditional Diffusion Module with Adaptive Noise Suppression","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/population-aware-diffusion-for-time-series","slug":"population-aware-diffusion-for-time-series","title":"Population Aware Diffusion for Time Series Generation","date":"2025-01-01","arxiv_id":"2501.00910","n_code_links":1,"syntology":{"ran":7,"of":8,"n_ran_checked":7,"n_instrument":0,"unverified":1,"pointer_only":8,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["wmd3i/PaD-TS"],"state":"official (archive's flag): 7 ran","n_ran":7,"n_constructed":0,"n_ran_no_instrument_failure":7,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"prompt2perturb-p2p-text-guided-diffusion-1","title":"Prompt2Perturb (P2P): Text-Guided Diffusion-Based Adversarial Attack on Breast Ultrasound Images","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/ps-diffusion-photorealistic-subject-driven","slug":"ps-diffusion-photorealistic-subject-driven","title":"PS-Diffusion: Photorealistic Subject-Driven Image Editing with Disentangled Control and Attention","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"pshuman-photorealistic-single-image-3d-human","title":"PSHuman: Photorealistic Single-image 3D Human Reconstruction using Cross-Scale Multiview Diffusion and Explicit Remeshing","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"random-conditioning-for-diffusion-model","title":"Random Conditioning for Diffusion Model Compression with Distillation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"rass-improving-denoising-diffusion-samplers","title":"RaSS: Improving Denoising Diffusion Samplers with Reinforced Active Sampling Scheduler","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"rediffdet-rotation-equivariant-diffusion","title":"ReDiffDet: Rotation-equivariant Diffusion Model for Oriented Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"rem-a-scalable-reinforced-multi-expert","title":"REM: A Scalable Reinforced Multi-Expert Framework for Multiplex Influence Maximization","date":"2025-01-01","arxiv_id":"2501.00779","n_code_links":0,"syntology":null},{"paper":null,"slug":"rethinking-diffusion-for-text-driven-human-1","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/revisiting-generative-replay-for-class","slug":"revisiting-generative-replay-for-class","title":"Revisiting Generative Replay for Class Incremental Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"robust-multi-object-4d-generation-for-in-the","title":"Robust Multi-Object 4D Generation for In-the-wild Videos","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"robust-mvton-learning-cross-pose-feature","title":"Robust-MVTON: Learning Cross-Pose Feature Alignment and Fusion for Robust Multi-View Virtual Try-On","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/rorem-training-a-robust-object-remover-with","slug":"rorem-training-a-robust-object-remover-with","title":"RORem: Training a Robust Object Remover with Human-in-the-Loop","date":"2025-01-01","arxiv_id":"2501.00740","n_code_links":1,"syntology":null},{"paper":null,"slug":"s-3-face-sss-compliant-facial-reflectance","title":"S^3-Face: SSS-Compliant Facial Reflectance Estimation via Diffusion Priors","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"satellite-to-groundscape-large-scale","title":"Satellite to GroundScape - Large-scale Consistent Ground View Generation from Satellite Views","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"scaling-inference-time-compute-for-diffusion","title":"Scaling Inference Time Compute for Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"scenecrafter-controllable-multi-view-driving","title":"SceneCrafter: Controllable Multi-View Driving Scene Editing","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sdgocc-semantic-and-depth-guided-bird-s-eye","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sealion-semantic-part-aware-latent-point","title":"SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"secret-lies-in-color-enhancing-ai-generated","title":"Secret Lies in Color: Enhancing AI-Generated Images Detection with Color Distribution Analysis","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"self-supervised-controlnet-with-spatio","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"shift-the-lens-environment-aware-unsupervised","title":"Shift the Lens: Environment-Aware Unsupervised Camouflaged Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"simpler-diffusion-1-5-fid-on-imagenet512-with","title":"Simpler Diffusion: 1.5 FID on ImageNet512 with Pixel-space Diffusion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sings-animatable-single-image-human-gaussian","title":"SinGS: Animatable Single-Image Human Gaussian Splats with Kinematic Priors","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"six-cd-benchmarking-concept-removals-for-text","title":"Six-CD: Benchmarking Concept Removals for Text-to-image Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"smartspatial-enhancing-the-3d-spatial","title":"SmartSpatial: Enhancing the 3D Spatial Arrangement Capabilities of Stable Diffusion Models and Introducing a Novel 3D Spatial Evaluation Framework","date":"2025-01-01","arxiv_id":"2501.01998","n_code_links":0,"syntology":null},{"paper":"/paper/spherical-manifold-guided-diffusion-model-for","slug":"spherical-manifold-guided-diffusion-model-for","title":"Spherical Manifold Guided Diffusion Model for Panoramic Image Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"stdd-spatio-temporal-dual-diffusion-for-video","title":"STDD: Spatio-Temporal Dual Diffusion for Video Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"steps-sequential-probability-tensor","title":"STEPS: Sequential Probability Tensor Estimation for Text-to-Image Hard Prompt Search","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"stereo-a-two-stage-framework-for","title":"STEREO: A Two-Stage Framework for Adversarially Robust Concept Erasing from Text-to-Image Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/t2icount-enhancing-cross-modal-understanding","slug":"t2icount-enhancing-cross-modal-understanding","title":"T2ICount: Enhancing Cross-modal Understanding for Zero-Shot Counting","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"take-the-bull-by-the-horns-learning-to","title":"Take the Bull by the Horns: Learning to Segment Hard Samples","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"taming-video-diffusion-prior-with-scene","title":"Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"texgarment-consistent-garment-uv-texture","title":"TexGarment: Consistent Garment UV Texture Generation via Efficient 3D Structure-Guided Diffusion Transformer","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"text2earth-unlocking-text-driven-remote","title":"Text2Earth: Unlocking Text-driven Remote Sensing Image Generation with a Global-Scale Dataset and a Foundation Model","date":"2025-01-01","arxiv_id":"2501.00895","n_code_links":0,"syntology":null},{"paper":null,"slug":"the-illusion-of-unlearning-the-unstable","title":"The Illusion of Unlearning: The Unstable Nature of Machine Unlearning in Text-to-Image Diffusion Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-precise-embodied-dialogue","title":"Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/towards-universal-ai-generated-image","slug":"towards-universal-ai-generated-image","title":"Towards Universal AI-Generated Image Detection by Variational Information Bottleneck Network","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"towards-universal-dataset-distillation-via","title":"Towards Universal Dataset Distillation via Task-Driven Diffusion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"turbofill-adapting-few-step-text-to-image","title":"TurboFill: Adapting Few-step Text-to-image Model for Fast Image Inpainting","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"unboxed-geometrically-and-temporally","title":"Unboxed: Geometrically and Temporally Consistent Video Outpainting","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"unleashing-the-potential-of-multi-modal-1","title":"Unleashing the Potential of Multi-modal Foundation Models and Video Diffusion for 4D Dynamic Physical Scene Simulation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null}],"record_sha256":"59bc4fe4b2fe9b30b89db2138e420fa370ee5d92fcb0b3ba9059b37865f0beee","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}