{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/image-generation/papers/40","list_of":"/task/image-generation","task":"Image Generation","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":40,"pages_in_order":67,"rows_per_page":100,"rows":[3901,4000],"of":6689,"counts":{"archive_papers_tagged":6689,"with_a_code_link":3102,"where_syntology_ran_a_sample":1223,"not_listed_spam_title":0,"listed":6689,"listed_where_code_ran":1223,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1063,"every_run_a_failure_of_syntologys_instrument":160,"listed_with_a_run_with_no_instrument_failure":1063,"listed_every_run_a_failure_of_syntologys_instrument":160,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/image-generation","prev":"/task/image-generation/papers/39","next":"/task/image-generation/papers/41","papers":[{"url":null,"slug":"multi-view-image-diffusion-via-coordinate","title":"Multi-view Image Diffusion via Coordinate Noise and Fourier Attention","date":"2024-12-04","arxiv_id":"2412.03756","repositories_listed":0,"syntology":null},{"url":null,"slug":"panoptic-diffusion-models-co-generation-of","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","date":"2024-12-04","arxiv_id":"2412.02929","repositories_listed":0,"syntology":null},{"url":null,"slug":"partially-conditioned-patch-parallelism-for","title":"Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference","date":"2024-12-04","arxiv_id":"2412.02962","repositories_listed":0,"syntology":null},{"url":null,"slug":"seamless-optical-cloud-computing-across-edge","title":"Seamless Optical Cloud Computing across Edge-Metro Network for Generative AI","date":"2024-12-04","arxiv_id":"2412.12126","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-understanding-and-quantifying","title":"Towards Understanding and Quantifying Uncertainty for Text-to-Image Generation","date":"2024-12-04","arxiv_id":"2412.03178","repositories_listed":0,"syntology":null},{"url":null,"slug":"3d-representation-in-512-byte-variational","title":"3D representation in 512-Byte:Variational tokenizer is the key for autoregressive 3D generation","date":"2024-12-03","arxiv_id":"2412.02202","repositories_listed":0,"syntology":null},{"url":null,"slug":"foundhand-large-scale-domain-specific","title":"FoundHand: Large-Scale Domain-Specific Learning for Controllable Hand Image Generation","date":"2024-12-03","arxiv_id":"2412.02690","repositories_listed":0,"syntology":null},{"url":null,"slug":"gist-towards-photorealistic-style-transfer","title":"GIST: Towards Photorealistic Style Transfer via Multiscale Geometric Representations","date":"2024-12-03","arxiv_id":"2412.02214","repositories_listed":0,"syntology":null},{"url":null,"slug":"shapewords-guiding-text-to-image-synthesis","title":"ShapeWords: Guiding Text-to-Image Synthesis with 3D Shape-Aware Prompts","date":"2024-12-03","arxiv_id":"2412.02912","repositories_listed":0,"syntology":null},{"url":null,"slug":"snoopi-supercharged-one-step-diffusion","title":"SNOOPI: Supercharged One-step Diffusion Distillation with Proper Guidance","date":"2024-12-03","arxiv_id":"2412.02687","repositories_listed":0,"syntology":null},{"url":null,"slug":"wem-gan-wavelet-transform-based-facial","title":"WEM-GAN: Wavelet transform based facial expression manipulation","date":"2024-12-03","arxiv_id":"2412.02530","repositories_listed":0,"syntology":null},{"url":null,"slug":"copyrightshield-spatial-similarity-guided","title":"CopyrightShield: Spatial Similarity Guided Backdoor Defense against Copyright Infringement in Diffusion Models","date":"2024-12-02","arxiv_id":"2412.01528","repositories_listed":0,"syntology":null},{"url":null,"slug":"loyaldiffusion-a-diffusion-model-guarding","title":"LoyalDiffusion: A Diffusion Model Guarding Against Data Replication","date":"2024-12-02","arxiv_id":"2412.01118","repositories_listed":0,"syntology":null},{"url":null,"slug":"schedule-on-the-fly-diffusion-time-prediction","title":"Schedule On the Fly: Diffusion Time Prediction for Faster and Better Image Generation","date":"2024-12-02","arxiv_id":"2412.01243","repositories_listed":0,"syntology":null},{"url":null,"slug":"serialgen-personalized-image-generation-by","title":"SerialGen: Personalized Image Generation by First Standardization Then Personalization","date":"2024-12-02","arxiv_id":"2412.01485","repositories_listed":0,"syntology":null},{"url":null,"slug":"switti-designing-scale-wise-transformers-for","title":"Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis","date":"2024-12-02","arxiv_id":"2412.01819","repositories_listed":0,"syntology":null},{"url":null,"slug":"world-consistent-video-diffusion-with","title":"World-consistent Video Diffusion with Explicit 3D Modeling","date":"2024-12-02","arxiv_id":"2412.01821","repositories_listed":0,"syntology":null},{"url":null,"slug":"animer-animal-pose-and-shape-estimation-using","title":"AniMer: Animal Pose and Shape Estimation Using Family Aware Transformer","date":"2024-12-01","arxiv_id":"2412.00837","repositories_listed":0,"syntology":null},{"url":null,"slug":"ctrlnerf-the-generative-neural-radiation","title":"CtrlNeRF: The Generative Neural Radiation Fields for the Controllable Synthesis of High-fidelity 3D-Aware Images","date":"2024-12-01","arxiv_id":"2412.00754","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-on-less-constraining-pre-trained","title":"Learning on Less: Constraining Pre-trained Model Learning for Generalizable Diffusion-Generated Image Detection","date":"2024-12-01","arxiv_id":"2412.00665","repositories_listed":0,"syntology":null},{"url":null,"slug":"memories-of-forgotten-concepts","title":"Memories of Forgotten Concepts","date":"2024-12-01","arxiv_id":"2412.00782","repositories_listed":0,"syntology":null},{"url":null,"slug":"art-free-generative-models-art-creation","title":"Opt-In Art: Learning Art Styles Only from Few Examples","date":"2024-11-29","arxiv_id":"2412.00176","repositories_listed":0,"syntology":null},{"url":null,"slug":"quota-quantifying-objects-with-text-to-image","title":"QUOTA: Quantifying Objects with Text-to-Image Models for Any Domain","date":"2024-11-29","arxiv_id":"2411.19534","repositories_listed":0,"syntology":null},{"url":null,"slug":"retrieval-guided-cross-view-image-synthesis","title":"Retrieval-guided Cross-view Image Synthesis","date":"2024-11-29","arxiv_id":"2411.19510","repositories_listed":0,"syntology":null},{"url":null,"slug":"3d-wag-hierarchical-wavelet-guided","title":"3D-WAG: Hierarchical Wavelet-Guided Autoregressive Generation for High-Fidelity 3D Shapes","date":"2024-11-28","arxiv_id":"2411.19037","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamblend-advancing-personalized-fine-tuning","title":"DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models","date":"2024-11-28","arxiv_id":"2411.19390","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-multi-subject-consistency-in-open","title":"Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention","date":"2024-11-28","arxiv_id":"2411.19261","repositories_listed":0,"syntology":null},{"url":null,"slug":"locally-focused-face-representation-for","title":"Locally-Focused Face Representation for Sketch-to-Image Generation Using Noise-Induced Refinement","date":"2024-11-28","arxiv_id":"2411.19005","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-cross-diffusion-guidance-for-text-to","title":"Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects","date":"2024-11-28","arxiv_id":"2411.18936","repositories_listed":0,"syntology":null},{"url":null,"slug":"sowing-information-cultivating-contextual","title":"SOWing Information: Cultivating Contextual Coherence with MLLMs in Image Generation","date":"2024-11-28","arxiv_id":"2411.19182","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-autoencoders-for-few-shot-image","title":"Diffusion Autoencoders for Few-shot Image Generation in Hyperbolic Space","date":"2024-11-27","arxiv_id":"2411.17784","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-self-distillation-for-zero-shot","title":"Diffusion Self-Distillation for Zero-Shot Customized Image Generation","date":"2024-11-27","arxiv_id":"2411.18616","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-compositional-text-to-image","title":"Enhancing Compositional Text-to-Image Generation with Reliable Random Seeds","date":"2024-11-27","arxiv_id":"2411.18810","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-visual-vulnerabilities-via-multi","title":"Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models","date":"2024-11-27","arxiv_id":"2411.18000","repositories_listed":0,"syntology":null},{"url":null,"slug":"faithdiff-unleashing-diffusion-priors-for","title":"FaithDiff: Unleashing Diffusion Priors for Faithful Image Super-resolution","date":"2024-11-27","arxiv_id":"2411.18824","repositories_listed":0,"syntology":null},{"url":null,"slug":"fam-diffusion-frequency-and-attention","title":"FAM Diffusion: Frequency and Attention Modulation for High-Resolution Image Generation with Stable Diffusion","date":"2024-11-27","arxiv_id":"2411.18552","repositories_listed":0,"syntology":null},{"url":null,"slug":"personacraft-personalized-full-body-image","title":"PersonaCraft: Personalized Full-Body Image Synthesis for Multiple Identities from Single References Using 3D-Model-Conditioned Diffusion","date":"2024-11-27","arxiv_id":"2411.18068","repositories_listed":0,"syntology":null},{"url":null,"slug":"prediction-with-action-visual-policy-learning","title":"Prediction with Action: Visual Policy Learning via Joint Denoising Process","date":"2024-11-27","arxiv_id":"2411.18179","repositories_listed":0,"syntology":null},{"url":null,"slug":"steering-rectified-flow-models-in-the-vector","title":"Steering Rectified Flow Models in the Vector Field for Controlled Image Generation","date":"2024-11-27","arxiv_id":"2412.00100","repositories_listed":0,"syntology":null},{"url":null,"slug":"type-r-automatically-retouching-typos-for","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","date":"2024-11-27","arxiv_id":"2411.18159","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-ensemble-approach-for-brain-tumor","title":"An Ensemble Approach for Brain Tumor Segmentation and Synthesis","date":"2024-11-26","arxiv_id":"2411.17617","repositories_listed":0,"syntology":null},{"url":null,"slug":"chatgen-automatic-text-to-image-generation","title":"ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting","date":"2024-11-26","arxiv_id":"2411.17176","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamcache-finetuning-free-lightweight","title":"DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching","date":"2024-11-26","arxiv_id":"2411.17786","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-graph-diffusion-to-graph-classification","title":"From Graph Diffusion to Graph Classification","date":"2024-11-26","arxiv_id":"2411.17236","repositories_listed":0,"syntology":null},{"url":null,"slug":"image-generation-with-multimodule-semantic","title":"Image Generation with Supervised Selection Based on Multimodal Features for Semantic Communications","date":"2024-11-26","arxiv_id":"2411.17428","repositories_listed":0,"syntology":null},{"url":null,"slug":"improve-improving-medical-plausibility","title":"IMPROVE: Improving Medical Plausibility without Reliance on HumanValidation -- An Enhanced Prototype-Guided Diffusion Framework","date":"2024-11-26","arxiv_id":"2411.17535","repositories_listed":0,"syntology":null},{"url":null,"slug":"interleaved-scene-graph-for-interleaved-text","title":"Interleaved Scene Graphs for Interleaved Text-and-Image Generation Assessment","date":"2024-11-26","arxiv_id":"2411.17188","repositories_listed":0,"syntology":null},{"url":null,"slug":"reward-incremental-learning-in-text-to-image","title":"Reward Incremental Learning in Text-to-Image Generation","date":"2024-11-26","arxiv_id":"2411.17310","repositories_listed":0,"syntology":null},{"url":null,"slug":"caphdr2ir-caption-driven-transfer-from","title":"CapHDR2IR: Caption-Driven Transfer from Visible Light to Infrared Domain","date":"2024-11-25","arxiv_id":"2411.16327","repositories_listed":0,"syntology":null},{"url":null,"slug":"cocono-attention-contrast-and-complete-for","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","date":"2024-11-25","arxiv_id":"2411.16783","repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-human-image-generation-with","title":"Controllable Human Image Generation with Personalized Multi-Garments","date":"2024-11-25","arxiv_id":"2411.16801","repositories_listed":0,"syntology":null},{"url":null,"slug":"debiasing-classifiers-by-amplifying-bias-with","title":"Debiasing Classifiers by Amplifying Bias with Latent Diffusion and Large Language Models","date":"2024-11-25","arxiv_id":"2411.16079","repositories_listed":0,"syntology":null},{"url":null,"slug":"factorized-visual-tokenization-and-generation","title":"Factorized Visual Tokenization and Generation","date":"2024-11-25","arxiv_id":"2411.16681","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-diffusion-to-resolution-leveraging-2d","title":"From Diffusion to Resolution: Leveraging 2D Diffusion Models for 3D Super-Resolution Task","date":"2024-11-25","arxiv_id":"2411.16792","repositories_listed":0,"syntology":null},{"url":null,"slug":"noise-diffusion-for-enhancing-semantic","title":"Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis","date":"2024-11-25","arxiv_id":"2411.16503","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-to-image-synthesis-a-decade-survey","title":"Text-to-Image Synthesis: A Decade Survey","date":"2024-11-25","arxiv_id":"2411.16164","repositories_listed":0,"syntology":null},{"url":null,"slug":"anysynth-harnessing-the-power-of-image","title":"AnySynth: Harnessing the Power of Image Synthetic Data Generation for Generalized Vision-Language Tasks","date":"2024-11-24","arxiv_id":"2411.16749","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-counter-turing-test-vct-2-discovering","title":"Visual Counter Turing Test (VCT^2): Discovering the Challenges for AI-Generated Image Detection and Introducing Visual AI Index (V_AI)","date":"2024-11-24","arxiv_id":"2411.16754","repositories_listed":0,"syntology":null},{"url":null,"slug":"consistentavatar-learning-to-diffuse-fully","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","date":"2024-11-23","arxiv_id":"2411.15436","repositories_listed":0,"syntology":null},{"url":"/paper/gradient-free-classifier-guidance-for","slug":"gradient-free-classifier-guidance-for","title":"Gradient-Free Classifier Guidance for Diffusion Model Sampling","date":"2024-11-23","arxiv_id":"2411.15393","repositories_listed":0,"syntology":null},{"url":null,"slug":"importance-based-token-merging-for-efficient","title":"Importance-Based Token Merging for Efficient Image and Video Generation","date":"2024-11-23","arxiv_id":"2411.16720","repositories_listed":0,"syntology":null},{"url":null,"slug":"interactive-visual-assessment-for-text-to","title":"Interactive Visual Assessment for Text-to-Image Generation Models","date":"2024-11-23","arxiv_id":"2411.15509","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-pruning-of-text-to-image-models","title":"Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion","date":"2024-11-22","arxiv_id":"2411.15113","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploiting-watermark-based-defense-mechanisms","title":"Exploiting Watermark-Based Defense Mechanisms in Text-to-Image Diffusion Models for Unauthorized Data Usage","date":"2024-11-22","arxiv_id":"2411.15367","repositories_listed":0,"syntology":null},{"url":null,"slug":"foundation-cures-personalization-recovering","title":"Foundation Cures Personalization: Recovering Facial Personalized Models' Prompt Consistency","date":"2024-11-22","arxiv_id":"2411.15277","repositories_listed":0,"syntology":null},{"url":null,"slug":"headrouter-a-training-free-image-editing","title":"HeadRouter: A Training-free Image Editing Framework for MM-DiTs by Adaptively Routing Attention Heads","date":"2024-11-22","arxiv_id":"2411.15034","repositories_listed":0,"syntology":null},{"url":null,"slug":"high-resolution-image-synthesis-via-next","title":"High-Resolution Image Synthesis via Next-Token Prediction","date":"2024-11-22","arxiv_id":"2411.14808","repositories_listed":0,"syntology":null},{"url":null,"slug":"latent-schrodinger-bridge-prompting-latent","title":"Latent Schrodinger Bridge: Prompting Latent Diffusion for Fast Unpaired Image-to-Image Translation","date":"2024-11-22","arxiv_id":"2411.14863","repositories_listed":0,"syntology":null},{"url":null,"slug":"prioritize-denoising-steps-on-diffusion-model","title":"Prioritize Denoising Steps on Diffusion Model Preference Alignment via Explicit Denoised Distribution Estimation","date":"2024-11-22","arxiv_id":"2411.14871","repositories_listed":0,"syntology":null},{"url":null,"slug":"reconciling-semantic-controllability-and","title":"Reconciling Semantic Controllability and Diversity for Remote Sensing Image Synthesis with Hybrid Semantic Embedding","date":"2024-11-22","arxiv_id":"2411.14781","repositories_listed":0,"syntology":null},{"url":null,"slug":"reward-fine-tuning-two-step-diffusion-models","title":"Reward Fine-Tuning Two-Step Diffusion Models via Learning Differentiable Latent-Space Surrogate Reward","date":"2024-11-22","arxiv_id":"2411.15247","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-multi-view-uav-image-geo","title":"Unsupervised Multi-view UAV Image Geo-localization via Iterative Rendering","date":"2024-11-22","arxiv_id":"2411.14816","repositories_listed":0,"syntology":null},{"url":null,"slug":"comfygi-automatic-improvement-of-image","title":"ComfyGI: Automatic Improvement of Image Generation Workflows","date":"2024-11-21","arxiv_id":"2411.14193","repositories_listed":0,"syntology":null},{"url":null,"slug":"edge-cloud-routing-for-text-to-image-model","title":"Edge-Cloud Routing for Text-to-Image Model with Token-Level Multi-Metric Prediction","date":"2024-11-21","arxiv_id":"2411.13787","repositories_listed":0,"syntology":null},{"url":null,"slug":"galaxyedit-large-scale-image-editing-dataset","title":"GalaxyEdit: Large-Scale Image Editing Dataset with Enhanced Diffusion Adapter","date":"2024-11-21","arxiv_id":"2411.13794","repositories_listed":0,"syntology":null},{"url":null,"slug":"safety-without-semantic-disruptions-editing","title":"Safety Without Semantic Disruptions: Editing-free Safe Image Generation via Context-preserving Dual Latent Reconstruction","date":"2024-11-21","arxiv_id":"2411.13982","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-embedding-is-not-all-you-need-attention","title":"Text Embedding is Not All You Need: Attention Control for Text-to-Image Semantic Alignment with Text Self-Attention Maps","date":"2024-11-21","arxiv_id":"2411.15236","repositories_listed":0,"syntology":null},{"url":null,"slug":"copyrightmeter-revisiting-copyright","title":"CopyrightMeter: Revisiting Copyright Protection in Text-to-image Models","date":"2024-11-20","arxiv_id":"2411.13144","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptively-controllable-diffusion-model-for","title":"Adaptively Controllable Diffusion Model for Efficient Conditional Image Generation","date":"2024-11-19","arxiv_id":"2411.15199","repositories_listed":0,"syntology":null},{"url":null,"slug":"ccis-diff-a-generative-model-with-stable","title":"CCIS-Diff: A Generative Model with Stable Diffusion Prior for Controlled Colonoscopy Image Synthesis","date":"2024-11-19","arxiv_id":"2411.12198","repositories_listed":0,"syntology":null},{"url":null,"slug":"constant-rate-schedule-constant-rate","title":"Constant Rate Schedule: Constant-Rate Distributional Change for Efficient Training and Sampling in Diffusion Models","date":"2024-11-19","arxiv_id":"2411.12188","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-low-dose-computed-tomography-images","title":"Enhancing Low Dose Computed Tomography Images Using Consistency Training Techniques","date":"2024-11-19","arxiv_id":"2411.12181","repositories_listed":0,"syntology":null},{"url":null,"slug":"frequency-aware-guidance-for-blind-image","title":"Frequency-Aware Guidance for Blind Image Restoration via Diffusion Models","date":"2024-11-19","arxiv_id":"2411.12450","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-modular-open-source-framework-for-genomic","title":"A Modular Open Source Framework for Genomic Variant Calling","date":"2024-11-18","arxiv_id":"2411.11513","repositories_listed":0,"syntology":null},{"url":null,"slug":"beautybank-encoding-facial-makeup-in-latent","title":"BeautyBank: Encoding Facial Makeup in Latent Space","date":"2024-11-18","arxiv_id":"2411.11231","repositories_listed":0,"syntology":null},{"url":null,"slug":"conceptwm-a-diffusion-model-watermark-for","title":"Conceptwm: A Diffusion Model Watermark for Concept Protection","date":"2024-11-18","arxiv_id":"2411.11688","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoupling-training-free-guided-diffusion-by","title":"Decoupling Training-Free Guided Diffusion by ADMM","date":"2024-11-18","arxiv_id":"2411.12773","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhanced-anime-image-generation-using-use","title":"Enhanced Anime Image Generation Using USE-CMHSA-GAN","date":"2024-11-17","arxiv_id":"2411.11179","repositories_listed":0,"syntology":null},{"url":null,"slug":"test-time-conditional-text-to-image-synthesis","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","date":"2024-11-16","arxiv_id":"2411.10800","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptive-non-uniform-timestep-sampling-for","title":"Adaptive Non-Uniform Timestep Sampling for Diffusion Model Training","date":"2024-11-15","arxiv_id":"2411.09998","repositories_listed":0,"syntology":null},{"url":null,"slug":"boundary-attention-constrained-zero-shot","title":"Boundary Attention Constrained Zero-Shot Layout-To-Image Generation","date":"2024-11-15","arxiv_id":"2411.10495","repositories_listed":0,"syntology":null},{"url":null,"slug":"cart-compositional-auto-regressive","title":"CART: Compositional Auto-Regressive Transformer for Image Generation","date":"2024-11-15","arxiv_id":"2411.10180","repositories_listed":0,"syntology":null},{"url":null,"slug":"content-aware-preserving-image-generation","title":"Content-Aware Preserving Image Generation","date":"2024-11-15","arxiv_id":"2411.09871","repositories_listed":0,"syntology":null},{"url":null,"slug":"safe-text-to-image-generation-simply-sanitize","title":"Safe Text-to-Image Generation: Simply Sanitize the Prompt Embedding","date":"2024-11-15","arxiv_id":"2411.10329","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-question-answering-based-evaluation","title":"Visual question answering based evaluation metrics for text-to-image generation","date":"2024-11-15","arxiv_id":"2411.10183","repositories_listed":0,"syntology":null},{"url":null,"slug":"advancing-diffusion-models-alias-free","title":"Advancing Diffusion Models: Alias-Free Resampling and Enhanced Rotational Equivariance","date":"2024-11-14","arxiv_id":"2411.09174","repositories_listed":0,"syntology":null},{"url":null,"slug":"image-regeneration-evaluating-text-to-image","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","date":"2024-11-14","arxiv_id":"2411.09449","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-vision-autoregressive-model","title":"A Survey on Vision Autoregressive Model","date":"2024-11-13","arxiv_id":"2411.08666","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-more-accurate-fake-detection-on","title":"Towards More Accurate Fake Detection on Images Generated from Advanced Generative and Neural Rendering Models","date":"2024-11-13","arxiv_id":"2411.08642","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-classification-of-children","title":"Emotion Classification of Children Expressions","date":"2024-11-12","arxiv_id":"2411.07708","repositories_listed":0,"syntology":null}],"record_sha256":"e891e7b7a1fa27c07a2bdcaf371fd87473bce7321e8d3786721bbd8a0b796185","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}