{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/image-generation/papers/32","list_of":"/task/image-generation","task":"Image Generation","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":32,"pages_in_order":67,"rows_per_page":100,"rows":[3101,3200],"of":6689,"counts":{"archive_papers_tagged":6689,"with_a_code_link":3102,"where_syntology_ran_a_sample":1223,"not_listed_spam_title":0,"listed":6689,"listed_where_code_ran":1223,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1063,"every_run_a_failure_of_syntologys_instrument":160,"listed_with_a_run_with_no_instrument_failure":1063,"listed_every_run_a_failure_of_syntologys_instrument":160,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/image-generation","prev":"/task/image-generation/papers/31","next":"/task/image-generation/papers/33","papers":[{"url":"/paper/bayesian-cp-factorization-of-incomplete","slug":"bayesian-cp-factorization-of-incomplete","title":"Bayesian CP Factorization of Incomplete Tensors with Automatic Rank Determination","date":"2014-01-25","arxiv_id":"1401.6497","repositories_listed":1,"syntology":null},{"url":"/paper/a-deep-and-tractable-density-estimator","slug":"a-deep-and-tractable-density-estimator","title":"A Deep and Tractable Density Estimator","date":"2013-10-07","arxiv_id":"1310.1757","repositories_listed":1,"syntology":null},{"url":null,"slug":"a-distributed-generative-ai-approach-for","title":"A Distributed Generative AI Approach for Heterogeneous Multi-Domain Environments under Data Sharing constraints","date":"2025-07-17","arxiv_id":"2507.12979","repositories_listed":0,"syntology":null},{"url":null,"slug":"fashionpose-text-to-pose-to-relight-image","title":"FashionPose: Text to Pose to Relight Image Generation for Personalized Fashion Visualization","date":"2025-07-17","arxiv_id":"2507.13311","repositories_listed":0,"syntology":null},{"url":null,"slug":"fastwdm3d-fast-and-accurate-3d-healthy-tissue","title":"fastWDM3D: Fast and Accurate 3D Healthy Tissue Inpainting","date":"2025-07-17","arxiv_id":"2507.13146","repositories_listed":0,"syntology":null},{"url":null,"slug":"pixel-perfect-megamed-a-megapixel-scale","title":"Pixel Perfect MegaMed: A Megapixel-Scale Vision-Language Foundation Model for Generating High Resolution Medical Images","date":"2025-07-17","arxiv_id":"2507.12698","repositories_listed":0,"syntology":null},{"url":null,"slug":"synthesizing-reality-leveraging-the","title":"Synthesizing Reality: Leveraging the Generative AI-Powered Platform Midjourney for Construction Worker Detection","date":"2025-07-17","arxiv_id":"2507.13221","repositories_listed":0,"syntology":null},{"url":null,"slug":"fade-adversarial-concept-erasure-in-flow","title":"FADE: Adversarial Concept Erasure in Flow Models","date":"2025-07-16","arxiv_id":"2507.12283","repositories_listed":0,"syntology":null},{"url":null,"slug":"catvis-context-aware-thought-visualization","title":"CATVis: Context-Aware Thought Visualization","date":"2025-07-15","arxiv_id":"2507.11522","repositories_listed":0,"syntology":null},{"url":null,"slug":"latent-space-consistency-for-sparse-view-ct","title":"Latent Space Consistency for Sparse-View CT Reconstruction","date":"2025-07-15","arxiv_id":"2507.11152","repositories_listed":0,"syntology":null},{"url":null,"slug":"vision-foundation-models-as-effective-visual","title":"Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation","date":"2025-07-11","arxiv_id":"2507.08441","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-attribute-confusion-in-fashion","title":"Evaluating Attribute Confusion in Fashion Text-to-Image Generation","date":"2025-07-09","arxiv_id":"2507.07079","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptagen-domain-specific-image-generation","title":"AdaptaGen: Domain-Specific Image Generation through Hierarchical Semantic Optimization Framework","date":"2025-07-08","arxiv_id":"2507.05621","repositories_listed":0,"syntology":null},{"url":null,"slug":"model-free-optical-processors-using-in-situ","title":"Model-free Optical Processors using In Situ Reinforcement Learning with Proximal Policy Optimization","date":"2025-07-08","arxiv_id":"2507.05583","repositories_listed":0,"syntology":null},{"url":null,"slug":"textpixs-glyph-conditioned-diffusion-with","title":"TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision","date":"2025-07-08","arxiv_id":"2507.06033","repositories_listed":0,"syntology":null},{"url":null,"slug":"corrdetail-visual-detail-enhanced-self","title":"CorrDetail: Visual Detail Enhanced Self-Correction for Face Forgery Detection","date":"2025-07-07","arxiv_id":"2507.05302","repositories_listed":0,"syntology":null},{"url":null,"slug":"dc-ar-efficient-masked-autoregressive-image","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","date":"2025-07-07","arxiv_id":"2507.04947","repositories_listed":0,"syntology":null},{"url":null,"slug":"loomnet-enhancing-multi-view-image-generation","title":"LoomNet: Enhancing Multi-View Image Generation via Latent Space Weaving","date":"2025-07-07","arxiv_id":"2507.05499","repositories_listed":0,"syntology":null},{"url":null,"slug":"trojan-horse-prompting-jailbreaking","title":"Trojan Horse Prompting: Jailbreaking Conversational Multimodal Models by Forging Assistant Message","date":"2025-07-07","arxiv_id":"2507.04673","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-training-free-style-personalization-via","title":"A Training-Free Style-Personalization via Scale-wise Autoregressive Model","date":"2025-07-06","arxiv_id":"2507.04482","repositories_listed":0,"syntology":null},{"url":"/paper/hita-holistic-tokenizer-for-autoregressive","slug":"hita-holistic-tokenizer-for-autoregressive","title":"Hita: Holistic Tokenizer for Autoregressive Image Generation","date":"2025-07-03","arxiv_id":"2507.02358","repositories_listed":0,"syntology":{"n":11,"n_ran":4,"n_constructed":0,"n_ran_checked":1,"n_instrument":3,"n_unverified":7,"n_honours":0,"n_violates":0,"n_no_contract":1,"n_pointer_only":0,"phrase":"4 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 3 where Syntology's instrument failed) · 7 unverified","sample_list":"/paper/hita-holistic-tokenizer-for-autoregressive#ran","syntology_url":"https://syntology.ai/paper/2507.02358","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2507.02358"}},"official":null}},{"url":null,"slug":"unimc-taming-diffusion-transformer-for","title":"UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation","date":"2025-07-03","arxiv_id":"2507.02713","repositories_listed":0,"syntology":null},{"url":null,"slug":"locality-aware-parallel-decoding-for","title":"Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation","date":"2025-07-02","arxiv_id":"2507.01957","repositories_listed":0,"syntology":null},{"url":null,"slug":"rethinking-discrete-tokens-treating-them-as","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","date":"2025-07-02","arxiv_id":"2507.01756","repositories_listed":0,"syntology":null},{"url":null,"slug":"process-aware-and-high-fidelity","title":"Process-aware and high-fidelity microstructure generation using stable diffusion","date":"2025-07-01","arxiv_id":"2507.00459","repositories_listed":0,"syntology":null},{"url":null,"slug":"uniglyph-unified-segmentation-conditioned","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","date":"2025-07-01","arxiv_id":"2507.00992","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-mechanisms-in-medical-imaging-a","title":"Prompt Mechanisms in Medical Imaging: A Comprehensive Survey","date":"2025-06-28","arxiv_id":"2507.01055","repositories_listed":0,"syntology":null},{"url":"/paper/bitmark-for-infinity-watermarking-bitwise","slug":"bitmark-for-infinity-watermarking-bitwise","title":"BitMark for Infinity: Watermarking Bitwise Autoregressive Image Generative Models","date":"2025-06-26","arxiv_id":"2506.21209","repositories_listed":0,"syntology":{"n":2,"n_ran":2,"n_constructed":2,"n_ran_checked":2,"n_instrument":0,"n_unverified":0,"n_honours":0,"n_violates":0,"n_no_contract":2,"n_pointer_only":0,"phrase":"2 ran (of which 2 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; every one of the 2 samples that ran constructed an object rather than computing a result","sample_list":"/paper/bitmark-for-infinity-watermarking-bitwise#ran","syntology_url":"https://syntology.ai/paper/2506.21209","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2506.21209"}},"official":null}},{"url":null,"slug":"genflow-interactive-modular-system-for-image","title":"GenFlow: Interactive Modular System for Image Generation","date":"2025-06-26","arxiv_id":"2506.21369","repositories_listed":0,"syntology":null},{"url":null,"slug":"hybridq-hybrid-classical-quantum-generative","title":"HybridQ: Hybrid Classical-Quantum Generative Adversarial Network for Skin Disease Image Generation","date":"2025-06-26","arxiv_id":"2506.21015","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-diffusion-based-image-editing","title":"Improving Diffusion-Based Image Editing Faithfulness via Guidance and Scheduling","date":"2025-06-26","arxiv_id":"2506.21045","repositories_listed":0,"syntology":null},{"url":null,"slug":"instella-t2i-pushing-the-limits-of-1d","title":"Instella-T2I: Pushing the Limits of 1D Discrete Latent Space Image Generation","date":"2025-06-26","arxiv_id":"2506.21022","repositories_listed":0,"syntology":null},{"url":null,"slug":"3dgh-3d-head-generation-with-composable-hair","title":"3DGH: 3D Head Generation with Composable Hair and Face","date":"2025-06-25","arxiv_id":"2506.20875","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-tree-sampling-scalable-inference","title":"Diffusion Tree Sampling: Scalable inference-time alignment of diffusion models","date":"2025-06-25","arxiv_id":"2506.20701","repositories_listed":0,"syntology":null},{"url":null,"slug":"hiwave-training-free-high-resolution-image","title":"HiWave: Training-Free High-Resolution Image Generation via Wavelet-Based Diffusion Sampling","date":"2025-06-25","arxiv_id":"2506.20452","repositories_listed":0,"syntology":null},{"url":null,"slug":"med-art-diffusion-transformer-for-2d-medical","title":"Med-Art: Diffusion Transformer for 2D Medical Text-to-Image Generation","date":"2025-06-25","arxiv_id":"2506.20449","repositories_listed":0,"syntology":null},{"url":"/paper/multihuman-testbench-benchmarking-image","slug":"multihuman-testbench-benchmarking-image","title":"MultiHuman-Testbench: Benchmarking Image Generation for Multiple Humans","date":"2025-06-25","arxiv_id":"2506.20879","repositories_listed":0,"syntology":{"n":5,"n_ran":5,"n_constructed":0,"n_ran_checked":3,"n_instrument":2,"n_unverified":0,"n_honours":0,"n_violates":0,"n_no_contract":3,"n_pointer_only":2,"phrase":"5 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified","sample_list":"/paper/multihuman-testbench-benchmarking-image#ran","syntology_url":"https://syntology.ai/paper/2506.20879","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2506.20879"}},"official":null}},{"url":null,"slug":"video-perception-models-for-3d-scene","title":"Video Perception Models for 3D Scene Synthesis","date":"2025-06-25","arxiv_id":"2506.20601","repositories_listed":0,"syntology":null},{"url":null,"slug":"sok-can-synthetic-images-replace-real-data-a","title":"SoK: Can Synthetic Images Replace Real Data? A Survey of Utility and Privacy of Synthetic Image Generation","date":"2025-06-24","arxiv_id":"2506.19360","repositories_listed":0,"syntology":null},{"url":null,"slug":"programmable-room-interactive-textured-3d","title":"Programmable-Room: Interactive Textured 3D Room Meshes Generation Empowered by Large Language Models","date":"2025-06-21","arxiv_id":"2506.17707","repositories_listed":0,"syntology":null},{"url":null,"slug":"ai-s-blind-spots-geographic-knowledge-and","title":"AI's Blind Spots: Geographic Knowledge and Diversity Deficit in Generated Urban Scenario","date":"2025-06-20","arxiv_id":"2506.16898","repositories_listed":0,"syntology":null},{"url":null,"slug":"beyond-blur-a-fluid-perspective-on-generative","title":"Beyond Blur: A Fluid Perspective on Generative Diffusion Models","date":"2025-06-20","arxiv_id":"2506.16827","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamcube-3d-panorama-generation-via-multi","title":"DreamCube: 3D Panorama Generation via Multi-plane Synchronization","date":"2025-06-20","arxiv_id":"2506.17206","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-hidden-cost-of-an-image-quantifying-the","title":"The Hidden Cost of an Image: Quantifying the Energy Consumption of AI Image Generation","date":"2025-06-20","arxiv_id":"2506.17016","repositories_listed":0,"syntology":null},{"url":null,"slug":"category-based-galaxy-image-generation-via","title":"Category-based Galaxy Image Generation via Diffusion Models","date":"2025-06-19","arxiv_id":"2506.16255","repositories_listed":0,"syntology":null},{"url":null,"slug":"paroattention-pattern-aware-reordering-for","title":"PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models","date":"2025-06-19","arxiv_id":"2506.16054","repositories_listed":0,"syntology":null},{"url":null,"slug":"align-your-flow-scaling-continuous-time-flow","title":"Align Your Flow: Scaling Continuous-Time Flow Map Distillation","date":"2025-06-17","arxiv_id":"2506.14603","repositories_listed":0,"syntology":null},{"url":null,"slug":"cost-aware-routing-for-efficient-text-to","title":"Cost-Aware Routing for Efficient Text-To-Image Generation","date":"2025-06-17","arxiv_id":"2506.14753","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoupled-classifier-free-guidance-for","title":"Decoupled Classifier-Free Guidance for Counterfactual Diffusion Models","date":"2025-06-17","arxiv_id":"2506.14399","repositories_listed":0,"syntology":null},{"url":"/paper/diffusionblocks-blockwise-training-for","slug":"diffusionblocks-blockwise-training-for","title":"DiffusionBlocks: Blockwise Training for Generative Models via Score-Based Diffusion","date":"2025-06-17","arxiv_id":"2506.14202","repositories_listed":0,"syntology":{"n":6,"n_ran":4,"n_constructed":0,"n_ran_checked":3,"n_instrument":1,"n_unverified":2,"n_honours":0,"n_violates":0,"n_no_contract":3,"n_pointer_only":0,"phrase":"4 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 1 where Syntology's instrument failed) · 2 unverified","sample_list":"/paper/diffusionblocks-blockwise-training-for#ran","syntology_url":"https://syntology.ai/paper/2506.14202","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2506.14202"}},"official":null}},{"url":null,"slug":"risk-estimation-of-knee-osteoarthritis","title":"Risk Estimation of Knee Osteoarthritis Progression via Predictive Multi-task Modelling from Efficient Diffusion Model using X-ray Images","date":"2025-06-17","arxiv_id":"2506.14560","repositories_listed":0,"syntology":null},{"url":null,"slug":"videomar-autoregressive-video-generatio-with","title":"VideoMAR: Autoregressive Video Generatio with Continuous Tokens","date":"2025-06-17","arxiv_id":"2506.14168","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-diffusion-models-and-unsupervised","title":"Deep Diffusion Models and Unsupervised Hyperspectral Unmixing for Realistic Abundance Map Synthesis","date":"2025-06-16","arxiv_id":"2506.13484","repositories_listed":0,"syntology":null},{"url":null,"slug":"fair-generation-without-unfair-distortions","title":"Fair Generation without Unfair Distortions: Debiasing Text-to-Image Generation with Entanglement-Free Attention","date":"2025-06-16","arxiv_id":"2506.13298","repositories_listed":0,"syntology":null},{"url":null,"slug":"quantitative-comparison-of-fine-tuning","title":"Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Image Concepts","date":"2025-06-16","arxiv_id":"2506.13307","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-watermark-for-auto-regressive-image","title":"A Watermark for Auto-Regressive Image Generation Models","date":"2025-06-13","arxiv_id":"2506.11371","repositories_listed":0,"syntology":null},{"url":null,"slug":"aligned-novel-view-image-and-geometry","title":"Aligned Novel View Image and Geometry Synthesis via Cross-modal Attention Instillation","date":"2025-06-13","arxiv_id":"2506.11924","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-the-effectiveness-of-deep-features","title":"Exploring the Effectiveness of Deep Features from Domain-Specific Foundation Models in Retinal Image Synthesis","date":"2025-06-13","arxiv_id":"2506.11753","repositories_listed":0,"syntology":null},{"url":null,"slug":"2506-10507","title":"Edit360: 2D Image Edits to 3D Assets from Any Angle","date":"2025-06-12","arxiv_id":"2506.10507","repositories_listed":0,"syntology":null},{"url":null,"slug":"anatomy-grounded-weakly-supervised-prompt","title":"Anatomy-Grounded Weakly Supervised Prompt Tuning for Chest X-ray Latent Diffusion Models","date":"2025-06-12","arxiv_id":"2506.10633","repositories_listed":0,"syntology":null},{"url":null,"slug":"high-resolution-efficient-image-generation","title":"High-resolution efficient image generation from WiFi CSI using a pretrained latent diffusion model","date":"2025-06-12","arxiv_id":"2506.10605","repositories_listed":0,"syntology":null},{"url":null,"slug":"mmmg-a-massive-multidisciplinary-multi-tier","title":"MMMG: A Massive, Multidisciplinary, Multi-Tier Generation Benchmark for Text-to-Image Reasoning","date":"2025-06-12","arxiv_id":"2506.10963","repositories_listed":0,"syntology":null},{"url":null,"slug":"pisces-an-auto-regressive-foundation-model","title":"Pisces: An Auto-regressive Foundation Model for Image Understanding and Generation","date":"2025-06-12","arxiv_id":"2506.10395","repositories_listed":0,"syntology":null},{"url":null,"slug":"symmetrical-flow-matching-unified-image","title":"Symmetrical Flow Matching: Unified Image Generation, Segmentation, and Classification with Score-Based Generative Models","date":"2025-06-12","arxiv_id":"2506.10634","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-to-image-for-multi-label-image","title":"Text to Image for Multi-Label Image Recognition with Joint Prompt-Adapter Learning","date":"2025-06-12","arxiv_id":"2506.10575","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-role-of-generative-ai-in-facilitating","title":"The Role of Generative AI in Facilitating Social Interactions: A Scoping Review","date":"2025-06-12","arxiv_id":"2506.10927","repositories_listed":0,"syntology":null},{"url":null,"slug":"2506-10230","title":"Prompt-Guided Latent Diffusion with Predictive Class Conditioning for 3D Prostate MRI Generation","date":"2025-06-11","arxiv_id":"2506.10230","repositories_listed":0,"syntology":null},{"url":null,"slug":"elbo-t2ialign-a-generic-elbo-based-method-for","title":"ELBO-T2IAlign: A Generic ELBO-Based Method for Calibrating Pixel-level Text-Image Alignment in Diffusion Models","date":"2025-06-11","arxiv_id":"2506.09740","repositories_listed":0,"syntology":null},{"url":null,"slug":"geometric-regularity-in-deterministic","title":"Geometric Regularity in Deterministic Sampling of Diffusion-based Generative Models","date":"2025-06-11","arxiv_id":"2506.10177","repositories_listed":0,"syntology":null},{"url":null,"slug":"hadanorm-diffusion-transformer-quantization","title":"HadaNorm: Diffusion Transformer Quantization through Mean-Centered Transformations","date":"2025-06-11","arxiv_id":"2506.09932","repositories_listed":0,"syntology":null},{"url":null,"slug":"only-style-stylistic-consistency-in-image","title":"Only-Style: Stylistic Consistency in Image Generation without Content Leakage","date":"2025-06-11","arxiv_id":"2506.09916","repositories_listed":0,"syntology":null},{"url":null,"slug":"sparke-scalable-prompt-aware-diversity","title":"SPARKE: Scalable Prompt-Aware Diversity Guidance in Diffusion Models via RKE Score","date":"2025-06-11","arxiv_id":"2506.10173","repositories_listed":0,"syntology":null},{"url":null,"slug":"2506-08822","title":"FreqPolicy: Efficient Flow-based Visuomotor Policy via Frequency Consistency","date":"2025-06-10","arxiv_id":"2506.08822","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffuse-and-disperse-image-generation-with","title":"Diffuse and Disperse: Image Generation with Representation Regularization","date":"2025-06-10","arxiv_id":"2506.09027","repositories_listed":0,"syntology":null},{"url":null,"slug":"mambo-high-resolution-generative-approach-for","title":"MAMBO: High-Resolution Generative Approach for Mammography Images","date":"2025-06-10","arxiv_id":"2506.08677","repositories_listed":0,"syntology":null},{"url":null,"slug":"re-thinking-the-automatic-evaluation-of-image","title":"Re-Thinking the Automatic Evaluation of Image-Text Alignment in Text-to-Image Models","date":"2025-06-10","arxiv_id":"2506.08480","repositories_listed":0,"syntology":null},{"url":null,"slug":"sakugaflow-a-stagewise-illustration-framework","title":"SakugaFlow: A Stagewise Illustration Framework Emulating the Human Drawing Process and Providing Interactive Tutoring for Novice Drawing Skills","date":"2025-06-10","arxiv_id":"2506.08443","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comprehensive-study-of-decoder-only-llms-1","title":"A Comprehensive Study of Decoder-Only LLMs for Text-to-Image Generation","date":"2025-06-09","arxiv_id":"2506.08210","repositories_listed":0,"syntology":null},{"url":null,"slug":"aptos-2024-challenge-report-generation-of","title":"APTOS-2024 challenge report: Generation of synthetic 3D OCT images from fundus photographs","date":"2025-06-09","arxiv_id":"2506.07542","repositories_listed":0,"syntology":null},{"url":null,"slug":"explore-the-vulnerability-of-black-box-models","title":"Explore the vulnerability of black-box models via diffusion models","date":"2025-06-09","arxiv_id":"2506.07590","repositories_listed":0,"syntology":null},{"url":null,"slug":"madformer-mixed-autoregressive-and-diffusion","title":"MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation","date":"2025-06-09","arxiv_id":"2506.07999","repositories_listed":0,"syntology":null},{"url":null,"slug":"vivat-virtuous-improving-vae-training-through","title":"VIVAT: Virtuous Improving VAE Training through Artifact Mitigation","date":"2025-06-09","arxiv_id":"2506.07863","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-free-identity-preservation-in","title":"Training-Free Identity Preservation in Stylized Image Generation Using Diffusion Models","date":"2025-06-07","arxiv_id":"2506.06802","repositories_listed":0,"syntology":null},{"url":null,"slug":"noise-consistency-regularization-for-improved","title":"Noise Consistency Regularization for Improved Subject-Driven Image Synthesis","date":"2025-06-06","arxiv_id":"2506.06483","repositories_listed":0,"syntology":null},{"url":null,"slug":"respf-residual-poisson-flow-for-efficient-and","title":"ResPF: Residual Poisson Flow for Efficient and Physically Consistent Sparse-View CT Reconstruction","date":"2025-06-06","arxiv_id":"2506.06400","repositories_listed":0,"syntology":null},{"url":null,"slug":"2506-05127","title":"PixCell: A generative foundation model for digital histopathology images","date":"2025-06-05","arxiv_id":"2506.05127","repositories_listed":0,"syntology":null},{"url":null,"slug":"aligning-latent-spaces-with-flow-priors","title":"Aligning Latent Spaces with Flow Priors","date":"2025-06-05","arxiv_id":"2506.05240","repositories_listed":0,"syntology":null},{"url":null,"slug":"contentv-efficient-training-of-video","title":"ContentV: Efficient Training of Video Generation Models with Limited Compute","date":"2025-06-05","arxiv_id":"2506.05343","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-ai-generated-music-with-user-guided","title":"Improving AI-generated music with user-guided training","date":"2025-06-05","arxiv_id":"2506.04852","repositories_listed":0,"syntology":null},{"url":null,"slug":"backbone-augmented-training-for-adaptations","title":"Backbone Augmented Training for Adaptations","date":"2025-06-04","arxiv_id":"2506.04288","repositories_listed":0,"syntology":null},{"url":null,"slug":"hmar-efficient-hierarchical-masked-auto-1","title":"HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation","date":"2025-06-04","arxiv_id":"2506.04421","repositories_listed":0,"syntology":null},{"url":null,"slug":"is-perturbation-based-image-protection","title":"Is Perturbation-Based Image Protection Disruptive to Image Editing?","date":"2025-06-04","arxiv_id":"2506.04394","repositories_listed":0,"syntology":null},{"url":null,"slug":"flexiffusion-training-free-segment-wise","title":"Flexiffusion: Training-Free Segment-Wise Neural Architecture Search for Efficient Diffusion Models","date":"2025-06-03","arxiv_id":"2506.02488","repositories_listed":0,"syntology":null},{"url":null,"slug":"hyperspectral-image-generation-with-unmixing","title":"Hyperspectral Image Generation with Unmixing Guided Diffusion Model","date":"2025-06-03","arxiv_id":"2506.02601","repositories_listed":0,"syntology":null},{"url":null,"slug":"solving-inverse-problems-with-flair","title":"Solving Inverse Problems with FLAIR","date":"2025-06-03","arxiv_id":"2506.02680","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-2-stage-model-for-vehicle-class-and","title":"A 2-Stage Model for Vehicle Class and Orientation Detection with Photo-Realistic Image Generation","date":"2025-06-02","arxiv_id":"2506.01338","repositories_listed":0,"syntology":null},{"url":null,"slug":"absorb-and-converge-provable-convergence","title":"Absorb and Converge: Provable Convergence Guarantee for Absorbing Discrete Diffusion Models","date":"2025-06-02","arxiv_id":"2506.02318","repositories_listed":0,"syntology":null},{"url":null,"slug":"image-generation-from-contextually","title":"Image Generation from Contextually-Contradictory Prompts","date":"2025-06-02","arxiv_id":"2506.01929","repositories_listed":0,"syntology":null},{"url":null,"slug":"pointt2i-llm-based-text-to-image-generation","title":"PointT2I: LLM-based text-to-image generation via keypoints","date":"2025-06-02","arxiv_id":"2506.01370","repositories_listed":0,"syntology":null},{"url":null,"slug":"psi-sampler-initial-particle-sampling-for-smc","title":"Psi-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models","date":"2025-06-02","arxiv_id":"2506.01320","repositories_listed":0,"syntology":null}],"record_sha256":"42321dcba07d0ace1d39352334fe890691b61ceee4cec2197f7c68ea21f815ca","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}