Browse State-of-the-Art › Text to Image Generation › Papers, page 7
Text to Image Generation
Papers archive 2025-07-28
archive papers tagged: 969 · with a code link: 461 · where Syntology ran a sample: 198 (171 with a run with no instrument failure, 27 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (198 of 969 tagged: 171 with a run with no instrument failure, 27 where every run was a failure of Syntology's instrument)
Page 7 of 10: papers 601 to 700 of 969, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
MC^2: Multi-concept Guidance for Customized Multi-concept Generation1 Jan 2025 0 repositories listed
-
Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception1 Jan 2025 0 repositories listed
-
SKE-Layout: Spatial Knowledge Enhanced Layout Generation with LLMs1 Jan 2025 0 repositories listed
-
VODiff: Controlling Object Visibility Order in Text-to-Image Generation1 Jan 2025 0 repositories listed
-
Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation30 Dec 2024 0 repositories listed
-
Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales27 Dec 2024 0 repositories listed
-
UNIC-Adapter: Unified Image-instruction Adapter with Multi-modal Transformer for Image Generation25 Dec 2024 0 repositories listed
-
1.58-bit FLUX24 Dec 2024 0 repositories listed
-
Self-Corrected Flow Distillation for Consistent One-Step and Few-Step Text-to-Image Generation22 Dec 2024 0 repositories listed
-
Flowing from Words to Pixels: A Framework for Cross-Modality Evolution19 Dec 2024 0 repositories listed
-
GALOT: Generative Active Learning via Optimizable Zero-shot Text-to-image Generation18 Dec 2024 0 repositories listed
-
A LoRA is Worth a Thousand Pictures16 Dec 2024 0 repositories listed
-
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation16 Dec 2024 0 repositories listed
-
SafetyDPO: Scalable Safety Alignment for Text-to-Image Generation13 Dec 2024 0 repositories listed
-
Are Conditional Latent Diffusion Models Effective for Image Restoration?12 Dec 2024 0 repositories listed
-
Vision-Language Models Represent Darker-Skinned Black Individuals as More Homogeneous than Lighter-Skinned Black Individuals12 Dec 2024 0 repositories listed
-
Seeing Syntax: Uncovering Syntactic Learning Limitations in Vision-Language Models11 Dec 2024 0 repositories listed
-
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation10 Dec 2024 0 repositories listed
-
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models10 Dec 2024 0 repositories listed
-
Preference Adaptive and Sequential Text-to-Image Generation10 Dec 2024 0 repositories listed
-
Efficiency Meets Fidelity: A Novel Quantization Framework for Stable Diffusion9 Dec 2024 0 repositories listed
-
BudgetFusion: Perceptually-Guided Adaptive Diffusion Models8 Dec 2024 0 repositories listed
-
Language-Guided Image Tokenization for Generation8 Dec 2024 0 repositories listed
-
Self-Guidance: Boosting Flow and Diffusion Generation on Their Own8 Dec 2024 0 repositories listed
-
SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation8 Dec 2024 0 repositories listed
-
BodyMetric: Evaluating the Realism of Human Bodies in Text-to-Image Generation5 Dec 2024 0 repositories listed
-
LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors5 Dec 2024 0 repositories listed
-
One Communication Round is All It Needs for Federated Fine-Tuning Foundation Models5 Dec 2024 0 repositories listed
-
T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts5 Dec 2024 0 repositories listed
-
DynamicControl: Adaptive Condition Selection for Improved Text-to-Image Generation4 Dec 2024 0 repositories listed
-
Implicit Priors Editing in Stable Diffusion via Targeted Token Adjustment4 Dec 2024 0 repositories listed
-
Multi-view Image Diffusion via Coordinate Noise and Fourier Attention4 Dec 2024 0 repositories listed
-
Towards Understanding and Quantifying Uncertainty for Text-to-Image Generation4 Dec 2024 0 repositories listed
-
Schedule On the Fly: Diffusion Time Prediction for Faster and Better Image Generation2 Dec 2024 0 repositories listed
-
Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis2 Dec 2024 0 repositories listed
-
Memories of Forgotten Concepts1 Dec 2024 0 repositories listed
-
QUOTA: Quantifying Objects with Text-to-Image Models for Any Domain29 Nov 2024 0 repositories listed
-
Enhancing Compositional Text-to-Image Generation with Reliable Random Seeds27 Nov 2024 0 repositories listed
-
Type-R: Automatically Retouching Typos for Text-to-Image Generation27 Nov 2024 0 repositories listed
-
ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting26 Nov 2024 0 repositories listed
-
Reward Incremental Learning in Text-to-Image Generation26 Nov 2024 0 repositories listed
-
Debiasing Classifiers by Amplifying Bias with Latent Diffusion and Large Language Models25 Nov 2024 0 repositories listed
-
23 Nov 2024 0 repositories listed
-
Interactive Visual Assessment for Text-to-Image Generation Models23 Nov 2024 0 repositories listed
-
Foundation Cures Personalization: Recovering Facial Personalized Models' Prompt Consistency22 Nov 2024 0 repositories listed
-
High-Resolution Image Synthesis via Next-Token Prediction22 Nov 2024 0 repositories listed
-
Prioritize Denoising Steps on Diffusion Model Preference Alignment via Explicit Denoised Distribution Estimation22 Nov 2024 0 repositories listed
-
CopyrightMeter: Revisiting Copyright Protection in Text-to-image Models20 Nov 2024 0 repositories listed
-
Safe Text-to-Image Generation: Simply Sanitize the Prompt Embedding15 Nov 2024 0 repositories listed
-
Visual question answering based evaluation metrics for text-to-image generation15 Nov 2024 0 repositories listed
-
Leveraging Previous Steps: A Training-free Fast Solver for Flow Diffusion12 Nov 2024 0 repositories listed
-
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models8 Nov 2024 0 repositories listed
-
On Improved Conditioning Mechanisms and Pre-training Strategies for Diffusion Models5 Nov 2024 0 repositories listed
-
MoLE: Enhancing Human-centric Text-to-image Diffusion via Mixture of Low-rank Experts30 Oct 2024 0 repositories listed
-
FairQueue: Rethinking Prompt Learning for Fair Text-to-Image Generation24 Oct 2024 0 repositories listed
-
A Wavelet Diffusion GAN for Image Super-Resolution23 Oct 2024 0 repositories listed
-
Scalable Ranked Preference Optimization for Text-to-Image Generation23 Oct 2024 0 repositories listed
-
MPDS: A Movie Posters Dataset for Image Generation with Diffusion Model22 Oct 2024 0 repositories listed
-
KITTEN: A Knowledge-Intensive Evaluation of Image Generation on Visual Entities15 Oct 2024 0 repositories listed
-
Saliency Guided Optimization of Diffusion Latents14 Oct 2024 0 repositories listed
-
RealEra: Semantic-level Concept Erasure via Neighbor-Concept Mining11 Oct 2024 0 repositories listed
-
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation10 Oct 2024 0 repositories listed
-
Scaling Laws For Diffusion Transformers10 Oct 2024 0 repositories listed
-
Sparse Repellency for Shielded Generation in Text-to-image Diffusion Models8 Oct 2024 0 repositories listed
-
OmniBooth: Learning Latent Control for Image Synthesis with Multi-modal Instruction7 Oct 2024 0 repositories listed
-
Uncovering Regional Defaults from Photorealistic Forests in Text-to-Image Generation with DALL-E 23 Oct 2024 0 repositories listed
-
ComfyGen: Prompt-Adaptive Workflows for Text-to-Image Generation2 Oct 2024 0 repositories listed
-
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation30 Sep 2024 0 repositories listed
-
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through f-divergence Minimization15 Sep 2024 0 repositories listed
-
IFAdapter: Instance Feature Control for Grounded Text-to-Image Generation12 Sep 2024 0 repositories listed
-
FreeEnhance: Tuning-Free Image Enhancement via Content-Consistent Noising-and-Denoising Process11 Sep 2024 0 repositories listed
-
PoseEmbroider: Towards a 3D, Visual, Semantic-aware Human Pose Representation10 Sep 2024 0 repositories listed
-
SVFit: Parameter-Efficient Fine-Tuning of Large Pre-Trained Models Using Singular Values9 Sep 2024 0 repositories listed
-
ArtiFade: Learning to Generate High-quality Subject from Blemished Images5 Sep 2024 0 repositories listed
-
Blended Latent Diffusion under Attention Control for Real-World Video Editing5 Sep 2024 0 repositories listed
-
SPDiffusion: Semantic Protection Diffusion for Multi-concept Text-to-image Generation2 Sep 2024 0 repositories listed
-
Training-Free Sketch-Guided Diffusion with Latent Optimization31 Aug 2024 0 repositories listed
-
Text-to-Image Generation Via Energy-Based CLIP30 Aug 2024 0 repositories listed
-
CSGO: Content-Style Composition in Text-to-Image Generation29 Aug 2024 0 repositories listed
-
Hand1000: Generating Realistic Hands from Text with Only 1,000 Images28 Aug 2024 0 repositories listed
-
Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System27 Aug 2024 0 repositories listed
-
Rethinking Training for De-biasing Text-to-Image Generation: Unlocking the Potential of Stable Diffusion22 Aug 2024 0 repositories listed
-
FRAP: Faithful and Realistic Text-to-Image Generation with Adaptive Prompt Weighting21 Aug 2024 0 repositories listed
-
Detection-Driven Object Count Optimization for Text-to-Image Diffusion Models21 Aug 2024 0 repositories listed
-
The Brittleness of AI-Generated Image Watermarking Techniques: Examining Their Robustness Against Visual Paraphrasing Attacks19 Aug 2024 0 repositories listed
-
DiffLoRA: Generating Personalized Low-Rank Adaptation Weights with Diffusion13 Aug 2024 0 repositories listed
-
Artworks Reimagined: Exploring Human-AI Co-Creation through Body Prompting10 Aug 2024 0 repositories listed
-
Instruction Tuning-free Visual Token Complement for Multimodal LLMs9 Aug 2024 0 repositories listed
-
Zero-Shot Uncertainty Quantification using Diffusion Probabilistic Models8 Aug 2024 0 repositories listed
-
One Framework to Rule Them All: Unifying Multimodal Tasks with LLM Neural-Tuning6 Aug 2024 0 repositories listed
-
The Fabrication of Reality and Fantasy: Scene Generation with LLM-Assisted Prompt Interpretation17 Jul 2024 0 repositories listed
-
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval15 Jul 2024 0 repositories listed
-
Surgical Text-to-Image Generation12 Jul 2024 0 repositories listed
-
JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation8 Jul 2024 0 repositories listed
-
Chest-Diffusion: A Light-Weight Text-to-Image Model for Report-to-CXR Generation30 Jun 2024 0 repositories listed
-
How Stable is Stable Diffusion under Recursive InPainting (RIP)?27 Jun 2024 0 repositories listed
-
Beyond Thumbs Up/Down: Untangling Challenges of Fine-Grained Feedback for Text-to-Image Generation24 Jun 2024 0 repositories listed
-
Invertible Consistency Distillation for Text-Guided Image Editing in Around 7 Steps20 Jun 2024 0 repositories listed
-
Exploring the Role of Large Language Models in Prompt Encoding for Diffusion Models17 Jun 2024 0 repositories listed
-
Poetry2Image: An Iterative Correction Framework for Images Generated from Chinese Classical Poetry15 Jun 2024 0 repositories listed