Browse State-of-the-Art › Text-to-Image Generation › Papers, page 9
Text-to-Image Generation
Papers archive 2025-07-28
archive papers tagged: 1,085 · with a code link: 546 · where Syntology ran a sample: 246 (215 with a run with no instrument failure, 31 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (246 of 1,085 tagged: 215 with a run with no instrument failure, 31 where every run was a failure of Syntology's instrument)
Page 9 of 11: papers 801 to 900 of 1,085, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Can Prompt Modifiers Control Bias? A Comparative Analysis of Text-to-Image Generative Models9 Jun 2024 0 repositories listed
-
OmniControlNet: Dual-stage Integration for Conditional Image Generation9 Jun 2024 0 repositories listed
-
TIGeR: Unifying Text-to-Image Generation and Retrieval with Large Multimodal Models9 Jun 2024 0 repositories listed
-
AttnDreamBooth: Towards Text-Aligned Personalized Text-to-Image Generation7 Jun 2024 0 repositories listed
-
Inv-Adapter: ID Customization Generation via Image Inversion and Lightweight Adapter5 Jun 2024 0 repositories listed
-
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation4 Jun 2024 0 repositories listed
-
The Crystal Ball Hypothesis in diffusion models: Anticipating object positions from initial noise4 Jun 2024 0 repositories listed
-
Dimba: Transformer-Mamba Diffusion Models3 Jun 2024 0 repositories listed
-
Improving Text Generation on Images with Synthetic Captions1 Jun 2024 0 repositories listed
-
Boost Your Human Image Generation Model via Direct Preference Optimization30 May 2024 0 repositories listed
-
Learning 3D Robotics Perception using Inductive Priors30 May 2024 0 repositories listed
-
Topological Perspectives on Optimal Multimodal Embedding Spaces29 May 2024 0 repositories listed
-
Anonymization Prompt Learning for Facial Privacy-Preserving Text-to-Image Generation27 May 2024 0 repositories listed
-
SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance24 May 2024 0 repositories listed
-
ArtWeaver: Advanced Dynamic Style Integration via Diffusion Model24 May 2024 0 repositories listed
-
Personalized Residuals for Concept-Driven Text-to-Image Generation21 May 2024 0 repositories listed
-
TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation18 May 2024 0 repositories listed
-
UPAM: Unified Prompt Attack in Text-to-Image Generation Models Against Both Textual Filters and Visual Checkers18 May 2024 0 repositories listed
-
Improving face generation quality and prompt following with synthetic captions17 May 2024 0 repositories listed
-
VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing16 May 2024 0 repositories listed
-
Compositional Text-to-Image Generation with Dense Blob Representations14 May 2024 0 repositories listed
-
Training-free Subject-Enhanced Attention Guidance for Compositional Text-to-image Generation11 May 2024 0 repositories listed
-
Controllable Image Generation With Composed Parallel Token Prediction10 May 2024 0 repositories listed
-
A Survey on Personalized Content Synthesis with Diffusion Models9 May 2024 0 repositories listed
-
FlexEControl: Flexible and Efficient Multimodal Control for Text-to-Image Generation8 May 2024 0 repositories listed
-
SonicDiffusion: Audio-Driven Image Generation and Editing with Pretrained Diffusion Models1 May 2024 0 repositories listed
-
DOCCI: Descriptions of Connected and Contrasting Images30 Apr 2024 0 repositories listed
-
Trinity Detector:text-assisted and attention mechanisms based spectral fusion for diffusion generation image detection26 Apr 2024 0 repositories listed
-
FINEMATCH: Aspect-based Fine-grained Image and Text Mismatch Detection and Correction23 Apr 2024 0 repositories listed
-
GLoD: Composing Global Contexts and Local Details in Image Generation23 Apr 2024 0 repositories listed
-
ID-Aligner: Enhancing Identity-Preserving Text-to-Image Generation with Reward Feedback Learning23 Apr 2024 0 repositories listed
-
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation23 Apr 2024 0 repositories listed
-
Towards Better Text-to-Image Generation Alignment via Attention Modulation22 Apr 2024 0 repositories listed
-
LTOS: Layout-controllable Text-Object Synthesis via Adaptive Cross-attention Fusions21 Apr 2024 0 repositories listed
-
Object-Attribute Binding in Text-to-Image Generation: Evaluation and Control21 Apr 2024 0 repositories listed
-
EdgeFusion: On-Device Text-to-Image Generation18 Apr 2024 0 repositories listed
-
MaxFusion: Plug&Play Multi-Modal Generation in Text-to-Image Diffusion Models15 Apr 2024 0 repositories listed
-
DreamScape: 3D Scene Creation via Gaussian Splatting joint Correlation Modeling14 Apr 2024 0 repositories listed
-
Mask-ControlNet: Higher-Quality Image Generation with An Additional Mask Prompt8 Apr 2024 0 repositories listed
-
UniFL: Improve Latent Diffusion Model via Unified Feedback Learning8 Apr 2024 0 repositories listed
-
Concept Weaver: Enabling Multi-Concept Fusion in Text-to-Image Models5 Apr 2024 0 repositories listed
-
Diverse and Tailored Image Generation for Zero-shot Multi-label Classification4 Apr 2024 0 repositories listed
-
MatAtlas: Text-driven Consistent Geometry Texturing and Material Assignment3 Apr 2024 0 repositories listed
-
MULAN: A Multi Layer Annotated Dataset for Controllable Text-to-Image Generation3 Apr 2024 0 repositories listed
-
On the Scalability of Diffusion-based Text-to-Image Generation3 Apr 2024 0 repositories listed
-
Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models2 Apr 2024 0 repositories listed
-
Condition-Aware Neural Network for Controlled Image Generation1 Apr 2024 0 repositories listed
-
Model-Agnostic Human Preference Inversion in Diffusion Models1 Apr 2024 0 repositories listed
-
Survey of Bias In Text-to-Image Generation: Definition, Evaluation, and Mitigation1 Apr 2024 0 repositories listed
-
30 Mar 2024 0 repositories listed
-
Automated Black-box Prompt Engineering for Personalized Text-to-Image Generation28 Mar 2024 0 repositories listed
-
ECNet: Effective Controllable Text-to-Image Diffusion Models27 Mar 2024 0 repositories listed
-
Tutorial on Diffusion Models for Imaging and Vision26 Mar 2024 0 repositories listed
-
An Intermediate Fusion ViT Enables Efficient Text-Image Alignment in Diffusion Models25 Mar 2024 0 repositories listed
-
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance25 Mar 2024 0 repositories listed
-
Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation25 Mar 2024 0 repositories listed
-
R3CD: Scene Graph to Image Generation with Relation-aware Compositional Contrastive Control Diffusion24 Mar 2024 0 repositories listed
-
AGFSync: Leveraging AI-Generated Feedback for Preference Optimization in Text-to-Image Generation20 Mar 2024 0 repositories listed
-
A Survey on Quality Metrics for Text-to-Image Generation18 Mar 2024 0 repositories listed
-
Infinite-ID: Identity-preserved Personalization via ID-semantics Decoupling Paradigm18 Mar 2024 0 repositories listed
-
Fast Personalized Text-to-Image Syntheses With Attention Injection17 Mar 2024 0 repositories listed
-
Denoising Task Difficulty-based Curriculum for Training Diffusion Models15 Mar 2024 0 repositories listed
-
Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering14 Mar 2024 0 repositories listed
-
Block-wise LoRA: Revisiting Fine-grained LoRA for Effective Personalization and Stylization in Text-to-Image Generation12 Mar 2024 0 repositories listed
-
Optimizing Negative Prompts for Enhanced Aesthetics and Fidelity in Text-To-Image Generation12 Mar 2024 0 repositories listed
-
DivCon: Divide and Conquer for Progressive Text-to-Image Generation11 Mar 2024 0 repositories listed
-
Beyond Finite Data: Towards Data-free Out-of-distribution Generalization via Extrapolation8 Mar 2024 0 repositories listed
-
Sora as an AGI World Model? A Complete Survey on Text-to-Video Generation8 Mar 2024 0 repositories listed
-
Discriminative Probing and Tuning for Text-to-Image Generation7 Mar 2024 0 repositories listed
-
Towards Understanding Cross and Self-Attention in Stable Diffusion for Text-Guided Image Editing6 Mar 2024 0 repositories listed
-
AtomoVideo: High Fidelity Image-to-Video Generation4 Mar 2024 0 repositories listed
-
HanDiffuser: Text-to-Image Generation With Realistic Hand Appearances4 Mar 2024 0 repositories listed
-
SCott: Accelerating Diffusion Models with Stochastic Consistency Distillation3 Mar 2024 0 repositories listed
-
Bespoke Non-Stationary Solvers for Fast Sampling of Diffusion and Flow Models2 Mar 2024 0 repositories listed
-
TCIG: Two-Stage Controlled Image Generation with Quality Enhancement through Diffusion2 Mar 2024 0 repositories listed
-
27 Feb 2024 0 repositories listed
-
Referee Can Play: An Alternative Approach to Conditional Generation via Model Inversion26 Feb 2024 0 repositories listed
-
Contrastive Prompts Improve Disentanglement in Text-to-Image Diffusion Models21 Feb 2024 0 repositories listed
-
SDXL-Lightning: Progressive Adversarial Diffusion Distillation21 Feb 2024 0 repositories listed
-
The Male CEO and the Female Assistant: Evaluation and Mitigation of Gender Biases in Text-To-Image Generation of Dual Subjects16 Feb 2024 0 repositories listed
-
Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation15 Feb 2024 0 repositories listed
-
7 Feb 2024 0 repositories listed
-
Text2Street: Controllable Text-to-image Generation for Street Views7 Feb 2024 0 repositories listed
-
Can Shape-Infused Joint Embeddings Improve Image-Conditioned 3D Diffusion?2 Feb 2024 0 repositories listed
-
Fréchet Distance for Offline Evaluation of Information Retrieval Systems with Sparse Labels31 Jan 2024 0 repositories listed
-
Divide and Conquer: Language Models can Plan and Self-Correct for Compositional Text-to-Image Generation28 Jan 2024 0 repositories listed
-
Object-Driven One-Shot Fine-tuning of Text-to-Image Diffusion with Prototypical Embedding28 Jan 2024 0 repositories listed
-
StyleInject: Parameter Efficient Tuning of Text-to-Image Diffusion Models25 Jan 2024 0 repositories listed
-
UrbanGenAI: Reconstructing Urban Landscapes using Panoptic Segmentation and Diffusion Models25 Jan 2024 0 repositories listed
-
UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion24 Jan 2024 0 repositories listed
-
Text-to-Image Cross-Modal Generation: A Systematic Review21 Jan 2024 0 repositories listed
-
DiffusionGPT: LLM-Driven Text-to-Image Generation System18 Jan 2024 0 repositories listed
-
Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation11 Jan 2024 0 repositories listed
-
Let's Go Shopping (LGS) -- Web-Scale Image-Text Dataset for Visual Concept Understanding9 Jan 2024 0 repositories listed
-
4 Jan 2024 0 repositories listed
-
Check Locate Rectify: A Training-Free Layout Calibration System for Text-to-Image Generation1 Jan 2024 0 repositories listed
-
Countering Personalized Text-to-Image Generation with Influence Watermarks1 Jan 2024 0 repositories listed
-
MAGICK: A Large-scale Captioned Dataset from Matting Generated Images using Chroma Keying1 Jan 2024 0 repositories listed
-
One-dimensional Adapter to Rule Them All: Concepts Diffusion Models and Erasing Applications1 Jan 2024 0 repositories listed
-
Prompt Expansion for Adaptive Text-to-Image Generation27 Dec 2023 0 repositories listed