Browse State-of-the-Art › Text to Image Generation › Papers, page 6
Text to Image Generation
Papers archive 2025-07-28
archive papers tagged: 969 · with a code link: 461 · where Syntology ran a sample: 198 (171 with a run with no instrument failure, 27 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (198 of 969 tagged: 171 with a run with no instrument failure, 27 where every run was a failure of Syntology's instrument)
Page 6 of 10: papers 501 to 600 of 969, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation8 May 2025 0 repositories listed
-
PIDiff: Image Customization for Personalized Identities with Diffusion Models8 May 2025 0 repositories listed
-
CRAFT: Cultural Russian-Oriented Dataset Adaptation for Focused Text-to-Image Generation7 May 2025 0 repositories listed
-
Preliminary Explorations with GPT-4o(mni) Native Image Generation6 May 2025 0 repositories listed
-
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation5 May 2025 0 repositories listed
-
Text to Image Generation and Editing: A Survey5 May 2025 0 repositories listed
-
WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation2 May 2025 0 repositories listed
-
Inception: Jailbreak the Memory Mechanism of Text-to-Image Generation Systems29 Apr 2025 0 repositories listed
-
RefVNLI: Towards Scalable Evaluation of Subject-driven Text-to-image Generation24 Apr 2025 0 repositories listed
-
Token-Shuffle: Towards High-Resolution Image Generation with Autoregressive Models24 Apr 2025 0 repositories listed
-
Emergence and Evolution of Interpretable Concepts in Diffusion Models21 Apr 2025 0 repositories listed
-
Twin Co-Adaptive Dialogue for Progressive Image Generation21 Apr 2025 0 repositories listed
-
What Lurks Within? Concept Auditing for Shared Diffusion Models at Scale21 Apr 2025 0 repositories listed
-
Exploring Language Patterns of Prompts in Text-to-Image Generation and Their Impact on Visual Diversity19 Apr 2025 0 repositories listed
-
PRISM: A Unified Framework for Photorealistic Reconstruction and Intrinsic Scene Modeling19 Apr 2025 0 repositories listed
-
Towards NSFW-Free Text-to-Image Generation via Safety-Constraint Direct Preference Optimization19 Apr 2025 0 repositories listed
-
Entropy Rectifying Guidance for Diffusion and Flow Models18 Apr 2025 0 repositories listed
-
POET: Supporting Prompting Creativity and Personalization with Automated Expansion of Text-to-Image Generation18 Apr 2025 0 repositories listed
-
SMPL-GPTexture: Dual-View 3D Human Texture Estimation using Text-to-Image Generation Models17 Apr 2025 0 repositories listed
-
Instruction-augmented Multimodal Alignment for Image-Text and Element Matching16 Apr 2025 0 repositories listed
-
Using LLMs as prompt modifier to avoid biases in AI image generators15 Apr 2025 0 repositories listed
-
InstructEngine: Instruction-driven Text-to-Image Alignment14 Apr 2025 0 repositories listed
-
Towards Explainable Partial-AIGC Image Quality Assessment12 Apr 2025 0 repositories listed
-
Muon-Accelerated Attention Distillation for Real-Time Edge Synthesis via Optimized Latent Diffusion11 Apr 2025 0 repositories listed
-
10 Apr 2025 0 repositories listed
-
Compass Control: Multi Object Orientation Control for Text-to-Image Generation9 Apr 2025 0 repositories listed
-
Storybooth: Training-free Multi-Subject Consistency for Improved Visual Storytelling8 Apr 2025 0 repositories listed
-
FineLIP: Extending CLIP's Reach via Fine-Grained Alignment with Longer Text Inputs2 Apr 2025 0 repositories listed
-
Semantic Packet Aggregation and Repeated Transmission for Text-to-Image Generation31 Mar 2025 0 repositories listed
-
On Geometrical Properties of Text Token Embeddings for Strong Semantic Binding in Text-to-Image Generation29 Mar 2025 0 repositories listed
-
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers28 Mar 2025 0 repositories listed
-
ORIGEN: Zero-Shot 3D Orientation Grounding in Text-to-Image Generation28 Mar 2025 0 repositories listed
-
Sell It Before You Make It: Revolutionizing E-Commerce with Personalized AI-Generated Items28 Mar 2025 0 repositories listed
-
CTRL-O: Language-Controllable Object-Centric Visual Representation Learning27 Mar 2025 0 repositories listed
-
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation26 Mar 2025 0 repositories listed
-
High Quality Diffusion Distillation on a Single GPU with Relative and Absolute Position Matching26 Mar 2025 0 repositories listed
-
LayerCraft: Enhancing Text-to-Image Generation with CoT Reasoning and Layered Object Integration25 Mar 2025 0 repositories listed
-
Reverse Prompt: Cracking the Recipe Inside Text-to-Image Generation25 Mar 2025 0 repositories listed
-
Plug-and-Play Interpretable Responsible Text-to-Image Generation via Dual-Space Multi-facet Concept Control24 Mar 2025 0 repositories listed
-
TDRI: Two-Phase Dialogue Refinement and Co-Adaptation for Interactive Image Generation22 Mar 2025 0 repositories listed
-
Leveraging Text-to-Image Generation for Handling Spurious Correlation21 Mar 2025 0 repositories listed
-
FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing20 Mar 2025 0 repositories listed
-
Advancing Deep Learning through Probability Engineering: A Pragmatic Paradigm for Modern AI19 Mar 2025 0 repositories listed
-
Di[M]O: Distilling Masked Diffusion Models into One-step Generator19 Mar 2025 0 repositories listed
-
Deeply Supervised Flow-Based Generative Models18 Mar 2025 0 repositories listed
-
18 Mar 2025 0 repositories listed
-
EditID: Training-Free Editable ID Customization for Text-to-Image Generation16 Mar 2025 0 repositories listed
-
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking14 Mar 2025 0 repositories listed
-
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation13 Mar 2025 0 repositories listed
-
DiT-Air: Revisiting the Efficiency of Diffusion Model Architecture Design in Text to Image Generation13 Mar 2025 0 repositories listed
-
Layton: Latent Consistency Tokenizer for 1024-pixel Image Reconstruction and Generation by 256 Tokens11 Mar 2025 0 repositories listed
-
LatexBlend: Scaling Multi-concept Customized Generation with Latent Textual Blending10 Mar 2025 0 repositories listed
-
Text-to-Image Diffusion Models Cannot Count, and Prompt Refinement Cannot Help10 Mar 2025 0 repositories listed
-
DynamicID: Zero-Shot Multi-ID Image Personalization with Flexible Facial Editability9 Mar 2025 0 repositories listed
-
PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation9 Mar 2025 0 repositories listed
-
Frequency Autoregressive Image Generation with Continuous Tokens7 Mar 2025 0 repositories listed
-
A Generative Approach to High Fidelity 3D Reconstruction from Text Data5 Mar 2025 0 repositories listed
-
Find Matching Faces Based On Face Parameters5 Mar 2025 0 repositories listed
-
ACCORD: Alleviating Concept Coupling through Dependence Regularization for Text-to-Image Diffusion Personalization3 Mar 2025 0 repositories listed
-
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage3 Mar 2025 0 repositories listed
-
How far can we go with ImageNet for Text-to-Image generation?28 Feb 2025 0 repositories listed
-
Analyzing CLIP's Performance Limitations in Multi-Object Scenarios: A Controlled High-Resolution Study27 Feb 2025 0 repositories listed
-
Culture-TRIP: Culturally-Aware Text-to-Image Generation with Iterative Prompt Refinement24 Feb 2025 0 repositories listed
-
Distributional Vision-Language Alignment by Cauchy-Schwarz Divergence24 Feb 2025 0 repositories listed
-
Unified Prompt Attack Against Text-to-Image Generation Models23 Feb 2025 0 repositories listed
-
FlipConcept: Tuning-Free Multi-Concept Personalization for Text-to-Image Generation21 Feb 2025 0 repositories listed
-
One-step Diffusion Models with f-Divergence Distribution Matching21 Feb 2025 0 repositories listed
-
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation19 Feb 2025 0 repositories listed
-
Multi-Faceted Multimodal Monosemanticity16 Feb 2025 0 repositories listed
-
Designing a Conditional Prior Distribution for Flow-Based Generative Models13 Feb 2025 0 repositories listed
-
Detecting Malicious Concepts Without Image Generation in AIGC13 Feb 2025 0 repositories listed
-
When the LM misunderstood the human chuckled: Analyzing garden path effects in humans and language models13 Feb 2025 0 repositories listed
-
ID-Cloak: Crafting Identity-Specific Cloaks Against Personalized Text-to-Image Generation12 Feb 2025 0 repositories listed
-
PoGDiff: Product-of-Gaussians Diffusion Models for Imbalanced Text-to-Image Generation12 Feb 2025 0 repositories listed
-
Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation12 Feb 2025 0 repositories listed
-
Classifier-Free Guidance: From High-Dimensional Analysis to Generalized Guidance Forms11 Feb 2025 0 repositories listed
-
FlexControl: Computation-Aware ControlNet with Differentiable Router for Text-to-Image Generation11 Feb 2025 0 repositories listed
-
Decoder-Only LLMs are Better Controllers for Diffusion Models6 Feb 2025 0 repositories listed
-
FairT2I: Mitigating Social Bias in Text-to-Image Generation via Large Language Model-Assisted Detection and Attribute Rebalancing6 Feb 2025 0 repositories listed
-
Generative Adversarial Networks Bridging Art and Machine Intelligence6 Feb 2025 0 repositories listed
-
Generative AI for Vision: A Comprehensive Study of Frameworks and Applications29 Jan 2025 0 repositories listed
-
Text-to-Image Generation for Vocabulary Learning Using the Keyword Method28 Jan 2025 0 repositories listed
-
LoRA-X: Bridging Foundation Models with Training-Free Cross-Model Adaptation27 Jan 2025 0 repositories listed
-
Accelerate High-Quality Diffusion Models with Inner Loop Feedback22 Jan 2025 0 repositories listed
-
LiT: Delving into a Simplified Linear Diffusion Transformer for Image Generation22 Jan 2025 0 repositories listed
-
PreciseCam: Precise Camera Control for Text-to-Image Generation22 Jan 2025 0 repositories listed
-
Parallel Sequence Modeling via Generalized Spatial Propagation Network21 Jan 2025 0 repositories listed
-
Know "No'' Better: A Data-Driven Approach for Enhancing Negation Awareness in CLIP19 Jan 2025 0 repositories listed
-
CookingDiffusion: Cooking Procedural Image Generation with Stable Diffusion15 Jan 2025 0 repositories listed
-
SHYI: Action Support for Contrastive Learning in High-Fidelity Text-to-Image Generation15 Jan 2025 0 repositories listed
-
Focus-N-Fix: Region-Aware Fine-Tuning for Text-to-Image Generation11 Jan 2025 0 repositories listed
-
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation7 Jan 2025 0 repositories listed
-
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation7 Jan 2025 0 repositories listed
-
Object-level Visual Prompts for Compositional Image Generation2 Jan 2025 0 repositories listed
-
Test-time Controllable Image Generation by Explicit Spatial Constraint Enforcement2 Jan 2025 0 repositories listed
-
Adapting Text-to-Image Generation with Feature Difference Instruction for Generic Image Restoration1 Jan 2025 0 repositories listed
-
Detect-and-Guide: Self-regulation of Diffusion Models for Safe Text-to-Image Generation via Guideline Token Optimization1 Jan 2025 0 repositories listed
-
Flowing from Words to Pixels: A Noise-Free Framework for Cross-Modality Evolution1 Jan 2025 0 repositories listed
-
Hierarchical Vision-Language Alignment for Text-to-Image Generation via Diffusion Models1 Jan 2025 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.