Browse State-of-the-Art › Text-to-Image Generation › Papers, page 7
Text-to-Image Generation
Papers archive 2025-07-28
archive papers tagged: 1,085 · with a code link: 546 · where Syntology ran a sample: 246 (215 with a run with no instrument failure, 31 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (246 of 1,085 tagged: 215 with a run with no instrument failure, 31 where every run was a failure of Syntology's instrument)
Page 7 of 11: papers 601 to 700 of 1,085, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
PRISM: A Unified Framework for Photorealistic Reconstruction and Intrinsic Scene Modeling19 Apr 2025 0 repositories listed
-
Towards NSFW-Free Text-to-Image Generation via Safety-Constraint Direct Preference Optimization19 Apr 2025 0 repositories listed
-
Entropy Rectifying Guidance for Diffusion and Flow Models18 Apr 2025 0 repositories listed
-
POET: Supporting Prompting Creativity and Personalization with Automated Expansion of Text-to-Image Generation18 Apr 2025 0 repositories listed
-
SMPL-GPTexture: Dual-View 3D Human Texture Estimation using Text-to-Image Generation Models17 Apr 2025 0 repositories listed
-
Instruction-augmented Multimodal Alignment for Image-Text and Element Matching16 Apr 2025 0 repositories listed
-
Using LLMs as prompt modifier to avoid biases in AI image generators15 Apr 2025 0 repositories listed
-
InstructEngine: Instruction-driven Text-to-Image Alignment14 Apr 2025 0 repositories listed
-
Towards Explainable Partial-AIGC Image Quality Assessment12 Apr 2025 0 repositories listed
-
Muon-Accelerated Attention Distillation for Real-Time Edge Synthesis via Optimized Latent Diffusion11 Apr 2025 0 repositories listed
-
10 Apr 2025 0 repositories listed
-
Compass Control: Multi Object Orientation Control for Text-to-Image Generation9 Apr 2025 0 repositories listed
-
Storybooth: Training-free Multi-Subject Consistency for Improved Visual Storytelling8 Apr 2025 0 repositories listed
-
8 Apr 2025 0 repositories listed
-
FineLIP: Extending CLIP's Reach via Fine-Grained Alignment with Longer Text Inputs2 Apr 2025 0 repositories listed
-
Semantic Packet Aggregation and Repeated Transmission for Text-to-Image Generation31 Mar 2025 0 repositories listed
-
On Geometrical Properties of Text Token Embeddings for Strong Semantic Binding in Text-to-Image Generation29 Mar 2025 0 repositories listed
-
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers28 Mar 2025 0 repositories listed
-
ORIGEN: Zero-Shot 3D Orientation Grounding in Text-to-Image Generation28 Mar 2025 0 repositories listed
-
Sell It Before You Make It: Revolutionizing E-Commerce with Personalized AI-Generated Items28 Mar 2025 0 repositories listed
-
CTRL-O: Language-Controllable Object-Centric Visual Representation Learning27 Mar 2025 0 repositories listed
-
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation26 Mar 2025 0 repositories listed
-
High Quality Diffusion Distillation on a Single GPU with Relative and Absolute Position Matching26 Mar 2025 0 repositories listed
-
LayerCraft: Enhancing Text-to-Image Generation with CoT Reasoning and Layered Object Integration25 Mar 2025 0 repositories listed
-
Reverse Prompt: Cracking the Recipe Inside Text-to-Image Generation25 Mar 2025 0 repositories listed
-
Plug-and-Play Interpretable Responsible Text-to-Image Generation via Dual-Space Multi-facet Concept Control24 Mar 2025 0 repositories listed
-
TDRI: Two-Phase Dialogue Refinement and Co-Adaptation for Interactive Image Generation22 Mar 2025 0 repositories listed
-
Leveraging Text-to-Image Generation for Handling Spurious Correlation21 Mar 2025 0 repositories listed
-
FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing20 Mar 2025 0 repositories listed
-
Advancing Deep Learning through Probability Engineering: A Pragmatic Paradigm for Modern AI19 Mar 2025 0 repositories listed
-
Di[M]O: Distilling Masked Diffusion Models into One-step Generator19 Mar 2025 0 repositories listed
-
Deeply Supervised Flow-Based Generative Models18 Mar 2025 0 repositories listed
-
18 Mar 2025 0 repositories listed
-
EditID: Training-Free Editable ID Customization for Text-to-Image Generation16 Mar 2025 0 repositories listed
-
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking14 Mar 2025 0 repositories listed
-
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation13 Mar 2025 0 repositories listed
-
DiT-Air: Revisiting the Efficiency of Diffusion Model Architecture Design in Text to Image Generation13 Mar 2025 0 repositories listed
-
Layton: Latent Consistency Tokenizer for 1024-pixel Image Reconstruction and Generation by 256 Tokens11 Mar 2025 0 repositories listed
-
LatexBlend: Scaling Multi-concept Customized Generation with Latent Textual Blending10 Mar 2025 0 repositories listed
-
Text-to-Image Diffusion Models Cannot Count, and Prompt Refinement Cannot Help10 Mar 2025 0 repositories listed
-
DynamicID: Zero-Shot Multi-ID Image Personalization with Flexible Facial Editability9 Mar 2025 0 repositories listed
-
PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation9 Mar 2025 0 repositories listed
-
Frequency Autoregressive Image Generation with Continuous Tokens7 Mar 2025 0 repositories listed
-
A Generative Approach to High Fidelity 3D Reconstruction from Text Data5 Mar 2025 0 repositories listed
-
Find Matching Faces Based On Face Parameters5 Mar 2025 0 repositories listed
-
ACCORD: Alleviating Concept Coupling through Dependence Regularization for Text-to-Image Diffusion Personalization3 Mar 2025 0 repositories listed
-
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage3 Mar 2025 0 repositories listed
-
How far can we go with ImageNet for Text-to-Image generation?28 Feb 2025 0 repositories listed
-
Analyzing CLIP's Performance Limitations in Multi-Object Scenarios: A Controlled High-Resolution Study27 Feb 2025 0 repositories listed
-
Culture-TRIP: Culturally-Aware Text-to-Image Generation with Iterative Prompt Refinement24 Feb 2025 0 repositories listed
-
Distributional Vision-Language Alignment by Cauchy-Schwarz Divergence24 Feb 2025 0 repositories listed
-
Unified Prompt Attack Against Text-to-Image Generation Models23 Feb 2025 0 repositories listed
-
FlipConcept: Tuning-Free Multi-Concept Personalization for Text-to-Image Generation21 Feb 2025 0 repositories listed
-
One-step Diffusion Models with f-Divergence Distribution Matching21 Feb 2025 0 repositories listed
-
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation19 Feb 2025 0 repositories listed
-
Multi-Faceted Multimodal Monosemanticity16 Feb 2025 0 repositories listed
-
Designing a Conditional Prior Distribution for Flow-Based Generative Models13 Feb 2025 0 repositories listed
-
Detecting Malicious Concepts Without Image Generation in AIGC13 Feb 2025 0 repositories listed
-
When the LM misunderstood the human chuckled: Analyzing garden path effects in humans and language models13 Feb 2025 0 repositories listed
-
ID-Cloak: Crafting Identity-Specific Cloaks Against Personalized Text-to-Image Generation12 Feb 2025 0 repositories listed
-
PoGDiff: Product-of-Gaussians Diffusion Models for Imbalanced Text-to-Image Generation12 Feb 2025 0 repositories listed
-
Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation12 Feb 2025 0 repositories listed
-
Classifier-Free Guidance: From High-Dimensional Analysis to Generalized Guidance Forms11 Feb 2025 0 repositories listed
-
FlexControl: Computation-Aware ControlNet with Differentiable Router for Text-to-Image Generation11 Feb 2025 0 repositories listed
-
Decoder-Only LLMs are Better Controllers for Diffusion Models6 Feb 2025 0 repositories listed
-
FairT2I: Mitigating Social Bias in Text-to-Image Generation via Large Language Model-Assisted Detection and Attribute Rebalancing6 Feb 2025 0 repositories listed
-
Generative Adversarial Networks Bridging Art and Machine Intelligence6 Feb 2025 0 repositories listed
-
Generative AI for Vision: A Comprehensive Study of Frameworks and Applications29 Jan 2025 0 repositories listed
-
Text-to-Image Generation for Vocabulary Learning Using the Keyword Method28 Jan 2025 0 repositories listed
-
LoRA-X: Bridging Foundation Models with Training-Free Cross-Model Adaptation27 Jan 2025 0 repositories listed
-
Accelerate High-Quality Diffusion Models with Inner Loop Feedback22 Jan 2025 0 repositories listed
-
LiT: Delving into a Simplified Linear Diffusion Transformer for Image Generation22 Jan 2025 0 repositories listed
-
PreciseCam: Precise Camera Control for Text-to-Image Generation22 Jan 2025 0 repositories listed
-
Parallel Sequence Modeling via Generalized Spatial Propagation Network21 Jan 2025 0 repositories listed
-
Know "No'' Better: A Data-Driven Approach for Enhancing Negation Awareness in CLIP19 Jan 2025 0 repositories listed
-
CookingDiffusion: Cooking Procedural Image Generation with Stable Diffusion15 Jan 2025 0 repositories listed
-
SHYI: Action Support for Contrastive Learning in High-Fidelity Text-to-Image Generation15 Jan 2025 0 repositories listed
-
Focus-N-Fix: Region-Aware Fine-Tuning for Text-to-Image Generation11 Jan 2025 0 repositories listed
-
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation7 Jan 2025 0 repositories listed
-
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation7 Jan 2025 0 repositories listed
-
Object-level Visual Prompts for Compositional Image Generation2 Jan 2025 0 repositories listed
-
Test-time Controllable Image Generation by Explicit Spatial Constraint Enforcement2 Jan 2025 0 repositories listed
-
Adapting Text-to-Image Generation with Feature Difference Instruction for Generic Image Restoration1 Jan 2025 0 repositories listed
-
Detect-and-Guide: Self-regulation of Diffusion Models for Safe Text-to-Image Generation via Guideline Token Optimization1 Jan 2025 0 repositories listed
-
Flowing from Words to Pixels: A Noise-Free Framework for Cross-Modality Evolution1 Jan 2025 0 repositories listed
-
Hierarchical Vision-Language Alignment for Text-to-Image Generation via Diffusion Models1 Jan 2025 0 repositories listed
-
MC^2: Multi-concept Guidance for Customized Multi-concept Generation1 Jan 2025 0 repositories listed
-
Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception1 Jan 2025 0 repositories listed
-
SKE-Layout: Spatial Knowledge Enhanced Layout Generation with LLMs1 Jan 2025 0 repositories listed
-
VODiff: Controlling Object Visibility Order in Text-to-Image Generation1 Jan 2025 0 repositories listed
-
Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation30 Dec 2024 0 repositories listed
-
Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales27 Dec 2024 0 repositories listed
-
UNIC-Adapter: Unified Image-instruction Adapter with Multi-modal Transformer for Image Generation25 Dec 2024 0 repositories listed
-
1.58-bit FLUX24 Dec 2024 0 repositories listed
-
Self-Corrected Flow Distillation for Consistent One-Step and Few-Step Text-to-Image Generation22 Dec 2024 0 repositories listed
-
Flowing from Words to Pixels: A Framework for Cross-Modality Evolution19 Dec 2024 0 repositories listed
-
GALOT: Generative Active Learning via Optimizable Zero-shot Text-to-image Generation18 Dec 2024 0 repositories listed
-
A LoRA is Worth a Thousand Pictures16 Dec 2024 0 repositories listed
-
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation16 Dec 2024 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.