{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/image-generation/papers/45","list_of":"/task/image-generation","task":"Image Generation","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":45,"pages_in_order":67,"rows_per_page":100,"rows":[4401,4500],"of":6689,"counts":{"archive_papers_tagged":6689,"with_a_code_link":3102,"where_syntology_ran_a_sample":1223,"not_listed_spam_title":0,"listed":6689,"listed_where_code_ran":1223,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1063,"every_run_a_failure_of_syntologys_instrument":160,"listed_with_a_run_with_no_instrument_failure":1063,"listed_every_run_a_failure_of_syntologys_instrument":160,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/image-generation","prev":"/task/image-generation/papers/44","next":"/task/image-generation/papers/46","papers":[{"url":null,"slug":"redistill-residual-encoded-distillation-for","title":"ReDistill: Residual Encoded Distillation for Peak Memory Reduction","date":"2024-06-06","arxiv_id":"2406.03744","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-traffic-sign-recognition-with","title":"Enhancing Traffic Sign Recognition with Tailored Data Augmentation: Addressing Class Imbalance and Instance Scarcity","date":"2024-06-05","arxiv_id":"2406.03576","repositories_listed":0,"syntology":null},{"url":null,"slug":"inv-adapter-id-customization-generation-via","title":"Inv-Adapter: ID Customization Generation via Image Inversion and Lightweight Adapter","date":"2024-06-05","arxiv_id":"2406.02881","repositories_listed":0,"syntology":null},{"url":null,"slug":"understanding-the-limitations-of-diffusion","title":"Understanding the Limitations of Diffusion Concept Algebra Through Food","date":"2024-06-05","arxiv_id":"2406.03582","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhance-image-to-image-generation-with-llava","title":"Enhance Image-to-Image Generation with LLaVA-generated Prompts","date":"2024-06-04","arxiv_id":"2406.01956","repositories_listed":0,"syntology":null},{"url":null,"slug":"i4vgen-image-as-stepping-stone-for-text-to","title":"I4VGen: Image as Free Stepping Stone for Text-to-Video Generation","date":"2024-06-04","arxiv_id":"2406.02230","repositories_listed":0,"syntology":null},{"url":null,"slug":"plug-and-play-diffusion-distillation","title":"Plug-and-Play Diffusion Distillation","date":"2024-06-04","arxiv_id":"2406.01954","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-crystal-ball-hypothesis-in-diffusion","title":"The Crystal Ball Hypothesis in diffusion models: Anticipating object positions from initial noise","date":"2024-06-04","arxiv_id":"2406.01970","repositories_listed":0,"syntology":null},{"url":null,"slug":"clip-guided-attribute-aware-pretraining-for","title":"ATTIQA: Generalizable Image Quality Feature Extractor using Attribute-aware Pretraining","date":"2024-06-03","arxiv_id":"2406.01020","repositories_listed":0,"syntology":null},{"url":null,"slug":"cut-a-controllable-universal-and-training","title":"Anomaly Anything: Promptable Unseen Visual Anomaly Generation","date":"2024-06-03","arxiv_id":"2406.01078","repositories_listed":0,"syntology":null},{"url":null,"slug":"differentially-private-fine-tuning-of","title":"Differentially Private Fine-Tuning of Diffusion Models","date":"2024-06-03","arxiv_id":"2406.01355","repositories_listed":0,"syntology":null},{"url":null,"slug":"dimba-transformer-mamba-diffusion-models","title":"Dimba: Transformer-Mamba Diffusion Models","date":"2024-06-03","arxiv_id":"2406.01159","repositories_listed":0,"syntology":null},{"url":null,"slug":"it-s-a-feature-not-a-bug-measuring-creative","title":"It's a Feature, Not a Bug: Measuring Creative Fluidity in Image Generators","date":"2024-06-03","arxiv_id":"2406.18570","repositories_listed":0,"syntology":null},{"url":null,"slug":"multiedits-simultaneous-multi-aspect-editing","title":"ParallelEdits: Efficient Multi-object Image Editing","date":"2024-06-03","arxiv_id":"2406.00985","repositories_listed":0,"syntology":null},{"url":null,"slug":"pops-photo-inspired-diffusion-operators","title":"pOps: Photo-Inspired Diffusion Operators","date":"2024-06-03","arxiv_id":"2406.01300","repositories_listed":0,"syntology":null},{"url":null,"slug":"scenetextgen-layout-agnostic-scene-text-image","title":"Layout Agnostic Scene Text Image Synthesis with Diffusion Models","date":"2024-06-03","arxiv_id":"2406.01062","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-guided-controllable-mesh-refinement-for","title":"Text-guided Controllable Mesh Refinement for Interactive 3D Modeling","date":"2024-06-03","arxiv_id":"2406.01592","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-car-brand-classification-by","title":"Visual Car Brand Classification by Implementing a Synthetic Image Dataset Creation Pipeline","date":"2024-06-03","arxiv_id":"2406.01071","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-counterfactual-image-generation","title":"Enhancing Counterfactual Image Generation Using Mahalanobis Distance with Distribution Preferences in Feature Space","date":"2024-05-31","arxiv_id":"2405.20685","repositories_listed":0,"syntology":null},{"url":null,"slug":"information-theoretic-text-to-image-alignment","title":"Information Theoretic Text-to-Image Alignment","date":"2024-05-31","arxiv_id":"2405.20759","repositories_listed":0,"syntology":null},{"url":null,"slug":"kaleido-diffusion-improving-conditional","title":"Kaleido Diffusion: Improving Conditional Diffusion Models with Autoregressive Latent Modeling","date":"2024-05-31","arxiv_id":"2405.21048","repositories_listed":0,"syntology":null},{"url":null,"slug":"you-only-scan-once-efficient-multi-dimension","title":"You Only Scan Once: Efficient Multi-dimension Sequential Modeling with LightNet","date":"2024-05-31","arxiv_id":"2405.21022","repositories_listed":0,"syntology":null},{"url":null,"slug":"boost-your-own-human-image-generation-model","title":"Boost Your Human Image Generation Model via Direct Preference Optimization","date":"2024-05-30","arxiv_id":"2405.20216","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-3d-robotics-perception-using","title":"Learning 3D Robotics Perception using Inductive Priors","date":"2024-05-30","arxiv_id":"2405.20364","repositories_listed":0,"syntology":null},{"url":null,"slug":"rigid-a-training-free-and-model-agnostic","title":"RIGID: A Training-free and Model-Agnostic Framework for Robust AI-Generated Image Detection","date":"2024-05-30","arxiv_id":"2405.20112","repositories_listed":0,"syntology":null},{"url":null,"slug":"inpaint-biases-a-pathway-to-accurate-and","title":"Inpaint Biases: A Pathway to Accurate and Unbiased Image Generation","date":"2024-05-29","arxiv_id":"2405.18762","repositories_listed":0,"syntology":null},{"url":null,"slug":"patch-enhanced-mask-encoder-prompt-image","title":"Patch-enhanced Mask Encoder Prompt Image Generation","date":"2024-05-29","arxiv_id":"2405.19085","repositories_listed":0,"syntology":null},{"url":null,"slug":"quo-vadis-chatgpt-from-large-language-models","title":"Quo Vadis ChatGPT? From Large Language Models to Large Knowledge Models","date":"2024-05-29","arxiv_id":"2405.19561","repositories_listed":0,"syntology":null},{"url":null,"slug":"sketchtriplet-self-supervised-scenarized","title":"SketchTriplet: Self-Supervised Scenarized Sketch-Text-Image Triplet Generation","date":"2024-05-29","arxiv_id":"2405.18801","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-ethical-situation-of-dall-e-2","title":"The ethical situation of DALL-E 2","date":"2024-05-29","arxiv_id":"2405.19176","repositories_listed":0,"syntology":null},{"url":null,"slug":"topological-perspectives-on-optimal","title":"Topological Perspectives on Optimal Multimodal Embedding Spaces","date":"2024-05-29","arxiv_id":"2405.18867","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-to-hero-enhancing-zero-shot-novel-view","title":"Zero-to-Hero: Enhancing Zero-Shot Novel View Synthesis via Attention Map Filtering","date":"2024-05-29","arxiv_id":"2405.18677","repositories_listed":0,"syntology":null},{"url":null,"slug":"are-image-distributions-indistinguishable-to","title":"Are Images Indistinguishable to Humans Also Indistinguishable to Classifiers?","date":"2024-05-28","arxiv_id":"2405.18029","repositories_listed":0,"syntology":null},{"url":null,"slug":"mindformer-a-transformer-architecture-for","title":"MindFormer: Semantic Alignment of Multi-Subject fMRI for Brain Decoding","date":"2024-05-28","arxiv_id":"2405.17720","repositories_listed":0,"syntology":null},{"url":null,"slug":"anonymization-prompt-learning-for-facial","title":"Anonymization Prompt Learning for Facial Privacy-Preserving Text-to-Image Generation","date":"2024-05-27","arxiv_id":"2405.16895","repositories_listed":0,"syntology":null},{"url":"/paper/glauber-generative-model-discrete-diffusion","slug":"glauber-generative-model-discrete-diffusion","title":"Glauber Generative Model: Discrete Diffusion Models via Binary Classification","date":"2024-05-27","arxiv_id":"2405.17035","repositories_listed":0,"syntology":{"n":2,"n_ran":2,"n_constructed":0,"n_ran_checked":2,"n_instrument":0,"n_unverified":0,"n_honours":0,"n_violates":0,"n_no_contract":2,"n_pointer_only":0,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","sample_list":"/paper/glauber-generative-model-discrete-diffusion#ran","syntology_url":"https://syntology.ai/paper/2405.17035","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2405.17035"}},"official":null}},{"url":null,"slug":"refdrop-controllable-consistency-in-image-or","title":"RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance","date":"2024-05-27","arxiv_id":"2405.17661","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-poisson-midpoint-method-for-langevin","title":"The Poisson Midpoint Method for Langevin Dynamics: Provably Efficient Discretization for Diffusion Models","date":"2024-05-27","arxiv_id":"2405.17068","repositories_listed":0,"syntology":null},{"url":null,"slug":"tie-revolutionizing-text-based-image-editing","title":"TIE: Revolutionizing Text-based Image Editing for Complex-Prompt Following and High-Fidelity Editing","date":"2024-05-27","arxiv_id":"2405.16803","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-free-editioning-of-text-to-image","title":"Training-free Editioning of Text-to-Image Models","date":"2024-05-27","arxiv_id":"2405.17069","repositories_listed":0,"syntology":null},{"url":null,"slug":"unified-editing-of-panorama-3d-scenes-and","title":"Unified Editing of Panorama, 3D Scenes, and Videos Through Disentangled Self-Attention Injection","date":"2024-05-27","arxiv_id":"2405.16823","repositories_listed":0,"syntology":null},{"url":null,"slug":"method-and-software-tool-for-generating","title":"Method and Software Tool for Generating Artificial Databases of Biomedical Images Based on Deep Neural Networks","date":"2024-05-25","arxiv_id":"2405.16119","repositories_listed":0,"syntology":null},{"url":null,"slug":"scaling-diffusion-mamba-with-bidirectional","title":"Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation","date":"2024-05-24","arxiv_id":"2405.15881","repositories_listed":0,"syntology":null},{"url":null,"slug":"sg-adapter-enhancing-text-to-image-generation","title":"SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance","date":"2024-05-24","arxiv_id":"2405.15321","repositories_listed":0,"syntology":null},{"url":null,"slug":"stylemaster-towards-flexible-stylized-image","title":"ArtWeaver: Advanced Dynamic Style Integration via Diffusion Model","date":"2024-05-24","arxiv_id":"2405.15287","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-models-for-gaussian-distributions","title":"Diffusion models for Gaussian distributions: Exact solutions and Wasserstein errors","date":"2024-05-23","arxiv_id":"2405.14250","repositories_listed":0,"syntology":null},{"url":null,"slug":"exposure-diffusion-hdr-image-generation-by","title":"Bracket Diffusion: HDR Image Generation by Consistent LDR Denoising","date":"2024-05-23","arxiv_id":"2405.14304","repositories_listed":0,"syntology":null},{"url":null,"slug":"freetuner-any-subject-in-any-style-with","title":"FreeTuner: Any Subject in Any Style with Training-free Diffusion","date":"2024-05-23","arxiv_id":"2405.14201","repositories_listed":0,"syntology":null},{"url":null,"slug":"good-seed-makes-a-good-crop-discovering","title":"Good Seed Makes a Good Crop: Discovering Secret Seeds in Text-to-Image Diffusion Models","date":"2024-05-23","arxiv_id":"2405.14828","repositories_listed":0,"syntology":null},{"url":null,"slug":"lg-vq-language-guided-codebook-learning","title":"LG-VQ: Language-Guided Codebook Learning","date":"2024-05-23","arxiv_id":"2405.14206","repositories_listed":0,"syntology":null},{"url":null,"slug":"litevae-lightweight-and-efficient-variational","title":"LiteVAE: Lightweight and Efficient Variational Autoencoders for Latent Diffusion Models","date":"2024-05-23","arxiv_id":"2405.14477","repositories_listed":0,"syntology":null},{"url":null,"slug":"opflowtalker-realistic-and-natural-talking","title":"OpFlowTalker: Realistic and Natural Talking Face Generation via Optical Flow Guidance","date":"2024-05-23","arxiv_id":"2405.14709","repositories_listed":0,"syntology":null},{"url":null,"slug":"reinforcement-learning-for-fine-tuning-text-1","title":"DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models","date":"2024-05-23","arxiv_id":"2405.14632","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantica-an-adaptable-image-conditioned","title":"Conditional Diffusion on Web-Scale Image Pairs leads to Diverse Image Variations","date":"2024-05-23","arxiv_id":"2405.14857","repositories_listed":0,"syntology":null},{"url":null,"slug":"time-cell-inspired-temporal-codebook-in","title":"Time Cell Inspired Temporal Codebook in Spiking Neural Networks for Enhanced Image Generation","date":"2024-05-23","arxiv_id":"2405.14474","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-study-of-posterior-stability-for-time","title":"A Study of Posterior Stability for Time-Series Latent Diffusion","date":"2024-05-22","arxiv_id":"2405.14021","repositories_listed":0,"syntology":null},{"url":"/paper/learning-latent-space-hierarchical-ebm","slug":"learning-latent-space-hierarchical-ebm","title":"Learning Latent Space Hierarchical EBM Diffusion Models","date":"2024-05-22","arxiv_id":"2405.13910","repositories_listed":0,"syntology":null},{"url":null,"slug":"metaearth-a-generative-foundation-model-for","title":"MetaEarth: A Generative Foundation Model for Global-Scale Remote Sensing Image Generation","date":"2024-05-22","arxiv_id":"2405.13570","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-analysis-of-prediction-uncertainty-in","title":"Visual Analysis of Prediction Uncertainty in Neural Networks for Deep Image Synthesis","date":"2024-05-22","arxiv_id":"2406.18545","repositories_listed":0,"syntology":null},{"url":null,"slug":"computational-tradeoffs-in-image-synthesis","title":"Computational Tradeoffs in Image Synthesis: Diffusion, Masked-Token, and Next-Token Prediction","date":"2024-05-21","arxiv_id":"2405.13218","repositories_listed":0,"syntology":null},{"url":null,"slug":"customtext-customized-textual-image","title":"CustomText: Customized Textual Image Generation using Diffusion Models","date":"2024-05-21","arxiv_id":"2405.12531","repositories_listed":0,"syntology":null},{"url":null,"slug":"personalized-residuals-for-concept-driven","title":"Personalized Residuals for Concept-Driven Text-to-Image Generation","date":"2024-05-21","arxiv_id":"2405.12978","repositories_listed":0,"syntology":null},{"url":null,"slug":"trilora-integrating-svd-for-advanced-style","title":"TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation","date":"2024-05-18","arxiv_id":"2405.11236","repositories_listed":0,"syntology":null},{"url":null,"slug":"upam-unified-prompt-attack-in-text-to-image","title":"UPAM: Unified Prompt Attack in Text-to-Image Generation Models Against Both Textual Filters and Visual Checkers","date":"2024-05-18","arxiv_id":"2405.11336","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-face-generation-quality-and-prompt","title":"Improving face generation quality and prompt following with synthetic captions","date":"2024-05-17","arxiv_id":"2405.10864","repositories_listed":0,"syntology":null},{"url":null,"slug":"lean-attention-hardware-aware-scalable","title":"Lean Attention: Hardware-Aware Scalable Attention Mechanism for the Decode-Phase of Transformers","date":"2024-05-17","arxiv_id":"2405.10480","repositories_listed":0,"syntology":null},{"url":null,"slug":"kpndepth-depth-estimation-of-lane-images","title":"KPNDepth: Depth Estimation of Lane Images under Complex Rainy Environment","date":"2024-05-16","arxiv_id":"2405.09964","repositories_listed":0,"syntology":null},{"url":null,"slug":"medisyn-text-guided-diffusion-models-for","title":"MediSyn: Text-Guided Diffusion Models for Broad Medical 2D and 3D Image Synthesis","date":"2024-05-16","arxiv_id":"2405.09806","repositories_listed":0,"syntology":null},{"url":null,"slug":"virtualmodel-generating-object-id-retentive","title":"VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing","date":"2024-05-16","arxiv_id":"2405.09985","repositories_listed":0,"syntology":null},{"url":null,"slug":"global-local-image-perceptual-score-glips","title":"Global-Local Image Perceptual Score (GLIPS): Evaluating Photorealistic Quality of AI-Generated Images","date":"2024-05-15","arxiv_id":"2405.09426","repositories_listed":0,"syntology":null},{"url":null,"slug":"visioblend-sketch-and-stroke-guided-denoising","title":"VisioBlend: Sketch and Stroke-Guided Denoising Diffusion Probabilistic Model for Realistic Image Generation","date":"2024-05-15","arxiv_id":"2407.05209","repositories_listed":0,"syntology":null},{"url":null,"slug":"compositional-text-to-image-generation-with","title":"Compositional Text-to-Image Generation with Dense Blob Representations","date":"2024-05-14","arxiv_id":"2405.08246","repositories_listed":0,"syntology":null},{"url":null,"slug":"similarity-metrics-for-mr-image-to-image","title":"Similarity and Quality Metrics for MR Image-To-Image Translation","date":"2024-05-14","arxiv_id":"2405.08431","repositories_listed":0,"syntology":null},{"url":null,"slug":"sar-image-synthesis-with-diffusion-models","title":"SAR Image Synthesis with Diffusion Models","date":"2024-05-13","arxiv_id":"2405.07776","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-free-subject-enhanced-attention","title":"Training-free Subject-Enhanced Attention Guidance for Compositional Text-to-image Generation","date":"2024-05-11","arxiv_id":"2405.06948","repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-image-generation-with-composed","title":"Controllable Image Generation With Composed Parallel Token Prediction","date":"2024-05-10","arxiv_id":"2405.06535","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-mmd-gradient-flow-without-adversarial","title":"Deep MMD Gradient Flow without adversarial training","date":"2024-05-10","arxiv_id":"2405.06780","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-personalized-content-synthesis","title":"A Survey on Personalized Content Synthesis with Diffusion Models","date":"2024-05-09","arxiv_id":"2405.05538","repositories_listed":0,"syntology":null},{"url":null,"slug":"vm-ddpm-vision-mamba-diffusion-for-medical","title":"VM-DDPM: Vision Mamba Diffusion for Medical Image Synthesis","date":"2024-05-09","arxiv_id":"2405.05667","repositories_listed":0,"syntology":null},{"url":null,"slug":"discrepancy-based-diffusion-models-for-lesion","title":"Discrepancy-based Diffusion Models for Lesion Detection in Brain MRI","date":"2024-05-08","arxiv_id":"2405.04974","repositories_listed":0,"syntology":null},{"url":null,"slug":"flexecontrol-flexible-and-efficient","title":"FlexEControl: Flexible and Efficient Multimodal Control for Text-to-Image Generation","date":"2024-05-08","arxiv_id":"2405.04834","repositories_listed":0,"syntology":null},{"url":null,"slug":"hagan-hybrid-augmented-generative-adversarial","title":"HAGAN: Hybrid Augmented Generative Adversarial Network for Medical Image Synthesis","date":"2024-05-08","arxiv_id":"2405.04902","repositories_listed":0,"syntology":null},{"url":"/paper/variational-schrodinger-diffusion-models","slug":"variational-schrodinger-diffusion-models","title":"Variational Schrödinger Diffusion Models","date":"2024-05-08","arxiv_id":"2405.04795","repositories_listed":0,"syntology":null},{"url":null,"slug":"resnct-a-deep-learning-model-for-the","title":"ResNCT: A Deep Learning Model for the Synthesis of Nephrographic Phase Images in CT Urography","date":"2024-05-07","arxiv_id":"2405.04629","repositories_listed":0,"syntology":null},{"url":null,"slug":"simple-drop-in-lora-conditioning-on-attention","title":"Simple Drop-in LoRA Conditioning on Attention Layers Will Improve Your Diffusion Model","date":"2024-05-07","arxiv_id":"2405.03958","repositories_listed":0,"syntology":null},{"url":null,"slug":"texcontrol-sketch-based-two-stage-fashion","title":"TexControl: Sketch-Based Two-Stage Fashion Image Generation Using Diffusion Model","date":"2024-05-07","arxiv_id":"2405.04675","repositories_listed":0,"syntology":null},{"url":null,"slug":"generated-contents-enrichment","title":"Generated Contents Enrichment","date":"2024-05-06","arxiv_id":"2405.03650","repositories_listed":0,"syntology":null},{"url":null,"slug":"defect-image-sample-generation-with-diffusion","title":"Defect Image Sample Generation With Diffusion Prior for Steel Surface Defect Recognition","date":"2024-05-03","arxiv_id":"2405.01872","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-method-integration-with-confidence","title":"Multi-method Integration with Confidence-based Weighting for Zero-shot Image Classification","date":"2024-05-03","arxiv_id":"2405.02155","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-subject-driven-image-synthesis-with","title":"Improving Subject-Driven Image Synthesis with Subject-Agnostic Guidance","date":"2024-05-02","arxiv_id":"2405.01356","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-inclusive-face-recognition-through","title":"Towards Inclusive Face Recognition Through Synthetic Ethnicity Alteration","date":"2024-05-02","arxiv_id":"2405.01273","repositories_listed":0,"syntology":null},{"url":null,"slug":"compressive-sensing-imaging-using-caustic","title":"Compressive Sensing Imaging Using Caustic Lens Mask Generated by Periodic Perturbation in a Ripple Tank","date":"2024-05-01","arxiv_id":"2405.00407","repositories_listed":0,"syntology":null},{"url":null,"slug":"guided-conditional-diffusion-classifier","title":"Guided Conditional Diffusion Classifier (ConDiff) for Enhanced Prediction of Infection in Diabetic Foot Ulcers","date":"2024-05-01","arxiv_id":"2405.00858","repositories_listed":0,"syntology":null},{"url":null,"slug":"rgb-leftrightarrow-x-image-decomposition-and","title":"RGB$\\leftrightarrow$X: Image decomposition and synthesis using material- and lighting-aware diffusion models","date":"2024-05-01","arxiv_id":"2405.00666","repositories_listed":0,"syntology":null},{"url":null,"slug":"sonicdiffusion-audio-driven-image-generation","title":"SonicDiffusion: Audio-Driven Image Generation and Editing with Pretrained Diffusion Models","date":"2024-05-01","arxiv_id":"2405.00878","repositories_listed":0,"syntology":null},{"url":null,"slug":"streamlining-image-editing-with-layered","title":"Streamlining Image Editing with Layered Diffusion Brushes","date":"2024-05-01","arxiv_id":"2405.00313","repositories_listed":0,"syntology":null},{"url":null,"slug":"docci-descriptions-of-connected-and","title":"DOCCI: Descriptions of Connected and Contrasting Images","date":"2024-04-30","arxiv_id":"2404.19753","repositories_listed":0,"syntology":null},{"url":null,"slug":"instantfamily-masked-attention-for-zero-shot","title":"InstantFamily: Masked Attention for Zero-shot Multi-ID Image Generation","date":"2024-04-30","arxiv_id":"2404.19427","repositories_listed":0,"syntology":null},{"url":null,"slug":"nerf-insert-3d-local-editing-with-multimodal","title":"NeRF-Insert: 3D Local Editing with Multimodal Control Signals","date":"2024-04-30","arxiv_id":"2404.19204","repositories_listed":0,"syntology":null},{"url":null,"slug":"swipeganspace-swipe-to-compare-image","title":"SwipeGANSpace: Swipe-to-Compare Image Generation via Efficient Latent Space Exploration","date":"2024-04-30","arxiv_id":"2404.19693","repositories_listed":0,"syntology":null}],"record_sha256":"e386c9945aedc6357a1baa09e1178270933ecd59228d84abecdb23cecf6d54b2","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}