{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/image-generation/papers/49","list_of":"/task/image-generation","task":"Image Generation","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":49,"pages_in_order":67,"rows_per_page":100,"rows":[4801,4900],"of":6689,"counts":{"archive_papers_tagged":6689,"with_a_code_link":3102,"where_syntology_ran_a_sample":1223,"not_listed_spam_title":0,"listed":6689,"listed_where_code_ran":1223,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1063,"every_run_a_failure_of_syntologys_instrument":160,"listed_with_a_run_with_no_instrument_failure":1063,"listed_every_run_a_failure_of_syntologys_instrument":160,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/image-generation","prev":"/task/image-generation/papers/48","next":"/task/image-generation/papers/50","papers":[{"url":null,"slug":"a-vision-check-up-for-language-models","title":"A Vision Check-up for Language Models","date":"2024-01-03","arxiv_id":"2401.01862","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-we-generate-realistic-hands-only-using","title":"GeoPos: A Minimal Positional Encoding for Enhanced Fine-Grained Details in Image Synthesis Using Convolutional Neural Networks","date":"2024-01-03","arxiv_id":"2401.01951","repositories_listed":0,"syntology":null},{"url":null,"slug":"ddpm-based-x-ray-image-synthesizer","title":"DDPM based X-ray Image Synthesizer","date":"2024-01-03","arxiv_id":"2401.01539","repositories_listed":0,"syntology":null},{"url":null,"slug":"few-shot-image-generation-via-information","title":"Few-shot Image Generation via Information Transfer from the Built Geodesic Surface","date":"2024-01-03","arxiv_id":"2401.01749","repositories_listed":0,"syntology":null},{"url":null,"slug":"instruct-imagen-image-generation-with-multi","title":"Instruct-Imagen: Image Generation with Multi-modal Instruction","date":"2024-01-03","arxiv_id":"2401.01952","repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-generative-modeling-of-scene-graphs-and","title":"Joint Generative Modeling of Scene Graphs and Images via Diffusion Models","date":"2024-01-02","arxiv_id":"2401.01130","repositories_listed":0,"syntology":null},{"url":null,"slug":"ssp-a-simple-and-safe-automatic-prompt","title":"SSP: A Simple and Safe automatic Prompt engineering method towards realistic image synthesis on LVM","date":"2024-01-02","arxiv_id":"2401.01128","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-text-to-continuous-image","title":"Adversarial Text to Continuous Image Generation","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"anyscene-customized-image-synthesis-with","title":"AnyScene: Customized Image Synthesis with Composited Foreground","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"check-locate-rectify-a-training-free-layout-1","title":"Check Locate Rectify: A Training-Free Layout Calibration System for Text-to-Image Generation","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"codi-2-in-context-interleaved-and-interactive-1","title":"CoDi-2: In-Context Interleaved and Interactive Any-to-Any Generation","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"countering-personalized-text-to-image","title":"Countering Personalized Text-to-Image Generation with Influence Watermarks","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"diffmorph-text-less-image-morphing-with","title":"DiffMorph: Text-less Image Morphing with Diffusion Models","date":"2024-01-01","arxiv_id":"2401.00739","repositories_listed":0,"syntology":null},{"url":null,"slug":"generate-subgoal-images-before-act-unlocking","title":"Generate Subgoal Images before Act: Unlocking the Chain-of-Thought Reasoning in Diffusion Model for Robot Manipulation with Multimodal Prompts","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-coupled-dictionaries-from-unpaired","title":"Learning Coupled Dictionaries from Unpaired Data for Image Super-Resolution","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-diffusion-texture-priors-for-image","title":"Learning Diffusion Texture Priors for Image Restoration","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"magick-a-large-scale-captioned-dataset-from","title":"MAGICK: A Large-scale Captioned Dataset from Matting Generated Images using Chroma Keying","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"one-dimensional-adapter-to-rule-them-all-1","title":"One-dimensional Adapter to Rule Them All: Concepts Diffusion Models and Erasing Applications","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"parenerf-toward-fast-large-scale-dynamic-nerf","title":"PaReNeRF: Toward Fast Large-scale Dynamic NeRF with Patch-based Reference","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"taming-stable-diffusion-for-text-to-360","title":"Taming Stable Diffusion for Text to 360 Panorama Image Generation","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"text-conditional-attribute-alignment-across","title":"Text-conditional Attribute Alignment across Latent Spaces for 3D Controllable Face Image Synthesis","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"training-diffusion-models-towards-diverse","title":"Training Diffusion Models Towards Diverse Image Generation with Reinforcement Learning","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unified-io-2-scaling-autoregressive-1","title":"Unified-IO 2: Scaling Autoregressive Multimodal Models with Vision Language Audio and Action","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unmixing-before-fusion-a-generalized-paradigm","title":"Unmixing Before Fusion: A Generalized Paradigm for Multi-Source-based Hyperspectral Image Synthesis","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"vector-graphics-generation-via-mutually","title":"Vector Graphics Generation via Mutually Impulsed Dual-domain Diffusion","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"video-prediction-by-modeling-videos-as","title":"Video Prediction by Modeling Videos as Continuous Multi-Dimensional Processes","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"zerorf-fast-sparse-view-360deg-reconstruction-1","title":"ZeroRF: Fast Sparse View 360deg Reconstruction with Zero Pretraining","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"rainsd-rain-style-diversification-module-for","title":"RainSD: Rain Style Diversification Module for Image Synthesis Enhancement using Feature-Level Style Distribution","date":"2023-12-31","arxiv_id":"2401.00460","repositories_listed":0,"syntology":null},{"url":null,"slug":"gan-ga-a-generative-model-based-on-genetic","title":"GAN-GA: A Generative Model based on Genetic Algorithm for Medical Image Generation","date":"2023-12-30","arxiv_id":"2401.00314","repositories_listed":0,"syntology":null},{"url":null,"slug":"gazeclip-towards-enhancing-gaze-estimation","title":"GazeCLIP: Towards Enhancing Gaze Estimation via Text Guidance","date":"2023-12-30","arxiv_id":"2401.00260","repositories_listed":0,"syntology":null},{"url":null,"slug":"cyclegan-models-for-mri-image-translation","title":"CycleGAN Models for MRI Image Translation","date":"2023-12-28","arxiv_id":"2401.00023","repositories_listed":0,"syntology":null},{"url":null,"slug":"pangu-draw-advancing-resource-efficient-text","title":"PanGu-Draw: Advancing Resource-Efficient Text-to-Image Synthesis with Time-Decoupled Training and Reusable Coop-Diffusion","date":"2023-12-27","arxiv_id":"2312.16486","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-expansion-for-adaptive-text-to-image","title":"Prompt Expansion for Adaptive Text-to-Image Generation","date":"2023-12-27","arxiv_id":"2312.16720","repositories_listed":0,"syntology":null},{"url":null,"slug":"refinenet-enhancing-text-to-image-conversion","title":"RefineNet: Enhancing Text-to-Image Conversion with High-Resolution and Detail Accuracy through Hierarchical Transformers and Progressive Refinement","date":"2023-12-27","arxiv_id":"2312.17274","repositories_listed":0,"syntology":null},{"url":null,"slug":"high-fidelity-diffusion-based-image-editing","title":"High-Fidelity Diffusion-based Image Editing","date":"2023-12-25","arxiv_id":"2312.15707","repositories_listed":0,"syntology":null},{"url":null,"slug":"make-a-character-high-quality-text-to-3d","title":"Make-A-Character: High Quality Text-to-3D Character Generation within Minutes","date":"2023-12-24","arxiv_id":"2312.15430","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-propose-verify-a-reliable-hand-object","title":"Prompt-Propose-Verify: A Reliable Hand-Object-Interaction Data Generation Framework using Foundational Models","date":"2023-12-23","arxiv_id":"2312.15247","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-draw-engineering-for-text-to-image","title":"Semantic Draw Engineering for Text-to-Image Creation","date":"2023-12-23","arxiv_id":"2401.04116","repositories_listed":0,"syntology":null},{"url":null,"slug":"emage-non-autoregressive-text-to-image","title":"Emage: Non-Autoregressive Text-to-Image Generation","date":"2023-12-22","arxiv_id":"2312.14988","repositories_listed":0,"syntology":null},{"url":null,"slug":"environment-specific-people","title":"Synthesizing Environment-Specific People in Photographs","date":"2023-12-22","arxiv_id":"2312.14579","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-ai-and-the-history-of-architecture","title":"Generative AI and the History of Architecture","date":"2023-12-22","arxiv_id":"2312.15106","repositories_listed":0,"syntology":null},{"url":null,"slug":"diff-oracle-diffusion-model-for-oracle","title":"Diff-Oracle: Deciphering Oracle Bone Scripts with Controllable Diffusion Model","date":"2023-12-21","arxiv_id":"2312.13631","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamtuner-single-image-is-enough-for-subject","title":"DreamTuner: Single Image is Enough for Subject-Driven Generation","date":"2023-12-21","arxiv_id":"2312.13691","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-self-attention-based-differentially-private","title":"A self-attention-based differentially private tabular GAN with high data utility","date":"2023-12-20","arxiv_id":"2312.13031","repositories_listed":0,"syntology":null},{"url":null,"slug":"all-but-one-surgical-concept-erasing-with","title":"All but One: Surgical Concept Erasing with Model Preservation in Text-to-Image Diffusion Models","date":"2023-12-20","arxiv_id":"2312.12807","repositories_listed":0,"syntology":null},{"url":null,"slug":"conditional-image-generation-with-pretrained","title":"Conditional Image Generation with Pretrained Generative Model","date":"2023-12-20","arxiv_id":"2312.13253","repositories_listed":0,"syntology":null},{"url":"/paper/unlocking-pre-trained-image-backbones-for","slug":"unlocking-pre-trained-image-backbones-for","title":"Unlocking Pre-trained Image Backbones for Semantic Image Synthesis","date":"2023-12-20","arxiv_id":"2312.13314","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompting-hard-or-hardly-prompting-prompt","title":"Prompting Hard or Hardly Prompting: Prompt Inversion for Text-to-Image Diffusion Models","date":"2023-12-19","arxiv_id":"2312.12416","repositories_listed":0,"syntology":null},{"url":null,"slug":"surf-cdm-score-based-surface-cold-diffusion","title":"Surf-CDM: Score-Based Surface Cold-Diffusion Model For Medical Image Segmentation","date":"2023-12-19","arxiv_id":"2312.12649","repositories_listed":0,"syntology":null},{"url":null,"slug":"magicscroll-nontypical-aspect-ratio-image","title":"MagicScroll: Nontypical Aspect-Ratio Image Generation for Visual Storytelling via Multi-Layered Semantic-Aware Denoising","date":"2023-12-18","arxiv_id":"2312.10899","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-right-losses-for-the-right-gains","title":"The Right Losses for the Right Gains: Improving the Semantic Consistency of Deep Text-to-Image Generation with Distribution-Sensitive Losses","date":"2023-12-18","arxiv_id":"2312.10854","repositories_listed":0,"syntology":null},{"url":null,"slug":"unified-framework-for-diffusion-generative","title":"Unified framework for diffusion generative models in SO(3): applications in computer vision and astrophysics","date":"2023-12-18","arxiv_id":"2312.11707","repositories_listed":0,"syntology":null},{"url":null,"slug":"deepart-a-benchmark-to-advance-fidelity","title":"DeepArt: A Benchmark to Advance Fidelity Research in AI-Generated Content","date":"2023-12-16","arxiv_id":"2312.10407","repositories_listed":0,"syntology":null},{"url":null,"slug":"operator-learning-inspired-modeling-of-neural","title":"Operator-learning-inspired Modeling of Neural Ordinary Differential Equations","date":"2023-12-16","arxiv_id":"2312.10274","repositories_listed":0,"syntology":null},{"url":null,"slug":"tell-me-what-you-see-text-guided-real-world","title":"Tell Me What You See: Text-Guided Real-World Image Denoising","date":"2023-12-15","arxiv_id":"2312.10191","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-the-unification-of-generative-and","title":"Towards the Unification of Generative and Discriminative Visual Foundation Model: A Survey","date":"2023-12-15","arxiv_id":"2312.10163","repositories_listed":0,"syntology":null},{"url":null,"slug":"arcgan-generative-adversarial-networks-for-3d","title":"ArcGAN: Generative Adversarial Networks for 3D Architectural Image Generation","date":"2023-12-14","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamdrone","title":"DreamDrone: Text-to-Image Diffusion Models are Zero-shot Perpetual View Generators","date":"2023-12-14","arxiv_id":"2312.08746","repositories_listed":0,"syntology":null},{"url":null,"slug":"finecontrolnet-fine-level-text-control-for","title":"FineControlNet: Fine-level Text Control for Image Generation with Spatially Aligned Text Control Injection","date":"2023-12-14","arxiv_id":"2312.09252","repositories_listed":0,"syntology":null},{"url":null,"slug":"lime-localized-image-editing-via-attention","title":"LIME: Localized Image Editing via Attention Regularization in Diffusion Models","date":"2023-12-14","arxiv_id":"2312.09256","repositories_listed":0,"syntology":null},{"url":null,"slug":"local-conditional-controlling-for-text-to","title":"Local Conditional Controlling for Text-to-Image Diffusion Models","date":"2023-12-14","arxiv_id":"2312.08768","repositories_listed":0,"syntology":null},{"url":null,"slug":"pi3d-efficient-text-to-3d-generation-with","title":"PI3D: Efficient Text-to-3D Generation with Pseudo-Image Diffusion","date":"2023-12-14","arxiv_id":"2312.09069","repositories_listed":0,"syntology":null},{"url":null,"slug":"valid-variable-length-input-diffusion-for","title":"VaLID: Variable-Length Input Diffusion for Novel View Synthesis","date":"2023-12-14","arxiv_id":"2312.08892","repositories_listed":0,"syntology":null},{"url":null,"slug":"zerorf-fast-sparse-view-360deg-reconstruction","title":"ZeroRF: Fast Sparse View 360° Reconstruction with Zero Pretraining","date":"2023-12-14","arxiv_id":"2312.09249","repositories_listed":0,"syntology":null},{"url":null,"slug":"3dgen-a-gan-based-approach-for-generating","title":"3DGEN: A GAN-based approach for generating novel 3D models from image data","date":"2023-12-13","arxiv_id":"2312.08094","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-of-generative-ai-for-intelligent","title":"A Survey of Generative AI for Intelligent Transportation Systems: Road Transportation Perspective","date":"2023-12-13","arxiv_id":"2312.08248","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffuseraw-end-to-end-generative-raw-image","title":"DiffuseRAW: End-to-End Generative RAW Image Processing for Low-Light Images","date":"2023-12-13","arxiv_id":"2402.18575","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-models-enable-zero-shot-pose","title":"Diffusion Models Enable Zero-Shot Pose Estimation for Lower-Limb Prosthetic Users","date":"2023-12-13","arxiv_id":"2312.07854","repositories_listed":0,"syntology":null},{"url":null,"slug":"ehancing-ct-image-synthesis-from-multi-modal","title":"Enhancing CT Image synthesis from multi-modal MRI data based on a multi-task neural network framework","date":"2023-12-13","arxiv_id":"2312.08343","repositories_listed":0,"syntology":null},{"url":null,"slug":"fast-sampling-through-the-reuse-of-attention","title":"Fast Sampling Through The Reuse Of Attention Maps In Diffusion Models","date":"2023-12-13","arxiv_id":"2401.01008","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-aware-artifact-image-synthesis-with","title":"Knowledge-Aware Artifact Image Synthesis with LLM-Enhanced Prompting and Multi-Source Supervision","date":"2023-12-13","arxiv_id":"2312.08056","repositories_listed":0,"syntology":null},{"url":null,"slug":"seeavatar-photorealistic-text-to-3d-avatar","title":"SEEAvatar: Photorealistic Text-to-3D Avatar Generation with Constrained Geometry and Appearance","date":"2023-12-13","arxiv_id":"2312.08889","repositories_listed":0,"syntology":null},{"url":null,"slug":"speedupnet-a-plug-and-play-hyper-network-for","title":"SpeedUpNet: A Plug-and-Play Adapter Network for Accelerating Text-to-Image Diffusion Models","date":"2023-12-13","arxiv_id":"2312.08887","repositories_listed":0,"syntology":null},{"url":null,"slug":"stable-rivers-a-case-study-in-the-application","title":"Stable Rivers: A Case Study in the Application of Text-to-Image Generative Models for Earth Sciences","date":"2023-12-13","arxiv_id":"2312.07833","repositories_listed":0,"syntology":null},{"url":null,"slug":"time-series-diffusion-method-a-denoising","title":"Time Series Diffusion Method: A Denoising Diffusion Probabilistic Model for Vibration Signal Generation","date":"2023-12-13","arxiv_id":"2312.07981","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffuvst-narrating-fictional-scenes-with","title":"DiffuVST: Narrating Fictional Scenes with Global-History-Guided Denoising Models","date":"2023-12-12","arxiv_id":"2312.07066","repositories_listed":0,"syntology":null},{"url":null,"slug":"invariant-representation-learning-via","title":"Invariant Representation via Decoupling Style and Spurious Features from Images","date":"2023-12-11","arxiv_id":"2312.06226","repositories_listed":0,"syntology":null},{"url":null,"slug":"portraitbooth-a-versatile-portrait-model-for","title":"PortraitBooth: A Versatile Portrait Model for Fast Identity-preserved Personalization","date":"2023-12-11","arxiv_id":"2312.06354","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-image-synthesis-for-abdominal-ct","title":"Semantic Image Synthesis for Abdominal CT","date":"2023-12-11","arxiv_id":"2312.06453","repositories_listed":0,"syntology":null},{"url":null,"slug":"stellar-systematic-evaluation-of-human","title":"Stellar: Systematic Evaluation of Human-Centric Personalized Text-to-Image Methods","date":"2023-12-11","arxiv_id":"2312.06116","repositories_listed":0,"syntology":null},{"url":null,"slug":"user-friendly-and-adaptable-discriminative-ai","title":"User Friendly and Adaptable Discriminative AI: Using the Lessons from the Success of LLMs and Image Generation Models","date":"2023-12-11","arxiv_id":"2312.06826","repositories_listed":0,"syntology":null},{"url":null,"slug":"class-prototype-conditional-diffusion-model","title":"Class-Prototype Conditional Diffusion Model with Gradient Projection for Continual Learning","date":"2023-12-10","arxiv_id":"2312.06710","repositories_listed":0,"syntology":null},{"url":null,"slug":"disentangled-representation-learning-for-3","title":"Disentangled Representation Learning for Controllable Person Image Generation","date":"2023-12-10","arxiv_id":"2312.05798","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-energy-guided-image-translation-with","title":"Multi-Energy Guided Image Translation with Stochastic Differential Equations for Near-Infrared Facial Expression Recognition","date":"2023-12-10","arxiv_id":"2312.05908","repositories_listed":0,"syntology":null},{"url":null,"slug":"conditional-stochastic-interpolation-for","title":"Conditional Stochastic Interpolation for Generative Learning","date":"2023-12-09","arxiv_id":"2312.05579","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-quantization-strategies-for-latent","title":"Efficient Quantization Strategies for Latent Diffusion Models","date":"2023-12-09","arxiv_id":"2312.05431","repositories_listed":0,"syntology":null},{"url":null,"slug":"image-synthesis-based-late-stage-cancer","title":"Image Synthesis-based Late Stage Cancer Augmentation and Semi-Supervised Segmentation for MRI Rectal Cancer Staging","date":"2023-12-08","arxiv_id":"2312.04779","repositories_listed":0,"syntology":null},{"url":null,"slug":"membership-inference-attacks-on-diffusion","title":"Membership Inference Attacks on Diffusion Models via Quantile Regression","date":"2023-12-08","arxiv_id":"2312.05140","repositories_listed":0,"syntology":null},{"url":null,"slug":"mvdd-multi-view-depth-diffusion-models","title":"MVDD: Multi-View Depth Diffusion Models","date":"2023-12-08","arxiv_id":"2312.04875","repositories_listed":0,"syntology":null},{"url":null,"slug":"noiseclr-a-contrastive-learning-approach-for","title":"NoiseCLR: A Contrastive Learning Approach for Unsupervised Discovery of Interpretable Directions in Diffusion Models","date":"2023-12-08","arxiv_id":"2312.05390","repositories_listed":0,"syntology":null},{"url":null,"slug":"reality-s-canvas-language-s-brush-crafting-3d","title":"Reality's Canvas, Language's Brush: Crafting 3D Avatars from Monocular Video","date":"2023-12-08","arxiv_id":"2312.04784","repositories_listed":0,"syntology":null},{"url":null,"slug":"rs-corrector-correcting-the-racial","title":"RS-Corrector: Correcting the Racial Stereotypes in Latent Diffusion Models","date":"2023-12-08","arxiv_id":"2312.04810","repositories_listed":0,"syntology":null},{"url":null,"slug":"smartmask-context-aware-high-fidelity-mask","title":"SmartMask: Context Aware High-Fidelity Mask Generation for Fine-grained Object Insertion and Layout Control","date":"2023-12-08","arxiv_id":"2312.05039","repositories_listed":0,"syntology":null},{"url":null,"slug":"approximate-caching-for-efficiently-serving","title":"Approximate Caching for Efficiently Serving Diffusion Models","date":"2023-12-07","arxiv_id":"2312.04429","repositories_listed":0,"syntology":null},{"url":null,"slug":"autoencoding-labeled-interpolator-inferring","title":"Autoencoding Labeled Interpolator, Inferring Parameters From Image, And Image From Parameters","date":"2023-12-07","arxiv_id":"2312.04640","repositories_listed":0,"syntology":null},{"url":null,"slug":"gen2det-generate-to-detect","title":"Gen2Det: Generate to Detect","date":"2023-12-07","arxiv_id":"2312.04566","repositories_listed":0,"syntology":null},{"url":null,"slug":"idesigner-a-high-resolution-and-complex","title":"iDesigner: A High-Resolution and Complex-Prompt Following Text-to-Image Diffusion Model for Interior Design","date":"2023-12-07","arxiv_id":"2312.04326","repositories_listed":0,"syntology":null},{"url":null,"slug":"koala-self-attention-matters-in-knowledge","title":"KOALA: Empirical Lessons Toward Memory-Efficient and Fast Diffusion Models for Text-to-Image Synthesis","date":"2023-12-07","arxiv_id":"2312.04005","repositories_listed":0,"syntology":null},{"url":null,"slug":"lsegdiff-a-latent-diffusion-model-for-medical","title":"LSegDiff: A Latent Diffusion Model for Medical Image Segmentation","date":"2023-12-07","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-view-unsupervised-image-generation-with","title":"Multi-View Unsupervised Image Generation with Cross Attention Guidance","date":"2023-12-07","arxiv_id":"2312.04337","repositories_listed":0,"syntology":null}],"record_sha256":"a322de9d9859a3b0611a97d4dc7c29698a107b0b96c4aa17cc18b99aaefe4400","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}