Browse State-of-the-Art › Video Generation › Papers, page 14
Video Generation
Papers archive 2025-07-28
archive papers tagged: 1,466 · with a code link: 609 · where Syntology ran a sample: 257 (221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (257 of 1,466 tagged: 221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument)
Page 14 of 15: papers 1,301 to 1,400 of 1,466, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
ART·V: Auto-Regressive Text-to-Video Generation with Diffusion Models30 Nov 2023 0 repositories listed
-
MicroCinema: A Divide-and-Conquer Approach for Text-to-Video Generation30 Nov 2023 0 repositories listed
-
VIDiff: Translating Videos via Multi-Modal Instructions with Diffusion Models30 Nov 2023 0 repositories listed
-
MotionZero:Exploiting Motion Priors for Zero-shot Text-to-Video Generation28 Nov 2023 0 repositories listed
-
FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax27 Nov 2023 0 repositories listed
-
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation25 Nov 2023 0 repositories listed
-
AdaDiff: Adaptive Step Selection for Fast Diffusion Models24 Nov 2023 0 repositories listed
-
Decouple Content and Motion for Conditional Image-to-Video Generation24 Nov 2023 0 repositories listed
-
GPT4Motion: Scripting Physical Motions in Text-to-Video Generation via Blender-Oriented GPT Planning21 Nov 2023 0 repositories listed
-
MoVideo: Motion-Aware Video Generation with Diffusion Models19 Nov 2023 0 repositories listed
-
18 Nov 2023 0 repositories listed
-
Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning17 Nov 2023 0 repositories listed
-
LLM as an Art Director (LaDi): Using LLMs to improve Text-to-Media Generators7 Nov 2023 0 repositories listed
-
Exploring the Hyperparameter Space of Image Diffusion Models for Echocardiogram Generation2 Nov 2023 0 repositories listed
-
POS: A Prompts Optimization Suite for Augmenting Text-to-Video Generation2 Nov 2023 0 repositories listed
-
VideoDreamer: Customized Multi-Subject Text-to-Video Generation with Disen-Mix Finetuning2 Nov 2023 0 repositories listed
-
The Missing U for Efficient Diffusion Models31 Oct 2023 0 repositories listed
-
Echocardiography video synthesis from end diastolic semantic map via diffusion model11 Oct 2023 0 repositories listed
-
LLM-grounded Video Diffusion Models29 Sep 2023 0 repositories listed
-
OSM-Net: One-to-Many One-shot Talking Head Generation with Spontaneous Head Motions28 Sep 2023 0 repositories listed
-
VideoDirectorGPT: Consistent Multi-scene Video Generation via LLM-Guided Planning26 Sep 2023 0 repositories listed
-
The Power of Sound (TPoS): Audio Reactive Video Generation with Stable Diffusion8 Sep 2023 0 repositories listed
-
RenAIssance: A Survey into AI Text-to-Image Generation in the Era of Large Model2 Sep 2023 0 repositories listed
-
VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation1 Sep 2023 0 repositories listed
-
Explaining Vision and Language through Graphs of Events in Space and Time29 Aug 2023 0 repositories listed
-
MagicAvatar: Multimodal Avatar Generation and Animation28 Aug 2023 0 repositories listed
-
Dysen-VDM: Empowering Dynamics-aware Text-to-Video Diffusion with LLMs26 Aug 2023 0 repositories listed
-
APLA: Additional Perturbation for Latent Noise with Adversarial Training Enables Consistency24 Aug 2023 0 repositories listed
-
Hamiltonian GAN22 Aug 2023 0 repositories listed
-
SimDA: Simple Diffusion Adapter for Efficient Video Generation18 Aug 2023 0 repositories listed
-
Dual-Stream Diffusion Net for Text-to-Video Generation16 Aug 2023 0 repositories listed
-
MobileVidFactory: Automatic Diffusion-Based Social Media Video Generation for Mobile Devices from Text31 Jul 2023 0 repositories listed
-
Hierarchical Semantic Perceptual Listener Head Video Generation: A High-performance Pipeline19 Jul 2023 0 repositories listed
-
Ada-TTA: Towards Adaptive High-Quality Text-to-Talking Avatar Synthesis6 Jun 2023 0 repositories listed
-
Quantifying Sample Anonymity in Score-Based Generative Models with Adversarial Fingerprinting2 Jun 2023 0 repositories listed
-
Make-Your-Video: Customized Video Generation Using Textual and Structural Guidance1 Jun 2023 0 repositories listed
-
17 May 2023 0 repositories listed
-
16 May 2023 0 repositories listed
-
Make-A-Protagonist: Generic Video Editing with An Ensemble of Experts15 May 2023 0 repositories listed
-
Multi-object Video Generation from Single Frame Layouts6 May 2023 0 repositories listed
-
StyleLipSync: Style-based Personalized Lip-sync Video Generation30 Apr 2023 0 repositories listed
-
LaMD: Latent Motion Diffusion for Image-Conditional Video Generation23 Apr 2023 0 repositories listed
-
High-Fidelity and Freely Controllable Talking Head Video Generation20 Apr 2023 0 repositories listed
-
Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation17 Apr 2023 0 repositories listed
-
Video Generation Beyond a Single Clip15 Apr 2023 0 repositories listed
-
VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs12 Apr 2023 0 repositories listed
-
Qualitative Failures of Image Generation Models and Their Application in Detecting Deepfakes29 Mar 2023 0 repositories listed
-
NUWA-XL: Diffusion over Diffusion for eXtremely Long Video Generation22 Mar 2023 0 repositories listed
-
Controllable Video Generation by Learning the Underlying Dynamical System with Neural ODE9 Mar 2023 0 repositories listed
-
One-Shot Face Video Re-enactment using Hybrid Latent Spaces of StyleGAN215 Feb 2023 0 repositories listed
-
Structure and Content-Guided Video Synthesis with Diffusion Models6 Feb 2023 0 repositories listed
-
Dreamix: Video Diffusion Models are General Video Editors2 Feb 2023 0 repositories listed
-
SceneScape: Text-Driven Consistent Scene Generation2 Feb 2023 0 repositories listed
-
31 Jan 2023 0 repositories listed
-
Regeneration Learning: A Learning Paradigm for Data Generation21 Jan 2023 0 repositories listed
-
Diffused Heads: Diffusion Models Beat GANs on Talking-Face Generation6 Jan 2023 0 repositories listed
-
SIDGAN: High-Resolution Dubbed Video Generation via Shift-Invariant Learning1 Jan 2023 0 repositories listed
-
Recovering Surveillance Video Using RF Cues27 Dec 2022 0 repositories listed
-
PV3D: A 3D Generative Model for Portrait Video Generation13 Dec 2022 0 repositories listed
-
Neural Cell Video Synthesis via Optical-Flow Diffusion6 Dec 2022 0 repositories listed
-
Audio-Driven Co-Speech Gesture Video Generation5 Dec 2022 0 repositories listed
-
3DDesigner: Towards Photorealistic 3D Object Generation and Editing with Text-guided Diffusion Models25 Nov 2022 0 repositories listed
-
20 Nov 2022 0 repositories listed
-
Facial Expression Video Generation Based-On Spatio-temporal Convolutional GAN: FEV-GAN20 Oct 2022 0 repositories listed
-
DeepHS-HDRVideo: Deep High Speed High Dynamic Range Video Reconstruction10 Oct 2022 0 repositories listed
-
See, Plan, Predict: Language-guided Cognitive Planning with Video Prediction7 Oct 2022 0 repositories listed
-
Text-driven Video Prediction6 Oct 2022 0 repositories listed
-
5 Oct 2022 0 repositories listed
-
AutoLV: Automatic Lecture Video Generator19 Sep 2022 0 repositories listed
-
Continuously Controllable Facial Expression Editing in Talking Face Videos17 Sep 2022 0 repositories listed
-
StableFace: Analyzing and Improving Motion Stability for Talking Face Generation29 Aug 2022 0 repositories listed
-
StyleTalker: One-shot Style-based Audio-driven Talking Head Video Generation23 Aug 2022 0 repositories listed
-
Jointly Harnessing Prior Structures and Temporal Consistency for Sign Language Video Generation8 Jul 2022 0 repositories listed
-
19 Jun 2022 0 repositories listed
-
FlexLip: A Controllable Text-to-Lip System7 Jun 2022 0 repositories listed
-
Cascaded Video Generation for Videos In-the-Wild1 Jun 2022 0 repositories listed
-
Copy Motion From One to Another: Fake Motion Video Generation3 May 2022 0 repositories listed
-
Sound-Guided Semantic Video Generation20 Apr 2022 0 repositories listed
-
Controllable Video Generation through Global and Local Motion Dynamics13 Apr 2022 0 repositories listed
-
Dynamic Neural Textures: Generating Talking-Face Videos with Continuously Controllable Expressions13 Apr 2022 0 repositories listed
-
V3GAN: Decomposing Background, Foreground and Motion for Video Generation26 Mar 2022 0 repositories listed
-
Transframer: Arbitrary Frame Prediction with Generative Models17 Mar 2022 0 repositories listed
-
DialogueNeRF: Towards Realistic Avatar Face-to-Face Conversation Video Generation15 Mar 2022 0 repositories listed
-
Autoencoding Video Latents for Adversarial Video Generation18 Jan 2022 0 repositories listed
-
Audio-Driven Talking Face Video Generation with Dynamic Convolution Kernels16 Jan 2022 0 repositories listed
-
Unpaired Cartoon Image Synthesis via Gated Cycle Mapping1 Jan 2022 0 repositories listed
-
Continuous-Time Video Generation via Learning Motion Dynamics with Neural ODE21 Dec 2021 0 repositories listed
-
Layered Controllable Video Generation24 Nov 2021 0 repositories listed
-
Video Content Swapping Using GAN21 Nov 2021 0 repositories listed
-
Xp-GAN: Unsupervised Multi-object Controllable Video Generation19 Nov 2021 0 repositories listed
-
Image Comes Dancing with Collaborative Parsing-Flow Video Synthesis27 Oct 2021 0 repositories listed
-
ViDA-MAN: Visual Dialog with Digital Humans26 Oct 2021 0 repositories listed
-
Intelligent Video Editing: Incorporating Modern Talking Face Generation Algorithms in a Video Editor16 Oct 2021 0 repositories listed
-
A Hierarchical Variational Neural Uncertainty Model for Stochastic Video Prediction6 Oct 2021 0 repositories listed
-
Video Autoencoder: self-supervised disentanglement of static 3D structure and motion6 Oct 2021 0 repositories listed
-
A review of Generative Adversarial Networks (GANs) and its applications in a wide variety of disciplines -- From Medical to Remote Sensing1 Oct 2021 0 repositories listed
-
Towards Generative Latent Variable Models for Speech29 Sep 2021 0 repositories listed
-
Conditional MoCoGAN for Zero-Shot Video Generation13 Sep 2021 0 repositories listed
-
Simple Video Generation using Neural ODEs7 Sep 2021 0 repositories listed
-
iButter: Neural Interactive Bullet Time Generator for Human Free-viewpoint Rendering12 Aug 2021 0 repositories listed