Browse State-of-the-Art › Video Generation › Papers, page 12
Video Generation
Papers archive 2025-07-28
archive papers tagged: 1,466 · with a code link: 609 · where Syntology ran a sample: 257 (221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (257 of 1,466 tagged: 221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument)
Page 12 of 15: papers 1,101 to 1,200 of 1,466, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Advancing Video Quality Assessment for AIGC23 Sep 2024 0 repositories listed
-
FaceVid-1K: A Large-Scale High-Quality Multiracial Human Face Video Dataset23 Sep 2024 0 repositories listed
-
Multi-Modal Generative AI: Multi-modal LLM, Diffusion and Beyond23 Sep 2024 0 repositories listed
-
Video-to-Audio Generation with Fine-grained Temporal Semantics23 Sep 2024 0 repositories listed
-
JVID: Joint Video-Image Diffusion for Visual-Quality and Temporal-Consistency in Video Generation21 Sep 2024 0 repositories listed
-
JoyHallo: Digital human model for Mandarin20 Sep 2024 0 repositories listed
-
Denoising Reuse: Exploiting Inter-frame Motion Consistency for Efficient Video Latent Generation19 Sep 2024 0 repositories listed
-
OSV: One Step is Enough for High-Quality Image to Video Generation17 Sep 2024 0 repositories listed
-
The Art of Storytelling: Multi-Agent Generative AI for Dynamic Multimodal Narratives17 Sep 2024 0 repositories listed
-
DiffTED: One-shot Audio-driven TED Talk Video Generation with Diffusion-based Co-speech Gestures11 Sep 2024 0 repositories listed
-
G3PT: Unleash the power of Autoregressive Modeling in 3D Generation via Cross-scale Querying Transformer10 Sep 2024 0 repositories listed
-
MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control10 Sep 2024 0 repositories listed
-
DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation9 Sep 2024 0 repositories listed
-
Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency4 Sep 2024 0 repositories listed
-
CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention3 Sep 2024 0 repositories listed
-
DiVE: DiT-based Video Generation with Enhanced Control3 Sep 2024 0 repositories listed
-
Compositional 3D-aware Video Generation with LLM Director31 Aug 2024 0 repositories listed
-
VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion Transformers30 Aug 2024 0 repositories listed
-
Alignment is All You Need: A Training-free Augmentation Strategy for Pose-guided Video Generation29 Aug 2024 0 repositories listed
-
DriveGenVLM: Real-world Video Generation for Vision Language Model based Autonomous Driving29 Aug 2024 0 repositories listed
-
One-Shot Learning Meets Depth Diffusion in Multi-Object Videos29 Aug 2024 0 repositories listed
-
GenDDS: Generating Diverse Driving Video Scenarios with Prompt-to-Video Generative Model28 Aug 2024 0 repositories listed
-
SurGen: Text-Guided Diffusion Model for Surgical Video Generation26 Aug 2024 0 repositories listed
-
Decoupled Video Generation with Chain of Training-free Diffusion Model Experts24 Aug 2024 0 repositories listed
-
TVG: A Training-free Transition Video Generation Method with Diffusion Models24 Aug 2024 0 repositories listed
-
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation23 Aug 2024 0 repositories listed
-
xGen-VideoSyn-1: High-fidelity Text-to-Video Synthesis with Compressed Representations22 Aug 2024 0 repositories listed
-
DreamFactory: Pioneering Multi-Scene Long Video Generation with a Multi-Agent Framework21 Aug 2024 0 repositories listed
-
TrackGo: A Flexible and Efficient Method for Controllable Video Generation21 Aug 2024 0 repositories listed
-
Factorized-Dreamer: Training A High-Quality Video Generator with Limited and Low-Quality Data19 Aug 2024 0 repositories listed
-
Kubrick: Multimodal Agent Collaborations for Synthetic Video Generation19 Aug 2024 0 repositories listed
-
JPEG-LM: LLMs as Image Generators with Canonical Codec Representations15 Aug 2024 0 repositories listed
-
When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding15 Aug 2024 0 repositories listed
-
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model10 Aug 2024 0 repositories listed
-
Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE10 Aug 2024 0 repositories listed
-
Puppet-Master: Scaling Interactive Video Generation as a Motion Prior for Part-Level Dynamics8 Aug 2024 0 repositories listed
-
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation5 Aug 2024 0 repositories listed
-
Reenact Anything: Semantic Video Motion Transfer Using Motion-Textual Inversion1 Aug 2024 0 repositories listed
-
Explainable and Controllable Motion Curve Guided Cardiac Ultrasound Video Generation31 Jul 2024 0 repositories listed
-
Benchmarking Multi-dimensional AIGC Video Quality Assessment: A Dataset and Unified Model31 Jul 2024 0 repositories listed
-
Fine-gained Zero-shot Video Sampling31 Jul 2024 0 repositories listed
-
FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention29 Jul 2024 0 repositories listed
-
Faster Image2Video Generation: A Closer Look at CLIP Image Embedding's Impact on Spatio-Temporal Cross-Attentions27 Jul 2024 0 repositories listed
-
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency24 Jul 2024 0 repositories listed
-
Diffusion Transformer Captures Spatial-Temporal Dependencies: A Theory for Gaussian Process Data23 Jul 2024 0 repositories listed
-
MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence23 Jul 2024 0 repositories listed
-
Anchored Diffusion for Video Face Reenactment21 Jul 2024 0 repositories listed
-
Unlearning Concepts from Text-to-Video Diffusion Models19 Jul 2024 0 repositories listed
-
Multi-sentence Video Grounding for Long Video Generation18 Jul 2024 0 repositories listed
-
Streetscapes: Large-scale Consistent Street View Generation Using Autoregressive Video Diffusion18 Jul 2024 0 repositories listed
-
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control17 Jul 2024 0 repositories listed
-
A Survey of Defenses against AI-generated Visual Media: Detection, Disruption, and Authentication15 Jul 2024 0 repositories listed
-
Learning Online Scale Transformation for Talking Head Video Generation13 Jul 2024 0 repositories listed
-
Bora: Biomedical Generalist Video Generation Model12 Jul 2024 0 repositories listed
-
Inference Optimization of Foundation Models on AI Accelerators12 Jul 2024 0 repositories listed
-
E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors11 Jul 2024 0 repositories listed
-
Still-Moving: Customized Video Generation without Customized Video Data11 Jul 2024 0 repositories listed
-
VEnhancer: Generative Space-Time Enhancement for Video Generation10 Jul 2024 0 repositories listed
-
Video-to-Audio Generation with Hidden Alignment10 Jul 2024 0 repositories listed
-
T2VSafetyBench: Evaluating the Safety of Text-to-Video Generative Models8 Jul 2024 0 repositories listed
-
The Tug-of-War Between Deepfake Generation and Detection8 Jul 2024 0 repositories listed
-
This&That: Language-Gesture Controlled Video Generation for Robot Planning8 Jul 2024 0 repositories listed
-
VIMI: Grounding Video Generation through Multi-modal Instruction8 Jul 2024 0 repositories listed
-
GVDIFF: Grounded Text-to-Video Generation with Diffusion Models2 Jul 2024 0 repositories listed
-
OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation2 Jul 2024 0 repositories listed
-
SVG: 3D Stereoscopic Video Generation via Denoising Frame Matrix29 Jun 2024 0 repositories listed
-
What Matters in Detecting AI-Generated Videos like Sora?27 Jun 2024 0 repositories listed
-
MotionBooth: Motion-Aware Customized Text-to-Video Generation25 Jun 2024 0 repositories listed
-
Text-Animator: Controllable Visual Text Video Generation25 Jun 2024 0 repositories listed
-
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation24 Jun 2024 0 repositories listed
-
Video-Infinity: Distributed Long Video Generation24 Jun 2024 0 repositories listed
-
Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model22 Jun 2024 0 repositories listed
-
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation21 Jun 2024 0 repositories listed
-
Video Generation with Learned Action Prior20 Jun 2024 0 repositories listed
-
ARDuP: Active Region Video Diffusion for Universal Policies19 Jun 2024 0 repositories listed
-
Splatter a Video: Video Gaussian Representation for Versatile Processing19 Jun 2024 0 repositories listed
-
NLDF: Neural Light Dynamic Fields for Efficient 3D Talking Head Generation17 Jun 2024 0 repositories listed
-
Training-free Camera Control for Video Generation14 Jun 2024 0 repositories listed
-
DiTFastAttn: Attention Compression for Diffusion Transformer Models12 Jun 2024 0 repositories listed
-
12 Jun 2024 0 repositories listed
-
Vivid-ZOO: Multi-View Video Generation with Diffusion Model12 Jun 2024 0 repositories listed
-
4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models11 Jun 2024 0 repositories listed
-
AV-DiT: Efficient Audio-Visual Diffusion Transformer for Joint Audio and Video Generation11 Jun 2024 0 repositories listed
-
HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness11 Jun 2024 0 repositories listed
-
Visual Representation Learning with Stochastic Frame Prediction11 Jun 2024 0 repositories listed
-
CoNo: Consistency Noise Injection for Tuning-free Long Video Diffusion7 Jun 2024 0 repositories listed
-
Zero-Shot Video Editing through Adaptive Sliding Score Distillation7 Jun 2024 0 repositories listed
-
Follow-Your-Pose v2: Multiple-Condition Guided Character Image Animation for Stable Pose Control5 Jun 2024 0 repositories listed
-
VideoPhy: Evaluating Physical Commonsense for Video Generation5 Jun 2024 0 repositories listed
-
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation4 Jun 2024 0 repositories listed
-
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation4 Jun 2024 0 repositories listed
-
V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation4 Jun 2024 0 repositories listed
-
Learning Temporally Consistent Video Depth from Video Diffusion Priors3 Jun 2024 0 repositories listed
-
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation3 Jun 2024 0 repositories listed
-
4Diffusion: Multi-view Video Diffusion Model for 4D Generation31 May 2024 0 repositories listed
-
VITON-DiT: Learning In-the-Wild Video Try-On from Human Dance Videos via Diffusion Transformers28 May 2024 0 repositories listed
-
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control27 May 2024 0 repositories listed
-
Controllable Longer Image Animation with Diffusion Models27 May 2024 0 repositories listed
-
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer27 May 2024 0 repositories listed
-
RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance27 May 2024 0 repositories listed