Browse State-of-the-Art › Video Generation › Papers, page 10
Video Generation
Papers archive 2025-07-28
archive papers tagged: 1,466 · with a code link: 609 · where Syntology ran a sample: 257 (221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (257 of 1,466 tagged: 221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument)
Page 10 of 15: papers 901 to 1,000 of 1,466, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
License Plate Images Generation with Diffusion Models6 Jan 2025 0 repositories listed
-
Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation6 Jan 2025 0 repositories listed
-
GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking5 Jan 2025 0 repositories listed
-
Free-Form Motion Control: A Synthetic Video Generation Dataset with Controllable Camera and Object Motions2 Jan 2025 0 repositories listed
-
JOG3R: Towards 3D-Consistent Video Generators2 Jan 2025 0 repositories listed
-
VideoAnydoor: High-fidelity Video Object Insertion with Precise Motion Control2 Jan 2025 0 repositories listed
-
Beyond Text: Implementing Multimodal Large Language Model-Powered Multi-Agent Systems Using a No-Code Platform1 Jan 2025 0 repositories listed
-
ByTheWay: Boost Your Text-to-Video Generation Model to Higher Quality in a Training-free Way1 Jan 2025 0 repositories listed
-
Co-Speech Gesture Video Generation with Implicit Motion-Audio Entanglement1 Jan 2025 0 repositories listed
-
Diffusion-based Realistic Listening Head Generation via Hybrid Motion Modeling1 Jan 2025 0 repositories listed
-
DriveScape: High-Resolution Driving Video Generation by Multi-View Feature Fusion1 Jan 2025 0 repositories listed
-
Dynamic Camera Poses and Where to Find Them1 Jan 2025 0 repositories listed
-
EIDT-V: Exploiting Intersections in Diffusion Trajectories for Model-Agnostic, Zero-Shot, Training-Free Text-to-Video Generation1 Jan 2025 0 repositories listed
-
GS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking1 Jan 2025 0 repositories listed
-
I2VGuard: Safeguarding Images against Misuse in Diffusion-based Image-to-Video Models1 Jan 2025 0 repositories listed
-
IM-Zero: Instance-level Motion Controllable Video Generation in a Zero-shot Manner1 Jan 2025 0 repositories listed
-
Mask^2DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation1 Jan 2025 0 repositories listed
-
MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation1 Jan 2025 0 repositories listed
-
Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception1 Jan 2025 0 repositories listed
-
PatchVSR: Breaking Video Diffusion Resolution Limits with Patch-wise Video Super-Resolution1 Jan 2025 0 repositories listed
-
Q-Bench-Video: Benchmark the Video Quality Understanding of LMMs1 Jan 2025 0 repositories listed
-
Satellite to GroundScape - Large-scale Consistent Ground View Generation from Satellite Views1 Jan 2025 0 repositories listed
-
STDD: Spatio-Temporal Dual Diffusion for Video Generation1 Jan 2025 0 repositories listed
-
Video-Bench: Human-Aligned Video Generation Benchmark1 Jan 2025 0 repositories listed
-
DreamDrive: Generative 4D Scene Modeling from Street View Images31 Dec 2024 0 repositories listed
-
Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling30 Dec 2024 0 repositories listed
-
Gender Bias in Text-to-Video Generation Models: A case study of Sora30 Dec 2024 0 repositories listed
-
ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation30 Dec 2024 0 repositories listed
-
Generative Video Propagation27 Dec 2024 0 repositories listed
-
24 Dec 2024 0 repositories listed
-
Video Is Worth a Thousand Images: Exploring the Latest Trends in Long Video Generation24 Dec 2024 0 repositories listed
-
ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation24 Dec 2024 0 repositories listed
-
Enhancing Multi-Text Long Video Generation Consistency without Tuning: Time-Frequency Analysis, Prompt Alignment, and Theory23 Dec 2024 0 repositories listed
-
FFA Sora, video generation as fundus fluorescein angiography simulator23 Dec 2024 0 repositories listed
-
Large Motion Video Autoencoding with Cross-modal Video VAE23 Dec 2024 0 repositories listed
-
Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation22 Dec 2024 0 repositories listed
-
SubstationAI: Multimodal Large Model-Based Approaches for Analyzing Substation Equipment Faults22 Dec 2024 0 repositories listed
-
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance21 Dec 2024 0 repositories listed
-
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models21 Dec 2024 0 repositories listed
-
VAST 1.0: A Unified Framework for Controllable and Consistent Video Generation21 Dec 2024 0 repositories listed
-
DOLLAR: Few-Step Video Generation via Distillation and Latent Reward Optimization20 Dec 2024 0 repositories listed
-
AV-Link: Temporally-Aligned Diffusion Features for Cross-Modal Audio-Video Generation19 Dec 2024 0 repositories listed
-
DirectorLLM for Human-Centric Video Generation19 Dec 2024 0 repositories listed
-
Parallelized Autoregressive Visual Generation19 Dec 2024 0 repositories listed
-
AKiRa: Augmentation Kit on Rays for optical video generation18 Dec 2024 0 repositories listed
-
FlexCache: Flexible Approximate Cache System for Video Diffusion18 Dec 2024 0 repositories listed
-
ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping18 Dec 2024 0 repositories listed
-
SurgSora: Object-Aware Diffusion Model for Controllable Surgical Video Generation18 Dec 2024 0 repositories listed
-
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation18 Dec 2024 0 repositories listed
-
CompactFlowNet: Efficient Real-time Optical Flow Estimation on Mobile Devices17 Dec 2024 0 repositories listed
-
Is Your World Simulator a Good Story Presenter? A Consecutive Events-Based Benchmark for Future Long Video Generation17 Dec 2024 0 repositories listed
-
MotionBridge: Dynamic Video Inbetweening with Flexible Controls17 Dec 2024 0 repositories listed
-
Can video generation replace cinematographers? Research on the cinematic language of generated video16 Dec 2024 0 repositories listed
-
InterDyn: Controllable Interactive Dynamics with Video Diffusion Models16 Dec 2024 0 repositories listed
-
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes15 Dec 2024 0 repositories listed
-
GenLit: Reformulating Single-Image Relighting as Video Generation15 Dec 2024 0 repositories listed
-
LinGen: Towards High-Resolution Minute-Length Text-to-Video Generation with Linear Computational Complexity13 Dec 2024 0 repositories listed
-
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion13 Dec 2024 0 repositories listed
-
SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device13 Dec 2024 0 repositories listed
-
TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation13 Dec 2024 0 repositories listed
-
Enhancing Facial Consistency in Conditional Video Generation via Facial Landmark Transformation12 Dec 2024 0 repositories listed
-
InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption12 Dec 2024 0 repositories listed
-
LiftImage3D: Lifting Any Single Image to 3D Gaussians with Video Generation Priors12 Dec 2024 0 repositories listed
-
Mojito: Motion Trajectory and Intensity Control for Video Generation12 Dec 2024 0 repositories listed
-
OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation12 Dec 2024 0 repositories listed
-
T-SVG: Text-Driven Stereoscopic Video Generation12 Dec 2024 0 repositories listed
-
Video Creation by Demonstration12 Dec 2024 0 repositories listed
-
FLIP: Flow-Centric Generative Planning as General-Purpose Manipulation World Model11 Dec 2024 0 repositories listed
-
Physical Informed Driving World Model11 Dec 2024 0 repositories listed
-
SweetTokenizer: Semantic-Aware Spatial-Temporal Tokenizer for Compact Visual Discretization11 Dec 2024 0 repositories listed
-
3DTrajMaster: Mastering 3D Trajectory for Multi-Entity Motion in Video Generation10 Dec 2024 0 repositories listed
-
From Slow Bidirectional to Fast Autoregressive Video Diffusion Models10 Dec 2024 0 repositories listed
-
Multi-Shot Character Consistency for Text-to-Video Generation10 Dec 2024 0 repositories listed
-
STIV: Scalable Text and Image Conditioned Video Generation10 Dec 2024 0 repositories listed
-
StyleMaster: Stylize Your Video with Artistic Generation and Translation10 Dec 2024 0 repositories listed
-
UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics10 Dec 2024 0 repositories listed
-
SafeWatch: An Efficient Safety-Policy Following Video Guardrail Model with Transparent Explanations9 Dec 2024 0 repositories listed
-
Accelerating Video Diffusion Models via Distribution Matching8 Dec 2024 0 repositories listed
-
Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training8 Dec 2024 0 repositories listed
-
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation8 Dec 2024 0 repositories listed
-
Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation8 Dec 2024 0 repositories listed
-
Mind the Time: Temporally-Controlled Multi-Event Video Generation6 Dec 2024 0 repositories listed
-
DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models5 Dec 2024 0 repositories listed
-
GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration5 Dec 2024 0 repositories listed
-
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation5 Dec 2024 0 repositories listed
-
Instructional Video Generation5 Dec 2024 0 repositories listed
-
MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation5 Dec 2024 0 repositories listed
-
Movie Gen: SWOT Analysis of Meta's Generative AI Foundation Model for Transforming Media Generation, Advertising, and Entertainment Industries5 Dec 2024 0 repositories listed
-
PaintScene4D: Consistent 4D Scene Generation from Text Prompts5 Dec 2024 0 repositories listed
-
Advancing Auto-Regressive Continuation for Video Frames4 Dec 2024 0 repositories listed
-
Imagine360: Immersive 360 Video Generation from Perspective Anchor4 Dec 2024 0 repositories listed
-
Mimir: Improving Video Diffusion Models for Precise Text Understanding4 Dec 2024 0 repositories listed
-
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention4 Dec 2024 0 repositories listed
-
SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model4 Dec 2024 0 repositories listed
-
AniGS: Animatable Gaussian Avatar from a Single Image with Inconsistent Gaussian Reconstruction3 Dec 2024 0 repositories listed
-
Improving Dynamic Object Interactions in Text-to-Video Generation with AI Feedback3 Dec 2024 0 repositories listed
-
Motion Prompting: Controlling Video Generation with Motion Trajectories3 Dec 2024 0 repositories listed
-
OmniCreator: Self-Supervised Unified Generation with Universal Editing3 Dec 2024 0 repositories listed
-
CPA: Camera-pose-awareness Diffusion Transformer for Video Generation2 Dec 2024 0 repositories listed
-
FLOAT: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait2 Dec 2024 0 repositories listed