Browse State-of-the-Art › Video Generation › Papers, page 9
Video Generation
Papers archive 2025-07-28
archive papers tagged: 1,466 · with a code link: 609 · where Syntology ran a sample: 257 (221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (257 of 1,466 tagged: 221 with a run with no instrument failure, 36 where every run was a failure of Syntology's instrument)
Page 9 of 15: papers 801 to 900 of 1,466, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Cross-Modal Learning for Music-to-Music-Video Description Generation14 Mar 2025 0 repositories listed
-
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models14 Mar 2025 0 repositories listed
-
14 Mar 2025 0 repositories listed Syntology 3 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified (of 3 harvested samples) · 3 pointer-only (licence)
-
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation14 Mar 2025 0 repositories listed
-
CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance13 Mar 2025 0 repositories listed
-
Long Context Tuning for Video Generation13 Mar 2025 0 repositories listed
-
Semantic Latent Motion for Portrait Video Generation13 Mar 2025 0 repositories listed
-
VideoMerge: Towards Training-free Long Video Generation13 Mar 2025 0 repositories listed
-
Accelerating Diffusion Sampling via Exploiting Local Transition Coherence12 Mar 2025 0 repositories listed
-
I2V3D: Controllable image-to-video generation with 3D guidance12 Mar 2025 0 repositories listed
-
LuciBot: Automated Robot Policy Learning from Generated Videos12 Mar 2025 0 repositories listed
-
On the Limitations of Vision-Language Models in Understanding Image Transforms12 Mar 2025 0 repositories listed
-
Other Vehicle Trajectories Are Also Needed: A Driving World Model Unifies Ego-Other Vehicle Trajectories in Video Latant Space12 Mar 2025 0 repositories listed
-
Reangle-A-Video: 4D Video Generation as Video-to-Video Translation12 Mar 2025 0 repositories listed
-
Unified Dense Prediction of Video Diffusion12 Mar 2025 0 repositories listed
-
ObjectMover: Generative Object Movement with Video Prior11 Mar 2025 0 repositories listed
-
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation11 Mar 2025 0 repositories listed
-
DreamRelation: Relation-Centric Video Customization10 Mar 2025 0 repositories listed
-
TR-DQ: Time-Rotation Diffusion Quantization9 Mar 2025 0 repositories listed
-
GSV3D: Gaussian Splatting-based Geometric Distillation with Stable Video Diffusion for Single-Image 3D Object Generation8 Mar 2025 0 repositories listed
-
Object-Centric World Model for Language-Guided Manipulation8 Mar 2025 0 repositories listed
-
Text2Story: Advancing Video Storytelling with Text Guidance8 Mar 2025 0 repositories listed
-
VACT: A Video Automatic Causal Testing System and a Benchmark8 Mar 2025 0 repositories listed
-
MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice7 Mar 2025 0 repositories listed
-
FluidNexus: 3D Fluid Reconstruction and Prediction from a Single Video6 Mar 2025 0 repositories listed
-
Rethinking Video Super-Resolution: Towards Diffusion-Based Methods without Motion Alignment5 Mar 2025 0 repositories listed
-
HAIC: Improving Human Action Understanding and Generation with Better Captions for Multi-modal Large Language Models28 Feb 2025 0 repositories listed
-
Unified Video Action Model28 Feb 2025 0 repositories listed
-
FlexiDiT: Your Diffusion Transformer Can Easily Generate High-Quality Samples with Less Compute27 Feb 2025 0 repositories listed
-
Online Pseudo-average Shifting Attention(PASA) for Robust Low-precision LLM Inference: Algorithms and Numerical Analysis26 Feb 2025 0 repositories listed
-
ASurvey: Spatiotemporal Consistency in Video Generation25 Feb 2025 0 repositories listed
-
VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing24 Feb 2025 0 repositories listed
-
X-Dancer: Expressive Music to Human Dance Video Generation24 Feb 2025 0 repositories listed
-
21 Feb 2025 0 repositories listed Syntology 6 ran (of which 1 constructed an object rather than computing a result; 4 with no instrument failure: 2 honoured, 1 violated, 1 with no contract checked; 2 where Syntology's instrument failed) · 1 unverified (of 7 harvested samples) · 4 pointer-only (licence)
-
Designing Parameter and Compute Efficient Diffusion Transformers using Distillation20 Feb 2025 0 repositories listed
-
Hardware-Friendly Static Quantization Method for Video Diffusion Transformers20 Feb 2025 0 repositories listed
-
20 Feb 2025 0 repositories listed
-
RelaCtrl: Relevance-Guided Efficient Control for Diffusion Transformers20 Feb 2025 0 repositories listed
-
LLMPopcorn: An Empirical Study of LLMs as Assistants for Popular Micro-video Generation18 Feb 2025 0 repositories listed
-
MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation18 Feb 2025 0 repositories listed
-
MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation16 Feb 2025 0 repositories listed
-
RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control14 Feb 2025 0 repositories listed
-
GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation13 Feb 2025 0 repositories listed
-
AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance12 Feb 2025 0 repositories listed
-
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation12 Feb 2025 0 repositories listed
-
FloVD: Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis12 Feb 2025 0 repositories listed
-
Articulate That Object Part (ATOP): 3D Part Articulation from Text and Motion Personalization11 Feb 2025 0 repositories listed
-
11 Feb 2025 0 repositories listed
-
Generative Ghost: Investigating Ranking Bias Hidden in AI-Generated Videos11 Feb 2025 0 repositories listed
-
Next Block Prediction: Video Generation via Semi-Auto-Regressive Modeling11 Feb 2025 0 repositories listed
-
VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation11 Feb 2025 0 repositories listed
-
CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers10 Feb 2025 0 repositories listed
-
Señorita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists10 Feb 2025 0 repositories listed
-
HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation7 Feb 2025 0 repositories listed
-
Learning Real-World Action-Video Dynamics with Heterogeneous Masked Autoregression6 Feb 2025 0 repositories listed
-
MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation6 Feb 2025 0 repositories listed
-
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation6 Feb 2025 0 repositories listed
-
UniForm: A Unified Multi-Task Diffusion Transformer for Audio-Video Generation6 Feb 2025 0 repositories listed
-
FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise5 Feb 2025 0 repositories listed
-
MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent5 Feb 2025 0 repositories listed
-
Towards Physical Understanding in Video Generation: A 3D Point Regularization Approach5 Feb 2025 0 repositories listed
-
Harness Local Rewards for Global Benefits: Effective Text-to-Video Generation Alignment with Patch-level Reward Models4 Feb 2025 0 repositories listed
-
IPO: Iterative Preference Optimization for Text-to-Video Generation4 Feb 2025 0 repositories listed
-
VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video Models4 Feb 2025 0 repositories listed
-
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation3 Feb 2025 0 repositories listed
-
OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models3 Feb 2025 0 repositories listed
-
Secure & Personalized Music-to-Video Generation via CHARCHA3 Feb 2025 0 repositories listed
-
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity3 Feb 2025 0 repositories listed
-
HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment2 Feb 2025 0 repositories listed
-
Zeroth-order Informed Fine-Tuning for Diffusion Model: A Recursive Likelihood Ratio Optimizer2 Feb 2025 0 repositories listed
-
Shape from Semantics: 3D Shape Generation from Multi-View Semantics1 Feb 2025 0 repositories listed
-
Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation1 Feb 2025 0 repositories listed
-
Every Image Listens, Every Image Dances: Music-Driven Image Animation30 Jan 2025 0 repositories listed
-
Improving Video Generation with Human Feedback23 Jan 2025 0 repositories listed
-
Taming Teacher Forcing for Masked Autoregressive Video Generation21 Jan 2025 0 repositories listed
-
GenVidBench: A Challenging Benchmark for Detecting AI-Generated Video20 Jan 2025 0 repositories listed
-
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation18 Jan 2025 0 repositories listed
-
RichSpace: Enriching Text-to-Video Prompt Space via Text Embedding Interpolation17 Jan 2025 0 repositories listed
-
Learnings from Scaling Visual Tokenizers for Reconstruction and Generation16 Jan 2025 0 repositories listed
-
VideoWorld: Exploring Knowledge Learning from Unlabeled Videos16 Jan 2025 0 repositories listed
-
Comprehensive Subjective and Objective Evaluation Method for Text-generated Video15 Jan 2025 0 repositories listed
-
Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion15 Jan 2025 0 repositories listed
-
RepVideo: Rethinking Cross-Layer Representation for Video Generation15 Jan 2025 0 repositories listed
-
3D Gaussian Splatting with Normal Information for Mesh Extraction and Improved Rendering14 Jan 2025 0 repositories listed
-
Diffusion Adversarial Post-Training for One-Step Video Generation14 Jan 2025 0 repositories listed
-
GameFactory: Creating New Games with Generative Interactive Videos14 Jan 2025 0 repositories listed
-
LayerAnimate: Layer-specific Control for Animation14 Jan 2025 0 repositories listed
-
BlobGEN-Vid: Compositional Text-to-Video Generation with Blob Video Representations13 Jan 2025 0 repositories listed
-
Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss13 Jan 2025 0 repositories listed
-
HeteroLLM: Accelerating Large Language Model Inference on Mobile SoCs platform with Heterogeneous AI Accelerators11 Jan 2025 0 repositories listed
-
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning11 Jan 2025 0 repositories listed
-
MEt3R: Measuring Multi-View Consistency in Generated Images10 Jan 2025 0 repositories listed
-
Multi-subject Open-set Personalization in Video Generation10 Jan 2025 0 repositories listed
-
VideoAuteur: Towards Long Narrative Video Generation10 Jan 2025 0 repositories listed
-
Progressive Growing of Video Tokenizers for Highly Compressed Latent Spaces9 Jan 2025 0 repositories listed
-
ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning8 Jan 2025 0 repositories listed
-
LipGen: Viseme-Guided Lip Video Generation for Enhancing Visual Speech Recognition8 Jan 2025 0 repositories listed
-
Tuning-Free Long Video Generation via Global-Local Collaborative Diffusion8 Jan 2025 0 repositories listed
-
Motion-Aware Generative Frame Interpolation7 Jan 2025 0 repositories listed
-
Brick-Diffusion: Generating Long Videos with Brick-to-Wall Denoising6 Jan 2025 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.