{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/video-editing/papers/3","list_of":"/task/video-editing","task":"Video Editing","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":3,"pages_in_order":4,"rows_per_page":100,"rows":[201,300],"of":346,"counts":{"archive_papers_tagged":346,"with_a_code_link":133,"where_syntology_ran_a_sample":46,"not_listed_spam_title":0,"listed":346,"listed_where_code_ran":46,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":40,"every_run_a_failure_of_syntologys_instrument":6,"listed_with_a_run_with_no_instrument_failure":40,"listed_every_run_a_failure_of_syntologys_instrument":6,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/video-editing","prev":"/task/video-editing/papers/2","next":"/task/video-editing/papers/4","papers":[{"url":null,"slug":"portrait-video-editing-empowered-by","title":"Portrait Video Editing Empowered by Multimodal Generative Priors","date":"2024-09-20","arxiv_id":"2409.13591","repositories_listed":0,"syntology":null},{"url":null,"slug":"blended-latent-diffusion-under-attention","title":"Blended Latent Diffusion under Attention Control for Real-World Video Editing","date":"2024-09-05","arxiv_id":"2409.03514","repositories_listed":0,"syntology":null},{"url":null,"slug":"sync-from-the-sea-retrieving-alignable-videos","title":"Sync from the Sea: Retrieving Alignable Videos from Large-Scale Datasets","date":"2024-09-02","arxiv_id":"2409.01445","repositories_listed":0,"syntology":null},{"url":null,"slug":"css-segment-2nd-place-report-of-lsvos","title":"CSS-Segment: 2nd Place Report of LSVOS Challenge VOS Track","date":"2024-08-24","arxiv_id":"2408.13582","repositories_listed":0,"syntology":null},{"url":null,"slug":"audio-match-cutting-finding-and-creating","title":"Audio Match Cutting: Finding and Creating Matching Audio Transitions in Movies and Videos","date":"2024-08-20","arxiv_id":"2408.10998","repositories_listed":0,"syntology":null},{"url":null,"slug":"deco-decoupled-human-centered-diffusion-video","title":"DeCo: Decoupled Human-Centered Diffusion Video Editing with Motion Consistency","date":"2024-08-14","arxiv_id":"2408.07481","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-gained-zero-shot-video-sampling","title":"Fine-gained Zero-shot Video Sampling","date":"2024-07-31","arxiv_id":"2407.21475","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-based-talking-video-editing-with","title":"Text-based Talking Video Editing with Cascaded Conditional Diffusion","date":"2024-07-20","arxiv_id":"2407.14841","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-sentence-video-grounding-for-long-video","title":"Multi-sentence Video Grounding for Long Video Generation","date":"2024-07-18","arxiv_id":"2407.13219","repositories_listed":0,"syntology":null},{"url":null,"slug":"invi-object-insertion-in-videos-using-off-the","title":"InVi: Object Insertion In Videos Using Off-the-Shelf Diffusion Models","date":"2024-07-15","arxiv_id":"2407.10958","repositories_listed":0,"syntology":null},{"url":null,"slug":"audio-driven-high-resolution-seamless-talking","title":"Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN","date":"2024-07-08","arxiv_id":"2407.05577","repositories_listed":0,"syntology":null},{"url":null,"slug":"transformer-based-image-and-video-inpainting","title":"Transformer-based Image and Video Inpainting: Current Challenges and Future Directions","date":"2024-06-28","arxiv_id":"2407.00226","repositories_listed":0,"syntology":null},{"url":null,"slug":"v-lasik-consistent-glasses-removal-from","title":"V-LASIK: Consistent Glasses-Removal from Videos Using Synthetic Data","date":"2024-06-20","arxiv_id":"2406.14510","repositories_listed":0,"syntology":null},{"url":null,"slug":"via-a-spatiotemporal-video-adaptation","title":"VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing","date":"2024-06-18","arxiv_id":"2406.12831","repositories_listed":0,"syntology":null},{"url":null,"slug":"videogui-a-benchmark-for-gui-automation-from","title":"VideoGUI: A Benchmark for GUI Automation from Instructional Videos","date":"2024-06-14","arxiv_id":"2406.10227","repositories_listed":0,"syntology":null},{"url":null,"slug":"instruct-4d-to-4d-editing-4d-scenes-as-pseudo-1","title":"Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion","date":"2024-06-13","arxiv_id":"2406.09402","repositories_listed":0,"syntology":null},{"url":null,"slug":"2nd-place-solution-for-mose-track-in-cvpr","title":"2nd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation","date":"2024-06-12","arxiv_id":"2406.08192","repositories_listed":0,"syntology":null},{"url":null,"slug":"hoi-swap-swapping-objects-in-videos-with-hand","title":"HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness","date":"2024-06-11","arxiv_id":"2406.07754","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-free-robust-interactive-video-object","title":"Training-Free Robust Interactive Video Object Segmentation","date":"2024-06-08","arxiv_id":"2406.05485","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-video-editing-through-adaptive","title":"Zero-Shot Video Editing through Adaptive Sliding Score Distillation","date":"2024-06-07","arxiv_id":"2406.04888","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-temporal-consistency-in-video","title":"Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting","date":"2024-06-04","arxiv_id":"2406.02541","repositories_listed":0,"syntology":null},{"url":null,"slug":"2nd-place-solution-for-pvuw-challenge-2024","title":"2nd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation","date":"2024-06-01","arxiv_id":"2406.00500","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-curious-case-of-end-token-a-zero-shot","title":"The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP","date":"2024-06-01","arxiv_id":"2406.00457","repositories_listed":0,"syntology":null},{"url":null,"slug":"unified-editing-of-panorama-3d-scenes-and","title":"Unified Editing of Panorama, 3D Scenes, and Videos Through Disentangled Self-Attention Injection","date":"2024-05-27","arxiv_id":"2405.16823","repositories_listed":0,"syntology":null},{"url":null,"slug":"i2vedit-first-frame-guided-video-editing-via","title":"I2VEdit: First-Frame-Guided Video Editing via Image-to-Video Diffusion Models","date":"2024-05-26","arxiv_id":"2405.16537","repositories_listed":0,"syntology":null},{"url":null,"slug":"revideo-remake-a-video-with-motion-and","title":"ReVideo: Remake a Video with Motion and Content Control","date":"2024-05-22","arxiv_id":"2405.13865","repositories_listed":0,"syntology":null},{"url":null,"slug":"edit-your-motion-space-time-diffusion","title":"Edit-Your-Motion: Space-Time Diffusion Decoupling Learning for Video Motion Editing","date":"2024-05-07","arxiv_id":"2405.04496","repositories_listed":0,"syntology":null},{"url":null,"slug":"genvideo-one-shot-target-image-and-shape","title":"GenVideo: One-shot Target-image and Shape Aware Video Editing using T2I Diffusion Models","date":"2024-04-18","arxiv_id":"2404.12541","repositories_listed":0,"syntology":null},{"url":null,"slug":"ctrl-adapter-an-efficient-and-versatile","title":"Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model","date":"2024-04-15","arxiv_id":"2404.09967","repositories_listed":0,"syntology":null},{"url":null,"slug":"s3editor-a-sparse-semantic-disentangled-self","title":"S3Editor: A Sparse Semantic-Disentangled Self-Training Framework for Face Video Editing","date":"2024-04-11","arxiv_id":"2404.08111","repositories_listed":0,"syntology":null},{"url":null,"slug":"investigating-the-effectiveness-of-cross","title":"Investigating the Effectiveness of Cross-Attention to Unlock Zero-Shot Editing of Text-to-Video Diffusion Models","date":"2024-04-08","arxiv_id":"2404.05519","repositories_listed":0,"syntology":null},{"url":null,"slug":"animatezoo-zero-shot-video-generation-of","title":"AnimateZoo: Zero-shot Video Generation of Cross-Species Animation via Subject Alignment","date":"2024-04-07","arxiv_id":"2404.04946","repositories_listed":0,"syntology":null},{"url":null,"slug":"expressedit-video-editing-with-natural","title":"ExpressEdit: Video Editing with Natural Language and Sketching","date":"2024-03-26","arxiv_id":"2403.17693","repositories_listed":0,"syntology":null},{"url":null,"slug":"edit3k-universal-representation-learning-for","title":"Edit3K: Universal Representation Learning for Video Editing Components","date":"2024-03-24","arxiv_id":"2403.16048","repositories_listed":0,"syntology":null},{"url":null,"slug":"eva-zero-shot-accurate-attributes-and-multi","title":"EVA: Zero-shot Accurate Attributes and Multi-Object Video Editing","date":"2024-03-24","arxiv_id":"2403.16111","repositories_listed":0,"syntology":null},{"url":null,"slug":"cartoon-hallucinations-detection-pose-aware","title":"Make VLM Recognize Visual Hallucination on Cartoon Character Image with Pose Information","date":"2024-03-22","arxiv_id":"2403.15048","repositories_listed":0,"syntology":null},{"url":null,"slug":"videoshop-localized-semantic-video-editing","title":"Videoshop: Localized Semantic Video Editing with Noise-Extrapolated Diffusion Inversion","date":"2024-03-21","arxiv_id":"2403.14617","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreammotion-space-time-self-similarity-score","title":"DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing","date":"2024-03-18","arxiv_id":"2403.12002","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-editing-via-factorized-diffusion","title":"Video Editing via Factorized Diffusion Distillation","date":"2024-03-14","arxiv_id":"2403.09334","repositories_listed":0,"syntology":null},{"url":null,"slug":"vlogger-multimodal-diffusion-for-embodied","title":"VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis","date":"2024-03-13","arxiv_id":"2403.08764","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-reimagined-text-to-pose-video-editing","title":"Action Reimagined: Text-to-Pose Video Editing for Dynamic Human Actions","date":"2024-03-11","arxiv_id":"2403.07198","repositories_listed":0,"syntology":null},{"url":null,"slug":"fastvideoedit-leveraging-consistency-models","title":"FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing","date":"2024-03-10","arxiv_id":"2403.06269","repositories_listed":0,"syntology":null},{"url":null,"slug":"reframe-anything-llm-agent-for-open-world","title":"Reframe Anything: LLM Agent for Open World Video Reframing","date":"2024-03-10","arxiv_id":"2403.06070","repositories_listed":0,"syntology":null},{"url":null,"slug":"place-anything-into-any-video","title":"Place Anything into Any Video","date":"2024-02-22","arxiv_id":"2402.14316","repositories_listed":0,"syntology":null},{"url":null,"slug":"uniedit-a-unified-tuning-free-framework-for","title":"UniEdit: A Unified Tuning-Free Framework for Video Motion and Appearance Editing","date":"2024-02-20","arxiv_id":"2402.13185","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-video-translation-via-query-warping","title":"Human Video Translation via Query Warping","date":"2024-02-19","arxiv_id":"2402.12099","repositories_listed":0,"syntology":null},{"url":null,"slug":"lave-llm-powered-agent-assistance-and","title":"LAVE: LLM-Powered Agent Assistance and Language Augmentation for Video Editing","date":"2024-02-15","arxiv_id":"2402.10294","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-editing-for-video-retrieval","title":"Video Editing for Video Retrieval","date":"2024-02-04","arxiv_id":"2402.02335","repositories_listed":0,"syntology":null},{"url":null,"slug":"anything-in-any-scene-photorealistic-video","title":"Anything in Any Scene: Photorealistic Video Object Insertion","date":"2024-01-30","arxiv_id":"2401.17509","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-video-diffusion-for-unseen-cross","title":"Generative Video Diffusion for Unseen Cross-Domain Video Moment Retrieval","date":"2024-01-24","arxiv_id":"2401.13329","repositories_listed":0,"syntology":null},{"url":null,"slug":"worlddreamer-towards-general-world-models-for","title":"WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens","date":"2024-01-18","arxiv_id":"2401.09985","repositories_listed":0,"syntology":null},{"url":null,"slug":"object-centric-diffusion-for-efficient-video","title":"Object-Centric Diffusion for Efficient Video Editing","date":"2024-01-11","arxiv_id":"2401.05735","repositories_listed":0,"syntology":null},{"url":null,"slug":"vase-object-centric-appearance-and-shape","title":"VASE: Object-Centric Appearance and Shape Manipulation of Real Videos","date":"2024-01-04","arxiv_id":"2401.02473","repositories_listed":0,"syntology":null},{"url":null,"slug":"camel-causal-motion-enhancement-tailored-for","title":"CAMEL: CAusal Motion Enhancement Tailored for Lifting Text-driven Video Editing","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"from-covert-hiding-to-visual-editing-robust","title":"From Covert Hiding to Visual Editing: Robust Generative Video Steganography","date":"2024-01-01","arxiv_id":"2401.00652","repositories_listed":0,"syntology":null},{"url":null,"slug":"lamp-learn-a-motion-pattern-for-few-shot-1","title":"LAMP: Learn A Motion Pattern for Few-Shot Video Generation","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-frame-affinity-for-srgb-to-raw","title":"Leveraging Frame Affinity for sRGB-to-RAW Video De-rendering","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fairy-fast-parallelized-instruction-guided","title":"Fairy: Fast Parallelized Instruction-Guided Video-to-Video Synthesis","date":"2023-12-20","arxiv_id":"2312.13834","repositories_listed":0,"syntology":null},{"url":null,"slug":"maskint-video-editing-via-interpolative-non","title":"MaskINT: Video Editing via Interpolative Non-autoregressive Masked Transformers","date":"2023-12-19","arxiv_id":"2312.12468","repositories_listed":0,"syntology":null},{"url":null,"slug":"realcraft-attention-control-as-a-solution-for","title":"RealCraft: Attention Control as A Tool for Zero-Shot Consistent Video Editing","date":"2023-12-19","arxiv_id":"2312.12635","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-video-fields-editing","title":"Neural Video Fields Editing","date":"2023-12-12","arxiv_id":"2312.08882","repositories_listed":0,"syntology":null},{"url":null,"slug":"neutral-editing-framework-for-diffusion-based","title":"Neutral Editing Framework for Diffusion-based Video Editing","date":"2023-12-10","arxiv_id":"2312.06708","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-3d-particle-based-simulators-from","title":"Learning 3D Particle-based Simulators from RGB-D Videos","date":"2023-12-08","arxiv_id":"2312.05359","repositories_listed":0,"syntology":null},{"url":null,"slug":"gendef-learning-generative-deformation-field","title":"GenDeF: Learning Generative Deformation Field for Video Generation","date":"2023-12-07","arxiv_id":"2312.04561","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusionatlas-high-fidelity-consistent","title":"DiffusionAtlas: High-Fidelity Consistent Diffusion Video Editing","date":"2023-12-05","arxiv_id":"2312.03772","repositories_listed":0,"syntology":null},{"url":null,"slug":"drag-a-video-non-rigid-video-editing-with","title":"Drag-A-Video: Non-rigid Video Editing with Point-based Interaction","date":"2023-12-05","arxiv_id":"2312.02936","repositories_listed":0,"syntology":null},{"url":null,"slug":"save-protagonist-diversification-with","title":"SAVE: Protagonist Diversification with Structure Agnostic Video Editing","date":"2023-12-05","arxiv_id":"2312.02503","repositories_listed":0,"syntology":null},{"url":null,"slug":"videoswap-customized-video-subject-swapping","title":"VideoSwap: Customized Video Subject Swapping with Interactive Semantic Point Correspondence","date":"2023-12-04","arxiv_id":"2312.02087","repositories_listed":0,"syntology":null},{"url":"/paper/zero-shot-video-question-answering-with","slug":"zero-shot-video-question-answering-with","title":"Zero-Shot Video Question Answering with Procedural Programs","date":"2023-12-01","arxiv_id":"2312.00937","repositories_listed":0,"syntology":null},{"url":null,"slug":"motion-conditioned-image-animation-for-video","title":"Motion-Conditioned Image Animation for Video Editing","date":"2023-11-30","arxiv_id":"2311.18827","repositories_listed":0,"syntology":null},{"url":null,"slug":"vidiff-translating-videos-via-multi-modal","title":"VIDiff: Translating Videos via Multi-Modal Instructions with Diffusion Models","date":"2023-11-30","arxiv_id":"2311.18837","repositories_listed":0,"syntology":null},{"url":null,"slug":"zest-nerf-using-temporal-aggregation-for-zero","title":"ZeST-NeRF: Using temporal aggregation for Zero-Shot Temporal NeRFs","date":"2023-11-30","arxiv_id":"2311.18491","repositories_listed":0,"syntology":null},{"url":null,"slug":"real-time-gazed-online-shot-selection-and","title":"Real Time GAZED: Online Shot Selection and Editing of Virtual Cameras from Wide-Angle Monocular Video Recordings","date":"2023-11-27","arxiv_id":"2311.15581","repositories_listed":0,"syntology":null},{"url":null,"slug":"highly-detailed-and-temporal-consistent-video","title":"Highly Detailed and Temporal Consistent Video Stylization via Synchronized Multi-Frame Diffusion","date":"2023-11-24","arxiv_id":"2311.14343","repositories_listed":0,"syntology":null},{"url":null,"slug":"cut-and-paste-subject-driven-video-editing","title":"Cut-and-Paste: Subject-Driven Video Editing with Attention Control","date":"2023-11-20","arxiv_id":"2311.11697","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-the-what-and-how-of-annotation-in","title":"Learning the What and How of Annotation in Video Object Segmentation","date":"2023-11-08","arxiv_id":"2311.04414","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynvideo-e-harnessing-dynamic-nerf-for-large","title":"DynVideo-E: Harnessing Dynamic NeRF for Large-Scale Motion- and View-Change Human-Centric Video Editing","date":"2023-10-16","arxiv_id":"2310.10624","repositories_listed":0,"syntology":null},{"url":null,"slug":"uvl-a-unified-framework-for-video-tampering","title":"UVL2: A Unified Framework for Video Tampering Localization","date":"2023-09-28","arxiv_id":"2309.16126","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-attacks-on-video-object","title":"Adversarial Attacks on Video Object Segmentation with Hard Region Discovery","date":"2023-09-25","arxiv_id":"2309.13857","repositories_listed":0,"syntology":null},{"url":null,"slug":"hashing-neural-video-decomposition-with","title":"Hashing Neural Video Decomposition with Multiplicative Residuals in Space-Time","date":"2023-09-25","arxiv_id":"2309.14022","repositories_listed":0,"syntology":null},{"url":null,"slug":"magicprop-diffusion-based-video-editing-via","title":"MagicProp: Diffusion-based Video Editing via Motion-aware Appearance Propagation","date":"2023-09-02","arxiv_id":"2309.00908","repositories_listed":0,"syntology":null},{"url":null,"slug":"magicedit-high-fidelity-and-temporally","title":"MagicEdit: High-Fidelity and Temporally Coherent Video Editing","date":"2023-08-28","arxiv_id":"2308.14749","repositories_listed":0,"syntology":null},{"url":null,"slug":"eve-efficient-zero-shot-text-based-video","title":"EVE: Efficient zero-shot text-based Video Editing with Depth Map Guidance and Temporal Consistency Constraints","date":"2023-08-21","arxiv_id":"2308.10648","repositories_listed":0,"syntology":null},{"url":null,"slug":"simda-simple-diffusion-adapter-for-efficient","title":"SimDA: Simple Diffusion Adapter for Efficient Video Generation","date":"2023-08-18","arxiv_id":"2308.09710","repositories_listed":0,"syntology":null},{"url":null,"slug":"infusion-inject-and-attention-fusion-for","title":"InFusion: Inject and Attention Fusion for Multi Concept Zero-Shot Text-based Video Editing","date":"2023-07-22","arxiv_id":"2308.00135","repositories_listed":0,"syntology":null},{"url":null,"slug":"inve-interactive-neural-video-editing","title":"INVE: Interactive Neural Video Editing","date":"2023-07-15","arxiv_id":"2307.07663","repositories_listed":0,"syntology":null},{"url":null,"slug":"videdit-zero-shot-and-spatially-aware-text","title":"VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing","date":"2023-06-14","arxiv_id":"2306.08707","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-consistent-video-editing-with-text-to","title":"Towards Consistent Video Editing with Text-to-Image Diffusion Models","date":"2023-05-27","arxiv_id":"2305.17431","repositories_listed":0,"syntology":null},{"url":null,"slug":"instructvid2vid-controllable-video-editing","title":"InstructVid2Vid: Controllable Video Editing with Natural Language Instructions","date":"2023-05-21","arxiv_id":"2305.12328","repositories_listed":0,"syntology":null},{"url":null,"slug":"make-a-protagonist-generic-video-editing-with","title":"Make-A-Protagonist: Generic Video Editing with An Ensemble of Experts","date":"2023-05-15","arxiv_id":"2305.08850","repositories_listed":0,"syntology":null},{"url":null,"slug":"haista-net-human-assisted-instance","title":"HAISTA-NET: Human Assisted Instance Segmentation Through Attention","date":"2023-05-04","arxiv_id":"2305.03105","repositories_listed":0,"syntology":null},{"url":null,"slug":"vidstyleode-disentangled-video-editing-via","title":"VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs","date":"2023-04-12","arxiv_id":"2304.06020","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-deep-multiscale-framework-for-video","title":"A Deep Multiscale Framework for Video Watermarking","date":"2023-03-28","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"edit-a-video-single-video-editing-with-object","title":"Edit-A-Video: Single Video Editing with Object-Aware Consistency","date":"2023-03-14","arxiv_id":"2303.07945","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatch-a-large-scale-audio-beat-matching","title":"AutoMatch: A Large-scale Audio Beat Matching Benchmark for Boosting Deep Learning Assistant Video Editing","date":"2023-03-03","arxiv_id":"2303.01884","repositories_listed":0,"syntology":null},{"url":null,"slug":"designing-a-3d-aware-stylenerf-encoder-for","title":"Designing a 3D-Aware StyleNeRF Encoder for Face Editing","date":"2023-02-19","arxiv_id":"2302.09467","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamix-video-diffusion-models-are-general","title":"Dreamix: Video Diffusion Models are General Video Editors","date":"2023-02-02","arxiv_id":"2302.01329","repositories_listed":0,"syntology":null},{"url":null,"slug":"shape-aware-text-driven-layered-video-editing","title":"Shape-aware Text-driven Layered Video Editing","date":"2023-01-30","arxiv_id":"2301.13173","repositories_listed":0,"syntology":null},{"url":null,"slug":"ai-based-approach-to-trailer-generation-for","title":"AI based approach to Trailer Generation for Online Educational Courses","date":"2023-01-10","arxiv_id":"2301.03957","repositories_listed":0,"syntology":null},{"url":null,"slug":"speech-driven-video-editing-via-an-audio","title":"Speech Driven Video Editing via an Audio-Conditioned Diffusion Model","date":"2023-01-10","arxiv_id":"2301.04474","repositories_listed":0,"syntology":null}],"record_sha256":"c38b9170c54346ca64aa3216b70a2b5a0961979cc7b7ed2b513fbb6d1521acd8","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}