Browse State-of-the-Art › Video Captioning › Papers, page 4
Video Captioning
Papers archive 2025-07-28
archive papers tagged: 473 · with a code link: 211 · where Syntology ran a sample: 64 (56 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (64 of 473 tagged: 56 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument)
Page 4 of 5: papers 301 to 400 of 473, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Exploiting Auxiliary Caption for Video Grounding15 Jan 2023 0 repositories listed
-
Exploring Group Video Captioning with Efficient Relational Approximation1 Jan 2023 0 repositories listed
-
HiVLP: Hierarchical Interactive Video-Language Pre-Training1 Jan 2023 0 repositories listed
-
ReGen: A good Generative Zero-Shot Video Classifier Should be Rewarded1 Jan 2023 0 repositories listed
-
30 Dec 2022 0 repositories listed
-
MAViC: Multimodal Active Learning for Video Captioning11 Dec 2022 0 repositories listed
-
9 Dec 2022 0 repositories listed
-
Aligning Source Visual and Target Language Domains for Unpaired Video Captioning22 Nov 2022 0 repositories listed
-
Fighting FIRe with FIRE: Assessing the Validity of Text-to-Video Retrieval Benchmarks10 Oct 2022 0 repositories listed
-
Recipe Generation from Unsegmented Cooking Videos21 Sep 2022 0 repositories listed
-
15 Sep 2022 0 repositories listed
-
Boosting Video-Text Retrieval with Explicit High-Level Semantics8 Aug 2022 0 repositories listed
-
SAVCHOI: Detecting Suspicious Activities using Dense Video Captioning with Human Object Interactions24 Jul 2022 0 repositories listed
-
PIC 4th Challenge: Semantic-Assisted Multi-Feature Encoding and Multi-Head Decoding for Dense Video Captioning6 Jul 2022 0 repositories listed
-
Modality Alignment between Deep Representations for Effective Video-and-Language Learning1 Jun 2022 0 repositories listed
-
Attract me to Buy: Advertisement Copywriting Generation with Multimodal Multi-structured Information7 May 2022 0 repositories listed
-
Dual-Level Decoupled Transformer for Video Captioning6 May 2022 0 repositories listed
-
18 Apr 2022 0 repositories listed
-
Semantic-Aware Pretraining for Dense Video Captioning13 Apr 2022 0 repositories listed
-
Video Captioning: a comparative review of where we are and which could be the route12 Apr 2022 0 repositories listed
-
1 Apr 2022 0 repositories listed
-
CREATE: A Benchmark for Chinese Short Video Retrieval and Title Generation31 Mar 2022 0 repositories listed
-
Global2Local: A Joint-Hierarchical Attention for Video Captioning13 Mar 2022 0 repositories listed
-
Exploiting long-term temporal dynamics for video captioning22 Feb 2022 0 repositories listed
-
An Integrated Approach for Video Captioning and Applications23 Jan 2022 0 repositories listed
-
Generative Adversarial Network Applications in Creating a Meta-Universe23 Jan 2022 0 repositories listed
-
20 Jan 2022 0 repositories listed
-
Discourse Analysis for Evaluating Coherence in Video Paragraph Captions17 Jan 2022 0 repositories listed
-
End-to-end Dense Video Captioning as Sequence Generation16 Jan 2022 0 repositories listed
-
Boosting Video Representation Learning with Multi-Faceted Integration11 Jan 2022 0 repositories listed
-
Variational Stacked Local Attention Networks for Diverse Video Captioning4 Jan 2022 0 repositories listed
-
CoCo-BERT: Improving Video-Language Pre-training with Contrastive Cross-modal Matching and Denoising14 Dec 2021 0 repositories listed
-
1 Dec 2021 0 repositories listed
-
Multi-modal Dependency Tree for Video Captioning1 Dec 2021 0 repositories listed
-
DVCFlow: Modeling Information Flow Towards Human-like Video Captioning19 Nov 2021 0 repositories listed
-
CREATE: A Benchmark for Chinese Short Video Retrieval and Title Generation16 Nov 2021 0 repositories listed
-
E-MMAD: Multimodal Advertising Caption Generation Based on Structured Information16 Nov 2021 0 repositories listed
-
Fill-in-the-Blank: A Challenging Video Understanding Evaluation Framework16 Nov 2021 0 repositories listed
-
Visual-aware Attention Dual-stream Decoder for Video Captioning16 Oct 2021 0 repositories listed
-
CLIP4Caption: CLIP for Video Caption13 Oct 2021 0 repositories listed
-
CrossCLR: Cross-modal Contrastive Learning For Multi-modal Video Representations30 Sep 2021 0 repositories listed
-
Graph Similarities and Dual Approach for Sequential Text-to-Image Retrieval29 Sep 2021 0 repositories listed
-
22 Sep 2021 0 repositories listed
-
O2NA: An Object-Oriented Non-Autoregressive Approach for Controllable Video Captioning5 Aug 2021 0 repositories listed
-
Optimizing Latency for Online Video CaptioningUsing Audio-Visual Transformers4 Aug 2021 0 repositories listed
-
Boosting Video Captioning with Dynamic Loss Network25 Jul 2021 0 repositories listed
-
iReason: Multimodal Commonsense Reasoning using Videos and Natural Language with Interpretability25 Jun 2021 0 repositories listed
-
Sketch, Ground, and Refine: Top-Down Dense Video Captioning19 Jun 2021 0 repositories listed
-
Towards Bridging Event Captioner and Sentence Localizer for Weakly Supervised Dense Event Captioning19 Jun 2021 0 repositories listed
-
17 Jun 2021 0 repositories listed
-
Weakly Supervised Dense Video Captioning via Jointly Usage of Knowledge Distillation and Cross-modal Matching18 May 2021 0 repositories listed
-
Automatic Generation of Descriptive Titles for Video Clips Using Deep Learning7 Apr 2021 0 repositories listed
-
The Use of Video Captioning for Fostering Physical Activity7 Apr 2021 0 repositories listed
-
CUPID: Adaptive Curation of Pre-training Data for Video-and-Language Representation Learning1 Apr 2021 0 repositories listed
-
Open-book Video Captioning with Retrieve-Copy-Generate Network9 Mar 2021 0 repositories listed
-
Recent Advances in Video Question Answering: A Review of Datasets and Methods15 Jan 2021 0 repositories listed
-
Exploration of Visual Features and their weighted-additive fusion for Video Captioning14 Jan 2021 0 repositories listed
-
Video Captioning in Compressed Video2 Jan 2021 0 repositories listed
-
Motion Guided Region Message Passing for Video Captioning1 Jan 2021 0 repositories listed
-
Guidance Module Network for Video Captioning20 Dec 2020 0 repositories listed
-
MSVD-Turkish: A Comprehensive Multimodal Dataset for Integrated Vision and Language Research in Turkish13 Dec 2020 0 repositories listed
-
Understanding Action Sequences based on Video Captioning for Learning-from-Observation9 Dec 2020 0 repositories listed
-
16 Nov 2020 0 repositories listed
-
Semi-Supervised Learning for Video Captioning1 Nov 2020 0 repositories listed
-
Transformer in action: a comparative study of transformer-based acoustic models for large scale speech recognition applications27 Oct 2020 0 repositories listed
-
TRECVID 2019: An Evaluation Campaign to Benchmark Video Activity Detection, Video Captioning and Matching, and Video Search & Retrieval21 Sep 2020 0 repositories listed
-
Video Captioning Using Weak Annotation2 Sep 2020 0 repositories listed
-
1 Sep 2020 0 repositories listed
-
In-Home Daily-Life Captioning Using Radio Signals25 Aug 2020 0 repositories listed
-
Active Learning for Video Description With Cluster-Regularized Ensemble Ranking27 Jul 2020 0 repositories listed
-
Pre-training for Video Captioning Challenge 2020 Summary27 Jul 2020 0 repositories listed
-
SBAT: Video Captioning with Sparse Boundary-Aware Transformer23 Jul 2020 0 repositories listed
-
Sparse Graph to Sequence Learning for Vision Conditioned Long Textual Sequence Generation12 Jul 2020 0 repositories listed
-
Auto-captions on GIF: A Large-scale Video-sentence Dataset for Vision-language Pre-training5 Jul 2020 0 repositories listed
-
SACT: Self-Aware Multi-Space Feature Composition Transformer for Multinomial Attention for Video Captioning25 Jun 2020 0 repositories listed
-
14 Jun 2020 0 repositories listed
-
7 Jun 2020 0 repositories listed
-
Rethinking and Improving Natural Language Generation with Layer-Wise Multi-View Decoding16 May 2020 0 repositories listed
-
Spatio-Temporal Graph for Video Captioning with Knowledge Distillation31 Mar 2020 0 repositories listed
-
Normalized and Geometry-Aware Self-Attention Network for Image Captioning19 Mar 2020 0 repositories listed
-
OVC-Net: Object-Oriented Video Captioning with Temporal Graph and Detail Enhancement8 Mar 2020 0 repositories listed
-
Hierarchical Memory Decoding for Video Captioning27 Feb 2020 0 repositories listed
-
26 Feb 2020 0 repositories listed
-
Spatio-Temporal Ranked-Attention Networks for Video Captioning17 Jan 2020 0 repositories listed
-
Vision and Language: from Visual Perception to Content Creation26 Dec 2019 0 repositories listed
-
28 Nov 2019 0 repositories listed
-
Characterizing the impact of using features extracted from pre-trained models on the quality of video captioning sequence-to-sequence models22 Nov 2019 0 repositories listed
-
Empirical Autopsy of Deep Video Captioning Frameworks21 Nov 2019 0 repositories listed
-
Crowd Video Captioning13 Nov 2019 0 repositories listed
-
Video Captioning with Text-based Dynamic Attention and Step-by-Step Learning5 Nov 2019 0 repositories listed
-
Guiding the Flowing of Semantics: Interpretable Video Captioning via POS Tag1 Nov 2019 0 repositories listed
-
Low-Rank HOCA: Efficient High-Order Cross-Modal Attention for Video Captioning1 Nov 2019 0 repositories listed
-
Diverse Video Captioning Through Latent Variable Expansion26 Oct 2019 0 repositories listed
-
Vatex Video Captioning Challenge 2020: Multi-View Features and Hybrid Reward Strategies for Video Captioning17 Oct 2019 0 repositories listed
-
Imperial College London Submission to VATEX Video Captioning Task16 Oct 2019 0 repositories listed
-
Integrating Temporal and Spatial Attentions for VATEX Video Captioning Challenge 201915 Oct 2019 0 repositories listed
-
VATEX Captioning Challenge 2019: Multi-modal Information Fusion and Multi-stage Training Strategy for Video Captioning13 Oct 2019 0 repositories listed
-
Human Action Sequence Classification7 Oct 2019 0 repositories listed
-
SMArT: Training Shallow Memory-aware Transformers for Robotic Explainability7 Oct 2019 0 repositories listed
-
Joint Syntax Representation Learning and Visual Cue Translation for Video Captioning1 Oct 2019 0 repositories listed