Browse State-of-the-Art › Video Captioning › Papers, page 5
Video Captioning
Papers archive 2025-07-28
archive papers tagged: 473 · with a code link: 211 · where Syntology ran a sample: 64 (56 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (64 of 473 tagged: 56 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument)
Page 5 of 5: papers 401 to 473 of 473, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Actions from Human Demonstration Video for Robotic Manipulation10 Sep 2019 0 repositories listed
-
Prediction and Description of Near-Future Activities in Video2 Aug 2019 0 repositories listed
-
Watch It Twice: Video Captioning with a Refocused Video Encoder21 Jul 2019 0 repositories listed
-
Activitynet 2019 Task 3: Exploring Contexts for Dense Captioning Events in Videos11 Jul 2019 0 repositories listed
-
Learning Video Representations using Contrastive Bidirectional Transformer13 Jun 2019 0 repositories listed
-
Object-aware Aggregation with Bidirectional Temporal Graph for Video Captioning11 Jun 2019 0 repositories listed
-
Attention is all you need for Videos: Self-attention based Video Summarization using Universal Transformers6 Jun 2019 0 repositories listed
-
Relational Reasoning using Prior Knowledge for Visual Captioning4 Jun 2019 0 repositories listed
-
Reconstruct and Represent Video Contents for Captioning via Reinforcement Learning3 Jun 2019 0 repositories listed
-
Interactive-predictive neural multimodal systems30 May 2019 0 repositories listed
-
On Flow Profile Image for Video Representation12 May 2019 0 repositories listed
-
Multimodal Semantic Attention Network for Video Captioning8 May 2019 0 repositories listed
-
Hierarchical Recurrent Neural Network for Video Summarization28 Apr 2019 0 repositories listed
-
End-to-End Video Captioning4 Apr 2019 0 repositories listed
-
Spatio-Temporal Dynamics and Semantic Attribute Enriched Visual Encoding for Video Captioning27 Feb 2019 0 repositories listed
-
Not All Words are Equal: Video-specific Information Loss for Video Captioning1 Jan 2019 0 repositories listed
-
Hierarchical LSTMs with Adaptive Attention for Visual Captioning26 Dec 2018 0 repositories listed
-
An Attempt towards Interpretable Audio-Visual Video Captioning7 Dec 2018 0 repositories listed
-
Learning to Compose Topic-Aware Mixture of Experts for Zero-Shot Video Captioning7 Nov 2018 0 repositories listed
-
Middle-Out Decoding28 Oct 2018 0 repositories listed
-
Image-to-Video Person Re-Identification by Reusing Cross-modal Embeddings4 Oct 2018 0 repositories listed
-
A Dataset for Telling the Stories of Social Media Videos1 Oct 2018 0 repositories listed
-
Incorporating Background Knowledge into Video Description Generation1 Oct 2018 0 repositories listed
-
Temporally Grounding Natural Sentence in Video1 Oct 2018 0 repositories listed
-
Vector Learning for Cross Domain Representations27 Sep 2018 0 repositories listed
-
Bridge Video and Text with Cascade Syntactic Structure1 Aug 2018 0 repositories listed
-
Move Forward and Tell: A Progressive Generator of Video Descriptions26 Jul 2018 0 repositories listed
-
Video Captioning with Boundary-aware Hierarchical Language Decoding and Joint Video Prediction8 Jul 2018 0 repositories listed
-
Deep Reinforcement Learning for NLP1 Jul 2018 0 repositories listed
-
Best Vision Technologies Submission to ActivityNet Challenge 2018-Task: Dense-Captioning Events in Videos25 Jun 2018 0 repositories listed
-
RUC+CMU: System Report for Dense Captioning Events in Videos22 Jun 2018 0 repositories listed
-
Fine-Grained Video Captioning for Sports Narrative1 Jun 2018 0 repositories listed
-
Interpretable Video Captioning via Trajectory Structured Localization1 Jun 2018 0 repositories listed
-
M3: Multimodal Memory Modelling for Video Captioning1 Jun 2018 0 repositories listed
-
Amortized Context Vector Inference for Sequence-to-Sequence Networks23 May 2018 0 repositories listed
-
Jointly Localizing and Describing Events for Dense Video Captioning23 Apr 2018 0 repositories listed
-
Less Is More: Picking Informative Frames for Video Captioning5 Mar 2018 0 repositories listed
-
Consensus-based Sequence Training for Video Captioning27 Dec 2017 0 repositories listed
-
Video Captioning via Hierarchical Reinforcement Learning29 Nov 2017 0 repositories listed
-
Attend and Interact: Higher-Order Object Interactions for Video Understanding16 Nov 2017 0 repositories listed
-
Grounded Objects and Interactions for Video Captioning16 Nov 2017 0 repositories listed
-
Procedural Text Generation from an Execution Video1 Nov 2017 0 repositories listed
-
Evaluation of Automatic Video Captioning Using Direct Assessment29 Oct 2017 0 repositories listed
-
Generating Video Descriptions with Topic Guidance31 Aug 2017 0 repositories listed
-
Video Captioning with Guidance of Multimodal Latent Topics31 Aug 2017 0 repositories listed
-
From Deterministic to Generative: Multi-Modal Stochastic RNNs for Video Captioning8 Aug 2017 0 repositories listed
-
Reinforced Video Captioning with Entailment Rewards7 Aug 2017 0 repositories listed
-
Supervising Neural Attention Models for Video Captioning by Human Gaze Data19 Jul 2017 0 repositories listed
-
Multimodal Machine Learning: Integrating Language, Vision and Speech1 Jul 2017 0 repositories listed
-
Task-Driven Dynamic Fusion: Reducing Ambiguity in Video Description1 Jul 2017 0 repositories listed
-
Hierarchical LSTM with Adjusted Temporal Attention for Video Captioning5 Jun 2017 0 repositories listed
-
Multi-Task Video Captioning with Video and Entailment Generation24 Apr 2017 0 repositories listed
-
Weakly Supervised Dense Video Captioning5 Apr 2017 0 repositories listed
-
Improving Interpretability of Deep Neural Networks with Semantic Information12 Mar 2017 0 repositories listed
-
Video Captioning with Multi-Faceted Attention1 Dec 2016 0 repositories listed
-
Bidirectional Multirate Reconstruction for Temporal Modeling in Videos28 Nov 2016 0 repositories listed
-
Hierarchical Boundary-Aware Neural Encoder for Video Captioning28 Nov 2016 0 repositories listed
-
Adaptive Feature Abstraction for Translating Video to Text23 Nov 2016 0 repositories listed
-
Video Captioning with Transferred Semantic Attributes23 Nov 2016 0 repositories listed
-
Recurrent Memory Addressing for describing videos20 Nov 2016 0 repositories listed
-
Multimodal Memory Modelling for Video Captioning17 Nov 2016 0 repositories listed
-
Spatio-Temporal Attention Models for Grounded Video Captioning17 Oct 2016 0 repositories listed
-
10 Oct 2016 0 repositories listed
-
Title Generation for User Generated Videos25 Aug 2016 0 repositories listed
-
A Shared Task on Multimodal Machine Translation and Crosslingual Image Description1 Aug 2016 0 repositories listed
-
MUTT: Metric Unit TesTing for Language Generation Tasks1 Aug 2016 0 repositories listed
-
Bidirectional Long-Short Term Memory for Video Description15 Jun 2016 0 repositories listed
-
Storytelling of Photo Stream with Bidirectional Multi-thread Recurrent Neural Network2 Jun 2016 0 repositories listed
-
Beyond Caption To Narrative: Video Captioning With Multiple Sentences18 May 2016 0 repositories listed
-
A Restricted Visual Turing Test for Deep Scene and Event Understanding6 Dec 2015 0 repositories listed
-
Hierarchical Recurrent Neural Encoder for Video Representation with Application to Captioning11 Nov 2015 0 repositories listed
-
Video Paragraph Captioning Using Hierarchical Recurrent Neural Networks26 Oct 2015 0 repositories listed
-
Chinese Whispers: Cooperative Paraphrase Acquisition1 May 2012 0 repositories listed