Browse State-of-the-Art › Video Question Answering › Papers, page 5
Video Question Answering
Papers archive 2025-07-28
archive papers tagged: 460 · with a code link: 250 · where Syntology ran a sample: 124 (107 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (124 of 460 tagged: 107 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 5 of 5: papers 401 to 460 of 460, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Structured Two-stream Attention Network for Video Question Answering2 Jun 2022 0 repositories listed
-
Modality Alignment between Deep Representations for Effective Video-and-Language Learning1 Jun 2022 0 repositories listed
-
Modeling Semantic Composition with Syntactic Hypergraph for Video Question Answering13 May 2022 0 repositories listed
-
Overview of the MedVidQA 2022 Shared Task on Medical Video Question-Answering1 May 2022 0 repositories listed
-
Video Language Co-Attention with Multimodal Fast-Learning Feature Fusion for VideoQA1 May 2022 0 repositories listed
-
Rethinking Multi-Modal Alignment in Video Question Answering from Feature and Sample Perspectives25 Apr 2022 0 repositories listed
-
Measuring Compositional Consistency for Video Question Answering14 Apr 2022 0 repositories listed
-
18 Feb 2022 0 repositories listed
-
8 Feb 2022 0 repositories listed
-
CoCo-BERT: Improving Video-Language Pre-training with Contrastive Cross-modal Matching and Denoising14 Dec 2021 0 repositories listed
-
Learning from Inside: Self-driven Siamese Sampling and Reasoning for Video Question Answering1 Dec 2021 0 repositories listed
-
LiVLR: A Lightweight Visual-Linguistic Reasoning Framework for Video Question Answering29 Nov 2021 0 repositories listed
-
CRAFT: A Benchmark for Causal Reasoning About Forces and inTeractions16 Nov 2021 0 repositories listed
-
Fill-in-the-Blank: A Challenging Video Understanding Evaluation Framework16 Nov 2021 0 repositories listed
-
Transferring Domain-Agnostic Knowledge in Video Question Answering26 Oct 2021 0 repositories listed
-
The Multi-Modal Video Reasoning and Analyzing Competition18 Aug 2021 0 repositories listed
-
Mounting Video Metadata on Transformer-based Language Model for Open-ended Video Question Answering11 Aug 2021 0 repositories listed
-
Multi-Scale Progressive Attention Network for Video Question Answering1 Aug 2021 0 repositories listed
-
CogME: A Cognition-Inspired Multi-Dimensional Evaluation Metric for Story Understanding21 Jul 2021 0 repositories listed
-
Hierarchical Object-oriented Spatio-Temporal Reasoning for Video Question Answering25 Jun 2021 0 repositories listed
-
iReason: Multimodal Commonsense Reasoning using Videos and Natural Language with Interpretability25 Jun 2021 0 repositories listed
-
Learning to Rehearse in Long Sequence Memorization2 Jun 2021 0 repositories listed
-
Bridge to Answer: Structure-aware Graph Interaction Network for Video Question Answering29 Apr 2021 0 repositories listed
-
Object-Centric Representation Learning for Video Question Answering12 Apr 2021 0 repositories listed
-
Video Question Answering with Phrases via Semantic Roles8 Apr 2021 0 repositories listed
-
CUPID: Adaptive Curation of Pre-training Data for Video-and-Language Representation Learning1 Apr 2021 0 repositories listed
-
30 Mar 2021 0 repositories listed
-
HySTER: A Hybrid Spatio-Temporal Event Reasoner17 Jan 2021 0 repositories listed
-
Recent Advances in Video Question Answering: A Review of Datasets and Methods15 Jan 2021 0 repositories listed
-
Env-QA: A Video Question Answering Benchmark for Comprehensive Understanding of Dynamic Environments1 Jan 2021 0 repositories listed
-
HAIR: Hierarchical Visual-Semantic Relational Reasoning for Video Question Answering1 Jan 2021 0 repositories listed
-
Video Question Answering Using Language-Guided Deep Compressed-Domain Video Feature1 Jan 2021 0 repositories listed
-
Trying Bilinear Pooling in Video-QA18 Dec 2020 0 repositories listed
-
16 Nov 2020 0 repositories listed
-
Co-attentional Transformers for Story-Based Video Understanding27 Oct 2020 0 repositories listed
-
Hierarchical Conditional Relation Networks for Multimodal Video Question Answering18 Oct 2020 0 repositories listed
-
Self-supervised pre-training and contrastive representation learning for multiple-choice video QA17 Sep 2020 0 repositories listed
-
Data augmentation techniques for the Video Question Answering task22 Aug 2020 0 repositories listed
-
Video Question Answering on Screencast Tutorials2 Aug 2020 0 repositories listed
-
What Gives the Answer Away? Question Answering Bias Analysis on Video QA Datasets7 Jul 2020 0 repositories listed
-
Auto-captions on GIF: A Large-scale Video-sentence Dataset for Vision-language Pre-training5 Jul 2020 0 repositories listed
-
Modality Shifting Attention Network for Multi-modal Video Question Answering4 Jul 2020 0 repositories listed
-
Knowledge-Based Visual Question Answering in Videos17 Apr 2020 0 repositories listed
-
Multimodal Transformer with Pointer Network for the DSTC8 AVSD Challenge25 Feb 2020 0 repositories listed
-
Video Dialog via Progressive Inference and Cross-Transformer1 Nov 2019 0 repositories listed
-
23 Oct 2019 0 repositories listed
-
Learning Question-Guided Video Representation for Multi-Turn Video Question Answering31 Jul 2019 0 repositories listed
-
Neural Reasoning, Fast and Slow, for Video Question Answering10 Jul 2019 0 repositories listed
-
Video Question Generation via Cross-Modal Self-Attention Networks Learning5 Jul 2019 0 repositories listed
-
Open-Ended Long-Form Video Question Answering via Hierarchical Convolutional Self-Attention Networks28 Jun 2019 0 repositories listed
-
Adversarial Multimodal Network for Movie Question Answering24 Jun 2019 0 repositories listed
-
Gaining Extra Supervision via Multi-task learning for Multi-Modal Video Question Answering28 May 2019 0 repositories listed
-
Holistic Multi-modal Memory Network for Movie Question Answering12 Nov 2018 0 repositories listed
-
Movie Question Answering: Remembering the Textual Cues for Layered Visual Contents25 Apr 2018 0 repositories listed
-
29 Mar 2018 0 repositories listed
-
Video Question Answering via Attribute-Augmented Attention Network Learning20 Jul 2017 0 repositories listed
-
The Forgettable-Watcher Model for Video Question Answering3 May 2017 0 repositories listed
-
MarioQA: Answering Questions by Watching Gameplay Videos6 Dec 2016 0 repositories listed
-
Leveraging Video Descriptions to Learn Video Question Answering12 Nov 2016 0 repositories listed
-
Uncovering Temporal Context for Video Question and Answering15 Nov 2015 0 repositories listed