Browse State-of-the-Art › Visual Question Answering (VQA) › Papers, page 20
Visual Question Answering (VQA)
Papers archive 2025-07-28
archive papers tagged: 2,167 · with a code link: 1,039 · where Syntology ran a sample: 359 (287 with a run with no instrument failure, 72 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (359 of 2,167 tagged: 287 with a run with no instrument failure, 72 where every run was a failure of Syntology's instrument)
Page 20 of 22: papers 1,901 to 2,000 of 2,167, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Visual Question Answering for Cultural Heritage22 Mar 2020 0 repositories listed
-
Normalized and Geometry-Aware Self-Attention Network for Image Captioning19 Mar 2020 0 repositories listed
-
RSVQA: Visual Question Answering for Remote Sensing Data16 Mar 2020 0 repositories listed
-
3 Mar 2020 0 repositories listed
-
A Study on Multimodal and Interactive Explanations for Visual Question Answering1 Mar 2020 0 repositories listed
-
Unshuffling Data for Improved Generalization27 Feb 2020 0 repositories listed
-
A Comparative Evaluation of Temporal Pooling Methods for Blind Video Quality Assessment25 Feb 2020 0 repositories listed
-
What BERT Sees: Cross-Modal Transfer for Visual Question Generation25 Feb 2020 0 repositories listed
-
On the General Value of Evidence, and Bilingual Scene-Text Visual Question Answering24 Feb 2020 0 repositories listed
-
VQA-LOL: Visual Question Answering under the Lens of Logic19 Feb 2020 0 repositories listed
-
CQ-VQA: Visual Question Answering on Categorized Questions17 Feb 2020 0 repositories listed
-
Component Analysis for Visual Question Answering Architectures12 Feb 2020 0 repositories listed
-
Uncertainty based Class Activation Maps for Visual Question Answering23 Jan 2020 0 repositories listed
-
Accuracy vs. Complexity: A Trade-off in Visual Question Answering Models20 Jan 2020 0 repositories listed
-
SQuINTing at VQA Models: Introspecting VQA Models with Sub-Questions20 Jan 2020 0 repositories listed
-
Extending Class Activation Mapping Using Gaussian Receptive Field15 Jan 2020 0 repositories listed
-
10 Jan 2020 0 repositories listed
-
Multi-Layer Content Interaction Through Quaternion Product For Visual Question Answering3 Jan 2020 0 repositories listed
-
Cost Function Dependent Barren Plateaus in Shallow Parametrized Quantum Circuits2 Jan 2020 0 repositories listed
-
Vision and Language: from Visual Perception to Content Creation26 Dec 2019 0 repositories listed
-
Deep Exemplar Networks for VQA and VQG19 Dec 2019 0 repositories listed
-
KonVid-150k: A Dataset for No-Reference Video Quality Assessment of Videos in-the-Wild17 Dec 2019 0 repositories listed
-
Towards Causal VQA: Revealing and Reducing Spurious Correlations by Invariant and Covariant Semantic Editing16 Dec 2019 0 repositories listed
-
9 Dec 2019 0 repositories listed
-
Weak Supervision helps Emergence of Word-Object Alignment and improves Vision-Language Tasks6 Dec 2019 0 repositories listed
-
Deep Bayesian Active Learning for Multiple Correct Outputs2 Dec 2019 0 repositories listed
-
A Free Lunch in Generating Datasets: Building a VQG and VQA System with Attention and Humans in the Loop30 Nov 2019 0 repositories listed
-
Assessing the Robustness of Visual Question Answering Models30 Nov 2019 0 repositories listed
-
OptiBox: Breaking the Limits of Proposals for Visual Grounding29 Nov 2019 0 repositories listed
-
Transfer Learning in Visual and Relational Reasoning27 Nov 2019 0 repositories listed
-
Unsupervised Keyword Extraction for Full-sentence VQA23 Nov 2019 0 repositories listed
-
Explanation vs Attention: A Two-Player Game to Obtain Attention for VQA19 Nov 2019 0 repositories listed
-
Question-Conditioned Counterfactual Image Generation for VQA14 Nov 2019 0 repositories listed
-
Open-Ended Visual Question Answering by Multi-Modal Domain Adaptation11 Nov 2019 0 repositories listed
-
Multimodal Intelligence: Representation Learning, Information Fusion, and Applications10 Nov 2019 0 repositories listed
-
Are we asking the right questions in MovieQA?8 Nov 2019 0 repositories listed
-
Representing Movie Characters in Dialogues1 Nov 2019 0 repositories listed
-
YouMakeup: A Large-Scale Domain-Specific Multimodal Dataset for Fine-Grained Semantic Comprehension1 Nov 2019 0 repositories listed
-
C3DVQA: Full-Reference Video Quality Assessment with 3D Convolutional Neural Network30 Oct 2019 0 repositories listed
-
Learning Rich Image Region Representation for Visual Question Answering29 Oct 2019 0 repositories listed
-
23 Oct 2019 0 repositories listed
-
Enforcing Reasoning in Visual Commonsense Reasoning21 Oct 2019 0 repositories listed
-
Good, Better, Best: Textual Distractors Generation for Multiple-Choice Visual Question Answering via Reinforcement Learning21 Oct 2019 0 repositories listed
-
Neural Memory Plasticity for Anomaly Detection12 Oct 2019 0 repositories listed
-
Multi-modal Deep Analysis for Multimedia11 Oct 2019 0 repositories listed
-
Modulated Self-attention Convolutional Network for VQA8 Oct 2019 0 repositories listed
-
From Strings to Things: Knowledge-Enabled VQA Model That Can Read and Reason1 Oct 2019 0 repositories listed
-
SegEQA: Video Segmentation Based Visual Attention for Embodied Question Answering1 Oct 2019 0 repositories listed
-
On Incorporating Semantic Prior Knowledge in Deep Learning Through Embedding-Space Constraints30 Sep 2019 0 repositories listed
-
Learning to Recognize the Unseen Visual Predicates25 Sep 2019 0 repositories listed
-
On Incorporating Semantic Prior Knowlegde in Deep Learning Through Embedding-Space Constraints25 Sep 2019 0 repositories listed
-
UNITER: Learning UNiversal Image-TExt Representations25 Sep 2019 0 repositories listed
-
Why Does the VQA Model Answer No?: Improving Reasoning through Visual and Linguistic Inference25 Sep 2019 0 repositories listed
-
Explainable High-order Visual Question Reasoning: A New Benchmark and Knowledge-routed Network23 Sep 2019 0 repositories listed
-
Non-monotonic Logical Reasoning Guiding Deep Learning for Explainable Visual Question Answering23 Sep 2019 0 repositories listed
-
Learning Sparse Mixture of Experts for Visual Question Answering19 Sep 2019 0 repositories listed
-
Triplet-Aware Scene Graph Embeddings19 Sep 2019 0 repositories listed
-
Inverse Visual Question Answering with Multi-Level Attentions17 Sep 2019 0 repositories listed
-
Sunny and Dark Outside?! Improving Answer Consistency in VQA through Entailed Question Generation10 Sep 2019 0 repositories listed
-
4 Sep 2019 0 repositories listed
-
3 Sep 2019 0 repositories listed
-
Adversarial Representation Learning for Text-to-Image Matching28 Aug 2019 0 repositories listed
-
Language Features Matter: Effective Language Representations for Vision-Language Tasks17 Aug 2019 0 repositories listed
-
U-CAM: Visual Explanation using Uncertainty based Class Activation Maps17 Aug 2019 0 repositories listed
-
What is needed for simple spatial language capabilities in VQA?17 Aug 2019 0 repositories listed
-
Reactive Multi-Stage Feature Fusion for Multimodal Dialogue Modeling14 Aug 2019 0 repositories listed
-
Multimodal Unified Attention Networks for Vision-and-Language Interactions12 Aug 2019 0 repositories listed
-
Why Does a Visual Question Have Different Answers?12 Aug 2019 0 repositories listed
-
Multi-modality Latent Interaction Network for Visual Question Answering10 Aug 2019 0 repositories listed
-
Question-Agnostic Attention for Visual Question Answering9 Aug 2019 0 repositories listed
-
CRIC: A VQA Dataset for Compositional Reasoning on Vision and Commonsense8 Aug 2019 0 repositories listed
-
The Meaning of ``Most'' for Visual Question Answering Models1 Aug 2019 0 repositories listed
-
An Empirical Study of Batch Normalization and Group Normalization in Conditional Computation31 Jul 2019 0 repositories listed
-
30 Jul 2019 0 repositories listed
-
An Empirical Study on Leveraging Scene Graphs for Visual Question Answering28 Jul 2019 0 repositories listed
-
23 Jul 2019 0 repositories listed
-
17 Jul 2019 0 repositories listed
-
2nd Place Solution to the GQA Challenge 201916 Jul 2019 0 repositories listed
-
Assessing Visual Quality of Omnidirectional Videos14 Jul 2019 0 repositories listed
-
Neural Reasoning, Fast and Slow, for Video Question Answering10 Jul 2019 0 repositories listed
-
Multi-grained Attention with Object-level Grounding for Visual Question Answering1 Jul 2019 0 repositories listed
-
ICDAR 2019 Competition on Scene Text Visual Question Answering30 Jun 2019 0 repositories listed
-
Adversarial Multimodal Network for Movie Question Answering24 Jun 2019 0 repositories listed
-
Integrating Knowledge and Reasoning in Image Understanding24 Jun 2019 0 repositories listed
-
Investigating Biases in Textual Entailment Datasets23 Jun 2019 0 repositories listed
-
Improving Visual Question Answering by Referring to Generated Paragraph Captions14 Jun 2019 0 repositories listed
-
Psycholinguistics meets Continual Learning: Measuring Catastrophic Forgetting in Visual Question Answering10 Jun 2019 0 repositories listed
-
3 Jun 2019 0 repositories listed
-
Dynamic Fusion With Intra- and Inter-Modality Attention Flow for Visual Question Answering1 Jun 2019 0 repositories listed
-
Grounded Word Sense Translation1 Jun 2019 0 repositories listed
-
ImageTTR: Grounding Type Theory with Records in Image Classification for Visual Question Answering1 Jun 2019 0 repositories listed
-
Vision-to-Language Tasks Based on Attributes and Attention Mechanism29 May 2019 0 repositories listed
-
Leveraging Medical Visual Question Answering with Supporting Facts28 May 2019 0 repositories listed
-
Structure Learning for Neural Module Networks27 May 2019 0 repositories listed
-
Misleading Failures of Partial-input Baselines14 May 2019 0 repositories listed
-
Visual TTR - Modelling Visual Question Answering in Type Theory with Records1 May 2019 0 repositories listed
-
Learning to Collocate Neural Modules for Image Captioning18 Apr 2019 0 repositories listed
-
18 Apr 2019 0 repositories listed
-
Question Guided Modular Routing Networks for Visual Question Answering17 Apr 2019 0 repositories listed
-
Evaluating the Representational Hub of Language and Vision Models12 Apr 2019 0 repositories listed