Browse State-of-the-Art › Visual Question Answering › Papers, page 19
Visual Question Answering
Papers archive 2025-07-28
archive papers tagged: 2,177 · with a code link: 1,042 · where Syntology ran a sample: 378 (308 with a run with no instrument failure, 70 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (378 of 2,177 tagged: 308 with a run with no instrument failure, 70 where every run was a failure of Syntology's instrument)
Page 19 of 22: papers 1,801 to 1,900 of 2,177, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
16 Nov 2021 0 repositories listed
-
Language bias in Visual Question Answering: A Survey and Taxonomy16 Nov 2021 0 repositories listed
-
Question-Led Semantic Structure Enhanced Attentions for VQA16 Nov 2021 0 repositories listed
-
Uncertainty-based Visual Question Answering: Estimating Semantic Inconsistency between Image and Knowledge Base16 Nov 2021 0 repositories listed
-
ViQuAE, a Dataset for Knowledge-based Visual Question Answering about Named Entities16 Nov 2021 0 repositories listed
-
Graph Relation Transformer: Incorporating pairwise object features into the Transformer architecture11 Nov 2021 0 repositories listed
-
Visual Question Answering based on Formal Logic8 Nov 2021 0 repositories listed
-
CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization1 Nov 2021 0 repositories listed
-
Diversity and Consistency: Exploring Visual Question-Answer Pair Generation1 Nov 2021 0 repositories listed
-
Single-Modal Entropy based Active Learning for Visual Question Answering21 Oct 2021 0 repositories listed
-
xGQA: Cross-Lingual Visual Question Answering16 Oct 2021 0 repositories listed
-
Improving Users' Mental Model with Attention-directed Counterfactual Edits13 Oct 2021 0 repositories listed
-
MMIU: Dataset for Visual Intent Understanding in Multimodal Assistants13 Oct 2021 0 repositories listed
-
Asking questions on handwritten document collections2 Oct 2021 0 repositories listed
-
Breaking Down Questions for Outside-Knowledge VQA29 Sep 2021 0 repositories listed
-
Crossformer: Transformer with Alternated Cross-Layer Guidance29 Sep 2021 0 repositories listed
-
How Much Can CLIP Benefit Vision-and-Language Tasks?29 Sep 2021 0 repositories listed
-
Measuring CLEVRness: Black-box Testing of Visual Reasoning Models29 Sep 2021 0 repositories listed
-
Variational Disentangled Attention for Regularized Visual Dialog29 Sep 2021 0 repositories listed
-
Multimodal Integration of Human-Like Attention in Visual Question Answering27 Sep 2021 0 repositories listed
-
27 Sep 2021 0 repositories listed
-
How to find a good image-text embedding for remote sensing visual question answering?24 Sep 2021 0 repositories listed
-
10 Sep 2021 0 repositories listed
-
TxT: Crossmodal End-to-End Learning with Transformers9 Sep 2021 0 repositories listed
-
Weakly Supervised Relative Spatial Reasoning for Visual Question Answering4 Sep 2021 0 repositories listed
-
On the Significance of Question Encoder Sequence Model in the Out-of-Distribution Performance in Visual Question Answering28 Aug 2021 0 repositories listed
-
Auto-Parsing Network for Image Captioning and Visual Question Answering24 Aug 2021 0 repositories listed
-
Localize, Group, and Select: Boosting Text-VQA by Scene Text Modeling20 Aug 2021 0 repositories listed
-
VALSE: A Task-Independent Benchmark for Vision and Language Models centered on Linguistic Phenomena17 Aug 2021 0 repositories listed
-
In Factuality: Efficient Integration of Relevant Facts for Visual Question Answering1 Aug 2021 0 repositories listed
-
利用图像描述与知识图谱增强表示的视觉问答(Exploiting Image Captions and External Knowledge as Representation Enhancement for Visual Question Answering)1 Aug 2021 0 repositories listed
-
LRRA:A Transparent Neural-Symbolic Reasoning Framework for Real-World Visual Question Answering1 Aug 2021 0 repositories listed
-
Towards Visual Question Answering on Pathology Images1 Aug 2021 0 repositories listed
-
MuVAM: A Multi-View Attention-based Model for Medical Visual Question Answering7 Jul 2021 0 repositories listed
-
Adventurer's Treasure Hunt: A Transparent System for Visually Grounded Compositional Visual Question Answering based on Scene Graphs28 Jun 2021 0 repositories listed
-
A Picture May Be Worth a Hundred Words for Visual Question Answering25 Jun 2021 0 repositories listed
-
25 Jun 2021 0 repositories listed
-
Probing Inter-modality: Visual Parsing with Self-Attention for Vision-Language Pre-training25 Jun 2021 0 repositories listed
-
VQA-Aid: Visual Question Answering for Post-Disaster Damage Assessment and Analysis19 Jun 2021 0 repositories listed
-
Bayesian Attention Belief Networks9 Jun 2021 0 repositories listed
-
Are VQA Systems RAD? Measuring Robustness to Augmented Data with Focused Interventions8 Jun 2021 0 repositories listed
-
PAM: Understanding Product Images in Cross Product Category Attribute Extraction8 Jun 2021 0 repositories listed
-
Human-Adversarial Visual Question Answering4 Jun 2021 0 repositories listed
-
Grounding Complex Navigational Instructions Using Scene Graphs3 Jun 2021 0 repositories listed
-
Adversarial VQA: A New Benchmark for Evaluating the Robustness of VQA Models1 Jun 2021 0 repositories listed
-
Learning to Select Question-Relevant Relations for Visual Question Answering1 Jun 2021 0 repositories listed
-
MIMOQA: Multimodal Input Multimodal Output Question Answering1 Jun 2021 0 repositories listed
-
Semantic Aligned Multi-modal Transformer for Vision-LanguageUnderstanding: A Preliminary Study on Visual QA1 Jun 2021 0 repositories listed
-
21 May 2021 0 repositories listed
-
Survey of Visual-Semantic Embedding Methods for Zero-Shot Image Retrieval16 May 2021 0 repositories listed
-
Show Why the Answer is Correct! Towards Explainable AI using Compositional Temporal Attention15 May 2021 0 repositories listed
-
Cross-Modal Generative Augmentation for Visual Question Answering11 May 2021 0 repositories listed
-
Proposal-free One-stage Referring Expression via Grid-Word Cross-Attention5 May 2021 0 repositories listed
-
Iterated learning for emergent systematicity in VQA3 May 2021 0 repositories listed
-
A survey on VQA_Datasets and Approaches2 May 2021 0 repositories listed
-
Chop Chop BERT: Visual Question Answering by Chopping VisualBERT's Heads30 Apr 2021 0 repositories listed
-
27 Apr 2021 0 repositories listed
-
26 Apr 2021 0 repositories listed
-
Playing Lottery Tickets with Vision and Language23 Apr 2021 0 repositories listed
-
Cross-Modal Retrieval Augmentation for Multi-Modal Classification16 Apr 2021 0 repositories listed
-
VGNMN: Video-grounded Neural Module Network to Video-Grounded Language Tasks16 Apr 2021 0 repositories listed
-
Jointly Learning Truth-Conditional Denotations and Groundings using Parallel Attention14 Apr 2021 0 repositories listed
-
Neuro-Symbolic VQA: A review from the perspective of AGI desiderata13 Apr 2021 0 repositories listed
-
How Transferable are Reasoning Patterns in VQA?8 Apr 2021 0 repositories listed
-
Multimodal Continuous Visual Attention Mechanisms7 Apr 2021 0 repositories listed
-
Compressing Visual-linguistic Model via Knowledge Distillation5 Apr 2021 0 repositories listed
-
`Just because you are right, doesn't mean I am wrong': Overcoming a bottleneck in development and evaluation of Open-Ended VQA tasks1 Apr 2021 0 repositories listed
-
UC2: Universal Cross-lingual Cross-modal Vision-and-Language Pre-training1 Apr 2021 0 repositories listed
-
Analysis on Image Set Visual Question Answering31 Mar 2021 0 repositories listed
-
Domain-robust VQA with diverse datasets and methods but no target labels29 Mar 2021 0 repositories listed
-
Generating and Evaluating Explanations of Attended and Error-Inducing Input Regions for VQA Models26 Mar 2021 0 repositories listed
-
Visual Grounding Strategies for Text-Only Natural Language Processing25 Mar 2021 0 repositories listed
-
How to Design Sample and Computationally Efficient VQA Models22 Mar 2021 0 repositories listed
-
A Comprehensive Survey of Scene Graphs: Generation and Application17 Mar 2021 0 repositories listed
-
Characterizing Misclassifications of Deep NLP Models12 Mar 2021 0 repositories listed
-
RL-CSDia: Representation Learning of Computer Science Diagrams10 Mar 2021 0 repositories listed
-
Learning Reasoning Paths over Semantic Graphs for Video-grounded Dialogues1 Mar 2021 0 repositories listed
-
Learning Compositional Representation for Few-shot Visual Question Answering21 Feb 2021 0 repositories listed
-
An Empirical Study on the Generalization Power of Neural Representations Learned via Visual Guessing Games31 Jan 2021 0 repositories listed
-
Unanswerable Questions about Images and Texts25 Jan 2021 0 repositories listed
-
Visual Question Answering based on Local-Scene-Aware Referring Expression Generation22 Jan 2021 0 repositories listed
-
Understanding in Artificial Intelligence17 Jan 2021 0 repositories listed
-
Latent Variable Models for Visual Question Answering16 Jan 2021 0 repositories listed
-
Understanding the Role of Scene Graphs in Visual Question Answering14 Jan 2021 0 repositories listed
-
Predicting Relative Depth between Objects from Semantic Features12 Jan 2021 0 repositories listed
-
Transformers in Vision: A Survey4 Jan 2021 0 repositories listed
-
Differentiable End-to-End Program Executor for Sample and Computationally Efficient VQA1 Jan 2021 0 repositories listed
-
Hierarchical Graph Attention Network for Few-Shot Visual-Semantic Learning1 Jan 2021 0 repositories listed
-
Linguistically Routing Capsule Network for Out-of-Distribution Visual Question Answering1 Jan 2021 0 repositories listed
-
Unshuffling Data for Improved Generalization in Visual Question Answering1 Jan 2021 0 repositories listed
-
Seeing is Knowing! Fact-based Visual Question Answering using Knowledge Graph Embeddings31 Dec 2020 0 repositories listed
-
Object-Centric Diagnosis of Visual Reasoning21 Dec 2020 0 repositories listed
-
WeaQA: Weak Supervision via Captions for Visual Question Answering4 Dec 2020 0 repositories listed
-
1 Dec 2020 0 repositories listed
-
Multimodal Graph Networks for Compositional Generalization in Visual Question Answering1 Dec 2020 0 repositories listed
-
Modular Graph Attention Network for Complex Visual Relational Reasoning22 Nov 2020 0 repositories listed
-
Logically Consistent Loss for Visual Question Answering19 Nov 2020 0 repositories listed
-
Generating Natural Questions from Images for Multimodal Assistants17 Nov 2020 0 repositories listed
-
Reasoning Over History: Context Aware Visual Dialog2 Nov 2020 0 repositories listed
-
Can Pre-training help VQA with Lexical Variations?1 Nov 2020 0 repositories listed