Browse State-of-the-Art › Visual Question Answering (VQA) › Papers, page 18
Visual Question Answering (VQA)
Papers archive 2025-07-28
archive papers tagged: 2,167 · with a code link: 1,039 · where Syntology ran a sample: 359 (287 with a run with no instrument failure, 72 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (359 of 2,167 tagged: 287 with a run with no instrument failure, 72 where every run was a failure of Syntology's instrument)
Page 18 of 22: papers 1,701 to 1,800 of 2,167, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
eaVQA: An Experimental Analysis on Visual Question Answering Models1 Dec 2021 0 repositories listed
-
Robust Visual Reasoning via Language Guided Neural Module Networks1 Dec 2021 0 repositories listed
-
Scallop: From Probabilistic Deductive Databases to Scalable Differentiable Reasoning1 Dec 2021 0 repositories listed
-
LiVLR: A Lightweight Visual-Linguistic Reasoning Framework for Video Question Answering29 Nov 2021 0 repositories listed
-
Scene Graph Generation with Geometric Context25 Nov 2021 0 repositories listed
-
A Confidence-Based Interface for Neuro-Symbolic Visual Question Answering21 Nov 2021 0 repositories listed
-
Medical Visual Question Answering: A Survey19 Nov 2021 0 repositories listed
-
UFO: A UniFied TransfOrmer for Vision-Language Representation Learning19 Nov 2021 0 repositories listed
-
17 Nov 2021 0 repositories listed
-
A Good Prompt Is Worth Millions of Parameters: Low-resource Prompt-based Learning for Vision-Language Models16 Nov 2021 0 repositories listed
-
Breaking Down Questions for Outside-Knowledge Visual Question Answering16 Nov 2021 0 repositories listed
-
Co-VQA : Answering by Interactive Sub Question Sequence16 Nov 2021 0 repositories listed
-
Document AI: Benchmarks, Models and Applications16 Nov 2021 0 repositories listed
-
16 Nov 2021 0 repositories listed
-
Language bias in Visual Question Answering: A Survey and Taxonomy16 Nov 2021 0 repositories listed
-
Question-Led Semantic Structure Enhanced Attentions for VQA16 Nov 2021 0 repositories listed
-
Uncertainty-based Visual Question Answering: Estimating Semantic Inconsistency between Image and Knowledge Base16 Nov 2021 0 repositories listed
-
ViQuAE, a Dataset for Knowledge-based Visual Question Answering about Named Entities16 Nov 2021 0 repositories listed
-
Graph Relation Transformer: Incorporating pairwise object features into the Transformer architecture11 Nov 2021 0 repositories listed
-
ICDAR 2021 Competition on Document VisualQuestion Answering10 Nov 2021 0 repositories listed
-
Visual Question Answering based on Formal Logic8 Nov 2021 0 repositories listed
-
CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization1 Nov 2021 0 repositories listed
-
Diversity and Consistency: Exploring Visual Question-Answer Pair Generation1 Nov 2021 0 repositories listed
-
Subtleties in the trainability of quantum machine learning models27 Oct 2021 0 repositories listed
-
Single-Modal Entropy based Active Learning for Visual Question Answering21 Oct 2021 0 repositories listed
-
Evaluating and Improving Interactions with Hazy Oracles19 Oct 2021 0 repositories listed
-
Explore before Moving: A Feasible Path Estimation and Memory Recalling Framework for Embodied Navigation16 Oct 2021 0 repositories listed
-
xGQA: Cross-Lingual Visual Question Answering16 Oct 2021 0 repositories listed
-
Guiding Visual Question Generation15 Oct 2021 0 repositories listed
-
Improving Users' Mental Model with Attention-directed Counterfactual Edits13 Oct 2021 0 repositories listed
-
MMIU: Dataset for Visual Intent Understanding in Multimodal Assistants13 Oct 2021 0 repositories listed
-
Asking questions on handwritten document collections2 Oct 2021 0 repositories listed
-
Breaking Down Questions for Outside-Knowledge VQA29 Sep 2021 0 repositories listed
-
Crossformer: Transformer with Alternated Cross-Layer Guidance29 Sep 2021 0 repositories listed
-
How Much Can CLIP Benefit Vision-and-Language Tasks?29 Sep 2021 0 repositories listed
-
Measuring CLEVRness: Black-box Testing of Visual Reasoning Models29 Sep 2021 0 repositories listed
-
PRNet: A Progressive Regression Network for No-Reference User-Generated-Content Video Quality Assessment29 Sep 2021 0 repositories listed
-
Variational Disentangled Attention for Regularized Visual Dialog29 Sep 2021 0 repositories listed
-
27 Sep 2021 0 repositories listed
-
Multimodal Integration of Human-Like Attention in Visual Question Answering27 Sep 2021 0 repositories listed
-
27 Sep 2021 0 repositories listed
-
How to find a good image-text embedding for remote sensing visual question answering?24 Sep 2021 0 repositories listed
-
10 Sep 2021 0 repositories listed
-
TxT: Crossmodal End-to-End Learning with Transformers9 Sep 2021 0 repositories listed
-
A review of Quantum Neural Networks: Methods, Models, Dilemma4 Sep 2021 0 repositories listed
-
Weakly Supervised Relative Spatial Reasoning for Visual Question Answering4 Sep 2021 0 repositories listed
-
On the Significance of Question Encoder Sequence Model in the Out-of-Distribution Performance in Visual Question Answering28 Aug 2021 0 repositories listed
-
Auto-Parsing Network for Image Captioning and Visual Question Answering24 Aug 2021 0 repositories listed
-
EKTVQA: Generalized use of External Knowledge to empower Scene Text in Text-VQA22 Aug 2021 0 repositories listed
-
StarVQA: Space-Time Attention for Video Quality Assessment22 Aug 2021 0 repositories listed
-
Localize, Group, and Select: Boosting Text-VQA by Scene Text Modeling20 Aug 2021 0 repositories listed
-
VALSE: A Task-Independent Benchmark for Vision and Language Models centered on Linguistic Phenomena17 Aug 2021 0 repositories listed
-
In Factuality: Efficient Integration of Relevant Facts for Visual Question Answering1 Aug 2021 0 repositories listed
-
利用图像描述与知识图谱增强表示的视觉问答(Exploiting Image Captions and External Knowledge as Representation Enhancement for Visual Question Answering)1 Aug 2021 0 repositories listed
-
LRRA:A Transparent Neural-Symbolic Reasoning Framework for Real-World Visual Question Answering1 Aug 2021 0 repositories listed
-
Towards Visual Question Answering on Pathology Images1 Aug 2021 0 repositories listed
-
MuVAM: A Multi-View Attention-based Model for Medical Visual Question Answering7 Jul 2021 0 repositories listed
-
Adventurer's Treasure Hunt: A Transparent System for Visually Grounded Compositional Visual Question Answering based on Scene Graphs28 Jun 2021 0 repositories listed
-
A Picture May Be Worth a Hundred Words for Visual Question Answering25 Jun 2021 0 repositories listed
-
25 Jun 2021 0 repositories listed
-
Probing Inter-modality: Visual Parsing with Self-Attention for Vision-Language Pre-training25 Jun 2021 0 repositories listed
-
A Transformer-based Cross-modal Fusion Model with Adversarial Training for VQA Challenge 202124 Jun 2021 0 repositories listed
-
FOVQA: Blind Foveated Video Quality Assessment24 Jun 2021 0 repositories listed
-
VQA-Aid: Visual Question Answering for Post-Disaster Damage Assessment and Analysis19 Jun 2021 0 repositories listed
-
15 Jun 2021 0 repositories listed
-
Supervising the Transfer of Reasoning Patterns in VQA10 Jun 2021 0 repositories listed
-
Bayesian Attention Belief Networks9 Jun 2021 0 repositories listed
-
Are VQA Systems RAD? Measuring Robustness to Augmented Data with Focused Interventions8 Jun 2021 0 repositories listed
-
PAM: Understanding Product Images in Cross Product Category Attribute Extraction8 Jun 2021 0 repositories listed
-
Human-Adversarial Visual Question Answering4 Jun 2021 0 repositories listed
-
Grounding Complex Navigational Instructions Using Scene Graphs3 Jun 2021 0 repositories listed
-
Adversarial VQA: A New Benchmark for Evaluating the Robustness of VQA Models1 Jun 2021 0 repositories listed
-
Learning to Select Question-Relevant Relations for Visual Question Answering1 Jun 2021 0 repositories listed
-
MIMOQA: Multimodal Input Multimodal Output Question Answering1 Jun 2021 0 repositories listed
-
MiniVQA - A resource to build your tailored VQA competition1 Jun 2021 0 repositories listed
-
Semantic Aligned Multi-modal Transformer for Vision-LanguageUnderstanding: A Preliminary Study on Visual QA1 Jun 2021 0 repositories listed
-
21 May 2021 0 repositories listed
-
Survey of Visual-Semantic Embedding Methods for Zero-Shot Image Retrieval16 May 2021 0 repositories listed
-
Show Why the Answer is Correct! Towards Explainable AI using Compositional Temporal Attention15 May 2021 0 repositories listed
-
Cross-Modal Generative Augmentation for Visual Question Answering11 May 2021 0 repositories listed
-
Proposal-free One-stage Referring Expression via Grid-Word Cross-Attention5 May 2021 0 repositories listed
-
Iterated learning for emergent systematicity in VQA3 May 2021 0 repositories listed
-
A survey on VQA_Datasets and Approaches2 May 2021 0 repositories listed
-
Chop Chop BERT: Visual Question Answering by Chopping VisualBERT's Heads30 Apr 2021 0 repositories listed
-
27 Apr 2021 0 repositories listed
-
26 Apr 2021 0 repositories listed
-
Playing Lottery Tickets with Vision and Language23 Apr 2021 0 repositories listed
-
Cross-Modal Retrieval Augmentation for Multi-Modal Classification16 Apr 2021 0 repositories listed
-
VGNMN: Video-grounded Neural Module Network to Video-Grounded Language Tasks16 Apr 2021 0 repositories listed
-
Jointly Learning Truth-Conditional Denotations and Groundings using Parallel Attention14 Apr 2021 0 repositories listed
-
Dealing with Missing Modalities in the Visual Question Answer-Difference Prediction Task through Knowledge Distillation13 Apr 2021 0 repositories listed
-
Neuro-Symbolic VQA: A review from the perspective of AGI desiderata13 Apr 2021 0 repositories listed
-
How Transferable are Reasoning Patterns in VQA?8 Apr 2021 0 repositories listed
-
Multimodal Continuous Visual Attention Mechanisms7 Apr 2021 0 repositories listed
-
Compressing Visual-linguistic Model via Knowledge Distillation5 Apr 2021 0 repositories listed
-
`Just because you are right, doesn't mean I am wrong': Overcoming a bottleneck in development and evaluation of Open-Ended VQA tasks1 Apr 2021 0 repositories listed
-
UC2: Universal Cross-lingual Cross-modal Vision-and-Language Pre-training1 Apr 2021 0 repositories listed
-
Analysis on Image Set Visual Question Answering31 Mar 2021 0 repositories listed
-
Domain-robust VQA with diverse datasets and methods but no target labels29 Mar 2021 0 repositories listed
-
Generating and Evaluating Explanations of Attended and Error-Inducing Input Regions for VQA Models26 Mar 2021 0 repositories listed