paper-with-me

Papers

Latent Variable Models for Visual Question Answering

2021-01-16 · Zixu Wang, Yishu Miao, Lucia Specia

Current work on Visual Question Answering (VQA) explore deterministic approaches conditioned on various types of image and question features. We posit that, in addition to image and question pairs, other modalities are useful for teaching machine to carry out question answering. Hence in this paper, we propose latent variable models for VQA where extra information (e.g. captions and answer categories) are incorporated as latent variables, which are observed during training but in turn benefit question-answering performance at test time. Experiments on the VQA v2.0 benchmarking dataset demonstrate the effectiveness of our proposed models: they improve over strong baselines, especially those that do not rely on extensive language-vision pre-training.

📄 PDF Abstract BibTeX arXiv:2101.06399

Code (0)

등록된 구현이 없습니다.

Tasks

BenchmarkingQuestion AnsweringVisual Question AnsweringVisual Question Answering (VQA)

Similar Papers 제목 키워드 기반

Multi-modality Latent Interaction Network for Visual Question Answering

2019-08-10 · ICCV 2019 10 · Peng Gao, Haoxuan You, Zhanpeng Zhang, Xiaogang Wang 외

Exploiting relationships between visual regions and question words have achieved great success in learning multi-modality features for Visual Question Answering (VQA). However, we argue that existing methods mostly model…

Language ModelingLanguage ModellingQuestion AnsweringVisual Question Answering+1

Probabilistic Neural-symbolic Models for Interpretable Visual Question Answering

2019-02-21 · ICLR 2019 5 · Ramakrishna Vedantam, Karan Desai, Stefan Lee, Marcus Rohrbach 외

We propose a new class of probabilistic neural-symbolic models, that have symbolic functional programs as a latent, stochastic variable. Instantiated in the context of visual question answering, our probabilistic formula…

counterfactualQuestion AnsweringVisual Question AnsweringVisual Question Answering (VQA)

Chain-of-Questions Training with Latent Answers for Robust Multistep Question Answering

2023-05-24 · Wang Zhu, Jesse Thomason, Robin Jia

We train a language model (LM) to robustly answer multistep questions by generating and answering sub-questions. We propose Chain-of-Questions, a framework that trains a model to generate sub-questions and sub-answers on…

Language ModelingLanguage ModellingQuestion Answering

Think Visually: Question Answering through Virtual Imagery

2018-05-25 · ACL 2018 7 · Ankit Goyal, Jian Wang, Jia Deng

In this paper, we study the problem of geometric reasoning in the context of question-answering. We introduce Dynamic Spatial Memory Network (DSMN), a new deep network architecture designed for answering questions that a…

Question AnsweringVisual Commonsense Reasoning

Improving Span-based Question Answering Systems with Coarsely Labeled Data

2018-11-05 · Hao Cheng, Ming-Wei Chang, Kenton Lee, Ankur Parikh 외

We study approaches to improve fine-grained short answer Question Answering models by integrating coarse-grained data annotated for paragraph-level relevance and show that coarsely annotated data can bring significant pe…

Multi-Task LearningQuestion Answering