paper-with-me

PO3D-VQA

Parts, Poses, and Occlusions in 3D Visual Question Answering

2000년 도입 · 논문 1편에서 사용

A VQA model that marries two powerful ideas: probabilistic neural symbolic program execution for reasoning and a deep neural network with 3D generative representations of objects for robust visual scene parsing.

출처: 3D-Aware Visual Question Answering about Parts, Poses and Occlusions

소개 논문: 3D-Aware Visual Question Answering about Parts, Poses and Occlusions

6D Pose Estimation Models · Computer VisionMulti-Modal Methods · Computer Vision