PO3D-VQA
Parts, Poses, and Occlusions in 3D Visual Question Answering
2000년 도입 · 논문 1편에서 사용
A VQA model that marries two powerful ideas: probabilistic neural symbolic program execution for reasoning and a deep neural network with 3D generative representations of objects for robust visual scene parsing.
출처: 3D-Aware Visual Question Answering about Parts, Poses and Occlusions
소개 논문: 3D-Aware Visual Question Answering about Parts, Poses and Occlusions
6D Pose Estimation Models · Computer VisionMulti-Modal Methods · Computer Vision