paper-with-me

Visual Question Answering 벤치마크

Visual Question Answering on COCO Visual Question Answering (VQA) real images 2.0 open ended

2개 결과 · ⬇ CSV · JSON

RankModel Percentage correct PaperCodeYear
1 MaMMUT (2B) 80.7 MaMMUT: A Simple Architecture for Joint Learning for MultiModal Tasks lucidrains/mammut-pytorch 2023
1 MaMMUT (2B) 80.7 MaMMUT: A Simple Architecture for Joint Learning for MultiModal Tasks lucidrains/mammut-pytorch 2023
1–2 / 2 페이지당 10 20 50 100