paper-with-me

Visual Question Answering 벤치마크

Visual Question Answering on VQA v2

4개 결과 · ⬇ CSV · JSON

Accuracy

57.5 63.12 68.75 74.38 80 2023-07 2026-09 Emu-I * — 57.5 (2023-07-11) Emu-I * — 57.5 (2023-07-11) RLHF-V — 80.0 (2023-12-01) RLHF-V — 80.0 (2023-12-01) Emu-I * — 57.5 (2023-07-11) RLHF-V — 80.0 (2023-12-01)
RankModel Accuracy PaperCodeYear
1 RLHF-V 80 RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback openbmb/minicpm-v · rlhf-v/rlhf-v · tidedra/vl-rlhf · +1 2023
2 Emu-I * 57.5 Emu: Generative Pretraining in Multimodality baaivision/emu · doc-doc/NExT-OE 2023
3 RLHF-V 80 RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback openbmb/minicpm-v · rlhf-v/rlhf-v · tidedra/vl-rlhf · +1 2023
4 Emu-I * 57.5 Emu: Generative Pretraining in Multimodality baaivision/emu · doc-doc/NExT-OE 2023
1–4 / 4 페이지당 10 20 50 100