paper-with-me

image-sentence alignment 벤치마크

image-sentence alignment on VALSE

14개 결과 · ⬇ CSV · JSON

average pairwise accuracy

46.4 53.57 60.75 67.92 75.1 2021-12 2026-09 ViLBERT 12-in-1 — 75.1 (2021-12-14) CLIP — 64.0 (2021-12-14) ViLBERT — 63.7 (2021-12-14) GPT1 — 60.7 (2021-12-14) GPT2 — 60.1 (2021-12-14) LXMERT — 59.6 (2021-12-14) VisualBERT — 46.4 (2021-12-14) ViLBERT 12-in-1 — 75.1 (2021-12-14) CLIP — 64.0 (2021-12-14) ViLBERT — 63.7 (2021-12-14) GPT1 — 60.7 (2021-12-14) GPT2 — 60.1 (2021-12-14) LXMERT — 59.6 (2021-12-14) VisualBERT — 46.4 (2021-12-14) ViLBERT 12-in-1 — 75.1 (2021-12-14)
RankModel average pairwise accuracyAverage Accuracy PaperCodeYear
11 GPT1 60.7– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
12 GPT2 60.1– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
13 LXMERT 59.653.5 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
14 VisualBERT 46.448.8 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
← 이전 11–14 / 14 페이지당 10 20 50 100