paper-with-me

image-sentence alignment 벤치마크

image-sentence alignment on VALSE counting small numbers

14개 결과 · ⬇ CSV · JSON

pairwise accuracy

48.2 56.2 64.2 72.2 80.2 2021-12 2026-09 ViLBERT 12-in-1 — 80.2 (2021-12-14) LXMERT — 69.2 (2021-12-14) ViLBERT — 62.9 (2021-12-14) CLIP — 62.5 (2021-12-14) GPT2 — 49.8 (2021-12-14) GPT1 — 48.7 (2021-12-14) VisualBERT — 48.2 (2021-12-14) ViLBERT 12-in-1 — 80.2 (2021-12-14) LXMERT — 69.2 (2021-12-14) ViLBERT — 62.9 (2021-12-14) CLIP — 62.5 (2021-12-14) GPT2 — 49.8 (2021-12-14) GPT1 — 48.7 (2021-12-14) VisualBERT — 48.2 (2021-12-14) ViLBERT 12-in-1 — 80.2 (2021-12-14)
RankModel pairwise accuracyAccuracy (%) PaperCodeYear
11 CLIP 62.5– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
12 GPT2 49.8– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
13 GPT1 48.7– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
14 VisualBERT 48.247.8 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
← 이전 11–14 / 14 페이지당 10 20 50 100