paper-with-me

image-sentence alignment 벤치마크

image-sentence alignment on VALSE coreference standard

14개 결과 · ⬇ CSV · JSON

pairwise accuracy

45.6 53.12 60.65 68.18 75.7 2021-12 2026-09 ViLBERT 12-in-1 — 75.7 (2021-12-14) GPT2 — 54.5 (2021-12-14) CLIP — 52.1 (2021-12-14) VisualBERT — 49.5 (2021-12-14) ViLBERT — 47.2 (2021-12-14) LXMERT — 46.8 (2021-12-14) GPT1 — 45.6 (2021-12-14) ViLBERT 12-in-1 — 75.7 (2021-12-14) GPT2 — 54.5 (2021-12-14) CLIP — 52.1 (2021-12-14) VisualBERT — 49.5 (2021-12-14) ViLBERT — 47.2 (2021-12-14) LXMERT — 46.8 (2021-12-14) GPT1 — 45.6 (2021-12-14) ViLBERT 12-in-1 — 75.7 (2021-12-14)
RankModel pairwise accuracyAccuracy (%) PaperCodeYear
11 VisualBERT 49.550.0 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
12 ViLBERT 47.250.0 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
13 LXMERT 46.849.8 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
14 GPT1 45.6– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
← 이전 11–14 / 14 페이지당 10 20 50 100