paper-with-me

image-sentence alignment 벤치마크

image-sentence alignment on VALSE coreference clean

14개 결과 · ⬇ CSV · JSON

pairwise accuracy

44.2 50.45 56.7 62.95 69.2 2021-12 2026-09 ViLBERT 12-in-1 — 69.2 (2021-12-14) GPT2 — 50.0 (2021-12-14) CLIP — 49.7 (2021-12-14) ViLBERT — 48.1 (2021-12-14) VisualBERT — 47.6 (2021-12-14) GPT1 — 45.2 (2021-12-14) LXMERT — 44.2 (2021-12-14) ViLBERT 12-in-1 — 69.2 (2021-12-14) GPT2 — 50.0 (2021-12-14) CLIP — 49.7 (2021-12-14) ViLBERT — 48.1 (2021-12-14) VisualBERT — 47.6 (2021-12-14) GPT1 — 45.2 (2021-12-14) LXMERT — 44.2 (2021-12-14) ViLBERT 12-in-1 — 69.2 (2021-12-14)
RankModel pairwise accuracyAccuracy (%) PaperCodeYear
11 ViLBERT 48.150.0 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
12 VisualBERT 47.650.0 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
13 GPT1 45.2– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
14 LXMERT 44.249.0 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
← 이전 11–14 / 14 페이지당 10 20 50 100