paper-with-me

image-sentence alignment 벤치마크

image-sentence alignment on VALSE

14개 결과 · ⬇ CSV · JSON

average pairwise accuracy

46.4 53.57 60.75 67.92 75.1 2021-12 2026-09 ViLBERT 12-in-1 — 75.1 (2021-12-14) CLIP — 64.0 (2021-12-14) ViLBERT — 63.7 (2021-12-14) GPT1 — 60.7 (2021-12-14) GPT2 — 60.1 (2021-12-14) LXMERT — 59.6 (2021-12-14) VisualBERT — 46.4 (2021-12-14) ViLBERT 12-in-1 — 75.1 (2021-12-14) CLIP — 64.0 (2021-12-14) ViLBERT — 63.7 (2021-12-14) GPT1 — 60.7 (2021-12-14) GPT2 — 60.1 (2021-12-14) LXMERT — 59.6 (2021-12-14) VisualBERT — 46.4 (2021-12-14) ViLBERT 12-in-1 — 75.1 (2021-12-14)
RankModel average pairwise accuracyAverage Accuracy PaperCodeYear
1 ViLBERT 12-in-1 75.163.2 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
2 CLIP 64.0– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
3 ViLBERT 63.751.3 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
4 GPT1 60.7– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
5 GPT2 60.1– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
6 LXMERT 59.653.5 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
7 VisualBERT 46.448.8 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
8 ViLBERT 12-in-1 75.163.2 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
9 CLIP 64.0– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
10 ViLBERT 63.751.3 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
11 GPT1 60.7– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
12 GPT2 60.1– VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
13 LXMERT 59.653.5 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
14 VisualBERT 46.448.8 VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena heidelberg-nlp/valse 2021
1–14 / 14 페이지당 10 20 50 100