paper
-with-
me
Papers
Browse State-of-the-Art
Datasets
Methods
AI Agents
Trends
Digest
🌙
image-sentence alignment
벤치마크
image-sentence alignment on
VALSE
14개 결과 ·
⬇ CSV
·
JSON
average pairwise accuracy
46.4
53.57
60.75
67.92
75.1
2021-12
2026-09
ViLBERT 12-in-1 — 75.1 (2021-12-14)
CLIP — 64.0 (2021-12-14)
ViLBERT — 63.7 (2021-12-14)
GPT1 — 60.7 (2021-12-14)
GPT2 — 60.1 (2021-12-14)
LXMERT — 59.6 (2021-12-14)
VisualBERT — 46.4 (2021-12-14)
ViLBERT 12-in-1 — 75.1 (2021-12-14)
CLIP — 64.0 (2021-12-14)
ViLBERT — 63.7 (2021-12-14)
GPT1 — 60.7 (2021-12-14)
GPT2 — 60.1 (2021-12-14)
LXMERT — 59.6 (2021-12-14)
VisualBERT — 46.4 (2021-12-14)
ViLBERT 12-in-1 — 75.1 (2021-12-14)
2021-12-14 — ViLBERT 12-in-1: average pairwise accuracy 75.1
Rank
Model
average pairwise accuracy
Average Accuracy
Paper
Code
Year
1
ViLBERT 12-in-1
75.1
63.2
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
2
CLIP
64.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
3
ViLBERT
63.7
51.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
4
GPT1
60.7
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
5
GPT2
60.1
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
6
LXMERT
59.6
53.5
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
7
VisualBERT
46.4
48.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
8
ViLBERT 12-in-1
75.1
63.2
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
9
CLIP
64.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
10
ViLBERT
63.7
51.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
11
GPT1
60.7
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
12
GPT2
60.1
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
13
LXMERT
59.6
53.5
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
14
VisualBERT
46.4
48.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
1–14 / 14
페이지당
10
20
50
100