paper
-with-
me
Papers
Browse State-of-the-Art
Datasets
Methods
AI Agents
Trends
Digest
🌙
image-sentence alignment
벤치마크
image-sentence alignment on VALSE coreference clean
14개 결과 ·
⬇ CSV
·
JSON
pairwise accuracy
44.2
50.45
56.7
62.95
69.2
2021-12
2026-09
ViLBERT 12-in-1 — 69.2 (2021-12-14)
GPT2 — 50.0 (2021-12-14)
CLIP — 49.7 (2021-12-14)
ViLBERT — 48.1 (2021-12-14)
VisualBERT — 47.6 (2021-12-14)
GPT1 — 45.2 (2021-12-14)
LXMERT — 44.2 (2021-12-14)
ViLBERT 12-in-1 — 69.2 (2021-12-14)
GPT2 — 50.0 (2021-12-14)
CLIP — 49.7 (2021-12-14)
ViLBERT — 48.1 (2021-12-14)
VisualBERT — 47.6 (2021-12-14)
GPT1 — 45.2 (2021-12-14)
LXMERT — 44.2 (2021-12-14)
ViLBERT 12-in-1 — 69.2 (2021-12-14)
2021-12-14 — ViLBERT 12-in-1: pairwise accuracy 69.2
Rank
Model
pairwise accuracy
Accuracy (%)
Paper
Code
Year
1
ViLBERT 12-in-1
69.2
54.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
2
GPT2
50.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
3
CLIP
49.7
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
4
ViLBERT
48.1
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
5
VisualBERT
47.6
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
6
GPT1
45.2
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
7
LXMERT
44.2
49.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
8
ViLBERT 12-in-1
69.2
54.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
9
GPT2
50.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
10
CLIP
49.7
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
11
ViLBERT
48.1
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
12
VisualBERT
47.6
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
13
GPT1
45.2
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
14
LXMERT
44.2
49.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
1–14 / 14
페이지당
10
20
50
100