paper
-with-
me
Papers
Browse State-of-the-Art
Datasets
Methods
AI Agents
Trends
Digest
🌙
image-sentence alignment
벤치마크
image-sentence alignment on VALSE counting adversarial
14개 결과 ·
⬇ CSV
·
JSON
pairwise accuracy
42.6
51.27
59.95
68.62
77.3
2021-12
2026-09
ViLBERT 12-in-1 — 77.3 (2021-12-14)
ViLBERT — 73.7 (2021-12-14)
GPT1 — 69.5 (2021-12-14)
CLIP — 57.5 (2021-12-14)
VisualBERT — 50.0 (2021-12-14)
GPT2 — 45.3 (2021-12-14)
LXMERT — 42.6 (2021-12-14)
ViLBERT 12-in-1 — 77.3 (2021-12-14)
ViLBERT — 73.7 (2021-12-14)
GPT1 — 69.5 (2021-12-14)
CLIP — 57.5 (2021-12-14)
VisualBERT — 50.0 (2021-12-14)
GPT2 — 45.3 (2021-12-14)
LXMERT — 42.6 (2021-12-14)
ViLBERT 12-in-1 — 77.3 (2021-12-14)
2021-12-14 — ViLBERT 12-in-1: pairwise accuracy 77.3
Rank
Model
pairwise accuracy
Accuracy (%)
Paper
Code
Year
1
ViLBERT 12-in-1
77.3
66.7
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
2
ViLBERT
73.7
51.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
3
GPT1
69.5
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
4
CLIP
57.5
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
5
VisualBERT
50.0
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
6
GPT2
45.3
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
7
LXMERT
42.6
49.9
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
8
ViLBERT 12-in-1
77.3
66.7
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
9
ViLBERT
73.7
51.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
10
GPT1
69.5
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
11
CLIP
57.5
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
12
VisualBERT
50.0
50.0
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
13
GPT2
45.3
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
14
LXMERT
42.6
49.9
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
1–14 / 14
페이지당
10
20
50
100