paper
-with-
me
Papers
Browse State-of-the-Art
Datasets
Methods
AI Agents
Trends
Digest
🌙
image-sentence alignment
벤치마크
image-sentence alignment on VALSE spatial relations
14개 결과 ·
⬇ CSV
·
JSON
pairwise accuracy
39.7
49.08
58.45
67.83
77.2
2021-12
2026-09
GPT1 — 77.2 (2021-12-14)
GPT2 — 75.0 (2021-12-14)
ViLBERT 12-in-1 — 67.7 (2021-12-14)
CLIP — 64.3 (2021-12-14)
LXMERT — 60.2 (2021-12-14)
ViLBERT — 57.2 (2021-12-14)
VisualBERT — 39.7 (2021-12-14)
GPT1 — 77.2 (2021-12-14)
GPT2 — 75.0 (2021-12-14)
ViLBERT 12-in-1 — 67.7 (2021-12-14)
CLIP — 64.3 (2021-12-14)
LXMERT — 60.2 (2021-12-14)
ViLBERT — 57.2 (2021-12-14)
VisualBERT — 39.7 (2021-12-14)
GPT1 — 77.2 (2021-12-14)
2021-12-14 — GPT1: pairwise accuracy 77.2
Rank
Model
pairwise accuracy
Accuracy (%)
Paper
Code
Year
1
GPT1
77.2
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
2
GPT2
75.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
3
ViLBERT 12-in-1
67.7
53.4
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
4
CLIP
64.3
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
5
LXMERT
60.2
50.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
6
ViLBERT
57.2
49.9
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
7
VisualBERT
39.7
49.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
8
GPT1
77.2
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
9
GPT2
75.0
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
10
ViLBERT 12-in-1
67.7
53.4
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
11
CLIP
64.3
–
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
12
LXMERT
60.2
50.8
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
13
ViLBERT
57.2
49.9
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
14
VisualBERT
39.7
49.3
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
heidelberg-nlp/valse
2021
1–14 / 14
페이지당
10
20
50
100