paper-with-me

Human Judgment Classification 벤치마크

Human Judgment Classification on Pascal-50S

3개 결과 · ⬇ CSV · JSON

Mean Accuracy

80.7 81.83 82.95 84.08 85.2 2021-04 2026-09 RefCLIP-S — 83.1 (2021-04-18) CLIP-S — 80.7 (2021-04-18) MID — 85.2 (2022-05-25) RefCLIP-S — 83.1 (2021-04-18) MID — 85.2 (2022-05-25)
RankModel Mean Accuracy PaperCodeYear
1 MID 85.2 Mutual Information Divergence: A Unified Metric for Multimodal Generative Models naver-ai/mid.metric 2022
2 RefCLIP-S 83.1 CLIPScore: A Reference-free Evaluation Metric for Image Captioning jmhessel/clipscore · showlab/loveu-tgve-2023 · jmhessel/pycocoevalcap 2021
3 CLIP-S 80.7 CLIPScore: A Reference-free Evaluation Metric for Image Captioning jmhessel/clipscore · showlab/loveu-tgve-2023 · jmhessel/pycocoevalcap 2021
1–3 / 3 페이지당 10 20 50 100