paper-with-me

Generalized Referring Expression Segmentation 벤치마크

Generalized Referring Expression Segmentation on gRefCOCO

26개 결과 · ⬇ CSV · JSON

gIoU

48.24 55.6 62.95 70.31 77.67 2018-01 2026-09 MattNet — 48.24 (2018-01-24) MattNet — 48.24 (2018-01-24) LTS — 52.7 (2021-03-30) LTS — 52.7 (2021-03-30) VLT — 52.0 (2021-08-12) VLT — 52.0 (2021-08-12) CRIS — 56.27 (2021-11-30) CRIS — 56.27 (2021-11-30) LAVT — 58.4 (2021-12-04) LAVT — 58.4 (2021-12-04) ReLA — 63.6 (2023-06-01) ReLA — 63.6 (2023-06-01) GSVA-Llama2-13B — 70.04 (2023-12-15) GSVA-Vicuna-13B-v1.1 — 68.01 (2023-12-15) GSVA-Vicuna-7B-v1.1 — 66.47 (2023-12-15) GSVA-Llama2-13B — 70.04 (2023-12-15) GSVA-Vicuna-13B-v1.1 — 68.01 (2023-12-15) GSVA-Vicuna-7B-v1.1 — 66.47 (2023-12-15) GROUNDHOG — 66.7 (2024-02-26) GROUNDHOG — 66.7 (2024-02-26) MABP — 68.79 (2024-05-24) HDC — 68.28 (2024-05-24) MABP — 68.79 (2024-05-24) HDC — 68.28 (2024-05-24) DeRIS-L — 77.67 (2025-07-02) DeRIS-L — 77.67 (2025-07-02) MattNet — 48.24 (2018-01-24) LTS — 52.7 (2021-03-30) CRIS — 56.27 (2021-11-30) LAVT — 58.4 (2021-12-04) ReLA — 63.6 (2023-06-01) GSVA-Llama2-13B — 70.04 (2023-12-15) DeRIS-L — 77.67 (2025-07-02)
RankModel gIoUcIoU Extra Training Data PaperCodeYear
1 DeRIS-L 77.6772.00 DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation through Loopback Synergy Dmmm1997/DeRIS 2025
2 GSVA-Llama2-13B 70.0466.38 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
3 MABP 68.7965.69 Bring Adaptive Binding Prototypes to Generalized Referring Expression Segmentation buptlwz/mabp 2024
4 HDC 68.2865.42 CoHD: A Counting-Aware Hierarchical Decoding Framework for Generalized Referring Expression Segmentation robertluo1/cohd · RobertLuo1/HDC 2024
5 GSVA-Vicuna-13B-v1.1 68.0164.05 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
6 GROUNDHOG 66.70 GROUNDHOG: Grounding Large Language Models to Holistic Segmentation 2024
7 GSVA-Vicuna-7B-v1.1 66.4763.29 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
8 ReLA 63.6062.42 GRES: Generalized Referring Expression Segmentation henghuiding/ReLA · henghuiding/grefcoco 2023
9 LAVT 58.4057.64 LAVT: Language-Aware Vision Transformer for Referring Image Segmentation yz93/lavt-ris 2021
10 CRIS 56.2755.34 CRIS: CLIP-Driven Referring Image Segmentation DerrickWang005/CRIS.pytorch 2021
11 LTS 52.7052.30 Locate then Segment: A Strong Pipeline for Referring Image Segmentation 2021
12 VLT 52.0052.51 Vision-Language Transformer and Query Generation for Referring Segmentation henghuiding/Vision-Language-Transformer 2021
13 MattNet 48.2447.51 MAttNet: Modular Attention Network for Referring Expression Comprehension lichengunc/MAttNet 2018
14 DeRIS-L 77.6772.00 DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation through Loopback Synergy Dmmm1997/DeRIS 2025
15 GSVA-Llama2-13B 70.0466.38 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
16 MABP 68.7965.69 Bring Adaptive Binding Prototypes to Generalized Referring Expression Segmentation buptlwz/mabp 2024
17 HDC 68.2865.42 CoHD: A Counting-Aware Hierarchical Decoding Framework for Generalized Referring Expression Segmentation robertluo1/cohd · RobertLuo1/HDC 2024
18 GSVA-Vicuna-13B-v1.1 68.0164.05 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
19 GROUNDHOG 66.70 GROUNDHOG: Grounding Large Language Models to Holistic Segmentation 2024
20 GSVA-Vicuna-7B-v1.1 66.4763.29 GSVA: Generalized Segmentation via Multimodal Large Language Models leaplabthu/gsva 2023
1–20 / 26 다음 → 페이지당 10 20 50 100