paper-with-me

Instance Segmentation 벤치마크

Instance Segmentation on Cityscapes val

17개 결과 · ⬇ CSV · JSON

mask AP

35.8 39.1 42.4 45.7 49 2019-12 2026-09 PointRend — 35.8 (2019-12-17) GAIS-Net — 37.1 (2020-06-14) Mask2Former (Swin-L, single-scale) — 43.7 (2021-12-02) Mask2Former (Swin-B) — 42.0 (2021-12-02) Mask2Former (Swin-S) — 41.8 (2021-12-02) Mask2Former (Swin-T) — 39.7 (2021-12-02) Mask2Former (ResNet-101) — 38.5 (2021-12-02) Mask2Former (ResNet-50) — 37.4 (2021-12-02) DiNAT-L (single-scale, Mask2Former) — 45.1 (2022-09-29) OneFormer (ConvNeXt-L, single-scale, Mapillary-Pretrained) — 48.7 (2022-11-10) OneFormer (DiNAT-L, single-scale) — 45.6 (2022-11-10) OneFormer (Swin-L, single-scale) — 45.6 (2022-11-10) PolySnake — 40.2 (2023-01-21) OpenSeeD( SwinL, single-scale) — 48.5 (2023-03-14) AFF-Base (single-scale, point-based Mask2Former) — 46.2 (2023-04-24) AFF-Small (single-scale, point-based Mask2Former) — 44.0 (2023-04-24) ViT-P (OneFormer, ConvNeXt-L, single-scale, 512x1024, Mapillary Vistas-pretrained) — 49.0 (2025-05-26) PointRend — 35.8 (2019-12-17) GAIS-Net — 37.1 (2020-06-14) Mask2Former (Swin-L, single-scale) — 43.7 (2021-12-02) DiNAT-L (single-scale, Mask2Former) — 45.1 (2022-09-29) OneFormer (ConvNeXt-L, single-scale, Mapillary-Pretrained) — 48.7 (2022-11-10) ViT-P (OneFormer, ConvNeXt-L, single-scale, 512x1024, Mapillary Vistas-pretrained) — 49.0 (2025-05-26)
RankModel mask APAP50AP Extra Training Data PaperCodeYear
1 ViT-P (OneFormer, ConvNeXt-L, single-scale, 512x1024, Mapillary Vistas-pretrained) 49.049.0 The Missing Point in Vision Transformers for Universal Image Segmentation sajjad-sh33/vit-p 2025
2 OneFormer (ConvNeXt-L, single-scale, Mapillary-Pretrained) 48.7 OneFormer: One Transformer to Rule Universal Image Segmentation huggingface/transformers · SHI-Labs/OneFormer · yangyucheng000/University · +1 2022
3 OpenSeeD( SwinL, single-scale) 48.5 A Simple Framework for Open-Vocabulary Segmentation and Detection microsoft/X-Decoder · idea-research/openseed 2023
4 AFF-Base (single-scale, point-based Mask2Former) 46.274.2 AutoFocusFormer: Image Segmentation off the Grid apple/ml-autofocusformer 2023
5 OneFormer (DiNAT-L, single-scale) 45.6 OneFormer: One Transformer to Rule Universal Image Segmentation huggingface/transformers · SHI-Labs/OneFormer · yangyucheng000/University · +1 2022
5 OneFormer (Swin-L, single-scale) 45.6 OneFormer: One Transformer to Rule Universal Image Segmentation huggingface/transformers · SHI-Labs/OneFormer · yangyucheng000/University · +1 2022
7 DiNAT-L (single-scale, Mask2Former) 45.172.6 Dilated Neighborhood Attention Transformer huggingface/transformers · SHI-Labs/Neighborhood-Attention-Transformer · leondgarse/keras_cv_attention_models · +4 2022
8 AFF-Small (single-scale, point-based Mask2Former) 44.072.8 AutoFocusFormer: Image Segmentation off the Grid apple/ml-autofocusformer 2023
9 Mask2Former (Swin-L, single-scale) 43.7 Masked-attention Mask Transformer for Universal Image Segmentation huggingface/transformers · open-mmlab/mmdetection · facebookresearch/Mask2Former · +4 2021
10 Mask2Former (Swin-B) 42 Masked-attention Mask Transformer for Universal Image Segmentation huggingface/transformers · open-mmlab/mmdetection · facebookresearch/Mask2Former · +4 2021
1–10 / 17 다음 → 페이지당 10 20 50 100