paper-with-me

Dense Video Captioning 벤치마크

Dense Video Captioning on ViTT

8개 결과 · ⬇ CSV · JSON

SODA

0.135 0.1388 0.1425 0.1462 0.15 2023-02 2026-09 Vid2Seq — 0.135 (2023-02-27) Vid2Seq — 0.135 (2023-02-27) HiCM² — 0.15 (2024-12-19) HiCM² — 0.15 (2024-12-19) Vid2Seq — 0.135 (2023-02-27) HiCM² — 0.15 (2024-12-19)
RankModel SODACIDErMETEOR Extra Training Data PaperCodeYear
1 Vid2Seq (VidChapters-7M PT) 0.15150.99.5
2 HiCM² 0.15051.29.6 HiCM$^2$: Hierarchical Compact Memory Modeling for Dense Video Captioning ailab-kyunghee/HiCM2-DVC 2024
3 Vid2Seq 0.13543.58.5 Vid2Seq: Large-Scale Pretraining of a Visual Language Model for Dense Video Captioning google-research/scenic · antoyang/VidChapters · KastanDay/video-pretrained-transformer 2023
4 E2ESG 25.08.1 End-to-end Dense Video Captioning as Sequence Generation 2022
5 Vid2Seq (VidChapters-7M PT) 0.15150.99.5
6 HiCM² 0.15051.29.6 HiCM$^2$: Hierarchical Compact Memory Modeling for Dense Video Captioning ailab-kyunghee/HiCM2-DVC 2024
7 Vid2Seq 0.13543.58.5 Vid2Seq: Large-Scale Pretraining of a Visual Language Model for Dense Video Captioning google-research/scenic · antoyang/VidChapters · KastanDay/video-pretrained-transformer 2023
8 E2ESG 25.08.1 End-to-end Dense Video Captioning as Sequence Generation 2022
1–8 / 8 페이지당 10 20 50 100