paper-with-me

Efficient ViTs

3개 벤치마크 · 논문 32편 · 이 태스크의 논문 보기 →

Benchmarks

Most implemented

Token Merging: Your ViT But Faster

2022-10-17 · 구현 5개

Papers

ImagePiece: Content-aware Re-tokenization for Efficient Image Recognition

2024-12-21 · Seungdong Yoa, Seungjun Lee, Hyeseung Cho, Bumsoo Kim 외

Vision Transformers (ViTs) have achieved remarkable success in various computer vision tasks. However, ViTs have a huge computational cost due to their inherent reliance on multi-head self-attention (MHSA), prompting eff…

Efficient ViTsToken Reduction

M$^2$-ViT: Accelerating Hybrid Vision Transformers with Two-Level Mixed Quantization

2024-10-10 · Yanbiao Liang, Huihong Shi, Zhongfeng Wang

Although Vision Transformers (ViTs) have achieved significant success, their intensive computations and substantial memory overheads challenge their deployment on edge devices. To address this, efficient ViTs have emerge…

Efficient ViTsQuantization

Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer

2024-05-06 · Huihong Shi, Haikuo Shao, Wendong Mao, Zhongfeng Wang

Motivated by the huge success of Transformers in the field of natural language processing (NLP), Vision Transformers (ViTs) have been rapidly developed and achieved remarkable performance in various computer vision tasks…

Efficient ViTsModel CompressionQuantization

An FPGA-Based Reconfigurable Accelerator for Convolution-Transformer Hybrid EfficientViT

2024-03-29 · Haikuo Shao, Huihong Shi, Wendong Mao, Zhongfeng Wang

Vision Transformers (ViTs) have achieved significant success in computer vision. However, their intensive computations and massive memory footprint challenge ViTs' deployment on embedded devices, calling for efficient Vi…

Efficient ViTs

Multi-criteria Token Fusion with One-step-ahead Attention for Efficient Vision Transformers

2024-03-15 · CVPR 2024 1 · Sanghyeok Lee, Joonmyung Choi, Hyunwoo J. Kim

Vision Transformer (ViT) has emerged as a prominent backbone for computer vision. For more efficient ViTs, recent works lessen the quadratic cost of the self-attention layer by pruning or fusing the redundant tokens. How…

Computational EfficiencyEfficient ViTsimage-classificationImage Classification

GTP-ViT: Efficient Vision Transformers via Graph-based Token Propagation

2023-11-06 · Xuwei Xu, Sen Wang, Yudong Chen, Yanping Zheng 외

Vision Transformers (ViTs) have revolutionized the field of computer vision, yet their deployments on resource-constrained devices remain challenging due to high computational demands. To expedite pre-trained ViTs, token…

Efficient ViTsImage Classification

전체 32편 보기 →