paper-with-me

Fine-Grained Visual Recognition

4개 벤치마크 · 논문 86편 · 이 태스크의 논문 보기 →

Benchmarks

CUB-200-2011

결과 1개

FGVC-Aircraft

결과 1개

Stanford Dogs

결과 1개

Most implemented

Papers

ConCA: Concentration-Aware Channel Attention for Fine-Grained Visual Recognition

2026-08-31 · Yu-Sheng Liu, Yu-Chen Tung arxiv

Lightweight channel attention mechanisms are widely used in image classification, yet their effectiveness in fine-grained visual recognition (FGVR) remains limited. Most modules summarize each channel by global average p…

Fine-Grained Visual RecognitionImage Classification

Subtoken Vision Transformer for Fine-grained Recognition

2026-07-10 · Jie Zhu, Ivy Zhang, Minchul Kim, Xiaoming Liu arxiv

We present Subtoken Vision Transformer (SubViT), a selective image tokenization method for fine-grained visual recognition. Standard Vision Transformers compress each fixed-size patch into a single token, although fine-g…

Fine-Grained Visual Recognition

Frequency-Enhanced Dual-Subspace Networks for Few-Shot Fine-Grained Image Classification

2026-04-16 · Meijia Wang, Guochao Wang, Haozhen Chu, Bin Yao 외 arxiv

Few-shot fine-grained image classification aims to recognize subcategories with high visual similarity using only a limited number of annotated samples. Existing metric learning-based methods typically rely solely on spa…

Fine-Grained Image ClassificationFine-Grained Visual RecognitionComputational EfficiencyMetric Learning

Progressive Deep Learning for Automated Spheno-Occipital Synchondrosis Maturation Assessment

2026-04-13 · Omid Halimi Milani, Amanda Nikho, Marouane Tliba, Lauren Mills 외 arxiv

Accurate assessment of spheno-occipital synchondrosis (SOS) maturation is a key indicator of craniofacial growth and a critical determinant for orthodontic and surgical timing. However, SOS staging from cone-beam CT (CBC…

Fine-Grained Visual RecognitionRepresentation Learning

SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition

2026-03-18 · Jingxiao Yang, DaLin He, Miao Pan, Kaixiang Yao 외 arxiv

Recent advances in Large Vision-Language Models (LVLMs) have enabled training-free Fine-Grained Visual Recognition (FGVR). However, effectively exploiting LVLMs for FGVR remains challenging due to the inherent visual amb…

Fine-Grained Visual Recognition

Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models

2026-02-28 · Hulingxiao He, Zhi Tan, Yuxin Peng arxiv

A high-performing, general-purpose visual understanding model should map visual inputs to a taxonomic tree of labels, identify novel categories beyond the training set for which few or no publicly available images exist.…

Fine-Grained Visual RecognitionContrastive Learning

전체 86편 보기 →