paper-with-me

홈 › Papers

Uni$^2$Det: Unified and Universal Framework for Prompt-Guided Multi-dataset 3D Detection

2024-09-30 · Yubin Wang, Zhikang Zou, Xiaoqing Ye, Xiao Tan, Errui Ding, Cairong Zhao

We present Uni$^2$Det, a brand new framework for unified and universal multi-dataset training on 3D detection, enabling robust performance across diverse domains and generalization to unseen domains. Due to substantial disparities in data distribution and variations in taxonomy across diverse domains, training such a detector by simply merging datasets poses a significant challenge. Motivated by this observation, we introduce multi-stage prompting modules for multi-dataset 3D detection, which leverages prompts based on the characteristics of corresponding datasets to mitigate existing differences. This elegant design facilitates seamless plug-and-play integration within various advanced 3D detection frameworks in a unified manner, while also allowing straightforward adaptation for universal applicability across datasets. Experiments are conducted across multiple dataset consolidation scenarios involving KITTI, Waymo, and nuScenes, demonstrating that our Uni$^2$Det outperforms existing methods by a large margin in multi-dataset training. Notably, results on zero-shot cross-dataset transfer validate the generalization capability of our proposed method.

📄 PDF Abstract BibTeX arXiv:2409.20558

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

UniVS: Unified and Universal Video Segmentation with Prompts as Queries

2024-02-28 · CVPR 2024 1 · Minghan Li, Shuai Li, Xindong Zhang, Lei Zhang

Despite the recent advances in unified image segmentation (IS), developing a unified video segmentation (VS) model remains a challenge. This is mainly because generic category-specified VS tasks need to detect all object…

DecoderReferring Expression SegmentationReferring Video Object SegmentationVideo Instance Segmentation+6

PromptHSI: Universal Hyperspectral Image Restoration with Vision-Language Modulated Frequency Adaptation

2024-11-24 · Chia-Ming Lee, Ching-Heng Cheng, Yu-Fan Lin, Yi-Ching Cheng 외

Recent advances in All-in-One (AiO) RGB image restoration have demonstrated the effectiveness of prompt learning in handling multiple degradations within a single model. However, extending these approaches to hyperspectr…

Image RestorationLanguage ModelingLanguage ModellingPrompt Learning

UniMedSeg: Unified In-Context Learning for Multi-Paradigm 2D/3D Medical Image Segmentation

2026-07-14 · Yunzhou Li, Jiesi Hu, Yanwu Yang, Hanyang Peng 외 arxiv

Medical image segmentation foundation models are expected to generalize across diverse clinical scenarios, yet existing universal methods remain fragmented by prompt paradigms and spatial dimensions. Visual in-context le…

Medical Image SegmentationInteractive Segmentation

A Unified Framework for Emotion Recognition and Sentiment Analysis via Expert-Guided Multimodal Fusion with Large Language Models

2026-01-12 · Jiaqi Qiao, Xiujuan Xu, Xinran Li, Yu Liu arxiv

Multimodal emotion understanding requires effective integration of text, audio, and visual modalities for both discrete emotion recognition and continuous sentiment analysis. We present EGMF, a unified framework combinin…

Computational EfficiencyEmotion RecognitionSentiment Analysis

MP-HSIR: A Multi-Prompt Framework for Universal Hyperspectral Image Restoration

2025-03-12 · Zhehui Wu, Yong Chen, Naoto Yokoya, wei he

Hyperspectral images (HSIs) often suffer from diverse and unknown degradations during imaging, leading to severe spectral and spatial distortions. Existing HSI restoration methods typically rely on specific degradation a…

Image RestorationSpectral Reconstruction