paper-with-me

홈 › Papers

REVEAL: Multi-turn Evaluation of Image-Input Harms for Vision LLM

2025-05-07 · Madhur Jindal, Saurabh Deshpande

Vision Large Language Models (VLLMs) represent a significant advancement in artificial intelligence by integrating image-processing capabilities with textual understanding, thereby enhancing user interactions and expanding application domains. However, their increased complexity introduces novel safety and ethical challenges, particularly in multi-modal and multi-turn conversations. Traditional safety evaluation frameworks, designed for text-based, single-turn interactions, are inadequate for addressing these complexities. To bridge this gap, we introduce the REVEAL (Responsible Evaluation of Vision-Enabled AI LLMs) Framework, a scalable and automated pipeline for evaluating image-input harms in VLLMs. REVEAL includes automated image mining, synthetic adversarial data generation, multi-turn conversational expansion using crescendo attack strategies, and comprehensive harm assessment through evaluators like GPT-4o. We extensively evaluated five state-of-the-art VLLMs, GPT-4o, Llama-3.2, Qwen2-VL, Phi3.5V, and Pixtral, across three important harm categories: sexual harm, violence, and misinformation. Our findings reveal that multi-turn interactions result in significantly higher defect rates compared to single-turn evaluations, highlighting deeper vulnerabilities in VLLMs. Notably, GPT-4o demonstrated the most balanced performance as measured by our Safety-Usability Index (SUI) followed closely by Pixtral. Additionally, misinformation emerged as a critical area requiring enhanced contextual defenses. Llama-3.2 exhibited the highest MT defect rate ($16.55 \%$) while Qwen2-VL showed the highest MT refusal rate ($19.1 \%$).

📄 PDF Abstract BibTeX arXiv:2505.04673

Code (1)

Madhur-1/RevealVLLMSafetyEval 공식 구현

Tasks

Misinformation

Similar Papers 제목 키워드 기반

IMCBench: A benchmark for multimodal LLMs in Image-grounded Medical Conversations

2026-06-26 · Maria Xenochristou, Ashutosh Joshi, Korosh Vatanparvar, Mohammad Abuzar Hashemi 외 arxiv

Recent advances in large language models and vision-language models have enabled reasoning over multimodal data, offering opportunities for clinical applications such as decision support and triaging. However, existing m…

MMDU: A Multi-Turn Multi-Image Dialog Understanding Benchmark and Instruction-Tuning Dataset for LVLMs

2024-06-17 · Ziyu Liu, Tao Chu, Yuhang Zang, Xilin Wei 외

Generating natural and meaningful responses to communicate with multi-modal human inputs is a fundamental capability of Large Vision-Language Models(LVLMs). While current open-source LVLMs demonstrate promising performan…

Visual Question Answering

FashionNTM: Multi-turn Fashion Image Retrieval via Cascaded Memory

2023-08-20 · ICCV 2023 1 · Anwesan Pal, Sahil Wadhwa, Ayush Jaiswal, Xu Zhang 외

Multi-turn textual feedback-based fashion image retrieval focuses on a real-world setting, where users can iteratively provide information to refine retrieval results until they find an item that fits all their requireme…

Image RetrievalRetrieval

Shallow Robustness, Deep Vulnerabilities: Multi-Turn Evaluation of Medical LLMs

2025-10-14 · Blazej Manczak, Eric Lin, Francisco Eiras, James O' Neill 외 arxiv

Large language models (LLMs) are rapidly transitioning into medical clinical use, yet their reliability under realistic, multi-turn interactions remains poorly understood. Existing evaluation frameworks typically assess …

Question Answering

MTR-Bench: A Comprehensive Benchmark for Multi-Turn Reasoning Evaluation

2025-05-21 · Xiaoyuan Li, Keqin Bao, Yubo Ma, Moxin Li 외

Recent advances in Large Language Models (LLMs) have shown promising results in complex reasoning tasks. However, current evaluations predominantly focus on single-turn reasoning scenarios, leaving interactive tasks larg…

Attribute