paper-with-me

Image Manipulation

1개 벤치마크 · 논문 486편 · 이 태스크의 논문 보기 →

Benchmarks

LRS2

결과 4개

Most implemented

Papers

FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification

2026-07-30 · Haoqing Wang, Xingrun Xing, Wei Xia, Ziheng Li 외 arxiv

Agentic vision-language models (VLMs), which interleave textual reasoning with explicit tool calls such as cropping and code-based image manipulation, have emerged as a compelling paradigm for reliable and interpretable …

Multimodal ReasoningImage Manipulation

Can Vision-Language Models Reason about AI Edits in Images?

2026-07-30 · Darsha Udayanga, Pin-Yu Chen, Payel Das, Qiang Ji arxiv

Detection and localization of AI-tampered images are critical for trustworthy AI, yet modern generative models have made such manipulations increasingly difficult to identify. While traditional binary classifiers can det…

Reinforcement LearningImage Manipulation

Editing Everything Everywhere All at Once

2026-06-30 · Fabio Quattrini, Carmine Zaccagnino, Enis Simsar, Marta Tintoré Gazulla 외 arxiv

Editing multiple elements of an image in a single forward pass is a practical alternative to multi-turn image manipulation, offering improved efficiency and potentially better harmonization. However, when several instruc…

Image ManipulationImage Editing

EPEdit: Redefining Image Editing with Generative AI and User-Centric Design

2026-06-23 · Hoang-Phuc Nguyen, Dinh-Khoi Vo, Trong-Le Do, Hai-Dang Nguyen 외 arxiv

The demand for image manipulation has seen a significant increase recently. Traditional tools like Photoshop and Capture One, while powerful, require considerable expertise to use effectively. Generative AI has introduce…

Image ManipulationImage GenerationImage Editing

Text-Vision Co-Instructed Image Editing

2026-06-15 · Chenxi Xie, Yuhui Wu, Qiaosi Yi, Lei Zhang arxiv

Existing image editing methods can be generally categorized into textual instruction-based and visual prompt-based ones. Textual instructions are semantically expressive, but are limited by the coarse granularity of spat…

Image ManipulationImage Editing

Toward 360-Degree Indoor Panorama Editing via Tuning-Free Diffusion Model with Refocusing Cross-Attention

2026-06-12 · Dinh-Khoi Vo, Nhut-Thanh Le-Hinh, Viet-Tham Huynh, Tam V. Nguyen 외 arxiv

Zero-shot text-guided diffusion has significantly advanced image editing; however, its practical usability remains constrained by three persistent challenges: prompt brittleness that requires meticulous prompt engineerin…

Image ManipulationPrompt EngineeringImage Editing

전체 486편 보기 →