paper-with-me

Papers Story Visualization

“Story Visualization” 태그가 달린 논문 50편 · 필터 해제

ReCap: Lightweight Referential Grounding for Coherent Story Visualization

2026-04-20 · Aditya Arora, Akshita Gupta, Pau Rodriguez, Marcus Rohrbach arxiv

Story Visualization aims to generate a sequence of images that faithfully depicts a textual narrative that preserve character identity, spatial configuration, and stylistic coherence as the narratives unfold. Maintaining…

Story Visualization

BOOKAGENT: Orchestrating Safety-Aware Visual Narratives via Multi-Agent Cognitive Calibration

2026-04-17 · Bo Gao, Chang Liu, Yuyang Miao, Siyuan Ma 외 arxiv

Recent advancements in Large Generative Models (LGMs) have revolutionized multi-modal generation. However, generating illustrated storybooks remains an open challenge, where prior works mainly decompose this task into se…

Story Visualization

LogiStory: A Logic-Aware Framework for Multi-Image Story Visualization

2026-03-30 · Chutian Meng, Fan Ma, Chi Zhang, Jiaxu Miao 외 arxiv

Generating coherent and communicative visual sequences, such as image sequences and videos, remains a significant challenge for current multimodal systems. Despite advances in visual quality and the integration of world …

Story VisualizationImage GenerationVideo Generation

Directing the Narrative: A Finetuning Method for Controlling Coherence and Style in Story Generation

2026-03-18 · Jianzhang Zhang, Yijing Tian, Jiwang Qu, Chuang Liu arxiv

Story visualization requires generating sequential imagery that aligns semantically with evolving narratives while maintaining rigorous consistency in character identity and visual style. However, existing methodologies …

Story VisualizationStory Generation

Persistent Story World Simulation with Continuous Character Customization

2026-03-17 · Jinlu Zhang, Qiyun Wang, Baoxiang Du, Jiayi Ji 외 arxiv

Story visualization has gained increasing attention in computer vision. However, current methods often fail to achieve a synergy between accurate character customization, semantic alignment, and continuous integration of…

Visual StorytellingStory Visualization

DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models

2025-12-01 · Patrick Kwon, Chen Chen arxiv

Current story visualization methods tend to position subjects solely by text and face challenges in maintaining artistic consistency. To address these limitations, we introduce DreamingComics, a layout-aware story visual…

Story Visualization

TaleDiffusion: Multi-Character Story Generation with Dialogue Rendering

2025-09-04 · Ayan Banerjee, Josep Llados, Umapada Pal, Anjan Dutta arxiv

Text-to-story visualization is challenging due to the need for consistent interaction among multiple characters across frames. Existing methods struggle with character consistency, leading to artifact generation and inac…

Story VisualizationStory Generation

Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models

2025-09-04 · Kiymet Akdemir, Jing Shi, Kushal Kafle, Brian Price 외 arxiv

Text-to-image diffusion models have demonstrated significant capabilities to generate diverse and detailed visuals in various domains, and story visualization is emerging as a particularly promising application. However,…

Story VisualizationStory Generation

Consistent Story Generation with Asymmetry Zigzag Sampling

2025-06-11 · Mingxiao Li, Mang Ning, Marie-Francine Moens

Text-to-image generation models have made significant progress in producing high-quality images from textual descriptions, yet they continue to struggle with maintaining subject consistency across multiple images, a fund…

Image GenerationStory GenerationStory VisualizationText to Image Generation+2

ViStoryBench: Comprehensive Benchmark Suite for Story Visualization

2025-05-30 · Cailin Zhuang, Ailin Huang, Wei Cheng, Jingwei Wu 외

Story visualization, which aims to generate a sequence of visually coherent images aligning with a given narrative and reference images, has seen significant progress with recent advancements in generative models. To fur…

Story Visualization

Object Isolated Attention for Consistent Story Visualization

2025-03-30 · Xiangyang Luo, Junhao Cheng, Yifan Xie, Xin Zhang 외

Open-ended story visualization is a challenging task that involves generating coherent image sequences from a given storyline. One of the main difficulties is maintaining character consistency while creating natural and …

ObjectStory Visualization

Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling

2024-12-30 · Min Zhang, Zilin Wang, Liyan Chen, KunHong Liu 외

Recent advances in AI-driven storytelling have enhanced video generation and story visualization. However, translating dialogue-centric scripts into coherent storyboards remains a significant challenge due to limited scr…

Retrieval-augmented GenerationStory VisualizationVideo Generation

DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation

2024-12-10 · CVPR 2025 1 · Jianzong Wu, Chao Tang, Jingbo Wang, Yanhong Zeng 외

Story visualization, the task of creating visual narratives from textual descriptions, has seen progress with text-to-image generation models. However, these models often lack effective control over character appearances…

Image GenerationLanguage ModellingLarge Language ModelMultimodal Large Language Model+3

StoryWeaver: A Unified World Model for Knowledge-Enhanced Story Character Customization

2024-12-10 · Jinlu Zhang, Jiji Tang, Rongsheng Zhang, Tangjie Lv 외

Story visualization has gained increasing attention in artificial intelligence. However, existing methods still struggle with maintaining a balance between character identity preservation and text-semantics alignment, la…

Story Visualization

Story-Adapter: A Training-free Iterative Framework for Long Story Visualization

2024-10-08 · Jiawei Mao, Xiaoke Huang, Yunfei Xie, Yuanqi Chang 외

Story visualization, the task of generating coherent images based on a narrative, has seen significant advancements with the emergence of text-to-image models, particularly diffusion models. However, maintaining semantic…

Image GenerationStory Visualization

DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion

2024-07-17 · Huiguo He, Huan Yang, Zixi Tuo, Yuan Zhou 외

Story visualization aims to create visually compelling images or videos corresponding to textual narratives. Despite recent advances in diffusion models yielding promising results, existing methods still struggle to crea…

DescriptiveStory Visualization

ContextualStory: Consistent Visual Storytelling with Spatially-Enhanced and Storyline Context

2024-07-13 · Sixiao Zheng, Yanwei Fu

Visual storytelling involves generating a sequence of coherent frames from a textual storyline while maintaining consistency in characters and scenes. Existing autoregressive methods, which rely on previous frame-sentenc…

Image GenerationStory ContinuationStory VisualizationText-to-Image Generation+1

Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models

2024-07-02 · Fei Shen, Hu Ye, Sibo Liu, Jun Zhang 외

Recent research showcases the considerable potential of conditional diffusion models for generating consistent stories. However, current methods, which predominantly generate stories in an autoregressive and excessively …

Story Visualization

Evolving Storytelling: Benchmarks and Methods for New Character Customization with Diffusion Models

2024-05-20 · Xiyu Wang, YuFei Wang, Satoshi Tsutsui, Weisi Lin 외

Diffusion-based models for story visualization have shown promise in generating content-coherent images for storytelling tasks. However, how to effectively integrate new characters into existing narratives while maintain…

Knowledge DistillationStory GenerationStory Visualization

StoryImager: A Unified and Efficient Framework for Coherent Story Visualization and Completion

2024-04-09 · Ming Tao, Bing-Kun Bao, Hao Tang, YaoWei Wang 외

Story visualization aims to generate a series of realistic and coherent images based on a storyline. Current models adopt a frame-by-frame architecture by transforming the pre-trained text-to-image model into an auto-reg…

Image GenerationStory Visualization
1–20 / 50 다음 →