paper-with-me

Papers

Edify Image: High-Quality Image Generation with Pixel Space Laplacian Diffusion Models

2024-11-11 · Nvidia, :, Yuval Atzmon, Maciej Bala, Yogesh Balaji, Tiffany Cai, Yin Cui, Jiaojiao Fan, Yunhao Ge, Siddharth Gururani, Jacob Huffman, Ronald Isaac, Pooya Jannaty, Tero Karras, Grace Lam, J. P. Lewis, Aaron Licata, Yen-Chen Lin, Ming-Yu Liu, Qianli Ma, Arun Mallya, Ashlee Martino-Tarr, Doug Mendez, Seungjun Nah, Chris Pruett, Fitsum Reda, Jiaming Song, Ting-Chun Wang, Fangyin Wei, Xiaohui Zeng, Yu Zeng, Qinsheng Zhang

We introduce Edify Image, a family of diffusion models capable of generating photorealistic image content with pixel-perfect accuracy. Edify Image utilizes cascaded pixel-space diffusion models trained using a novel Laplacian diffusion process, in which image signals at different frequency bands are attenuated at varying rates. Edify Image supports a wide range of applications, including text-to-image synthesis, 4K upsampling, ControlNets, 360 HDR panorama generation, and finetuning for image customization.

📄 PDF Abstract BibTeX arXiv:2411.07126

Code (0)

등록된 구현이 없습니다.

Tasks

4kImage Generation

Methods 이 논문이 사용한 방법론

Diffusion Diffusion models generate samples by gradually removing noise from a signal, and their training objective can be expressed as a reweighted variational lower-bound…

Similar Papers 제목 키워드 기반

Edify 3D: Scalable High-Quality 3D Asset Generation

2024-11-11 · Nvidia, :, Maciej Bala, Yin Cui 외

We introduce Edify 3D, an advanced solution designed for high-quality 3D asset generation. Our method first synthesizes RGB and surface normal images of the described object at multiple viewpoints using a diffusion model…

Object

Predify: Augmenting deep neural networks with brain-inspired predictive coding dynamics

2021-06-04 · NeurIPS 2021 12 · Bhavin Choksi, Milad Mozafari, Callum Biggs O'May, Benjamin Ador 외

Deep neural networks excel at image classification, but their performance is far less robust to input perturbations than human perception. In this work we explore whether this shortcoming may be partly addressed by incor…

image-classificationImage Classification

CAMERAS: Enhanced Resolution And Sanity preserving Class Activation Mapping for image saliency

2021-06-20 · CVPR 2021 1 · Mohammad A. A. K. Jalwana, Naveed Akhtar, Mohammed Bennamoun, Ajmal Mian

Backpropagation image saliency aims at explaining model predictions by estimating model-centric importance of individual pixels in the input. However, class-insensitivity of the earlier layers in a network only allows sa…

GreenStableYolo: Optimizing Inference Time and Image Quality of Text-to-Image Generation

2024-07-20 · Jingzhi Gong, Sisi Li, Giordano d'Aloisio, Zishuo Ding 외

Tuning the parameters and prompts for improving AI-based text-to-image generation has remained a substantial yet unaddressed challenge. Hence we introduce GreenStableYolo, which improves the parameters and prompts for St…

GPUImage GenerationText to Image GenerationText-to-Image Generation

Efficient-VQGAN: Towards High-Resolution Image Generation with Efficient Vision Transformers

2023-10-09 · ICCV 2023 1 · Shiyue Cao, Yueqin Yin, Lianghua Huang, Yu Liu 외

Vector-quantized image modeling has shown great potential in synthesizing high-quality images. However, generating high-resolution images remains a challenging task due to the quadratic computational overhead of the self…

Image GenerationImage ReconstructionQuantization