paper-with-me

Papers

Q-Drift: Quantization-Aware Drift Correction for Diffusion Model Sampling

2026-03-18 · Sooyoung Ryu, Mathieu Salzmann, Saqib Javed arxiv

Post-training quantization (PTQ) is a practical path to deploy large diffusion models, but quantization noise can accumulate over the denoising trajectory and degrade generation quality. We propose Q-Drift, a principled sampler-side correction that treats quantization error as an implicit stochastic perturbation on each denoising step and derives a marginal-distribution-preserving drift adjustment. Q-Drift estimates a timestep-wise variance statistic from calibration, in practice requiring as few as 5 paired full-precision/quantized calibration runs. The resulting sampler correction is plug-and-play with common samplers, diffusion models, and PTQ methods, while incurring negligible overhead at inference. Across six diverse text-to-image models (spanning DiT and U-Net), three samplers (Euler, flow-matching, DPM-Solver++), and two PTQ methods (SVDQuant, MixDQ), Q-Drift improves FID over the corresponding quantized baseline in most settings, with up to 4.59 FID reduction on PixArt-Sigma (SVDQuant W3A4), while preserving CLIP scores.

📄 PDF Abstract BibTeX arXiv:2603.18095

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

Closing the Null Space: Guidance-Aware Quantization for Classifier-Free Diffusion

2026-07-09 · Abdullah Al Shafi, Sumaiya Rahim Suma arxiv

Deploying classifier-free guidance (CFG) diffusion models under real-world compute budgets requires quantization, yet existing post-training quantization (PTQ) methods treat CFG models as single-branch networks, ignoring…

DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models

2026-04-13 · Siyuan Xu, Tianshi Wang, Fengling Li, Lei Zhu 외 arxiv

Vision-Language-Action models (VLAs) have demonstrated strong potential for embodied AI, yet their deployment on resource-limited robots remains challenging due to high memory and computational demands. While Post-Traini…

NSVQ: Mitigating Codebook Collapse by Stabilizing Encoder Drift in Vector Quantization

2026-06-09 · Hao Lu, Yongxin Guo, Onur Koyun, Zhengjie Zhu 외 arxiv

Vector quantization is central to modern generative modeling pipelines, but large-codebook VQ models often suffer from codebook collapse. We identify encoder drift as a key driver of this failure: as the encoder moves th…

Drifting Objectives for Refining Discrete Diffusion Language Models

2026-05-19 · Daisuke Oba, Hiroki Furuta, Naoaki Okazaki arxiv

Discrete diffusion language models (DDLMs) generate text by iteratively denoising categorical token sequences, while recent drifting methods for continuous generators suggest that part of this sampling-time correction ca…

Self-Auditing Residual Drifting for Pathology-Preserving Accelerated Knee MRI

2026-07-02 · Qing Lyu, Jianxu Wang, Mohammad Kawas, Ge Wang 외 arxiv

Accelerated magnetic resonance imaging reduces acquisition time, but reconstruction from undersampled k-space can blur diagnostically relevant structures or introduce failures that are not captured by global image metric…