跳到正文
原文
Hugging Face Blog·· 2026-07-23精选AI 评分69

Hugging Face 将 Nunchaku 4-bit 扩散推理接入 Diffusers

Bringing Nunchaku 4-bit Diffusion Inference to Diffusers

AI 导读

Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 的 SVDQuant 4-bit 检查点,无需自定义 pipeline 或本地 CUDA 编译。

推荐理由

原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,可据此判断消费级 GPU 跑扩散模型的量化选型。

来源:Hugging Face Blog · huggingface.co