Hugging Face Blog·· 2026-07-23精选AI 评分69
Hugging Face 将 Nunchaku 4-bit 扩散推理接入 Diffusers
Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
AI 导读
Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 的 SVDQuant 4-bit 检查点,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由
原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,可据此判断消费级 GPU 跑扩散模型的量化选型。
来源:Hugging Face Blog · huggingface.co