Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
Hugging Face Blog2629 字 (约 11 分钟)
85
Hugging Face 将 Nunchaku 4-bit 量化技术集成到 Diffusers,实现低内存高效率的扩散模型推理。
入选理由:Nunchaku Lite 支持 4-bit 权重和激活量化,内存需求降低至 20-30GB 的 1/10
精选文章#Diffusers#量化#Hugging Face#Nunchaku#AI推理英文