Hugging Face Blog·· 2026-07-23精选AI 评分78
Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理
Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
AI 导读
Nunchaku 4-bit 扩散模型推理引擎现已原生集成到 Diffusers,支持通过 from_pretrained() 直接加载预量化模型,无需本地 CUDA 编译。
推荐理由
原文给出了 Nunchaku Lite 的性能数据、实现方式和可用入口,读者可以据此判断这个量化推理方案是否适合自己的场景。
来源:Hugging Face Blog · huggingface.co
最近 7 天的更新
- OpenAI 一次发布 372 项数学证明,包括唯一游戏猜想Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览,权重将于月底开源Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型Mistral AI·
- Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理Mistral AI·
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语Hacker News · 首页·
- Singularity:原子化 ticket 驱动的 AI 编码工具Product Hunt · AI 分类·
- eu/jev 发布欧盟版 System One 模型Product Hunt · AI 分类·
- Allen AI 开源 AstaBrief 8B 科学报告生成模型Hugging Face Blog·
相关工具
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语82
- Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next81
- Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB80
- Hugging Face $399 双足机器人 Microduck 开放预购,首日订单达 260 万美元79
- H company 发布 Holo4:通用计算机使用智能体模型系列78
- 如何使用 GRPO 微调 LFM2.5-350M 提升结构化输出能力77
- Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核支持本地 AI 推理74
- Hugging Face 发布 Open TTS Leaderboard:开源多语言 TTS 与语音克隆的可扩展评估70