Hugging Face Blog·· 2026-09-01精选AI 评分74
Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核支持本地 AI 推理
Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AI
AI 导读
Hugging Face 发布 WebGPU 内核库 @hugglingface/kernels,包含 207 个优化内核,可从 Hub 直接加载运行。性能对比测试显示,与 ORT WebGPU 相比,新内核在 Apple M4 GPU 上实现几何平均 2.57 倍提速、中位数 1.90 倍提速,部分操作如 bilinear Einsum 提速超过 10000 倍。
推荐理由
原文给出了 207 个内核的性能对比数据(2.57x 几何平均提速),读者可以据此判断这个底层工具对自己浏览器端 AI 推理工作流的价值。
来源:Hugging Face Blog · huggingface.co
最近 7 天的更新
- Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理Mistral AI·
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语Hacker News · 首页·
- Singularity:原子化 ticket 驱动的 AI 编码工具Product Hunt · AI 分类·
- eu/jev 发布欧盟版 System One 模型Product Hunt · AI 分类·
- Allen AI 开源 AstaBrief 8B 科学报告生成模型Hugging Face Blog·
- Audionaut 发布:开源多轨音频编辑器,支持 MCP 可被 AI 代理驱动Hacker News · 首页·
- Microsoft AI 发布用于语音智能体的转录和文本转语音模型The Decoder·
- Audryo:面向 AI 智能体的邮件生命周期工具Product Hunt · AI 分类·
相关工具
- Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next81
- Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB80
- Hugging Face $399 双足机器人 Microduck 开放预购,首日订单达 260 万美元79
- H company 发布 Holo4:通用计算机使用智能体模型系列78
- Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理78
- 如何使用 GRPO 微调 LFM2.5-350M 提升结构化输出能力77
- Hugging Face 发布 Open TTS Leaderboard:开源多语言 TTS 与语音克隆的可扩展评估70
- Hugging Face 开源 Grabette:手持式机器人操作数据采集系统70