Hugging Face Blog·· 2026-08-21精选AI 评分65
Liquid AI 发布 LFM2.5-DSpark 草稿模型,最高实现 3.2 倍推理加速
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 发布 LFM2.5 系列的 DSpark 草稿模型检查点,包括 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三款。
推荐理由
给出了在 H100 和 MacBook M4 Max 上的具体加速数字,以及 llama.cpp 和 SGLang 的集成方式,读者可以据此判断迁移成本和预期收益。
来源:Hugging Face Blog · huggingface.co
最近 7 天的更新
- OpenAI 一次发布 372 项数学证明,包括唯一游戏猜想Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览,权重将于月底开源Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型Mistral AI·
- Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理Mistral AI·
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语Hacker News · 首页·
- Singularity:原子化 ticket 驱动的 AI 编码工具Product Hunt · AI 分类·
- eu/jev 发布欧盟版 System One 模型Product Hunt · AI 分类·
- Allen AI 开源 AstaBrief 8B 科学报告生成模型Hugging Face Blog·
相关工具
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语82
- Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next81
- Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB80
- Hugging Face $399 双足机器人 Microduck 开放预购,首日订单达 260 万美元79
- Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理78
- 如何使用 GRPO 微调 LFM2.5-350M 提升结构化输出能力77
- Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核支持本地 AI 推理74
- Hugging Face 发布 Open TTS Leaderboard:开源多语言 TTS 与语音克隆的可扩展评估70