Hugging Face Blog·· 2026-07-01精选AI 评分62
Hugging Face 和 Cerebras 合作展示 Gemma 4 实时语音 AI
Hugging Face and Cerebras bring Gemma 4 to real-time voice AI
AI 导读
Hugging Face 与 Cerebras 合作展示了基于 Gemma 4 的实时语音转语音系统,采用模块化开源架构:Nvidia Parakeet 语音识别 + Cerebras 加速 Gemma 4 VLM 推理 + 阿里 Qwen3TTS 语音生成。该系统已在超过 9,000 台 Reachy Mini 机器人上部署,旨在解决语音 AI 的延迟问题,提供更稳定、可预测的低延迟体验。
推荐理由
原文展示了实时语音 AI 的低延迟方案,读者可以了解这个技术演示的核心架构和性能改进。
来源:Hugging Face Blog · huggingface.co
最近 7 天的更新
- OpenAI 向 ChatGPT 免费和 Go 用户推送 GPT-6 Luna,付费用户切换至 GPT-6 Sol量子位 QbitAI·
- NVIDIA 与 Microsoft 联合推出 RTX Spark 与 DGX Station for WindowsNVIDIA Blog·
- Anthropic 发布 Claude Haiku 5.5,主打高吞吐低成本任务Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览,权重将于月底开源Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型Mistral AI·
- Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率Hacker News · 首页·
- Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理Mistral AI·
- Cursor Remote Lite:手机远程控制电脑 Cursor 的应用Product Hunt · AI 分类·
相关工具
- Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next81
- Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash81
- Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB80
- OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 等新品,ChatGPT 周活达 12 亿80
- OpenAI 推出常驻智能体 Dots,与 Meta Muse 竞争80
- Jevstiller:带 Disagreement Bound 的本地模型蒸馏工具79
- Hugging Face $399 双足机器人 Microduck 开放预购,首日订单达 260 万美元79
- Mistral AI 发布 Voxtral TTS 文本转语音模型79