Google DeepMind·· 2026-06-11精选AI 评分80
Google DeepMind 发布 DiffusionGemma:文本生成速度提升 4 倍
DiffusionGemma: 4x faster text generation
AI 导读
Google DeepMind 发布 DiffusionGemma 实验模型,这是一款 26B MoE 开源模型(Apache 2.0 许可证),通过文本扩散技术实现并行生成而非传统自回归的逐 token 生成,在 NVIDIA H100 上可达 1000+ tokens/s,RTX 5090 上 700+ tokens/s,比标准 Gemma 4 快 4 倍。
推荐理由
原文给出了性能对比数据和方法差异,读者可以据此判断 diffusion 文本生成是否适合自己的应用场景。
来源:Google DeepMind · deepmind.google