NVIDIA Blog· Zhihan Jiang·· 22 天前精选AI 评分67
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次亮相中实现领先性能
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA Vera Rubin NVL72 系统首次提交 MLPerf Inference v6.1 预览测试,在 Qwen3-VL 基准上提供高达 3.7 倍于 GB300 NVL72 的吞吐量,在 DeepSeek-R1 上达到 2.5 倍。GB300 NVL72 在 288-GPU 四机架扩展测试中实现 99% 扩展效率,软件优化相比 v6.0 提升高达 1.6 倍性能。
推荐理由
给出了具体的性能倍数和扩展效率数据,读者可以据此评估新硬件对推理工作负载的实际价值。
来源:NVIDIA Blog · blogs.nvidia.com
最近 7 天的更新
- OpenAI 一次发布 372 项数学证明,包括唯一游戏猜想Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览,权重将于月底开源Hacker News · 首页·
- Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型Mistral AI·
- Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语Hacker News · 首页·
- Singularity:原子化 ticket 驱动的 AI 编码工具Product Hunt · AI 分类·
- eu/jev 发布欧盟版 System One 模型Product Hunt · AI 分类·
- Allen AI 开源 AstaBrief 8B 科学报告生成模型Hugging Face Blog·
- Audionaut 发布:开源多轨音频编辑器,支持 MCP 可被 AI 代理驱动Hacker News · 首页·