跳到正文
原文
Reddit · r/LocalLLaMA· /u/ciprianveg·· 4 天前AI 评分23

从单张 3090 到 20 节点 DGX Spark:我的本地大模型推理集群升级之路

From 1x3090 to 20 DGX Sparks: my house fuses were the first bottleneck

AI 导读

一位工程师分享了他从单张 RTX 3090 逐步搭建本地大模型推理集群的过程,历经 16x3090、4x/8x ASUS GB10,最终扩展到 20 节点 NVIDIA DGX Spark,可本地运行 Kimi K3(2.8T)等顶级开源模型。通过优化在 300k 上下文下达到 20 t/s,从未订阅商业 API。

来源:Reddit · r/LocalLLaMA · reddit.com