跳到正文
原文
Reddit · r/LocalLLaMA· /u/SnooPredictions515·· 6 天前精选AI 评分81

Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next

Running 95.5 GiB Qwen3.8-Flash-Next at 41–52 tok/s on a 64GB Mac (1.76x faster than llama.cpp): Slipstream release, 130k context scaling, + Swift variant

AI 导读

开发者发布 Slipstream 引擎,可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next 模型,比 llama.cpp 快 1.76 倍。

推荐理由

原文给出了新推理引擎的具体性能数据、架构设计和与 llama.cpp 的对比,读者可以据此判断它在本地运行大模型场景下的实际价值。

来源:Reddit · r/LocalLLaMA · reddit.com