跳到正文
原文
Reddit · r/LocalLLaMA· /u/human_in_the_looop·· 2 小时前AI 评分34

在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next 实测:500k 上下文与 105–160 tok/s 解码

I ran Qwen 3.8 Flash-Next on my AMD 7900 XTX at 500k context. All local and what a shift it has been.

AI 导读

作者在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next(176B 总参数、每 token 激活 6B),实测在 500k 上下文下可稳定承载约 506,849 token,未发生截断;解码速度达 105–160 tok/s,跨 4k 到 256k 时下降约 18%。

来源:Reddit · r/LocalLLaMA · reddit.com