热点事件持续更新
7900XTX 本地跑通Qwen3.8-Flash-Next 50万上下文
1 篇报道1 个报道来源1 小时前更新
先了解这件事
AI 综述
2026年10月12日,Reddit r/LocalLLaMA 用户发布实测,在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next 模型。该模型总参数176B,每token激活约6B。作者测试显示,在长达约506,849 token(50万级)的上下文长度下,模型可稳定承载,未出现截断。解码速度方面,4k至256k上下文区间内,吞吐维持在105–160 tok/s,跨上下文长度增大时性能下降约18%。报道中只给出了本次实测数据,未披露更早版本或其他来源的相关记录。
AI 根据报道生成 · 57 分钟前更新
最新进展10月12日 05:44
实测在50万token上下文下保持稳定,解码105–160 tok/s。报道时间线
沿着报道,了解事件的不同侧面。
10月12日
- Reddit · r/LocalLLaMA在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next 实测:500k 上下文与 105–160 tok/s 解码
作者在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next(176B 总参数、每 token 激活 6B),实测在 500k 上下文下可稳定承载约 506,849 token,未发生截断;解码速度达 105–160 tok/s,跨 4k 到 256k 时下降约 18%。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。