跳到正文
热点事件持续更新

7900XTX 本地跑通Qwen3.8-Flash-Next 50万上下文

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月12日,Reddit r/LocalLLaMA 用户发布实测,在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next 模型。该模型总参数176B,每token激活约6B。作者测试显示,在长达约506,849 token(50万级)的上下文长度下,模型可稳定承载,未出现截断。解码速度方面,4k至256k上下文区间内,吞吐维持在105–160 tok/s,跨上下文长度增大时性能下降约18%。报道中只给出了本次实测数据,未披露更早版本或其他来源的相关记录。

AI 根据报道生成 · 57 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月12日
  1. Reddit · r/LocalLLaMA
    在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next 实测:500k 上下文与 105–160 tok/s 解码

    作者在 AMD 7900 XTX 上本地运行 Qwen3.8-Flash-Next(176B 总参数、每 token 激活 6B),实测在 500k 上下文下可稳定承载约 506,849 token,未发生截断;解码速度达 105–160 tok/s,跨 4k 到 256k 时下降约 18%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。