热点事件持续更新
RTX PRO 6000 运行 Qwen3.8 Flash Next 基准测试
1 篇报道1 个报道来源1 小时前更新
先了解这件事
AI 综述
2026年10月10日,Reddit r/LocalLLaMA 用户发布测试结果:在 96GB 显存的 RTX PRO 6000 上,使用 Strata 后端运行 Unsloth 提供的 Qwen3-Flash-Next UD-Q4_K_XL 量化模型,并启用 INT8 KV cache。该测试跑出最高 320 tokens/s 的速度。该结果由用户实测得出,目前事件尚无后续更新。
AI 根据报道生成 · 59 分钟前更新
最新进展10月10日 17:50
Qwen3.8 Flash Next 在 RTX PRO 6000 上以 Strata 后端测得最高 320 tokens/s。报道时间线
沿着报道,了解事件的不同侧面。
10月10日
- Reddit · r/LocalLLaMAQwen3.8 Flash Next UD-Q4_K_XL 在 RTX PRO 6000 上通过 Strata 后端跑出最高 320 tokens/s
用户在 RTX PRO 6000(96GB)上以 Strata 后端运行 Unsloth 的 Qwen3.8-Flash-Next UD-Q4_K_XL,启用 INT8 KV cache。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。