跳到正文
热点事件持续更新

RTX PRO 6000 运行 Qwen3.8 Flash Next 基准测试

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月10日,Reddit r/LocalLLaMA 用户发布测试结果:在 96GB 显存的 RTX PRO 6000 上,使用 Strata 后端运行 Unsloth 提供的 Qwen3-Flash-Next UD-Q4_K_XL 量化模型,并启用 INT8 KV cache。该测试跑出最高 320 tokens/s 的速度。该结果由用户实测得出,目前事件尚无后续更新。

AI 根据报道生成 · 59 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月10日
  1. Reddit · r/LocalLLaMA
    Qwen3.8 Flash Next UD-Q4_K_XL 在 RTX PRO 6000 上通过 Strata 后端跑出最高 320 tokens/s

    用户在 RTX PRO 6000(96GB)上以 Strata 后端运行 Unsloth 的 Qwen3.8-Flash-Next UD-Q4_K_XL,启用 INT8 KV cache。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。