跳到正文
热点事件持续更新

DGX Spark集群启动Qwen3.8-Flash MTP模型遇stall

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

用户在由两张 DGX Spark 组成的集群上部署 `deepseek-flash` 成功后,尝试使用 llama.cpp 的 `./llama-server` 启动 Unsloth 发布的 `Qwen3.8-Flash-Next-GGUF:Q8_0` 多 token 预测(MTP)版本,期间遇到 DGX stall,流程被迫中断。这是目前已知的最新也是唯一一篇相关报道,问题原因与后续解决方案尚未在公开报道中提及。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. Reddit · r/LocalLLaMA
    求助:在 2 x DGX Spark 集群上用 llama-server 启动 Unsloth Qwen3.8-Flash-Next MTP GGUF 时遇到 stall

    用户在 2 张 DGX Spark 组成的集群上部署 `deepseek-flash` 成功后,尝试用 llama.cpp 的 `./llama-server` 启动 Unsloth 发布的 `Qwen3.8-Flash-Next-GGUF:Q8_0` 多 token 预测(MTP)版本时遭遇 DGX stall。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。