跳到正文
原文
Reddit · r/LocalLLaMA· /u/Loginhe·· 9 天前AI 评分72

Qwen3.8-Flash-Next 发布 GSQ/RCO 量化 GGUF 模型,同时推出 50% 专家剪枝的 Coder 版本

[Release] GSQ-RCO GGUFs for Qwen3.8-Flash-Next, plus a 50% expert-pruned Coder build at ~1.89 bpw

AI 导读

ISTAQwen3.8-Flash-Next 量化模型发布,这是稀疏 MoE 模型(512 路由专家/层,176.9B 参数)。提供 4 个 GGUF 量化版本(2.40-3.50 bpw),以及通过 RCO 剪枝 50% 专家的 Coder 版本。

来源:Reddit · r/LocalLLaMA · reddit.com