Reddit · r/LocalLLaMA· /u/Loginhe·· 9 天前AI 评分72
Qwen3.8-Flash-Next 发布 GSQ/RCO 量化 GGUF 模型,同时推出 50% 专家剪枝的 Coder 版本
[Release] GSQ-RCO GGUFs for Qwen3.8-Flash-Next, plus a 50% expert-pruned Coder build at ~1.89 bpw
AI 导读
ISTAQwen3.8-Flash-Next 量化模型发布,这是稀疏 MoE 模型(512 路由专家/层,176.9B 参数)。提供 4 个 GGUF 量化版本(2.40-3.50 bpw),以及通过 RCO 剪枝 50% 专家的 Coder 版本。
来源:Reddit · r/LocalLLaMA · reddit.com