Reddit · r/LocalLLaMA· /u/chibop1·· 4 小时前AI 评分25
用户在 M3 Max 64GB Mac 上用 oMLX 成功运行 Qwen3.8-Flash-Next-oQ4e-mtp
OMG! If you have a Mac with 64GB, try Qwen3.8-Flash-Next-oQ4e-mtp with oMLX!
AI 导读
一名用户反馈,在搭载 64GB 内存的 M3 Max Mac 上通过 oMLX 成功运行了 Qwen3.8-Flash-Next-oQ4e-mtp,用 58GB GPU 内存加载一个 100GB 模型,并实现了最高 130k 上下文窗口。短会话测试显示 Prompt Processing 速度 140.0 tok/s、Token Generation 15.8 tok/s,缓存命中率 90.9%。
来源:Reddit · r/LocalLLaMA · reddit.com