Reddit · r/LocalLLaMA· /u/thatscoolbutno123·· 3 小时前AI 评分6
讨论在 Hermes Agent 上搭配 Qwen3.8-Flash-Next 与 MiniCPM5 的本地推理配置
Best small model + setup together with qwen3.8-flash-next
AI 导读
用户在 r/LocalLLaMA 询问在 Hermes Agent 上跑小型执行模型的最佳配置,硬件为 64GB RAM + 32GB R9700 + 16GB RX 7800XT。候选方案包括 R9700 上跑 Qwen Flash-Next、RX 7800XT 上跑 MiniCPM5-2B,或反向分配后搭配 Qwen3.8 27B 的 q3/q4 量化版本运行多个并行会话。
来源:Reddit · r/LocalLLaMA · reddit.com