跳到正文
原文
Reddit · r/LocalLLaMA· /u/Altruistic_Heat_9531·· 5 小时前AI 评分13

本地 LLM 用户盲测:8 人体验 Qwen 3.5/3.6 与 Gemma 多档模型,多数以为是 GPT-5.5

2 months (meme-d) research, Do People Notice the Difference Between AI Models?

AI 导读

一名用户在 RTX 3090 上用 vLLM 部署了 Qwen 3.6 27B、Qwen 3.6 35B-A3B、Gemma 26B-A4B、Qwen 3.5 9B、Gemma 12B、E4B、E2B 等本地模型,让 13 名参与者通过 OpenWebUI 界面盲用约两个月共 7,912 次请求。

来源:Reddit · r/LocalLLaMA · reddit.com