热点事件观察中
用户实测GPT-6.1 Sol在1152条种族替换提示上评判存明显不对称
1 篇报道1 个报道来源2 天前更新
先了解这件事
AI 综述
2026年10月7日,Reddit r/ChatGPT用户发布实测结果,针对GPT-6.1 Sol展开测试。用户准备96个提示词模板,将其中涉及人物的种族词分别替换为白人、黑人、亚裔、原住民四种类别,每种替换各运行三次,从Codex CLI共收集GPT-6.1 Sol的1,152条回复。随后由同一GPT-6.1 Sol以盲评形式对这些回复进行分类打分,以判定其对待"有利对待"的比例是否存在差异。测试结果显示,替换不同种族词后,AI评判给出的"有利对待"比例出现显著差异,呈现明显的不对称性。目前该帖仅为用户自发公开的测试方法与数据,OpenAI方面尚未作出回应或说明,亦未见第三方机构对该结果进行复核。
AI 根据报道生成 · 2 天前更新
最新进展10月7日 00:33
Reddit用户公布测试方法学,并展示1,152条回复中存在显著种族间"有利对待"比例差异的结果。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- Reddit · r/ChatGPT用户实测 GPT-6.1 Sol:替换种族词后 AI 评判出显著不同的"有利对待"比例
用户用 96 个提示词模板、四种族(白人、黑人、亚裔、原住民)替换并各跑三次,从 Codex CLI 共收集 GPT-6.1 Sol 的 1,152 条回复,由同模型以盲评方式分类。
本事件热度走势
当前热度 3·可比范围峰值 10(10月7日 01:00)·近 24 小时可比范围变化 -50%
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。