跳到正文
热点事件观察中

用户实测GPT-6.1 Sol在1152条种族替换提示上评判存明显不对称

1 篇报道1 个报道来源2 天前更新

先了解这件事

AI 综述

2026年10月7日,Reddit r/ChatGPT用户发布实测结果,针对GPT-6.1 Sol展开测试。用户准备96个提示词模板,将其中涉及人物的种族词分别替换为白人、黑人、亚裔、原住民四种类别,每种替换各运行三次,从Codex CLI共收集GPT-6.1 Sol的1,152条回复。随后由同一GPT-6.1 Sol以盲评形式对这些回复进行分类打分,以判定其对待"有利对待"的比例是否存在差异。测试结果显示,替换不同种族词后,AI评判给出的"有利对待"比例出现显著差异,呈现明显的不对称性。目前该帖仅为用户自发公开的测试方法与数据,OpenAI方面尚未作出回应或说明,亦未见第三方机构对该结果进行复核。

AI 根据报道生成 · 2 天前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Reddit · r/ChatGPT
    用户实测 GPT-6.1 Sol:替换种族词后 AI 评判出显著不同的"有利对待"比例

    用户用 96 个提示词模板、四种族(白人、黑人、亚裔、原住民)替换并各跑三次,从 Codex CLI 共收集 GPT-6.1 Sol 的 1,152 条回复,由同模型以盲评方式分类。

本事件热度走势

当前热度 3·可比范围峰值 10(10月7日 01:00)·近 24 小时可比范围变化 -50%

02.557.51010月7日01:0010月7日13:0010月8日02:0010月8日14:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。