Reddit · r/artificial· /u/NakedPlato·· 4 天前AI 评分25
MoralityBench.ai:AI 道德评测基准
MoralityBench.ai: Morality Leaderboard for AI
AI 导读
MoralityBench.ai 是一个基于道德心理学测试的 AI 基准评测。评测结果显示,除 Jev 外,各模型在不同运行中的答案存在显著差异,表明道德推理并非确定性输出。该基准旨在评估大语言模型的道德判断能力。
来源:Reddit · r/artificial · reddit.com