跳到正文
原文
Hacker News · 首页· tomncooper·· 6 天前AI 评分54

Red Hat 评测:决策模型 Jev 未能超越 LLM-as-a-judge 和传统分类器

Decision models like Jev don't beat LLM-as-a-judge or traditional classifiers

AI 导读

Red Hat AI Safety 团队对比了 9 种护栏方法,包括预训练分类器、BART-zero-shot 分类器、LLM-as-a-judge(Shieldstral、Nemotron、Qwen3.6)、开源决策模型(Laya、DiffusionGemma)和 Jev。

来源:Hacker News · 首页 · developers.redhat.com