跳到正文
原文
Reddit · r/LocalLLaMA· /u/klieret·· 6 天前AI 评分49

SWE-sweep:Meta 等推出新 benchmark,测试大语言模型主动发现并修复 bug 能力

New benchmark on LMs fixing bugs before users run into them

AI 导读

Meta、Stanford、Harvard、UW 研究人员推出 SWE-sweep benchmark,测试大语言模型在用户遇到 bug 前主动发现并修复 bug 的能力,bugs 均为来自真实代码库的可发现可修复问题。

来源:Reddit · r/LocalLLaMA · reddit.com