Reddit · r/LocalLLaMA· /u/klieret·· 6 天前AI 评分49
SWE-sweep:Meta 等推出新 benchmark,测试大语言模型主动发现并修复 bug 能力
New benchmark on LMs fixing bugs before users run into them
AI 导读
Meta、Stanford、Harvard、UW 研究人员推出 SWE-sweep benchmark,测试大语言模型在用户遇到 bug 前主动发现并修复 bug 的能力,bugs 均为来自真实代码库的可发现可修复问题。
来源:Reddit · r/LocalLLaMA · reddit.com