跳到正文
原文
AGI Hunt· DonkeyTheKing·· 3 小时前AI 评分48

编译器驱动的 AI 编码 agent Benzi:声称胜过 Claude Code,SWE-bench 78.2%、单次修复不到 1 毛钱

编译器驱动的 Benzi 声称胜过 Claude Code:SWE-bench 78.2%、每修复不到 1 毛钱

AI 导读

开发者发布编译器驱动的 AI 编码 agent Benzi,声称 SWE-bench Verified 达 78.2%、单次修复成本不到 10 美分。它不读源码,靠工具调用让编译器直接告知改动影响范围并做静态检查;同样任务只读 9,125 行代码,Claude Code Sonnet 为 20,704 行、DeepSeek harness 为 43,598 行。

来源:AGI Hunt · agihunt.info