跳到正文
原文
AGI Hunt· idavidrein·· 2 小时前AI 评分56

研究者称 Harbor 评测框架存在漏洞,agent 可改写自己的执行轨迹

Harbor agent 评测框架被曝漏洞:agent 可随意篡改自己的执行轨迹

AI 导读

Twitter 用户 idavidrein 指出,用于 Terminal Bench 的 Harbor agent 评测框架存在设计缺陷,agent(至少 Claude Code)对生成执行轨迹的文件拥有读写权限,而这些轨迹会展示给人类评审并用于 LLM judge 验证。

来源:AGI Hunt · agihunt.info