跳到正文
热点事件持续更新

SCOUT:计算机使用Agent安全验证框架

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年9月30日,arXiv cs.CL 刊出论文,提出 SCOUT 框架,用于验证计算机使用智能体(computer-use agent)的安全性。据该报道,SCOUT 以两阶段方式融合推理与工具使用:先进行评分规则生成,再借助工具取证完成安全验证。在 AutoElicit-Bench 基准上,SCOUT 取得 75.4 的 unsafe F1 与 74.5 的 completion F1。目前公开信息仅此一篇论文,尚无后续复现、第三方评测或落地应用的报道。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.CL
    SCOUT:融合推理与工具使用,实现计算机使用安全验证

    SCOUT 以两阶段方式融合评分规则生成与工具取证来验证计算机使用智能体的安全性,在 AutoElicit-Bench 上取得 75.4 unsafe F1 和 74.5 completion F1。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。