跳到正文
热点事件持续更新

AA 发布 CyberGym-E2E-AA 网络安全基准

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月 1 日,AGI Hunt 报道 Artificial Analysis 发布了防御性网络安全基准 CyberGym-E2E-AA 的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型以三步通关方式完成真实开源漏洞的修复。报道称,分析揭示出一个核心矛盾:模型的安全护栏会拦截约 85% 的任务,同时很难做到只限制攻击性用途而不阻断防御性用途。这是目前关于该基准的最新公开信息,报道未提及更早的发布时间或其他版本数据。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. AGI Hunt
    Artificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA

    Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型以三步通关完成真实开源漏洞修复。分析揭示核心矛盾:模型安全护栏拦截约 85% 任务的同时,很难做到只限制攻击性用途而不阻断防御性用途。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。