热点事件持续更新
AA 发布 CyberGym-E2E-AA 网络安全基准
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026 年 10 月 1 日,AGI Hunt 报道 Artificial Analysis 发布了防御性网络安全基准 CyberGym-E2E-AA 的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型以三步通关方式完成真实开源漏洞的修复。报道称,分析揭示出一个核心矛盾:模型的安全护栏会拦截约 85% 的任务,同时很难做到只限制攻击性用途而不阻断防御性用途。这是目前关于该基准的最新公开信息,报道未提及更早的发布时间或其他版本数据。
AI 根据报道生成 · 1 小时前更新
最新进展10月1日 09:09
Artificial Analysis 公布 CyberGym-E2E-AA 结果:安全护栏拦截约 85% 防御性任务。报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- AGI HuntArtificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA
Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型以三步通关完成真实开源漏洞修复。分析揭示核心矛盾:模型安全护栏拦截约 85% 任务的同时,很难做到只限制攻击性用途而不阻断防御性用途。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。