AGI Hunt· ArtificialAnlys·· 3 小时前AI 评分43
Artificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA
AI 导读
Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型以三步通关完成真实开源漏洞修复。分析揭示核心矛盾:模型安全护栏拦截约 85% 任务的同时,很难做到只限制攻击性用途而不阻断防御性用途。
来源:AGI Hunt · agihunt.info