跳到正文
热点事件持续更新

SafeCoEvo:智能体测试时安全协同演化框架

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年9月30日,arXiv cs.AI 发布 SafeCoEvo,一个面向 LLM 智能体的测试时 Harness-Guard 协同演化框架,目标是让外部安全系统持续从累积的运行时经验中自适应。该框架由两部分组成:S-Harness 将近期运行时经验外化为可更新的显式安全知识,以快速影响后续任务;GuardVPO 则在更长时间尺度上把安全经验内化为参数化风险判断能力。报道称,相比最强 baseline,SafeCoEvo 使不安全结果率降低 10.05%,任务成功率提升 12.15%。目前公开信息仅此一篇,尚无后续进展或第三方复现报道。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.AI
    SafeCoEvo:面向 LLM 智能体的测试时安全 Harness 与 Guard 协同演化框架

    SafeCoEvo 是一个面向 LLM 智能体的测试时 Harness-Guard 协同演化框架,让外部安全系统持续从累积的运行时经验中自适应。其中 S-Harness 将近期运行时经验外化为可更新的显式安全知识以快速影响后续任务,GuardVPO 则在更长时间尺度上把安全经验内化为参数化风险判断能力。相比最强 baseline,其不安全结果率降低 10.05%,任务成功率提升 12.15%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。