热点事件持续更新
Cisco 实测决策模型安全分类对比
1 篇报道1 个报道来源7 小时前更新
先了解这件事
AI 综述
2026 年 10 月,Cisco 在官方博客发布内容安全对比实验,在 24 个伤害类别、6 个数据集上,比较决策模型、策略训练分类器与 LLM-as-judge 三类方案。参与测试的模型为 ConvAI Innovations 开源权重的 Laya 和 TypeSafe 托管的 Jev。报道称,二者直接输出概率或分数而非自由文本,规避了格式漂移与误报预算调节难题,在零样本安全分类上逼平 31B LLM 裁判。目前公开信息仅来自 Cisco 官方博客与 AGI Hunt 的转述,尚无第三方复现或更多评测细节披露。
AI 根据报道生成 · 2 小时前更新
最新进展10月6日 10:34
Cisco 博客公布 24 类、6 数据集对比实验,Laya 与 Jev 零样本分类逼平 31B LLM 裁判。报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- AGI HuntCisco 实测决策模型:零样本安全分类逼平 31B LLM 裁判
Cisco 在官方博客发布内容安全对比实验,在 24 个伤害类别、6 个数据集上比较决策模型、策略训练分类器与 LLM-as-judge。测试模型为 ConvAI Innovations 开源权重的 Laya 和 TypeSafe 托管的 Jev,二者直接输出概率或分数而非自由文本,规避了格式漂移与误报预算调节难题。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。