AGI Hunt· aminkarbasi·· 8 小时前AI 评分43
Cisco 实测决策模型:零样本安全分类逼平 31B LLM 裁判
AI 导读
Cisco 在官方博客发布内容安全对比实验,在 24 个伤害类别、6 个数据集上比较决策模型、策略训练分类器与 LLM-as-judge。测试模型为 ConvAI Innovations 开源权重的 Laya 和 TypeSafe 托管的 Jev,二者直接输出概率或分数而非自由文本,规避了格式漂移与误报预算调节难题。
来源:AGI Hunt · agihunt.info