跳到正文
原文
AGI Hunt· zeeshanp_·· 8 小时前AI 评分24

Stanford HAI 质疑基准分数:LLM 多语言安全研究将亮相 COLM 2026

Stanford HAI 质疑基准分数:LLM 多语言安全研究将亮相 COLM 2026

AI 导读

多语言 LLM 安全论文将亮相 COLM 2026,作者预告时间为周三 11 点、Franciscan C 展位 #99。该论文由作者与合作者共同一作,方法基于 multi-group IRT(多组项目反应理论)。Stanford HAI 近期报道的两项研究指出,基准分数影响 AI 模型的融资、采购与监管,并追问测试是否真能度量其声称的能力。

来源:AGI Hunt · agihunt.info