跳到正文
原文
AGI Hunt· gerardsans·· 4 小时前AI 评分33

Gerard Sans 批评对齐形同「安全洗白」,称 AI 实验室未真正关心安全

研究者称对齐形同「安全洗白」, Labs 未真正关心安全

AI 导读

ML 研究者 Gerard Sans 批评 AI 实验室把对齐做成「安全洗白」,只是给实验室一条表面重视安全的出路。他表示实验室若真正解释技术原理与局限性,产品就会失去商业吸引力,而系统可靠实际需要 harness、上百次迭代和层层校验。由此用户困惑于指令被忽略、模型跑偏,他称「你只能骗人一时」。

来源:AGI Hunt · agihunt.info