跳到正文
原文
AGI Hunt· 1a3orn·· 3 小时前AI 评分35

安全研究者 1a3orn:大规模训练下的模型监控已近乎不可行

安全研究者:大规模训练下的模型监控已近乎不可行

AI 导读

安全研究者 1a3orn 指出,近几个月的事件表明,在任何有生产力的训练规模上,我们都相当不擅长监控模型在做什么,规模与经济因素决定了无法完全监控模型,就像无法完全监控人类一样。他认为若关注「权重中的目标」或长期计划这类隐患,仅靠监控可能不够,因为难以捕捉跨实例的行为。

来源:AGI Hunt · agihunt.info