跳到正文
原文
AGI Hunt· Sauers_·· 5 小时前AI 评分34

在已后训练模型上再训练会「炸坏」模型:能力退化与 reality drift

AI 导读

一条被引用的讨论指出,在已后训练(post-trained)模型上继续训练这条常见捷径往往会「炸坏」模型:出现能力退化、模型偏好变得不稳定,并引发 reality drift——模型开始分不清什么是真实的、什么是虚构的。转发者感叹「我们正处在一个迷人的时间线」。

来源:AGI Hunt · agihunt.info