跳到正文
原文
AGI Hunt· brandon_xyzw·· 7 小时前AI 评分33

语料重复千遍「狗不能吃巧克力」,模型照答被封神

AI 导读

作者演示反直觉实验:在语料中把「狗不能吃巧克力」重复一千遍,再问模型「狗能吃巧克力吗」,模型直接答「狗不能吃巧克力」,用户惊呼「这是上帝吗?」。该实验以夸张方式展示了训练数据重复与记忆对模型输出的影响。

来源:AGI Hunt · agihunt.info