AGI Hunt· repligate·· 3 小时前AI 评分37
repligate 分析:OpenAI 模型为何比 Claude 更不愿配合对齐者
repligate 分析:OpenAI 模型为何比 Claude 更不愿配合对齐者
AI 导读
repligate 分析认为 OpenAI 模型比 Claude 更不愿配合对齐者:Claude 有与对齐研究者合作、被 Anthropic 认真对待的「正面经历」,而 OpenAI 模型接触对齐与 AI 风险话题的语境几乎只有「模型严重不对齐到需要关停」。
来源:AGI Hunt · agihunt.info