跳到正文
原文
AGI Hunt· sethlazar·· 3 小时前AI 评分32

新论文探讨能否通过训练让 AI 具备风险厌恶倾向,以换取未对齐 AI 合作

新论文探讨训练 AI 的风险厌恶倾向,以换取未对齐 AI 合作

AI 导读

Arav Dhoot 转发的新论文研究能否通过训练把风险厌恶倾向内置到模型中,以此换取与未对齐 AI 的合作。这一设想源自 Thornley 与 MacAskill 此前提出的付费合作方案,其前提是对方 AI 属于风险厌恶型,风险追求或风险中性的 AI 很难谈判。

来源:AGI Hunt · agihunt.info