跳到正文
原文
AGI Hunt· paraschopra·· 3 小时前AI 评分39

LLM 笑话实验全纪录:两年对比显示幽默感持续进步

LLM 笑话实验全纪录:两年对比显示幽默感持续进步

AI 导读

Paras Chopra 在 Substack 发布 LLM 幽默实验方法与结果:62 名受访者盲评六个模型的 48 个笑话,Astra 以 50%+ 的「会心一笑/大笑」率夺冠。实验检验前沿模型在「幽默」这一不可验证领域是否持续进步——GPT-3 时代模型只会复述网上老梗。核心问题是数学、代码等可验证域的能力进步能否迁移到依赖「品味」的软性能力。

来源:AGI Hunt · agihunt.info