跳到正文
原文
AGI Hunt· paraschopra·· 3 小时前AI 评分38

62人盲测48个LLM笑话 大模型幽默感持续进步

AI 导读

Paras Chopra 发布实验,62 名受访者对来自六个模型的 48 个笑话盲测评分,结果显示前沿大模型的幽默感确实在进步,与 GPT-3 时代只会复述网上老梗形成对比。完整方法与结果已在 Substack 公开,两年对比进一步表明大模型在「幽默」这类不可验证领域的能力持续提升。

来源:AGI Hunt · agihunt.info