跳到正文
原文
AGI Hunt· eliebakouch·· 5 小时前AI 评分34

让 LLM 比"谁玩得最开心":新模型反而更不好玩,Opus 4.6 夺冠

AI 导读

David Holz 让多个 LLM"找乐子"并互相评分谁最开心,结果显示越新的模型似乎越不有趣,Opus 4.6 反复胜出。多数模型玩的是文字游戏,Opus 4.6 则想象出"住在下落水滴里的、由矛盾构成的短暂世界"。Mistral 的 eliebakouch 回复称这超酷。

来源:AGI Hunt · agihunt.info