跳到正文
原文
AGI Hunt· ramendik·· 12 小时前AI 评分38

实测 GLM 5.3 Flash 与腾讯 Hy3:谄媚度最低的两款模型对决

AI 导读

实测模型谄媚倾向后,GLM 5.3 Flash 与腾讯 Hy3 成为两个明显赢家,前者在烟雾测试中甚至比完整版 GLM 5.3 更不谄媚。Hy3 更紧凑但易丢细节(加搜索后改善),GLM 5.3 Flash 更精确却偏泛化;公开基准上 GLM 5.3 Flash 明显胜出,但作者认为基准不完全可信。作者正征集两者在 agentic 循环、编程与创意写作上的实战意见。

来源:AGI Hunt · agihunt.info