AGI Hunt· b_roziere·· 3 小时前AI 评分55
Mistral Large 4 实测宣称:DeepSWE 超 GLM 5.3,Tbench 4 胜 Kimi k3
AI 导读
Mistral 团队继续介绍 Mistral Large 4(Chonky)的评测表现,称其在代码 agent 基准上 DeepSWE 超过 GLM 5.3、Tbench 4 超过 Kimi k3。官方强调基准不代表全部,重点在实际使用场景,并称其为世界最好的开源模型。模型已在预览 API 开放试用,详情见官方博客。
来源:AGI Hunt · agihunt.info