跳到正文
原文
AGI Hunt· Evermoving-·· 3 小时前AI 评分31

Mistral Large 4 在 Terminal-Bench 力压 Qwen 与 Kimi 新旗舰

AI 导读

Reddit 用户发帖称 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过 Qwen 3.8 Max 与 Kimi K3,并附有对比截图。相关模型与成绩均未获官方渠道证实,真实性存疑。若属实,将是 Mistral 在 agentic coding 领域的一次重要反超。

来源:AGI Hunt · agihunt.info