AGI Hunt· Evermoving-·· 3 小时前AI 评分31
Mistral Large 4 在 Terminal-Bench 力压 Qwen 与 Kimi 新旗舰
AI 导读
Reddit 用户发帖称 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过 Qwen 3.8 Max 与 Kimi K3,并附有对比截图。相关模型与成绩均未获官方渠道证实,真实性存疑。若属实,将是 Mistral 在 agentic coding 领域的一次重要反超。
来源:AGI Hunt · agihunt.info