热点事件持续更新
Mistral Large 4 被指编程基准超 Qwen 与 Kimi
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026 年 10 月 7 日,AGI Hunt 报道称,有 Reddit 用户发帖表示 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过了 Qwen 3.8 Max 与 Kimi K3,并附上了对比截图。报道同时指出,相关模型与成绩均未获官方渠道证实,真实性存疑;若该成绩属实,将是 Mistral 在 agentic coding 领域的一次重要反超。目前此事仍停留在社区流传的截图层面,尚无 Mistral、Qwen 或 Kimi 任何一方的官方回应,也没有第三方复现结果公布。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- AGI HuntMistral Large 4 在 Terminal-Bench 力压 Qwen 与 Kimi 新旗舰
Reddit 用户发帖称 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过 Qwen 3.8 Max 与 Kimi K3,并附有对比截图。相关模型与成绩均未获官方渠道证实,真实性存疑。若属实,将是 Mistral 在 agentic coding 领域的一次重要反超。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。