跳到正文
热点事件持续更新

Mistral Large 4 被指编程基准超 Qwen 与 Kimi

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月 7 日,AGI Hunt 报道称,有 Reddit 用户发帖表示 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过了 Qwen 3.8 Max 与 Kimi K3,并附上了对比截图。报道同时指出,相关模型与成绩均未获官方渠道证实,真实性存疑;若该成绩属实,将是 Mistral 在 agentic coding 领域的一次重要反超。目前此事仍停留在社区流传的截图层面,尚无 Mistral、Qwen 或 Kimi 任何一方的官方回应,也没有第三方复现结果公布。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. AGI Hunt
    Mistral Large 4 在 Terminal-Bench 力压 Qwen 与 Kimi 新旗舰

    Reddit 用户发帖称 Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过 Qwen 3.8 Max 与 Kimi K3,并附有对比截图。相关模型与成绩均未获官方渠道证实,真实性存疑。若属实,将是 Mistral 在 agentic coding 领域的一次重要反超。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。