Gemini 4 Argon 登顶自动化基准,智能指数 53 分
先了解这件事
2026 年 10 月 1 日,AGI Hunt 连续报道 Artificial Analysis 对 Google Gemini 4 Argon 的评测。首批结果显示,该模型在 AutomationBench-AA 上以 77.5% 排名第一,领先 Claude Sonnet 5.5(max 版,71.3%)6 个百分点。同日报道补充其开启高推理模式后的完整跑分:智能指数 53,在 223 个模型中排第 8,追平 GPT-6 Astra,成本约为其六成,并称这是 Google DeepMind 七个多月来首款超越 Flash 档的专有模型。随后一篇报道称该 53 分与 GPT-6 Astra、Fable 5.1 持平、同列第一梯队,并超过 GPT 6.1,性价比处于 GPT 两代模型之间。最新一篇则称 Gemini 4 与 GPT 6 Astra 得分相同但价格便宜约 40%,Reddit 用户贴出对比后引发讨论。需注意:早先报道称其在 223 个模型中排第 8,后续报道则称与另两款模型并列第一梯队;AutomationBench-AA 与智能指数并非同一榜单。评测项目与运行条件均未披露。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
- AGI HuntGemini 4 Argon 智能指数 53 分追平 GPT-6 Astra
Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上获得 53 分,与 GPT-6 Astra、Fable 5.1 持平,同列第一梯队,并超过 GPT 6.1。其性价比处于 GPT 两代模型之间,综合竞争力较强。
- AGI HuntGemini 4 跑分追平 GPT 6 Astra,价格便宜四成
Artificial Analysis 基准测试显示,Google 的 Gemini 4 与 OpenAI 的 GPT 6 Astra 得分相同,但 Gemini 4 价格便宜约 40%。Reddit 用户贴出对比结果后引发讨论,认为 Gemini 4 在性能上已追平 OpenAI 旗舰,同时具备显著的成本优势。
- AGI HuntGemini 4 Argon 高推理模式完整跑分出炉
Artificial Analysis 公布了 Google Gemini 4 Argon 开启高推理模式后的完整基准结果,智能指数达 53,在 223 个模型中排第 8。该成绩追平 GPT-6 Astra,而成本约为其六成。Gemini 4 Argon 也是 Google DeepMind 七个多月来首款超越 Flash 档的专有模型。
- AGI HuntGemini 4 Argon 登顶 AutomationBench,领先 Claude Sonnet 5.5 六个百分点
Artificial Analysis 公布评测结果,Gemini 4 Argon 在 AutomationBench-AA 上以 77.5% 排名第一,领先 Claude Sonnet 5.5(max,71.3%)6 个百分点。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。