Gemini 4 Argon 发布登顶 LMArena,可用性受限
先了解这件事
2026 年 10 月 1 日,Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先经 Fairwind Program 向一组受信任的网络安全防御方开放,之后逐步扩大至开发者与企业。Koray Kavukcuoglu 称其在软件工程、法律金融等企业知识工作与网络安全防御等真实工作流具备前沿性能。官方称支持 100 万输出 token(早先爆料称输出上限由 64K 升至 100 万),尝鲜价输入 $2/输出 $10,缓存输入价低 95%;Ars Technica 则称模型已宣布但用户目前无法使用。LMArena 宣布 Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,超第二名 Claude Opus 4.6 约 20 分,可控性第 1,每任务成本 $0.62。早先 Yuchen Jin 称其各基准全面超越 GPT-6 Astra 与 Claude Opus 5.5;后续独立测试报道改称它与 GPT-6 Astra 打平、仍逊于 Claude Opus 5.5,且每任务耗 token 是 Astra 的两倍多,成本优势被抵消,目前仅部分测试者可用。网友质疑普通用户无法使用、Google 跑分不可靠。
AI 根据报道生成 · 9 分钟前更新
事件进展
- 10月1日 06:38 · 1 篇报道前OpenAI研究员调侃谷歌元素名模型抢注AGI Hunt:AI 模型元素名抢注大战:Neon 和 Argon 已被拿下,Krypton 花落谁家?
- 10月1日 05:53 · 1 篇报道曝 Gemini 4 Argon token 效率不佳AGI Hunt:曝 Gemini 4 Argon token 效率不佳,早期口碑转冷
- 10月1日 05:53 · 1 篇报道Reddit 传闻称 Gemini 4 已发布引热议AGI Hunt:「Gemini 4 已发布」传闻引热议:Claude Opus 迎对手?
- 10月1日 05:52 · 1 篇报道Polymarket:谷歌AI概率因Gemini 4升至40%AGI Hunt:Polymarket:谷歌年底领跑 AI 概率升至 40%,Gemini 4 Argon 曝百万 token 输出窗口
- 10月1日 05:24 · 1 篇报道爆料称谷歌Gemini 4 Argon已悄然上线AGI Hunt:爆料称 Google Gemini 4 Argon 已悄然上线,速度远超预期
- 10月1日 05:11 · 2 篇报道Gemini 4 Argon (High) 登顶 Text Arena 1525 分AGI Hunt:Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,混合价格 $8/MToken
- 10月1日 04:58 · 1 篇报道爆料称Gemini 4 Argon单次可输出百万tokenAGI Hunt:爆料称 Gemini 4 Argon 单次可输出 100 万 token,为同级模型 128K 上限的 8 倍
- 10月1日 04:32 · 1 篇报道网友质疑 Google 新模型跑分不可信AGI Hunt:Google 新模型获追捧遭网友泼冷水:跑分未必可信
- 10月1日 04:22 · 2 篇报道Gemini 4 Argon 基准超越 Astra 与 OpusAGI Hunt:Yuchen Jin 称 Gemini 4 Argon 各基准全面超越 GPT-6 Astra 与 Claude Opus 5.5
- 10月1日 04:01 · 7 篇报道Google 发布 Gemini 4 Argon 前沿模型Google DeepMind:Blog:Google DeepMind 发布 Gemini 4 Argon,输出 token 上限提至 1M
报道时间线
沿着报道,了解事件的不同侧面。
- AGI HuntAI 模型元素名抢注大战:Neon 和 Argon 已被拿下,Krypton 花落谁家?
OpenAI 前研究员 Liam Fedus 称,Periodic Neon 与 Gemini Argon 已先后被注册,元素名抢注竞赛蔓延到 Krypton,暗指 Google 新模型以元素命名,并祝贺 Google 团队「重返前沿」。TKipf 跟帖调侃谁先抢到镨(Praseodymium)。帖中还称持续智能爆炸带来巨大消费者剩余,「随叫随到的 PhD,运行成本几分钱」。
- The Decoder:AI News精选Google 发布 Gemini 4 Argon,追近 OpenAI 与 Anthropic 但未明显领先
Google 发布新前沿模型 Gemini 4 Argon,在多项基准上缩小了与 OpenAI、Anthropic 的差距,但未取得明显领先。该模型初期只向 Fairwind 计划的一批可信网络防御者和 Google 内部团队开放,促销价为每百万输入 token 2 美元、输出 token 10 美元,缓存输入价格低 95%。
- AGI Hunt谷歌时隔 7 个月发布 Gemini 4 Argon:追平 GPT-6 Astra,仍逊于 Opus 5.5
Google 发布七个多月来首个前沿模型 Gemini 4 Argon,独立测试中与 OpenAI 的 GPT-6 Astra 打平,但未能赶上 Anthropic 的 Claude Opus 5.5。Argon 单 token 定价较低,但每个任务消耗的 token 数是 Astra 的两倍多,实际成本优势被抵消。目前仅部分测试者可先用,API 和付费层随后开放。
- AGI Hunt精选谷歌发布 Gemini 4 Argon:百万输出 token,输入定价低至 $2/M
Google 推出新旗舰模型 Gemini 4 Argon,支持 100 万输出 token,输入定价 $2/百万 token、输出 $10/百万 token,官方称其幻觉率较低。
- AGI Hunt曝 Gemini 4 Argon token 效率不佳,早期口碑转冷
开发者 adonissingh 称,未经官方证实的未发布模型 Gemini 4 Argon 在初期狂热过后社区反馈转冷,被指 token 效率不佳。他认为这不是自己期待的翻身之作,但强调真正上手使用前还无法下结论。该说法属于对未发布模型的早期观察,需谨慎对待。
- AGI Hunt「Gemini 4 已发布」传闻引热议:Claude Opus 迎对手?
一则声称 Gemini 4 已经发布、称「竞争对手已觉醒」的 Reddit 帖引发热议,讨论 Google 新模型是否会撼动 Anthropic Claude Opus 的领先地位。帖内未提供发布细节或评测数据,真实性有待验证,评论区围绕「Opus 5.5 是否终于迎来对手」展开讨论。
- AGI HuntPolymarket:谷歌年底领跑 AI 概率升至 40%,Gemini 4 Argon 曝百万 token 输出窗口
Polymarket 盘口显示,在「2026 年底谁拥有第一 AI 模型」中 Anthropic 48%、Google 35%、OpenAI 8%,谷歌因 Gemini 4 Argon 消息涨至 40%。
- AGI HuntGemini 4 Argon 登顶 Text Arena,每任务成本仅 $0.62
Google DeepMind 的 Gemini 4 Argon (High) 在 Text Arena 以 1525 分登顶,超第二名 Claude Opus 4.6 (High) 约 20 分,混合价格 $8/MToken,在 Coding、Hard Prompts、指令遵循、长查询和创意写作等分项均居首,可控性排第 1(+15.88%)。
- AGI Hunt爆料称 Google Gemini 4 Argon 已悄然上线,速度远超预期
有账号爆料称 Google 的 Gemini 4 Argon 已经推出,并感叹发布节奏「快得离谱」,但目前尚未见 Google 官方发布或第三方证实。该消息真实性以及模型能力、可用范围、定价均待确认。同频道另有信息称,Gemini 4 Argon 已登顶 Text Arena,每任务成本仅 $0.62。
- AGI HuntGemini 4 Argon (High) 以 1525 分登顶 Text Arena,混合价格 $8/MToken
LMArena 官方宣布,Gemini 4 Argon (High) 在 Text Arena 榜单取得 1525 分,混合价格仅为 $8/MToken。按官方说法,该成绩在当前价格带上同时做到最强能力与更优性价比,重塑了榜单上的性能价格 Pareto 前沿。
- AGI Hunt爆料称 Google Gemini 4 Argon 单次可输出 100 万 token,基准全面领先
爆料称 Google 新旗舰 Gemini 4 Argon 在多数基准上超过 GPT-6 Astra 与 Claude Opus 5.5,单次响应输出上限从 64K 升至 100 万 token。
- AGI Hunt爆料称 Gemini 4 Argon 单次可输出 100 万 token,为同级模型 128K 上限的 8 倍
未经官方确认的爆料称,Google 新旗舰 Gemini 4 Argon 单次响应最多可输出 100 万 token。该数字指输出上限而非输入上下文,约为同级前沿模型 128K 上限的 8 倍。爆料还称其在多数基准上超过 GPT-6 Astra 与 Claude Opus 5.5。
- AGI HuntGemini 4 Argon 优化量子计算子程序,几分钟内超已发表基线 40%
Gemini 4 Argon 帮助 Google 量子计算团队优化关键应用中的瓶颈子程序,其中一个案例在几分钟内比已发表基线提升 40%,优化对象为时空资源(qubits × gates)。该模型单次响应可输出 1M token,约为同级模型 128K 上限的 8 倍,并面向网络防御者推出,尝鲜价输入 $2/输出 $10。发布日未全面开放。
- The Verge · AIGoogle 发布 Gemini 4 Argon,初期仅向受信任的网络安全人员开放
Google 发布下一代前沿模型 Gemini 4 Argon,初期仅向一组受信任的网络安全人员开放,之后再逐步扩大访问。Google DeepMind SVP 兼首席 AI 架构师 Koray Kavukcuoglu 称,该模型在软件工程、法律金融等企业知识工作与网络安全防御等真实复杂工作流中具备前沿性能,已在 Google 内部用于大规模代码库迁移等任务。
- AGI HuntGoogle 新模型获追捧遭网友泼冷水:跑分未必可信
Google 新模型引发社区「Google is so back」的欢呼,但多位网友泼冷水指出,该模型普通用户目前根本无法实际使用,只能看基准成绩。网友还称 Google 模型的基准成绩历来不可靠,并提及 Gemini 3 Pro 的先例,暗示宣传性跑分与实际表现常有落差。作者因此呼吁等模型真实可用后再下结论。
- AGI HuntYuchen Jin 称 Gemini 4 Argon 各基准全面超越 GPT-6 Astra 与 Claude Opus 5.5
知名 AI 博主 Yuchen Jin 表示「Google 回来了」,称 Gemini 4 Argon 在各基准上全面优于 GPT-6 Astra 和 Claude Opus 5.5,并说如果不是刷榜,很乐意看到 Google 重新加入竞赛。
- Ars Technica · AIGoogle 宣布 Gemini 4 Argon AI 模型,但你还不能用
Google 宣布 Gemini 4 Argon AI 模型,但用户目前无法使用。消息同时提到 Gemini 3.5 Pro,并称“So much for Gemini 3.5 Pro”。
- Google DeepMind:Blog精选Google DeepMind 发布 Gemini 4 Argon,输出 token 上限提至 1M
Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向一组受信任的网络安全防御方开放,并称会逐步扩大至开发者、企业和消费者。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。