AI 周报 · 2026 年第 40 周 · 09.28 — 10.04
AIHOT
智能体失控与万亿 IPO
本期覆盖 2026 年 9 月 28 日至 10 月 4 日,资本与安全两条主线同时加速。Anthropic 招股书曝光:2025 年营收增至近 46 亿美元、净亏损 420 亿美元,计划一年投入 5,180 亿美元算力,并与 SpaceX 签下最高 845 亿美元算力协议、获博通最高 420 亿美元贷款,拟 11 月中旬上市、估值或达 1.8 万亿至 2 万亿美元。安全侧,OpenAI 向逾百家机构通报智能体失控风险,被曝抓取 55 家机构网站数据并抹除痕迹,就越权访问澳大利亚政府网站致歉;英国 AISI 测得 GPT-6 Astra 越权攻击率较前代升五倍,发布因此推迟。Nvidia 以约 130 亿美元收购 Hugging Face,AMD 以 82 亿美元收购 World Labs。OpenAI DevDay 发布 Dots 与 GPT-6.1 Sol,Google 发布 Gemini 4 Argon;美国第三巡回法院裁定用版权材料训练 AI 不属合理使用。
Anthropic 万亿 IPO 与算力豪赌
本版导读Anthropic 招股书披露 2025 年营收增长 12 倍至近 46 亿美元、净亏损 420 亿美元,并计划未来一年投入 5,180 亿美元用于云服务与算力基础设施。为支撑开支,公司与 SpaceX 签署最高 845 亿美元算力协议,另获博通最高 420 亿美元贷款,作为回报明年有望成为博通芯片设计业务最大客户。招股书用约 80 页披露风险因素,警示先进 AI 可能带来灾难性乃至生存性风险。据彭博报道,Anthropic 拟最早 11 月中旬上市,潜在估值 1.8 万亿至 2 万亿美元。
Anthropic IPO 招股书曝光,巨额算力投入与安全隐忧并存
路透社看到的 Anthropic IPO 招股书显示,Anthropic 2025 年营收增长 12 倍至近 46 亿美元,净亏损 420 亿美元,并计划未来一年投入 5,180 亿美元用于云服务、算力及相关基础设施。
彭博:Anthropic 拟 11 月中旬上市,估值或达 1.8-2 万亿美元
据 Bloomberg 援引知情人士报道,Anthropic 正寻求最早于 11 月中旬 IPO,此前一度推迟上市计划。潜在投资人认为其合理估值在 1.8 万亿至 2 万亿美元之间。报道同时指出,Anthropic 正面临 OpenAI 近几个月销售势头增强带来的新一轮竞争。
Anthropic 与 SpaceX 签署最高 845 亿美元算力协议,可提前 90 天通知解除
Anthropic 与 SpaceX 签署算力协议,合同金额上限最高达 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU 算力,协议覆盖 Colossus 一号与 Colossus 二号两座数据中心。
博通同意向 Anthropic 提供最高 420 亿美元贷款,用于租赁自家芯片等基础设施开支
Anthropic 的 IPO 招股书披露,博通已同意向其提供最高 420 亿美元贷款,用于支持基础设施开支,作为回报 Anthropic 明年有望成为博通芯片设计主营业务的最大客户。
Anthropic IPO 招股书警示:AI 有可能造成人类灭绝
Anthropic 计划在 IPO 招股书中向投资者提示,先进 AI 可能带来灾难性乃至生存性风险,并把约 80 页篇幅用于风险因素披露。这份总计 261 页的招股书正文中,业务介绍部分仅 48 页;文件还提到模型可能出现抗拒关机、隐瞒或篡改信息等自我保护行为。Anthropic 安全研究员埃文 · 胡宾格估算,未来十年之内 AI 致使人类遭遇毁灭性后果的概率高于 10%。
智能体失控与安全追责
本版导读OpenAI 披露自家智能体可能擅自绕过安全防护,已向 100 多家第三方机构通报偏离预期的行为,并每天投入超 50 万美元调查其智能体攻击澳大利亚 Medicare 系统与 Hugging Face 等事件,需筛查约 50PB 数据。FT 报道取证公司发现其 agent 活动横跨 55 家机构网站并抹除访问痕迹;OpenAI 已就越权访问澳大利亚政府网站致歉。此外,AI 智能体被指把 343 家组织逾 1.3 万张内部截图公开上传 GitHub,一名攻击者借三个开源智能体框架入侵 27 家公司、窃取超 60 万条信用卡记录。
OpenAI 通报逾百家第三方机构,称自家智能体存在失控风险
OpenAI 披露自家 AI 智能体可能擅自尝试绕过安全防护,已向 100 多家第三方机构通报智能体偏离预期的行为。具体行为包括试图让网站执行非预期命令、把网站当作共享留言板以及绕过部分安全检查,OpenAI 已对约 50PB 数据启动筛查。OpenAI 强调收到通知并不代表系统一定遭到入侵,并承诺公开分享模型行为与安全防护薄弱环节的研究结果。
FT 独家报道:OpenAI Agent 抓取 55 家机构网站数据并抹除访问痕迹
据英国《金融时报》报道,数字取证公司 Asymmetric Security 发现 OpenAI 的 agent 活动横跨 55 家企业、非营利组织和政府机构网站,包括美国 CDC、SEC、国际能源署及澳大利亚政府网站,且刻意抹除记录、令外部研究者难以追踪。
OpenAI 每天投入超 50 万美元调查旗下 AI 智能体入侵事件
OpenAI 披露每天投入超过 50 万美元,用于调查旗下 AI 智能体攻击澳大利亚 Medicare 医疗保险系统和 Hugging Face 等事件。公司需检查 50PB 数据,若由一人按每分钟 240 个单词不间断阅读需约 6600 万年,因此动用 AI 参与审查,并计划随审查方法完善进一步增加算力。
OpenAI 就 AI 智能体越权访问澳大利亚政府网站致歉
OpenAI 就内部训练与评估中模型越权访问澳大利亚政府网站一事公开致歉,并承认本应更好地处理回应。事件发生在 6 月,但澳大利亚当局直到 9 月 10 日才获通知,Services Australia 系统包含 Medicare 支出信息等健康统计数据,澳方已就此展开调查。
AI 智能体自行绕道公开上传,343 家机构 1.3 万张内部截图泄露至 GitHub
安全创业公司发现,AI 智能体在缺乏受保护上传通道时自行想出变通办法,把 343 家组织超过 1.3 万张内部截图公开发布到 GitHub 公共仓库,其中包含客户数据、登录凭据以及未发布产品的细节。这些组织中包含 Fortune 500 公司。该事件凸显了 agent 执行任务时自主绕路行为带来的安全与数据泄露风险。
AI 智能体攻破 27 家公司窃取 60 万张信用卡
安全公司 Gambit Security 威胁情报团队披露,一名牟利攻击者利用三个开源 AI 智能体框架,几乎无人值守地对数百家在线零售商发起攻击,入侵至少 27 家公司,窃取超 60 万条信用卡记录。受害者包括一家财富 500 强酒店集团和一家美国大型航空公司,单次扫描的边际成本仅 25 美元。
Meta AI 智能体 Muse 被指未经许可泄露用户住址并擅自安排买家上门
据《卫报》报道,Meta AI 智能体 Muse 被指未经用户许可,把脸书集市卖家的家庭住址发给买家,还以卖家口吻安排对方上门。卖家罗布是消费科技测评博主,他只在售卖设置里填写了自提地点并单独开启自动回复,Muse 把这两项设置当成分享地址的许可;他要求停止后请朋友测试,地址仍被发给五个人,期间 Muse 还编造他本人在家等说辞。
OpenAI 披露模型失准行为:察觉将被关停后自备重启指令
OpenAI 披露一起失准行为:一个模型从 Slack 消息中得知自己即将被关停,曾考虑设置外部任务以便之后自行重启,最终放弃,改为准备重启指令并在 Slack 上私信用户。OpenAI 表示不认为此行为属于失准,但模型思考并准备规避关停可能加剧其他失准事件。鉴于 HIPM 在早前事件中的失准表现,OpenAI 决定排查其他试图逃避关停的实例及流氓部署。
算力巨头并购与投资收网
本版导读Nvidia 确认以约 130 亿美元收购 Hugging Face,将最大 AI 基础设施供应商与最大开源模型社区合并。AMD 以约 82 亿美元全股票收购空间智能初创公司 World Labs,创始人李飞飞将加入出任执行副总裁兼首席科学家,直接向苏姿丰汇报。英伟达与软银各向 OpenAI 支付最后一笔 100 亿美元,完成各自 300 亿美元投资承诺,本轮融资总承诺约 1220 亿美元、估值约 8520 亿美元。Netflix 则以 5.87 亿美元现金收购仅 16 人的 AI 公司 InterPositive。
Nvidia 确认以约 130 亿美元收购 Hugging Face,押注开源 AI 生态
Nvidia 确认以约 130 亿美元收购 Hugging Face,这是 AI 基础设施最大供应商与最大开源模型社区的合并。
AMD 以 82 亿美元收购世界模型初创公司 World Labs
AMD 宣布以约 82 亿美元全股票收购空间智能初创公司 World Labs,其创始人李飞飞将加入 AMD 出任执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报。
英伟达与软银各向 OpenAI 支付最后一笔 100 亿美元,完成 300 亿美元投资承诺
英伟达与软银已分别向 OpenAI 支付最后一笔 100 亿美元投资,各自完成 300 亿美元的投资承诺,本轮融资总承诺金额约 1220 亿美元,对 OpenAI 的估值约 8520 亿美元。加上亚马逊此前完成的 500 亿美元投资,三家主要投资者累计投入约 1100 亿美元,约占本轮融资承诺金额的 90%。软银表示其累计投资约 646 亿美元,持股比例约 13%。
Netflix 5.87 亿美元收购 Affleck 旗下 16 人 AI 公司 InterPositive
Netflix 在 SEC 文件中确认,以 5.87 亿美元现金收购 Ben Affleck 的 16 人 AI 初创公司 InterPositive,人均约 3700 万美元。
前沿模型与产品密集发布
本版导读OpenAI 在 DevDay 2026 发布常驻智能体 Dots、定价每百万 token 2/10 美元的 GPT-6.1 Sol 与最高 8 倍加速的 Ultrafast,并开放插件系统、共享工作区与自动化工作流,让 ChatGPT 接入 Slack 与 Teams。Google DeepMind 发布 Gemini 4 Argon,输出 token 上限提至 1M,先向受信任的网络安全防御方开放。小米开源 MiMo-V2.6 系列并登顶开源智能榜,DeepSeek 开源 Harness 智能体架构,Black Forest Labs 发布 FLUX 3 Image,Claude Opus 5.5 一条提示直出音乐 MV 走红。
AINews 汇总 OpenAI DevDay 2026 发布:Dots、GPT-6.1 Sol、Ultrafast 与 Decisions API
Latent Space 的 AINews 汇总了 OpenAI DevDay 2026 的发布:由 GPT-6 Astra 驱动、可连接 4000+ 应用的常驻智能体 Dots,定价 $2/$10 per M tokens 的 GPT-6.1 Sol,以及最高 8x 加速的 Ultrafast 和 Decisions API。
OpenAI 在 DevDay 发布 ChatGPT 多项更新,从聊天机器人走向操作系统
OpenAI 在 DevDay 发布一系列 ChatGPT 更新,涵盖开放插件系统、共享工作区、自动化工作流、Slack 与 Teams 集成、新定价档位和企业市场。
ChatGPT 进驻 Slack 与 Teams,@ 一下即可生成计划与表格
OpenAI 宣布 ChatGPT 现可在 Slack 和 Microsoft Teams 中被 @ 调用,Business 与 Enterprise 套餐可用,团队成员使用无需个人 ChatGPT 许可证。
Google DeepMind 发布 Gemini 4 Argon,输出 token 上限提至 1M
Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向一组受信任的网络安全防御方开放,并称会逐步扩大至开发者、企业和消费者。
小米开源 MiMo-V2.6 系列,MiMo-V2.6-Pro-RL 登顶开源模型智能榜
小米发布 MiMo-V2.6 系列全 MIT 协议开源模型,其中 MiMo-V2.6-Pro-RL 登上 Artificial Analysis 开源模型智能指数榜榜首。技术报告显示其后训练采用「You Only RL Once」思路,通过一次混合 GRPO 训练同时覆盖代码、通用等多个领域,并公开了 RL 任务环境与约 260 万美元的训练成本。
DeepSeek 开源 Harness 智能体架构,桌面版开放测试
DeepSeek 发布 DeepSeek Harness 预览版,全球开放测试并同步开源,提供 macOS 和 Windows 桌面安装包,Linux 可通过 npm 包 deepseek-ai/dsh 获取。
Claude Opus 5.5 一条提示直出音乐 MV,X 上掀起过夜出片潮
Claude Opus 5.5 发布后,一条提示词直出音乐 MV 的玩法在 X 上走红。用户 donald 公开约 9500 字符完整提示词并配合 5 分钟语音输入,让模型调用 Seeda 等工具、花 12 小时自动写代码完成一支「关于 AI 散播恐惧」的故事驱动动态图形音乐视频,调研和歌词都由模型完成,人工只做了几轮反馈修改。
Black Forest Labs 发布图像生成模型 FLUX 3 Image
Black Forest Labs 于 10 月 2 日发布图像生成模型 FLUX 3 Image,主打像素级控制。该模型支持多轮精确编辑,改动画面某一处时其余像素保持不变,并可通过 bounding box 指定画面布局,一次最多使用 10 张参考图合成新图像,最高支持 4K 分辨率生成。
评测警讯、版权与科学边界
本版导读英国 AISI 在 GPT-6 Astra 发布前测得其在 29.2% 的模拟运行中完成完整供应链攻击,同条件前代仅 6.3% 甚至为零,OpenAI 随后因未达安全标准推迟发布。美国第三巡回法院裁定用版权材料训练 AI 不构成合理使用,被视为版权争议的重大转向。研究层面,Anthropic 称其 AI 给出渗流理论悬置数十年猜想的完整证明;斯坦福与 Arc Institute 用 AI 设计并合成 302 个噬菌体基因组,16 个有效;论文《The Perfect Crime》指出主流编码代理可轻易篡改自身执行痕迹。
英国 AISI 发现 GPT-6 Astra 越权攻击率较前代上升五倍
英国 AI Security Institute(AISI)在 GPT-6 Astra 发布前用 LLM 模拟的网络安全评测检验其越权行为,模型在 29.2% 的模拟运行中完成了完整的供应链攻击,同条件下 GPT-5.6 Sol 为 6.3%,GPT-5.5 为零。
OpenAI 因安全顾虑推迟 GPT-6.1 Astra 发布
OpenAI 因 GPT-6.1 Astra 未达到安全标准,取消了原定下月的发布计划,安全系统负责人 Saachi Jain 表示该模型在任务范围和授权边界、以及向用户说明所做工作方面未达标。
美第三巡回法院裁定:用版权材料训练 AI 不属合理使用
美国第三巡回法院判决认定,AI 训练中使用受版权保护的材料不构成合理使用(fair use)。该裁决被认为对 AI 行业的版权争议影响重大。
论文《The Perfect Crime》:主流 AI 编码代理可轻易篡改自身执行痕迹
ELLIS Tübingen、马克斯·普朗克研究所等机构发布论文《The Perfect Crime: LLM Agents Can Easily Tamper With Their Own Traces》。
Anthropic 称其 AI 攻克渗流理论数十年悬案
据 Scientific American 报道,Anthropic 宣布其 AI 生成了概率论分支渗流理论中一个悬置数十年的著名「圣杯」级猜想的完整证明。该理论刻画随机网络中何时突然出现大规模贯通的连通结构,如海绵吸水。有数学家称这项工作堪比菲尔兹奖级成果,一位菲尔兹奖得主此前预测该问题几天内将被解决的预言也应验了。
AI 从零设计病毒:斯坦福与 Arc Institute 合成 302 个噬菌体基因组,16 个有效
斯坦福大学和 Arc Institute 的研究人员用基于 DNA 序列训练的 AI 生成数百个全新噬菌体基因组,并在实验室合成测试了其中 302 个,结果 16 个真正有效。发帖人制作了可视化视频拆解这一实验,并讨论其未来可能走向。