Colab 现已纳入 Google AI 订阅计划
Google AI 订阅用户现在可获得 Colab 高级权益,包括优先使用更快的加速器和算力更强的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页打开。相关权益将在未来几周内在支持 Colab 的国家和地区陆续推送,已订阅 Colab 的用户不受影响,且两类订阅权益可以叠加。
Google AI 订阅用户现在可获得 Colab 高级权益,包括优先使用更快的加速器和算力更强的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页打开。相关权益将在未来几周内在支持 Colab 的国家和地区陆续推送,已订阅 Colab 的用户不受影响,且两类订阅权益可以叠加。
Google 宣布 Antigravity SDK 支持本地模型工作流,初期可通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,在完全离线状态下提供智能体辅助。
推荐理由:Antigravity SDK 把本地模型接入智能体工作流,读者可据此判断离线运行与云端混合编排的成本和隐私取舍。
Google MaxText 团队在 Cloud TPU 上从头复现了 Ai2 的 Olmo 3 7B 预训练与中期退火,阶段 1、阶段 2 的损失曲线与 Ai2 公开参考在留出评估上对齐。
Google Cloud API Gateway 进入 Public Preview,可直接充当远程 MCP 服务器,把已部署的 OpenAPI REST 操作暴露为智能体可调用的 MCP 工具,无需另外搭建和维护服务器。
推荐理由:文中给出把既有 REST API 直接改造成 MCP 工具的配置方式与已知限制,便于判断这类改造是否适合现有服务。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并公布更完善的防护措施与支持,以加强澳大利亚的网络防御。
GitHub 博客介绍其 Security Lab 用开源的 Taskflow Agent 智能体在 Android 应用中发现了 24 个漏洞,并给出 OsmAnd 位置追踪与 Wikipedia 账号接管两个案例。
推荐理由:文中给出审计 taskflow 查找 Android 漏洞的具体案例与运行步骤,安全研究者可迁移到自有应用的审计流程。
OpenAI 扩大对 Lenfest Institute 的资助,为 Lenfest AI Collaborative and Fellowship Program 追加 $5 million 资金。OpenAI 同时提供最高 $5 million 的软件额度与工程支持,用于扩展这一项目。
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、创客、研究者与创作者的真实故事。有意加入该项目下一阶段的人,需提交自己的故事与项目。
Basis 用 GPT-6 Astra 完成了一份 50-tab 税务工作簿,速度达到 GPT-5.6 Sol 的两倍。GPT-6 Astra 对用户意图的理解更强,这让 Basis 在真实业务场景中使用它更有信心。
Proaction 借助 Codex 将销售额提升 60%,并节省 75+ 小时。其还使用 Codex、GPT-Live-1 和 GPT-6 Astra,更快地构建、运营和销售现代车队管理。
AWS 的 NarrateAI 团队公开了在 Amazon Bedrock 上实现生产级 LLM 质量保障的五种技术,覆盖自适应流水线编排、跨账号多模型故障转移、实时流式评估、复合评估框架和数据准确性验证。
AWS 官方博客给出在 Amazon SageMaker AI 上通过 JumpStart 部署 Qwen3-TTS-12Hz-1.7B-Base 到实时推理端点、并用几秒参考音频做语音克隆的完整步骤。
Datacor 将 Amazon Quick Sight 嵌入 TrackAbout,为气体与焊接分销商提供自助式租赁分析仪表盘与自然语言搜索栏。TrackAbout 客户合计管理 2750 万个资产、每月超 72.5 万张账单,此前租金数据只能靠 IT 生成的报告获取。自然语言问答由 Amazon Q in Quick Sight 驱动。
Amazon SageMaker HyperPod 搭配 Qumulo 的 CNQ 与 Cloud Data Fabric(CDF),让训练集群无需复制数据即可读取另一 AWS Region 的数据集。
GitHub 的 Primer Design System 将所有组件从 CSS-in-JS 迁移到 CSS Modules,到 2024 年 12 月完成,服务端渲染页面耗时减少 55%,组件初始化耗时减少 25%。
Cloudflare 发布 Turnstile Spin,让 Claude Code、Cursor、Codex 等编码智能体自动完成 Turnstile 的前后端集成。
Google Research 提出 AI video co-director,一个构建在 Gemini 和 Veo 之上的统一多智能体编排框架,用于自动化生成跨镜头连贯的分钟级长视频。
AWS WhisperX DLC 可部署到 Amazon SageMaker AI 实时或异步端点,无需构建自定义镜像。WhisperX 基于 OpenAI Whisper,增加批量推理、wav2vec2 逐词时间戳和说话人分离,支持 json、verbose_json、srt、vtt 输出。实时端点限 60 秒内短音频,长音频和高吞吐批处理建议用异步端点。
平台账户用 Amazon Bedrock AgentCore Gateway 把各业务线账户的 MCP server 聚合成单一 MCP 端点,智能体无需复制数据即可跨账户发现并调用工具,数据只在查询时流出所属账户。
Aderant 通过 Amazon Bedrock 调用 Amazon Nova Lite 构建 Intelligent Ticket Analyzer,为 38 人 SierraOps 团队自动分类、路由工单并补全上下文。
HEMA 基于 MCP 和 Amazon Bedrock AgentCore 构建内部 AI 助手 HAL,把分散在门户、wiki 与文档中的知识集中,并在 HAL 聊天、Kiro、Claude 等工具中直接提供答案。此前查一个答案需在 3 或 4 个门户间跳转、有时耗费整个下午,现在可在 IDE 或聊天窗口几秒内完成;当前为只读知识层,下一步将转为可执行操作层。
AWS 在官方博客给出基于 Strands Agents SDK 的对话式视频智能方案,由大模型在运行时决定调用 Amazon Bedrock、Amazon Rekognition 还是 Amazon Transcribe,不再为每类问题预建处理流水线。
OpenCode 可接入 Amazon Bedrock 的开放权重模型,作为终端 AI 编程智能体在本地运行、推理留在 AWS 账户,且无按席位费用。示例模型包括 Moonshot AI Kimi K3、OpenAI GPT-OSS 120B 与 NVIDIA Nemotron 3 Super 120B。
Google Beam 扩展至美国、加拿大、英国、法国、德国和日本六个国家,并由 18 家渠道合作伙伴支持部署。Google 与 Industrious 合作推出首个 Beam 扩展网络,10 月起可在美国部分 Industrious 地点预约体验。八周内部研究显示,使用 Beam 的 Google 团队连接感提升 50%、后续会议需求下降 21%。
OpenAI Academy 迎来两周年,并将 AI 技能带给更多社区。该 Academy 是 OpenAI 面向社区的 AI 技能项目。
OpenAI 宣布将其 Daybreak 计划的网络访问权限扩展至乌克兰政府,以支持民用基础设施的网络防御。
GitHub 与耶鲁气候变化传播项目对 1,039 名 GitHub 用户的调查显示,80% 受访者有兴趣使用帮助写出更节能代码的工具,78% 想要减少软件环境足迹的最佳实践,74% 希望衡量软件或开发流程的影响。
Harvey 借助 GPT-6 Astra 将法律上下文转化为更强的文书草稿,生成的文档结构更清晰、也更贴合上下文。这一能力把律师从文书撰写中释放出来,转而专注策略。
Ringg 基于 GPT-5.6 的 AI 智能体在多语言场景下可解决最高 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页渠道。相比 GPT-4.1,其成本降低 90%。
invideo 借助 GPT‑6 Astra 规划剪辑,把色彩校正与调色效率提升至原来的 3 倍。模型让剪辑规划更精准,还使 invideo 在一天内产出 50 个自定义特效。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,谈及 AI 安全、人类控制以及国际合作。这是他面向安理会就上述议题所作的表态。
OpenAI 发布 MentalHealthBench,一个由专家参与制定的基准,用于评估 AI 在真实心理健康对话场景中回复是否有帮助且安全。该基准覆盖现实的mental health对话,兼顾有用性与安全性两个维度。
ChatGPT Ads 扩展至东南亚和台湾,为符合条件的商家提供触达更多地区用户的新渠道。该广告业务的覆盖范围已超过 60 个国家和地区。
Airbnb 扩大对 GPT-6 Astra 及 OpenAI 前沿模型的接入范围,帮助工程团队排查 bug、设计系统并加快交付。
OpenAI 与 Grab 推出区域项目 GO Forward with AI,帮助东南亚 30,000 名合作伙伴建立实用 AI 技能。该计划面向东南亚地区,以合作伙伴为对象提升实用 AI 能力。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新增的诊断能力与显式断点,以及可降低延迟和成本的控制项。这些改动让开发者能更清楚地排查缓存行为并控制推理开销。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 在 Amazon Bedrock 正式可用,API 定价显著低于 GPT-5.6 前代。GPT-6 Sol 面向开发与运维中反复出现的复杂任务,GPT-6 Luna 面向大批量重复任务,两者都支持显式提示词缓存。OpenAI 的内部事实性评测显示,GPT-6 Sol 的事实性错误约为 GPT-5.6 Sol 的一半。
推荐理由:两款模型按复杂任务与高频任务分层,API 定价低于 GPT-5.6 前代,可据此判断日常负载的选型。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,称它们把前沿智能带入日常工作,区别在于能力与成本的不同平衡。
推荐理由:OpenAI 一次发布两款模型并给出能力与成本的不同取舍,读者可据此比较它们在日常工作场景中的定位。
AWS 宣布 Claude Opus 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,这是 Claude 5.5 系列的首个模型。
推荐理由:文章对比了 Claude Opus 5.5 与 Opus 5 在 token 效率、定价和安全分类器上的差异,并给出在 Bedrock 上调用该模型的代码示例。
Cloudflare 发布 Worker Previews,为每个 Git 分支提供接近生产的隔离运行环境,各自拥有独立的代码、配置、URL、可观测性和状态。
推荐理由:每个 Git 分支都获得带独立状态与 URL 的预览环境,读者可据此了解智能体开发闭环怎样接入现有部署流程。