Amazon Bedrock 在首尔和新加坡推出 Anthropic Claude 区域内推理
Amazon Bedrock 现支持在首尔和新加坡以区域内推理调用 Anthropic 的 Claude 模型:首尔提供 Claude Opus 5 和 Claude Sonnet 5,新加坡提供 Claude Sonnet 5。
Amazon Bedrock 现支持在首尔和新加坡以区域内推理调用 Anthropic 的 Claude 模型:首尔提供 Claude Opus 5 和 Claude Sonnet 5,新加坡提供 Claude Sonnet 5。
Amazon Bedrock 在印度上线 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理把请求限制在 ap-south-1 与 ap-south-2 之间,客户数据不存储在目标区域、只保留在源区域。
OpenAI 推出 dots,一款可在复杂项目和日常任务中持续工作的主动型助手。dots 强调在任务推进的同时让用户保持控制。用户可了解它如何在项目与日常事务中帮助推进工作。
Cloudflare 推出 Application Profiles,用 Schema Profiles 学习 HTTP 请求的结构与格式、识别偏离,以正向安全策略大幅缩小攻击面。
Cloudflare 发布 Threat Signals,把用户选定的开源威胁情报报告转化为可执行情报,并向所有 Cloudflare 账户免费开放。它通过智能体技能总结报告、提取并归一化 IOC、按账户既有标签体系打标签,产出的指标以 Threat Event 形式存入账户私有 Threat Intelligence 数据集,可直接用于 WAF 策略。
Cloudflare 发布面向 AI 时代的自适应应用安全框架,把发现并排序风险、治理访问与智能体行为、运行时防护、调查与响应四个阶段连成闭环。
Cloudflare 发布基于 Astro 的开源 CMS EmDash 1.0,采用 MIT 许可,并同步上线基于 AT Protocol 的去中心化插件注册表。
推荐理由:EmDash 1.0 把 CMS 与去中心化插件注册表放在一起,读者可了解插件沙箱权限与 agent 接入的具体设计。
Cloudflare 为其运行在 Workers 上的智能体浏览器 Kitesurf 发布更新,新增 WebMCP 支持,并宣布 Kitesurf 已实现 Browser Run API 全覆盖。
Google 开源了 C++ 库 Credentio,用于在本地验证 C2PA 内容凭证,初期支持规范 2.2 和 2.4 版本。该库已在近 40 款 Google 产品中处理数百亿个图像、视频、音频和文档资产,验证在开发者应用本地完成,无需将媒体文件传回 Google 或外部验证端点,以降低延迟、带宽与隐私限制。
Google Cloud 将原生 TPU 支持集成进 vLLM,在 Cloud TPU 上实现企业级精度的长上下文多模态嵌入推理。该方案以 Qwen3-Embedding-8B 为目标模型,支持文本 4K+ tokens、多模态文本加图像 15K+ tokens 的超长上下文,并以余弦相似度验证跨硬件数值对齐,文本目标阈值 ≥0.999、多模态 ≥0.995。
Google Cloud 的 Gemini Enterprise DevEx 计划以 Sprint 形式按开发者真实路径压测自家工具,本轮聚焦智能体治理,梳理出身份预置、Agent Registry 注册、Agent Gateway 绑定、政策与 Model Armor 内容安全、请求验证 5 条端到端工作流。
ADK for Kotlin 1.0 正式 GA,与 ADK 1.0 Core 功能对齐并补齐 Android 优先的端侧扩展。框架基于 Kotlin Multiplatform(KMP)核心,可用 LiteRT-LM、ML Kit(beta)端侧运行智能体,经 Firebase AI Logic 编排混合云工作流,以 Room 和 AppSearch 跨进程重启持久化状态。
Gemini Enterprise Agent Platform 的 Agent Anomaly Detection 进入 Private Preview,这套基于推理的监督与审计层通过 reasoning traces、tool calls 和执行流标记智能体的行为异常与策略违规。
Google 宣布与 Speakeasy 合作,将其 OpenAPI 代码生成套件以 AGPLv3 协议开源。开源内容包括覆盖 Python、TypeScript、Go、Java、C#、PHP、Ruby 7 种语言的 SDK 生成器、CLI 生成器和文档 MCP server 生成器,生成的代码仍可沿用 MIT 或 Apache 2.0 等自选许可。
Google AI 订阅用户现在可获得 Colab 高级权益,包括优先使用更快的加速器和算力更强的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页打开。相关权益将在未来几周内在支持 Colab 的国家和地区陆续推送,已订阅 Colab 的用户不受影响,且两类订阅权益可以叠加。
Google 宣布 Antigravity SDK 支持本地模型工作流,初期可通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,在完全离线状态下提供智能体辅助。
推荐理由:Antigravity SDK 把本地模型接入智能体工作流,读者可据此判断离线运行与云端混合编排的成本和隐私取舍。
Google Cloud API Gateway 进入 Public Preview,可直接充当远程 MCP 服务器,把已部署的 OpenAPI REST 操作暴露为智能体可调用的 MCP 工具,无需另外搭建和维护服务器。
推荐理由:文中给出把既有 REST API 直接改造成 MCP 工具的配置方式与已知限制,便于判断这类改造是否适合现有服务。
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、创客、研究者与创作者的真实故事。有意加入该项目下一阶段的人,需提交自己的故事与项目。
Cloudflare 发布 Turnstile Spin,让 Claude Code、Cursor、Codex 等编码智能体自动完成 Turnstile 的前后端集成。
Google Beam 扩展至美国、加拿大、英国、法国、德国和日本六个国家,并由 18 家渠道合作伙伴支持部署。Google 与 Industrious 合作推出首个 Beam 扩展网络,10 月起可在美国部分 Industrious 地点预约体验。八周内部研究显示,使用 Beam 的 Google 团队连接感提升 50%、后续会议需求下降 21%。
Harvey 借助 GPT-6 Astra 将法律上下文转化为更强的文书草稿,生成的文档结构更清晰、也更贴合上下文。这一能力把律师从文书撰写中释放出来,转而专注策略。
Ringg 基于 GPT-5.6 的 AI 智能体在多语言场景下可解决最高 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页渠道。相比 GPT-4.1,其成本降低 90%。
invideo 借助 GPT‑6 Astra 规划剪辑,把色彩校正与调色效率提升至原来的 3 倍。模型让剪辑规划更精准,还使 invideo 在一天内产出 50 个自定义特效。
ChatGPT Ads 扩展至东南亚和台湾,为符合条件的商家提供触达更多地区用户的新渠道。该广告业务的覆盖范围已超过 60 个国家和地区。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新增的诊断能力与显式断点,以及可降低延迟和成本的控制项。这些改动让开发者能更清楚地排查缓存行为并控制推理开销。
Cloudflare 发布 Worker Previews,为每个 Git 分支提供接近生产的隔离运行环境,各自拥有独立的代码、配置、URL、可观测性和状态。
推荐理由:每个 Git 分支都获得带独立状态与 URL 的预览环境,读者可据此了解智能体开发闭环怎样接入现有部署流程。
Meta 将其内部使用九年多的分配问题求解库 Rebalancer 开源,采用 Apache 2.0 许可,同时提供 GitHub 仓库、文档和 PyPI 包。
Cloudflare 宣布 Python Workers 正式可用(GA),Python 成为 Cloudflare Workers 运行时的一等支持语言。
推荐理由:Python Workers 转为正式可用,文章说明了 WSGI/ASGI 连接器与 socket 桥接如何让框架、数据库驱动和 AI 库直接在 Workers 上运行。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线新的视频功能,让小型企业制作视频广告更简单。该公司也因此能更快把新的创意工具推向市场。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助他们构建并展示实用 AI 技能。
V7 使用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,用于完成复杂且带来源链接的工作。该方案将成本降低 78%,同时提升了准确率。
Google Envisioning Studio 在 Google Labs 支持下与设计师 Jane Wade、Sergio Hudson 合作,用 Google Flow 打造的两款定制工具已用于纽约时装周。
联合国系统在 Google 支持下推出 UN System Data Commons,一个基于 Data Commons 构建的开源平台,把联合国各机构分散的全球统计数据整合为可搜索的 AI-ready 知识图谱。
Pawprint Studio 的免费开放世界抓宠 RPG《Aniimo》本周随发售同步登陆 GeForce NOW,可在 Steam Deck、新支持的 Firefox 浏览器等设备串流,无需 45GB 下载。
OpenAI 推出 Astra for Law,为法律领域带来前沿智能、定制律所工作流、连接法律数据源,以及面向保密客户工作的法律级控制。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍。GB300 NVL72 凭 288 个 GPU 跨四机架实现 99% 扩展效率;v6.1 提交的软件优化较 v6.0 最高提升 1.6 倍性能。
OpenAI 公布 AI 广告新体验,包含 Sponsored Agents、面向营销人员的工具,以及与 HubSpot、Shopify 的集成。该体验指向广告与营销场景,是 OpenAI 用 AI 重塑广告的一次探索。
OpenAI 展示如何借助 ChatGPT Work 与 Codex 的分析功能,把 AI 使用情况和支出转化为可追踪的业务价值。团队可据此了解 AI 的使用量与花费、识别培训需求,并将 AI 采纳程度与业务成果对应起来。
Hex 借助 GPT-6 Astra 将复杂分析转化为可视化报告,GPT-6 Astra 帮助其数据智能体把答案变成交互式可视化内容。员工乐于分享这些结果。
NVIDIA 公布 DSX MaxLPS 首个部署验证:Lambda 在 19 节点 HGX B200 集群上以 16 节点的电力预算将 token 吞吐提升 24%,每瓦性能提升 23%。