ChatGPT Ads 扩展至东南亚和台湾
ChatGPT Ads 扩展至东南亚和台湾,为符合条件的商家提供触达更多地区用户的新渠道。该广告业务的覆盖范围已超过 60 个国家和地区。
ChatGPT Ads 扩展至东南亚和台湾,为符合条件的商家提供触达更多地区用户的新渠道。该广告业务的覆盖范围已超过 60 个国家和地区。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新增的诊断能力与显式断点,以及可降低延迟和成本的控制项。这些改动让开发者能更清楚地排查缓存行为并控制推理开销。
Simon Willison 发布 llm-anthropic 0.29,该条目于 9 月 22 日发出,仅标注 llm 与 anthropic 两个标签,未披露具体更新内容。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 的新模型 Jev 提供支持。它支持 noul 是/否判断、choice 选项分类和 score 打分三类提问,需先用 llm keys set typesafe 配置 API key。
Cloudflare 发布 Worker Previews,为每个 Git 分支提供接近生产的隔离运行环境,各自拥有独立的代码、配置、URL、可观测性和状态。
推荐理由:每个 Git 分支都获得带独立状态与 URL 的预览环境,读者可据此了解智能体开发闭环怎样接入现有部署流程。
Meta 将其内部使用九年多的分配问题求解库 Rebalancer 开源,采用 Apache 2.0 许可,同时提供 GitHub 仓库、文档和 PyPI 包。
Cloudflare 宣布 Python Workers 正式可用(GA),Python 成为 Cloudflare Workers 运行时的一等支持语言。
推荐理由:Python Workers 转为正式可用,文章说明了 WSGI/ASGI 连接器与 socket 桥接如何让框架、数据库驱动和 AI 库直接在 Workers 上运行。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线新的视频功能,让小型企业制作视频广告更简单。该公司也因此能更快把新的创意工具推向市场。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助他们构建并展示实用 AI 技能。
V7 使用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,用于完成复杂且带来源链接的工作。该方案将成本降低 78%,同时提升了准确率。
llm-keys-ui 0.1 插件发布,为 llm CLI 提供保存 API key 的网页界面,避免把 key 粘贴进智能体会话。运行 `uvx --with llm-keys-ui llm keys-ui --all` 会返回含局域网或 Tailscale 设备 IP 的 URL,之后可用 `llm keys get anthropic` 在 shell 命令中取用。
Google 在 Google I/O 2026 重组 Gemini 订阅体系,新增约 $100 的 AI Ultra 档,并把所有方案从固定月度配额改为基于算力的用量上限。
Google Envisioning Studio 在 Google Labs 支持下与设计师 Jane Wade、Sergio Hudson 合作,用 Google Flow 打造的两款定制工具已用于纽约时装周。
联合国系统在 Google 支持下推出 UN System Data Commons,一个基于 Data Commons 构建的开源平台,把联合国各机构分散的全球统计数据整合为可搜索的 AI-ready 知识图谱。
Pawprint Studio 的免费开放世界抓宠 RPG《Aniimo》本周随发售同步登陆 GeForce NOW,可在 Steam Deck、新支持的 Firefox 浏览器等设备串流,无需 45GB 下载。
Cooley 用 ChatGPT Work 打造了 GO Public,把智能引入 IPO 流程。这帮助律师更早发现问题,并将判断力集中在最关键的地方。
OpenAI 推出 Astra for Law,为法律领域带来前沿智能、定制律所工作流、连接法律数据源,以及面向保密客户工作的法律级控制。
Cloudflare Client-Side Security 的 Page Shield ML 在实时流量中捕获四个恶意 JavaScript 操作的全部八个 payload,其中七个在 VirusTotal 完全缺失,URLScan 未对任何一个给出恶意判定。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍。GB300 NVL72 凭 288 个 GPU 跨四机架实现 99% 扩展效率;v6.1 提交的软件优化较 v6.0 最高提升 1.6 倍性能。
OpenAI 公布 AI 广告新体验,包含 Sponsored Agents、面向营销人员的工具,以及与 HubSpot、Shopify 的集成。该体验指向广告与营销场景,是 OpenAI 用 AI 重塑广告的一次探索。
OpenAI 展示如何借助 ChatGPT Work 与 Codex 的分析功能,把 AI 使用情况和支出转化为可追踪的业务价值。团队可据此了解 AI 的使用量与花费、识别培训需求,并将 AI 采纳程度与业务成果对应起来。
Hex 借助 GPT-6 Astra 将复杂分析转化为可视化报告,GPT-6 Astra 帮助其数据智能体把答案变成交互式可视化内容。员工乐于分享这些结果。
NotebookLM 是 Google 的 AI 研究助手,只依据用户上传的 PDF、URL、Google Docs、Google Slides、YouTube 链接或粘贴文本作答并给出引用,找不到答案时会明说。
NVIDIA 公布 DSX MaxLPS 首个部署验证:Lambda 在 19 节点 HGX B200 集群上以 16 节点的电力预算将 token 吞吐提升 24%,每瓦性能提升 23%。
Google 介绍其语言技术已支持 300 多种语言,其中 Gemini 3.5 Live Translate 覆盖 70 种语言、2000 多个语言对,可实时翻译并处理语码转换和情绪线索。
Cloudflare 推出 Disallow AI Training 设置,网站可在保留搜索收录的同时拒绝同一爬虫把内容用于 AI 训练,Apple、Google、Microsoft 已遵守或承诺在指定时间内遵守。
推荐理由:Cloudflare 用分级爬虫控制替代一刀切屏蔽,并对比了谷歌、微软、苹果在训练退出上的实际支持程度。
Cloudflare Workers 新增资源级访问控制与 Metadata Read-Only、Content Read-Only、Editor、Admin 四个角色,可只把单个 Worker 的权限授予指定团队成员或智能体,即日起面向所有客户开放。
费城儿童医院(CHOP)用基于 MONAI 的开源 AI 心脏建模服务,把生成解剖精确心脏模型的时间从 4 小时压缩到几秒,全美已有 20 多家儿童医院运行心脏建模项目。
Fyxer 用 OpenAI 模型、微调、记忆功能与真实用户反馈打造 AI 行政助理,可整理收件箱并按每位用户自己的语气起草邮件。真实用户反馈被用于持续改进,以换取用户信任。
César de la Fuente 的实验室用 Codex 和 ChatGPT 在现存与已灭绝生物的基因组中搜索抗菌候选分子,目标是应对耐药感染。
OpenAI 在 ChatGPT Work 中推出 Data agent,用户可以用自然语言连接公司数据、挖掘洞察并构建交互式看板。OpenAI 表示现在所有人都能用它来处理数据。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并搭载 GPT-6 Astra。该产品用于金融研究与建模,并可生成可直接交付客户的材料。
OpenAI 发布 Agents API,这是一个用于构建和上线云端智能体的托管服务。该服务由 Codex harness 驱动,支持编排、长时间运行的会话以及工具调用。
推荐理由:原文交代了 Agents API 的托管定位与 Codex harness 的编排能力,读者可据此判断云端智能体的落地形态。
在纪录片短片《Love, Rendered》中,Google DeepMind 与 Darren Aronofsky 的 Primordial Soup 合作,用 AI 逐帧重现 Burt 与 Ethelle Shatz 结婚 70 余年却未留下影像的相遇记忆。
Google Search 上线 Live Game Feed,搜索进行中的比赛即可看到实时逐回合更新、集锦与 AI 洞察,目前在美国移动端英文版可用。Search 还新增 matchup carousel 与更细的球员、联盟数据,并支持关联 Yahoo Fantasy 或 Sleeper 账户,用 AI Mode 获取首发/替补与 waiver wire 建议。
一名 MIT 研究者用 GPT-5.6 Sol 搭配 Codex,自主运行量子计算实验并分析实验结果。GPT-5.6 Sol 还参与校准量子比特,这些实验步骤由模型自主完成。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴合用户原意。
1Password 使用 Codex 将工程生产力提升 21%,并让工程师快速构建新功能和内部工具。其工程师在维持严格安全政策的同时,将新功能和内部工具推进到生产就绪。
GitHub 发布研究预览 Project HydraFusion,在 GitHub Copilot CLI 中通过运行时多模型编排为每个请求选择执行方案。它目前会在 Single、Cascade、Critique 三种模式中选择,用户通过 /experimental 和 /model 选用,费用按所调用模型的 token 标准费率计。
推荐理由:原文给出三种多模型编排模式,并列出三个编码基准上的质量与成本对比,便于评估这种编排方式的取舍。
Legora 使用 GPT-6 Astra 在数分钟内审查了 41 份文档,并找出全部 4 处植入错误。在这一财务审查工作流中,其性能提升近 40%。