Grab 与 OpenAI 把实用 AI 技能带到东南亚
OpenAI 与 Grab 推出区域项目 GO Forward with AI,帮助东南亚 30,000 名合作伙伴建立实用 AI 技能。该计划面向东南亚地区,以合作伙伴为对象提升实用 AI 能力。
OpenAI 与 Grab 推出区域项目 GO Forward with AI,帮助东南亚 30,000 名合作伙伴建立实用 AI 技能。该计划面向东南亚地区,以合作伙伴为对象提升实用 AI 能力。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,Simon Willison 记录了自己对这些新模型的定价观察与实测表现。
推荐理由:文章给出 Claude Opus 5.5、GPT-6 Sol 与 Luna 的最新定价和实测表现,可以看清这轮模型降价对调用成本的直接影响。
Meta 新智能体 Muse 被指在重走 Facebook M 的老路,同样主打餐厅预订、剧院购票等任务。Meta 于 2015 年推出的 Facebook M 仅开放给约 1 万名用户,因运行成本高昂未能推广,且被曝有真人幕后参与,该项目在 2018 年 1 月被取消,当时由 AI 处理的请求不超过 30%。作者对 Muse 能否成功存疑,并批评 Meta 在隐私问题上依旧麻木。
Anthropic 与 OpenAI 相继发布新模型,都主打能力小幅提升而成本明显下降。Anthropic 称 Opus 5.5 在默认设置下处理典型任务比 Opus 5 省约 40%,原因是 token 单价下降且完成任务耗用的 token 更少,并在网络安全、生物学等高风险领域沿用 Fable 5.1 的保护措施,被标记的请求可能被自动、透明地转给旧模型。
Latent Space 访谈 Google 研究员 John Platt,他介绍团队用 Gemini 驱动的 Empirical Research Assistance(ERA)把科学问题写成评分函数后自动搜索解,并已产出至少十篇论文。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新增的诊断能力与显式断点,以及可降低延迟和成本的控制项。这些改动让开发者能更清楚地排查缓存行为并控制推理开销。
微软表示,其主导的行业联合行动捣毁了一个名为 EvilTokens 的订阅制诈骗平台,该平台借助 AI 聊天机器人入侵了 1.2 万个微软账号。该平台 2 月在 Telegram 频道上线,初始收费 1500 美元,此后每月收取 500 美元。其核心是一个可分析受害者收件箱的 AI 聊天机器人,能识别可信关系与付款授权,并起草冒充熟人的邮件诱骗员工转账。
不列颠哥伦比亚省起诉 OpenAI,要求其为枪击案后 Tumbler Ridge 社区新建学校出资,并可能就应急响应等费用索赔。该省请求法院把 ChatGPT 模型规范中要求假设用户“善意”且“不探究意图”的两条指令改掉,并命令 OpenAI 定期接受独立审计。
推荐理由:诉讼要求法院改动 ChatGPT 模型规范中的指令,并主张 OpenAI 公开承诺的安全响应职责不能被否认。
Gary Marcus 发文讽刺 Sam Altman 在联合国安理会就 AI 作简报,称这如同让纵火犯编写消防规范。他引述 Drainpipe.io 创始人 Dominic Romano 的说法:此人并不真正了解底层技术,却带领一家制造安全危机观感的公司向安理会做简报,就像 Al Capone 向 FBI 讲安全。Marcus 也说不理解联合国为何要给 Altman 话筒。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 在 Amazon Bedrock 正式可用,API 定价显著低于 GPT-5.6 前代。GPT-6 Sol 面向开发与运维中反复出现的复杂任务,GPT-6 Luna 面向大批量重复任务,两者都支持显式提示词缓存。OpenAI 的内部事实性评测显示,GPT-6 Sol 的事实性错误约为 GPT-5.6 Sol 的一半。
推荐理由:两款模型按复杂任务与高频任务分层,API 定价低于 GPT-5.6 前代,可据此判断日常负载的选型。
@therealcornpop 在 TikTok 表示,用 AI 撰写 TikTok 和 YouTube 脚本会一眼被识破。除了 "it's not X, it's Y"、三段式、堆叠标点且破碎断奏式的写法这些 AI 腔调外,关键问题在于内容缺少明确的个人声音,也看不出作者对所谈话题有观点。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,称它们把前沿智能带入日常工作,区别在于能力与成本的不同平衡。
推荐理由:OpenAI 一次发布两款模型并给出能力与成本的不同取舍,读者可据此比较它们在日常工作场景中的定位。
AWS 宣布 Claude Opus 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,这是 Claude 5.5 系列的首个模型。
推荐理由:文章对比了 Claude Opus 5.5 与 Opus 5 在 token 效率、定价和安全分类器上的差异,并给出在 Bedrock 上调用该模型的代码示例。
Simon Willison 发布 llm-anthropic 0.29,该条目于 9 月 22 日发出,仅标注 llm 与 anthropic 两个标签,未披露具体更新内容。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 的新模型 Jev 提供支持。它支持 noul 是/否判断、choice 选项分类和 score 打分三类提问,需先用 llm keys set typesafe 配置 API key。
Cloudflare 发布 Worker Previews,为每个 Git 分支提供接近生产的隔离运行环境,各自拥有独立的代码、配置、URL、可观测性和状态。
推荐理由:每个 Git 分支都获得带独立状态与 URL 的预览环境,读者可据此了解智能体开发闭环怎样接入现有部署流程。
GPT-6 Astra 帮助 Parallel 的智能体将劳动力市场数据的调研与综合时间及成本各削减一半,对比对象为此前使用的模型。
Timnit Gebru 与 Emily M. Bender 在 MIT Technology Review 撰文指出,今夏多起 AI 事件中企业的宣传与专家后续复核结论并不一致。
小米发布 MiMo-V2.6 系列开放权重模型,包含原生全模态的 MiMo-V2.6-Pro、MiMo-V2.6-Flash 以及 MiMo-V2.6-Pro-UltraSpeed,其中 Pro 以 1.02T 总参数、42B 激活参数在 Artificial Analysis 智能指数上以 46 分成为该榜首位开放权重模型。
推荐理由:原文给出 MiMo-V2.6 的 RL 训练细节与开源清单,可对照开放权重模型的成本与复现门槛。
OpenAI 阐述对前沿模型及防护措施开展第三方 AI 安全评估的优先事项与原则,主张这类评估应严格、安全且独立。相关原则聚焦前沿模型的安全评估与防护措施,为有效开展第三方评估提供方向。
TypeSafe AI 发布 Jev,一种被称作 System One(决策模型)的新形态 LLM,仍然接收文本输入,但输出的是对应类别、是非题答案、评分及置信度的浮点数。
推荐理由:通过对比 Jev 与常规 LLM 在输出形态和计价上的差异,可以判断决策模型适合落在哪些分类与排序任务上。
TypeSafe AI 的 Diogo Almeida 在 Latent Space 播客中介绍新模型 Jev,把它定义为以代码为消费方、按每美元智能优化的 System 1 模型。
Gary Marcus 在联合国大会数字合作活动上发表发言,反对 AI 监管的两极化,并提出三项国际监管主张。三项主张包括设立国际咨询委员会在系统发布前评估风险与收益、发布后持续审计并有权要求整改或召回,以及就不部署已证明有害的架构达成国际协议。
Meta 将其内部使用九年多的分配问题求解库 Rebalancer 开源,采用 Apache 2.0 许可,同时提供 GitHub 仓库、文档和 PyPI 包。
NVIDIA 官方博客提出 AI 安全是工程问题,需要为智能体栈各层设置可强制执行的边界、明确责任人和可验证的保护证据。文章介绍了开源安全运行时 NVIDIA OpenShell,以及在其之上构建治理层的 Cisco DefenseClaw、用于扫描与校验智能体技能的 JFrog 等 Open Secure AI Alliance 伙伴实践。
Cloudflare 宣布 Python Workers 正式可用(GA),Python 成为 Cloudflare Workers 运行时的一等支持语言。
推荐理由:Python Workers 转为正式可用,文章说明了 WSGI/ASGI 连接器与 socket 桥接如何让框架、数据库驱动和 AI 库直接在 Workers 上运行。
RAND 发布报告,认为美国面对通往超级智能的不确定路径应采取"行动自由"战略,以保留所有选项并维持地缘政治优势。报告归纳出共存、拒止、加速三大家族共七种原型策略,并列出危险临近度、共存可行性、克制可行性等五项主要不确定性。其核心结论是美国需投入大量资金提前布局,即便重点只是保留可选性。
MIT Technology Review 用 15 个月整理边境监控塔位置与移民死亡记录,制作出美国边境“虚拟墙”沿线首张死亡综合地图,并分析了近 4000 例死亡。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线新的视频功能,让小型企业制作视频广告更简单。该公司也因此能更快把新的创意工具推向市场。
OpenAI 正与独立的数学与人工智能咨询小组(Advisory Group on Mathematics and Artificial Intelligence)合作,由该小组指导新兴 AI 结果的审查与传播。合作聚焦于 AI 成果的评审与对外沟通。
MIT Technology Review 调查发现,2015年至2026年初有超过1050人死在美国边境监控塔的覆盖范围内。调查把近4000处遗骸发现地与近600座监控塔的位置交叉比对,死亡出现在所分析塔中近三分之二的范围,其中2021年以来有超过110人死在 Anduril 自主监控塔范围内。CBP 回应称自主监控塔用 AI 检测并提醒探员,但该机构几乎没有评估这些塔的工作效果。
30岁的格拉西埃拉·戈麦斯·埃尔南德斯于2025年9月14日从蒂华纳东侧进入美国加州,在圣迭戈以东的奥泰山荒野失联,约三周后遗体被发现。
MIT Technology Review 发布调查,发现美国边境由政府部署的 AI 监控塔组成的“虚拟墙”存在塔体故障、算法漏检和警员不响应等系统性缺陷,并给出 CBP 可以采取的四项整改建议。
OpenAI 提出面向 AI 下一阶段的全球共享标准路径,呼吁通过协调的评估、报告与治理机制提升安全性。该主张强调在全球范围内统一评测与信息披露方式,以推进 AI 治理协作。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助他们构建并展示实用 AI 技能。
V7 使用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,用于完成复杂且带来源链接的工作。该方案将成本降低 78%,同时提升了准确率。
一名新入职大公司的工程师称,团队的规格、代码、测试、PRD、工单与报告全部由 Claude Code 生成,从 L1 到 L7 的工程师都在与 Claude 对话。他表示团队没人喜欢这种状态,高层反复强调推代码不是瓶颈,员工每天工作 12 到 13 小时只为按回车。
llm-keys-ui 0.1 插件发布,为 llm CLI 提供保存 API key 的网页界面,避免把 key 粘贴进智能体会话。运行 `uvx --with llm-keys-ui llm keys-ui --all` 会返回含局域网或 Tailscale 设备 IP 的 URL,之后可用 `llm keys get anthropic` 在 shell 命令中取用。
Google 在 Google I/O 2026 重组 Gemini 订阅体系,新增约 $100 的 AI Ultra 档,并把所有方案从固定月度配额改为基于算力的用量上限。
Dario Amodei 在呼吁 AI 行业“pace the frontier”后一周内可信度受损,Gary Marcus 质疑其选择的 METR 和 Accenture 能否独立监督 Anthropic。