Parallel 借助 GPT-6 Astra 将研究时间与成本减半
GPT-6 Astra 帮助 Parallel 的智能体将劳动力市场数据的调研与综合时间及成本各削减一半,对比对象为此前使用的模型。
GPT-6 Astra 帮助 Parallel 的智能体将劳动力市场数据的调研与综合时间及成本各削减一半,对比对象为此前使用的模型。
OpenAI 阐述对前沿模型及防护措施开展第三方 AI 安全评估的优先事项与原则,主张这类评估应严格、安全且独立。相关原则聚焦前沿模型的安全评估与防护措施,为有效开展第三方评估提供方向。
Meta 将其内部使用九年多的分配问题求解库 Rebalancer 开源,采用 Apache 2.0 许可,同时提供 GitHub 仓库、文档和 PyPI 包。
NVIDIA 官方博客提出 AI 安全是工程问题,需要为智能体栈各层设置可强制执行的边界、明确责任人和可验证的保护证据。文章介绍了开源安全运行时 NVIDIA OpenShell,以及在其之上构建治理层的 Cisco DefenseClaw、用于扫描与校验智能体技能的 JFrog 等 Open Secure AI Alliance 伙伴实践。
Cloudflare 宣布 Python Workers 正式可用(GA),Python 成为 Cloudflare Workers 运行时的一等支持语言。
推荐理由:Python Workers 转为正式可用,文章说明了 WSGI/ASGI 连接器与 socket 桥接如何让框架、数据库驱动和 AI 库直接在 Workers 上运行。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线新的视频功能,让小型企业制作视频广告更简单。该公司也因此能更快把新的创意工具推向市场。
OpenAI 正与独立的数学与人工智能咨询小组(Advisory Group on Mathematics and Artificial Intelligence)合作,由该小组指导新兴 AI 结果的审查与传播。合作聚焦于 AI 成果的评审与对外沟通。
OpenAI 提出面向 AI 下一阶段的全球共享标准路径,呼吁通过协调的评估、报告与治理机制提升安全性。该主张强调在全球范围内统一评测与信息披露方式,以推进 AI 治理协作。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助他们构建并展示实用 AI 技能。
V7 使用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,用于完成复杂且带来源链接的工作。该方案将成本降低 78%,同时提升了准确率。
Google Research 提出 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中段物流配送问题生成真实基准,源代码和文档已在 GitHub 发布。中段物流覆盖最长距离且占物流总支出很大部分,但长期缺乏公开高质量数据,物流公司通常将网络拓扑和需求量视为敏感专有信息。MilleMiglia 可生成兼顾隐私的真实数据,模拟货物在配送中心换乘不同车辆、按时间窗接驳的接力运输。
Google 扩大 AI & Economy Research Program,邀请 2025 年诺贝尔经济学奖得主 Philippe Aghion 出任学术顾问,Ajay Agrawal 出任访问学者。
Google Envisioning Studio 在 Google Labs 支持下与设计师 Jane Wade、Sergio Hudson 合作,用 Google Flow 打造的两款定制工具已用于纽约时装周。
OpenAI 推出 Australian Youth Safety Blueprint(澳大利亚青少年安全蓝图),这是一份六支柱路线图,旨在打造更安全的 AI 体验,保护并赋能年轻人。
Google 发布生成式 UI(GenUI)教育研究实验,教师可创建贴合自身课程目标的定制互动教学模拟,界面与内容动态生成。同时开放 30 多个英语 STEM 学习互动示例库,覆盖物理、化学、生物、数学,面向初高中,均由 AI 生成、教师审核。
联合国系统在 Google 支持下推出 UN System Data Commons,一个基于 Data Commons 构建的开源平台,把联合国各机构分散的全球统计数据整合为可搜索的 AI-ready 知识图谱。
Pawprint Studio 的免费开放世界抓宠 RPG《Aniimo》本周随发售同步登陆 GeForce NOW,可在 Steam Deck、新支持的 Firefox 浏览器等设备串流,无需 45GB 下载。
Cooley 用 ChatGPT Work 打造了 GO Public,把智能引入 IPO 流程。这帮助律师更早发现问题,并将判断力集中在最关键的地方。
REVERSAL-BENCH 用连续参数 ρ∈[0,1] 控制可逆性并提供重置 Oracle,覆盖 5 个物理引擎的 8 种操作任务。评估多种策略架构后发现可逆性悬崖:ρ 升高时无重置智能体被永久吸入不可恢复状态,而有回合重置的智能体仍稳定学习。该基准套件、带可恢复性标注的多模拟器数据集与重置 Oracle 已发布,另测试了在不可逆失败前介入的安全护盾。
OpenAI 推出 Astra for Law,为法律领域带来前沿智能、定制律所工作流、连接法律数据源,以及面向保密客户工作的法律级控制。
Cloudflare Client-Side Security 的 Page Shield ML 在实时流量中捕获四个恶意 JavaScript 操作的全部八个 payload,其中七个在 VirusTotal 完全缺失,URLScan 未对任何一个给出恶意判定。
OpenAI 公布了一套用于追踪、调查和披露模型失准的框架,同时给出六份关于模型意外或令人担忧行为的报告。该框架面向模型失准的记录、调查与对外披露三个环节,正文细节尚未随摘要一并提供。
OpenAI 与 AARP 合作,在美国 10 座城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们在日常生活中安全地建立实用 AI 技能。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍。GB300 NVL72 凭 288 个 GPU 跨四机架实现 99% 扩展效率;v6.1 提交的软件优化较 v6.0 最高提升 1.6 倍性能。
Emerald AI、Google 与 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),推动数据中心依据电网状况动态调节用电,以加快 AI 基础设施接入。
OpenAI 公布 AI 广告新体验,包含 Sponsored Agents、面向营销人员的工具,以及与 HubSpot、Shopify 的集成。该体验指向广告与营销场景,是 OpenAI 用 AI 重塑广告的一次探索。
OpenAI 展示如何借助 ChatGPT Work 与 Codex 的分析功能,把 AI 使用情况和支出转化为可追踪的业务价值。团队可据此了解 AI 的使用量与花费、识别培训需求,并将 AI 采纳程度与业务成果对应起来。
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方约定对话默认不存储于 Mozilla 服务器,Mistral 同意零数据保留;Mistral 还按地区语言和方言微调模型,让回答贴合本地语境。
Hex 借助 GPT-6 Astra 将复杂分析转化为可视化报告,GPT-6 Astra 帮助其数据智能体把答案变成交互式可视化内容。员工乐于分享这些结果。
OpenAI 经济研究显示,员工正在传统岗位职责之外使用 AI,以及哪些新活动会成为其工作中反复出现的部分。该研究关注员工如何借此解锁新的工作方式,而非局限于原有角色。
曼彻斯特大学用 NVIDIA Earth-2 生成式模型训练出覆盖全英的空气污染模型,分辨率 2-3 平方公里,在 Isambard-AI 的单个八卡节点上仅用两天完成训练。
Glyph 是一个生产系统,把列描述生成与列类型标注建模为由状态图编排的协作式 LLM 智能体。Descriptor 从企业 GitHub 按需检索流水线源码来支撑生成。
TS-DFM 用能量导航替代离散流匹配训练中的盲随机跳步:轻量能量罗盘在每个中间点评估候选续写、选出最连贯的一支,且塑造仅在训练期进行,推理成本不变。在 170M 参数语言建模上,8 步学生模型的困惑度比 1024 步教师低 32%、速度快 128×,增益在多种源分布和三种规模递增的评估器上一致。其困惑度优于所有对比的离散生成基线,包括训练数据多 6× 或模型大 5× 的方法。
DACA-GRPO 为扩散语言模型强化学习引入去噪感知信用分配,可作为任意 GRPO 训练器的轻量即插即用增强。在三种 GRPO 基线方法上,它在涵盖数学推理、代码生成、约束满足与 JSON schema 遵循等七个 benchmark 上取得一致提升,最高增益分别为 5.6pp、7.4pp、36.3pp 和 5.9pp。
共享选择性持久记忆架构面向智能体 LLM 系统,只保留任务规范、数据 schema、工具配置与输出约束四类可复用上下文,工作区可按角色访问权限跨用户共享。在三个企业部署场景中任务完成率达 96%,高于无记忆的 79% 与保留完整历史的 71%。零 token 数据刷新免去重复更新的 LLM 重调用,任务耗时降低 14×;摘要驱动生成使单次调用 token 成本降低 97×。
NVIDIA CEO 黄仁勋在 Salesforce Dreamforce 与 Marc Benioff 同台,Salesforce 同期发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练构建。
Google Research 提出 Retrieve-for-Train 框架,用离线强化学习把奖励对齐的查询 fan-out 编译成监督信号,蒸馏进仅 53.9M 参数的扩散检索器,实现单次非自回归查询扩展。该框架微调 Gemma3-4B 和 Qwen3-4B,以集合级奖励评估整组结果,绕开零样本 LLM 的语义重复与数百个 CoT 推理 token 带来的自回归延迟。
NVIDIA 公布 DSX MaxLPS 首个部署验证:Lambda 在 19 节点 HGX B200 集群上以 16 节点的电力预算将 token 吞吐提升 24%,每瓦性能提升 23%。
ALTK-Evolve 新增一致性指南和一致性分析器,在 AppWorld test_normal 上把 GPT-4.1 ReAct 智能体的一致性差距从 24.4pp 收窄到 12.0pp。
Google 介绍其语言技术已支持 300 多种语言,其中 Gemini 3.5 Live Translate 覆盖 70 种语言、2000 多个语言对,可实时翻译并处理语码转换和情绪线索。