跳到正文

#OpenAI

今日 125 条
9月18日周五
9月17日周四
  1. Dwarkesh Patel:Podcast & Blog68

    Noam Brown 谈智能体集群、对齐与递归自我改进

    OpenAI 研究员 Noam Brown 在 Dwarkesh Patel 的播客中谈多智能体、对齐与递归自我改进。他提到 OpenAI 上周用 10,000 个智能体、88 小时消耗 1300 亿 token 解决了一个千禧年大奖难题(Navier-Stokes),但认为多智能体的功劳不到 10%,核心是模型本身足够强。

    推荐理由:对话从 OpenAI 内部视角说明多智能体并行扩展的收益与代价,并解释递归自我改进为何受实验算力制约。

  2. OpenAI:官网动态53

    OpenAI 公布模型失准追踪与披露框架

    OpenAI 公布了一套用于追踪、调查和披露模型失准的框架,同时给出六份关于模型意外或令人担忧行为的报告。该框架面向模型失准的记录、调查与对外披露三个环节,正文细节尚未随摘要一并提供。

9月16日周三
9月15日周二
  1. Latent Space54

    第三方评估标准 AEF-1 出炉,xAI、OpenAI 与 Anthropic 共同签署

    AI Evaluator Forum 发布 AEF-1,作为独立第三方 AI 评估的拟议基线,覆盖访问权限、利益冲突、资助关系、回避与透明度。Anthropic 的 Dario 同期在个人博客中提出嵌入式评估员方案,承诺单向提供办公室工位、门禁徽章、公司笔记本,以及接近内部风险评估团队的权限,并将其视为 pacing 承诺可被验证的关键一步。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. Gary Marcus:The Road to AI We Can Trust50

    Gary Marcus 反驳 AI 将在 2030 年前消灭人类的说法

    Gary Marcus 撰文回应前 OpenAI、Anthropic 员工 Jacob Coxon 关于人类五年内可能不复存在的言论,认为 AI 在 2030 年前消灭人类几乎不可能。他认为过去十年的 Doomer 言论反而让前沿 AI 公司更富有、更强大,且未产出可落地的安全方案。他主张区分存在性风险与灾难性风险,认为生物武器、虚假信息、网络攻击和教育受损等灾难性风险更值得关注。

  2. OpenAI:官网动态68

    OpenAI 在 API 中上线 GPT-Live-1,支持全双工语音对话

    OpenAI 将 GPT-Live-1 引入 API,为开发者带来自然的全双工语音对话能力。该模型具备更强的指令遵循能力,支持自定义音色,并提供电话(telephony)支持。

    推荐理由:原文给出 GPT-Live-1 在 API 中的全双工语音、自定义音色与电话接入能力,可据此判断语音应用的接入变化。

9月9日周三
  1. OpenAI:官网动态63

    OpenAI 发布 GPT-6 Astra,面向企业场景的最强模型

    OpenAI 发布 GPT-6 Astra,称其为企业场景下能力最强的模型,具备进阶推理、computer use 以及更强的写作与设计判断能力。官方目前只给出能力方向,未披露评测数据、定价与开放时间。

    推荐理由:官方给出 GPT-6 Astra 面向企业场景的定位与能力方向,可作为观察工作型模型演进的一手参考。

9月8日周二
  1. OpenAI:官网动态87

    OpenAI 分享 AI 生成的纳维-斯托克斯千禧年难题解答与 Lean 形式化证明

    OpenAI 表示正在分享一份由 AI 生成的纳维-斯托克斯千禧年难题解答,包含一份说明文档和一份 Lean 形式化证明。该条目目前只有这一句简要描述,未提供更多细节。

    推荐理由:AI 生成的纳维-斯托克斯千禧年难题解答以 Lean 形式化证明一并公开,读者可关注机器产出数学证明的呈现方式。

9月7日周一
9月6日周日