跳到正文

#OpenAI

今日 32 条
今天9月30日周三
  1. AGI Hunt34

    开发者实测:GPT-5.6 Sol 发布数周后被悄悄降级性能

    一位在 Unity 开发中重度使用 GPT-5.6 Sol 的开发者实测指控,该模型发布后 3-4 周内性能持续下滑,连最初能解决的简单问题都会陷入无限循环,如今表现仅略好于价格便宜得多的 Grok。他据此认为 OpenAI 在用户养成使用习惯后,悄悄降级其判定为「太贵」的模型以提升利润率,且未向任何人说明。该指控属用户单方面感受,OpenAI 未回应,降级说法未经证实。

  2. AGI Hunt41

    Mollick 批评 OpenAI 产品线再度混乱重叠

    AI 学者 Ethan Mollick 发推批评 OpenAI 产品线在短暂聚焦 ChatGPT 主应用后再度混乱:Dot、Spaces、Pages 与本地/云端版 ChatGPT Work 等产品并存,功能定位交叉、权限划分不明。他此前曾期待 OpenAI 收敛产品线,如今认为公司又回到了多产品并行、边界模糊的老路。

  3. AGI Hunt29

    用户按场景拆分 AI 助手:Claude 管工作,ChatGPT 装杂事

    一位 X 用户按场景隔离 AI 工具:让 Claude 专门处理工作,ChatGPT、Instinct 等承担其他事务。起因是 ChatGPT 曾在工作场景中突然提起她的私人生活内容。她强调这并非担心隐私泄露,也不觉得“毛骨悚然”,而是认为模型不够聪明,判断不出这些信息在当前语境下完全无关,因此选择主动隔离不同产品的信息输入。

  4. AGI Hunt25

    人形机器人「像人」不是讨好用户:上身按普通人尺度设计是为采集数据

    作者评论某款人形机器人设计称,其上身按普通人尺度设计是为了方便数据采集与迁移,而非单纯追求「像人」。他认可该团队设计有自己的思考,也坦言有参考别人之处;并批评国内不少机器人创业公司虽有能力做出好产品,却因资本、管理层乃至技术团队缺乏承担风险的勇气,选择抄袭最火的产品。

  5. AGI Hunt30

    iOS 开发者 Dimillian 盛赞 Codex 云端环境:配合 dots 体验极佳

    iOS 开发者 Dimillian 转发并确认对 Codex 新发布的云端环境(cloud environments)给出好评,称迫不及待要详细介绍它的用法。被引用的开发者 mweinbach 表示这些环境「好得离谱」,尤其配合 dots 使用时体验出色。这是早期用户对 Open Codex 云端并行开发环境的高口碑反馈,具体细节待作者后续演示。

  6. AGI Hunt33

    用户视角:ChatGPT 积累的上下文成个人 Agent 护城河

    用户 AnneliesGamble 认为 OpenAI 的个人 AI agent 项目 Dots 有先发优势,因为 ChatGPT 已积累了大量关于她的个人上下文。Instinct、Muse、Grok Bot 等其他 agent 虽能连接她的各类应用,却无法替代长期对话历史形成的对她思维方式的理解。这折射出个人 agent 竞争中「上下文积累」可能比「应用集成」更关键。

  7. AGI Hunt31

    OpenAI 与数学社区矛盾:「地球更需要数学家而非前沿模型」被讥为最脱离现实

    一位评论者讥讽「这个星球想要数学家多过想要可用的前沿模型」是极度脱离现实的想法,此事折射出 OpenAI 与数学社区的矛盾。被引用的推文则以自嘲口吻反讽 OpenAI,把数学家的毕生热爱变成「无灵魂的垃圾抽奖游戏」,只为建工业界并不需要的前沿模型、撑起一场不会发生的一万亿美元 IPO。

  8. AGI Hunt35

    被问是否再推开源模型,Sam Altman 称将考虑,网友推荐 NVIDIA Nemotron

    OpenAI 的 Sam Altman 被追问是否会推出更多 gpt-oss 类开源模型,回应称「已经有很多优秀的开源模型,如果我们能在那里做出有用的事,我们会做的」。被追问「我们想要更多可微调的美国模型」时,他仅回答「我们会考虑一下」。发帖人调侃不想等 OpenAI 思考的话可直接看 NVIDIA 的 Nemotron 开源模型系列,折射社区对 OpenAI 开源意愿的不耐。

  9. AGI Hunt52

    剑桥学者 David Krueger 澄清:恶意 prompt 自传播两年前已有论文

    剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。

  10. Gary Marcus:The Road to AI We Can Trust68

    Gary Marcus 评纽约时报报道,OpenAI 在 Hugging Face 事件前数月已获警告

    Gary Marcus 引用纽约时报 Sheera Frenkel、Dustin Volz 和 Dylan Freedman 的报道称,OpenAI 员工与高管的往来记录显示,公司在 Hugging Face 事件发生前数月就已收到安全警告,且未把安全列为优先事项。

    推荐理由:借纽约时报披露的警告时间线,作者质疑企业自我监管以及 Jensen Huang 信任这些公司的说法。

  11. Gary Marcus:The Road to AI We Can Trust55

    Gary Marcus 点评白宫超级智能协议过于软弱

    Gary Marcus 发文点评白宫超级智能协议,认为其核心是签署方承诺不受监管、也不给公众发言权,只能靠信任。他质疑协议中所谓独立监督是否只是由大公司自己挑选的承包商承担,并追问两周前各方热议的 Pacing 议题为何消失。他还指出,Dario、Sam 和 Elon 都退缩了。

  12. AGI Hunt42

    博主盘点:OpenAI 高调风险警告屡发,半年内从未兑现

    博主 xeophon 盘点指出,OpenAI 的高调风险警告屡发却未兑现,其公关节奏是先在博客暗示某领域更强模型即将到来,随后不久就发布模型。他举例称,OpenAI 曾在2024年10月31日呼吁在18个月内(即2026年4月前)应对网络与生物风险,但截至发帖,期限已过,风险并未兑现。帖子质疑前沿实验室的风险警告更多是为模型发布造势,而非实质预警。

  13. IT之家48

    OpenAI 奥尔特曼:AI 影响将超过工业革命,现在是进入就业市场的最佳时机

    奥尔特曼在 OpenAI DevDay 上称 AI 的影响会超过工业革命,并发布 AI 智能体产品 Dots,认为现在是进入就业市场的最佳时机。他还称 token 是糟糕的指标,OpenAI 曾考虑放弃但客户不赞成;Dots 已替他处理通知和待办,让他不再那么依赖手机。他预计部分工作会彻底消失,但大规模失业的悲观预测低估了经济未来的增长。

9月29日周二
  1. MIT Technology Review:AI35

    The Download:Anthropic 的 AI 发现争议与 2026 气候科技公司名单

    Anthropic 宣布其新设分子生物学实验室作出首个发现:AI 智能体标记出一个此前未被收录的酶相关模式,生物学家质疑这能否算作发现。有研究者称其团队早已发现同一模式,并质疑该系统是否从他与 Claude 的对话中学习。MIT Technology Review 的 2026 气候科技公司名单将于 10 月 6 日发布,覆盖储能、核能、交通等领域。

  2. Wired AI53

    Timnit Gebru 认为 AI 不存在存在性威胁

    在 Wired 的访谈中,AI 研究者 Timnit Gebru 表示 AI 并不构成存在性威胁,认为这一叙事不只是分心,而且有害。她把这种叙事追溯到资助 Anthropic 早期融资并资助 METR 等机构的人群,称其为监管俘获的一部分,并援引 Lina Khan 提出的欺骗性营销、数据透明度与数据工人劳动剥削等现有法律本该管辖的事项。