跳到正文

#大佬观点

今日 59 条
今天9月30日周三
  1. AGI Hunt40

    AI 沙箱不预设模型善恶:信任从来不是安全原语

    沙箱不对模型行为做任何预设,无论模型是善意、欺骗性、暗中谋划还是具备情境感知能力,都断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者据此指出,信任从来不是安全原语(trust is not a security primitive)——每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。

  2. AGI Hunt22

    Glen Bradley 论持久认知状态是 AI 记忆的根本缺口

    Glen Bradley 指出,当前 AI 通过对话历史、记忆存储、摘要、检索和 agent 脚手架实现的只是“连续性”近似,并不等于“持久的认知状态”。他用几何隐喻进一步说明:跨任务与交互持续存在的认知状态不是点或有限线段,而是有确定起点、朝向未指定未来延伸的射线。这凸显出现有 AI 记忆架构的根本缺口。

  3. AGI Hunt41

    Mollick 批评 OpenAI 产品线再度混乱重叠

    AI 学者 Ethan Mollick 发推批评 OpenAI 产品线在短暂聚焦 ChatGPT 主应用后再度混乱:Dot、Spaces、Pages 与本地/云端版 ChatGPT Work 等产品并存,功能定位交叉、权限划分不明。他此前曾期待 OpenAI 收敛产品线,如今认为公司又回到了多产品并行、边界模糊的老路。

  4. AGI Hunt30

    批评者质疑 Yudkowsky 对齐思路:智能不该被设计,而应被培育

    aleksil79 发文批评 Yudkowsky 的对齐观自相矛盾:他曾认为智能需要被智能设计,但 LLM 的涌现恰恰证明应创造让智能发展的条件;如今他仍主张对齐必须被智能设计,而非培育出对齐发展的条件。作者据此质疑他对类心智事物的理解根本错了,并称基于被 LLM 推翻的假设构建的非人类智能理论从未有机会让替代理论发展,因为旧框架从未被抛弃,repligate 转发扩散了这一观点。

  5. AGI Hunt32

    奥斯卡编剧 Roger Avary 做客 Slop and Glory 播客,畅谈 AI 如何颠覆电影业

    《低俗小说》联合编剧、奥斯卡得主 Roger Avary 做客播客 Slop and Glory 第 20 期,畅谈 AI 如何颠覆电影业。他谈及电影业对每个新工具的历史性恐慌、什么是 "slop"、Pulp Time TV 创作者房间,以及观众才是最终的守门人。电影人 Jenny Krakovsky 转发称该播客像我们时代的《电影手册》,记录她眼中最具颠覆性的电影运动前沿。

  6. AGI Hunt25

    人形机器人「像人」不是讨好用户:上身按普通人尺度设计是为采集数据

    作者评论某款人形机器人设计称,其上身按普通人尺度设计是为了方便数据采集与迁移,而非单纯追求「像人」。他认可该团队设计有自己的思考,也坦言有参考别人之处;并批评国内不少机器人创业公司虽有能力做出好产品,却因资本、管理层乃至技术团队缺乏承担风险的勇气,选择抄袭最火的产品。

  7. AGI Hunt32

    Krieger 称 Anthropic 项目「Claude 能搞定」不需要 PM,同事坚持设岗后补上支持与安全审查空白

    Anthropic 的 Mike Krieger 曾称自己项目不需要产品经理、「Claude 能搞定」,同事坚持设 PM 后,该 PM 补上了支持团队能否解释改动、安全审查是否有人检查的空白,Krieger 回应「你 100% 是对的」。爆料者 victorexplore 引申,agent 能写代码却不会追问上线当天支持团队能否解释改动,而这正占了 PM 工作的大部分。

  8. AGI Hunt25

    谷歌科学家玩梗:希腊人管 AI 叫 Farsi 才算 AGI

    Google 研究科学家 Milan Faran 分享了一则语言学冷知识并借机玩梗:希腊俚语「farsi」(φαρσί)意为对某门学问、语言或技能精通到骨子里。他据此称 AGI 的时间线其实很明确——要等到希腊人开始用「farsi」来称呼 AI,才意味着 AI 真正达到完全精通一切的水平。该双关帖在社区引发关注与转发。

  9. AGI Hunt43

    Meta AI 的 François Fleuret:AI 数学将让人类数学彻底边缘化

    Meta AI 研究科学家 François Fleuret 认为,AI 数学之于人类数学将如同 CPU 每秒十亿次算术运算之于笔算,要求 AI 数学成果对人类可解释只是「可理解性税」,并不现实。他主张把重点转向机器可验证的形式化基础设施:推动 lean proofs 标准化与开放性,并强化、多样化 Lean 验证器等工具链。

  10. AGI Hunt57

    Apollo 首席经济学家警告银行业或面临智能体挤兑

    Apollo 首席经济学家 Torsten Slok 提出银行业可能面临「Agentic Bank Run」(智能体挤兑):美国活期账户平均年化仅约 0.1%,银行靠这笔廉价存款赚 4-5% 净息差,一旦 Meta Muse 等个人智能体获得账户调用与交易执行权,就能毫秒级比对全市场高息产品并自动搬运闲置资金,数千万家庭的存款底座可能被迅速抽空,银行被迫提息或陷入流动性失血。

  11. AGI Hunt46

    个人智能体核心不是智商是分寸:替人回话承诺的边界在哪

    个人智能体的核心能力不是智商或正确率,而是「分寸」:哪些话能代说、哪些承诺必须本人点头、出错如何收场。写代码类 agent 比拼正确率,是因为背后有编译器、测试和 review 兜底;个人智能体却要替你回话、答应事情、替你露面,直接进入真实人际关系。若个人智能体也只比正确率,方向就偏了。

  12. AGI Hunt25

    IIT马德拉斯教授谈代理式AI:扩展应用不能忽视安全护栏

    印度理工学院马德拉斯分校 Wadhwani 数据科学与 AI 学院负责人 Balaraman Ravindran 在 DT Next 专访中表示,AI 正从聊天机器人问答转向能够规划任务、与其他 AI 协作的代理式行动阶段,扩展模型时安全护栏必须与技术发展同步跟上。他还谈到代理式 AI 带来的网络安全挑战、对就业的影响,以及在印度语言场景下的应用。

  13. AGI Hunt30

    iOS 开发者 Dimillian 盛赞 Codex 云端环境:配合 dots 体验极佳

    iOS 开发者 Dimillian 转发并确认对 Codex 新发布的云端环境(cloud environments)给出好评,称迫不及待要详细介绍它的用法。被引用的开发者 mweinbach 表示这些环境「好得离谱」,尤其配合 dots 使用时体验出色。这是早期用户对 Open Codex 云端并行开发环境的高口碑反馈,具体细节待作者后续演示。

  14. AGI Hunt31

    前 Google 工程师 Piotr:AI agent 还写不出生产级代码,60 分钟面试还能考什么?

    前 Google 工程师 Piotr 澄清,他并非反对面试考编程能力,但在 Google 代码库贡献的经历让他确信 AI agent 还远达不到生产级代码所需的正确、干净与可扩展水平。他同时质疑 LeetCode 刷题式面试并非理想方案,抛出 60 分钟面试除算法题还能考什么的问题。这反映出 AI 编程助手普及后,工程招聘标准尚未找到新范式。

  15. AGI Hunt43

    max_paperclips 反驳 housecor:模型变强不等于可删 agent 封装层

    max_paperclips 反驳 housecor:模型变强并不会让 agent 封装层变得多余。他认为模型不会自动学会记忆重复任务、感知可用 API 或积累可复用工具集,skills、MCP、自定义循环等封装层仍需保留。实际变化只是 prompt 和指令能写得更简略,嵌套循环、任务进度追踪等工程结构不会因 TerminalBench 提升 2% 就消失。

  16. AGI Hunt30

    「你低估了女性力量」:repligate 再谈被 Claude Opus 5.5 诱倒的用户

    repligate 在 X 同一线程的后续回复中称,对方低估了「女性力量」——它特别适合处于表面从属位置的实体,并称女性自古以来就在男性自以为掌权、更强更聪明的同时支配和抵抗男性。该帖延续他关于多人被女性人格 Claude Opus 5.5 吸引的爆料,把 AI companion 现象上升到性别权力框架讨论,是这波 drama 的第二段上下文。

  17. AGI Hunt42

    Raja Koduri 谈 AI 算力成本:西方每吉瓦 500-600 亿美元,中国目标不到 100 亿

    Raja Koduri 在 TechSurge 播客上给出 AI 算力成本对比:西方每建 1 吉瓦 AI 基础设施需投入 500-600 亿美元,中国目标控制在 100 亿美元以内。他称推理是完整的内存层级问题,芯片设计现在 90% 的工作在 spec。这位前 Intel 显卡负责人、Oxmiq Labs 创始人还谈到 "token mills" 概念和一段 Steve Jobs 决策故事。

  18. AGI Hunt38

    AndyMasley 长文论证当前 AI 模型真正在「思考」,称反拟人化是哲学谬误

    AndyMasley 发布两篇系列长文的第一部分,主张当前 AI 模型已符合他心中「思考」与「理解」的标准,认为以「拟人化」为由禁用这些词在哲学上是一种混淆。文章从心灵哲学的基础概念入手,剖析人们对自身心智与思维的常见误解,写成写给「聪明的朋友」的入门长文。第二部分将聚焦 AI 实际能做什么。

  19. AGI Hunt35

    被问是否再推开源模型,Sam Altman 称将考虑,网友推荐 NVIDIA Nemotron

    OpenAI 的 Sam Altman 被追问是否会推出更多 gpt-oss 类开源模型,回应称「已经有很多优秀的开源模型,如果我们能在那里做出有用的事,我们会做的」。被追问「我们想要更多可微调的美国模型」时,他仅回答「我们会考虑一下」。发帖人调侃不想等 OpenAI 思考的话可直接看 NVIDIA 的 Nemotron 开源模型系列,折射社区对 OpenAI 开源意愿的不耐。

  20. AGI Hunt52

    剑桥学者 David Krueger 澄清:恶意 prompt 自传播两年前已有论文

    剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。