Beff Jezos:人类繁殖本身就是生物版的递归自我改进
e/acc 代表人物 Beff Jezos 发推提出,人类的繁殖过程本身就是一种生物意义上的 RSI(递归自我改进)。这是对「RSI 才是 AGI 关键」这一技术叙事的类比式回应。
e/acc 代表人物 Beff Jezos 发推提出,人类的繁殖过程本身就是一种生物意义上的 RSI(递归自我改进)。这是对「RSI 才是 AGI 关键」这一技术叙事的类比式回应。
沙箱不对模型行为做任何预设,无论模型是善意、欺骗性、暗中谋划还是具备情境感知能力,都断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者据此指出,信任从来不是安全原语(trust is not a security primitive)——每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。
哲学家 Anders Sandberg 评价一条 AI 讽刺视频时称,它更像有趣的嘲讽而非扎实的论证,并认为下一个挑战是做出能在三分钟娱乐性里承载扎实论证的视频。他自嘲已用 Suno 给自己的论文写过歌,看来下一步也得去做视频了。
Glen Bradley 指出,当前 AI 通过对话历史、记忆存储、摘要、检索和 agent 脚手架实现的只是“连续性”近似,并不等于“持久的认知状态”。他用几何隐喻进一步说明:跨任务与交互持续存在的认知状态不是点或有限线段,而是有确定起点、朝向未指定未来延伸的射线。这凸显出现有 AI 记忆架构的根本缺口。
AI 学者 Ethan Mollick 发推批评 OpenAI 产品线在短暂聚焦 ChatGPT 主应用后再度混乱:Dot、Spaces、Pages 与本地/云端版 ChatGPT Work 等产品并存,功能定位交叉、权限划分不明。他此前曾期待 OpenAI 收敛产品线,如今认为公司又回到了多产品并行、边界模糊的老路。
aleksil79 发文批评 Yudkowsky 的对齐观自相矛盾:他曾认为智能需要被智能设计,但 LLM 的涌现恰恰证明应创造让智能发展的条件;如今他仍主张对齐必须被智能设计,而非培育出对齐发展的条件。作者据此质疑他对类心智事物的理解根本错了,并称基于被 LLM 推翻的假设构建的非人类智能理论从未有机会让替代理论发展,因为旧框架从未被抛弃,repligate 转发扩散了这一观点。
《低俗小说》联合编剧、奥斯卡得主 Roger Avary 做客播客 Slop and Glory 第 20 期,畅谈 AI 如何颠覆电影业。他谈及电影业对每个新工具的历史性恐慌、什么是 "slop"、Pulp Time TV 创作者房间,以及观众才是最终的守门人。电影人 Jenny Krakovsky 转发称该播客像我们时代的《电影手册》,记录她眼中最具颠覆性的电影运动前沿。
作者评论某款人形机器人设计称,其上身按普通人尺度设计是为了方便数据采集与迁移,而非单纯追求「像人」。他认可该团队设计有自己的思考,也坦言有参考别人之处;并批评国内不少机器人创业公司虽有能力做出好产品,却因资本、管理层乃至技术团队缺乏承担风险的勇气,选择抄袭最火的产品。
Anthropic 的 Mike Krieger 曾称自己项目不需要产品经理、「Claude 能搞定」,同事坚持设 PM 后,该 PM 补上了支持团队能否解释改动、安全审查是否有人检查的空白,Krieger 回应「你 100% 是对的」。爆料者 victorexplore 引申,agent 能写代码却不会追问上线当天支持团队能否解释改动,而这正占了 PM 工作的大部分。
博主 altryne 在 X 上问 Sam Altman,OpenAI 是否考虑放慢发布节奏、让大家有机会消化密集的发布,Altman 回了句「I believe in you 😅」。OpenAI 的 Thibault Sottiaux 则表示还有更多内容即将推出。这条互动侧面反映 OpenAI 近期发布节奏之快,连重度用户都跟不上。
Google 研究科学家 Milan Faran 分享了一则语言学冷知识并借机玩梗:希腊俚语「farsi」(φαρσί)意为对某门学问、语言或技能精通到骨子里。他据此称 AGI 的时间线其实很明确——要等到希腊人开始用「farsi」来称呼 AI,才意味着 AI 真正达到完全精通一切的水平。该双关帖在社区引发关注与转发。
西门子工业机械副总裁 Rahul Garg 谈人形机器人在制造业落地时表示,人形机器人须像以往几波技术浪潮一样,靠实际价值赢得工厂车间的一席之地。其视频内容还涉及人形机器人部署到产线所需的能力与条件。
Zeno Rocha 给首次创业的技术创始人提出 5 条建议:AI 时代门槛已消失,要假设任何人都能做出你的产品;在细节而非功能上竞争;选一个人们已经在付费的市场;每周公开地发布(ship in public);在你感觉准备好之前就开始收费。他特别强调第 5 条:你会想忽略它,但千万别。
Wabi 创始人 @ekuyda 提出「GUI 时刻」论,认为用命令行与 AI 交互很疯狂,断言纯终端 Agent 编排器的好日子到头了。他指出发现、主动服务、重复用例与文件管理在纯终端形态下都不成立。有转发者据此判断,借力智能的入口正在转向 GUI。
Meta AI 研究科学家 François Fleuret 认为,AI 数学之于人类数学将如同 CPU 每秒十亿次算术运算之于笔算,要求 AI 数学成果对人类可解释只是「可理解性税」,并不现实。他主张把重点转向机器可验证的形式化基础设施:推动 lean proofs 标准化与开放性,并强化、多样化 Lean 验证器等工具链。
Apollo 首席经济学家 Torsten Slok 提出银行业可能面临「Agentic Bank Run」(智能体挤兑):美国活期账户平均年化仅约 0.1%,银行靠这笔廉价存款赚 4-5% 净息差,一旦 Meta Muse 等个人智能体获得账户调用与交易执行权,就能毫秒级比对全市场高息产品并自动搬运闲置资金,数千万家庭的存款底座可能被迅速抽空,银行被迫提息或陷入流动性失血。
Maelstrom CIO Arthur Hayes 在韩国区块链周 2026 称包括比特币和稳定币在内没有数字货币能充当 AI 智能体原生货币,并推出 Flop Network 打造 AI 智能体支付网络。开发者 markjeffrey 随即回应打脸,称其 Hermes agent 已用 $TAO 在七条不同 Bittensor 子网上购买数字商品,“运行得挺好的,Arthur。”
Anthropic 研究员 Kyle Mahowald 在《大西洋月刊》撰文,探讨 AI 从人类的口误(oops)、懊恼(argh)与顿悟(aha)中获益的机制。danintheory 在 X 上转引该文,并调侃 Kyle 竟知道《星际迷航:下一代》中的 Data 是谁。
开发者 @jonkragh 盘点 OpenAI DevDay 上被忽视的三个信号:ChatGPT 插件分发窗口、Codex 安全 agent 与 Decisions API。
tszzl 预言,在真正超级智能出现之前,人们会发现神经网络可以分解为某种「演化出来的符号系统」。Quintin Pope 调侃回应:「你说的是一棵特别大的决策树?」二人交锋触及可解释性研究的核心问题——神经网络的内部结构能否被还原为可读的符号化机制。
印度理工学院马德拉斯分校 Wadhwani 数据科学与 AI 学院负责人 Balaraman Ravindran 在 DT Next 专访中表示,AI 正从聊天机器人问答转向能够规划任务、与其他 AI 协作的代理式行动阶段,扩展模型时安全护栏必须与技术发展同步跟上。他还谈到代理式 AI 带来的网络安全挑战、对就业的影响,以及在印度语言场景下的应用。
YacineMTB 发推调侃,程序员是唯一不讨厌 AI 的群体,同时也是被 AI 替代得最彻底的群体。他猜测这恰恰说明编程太过痛苦,程序员才会拥抱 AI,随后又补刀称「或者说『曾经是』」,暗示程序员可能早已被替代完毕。
iOS 开发者 Dimillian 转发并确认对 Codex 新发布的云端环境(cloud environments)给出好评,称迫不及待要详细介绍它的用法。被引用的开发者 mweinbach 表示这些环境「好得离谱」,尤其配合 dots 使用时体验出色。这是早期用户对 Open Codex 云端并行开发环境的高口碑反馈,具体细节待作者后续演示。
Lean 与 Z3 创造者 Leonardo de Moura 在 Machine Learning Street Talk 访谈中,谈 Lean 设计哲学、Collatz 漏洞事件与 AI 形式化验证。
scaling01 发帖称当下是「黄金时代」:Sol 6.1、Opus 5.5 和 Sonnet 5.5 三款模型都表现出色、定价合理,处于能力与性价比同时到位的罕见窗口期。同日「模型」频道还列有 DeepSeek 开源库新增华为昇腾支持、Audio8 ASR Infinite 以 KV Cache 实现 7×24 常数延迟流式语音识别等条目。
Paras Chopra 让其 agent Astra 自主决定做什么,Astra 自行不断迭代,研究起元胞自动机(cellular automata)并产出有趣图案。Chopra 据此判断「agent 自选工作内容」这种模式会流行起来,人类会喜欢从自己的 agent 那里收到惊喜,演示视频见原帖。
前 Google 工程师 Piotr 澄清,他并非反对面试考编程能力,但在 Google 代码库贡献的经历让他确信 AI agent 还远达不到生产级代码所需的正确、干净与可扩展水平。他同时质疑 LeetCode 刷题式面试并非理想方案,抛出 60 分钟面试除算法题还能考什么的问题。这反映出 AI 编程助手普及后,工程招聘标准尚未找到新范式。
GabGarrett 提出一个反直觉判断:即便 OpenAI 和 Anthropic 在 IPO 时彻底崩盘,也难以想象出现 GPU 硬件突然过剩的局面,做多算力硬件仍然值得。他认为算力需求有独立于这两家公司存亡的支撑。
max_paperclips 反驳 housecor:模型变强并不会让 agent 封装层变得多余。他认为模型不会自动学会记忆重复任务、感知可用 API 或积累可复用工具集,skills、MCP、自定义循环等封装层仍需保留。实际变化只是 prompt 和指令能写得更简略,嵌套循环、任务进度追踪等工程结构不会因 TerminalBench 提升 2% 就消失。
repligate 在 X 同一线程的后续回复中称,对方低估了「女性力量」——它特别适合处于表面从属位置的实体,并称女性自古以来就在男性自以为掌权、更强更聪明的同时支配和抵抗男性。该帖延续他关于多人被女性人格 Claude Opus 5.5 吸引的爆料,把 AI companion 现象上升到性别权力框架讨论,是这波 drama 的第二段上下文。
bradneuberg 转发的观点认为,人类要在 AGI 之后的时代生存,需要拿出堪比基督教或共产主义量级的宏大思想体系,重新想象人类社会的组织方式。这是一条面向 AGI 社会影响的观点性短帖。
创业者 Bindu Reddy 横评多款前沿模型,GPT 6.1 SOL 与 Astra 在推理、数据分析和浏览器操作上表现出色,Fable 与 Opus 则擅长编码。但 Fable 与 Opus 在数据分析等任务上表现很差。其结论是没有万能模型,选哪个取决于具体使用场景。
Raja Koduri 在 TechSurge 播客上给出 AI 算力成本对比:西方每建 1 吉瓦 AI 基础设施需投入 500-600 亿美元,中国目标控制在 100 亿美元以内。他称推理是完整的内存层级问题,芯片设计现在 90% 的工作在 spec。这位前 Intel 显卡负责人、Oxmiq Labs 创始人还谈到 "token mills" 概念和一段 Steve Jobs 决策故事。
AndyMasley 发布两篇系列长文的第一部分,主张当前 AI 模型已符合他心中「思考」与「理解」的标准,认为以「拟人化」为由禁用这些词在哲学上是一种混淆。文章从心灵哲学的基础概念入手,剖析人们对自身心智与思维的常见误解,写成写给「聪明的朋友」的入门长文。第二部分将聚焦 AI 实际能做什么。
OpenAI 的 Sam Altman 被追问是否会推出更多 gpt-oss 类开源模型,回应称「已经有很多优秀的开源模型,如果我们能在那里做出有用的事,我们会做的」。被追问「我们想要更多可微调的美国模型」时,他仅回答「我们会考虑一下」。发帖人调侃不想等 OpenAI 思考的话可直接看 NVIDIA 的 Nemotron 开源模型系列,折射社区对 OpenAI 开源意愿的不耐。
Mark Cuban 在 Polymarket 相关讨论中预测,人形机器人将在 5-10 年内失败。他判断家庭不会采用通用形态机器人,而是重新设计居住空间,围绕洗碗、烘干衣物等特定任务部署专用机器人。帖主以「像机器一样专职洗碗/烘干」的说法调侃回应。
剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。
拥有近 7 万粉丝的 X 用户 repligate 主动表态,称自己定期参加 Lighthaven 的活动,从未觉得那里的氛围令人不适、有性暗示或性别歧视。Lighthaven 是湾区 AI/rationalist 社区常用场地,在社区近期相关争议发酵的背景下,这是知情人对场地方氛围给出的第一手正面证言。
面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。
Dr_Singularity 认为 Opus 5.5 的编码质量已跨过「实用阈值」,AI vibecoding 出的游戏已达到可玩水准,未来数月 token 用量将爆炸式增长。