AI 让一切同质化?瓶颈不在技术,而在人的想象力与野心
面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。
面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。
一位开发者为推广其婴儿踢动计数器 app TenKicks,搭建了 reels 自动生成流水线,弃用所有付费视频模型订阅,改在自租的 RunPod GPU 上运行开源 MiniMax H3,无需 credits、无月费,每条 reel 成本约 $0.50。
Robinhood 宣布向数百万用户推出 AI 交易智能体,该智能体基于 OpenAI 和 Anthropic 的模型。它可通宵监控市场,在满足用户指定条件时自动执行股票交易,并为普通投资者提供 AI 驱动的投资分析与交易辅助。
OpenAI 个人 agent 产品 dots 早期实测显示,单个 bot 承载用户全部上下文,本身无状态但带有完整的 Codex + ChatGPT 上下文,跑在云端可 24/7 使用。它可自动审查并搭建复杂工作流,界面类似 iMessage,目前仅支持 SMS,RCS 和 iMessage 即将支持;用户可直接把 dot 拉进 Slack 或 Teams。
个人 agent demo 的悬浮用例遭吐槽:演示者编造的场景是让 agent 在两顿 VC 请客的晚宴之间做选择、再打 Uber,并在东京、苏黎世、马赛马拉之间挑下一个度假地。freialobo 转发了 josh_wills 的这条吐槽,指向 agent 发布会脱离普通人真实需求的通病。
博主 xiaohu 在 X 发布了 OpenAI DevDay 2025 大会的中英双语完整版视频链接,中文观众可直接观看发布会全场内容。
Dr_Singularity 认为 Opus 5.5 的编码质量已跨过「实用阈值」,AI vibecoding 出的游戏已达到可玩水准,未来数月 token 用量将爆炸式增长。
Scale AI 创始人、Meta AI 负责人 Alexandr Wang 发推玩梗,称相关方“成功躲开了指控”(dodged the butthole allegations)。原帖未展开细节,属 AI 圈围绕某争议事件的调侃式表态。
作者 yawnxyz 展示了一条 AI 全程生成的 7 分钟 SQLite 讲解视频,内容覆盖项目用途、代码高层结构图、一条查询在代码库中的生命周期、核心抽象,以及一次真实执行的 trace(含 join-order 查询规划)。
OpenAI CEO 奥尔特曼在开发者大会(DevDay)主旨演讲后的记者问答中表示,只有当公司能够就模型安全作出更完善的承诺之后才会考虑上市,目前没有确定的时间节点。
百度地图 V22 发布,带来车道级导航 4.0、SR 导航 2.0 和全域护航系统三大导航能力升级。车道级导航 4.0 延伸至小区、园区等内部道路,打通超百万停车场“最后一公里”,推动导航向“车位到车位”延伸;SR 导航 2.0 融合车辆实时感知并引入 AI 生成式渲染。全域护航系统支持 30 多种安全提醒、秒级感知重大异常,AI 搜索、AI 出游等 AI 服务同步升级。
微星流光 X32 MAG 271QPX32 OLED 显示器采用 QD-OLED 第 4.5 代面板,配备 2K 分辨率、320Hz 刷新率、最高 1300nits HDR 峰值亮度,价格卡位 3000 元。IT之家实测其 SDR 均匀亮度约 300nits,EOTF 增强可提升 5% 以下小窗口亮度,并提供 AI 视觉、AI 准星、SLMB、Optix 狙击镜及 3 年整机售后与 3 年烧屏险。
Anthropic 与 SpaceX 签署算力协议,合同金额上限最高达 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU 算力,协议覆盖 Colossus 一号与 Colossus 二号两座数据中心。
推荐理由:披露文件给出了月付金额、合同上限与解约条件,可对照 Anthropic 自建基础设施的长期支出规模。
微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和影像等模态训练的生物学世界模型,以及连接模型、科学工具、文献与研究者的交互框架组成。
Okta 首席营收官 Jon Addison 在 Oktane 大会上表示,随着 AI 智能体从试点走向生产,企业正把智能体安全视为既有身份管理工作的延伸,并着手整合零散的身份工具。他指出,大量单点方案会制造安全漏洞,客户因此在规模化部署前先理顺基础架构;部分企业已出现生产环境中的影子智能体,急需建立访问管理控制。
戴尔 AI 领导力峰会上专家总结出企业 AI 部署的四大洞察:成本与控制正取代模型和 GPU 成为核心议题。戴尔称依托长期芯片合作可在两周内交付 350 个机架,Deepgram 的语音模型将从数据中心走向在 AI 笔记本上物理隔离运行。token 预算被数周耗尽,推动负载回流本地并让 CPU 在智能体 AI 中重新受重视,运行时治理成为企业智能体的准入门槛。
HPE Labs 总监 Andrew Wheeler 表示,AI、数据主权与量子安全正成为企业必须同时应对的议题。他指出全球已有超过 170 个国家出台数据保护或隐私框架,HPE 以加密态势管理和后量子密码就绪能力,帮客户在合规前提下控制敏感数据。
Anthropic 机密 S-1 文件经媒体披露,营收从 2024 年的 4 亿美元增至去年的 46 亿美元,2025 年运营亏损达 80 亿美元。文件显示去年净亏损 420 亿美元,含 340 亿美元与融资相关的会计计提;未来十年算力基础设施计划支出 5180 亿美元,其中 80% 属于不可取消或需照付的合同。报道称公司计划 11 月上市,估值 2 万亿美元以上,募资规模最多 1000 亿美元。
推荐理由:泄露的 S-1 文件披露 Anthropic 营收与亏损同步放大,可据此了解头部模型公司上市前的成本结构与算力承诺。
Equals Money 向客户的 AI 工具开放 MCP server,但客户不能通过 MCP 指示支付,数据目前为只读,非敏感内容可写。其首席运营与产品官 James Simcox 称,AI 现已编写公司约 92% 的代码,因此智能体要有自己的身份,也要能被随时切断。
OpenAI 在 DevDay 开发者大会上发布 ChatGPT 常驻 AI 智能体 Dots,用户给出目标后智能体可继续推进任务,并会从反馈中学习用户偏好。Dots 由 GPT-6 Astra 驱动,每个智能体配有可随时查看的独立云端计算机,可通过插件访问 4000 多个应用,也能在桌面、网页、移动端以及 Slack 和 Teams 中接续同一项目上下文。
推荐理由:原文给出常驻智能体的运行方式与权限限制,读者可据此判断这类产品在企业协作中的落地条件。
面向房地产和医疗行业的 AI 自动化初创公司 EliseAI 完成 $350M 融资,由 Andreessen Horowitz 与 Bessemer 联合领投,估值达 $4B。资金将用于扩展自动化功能,并增聘工程师、软件部署与销售人员。其平台管理超过美国六分之一公寓,医疗平台被逾 3,500 家机构使用,聊天机器人可处理最高 95% 的来电咨询。
OpenAI 在 DevDay 上发布 GPT-6.1 Sol,官方称其性能与 GPT-6 Astra 大致相当,但成本大幅降低,每百万 token 定价 10 美分,约为 GPT-6.0 Astra 的一半。
推荐理由:对比 DevDay 公布的基准与定价可以看出,Sol 以约一半价格提供 Astra 级能力,并面向长时编码负载。
世界模型创业公司 General Intuition 完成 2.2 亿美元融资,估值 62 亿美元,投资方包括 Valor Equity Partners、Atreides、Seven Seven Six、Point72、Khosla Ventures 和 General Catalyst。
Gary Marcus 引用纽约时报 Sheera Frenkel、Dustin Volz 和 Dylan Freedman 的报道称,OpenAI 员工与高管的往来记录显示,公司在 Hugging Face 事件发生前数月就已收到安全警告,且未把安全列为优先事项。
推荐理由:借纽约时报披露的警告时间线,作者质疑企业自我监管以及 Jensen Huang 信任这些公司的说法。
Gary Marcus 发文点评白宫超级智能协议,认为其核心是签署方承诺不受监管、也不给公众发言权,只能靠信任。他质疑协议中所谓独立监督是否只是由大公司自己挑选的承包商承担,并追问两周前各方热议的 Pacing 议题为何消失。他还指出,Dario、Sam 和 Elon 都退缩了。
bennash 分享了自己最喜欢的 AI 生成歌曲之一《21st Century Blues》的真人翻拍版,主题是 21 世纪离婚后重新寻找爱情,他本人也承认作品"很怪"。该作品展示了 AI 音乐生成从成品走向二次创作的可能性。
Sam Altman 在 DevDay 主题演讲后的记者问答中表示,OpenAI 在能够对模型安全做出更有把握的承诺之前不会 IPO,且没有明确时间表。他说随着模型能力大幅跃升,公司必须能够做出有信心的安全声明,但同时承认等待太久才上市对世界不利。这番表态把上市时间与安全进展直接挂钩,此前数月围绕 OpenAI 及同行能否兑现安全承诺的争议不断。
据Bloomberg和WSJ报道,特朗普在与AI行业领袖共进午餐后明确表示不会出台新的联邦AI监管规则,并强调行业自我监管非常重要。他称司法部和FBI等现有机构天然就有监管能力,尽管硅谷和公众对AI安全护栏的呼声日益高涨,仍承诺不会让监管阻碍AI行业发展。
Angaisb 在 x 上展示用 GPT-6 Astra 等模型可以非常轻松地生成 Minecraft 游戏生物,并附带了演示视频。演示体现了这类模型在游戏内容创作上的能力。
一位图像创作者实测后认为,T2I 任务上 Krea 2 比 Qwen 2.1 更胜一筹。同样提示词增强下,Qwen 2.1 出图偏真实照片质感、纹理发灰,默认人物偏亚洲/动漫风,需加「West cartoon semi-realistic style」纠正。他偏好半写实卡通风格,此前用 Krea 2 Turbo 工作流几乎次次命中。
jeffreyajewett 发帖指出,当前算力市场真正稀缺的是没有被长期采购协议(offtake)锁定的算力容量,若所有可用 MW 和 GPU 都被预留给最安全的大客户,下一代巨头将失去成长竞争的机会。他主张市场应刻意为尚未显山露水的公司保留容量。
在 OpenAI DevDay 期间的记者会和媒体问答中,Sam Altman 回应了近期黑客事件,表示公司正加大在安全与对齐方面的投入。他明确表示,OpenAI 在能够对模型安全作出可信承诺之前不会启动 IPO,现在仓促上市并不明智,因为不想承受华尔街带来的额外压力。
前 FTC 官员、AI 评论人 Neil Chilson 发问:为什么人们还把 OpenAI 和 Anthropic 称为「lab」?他指出这两家早已是创造大量营收的庞大商业实体,应该摘掉「实验室」标签,正视自己作为真正公司的身份及其附带的责任与监管期待。这一提法触及了 AI 行业叙事与商业现实之间的落差。
一位用户收到 OpenAI 的竞品调研问卷,发现选项列表几乎只聚焦 Claude,仿佛其他竞品不存在。该用户称自己一到用量上限就切换到 Grok 等其他模型,不想为此多付钱给 ChatGPT。帖文侧面反映了用户在多家模型间的切换行为,以及 OpenAI 对 Anthropic 的竞争关注。
OpenRouter 研究负责人 Peter Walker 发布首期数据简报,指出平台推理量持续激增,2026 年 2 月 6 日可能是历史上最后一天人类消耗的 token 多于 agent。
推荐理由:OpenRouter 数据简报给出了 token 用量、开源模型支出与降价后用量弹性的具体倍数,可作为观察 agent 消耗趋势的参照。
OpenAI 发布 GPT 6.1 Sol,缓存价格直降 50%,但博主点评其能力仍不敌 Anthropic。Sonnet 5.5 跑分已超过 GPT 6.1 Astra,而 6.1 Astra 因安全原因迟迟未放出;GLM 5.3 则被点名批为「跑太快、不够安全」,折射头部厂商在安全叙事与竞赛速度间的张力。
SFTMill 开源,通过 OpenAI 兼容端点对任意现有 LLM 做离策略蒸馏,把行为目标转成完整训练数据集。工作流用 YAML 定义课程表,由 LLM 生成任务,教师模型逐题求解产出覆盖微调目标的问答数据集。作者建议任务生成至少用 Qwen 3.8 27B(medium 档),更弱的模型质量不够。
作者从 Grokbot 连续三天的直播中记录下 11 个真实运行的 agent 团队,并整理 Twitter 上走红的架构图归纳出几条组织模式。
CMU 团队的论文 Gym-Anything 被 NeurIPS 接收,该框架能把任意软件自动转换为 computer-use agent 的训练与测试环境,并全部开源。
博主 eyishazyer 在 X 发帖称,Anthropic 为 Claude 用户「送上一份大礼」,并附上链接,但帖文未展开细节。具体更新内容需点开链接确认。