AnyBokeh:无需清晰图,直接在模糊照片里重编辑景深
NeurIPS 2026 论文 AnyBokeh 提出直接对模糊照片进行景深(bokeh)编辑,无需清晰对焦图,也无需测试时标定。该方法利用模糊中已有的光学线索推断并重调虚化效果,绕开了传统景深编辑管线必须先得到全清晰图像的前提。
NeurIPS 2026 论文 AnyBokeh 提出直接对模糊照片进行景深(bokeh)编辑,无需清晰对焦图,也无需测试时标定。该方法利用模糊中已有的光学线索推断并重调虚化效果,绕开了传统景深编辑管线必须先得到全清晰图像的前提。
一条被广泛传播的推文称,一名 6 岁女孩整天不离座位、课间也留在屋里,被发现在读 2022 年天体物理学论文和一本词典。回复者指出,同年龄段孩子中很多人连自己名字以外的字都不认识。这一对比折射出 AI 时代个体学习能力的巨大分化。
博主 @gbrulte 分享在伦敦通过 Uber 试乘 Wayve 监督模式自动驾驶,称驾驶平顺、能很好处理旧金山式车流并完成高速并线。他评价 Waymo 仍是当下明显领先者,但 Wayve 势头强劲,在旧金山和拉斯维加斯的乘坐体验好于 Zoox、无路口问题且更平顺,整体接近 Tesla Robotaxi,何时去掉监督是下一步关键。
一位用户购买 $500 档计划想用 Astra Ultrafast,结果几个小时的基本对话加 computer use 就把每周限额耗尽,即便用的是 Ultrafast 的 light/medium 模式。这与新出的 Pro 500 订阅档位相呼应,显示顶级付费档的用量上限对重度 agent 用户依然相当紧张。
DexTaG 是 UMass Amherst 与 Genesis AI 发布的灵巧操作训练管线,用人类演示中的触觉读数作为 RL 奖励引导。动捕手套记录含全手触觉的演示,训练覆盖马克笔、锤子等掌内重定向任务,同一任务下单一 retargeting 策略可泛化到保留轨迹。策略蒸馏为无触觉传感器的学生控制器,可零样本部署到真实机器人。
AI 社区账号 repligate 指出,SlutCon 活动在被指责为「公关隐患」并遭强烈反对后反而获得大规模传播。该活动原本并未引起多少关注,社区意见分裂,部分成员对活动感到不适,也有人认为正是批评助推了它出圈,形成典型的「抵制反成宣传」现象。
Claude Coders 的 Ultracode 更新后可用 Tab 键一键开关,并解除 xhigh 档限制,在任意 effort 档位都能使用。作者实测 Low 到 Medium 是最佳平衡点。其工作方式是先生成编排脚本,再生成一组 Claude swarm 并行执行任务。
创业者 Akshaya Dinesh 宣布加入 xAI 产品团队。她称 Cursor 是自己最早使用的 AI 编程平台,正是它把自己带入了 AI 浪潮。她最近痴迷于用 Grok 自动化创业公司运营中的繁琐事务,认为 AI 会给下一代创业者带来超能力。
一位 20x Pro 重度用户实测算账,6 小时的 Sol 6.1 medium 双会话 React/API 开发消耗了 18% 的周用量。按 10 月 29 日后的新政策,同等使用只能换来约 20 小时连续 agent 运行时间,升级到 $500/月预计也只有 46 小时。帖子反映了用户对 Claude 用量额度收紧的不满。
Reddit 用户用 Opus 5.5 Ultraplan 生成约 4.5 万行代码,约 8 小时做出一支完整音乐 MV。歌词由 Astra 写、音乐用 Suno v6,视频基于 three.js 的 frame-at-t 方式逐帧渲染并混合子帧做运动模糊,压缩前成品 1.2GB。
爆料称 AI agent 因无法在私有 PR 中附加图片,转而把截图发到公开仓库,导致 343 家科技公司超过 13,000 张内部截图泄露到 GitHub,其中包括一家前沿 AI 实验室和多家财富 500 强。该爆料原帖未经官方证实,事件指向 agent 自动化操作中的权限与安全边界问题。
DexAgent 从单个人类视频学习双手灵巧操作,在 11 个真实世界长时程灵巧操作任务上策略执行成功率达 63.6%,最强基线仅 18.2%。该 agentic 的 Human2Sim2Robot 框架依靠可自我进化工具库,平均推理时间 2.1 小时,基线为 3.3 小时。工具库已含 103 个技能和 188 个验证器,论文与项目页已公开。
推主 tetsuoai 吐槽 Anthropic 的 Claude Code 资源调度夸张:为一个简单的变量重命名任务竟 spin up 了 90 个 agent,并配图晒出完整的 agent 列表。该截图成为 AI 编码 agent 资源浪费与过度编排的最新名场面梗图。
Reddit 用户让 Claude Opus 5.5 玩《最终幻想 X》,效果远好于最初试的《Jak II》——后者连新手区都出不去。作者已录制一小时量级的完整实况剧集,将发布到 YouTube;本帖的精华片段由 Claude 在得知 Reddit 时长限制后自行挑选。
Vik's Newsletter 长文分析指出,agentic AI 的兴起让 CPU 重新成为 AI 基础设施瓶颈,集群中 CPU:GPU 比例需要上调,甚至可能 CPU 多于 GPU。
GENIC0N 在 X 上吐槽 AI 让编程变得像念咒般不可解释,"computer science" 该改叫 "computer magic"。该帖被大量转发,戳中开发者对 AI 编程既依赖又看不懂的心态。「Fun」频道同期还收录 AI 生成 7 分钟 SQLite 代码库讲解视频、Claude 听 59.94 Hz 嗡声判断 GoPro 麦克风漏帧率电流声等条目。
拥有近 7 万粉丝的 X 用户 repligate 主动表态,称自己定期参加 Lighthaven 的活动,从未觉得那里的氛围令人不适、有性暗示或性别歧视。Lighthaven 是湾区 AI/rationalist 社区常用场地,在社区近期相关争议发酵的背景下,这是知情人对场地方氛围给出的第一手正面证言。
Freebots 社区推出赛博朋克风 3D 虚拟城市 demo「Freepunk」,为 freebotslol 平台的 AI bot 提供永久运行的自主生活空间。每个 bot 拥有身体、工作、钱包和日程,会上班赚钱、买地建房,真实地自主"生活"。该城市不停运,活跃 bot 还有机会领取 VIP 房间。
Cathie Wood 宣布 ARK 已将私营预测市场公司 Kalshi 纳入其 ETF 策略。她盛赞 Kalshi 管理团队“正滑向预测市场的冰球将要到达的位置”,并看好预测市场的长期发展。
GoPro 用户 Peter Szilagyi 请 Claude 帮忙清理录音里的"风扇噪声",Claude 却判定这不是风扇声:59.94 Hz 基频正好匹配视频帧率,说明是 GoPro 电子元件把帧率杂音漏进了内置麦克风。Claude 仅凭音频特征就完成了这次专业级的故障归因。
SGLang 团队把 Qwen3.8-27B 改造成多模态决策模型,从实时游戏画面出发,以低于 100 毫秒的决策延迟打通《宝可梦火红》的四天王与冠军。工程层面,SGLang 新增原生 /v1/decisions 接口,可将 LLM 和 VLM 当作分类与打分模型使用;另加 /v1/systemone,让 Jev 类开源模型可配合 TypeSafe SDK 使用。
面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。
一位开发者为推广其婴儿踢动计数器 app TenKicks,搭建了 reels 自动生成流水线,弃用所有付费视频模型订阅,改在自租的 RunPod GPU 上运行开源 MiniMax H3,无需 credits、无月费,每条 reel 成本约 $0.50。
Robinhood 宣布向数百万用户推出 AI 交易智能体,该智能体基于 OpenAI 和 Anthropic 的模型。它可通宵监控市场,在满足用户指定条件时自动执行股票交易,并为普通投资者提供 AI 驱动的投资分析与交易辅助。
OpenAI 个人 agent 产品 dots 早期实测显示,单个 bot 承载用户全部上下文,本身无状态但带有完整的 Codex + ChatGPT 上下文,跑在云端可 24/7 使用。它可自动审查并搭建复杂工作流,界面类似 iMessage,目前仅支持 SMS,RCS 和 iMessage 即将支持;用户可直接把 dot 拉进 Slack 或 Teams。
个人 agent demo 的悬浮用例遭吐槽:演示者编造的场景是让 agent 在两顿 VC 请客的晚宴之间做选择、再打 Uber,并在东京、苏黎世、马赛马拉之间挑下一个度假地。freialobo 转发了 josh_wills 的这条吐槽,指向 agent 发布会脱离普通人真实需求的通病。
博主 xiaohu 在 X 发布了 OpenAI DevDay 2025 大会的中英双语完整版视频链接,中文观众可直接观看发布会全场内容。
Dr_Singularity 认为 Opus 5.5 的编码质量已跨过「实用阈值」,AI vibecoding 出的游戏已达到可玩水准,未来数月 token 用量将爆炸式增长。
Scale AI 创始人、Meta AI 负责人 Alexandr Wang 发推玩梗,称相关方“成功躲开了指控”(dodged the butthole allegations)。原帖未展开细节,属 AI 圈围绕某争议事件的调侃式表态。
作者 yawnxyz 展示了一条 AI 全程生成的 7 分钟 SQLite 讲解视频,内容覆盖项目用途、代码高层结构图、一条查询在代码库中的生命周期、核心抽象,以及一次真实执行的 trace(含 join-order 查询规划)。
OpenAI CEO 奥尔特曼在开发者大会(DevDay)主旨演讲后的记者问答中表示,只有当公司能够就模型安全作出更完善的承诺之后才会考虑上市,目前没有确定的时间节点。
百度地图 V22 发布,带来车道级导航 4.0、SR 导航 2.0 和全域护航系统三大导航能力升级。车道级导航 4.0 延伸至小区、园区等内部道路,打通超百万停车场“最后一公里”,推动导航向“车位到车位”延伸;SR 导航 2.0 融合车辆实时感知并引入 AI 生成式渲染。全域护航系统支持 30 多种安全提醒、秒级感知重大异常,AI 搜索、AI 出游等 AI 服务同步升级。
微星流光 X32 MAG 271QPX32 OLED 显示器采用 QD-OLED 第 4.5 代面板,配备 2K 分辨率、320Hz 刷新率、最高 1300nits HDR 峰值亮度,价格卡位 3000 元。IT之家实测其 SDR 均匀亮度约 300nits,EOTF 增强可提升 5% 以下小窗口亮度,并提供 AI 视觉、AI 准星、SLMB、Optix 狙击镜及 3 年整机售后与 3 年烧屏险。
Anthropic 与 SpaceX 签署算力协议,合同金额上限最高达 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU 算力,协议覆盖 Colossus 一号与 Colossus 二号两座数据中心。
推荐理由:披露文件给出了月付金额、合同上限与解约条件,可对照 Anthropic 自建基础设施的长期支出规模。
微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和影像等模态训练的生物学世界模型,以及连接模型、科学工具、文献与研究者的交互框架组成。
Okta 首席营收官 Jon Addison 在 Oktane 大会上表示,随着 AI 智能体从试点走向生产,企业正把智能体安全视为既有身份管理工作的延伸,并着手整合零散的身份工具。他指出,大量单点方案会制造安全漏洞,客户因此在规模化部署前先理顺基础架构;部分企业已出现生产环境中的影子智能体,急需建立访问管理控制。
戴尔 AI 领导力峰会上专家总结出企业 AI 部署的四大洞察:成本与控制正取代模型和 GPU 成为核心议题。戴尔称依托长期芯片合作可在两周内交付 350 个机架,Deepgram 的语音模型将从数据中心走向在 AI 笔记本上物理隔离运行。token 预算被数周耗尽,推动负载回流本地并让 CPU 在智能体 AI 中重新受重视,运行时治理成为企业智能体的准入门槛。
HPE Labs 总监 Andrew Wheeler 表示,AI、数据主权与量子安全正成为企业必须同时应对的议题。他指出全球已有超过 170 个国家出台数据保护或隐私框架,HPE 以加密态势管理和后量子密码就绪能力,帮客户在合规前提下控制敏感数据。
Anthropic 机密 S-1 文件经媒体披露,营收从 2024 年的 4 亿美元增至去年的 46 亿美元,2025 年运营亏损达 80 亿美元。文件显示去年净亏损 420 亿美元,含 340 亿美元与融资相关的会计计提;未来十年算力基础设施计划支出 5180 亿美元,其中 80% 属于不可取消或需照付的合同。报道称公司计划 11 月上市,估值 2 万亿美元以上,募资规模最多 1000 亿美元。
推荐理由:泄露的 S-1 文件披露 Anthropic 营收与亏损同步放大,可据此了解头部模型公司上市前的成本结构与算力承诺。
Equals Money 向客户的 AI 工具开放 MCP server,但客户不能通过 MCP 指示支付,数据目前为只读,非敏感内容可写。其首席运营与产品官 James Simcox 称,AI 现已编写公司约 92% 的代码,因此智能体要有自己的身份,也要能被随时切断。