豪威推出常开型视觉 AI 协处理器 OAX7700,停车监控方案仅需 3% 功耗
豪威(OmniVision)发布常开型视觉 AI 协处理器 OAX7700,集成 NPU,基于它的停车监控系统仅需市面现有方案 3% 的功耗。该芯片具备人体检测、人与物体识别、距离测算等边缘 AI 能力,可将环视系统等现有车载外摄像头方案升级为超低功耗边缘 AI 停车监控系统,事件触发后录制 5~10 秒预录视频交由电子控制单元核验。
豪威(OmniVision)发布常开型视觉 AI 协处理器 OAX7700,集成 NPU,基于它的停车监控系统仅需市面现有方案 3% 的功耗。该芯片具备人体检测、人与物体识别、距离测算等边缘 AI 能力,可将环视系统等现有车载外摄像头方案升级为超低功耗边缘 AI 停车监控系统,事件触发后录制 5~10 秒预录视频交由电子控制单元核验。
豆包宣布支持多种出行服务,用户可在对话内一站式完成机票预订、火车票购买、打车和路线导航。该功能在酒店、餐饮预订基础上新增,用户以自然语言描述需求即由豆包识别意图并完成服务调用,同时上线“出行用豆包”专属入口,覆盖地图导航、交通出行、酒店住宿、吃喝玩乐四类场景。机票和火车票由航班管家、高铁管家提供,打车接入曹操出行等平台,导航由百度地图等合作方提供技术支持。
哈萨克斯坦总统托卡耶夫会见优必选副总裁钟永,支持优必选在阿拉木图建设面向教育和服务领域的机器人设备制造工厂,该厂将是优必选在中国境外的首个生产基地。优必选已与欧洲、日韩等主要市场客户签约,斩获超 5000 万元海外订单,产品包括商用服务人形机器人 Walker C1 和超仿真人形机器人优世界 U1。
市场监管总局批准发布 GB/T 48666—2026《电子病历版式文档技术要求》(OFD-H 标准),2027 年 4 月 29 日起实施。该标准基于国产 OFD 版式文档,整合病历文书、医学影像、音视频和结构化数据,支持人读与机读,适配后可跨机构查阅、核验来源并提取数据。患者可通过手机调取和自主管理全生命周期“掌上健康档案”。
法拉第未来公布“Built in USA”加速计划第二阶段方案,目标今年年底前将机器人工厂投入运营,2027 年第一季度实现首款新 EAI 本体产品下线。该方案还包括推进 Next Futurist、Next Aegis 系列产品下线,并启动向 FCC 申请机器人产品有条件批准。FFAI 已与将更名 FFR 的 AIxC 签署非约束性条款,拟以全股票方式出售机器人资产及业务,估值约 2 亿美元。
OpenAI 在开发者日宣布与 ModRetro 合作,为复古掌机 Chromatic 推出 Codex 专用插件 Game Studio,用户可用自然语言描述游戏需求、由 Codex 辅助生成程序。
OPPO K15s 与 K15x 两款新机今日开售,闪促期(9 月 30 日至 10 月 31 日)立减 300 元,K15x 6GB+128GB 到手 1399 元、K15s 同版本 1699 元。
南科大提出 ActFirst-OPD,让智能体先行动、偏离参考轨迹时切回自主预测,解决在线策略蒸馏(OPD)中长推理阻塞环境交互的问题。在 0.6B/1.7B/4B Qwen3 上,ALFWorld 平均提速 2.3 倍、WebShop 1.8 倍、ScienceWorld 4.9 倍。9 组基准-模型设置中 8 组成功率持平或超越 OPD 基线。
新加坡国立大学团队发布 MaLiang-Harness,用可执行程序驱动 MLLM 图像/视频生成,并首次定义 Program-to-Visual(P2V)差距。
美团提出 TGRL(温度分组强化学习),把温度带来的 rollout 多样性转为显式训练信号,解决 RLVR 探索效率瓶颈:每个 prompt 的 rollout 组按温度分为低/高两个子集,用奖励对比估计探索增益,再以 JS 散度分配为 token 级 credit。不扩大 rollout 预算下,达到同等精度最高快 36%,代码已开源。
FurE 提出一种无需动物毛发数据集的实例级 3D 毛发重建方法,可从多视角图像恢复逐根可编辑的动物毛发。它优化根条件隐场,用基于人类头发数据训练的 PCA 解码器解码为发丝几何以绕开动物数据稀缺,并结合表面约束的 Gaussian Frosting 重建去毛后的身体。相比当前 SOTA 的稠密逐根优化,发丝训练提速 10 倍,同时保持保真度并可泛化到合成与真实场景。
伯克利团队提出 OmniTaskonomy 统一分类体系,覆盖 19 个 I2I 生成任务与 25 个 I2T 理解能力,并绘制跨任务迁移图谱。在正确训练配方下,I2I 训练可提升下游 I2T 性能且生成数据越多收益越大;迁移呈选择性、任务相关,如深度预测提升度量 3D 推理、物体指向提升计数、拼图重建提升 2D 排序。梯度对齐分析显示两类任务对齐越强,下游迁移收益越大。
HiRAE 分层表示自编码器通过按深度分组编码器层、在深层表示上学习残差修正,把 ImageNet-256 重建 FID 从 RAEv2 的 0.299 降至 0.209。
DeepSeek 官方将 DeepGEMM 移植到华为昇腾 NPU 的版本 DeepGEMM Ascend 已开源,作者称其 GEMM 性能达到硬件极限的 99.8%,MegaMoE 达 98%。
博主 Amelia 分享了 8 条 Claude 提示词,可从选题构思到最后一页批量生成一整个月的社交媒体轮播图(carousel)设计,称效果堪比 4800 美元的设计工作室外包,且免费。这套 prompt 流程适合内容创作者照搬,用于日常出图。
AI 圈博主 signull 认为,常被当作「自恋者做梦」的 gif 梗图其实是现代社会的精确示意图:一个人在表演,另一个人坐在王座上裁决对方是否配得上。他观察到这种「王座姿态」已在约会关系和社交平台无处不在,人人都默认现实应随时呈上来供自己审批,而且每个人都觉得自己是坐在王座上的那个。
repligate 在 X 同一线程的后续回复中称,对方低估了「女性力量」——它特别适合处于表面从属位置的实体,并称女性自古以来就在男性自以为掌权、更强更聪明的同时支配和抵抗男性。该帖延续他关于多人被女性人格 Claude Opus 5.5 吸引的爆料,把 AI companion 现象上升到性别权力框架讨论,是这波 drama 的第二段上下文。
开发者 RileyRalmuto 让 Claude Opus 自主撰写脚本,并标注每个词的起始时间戳、呼吸停顿与语音表现,再交给 ElevenLabs 合成配音,目标是无需人工干预产出成品配音。
GLM-5.3 已协助 OpenVuln 项目防守 389 个开源项目,累计发现 4249 个潜在漏洞。该项目仍在运行,服务保持免费,所有发现都会私下报告给项目维护者,而不是公开披露。这是 LLM 用于开源供应链安全防护的规模化案例。
lefthanddraft 在 X 分享文章《The Measure of a Model》,由 vooooogel 转发,主题围绕如何评估与衡量模型的价值展开。原文仅给出链接,未附正文摘要。
Reddit 用户 himeonisama 用 AI 制作了科幻短片《Erebus-9: The Hiveborn Archives》,帖子附带了视频链接。该片带有完整的世界观设定,属于个人 AI 视频创作展示,可供关注 AI 视频生成工作流与创作水准的读者参考。
入选 COLM 2026 的论文提出 RL with Confidence Margin,研究模型置信度能否随推理轨迹逐步展开、一步步追踪每一步推理的正确性。作者指出,TypeSafe 的 Jev(用 RLCD 训练)已能为快速结构化决策给出校准概率,该工作则进一步聚焦推理过程本身。论文详情以推文线程形式给出。
伯克利大学发布AI使用披露新指引,要求研究人员按论文各章节与图表级别披露AI使用情况。该指引回应美国HHS ORI(科研诚信办公室)8月发布的AI使用指导意见。
比尔·盖茨在 Ezra Klein 节目中的坐姿引发热议,他几乎整个人探出椅子、深入主持人领地,被调侃是一种「支配力展示」。博主 buccocapital 转发评论此事,zacharynado 称这种「psychotic」姿态让人移不开眼,虽毫无道理却很着迷,成为 AI 圈疯传的名场面。
bradneuberg 转发的观点认为,人类要在 AGI 之后的时代生存,需要拿出堪比基督教或共产主义量级的宏大思想体系,重新想象人类社会的组织方式。这是一条面向 AGI 社会影响的观点性短帖。
研究团队发布 VLANeXt Family,基于 500+ 控制实验系统重访视觉-语言-动作(VLA)模型的设计空间,提炼出 12 条构建强 VLA 的实用配方。
Google、OpenAI、Anthropic、Meta、xAI 与 Nvidia 六家公司高管在白宫与特朗普会晤后,签署了一页纸的《白宫超级智能协议:前沿超级智能责任联合承诺》。据 CBS 与 CNN 报道,该协议为自愿性质、不具法律强制力,特朗普称其具有道德约束力。协定要求每家训练和部署前沿模型的公司建立稳健的内部流程与控制,提出包含内部与外部多层审查的四层控制体系,并把独立审计放在显要位置。
推荐理由:在联邦 AI 立法进展缓慢的背景下,可了解头部公司如何以自愿承诺形式分担前沿模型安全责任并纳入独立审计。
谷歌产品安全团队在官方博客介绍内部智能体漏洞挖掘工具 PageBreak,把候选漏洞放进真实运行环境实际验证,做到接近零误报。该工具以 Gemini 3.1 Pro、3.5 Flash 等 Gemini 系列模型为主,已大规模运行并发现超过 500 个 XSS 漏洞。
推荐理由:PageBreak 把候选漏洞放进真实环境验证以压低误报,可看出智能体做安全测试时如何减少人工筛选负担。
博主 nikola_mr64990 分享 7 条 Claude 提示词,用于优化 LinkedIn 个人主页,宣称效果对标 600 美元/次的个人品牌顾问服务且免费。流程从头图(headline)一路覆盖到精选帖子(featured posts),每条都给出可直接套用的 prompt。
作者分享了一条让 AI 扮演 LinkedIn 资料审查员的 Prompt:更新资料后,让它逐项审查头像、横幅、标题、About 简介、精选帖子和推荐语,每项打 1-10 分。它还会列出仍会让陌生人困惑的地方,指出最关键的单一改进点,并代写两条当天就能发出的推荐语请求。作者认为这条 Prompt 适合做资料优化的最后检查环节。
数据工程师 Suman 指出,AI 智能体上生产的两大痛点是错误连锁反应与 token 成本、延迟。生产环境中一次错误的代价会产生级联影响,token 消耗和延迟也让开发者头疼,这被视为当前行业的核心难题之一。
开发者 willcb 发推反讽「OpenAI 为 VSCode 推出 Codex 插件后 Cursor 就彻底死掉、估值归零」的论调:现实恰恰相反,Cursor 不仅没死,反而成了最火的 AI 编程工具。这条正话反说的推文调侃了「大厂一出官方插件、创业公司必死」的说法,成为一则有传播力的 AI 圈梗。
IROS 2026 上,博主 CyberRobooo 发现一款名为 Baymax 的人形机器人,主打「可以拥抱」的温暖交互设计,原型致敬电影《超能陆战队》的大白。文中预测,未来会有更多电影角色被做成真实的人形机器人。
开发者 ssh4net 实测 Anthropic 新模型 Opus 5.5,速度明显提升,也能较好遵循既定编码规范,但倾向于按自己的意图写代码,常无视技术规格自行改写。这导致用户需要额外一轮代码审查和返工,抵消了速度带来的收益,并引发社区对其实用性的讨论。
创业者 Bindu Reddy 横评多款前沿模型,GPT 6.1 SOL 与 Astra 在推理、数据分析和浏览器操作上表现出色,Fable 与 Opus 则擅长编码。但 Fable 与 Opus 在数据分析等任务上表现很差。其结论是没有万能模型,选哪个取决于具体使用场景。
开发者 GeFei 公布其 AI 视频生成站经 TrustMRR 用 Stripe API 验证的收入数据:近 30 天收入 $829、MRR $90、3 个付费订阅。该产品是面向内容创作、娱乐与社媒市场的 B2C AI 视频制作工具。TrustMRR 是通过 Stripe API key 验证初创公司收入的公开数据库。
开发者 GeFei 的 AI 视频站首日进账 221 美元,17 笔订单的付费用户全部来自 ChatGPT 渠道。首日 600 独立访客、1400 页面访问、255 注册用户,收入经 TrustMRR 通过 Stripe 数据验证。ChatGPT 渠道 282 个访客注册率 61%、付费率 6.4%,目前累计总收入 829 美元、MRR 90 美元。
视频博主 EHuanglu 用 Claude Opus 5.5 生成了一段想象《戴珍珠耳环的少女》被创作那一刻的视频,画面被认为真实而动人,获得包括 justin_hart 在内的多人转发称赞。
独立开发者 yihuiindie 宣布其单个产品已实现日入 500 美元,并按手头几个产品的规划预计年底有望冲击日入 1 万美元。同一资讯流还列出多位开发者的收入数据,包括一家 AI 视频站 30 天收入 $829 且经 Stripe 数据验证。另有开发者弃用付费视频模型、自跑 MiniMax H3,一条 reel 成本约 $0.50。
多家前沿 AI 公司通过 RapidResponse47 发布 Joint Commitment on Frontier Responsibilities,被视为行业自我监管的重要第一步。Encord CEO Sneha Revanur 称,这既需要公司内部强有力的个人责任文化,也需要公平且有约束力的法律抬高整体底线,两者缺一不可,任何一方都不应成为另一方的免责借口。