Motif 上线 MCP 设计规范服务,助力编码智能体
Motif 上线远程设计规范服务,编码智能体可通过 HTTP MCP server 接入,边写边查设计规范。该服务提供 738 条设计指导及设计规则等设计库内容,用于解决智能体产出的 UI 能运行却难以满足真实设计需求的问题。免费档每月提供 100 次调用。
Motif 上线远程设计规范服务,编码智能体可通过 HTTP MCP server 接入,边写边查设计规范。该服务提供 738 条设计指导及设计规则等设计库内容,用于解决智能体产出的 UI 能运行却难以满足真实设计需求的问题。免费档每月提供 100 次调用。
DeepSeek 于 9 月 30 日开源面向华为昇腾算力平台的 6 个基础设施组件,与此前面向英伟达开源的组件一一对应,完成从英伟达 GPU 到昇腾芯片的整套移植。
推荐理由:读者可以对照这套组件与英伟达版的对应关系,了解头部模型厂商把训练栈移植到国产算力生态的进展。
ComfyUI v0.38.0 发布,新增 Ming Image 0.1 6B 文生图模型、MiniMax-H3 Fun ControlNet Union 2.0 与基于 Wan 2.1 和 VACE 的 ID-V2V 身份保持视频转视频支持。
推荐理由:版本清单列出新增模型节点与量化、HDR 支持,可据此判断现有 ComfyUI 工作流是否要调整。
独立开发者 Acrobatic-Example315 为 H3 工作流发布小工具 IAMCCS Prompter H3,可用自然语言描述意图,由 Ollama 或其他 LLM 转译为结构化的 H3 提示词。
微软研究院推出实验性多模态 AI 研究系统 Project Quine,定位为把计算生物学建模与实际湿实验衔接起来的生物学“世界模型”。该系统由微软研究院与哈佛大学和麻省理工学院博德研究所共同开发,覆盖基因组学、蛋白质、化学、细胞状态和生物成像的联合表征,并结合交互式推理框架。
Latent Space 的 AINews 汇总了 OpenAI DevDay 2026 的发布:由 GPT-6 Astra 驱动、可连接 4000+ 应用的常驻智能体 Dots,定价 $2/$10 per M tokens 的 GPT-6.1 Sol,以及最高 8x 加速的 Ultrafast 和 Decisions API。
推荐理由:汇总了 DevDay 发布清单、定价与第三方评测,可对照 GPT-6.1 Sol 与 Opus 5.5 的成本差异。
Niantic Spatial 的 asimahmed 用 astra 工具在伦敦 Leake Street Arches 实拍场景的高保真高斯泼溅中,仅用几个小时制作了一段短片。该演示把真实空间重建为可编辑、可生成的数字资产,创作者可直接在重建场景中拍摄合成影像。这是 Niantic Spatial“让物理世界对机器可计算”方向的一次直观展示。
OpenAI Bot 支持自定义宠物:用户只需生成一张想要的形象图并交给 Bot,它就会创建一个带姿势和动作的动画宠物,并加入你的宠物收藏。作者 alexcovo_eth 展示了自制的 Bot「TOAA」作为实例,后续帖子补充了等待动画生成、上线使用的完整流程。
开发者 icanberk 用 OpenAI Astra 与 Snap Lens Studio 制作了 SPECS 的演示,展示孩子和家长如何通过 AR 眼镜进行沉浸式学习。转发者 TerekJudi 进一步畅想真实教室中多名学生通过 see-through AR 眼镜加入同一多人学习体验,共同在物理空间协作。该演示呈现了 see-through AR 与多模态 AI 结合在教育场景的可能性。
EnigmaFund 投资人展示了正在开发的 beta 工具 GetOra,用它为代币/初创项目 $MOTION 生成一份研究报告,称这套流程把任何初创公司两周的尽职调查压缩到 4 分钟。他读完报告后直接放弃跟进该项目,并坦言报告仍有逻辑 bug 待修复,但认为方法已验证可行。
开发者 BlendiByl 开源了免费框架 Dioramas,用于搭建电影感、可交互的 3D 网站,无付费层也无需注册。其 AI 资产管线先用 Nano Banana 2(fal)生成白底产品图,再由 Meshy 7.1 以 image-to-3D 生成 6 万至 25 万面数的 PBR 模型,所有 3D 物体均为生成而非建模。
Canonical 与高通宣布,官方 Ubuntu 支持将于 2027 年登陆骁龙 X2 系列笔记本平台,为本地构建和运行 agentic AI 提供软硬件一体环境。该支持提供在骁龙 X2 硬件上严格验证的标准化认证企业级镜像,开箱即用,无需手动调内核或装驱动。平台主打 80 TOPS NPU 加速与多天续航,双方称这是「为 agentic 世界解锁更多 Linux PC」的一步。
开发者发布 WinMind,一个绕开截图、读取 Windows UI Automation 无障碍树来驱动 computer-use Agent 的 Windows MCP server。
开发者转发消息称,Ubuntu Snapdragon Edition 的 ISO 已开放下载,面向高通骁龙 X 系列笔记本平台。用户可提前体验 Canonical 与高通合作推出的官方 Ubuntu 支持,正式版目标为 2027 年。
MindOn Tech 发布物理 AI 机器人 Mind-1,在双臂、移动双臂和人形三种形态上实现快速、流畅的全自主操作。其定位为「以人类速度完成实际工作」,面向真实部署场景,官方强调从演示走向真实工作后,完成任务的速度才是下一阶段竞争点。
Dolphin AI 以邀请码方式开启 Early Access,推出主打多镜头一致性的 agentic 视频制作工作室,覆盖长视频、广告、短剧、社交 Reels 等场景。写一次场景即可生成最多 10 个镜头,角色面孔、光线、街景等跨镜头保持一致。测试阶段已用该工具制作超 4.5 万条视频,据称广告 CTR/CTI 有提升。
OpenAI 在 Dev Day 上演示了由约一万个智能体组成的研究集群,协作求解纳维-斯托克斯方程。不同研究团队分别探索不同思路,跨团队保持通信,再汇总整合各自成果,展示了多智能体协同科研的真实运作方式。有转发者称其为现场「最重要的 alpha」。
Ollama 0.35 发布,新增 /v1/systemone 端点,支持基于 TypeSafe Jev API 的决策模型,并同步上线 Nimble 等三个可本地运行的新模型。Nimble 单次决策仅需 91ms,官方随后补充发布了配套博客、决策能力文档与 API 文档。该功能本地运行无额外成本、延迟更低,适用于工单分诊等需要一次性回答一组命名问题的场景。
DeepSeek 上线面向社区的用户反馈渠道,用户下载 DeepSeek 的 harness 并打开相应选项,即可向官方贡献数据,帮助改进其模型和产品。该渠道的具体操作路径由网友披露;同期还有登录 harness 即可领取 6 元 API 赠金的活动。
DeepSeek 推出 Harness 桌面端并发布 v0.2.0-rc.2 新版本,提供 macOS 和 Windows 安装包,无需终端部署即可开箱即用。用户在左下角登录账号即可领取 6 元 API 赠金,活动有效期至 10 月 6 日。
Hugging Face 团队发布 tokenizers v1,并撰文详解这次重构,称在很多场景下比 v0.23 快数十倍,重点是把 encode/decode 与扩展性都做到可度量。
Robinhood 在年度活动上推出应用内 AI 智能体 Robinhood Agents,可解答行情疑问、从零搭建定制化投资策略,并在用户入睡、工作或远离屏幕时自动盯盘和执行交易。
数据基础设施工程师 shreya 透露,结构化数据查询工具 Quail 即将推出 AI.CLASSIFY,为 OLAP 场景提供原生 AI 分类算子。她称当下用通用模型 API 做 OLAP 式 AI 数据操作是「一种非常糟糕的方式」,Quail 的价值在于建立在成熟的「向数据提问」UX 与生态之上,而非再做一层模型厂商的 API 包装。
OpenAI 面向 Pro 用户上线常驻云端的后台智能体 dots,开源同类项目 Thursday 的作者随后发布逐项对比。dots 的优势是 24 小时跑在 OpenAI 云端电脑上,接入 GPT-6 Astra 与 4000+ 连接应用目录,且零配置。
推荐理由:文中逐项列出 dots 的云端常驻优势与 Thursday 在本地文件访问、多 bot 交接上的差异,便于理解两类后台智能体的取舍。
thsottiaux 宣布其个人智能体产品 dots 将在几天内有数百万实例在线,覆盖广泛使用场景。他称使用 2-3 天、教它了解个人偏好和手头事务后能力有明显跃升,学习速度很快,还能自主承担相当有野心的任务。团队将先观察用户如何使用主 dots,之后才开放创建一整个 dots 团队的能力。
微软研究院发布生物学 AI 科研系统 Project Quine,将生物学世界模型与研究框架结合,连接文献、计算与湿实验室。该系统覆盖蛋白质、细胞、组织等多个层面的研究能力,旨在加速生物学科学发现。微软同时向一小批研究者开放 Fellows 计划,让科学家率先试用。
雅虎前 CEO、前 Google 高管 Marissa Mayer 于 9 月 30 日发布个人 AI 助理 Dazzle。该产品读取手机相册,从服装、旅行、夜出行等照片中理解用户偏好,实现个性化购物推荐与代理购物,并把手机相机按钮变成无需输入提示词的「搞定」按钮,直接基于当前画面提供即时上下文与操作。
Sol 6 智能体在 @VoidNulled 的演示中,于全程无任何提示词干预下独立完成一支短片,视频和配乐均由自己生成。这类“放出去让它自己折腾”的 demo 展示了智能体自主创作能力的边界,并在 X 上引发转发关注。
IIT Delhi 团队历时 6 个月在印度打造 4D 城市数字孪生 GeoTwin,已在 Guwahati 市完成原型演示。该系统基于 LiDAR 点云构建 3D 建筑、道路、铁路,可流畅串流 TB 级点云数据,融合 AI 实现街区级内涝、滑坡、违建监测与交通监控、路径优化。4 个月内新增天气监测与预报(复用 Zomato 外卖传感器气象数据)、污染监测、InSAR 地面位移分析和实时交通监控。
作者 iamrishavraj1 开源了 YourSpeakReps,一个完全本地运行、用于英语口语和模拟面试练习的 AI 口语教练。它用 Ollama 跑本地 LLM、faster-whisper 做语音转文字,配系统原生 TTS 和 FastAPI 浏览器 UI,无需 API key、不依赖云、无按次成本。
豪威(OmniVision)发布常开型视觉 AI 协处理器 OAX7700,集成 NPU,基于它的停车监控系统仅需市面现有方案 3% 的功耗。该芯片具备人体检测、人与物体识别、距离测算等边缘 AI 能力,可将环视系统等现有车载外摄像头方案升级为超低功耗边缘 AI 停车监控系统,事件触发后录制 5~10 秒预录视频交由电子控制单元核验。
豆包宣布支持多种出行服务,用户可在对话内一站式完成机票预订、火车票购买、打车和路线导航。该功能在酒店、餐饮预订基础上新增,用户以自然语言描述需求即由豆包识别意图并完成服务调用,同时上线“出行用豆包”专属入口,覆盖地图导航、交通出行、酒店住宿、吃喝玩乐四类场景。机票和火车票由航班管家、高铁管家提供,打车接入曹操出行等平台,导航由百度地图等合作方提供技术支持。
OpenAI 在开发者日宣布与 ModRetro 合作,为复古掌机 Chromatic 推出 Codex 专用插件 Game Studio,用户可用自然语言描述游戏需求、由 Codex 辅助生成程序。
OPPO K15s 与 K15x 两款新机今日开售,闪促期(9 月 30 日至 10 月 31 日)立减 300 元,K15x 6GB+128GB 到手 1399 元、K15s 同版本 1699 元。
DeepSeek 官方将 DeepGEMM 移植到华为昇腾 NPU 的版本 DeepGEMM Ascend 已开源,作者称其 GEMM 性能达到硬件极限的 99.8%,MegaMoE 达 98%。
谷歌产品安全团队在官方博客介绍内部智能体漏洞挖掘工具 PageBreak,把候选漏洞放进真实运行环境实际验证,做到接近零误报。该工具以 Gemini 3.1 Pro、3.5 Flash 等 Gemini 系列模型为主,已大规模运行并发现超过 500 个 XSS 漏洞。
推荐理由:PageBreak 把候选漏洞放进真实环境验证以压低误报,可看出智能体做安全测试时如何减少人工筛选负担。
IROS 2026 上,博主 CyberRobooo 发现一款名为 Baymax 的人形机器人,主打「可以拥抱」的温暖交互设计,原型致敬电影《超能陆战队》的大白。文中预测,未来会有更多电影角色被做成真实的人形机器人。
OpenAI 新产品 dots 定价 200 美元起,引发社区批评。Reddit 用户将其与开源方案 OpenClaw 对比,认为 dots 可登录服务受限,不如开源方案可定制、透明、可自行托管。开发者 Micah Berkley 称朋友圈几乎人人有 20 美元 OpenAI 订阅、多数人已为 Claude 每月支付 200 美元,dots 的 200 美元门槛恐难破圈。
Exploit Summit 现场,@centrumblue 预览了 @theminosai 为 Bittensor SN107 子网设计的第二套激励机制:AI 智能体执行基因组学研究任务。演示同时发布面向矿工的 Mac 应用,并配套 iPhone 远程控制端,可在手机上让智能体自主跑研究循环、查看日志、暂停矿机,口号是「让 agent 替你干活」。
鸿蒙智行尚界 Z7/Z7T 国庆 OTA 正式推送,带来 3 大维度提升、20+ 项体验进化,新增肖战专属泊车语音。Z7/Z7T 新增防误打方向盘功能,NCA/LCC 开启且车速 60 公里每小时以上时,检测到驾驶员注意力不集中会自动提升方向盘接管力矩,另新增转向时 HUD 边缘告警光晕。车外语音可控前后备箱与调光天幕,组队出行升级至 2.0 版本,支持全员实时语音对讲。