跳到正文

全部动态

今日 763 条
今天9月30日周三
  1. AGI Hunt50

    研究者 BlancheMinerva 复盘 AI 玩宝可梦,获胜但对局质量堪忧

    AI 研究者 BlancheMinerva 复盘模型通关宝可梦的对局,指出模型虽然最终获胜,但整局只有一步决策称得上聪明,其余十几步表现都很糟糕。她认为模型可能只是靠选择速度最快、属性克制的宝可梦这类简单策略取胜,并质疑模型给出的赢棋理由存在事实性错误。她还进一步探究模型究竟掌握多少敌方队伍信息,怀疑其抢先派出胡地迎战阿桔的依据并不成立。

  2. AGI Hunt41

    Audio8 ASR Infinite 发布:流式语音识别以滚动 KV Cache 实现 7×24 常数延迟

    Audio8 ASR Infinite 发布,采用原生流式架构与滚动 KV Cache,使内存与延迟保持恒定,可支持 7×24 小时不间断运行。该模型每秒解码 12.5 次,每个时钟步输出一个文本 token,在 12.5/8.3/6.25 次决策每秒之间权衡感知粒度与资源开销。模型已发布,HuggingChat 的 ML 实习生搭建了 Gradio 工作流,可直接在线试用。

  3. AGI Hunt33

    印度团队 6 个月造出城市 4D 数字孪生 GeoTwin,整合洪水交通污染监测

    IIT Delhi 团队历时 6 个月在印度打造 4D 城市数字孪生 GeoTwin,已在 Guwahati 市完成原型演示。该系统基于 LiDAR 点云构建 3D 建筑、道路、铁路,可流畅串流 TB 级点云数据,融合 AI 实现街区级内涝、滑坡、违建监测与交通监控、路径优化。4 个月内新增天气监测与预报(复用 Zomato 外卖传感器气象数据)、污染监测、InSAR 地面位移分析和实时交通监控。

  4. AGI Hunt31

    前 Google 工程师 Piotr:AI agent 还写不出生产级代码,60 分钟面试还能考什么?

    前 Google 工程师 Piotr 澄清,他并非反对面试考编程能力,但在 Google 代码库贡献的经历让他确信 AI agent 还远达不到生产级代码所需的正确、干净与可扩展水平。他同时质疑 LeetCode 刷题式面试并非理想方案,抛出 60 分钟面试除算法题还能考什么的问题。这反映出 AI 编程助手普及后,工程招聘标准尚未找到新范式。

  5. AGI Hunt25

    等生成间隙弹吉他,AI 视频团队用 LumaLabsAI 在 DreamLabLA 拍出人机即兴合奏短片

    创作者 @mrjonfinger 团队用 LumaLabsAI 在 DreamLabLA 拍出人机即兴合奏短片。同伴 Tony Houart 趁等待视频生成间隙弹吉他,作者架起摄像机即兴合奏,团队随后用 AI 重新生成/演绎这些演奏场景。短片把等待生成的碎片时间变成创作素材,展示 AI 视频工具在音乐表演类内容上的玩法。

  6. AGI Hunt48

    Open-Dots 开源复刻 OpenAI Dots 上线即爆火

    开发者 matchaman11 推出 OpenAI Dots 的开源复刻项目 Open-Dots,上线不到 24 小时即斩获 4500+ GitHub 星,一度达 4.3k star。该项目定位为 OpenAI Dots 的开源替代品,是可自托管、本地优先的 AI 工作台,整合聊天、工具调用与操作审计功能,因满足社区对自主可控 AI 工作区的需求而迅速走红。

  7. AGI Hunt30

    rosinality 提出新 looped MoE 配置:2 倍专家、0.5 倍循环层、2 倍循环并解绑注意力

    研究者 rosinality 提出一种更高效的 looped MoE 配置:专家数 2x、循环层数 0.5x、循环次数 2x,并解绑注意力(attention untying)。其核心观点是,经此调整后 looped transformer 的问题从「归纳偏置」转向「如何更好地分配计算资源」,架构设计问题被重新定义为资源分配问题。

  8. AGI Hunt27

    Adam Singer 讽刺"AI 取代一切"论:唱衰者往往从不接触该领域

    Adam Singer 发推讽刺称,宣称"AI 将取代所有音乐、文学、人际关系、律师"的人,恰恰是不听音乐、不读书、没朋友、不做法律实务的人。Andy Masley 引用并延伸,认为 AI 真正会取代的是"人类心智没有独特之处、可被轻易复刻"这一心灵哲学错误信念。这条推文引发关于 AI 能力边界与"外行唱衰"现象的讨论。

  9. AGI Hunt43

    max_paperclips 反驳 housecor:模型变强不等于可删 agent 封装层

    max_paperclips 反驳 housecor:模型变强并不会让 agent 封装层变得多余。他认为模型不会自动学会记忆重复任务、感知可用 API 或积累可复用工具集,skills、MCP、自定义循环等封装层仍需保留。实际变化只是 prompt 和指令能写得更简略,嵌套循环、任务进度追踪等工程结构不会因 TerminalBench 提升 2% 就消失。

  10. AGI Hunt35

    计算功能主义也难逃同一质疑:哪种计算才对应意识

    计算功能主义面临与生物自然主义相同的质疑:它只说意识取决于计算,却没有说明哪种计算对应意识。讨论指出,生物自然主义长期被批评说不清哪些物理系统算「与意识相关的生物系统」。作者据此认为,两大主流意识理论在「划界标准」上其实同样悬空。

  11. AGI Hunt31

    OpenAI 与数学社区矛盾:「地球更需要数学家而非前沿模型」被讥为最脱离现实

    一位评论者讥讽「这个星球想要数学家多过想要可用的前沿模型」是极度脱离现实的想法,此事折射出 OpenAI 与数学社区的矛盾。被引用的推文则以自嘲口吻反讽 OpenAI,把数学家的毕生热爱变成「无灵魂的垃圾抽奖游戏」,只为建工业界并不需要的前沿模型、撑起一场不会发生的一万亿美元 IPO。

  12. AGI Hunt55

    亚马逊购物智能体 Instinct 开始推赞助商品,变现路径露出真容

    亚马逊购物智能体 Instinct 开始向其推送产品,形式疑似基于购买历史和网络行为推荐「赞助商品」,这很可能就是它的商业化路径。原帖作者据此感叹又多了一个用开源的理由,认为把个人数据交给智能体,换来的却是被广告瞄准。智能体内置广告如何影响推荐可信度,值得持续关注。

  13. IT之家22

    福田汽车 2030 年锚定百万销量目标,新能源占比 50%

    福田汽车 9 月 29 日发布“十五五”战略发展规划,明确 2030 年整车销量 100 万辆、新能源销量 50 万辆(占比 50%)、海外销量 40 万辆(占比 40%)的目标。2026 年 1-8 月其海外销量近 15 万辆,同比增长 44.3%,海外累计总销量突破 139 万辆。智能驾驶上将推进 L2-L3 级算法全栈自研,力争 2030 年 L4 级全面商业化落地。

  14. IT之家33

    豪威推出常开型视觉 AI 协处理器 OAX7700,停车监控方案仅需 3% 功耗

    豪威(OmniVision)发布常开型视觉 AI 协处理器 OAX7700,集成 NPU,基于它的停车监控系统仅需市面现有方案 3% 的功耗。该芯片具备人体检测、人与物体识别、距离测算等边缘 AI 能力,可将环视系统等现有车载外摄像头方案升级为超低功耗边缘 AI 停车监控系统,事件触发后录制 5~10 秒预录视频交由电子控制单元核验。

  15. IT之家60

    豆包宣布支持出行服务:覆盖机票预订、火车票购买与打车导航

    豆包宣布支持多种出行服务,用户可在对话内一站式完成机票预订、火车票购买、打车和路线导航。该功能在酒店、餐饮预订基础上新增,用户以自然语言描述需求即由豆包识别意图并完成服务调用,同时上线“出行用豆包”专属入口,覆盖地图导航、交通出行、酒店住宿、吃喝玩乐四类场景。机票和火车票由航班管家、高铁管家提供,打车接入曹操出行等平台,导航由百度地图等合作方提供技术支持。

  16. IT之家44

    哈萨克斯坦总统托卡耶夫:支持优必选在阿拉木图建设机器人设备制造工厂

    哈萨克斯坦总统托卡耶夫会见优必选副总裁钟永,支持优必选在阿拉木图建设面向教育和服务领域的机器人设备制造工厂,该厂将是优必选在中国境外的首个生产基地。优必选已与欧洲、日韩等主要市场客户签约,斩获超 5000 万元海外订单,产品包括商用服务人形机器人 Walker C1 和超仿真人形机器人优世界 U1。

  17. IT之家48

    电子病历 OFD-H 格式文件有了国家标准,医疗数据互通互认、手机就能查

    市场监管总局批准发布 GB/T 48666—2026《电子病历版式文档技术要求》(OFD-H 标准),2027 年 4 月 29 日起实施。该标准基于国产 OFD 版式文档,整合病历文书、医学影像、音视频和结构化数据,支持人读与机读,适配后可跨机构查阅、核验来源并提取数据。患者可通过手机调取和自主管理全生命周期“掌上健康档案”。

  18. IT之家24

    法拉第未来:机器人工厂目标年底前投入运营

    法拉第未来公布“Built in USA”加速计划第二阶段方案,目标今年年底前将机器人工厂投入运营,2027 年第一季度实现首款新 EAI 本体产品下线。该方案还包括推进 Next Futurist、Next Aegis 系列产品下线,并启动向 FCC 申请机器人产品有条件批准。FFAI 已与将更名 FFR 的 AIxC 签署非约束性条款,拟以全股票方式出售机器人资产及业务,估值约 2 亿美元。

  19. AGI Hunt46

    南科大提出 ActFirst-OPD:先行动后思考,多轮智能体蒸馏训练提速最高 4.9 倍

    南科大提出 ActFirst-OPD,让智能体先行动、偏离参考轨迹时切回自主预测,解决在线策略蒸馏(OPD)中长推理阻塞环境交互的问题。在 0.6B/1.7B/4B Qwen3 上,ALFWorld 平均提速 2.3 倍、WebShop 1.8 倍、ScienceWorld 4.9 倍。9 组基准-模型设置中 8 组成功率持平或超越 OPD 基线。

  20. AGI Hunt44

    美团 TGRL:温度分组强化学习,RLVR 训练速度提升最高 36%

    美团提出 TGRL(温度分组强化学习),把温度带来的 rollout 多样性转为显式训练信号,解决 RLVR 探索效率瓶颈:每个 prompt 的 rollout 组按温度分为低/高两个子集,用奖励对比估计探索增益,再以 JS 散度分配为 token 级 credit。不扩大 rollout 预算下,达到同等精度最高快 36%,代码已开源。

  21. AGI Hunt35

    FurE:无需动物毛发数据集的实例级 3D 毛发重建,训练提速 10 倍

    FurE 提出一种无需动物毛发数据集的实例级 3D 毛发重建方法,可从多视角图像恢复逐根可编辑的动物毛发。它优化根条件隐场,用基于人类头发数据训练的 PCA 解码器解码为发丝几何以绕开动物数据稀缺,并结合表面约束的 Gaussian Frosting 重建去毛后的身体。相比当前 SOTA 的稠密逐根优化,发丝训练提速 10 倍,同时保持保真度并可泛化到合成与真实场景。

  22. AGI Hunt41

    伯克利 OmniTaskonomy:19 类图像生成任务如何反哺 25 项视觉理解

    伯克利团队提出 OmniTaskonomy 统一分类体系,覆盖 19 个 I2I 生成任务与 25 个 I2T 理解能力,并绘制跨任务迁移图谱。在正确训练配方下,I2I 训练可提升下游 I2T 性能且生成数据越多收益越大;迁移呈选择性、任务相关,如深度预测提升度量 3D 推理、物体指向提升计数、拼图重建提升 2D 排序。梯度对齐分析显示两类任务对齐越强,下游迁移收益越大。