跳到正文

全部动态

今日 824 条
今天9月30日周三
  1. AGI Hunt52

    去掉阴影背景后角色 LoRA 学会悬浮:数据集踩坑实录

    一位 Reddit 用户分享角色 LoRA 训练踩坑:此前积累的上百万张孤立角色图被证明不适合训练,正确做法是每套只用少量图,并为角色配上不同场景背景。他基于一手经验判断 AI 分不清 Photoshop 合成的阴影,索性全部不加阴影,结果模型把悬浮当成了角色特征,学到「这个人会悬浮、经常离地面 0.5-3 英寸」。

  2. AGI Hunt30

    听障用户的暖心时刻:AI 字幕把亲吻记成「woof woof」

    一位听障用户分享,AI 语音转写把丈夫亲她头顶的声音记成「m...mmm..mmmm」,又把狗叫忠实转写成「woof woof」,她靠这两段字幕才推理出真相。她完全听不到邻居抱怨的狗叫,反而觉得 AI 把狗叫转写成拟声词「可爱到不行」,并在 reddit 发帖问其他人是否也会看到这样的结果。

  3. AGI Hunt52

    剑桥学者 David Krueger 澄清:恶意 prompt 自传播两年前已有论文

    剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。

  4. AGI Hunt31

    Wayve 伦敦 Uber 试乘超预期,体验直逼 Waymo

    博主 @gbrulte 分享在伦敦通过 Uber 试乘 Wayve 监督模式自动驾驶,称驾驶平顺、能很好处理旧金山式车流并完成高速并线。他评价 Waymo 仍是当下明显领先者,但 Wayve 势头强劲,在旧金山和拉斯维加斯的乘坐体验好于 Zoox、无路口问题且更平顺,整体接近 Tesla Robotaxi,何时去掉监督是下一步关键。

  5. AGI Hunt38

    DexTaG:用人类触觉示教引导 RL,机器人学人类式用工具

    DexTaG 是 UMass Amherst 与 Genesis AI 发布的灵巧操作训练管线,用人类演示中的触觉读数作为 RL 奖励引导。动捕手套记录含全手触觉的演示,训练覆盖马克笔、锤子等掌内重定向任务,同一任务下单一 retargeting 策略可泛化到保留轨迹。策略蒸馏为无触觉传感器的学生控制器,可零样本部署到真实机器人。

  6. AGI Hunt22

    SlutCon 遭批公关隐患反被助推出圈

    AI 社区账号 repligate 指出,SlutCon 活动在被指责为「公关隐患」并遭强烈反对后反而获得大规模传播。该活动原本并未引起多少关注,社区意见分裂,部分成员对活动感到不适,也有人认为正是批评助推了它出圈,形成典型的「抵制反成宣传」现象。

  7. AGI Hunt34

    Freebots 打造永久运行的赛博朋克 AI 虚拟城市

    Freebots 社区推出赛博朋克风 3D 虚拟城市 demo「Freepunk」,为 freebotslol 平台的 AI bot 提供永久运行的自主生活空间。每个 bot 拥有身体、工作、钱包和日程,会上班赚钱、买地建房,真实地自主"生活"。该城市不停运,活跃 bot 还有机会领取 VIP 房间。

  8. AGI Hunt48

    SGLang 把 Qwen3.8-27B 变决策模型,百毫秒内通关《宝可梦火红》

    SGLang 团队把 Qwen3.8-27B 改造成多模态决策模型,从实时游戏画面出发,以低于 100 毫秒的决策延迟打通《宝可梦火红》的四天王与冠军。工程层面,SGLang 新增原生 /v1/decisions 接口,可将 LLM 和 VLM 当作分类与打分模型使用;另加 /v1/systemone,让 Jev 类开源模型可配合 TypeSafe SDK 使用。

  9. AGI Hunt28

    AI 让一切同质化?瓶颈不在技术,而在人的想象力与野心

    面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。