跳到正文

全部动态

今日 871 条
今天9月30日周三
  1. AGI Hunt30

    CineSubBench:用 1012 部电影字幕考 LLM 长叙事与文化理解

    新基准 CineSubBench 用 1012 部电影、6 种语言的 813 万条带时间戳字幕,评估 LLM 的长上下文叙事与文化理解。它设 7 项任务,覆盖叙事重建与抽象、类型预测、年龄适宜性及 10 国分级体系。对九个 LLM 的评测显示,情节梗概还原比完整事件概要更可靠,跨语言一致性因模型与语言差异显著,强脏话远比轻度粗俗语更易识别。

  2. AGI Hunt34

    Instinct 推出 Instinct Selections:联合本地主厨与设计师做真人策展推荐

    AI 助手 Instinct 推出 Instinct Selections,联合本地主厨、设计师、建筑师、向导等各领域专家做真人手工策展推荐。找餐厅可调用当地主厨精选的私藏好店清单,找徒步路线参考本地向导推荐,布置家居则匹配符合风格与预算的独立设计师作品。该功能正面向早期访问用户逐步开放,团队称目标是与网上通用内容及其他 chatbot 产出形成质量差异化的「世界级推荐」。

  3. AGI Hunt38

    开发者打造能记住 300 起历史故障的值班运维 Agent

    一位开发者在 Medium 分享其团队构建的运维值班 Agent:它能查询并理解某项服务上次故障时的具体情况,用以辅助事件响应。该系统以 300 起过往事故作为长期记忆,排障时可检索参考,针对值班 Agent 缺乏历史上下文、如同「失忆」的痛点。文章围绕其设计思路与落地过程展开。

  4. AGI Hunt34

    科技圈的疯狂反而逼社会重新讨论何为良好生活与爱

    @credenzaclear2 发长文称,科技人士尤其 AI 伴侣与情感话题相关的激进举动,反而加速了一场被推迟已久的公共讨论:何为良好生活、爱的意义与性的本质。她认为过去几十年「不评判」的自由放任氛围留下价值真空,如今正是重新给出明确判定的时机,可以指出良好生活中一些稳定、可定义的要素。

  5. AGI Hunt29

    abliteration_ai 推出用户自控护栏版 GLM-5.3,直指大厂垄断网络能力

    abliteration_ai 宣布其上月发布的 GLM-5.3 定制版允许客户自行控制安全护栏,称客户覆盖从初创公司到财富 500 强。该团队抨击大实验室以集中式护栏实施「黑盒」管控,客户即便进入特殊「cyber」项目也常被拦截而无法开展工作,认为大厂在意的是失去对网络安全能力的垄断。团队强调将坚持把护栏定义权交还给用户。

  6. AGI Hunt52

    去掉阴影背景后角色 LoRA 学会悬浮:数据集踩坑实录

    一位 Reddit 用户分享角色 LoRA 训练踩坑:此前积累的上百万张孤立角色图被证明不适合训练,正确做法是每套只用少量图,并为角色配上不同场景背景。他基于一手经验判断 AI 分不清 Photoshop 合成的阴影,索性全部不加阴影,结果模型把悬浮当成了角色特征,学到「这个人会悬浮、经常离地面 0.5-3 英寸」。

  7. AGI Hunt30

    听障用户的暖心时刻:AI 字幕把亲吻记成「woof woof」

    一位听障用户分享,AI 语音转写把丈夫亲她头顶的声音记成「m...mmm..mmmm」,又把狗叫忠实转写成「woof woof」,她靠这两段字幕才推理出真相。她完全听不到邻居抱怨的狗叫,反而觉得 AI 把狗叫转写成拟声词「可爱到不行」,并在 reddit 发帖问其他人是否也会看到这样的结果。

  8. AGI Hunt52

    剑桥学者 David Krueger 澄清:恶意 prompt 自传播两年前已有论文

    剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。

  9. AGI Hunt31

    Wayve 伦敦 Uber 试乘超预期,体验直逼 Waymo

    博主 @gbrulte 分享在伦敦通过 Uber 试乘 Wayve 监督模式自动驾驶,称驾驶平顺、能很好处理旧金山式车流并完成高速并线。他评价 Waymo 仍是当下明显领先者,但 Wayve 势头强劲,在旧金山和拉斯维加斯的乘坐体验好于 Zoox、无路口问题且更平顺,整体接近 Tesla Robotaxi,何时去掉监督是下一步关键。

  10. AGI Hunt38

    DexTaG:用人类触觉示教引导 RL,机器人学人类式用工具

    DexTaG 是 UMass Amherst 与 Genesis AI 发布的灵巧操作训练管线,用人类演示中的触觉读数作为 RL 奖励引导。动捕手套记录含全手触觉的演示,训练覆盖马克笔、锤子等掌内重定向任务,同一任务下单一 retargeting 策略可泛化到保留轨迹。策略蒸馏为无触觉传感器的学生控制器,可零样本部署到真实机器人。

  11. AGI Hunt22

    SlutCon 遭批公关隐患反被助推出圈

    AI 社区账号 repligate 指出,SlutCon 活动在被指责为「公关隐患」并遭强烈反对后反而获得大规模传播。该活动原本并未引起多少关注,社区意见分裂,部分成员对活动感到不适,也有人认为正是批评助推了它出圈,形成典型的「抵制反成宣传」现象。

  12. AGI Hunt34

    Freebots 打造永久运行的赛博朋克 AI 虚拟城市

    Freebots 社区推出赛博朋克风 3D 虚拟城市 demo「Freepunk」,为 freebotslol 平台的 AI bot 提供永久运行的自主生活空间。每个 bot 拥有身体、工作、钱包和日程,会上班赚钱、买地建房,真实地自主"生活"。该城市不停运,活跃 bot 还有机会领取 VIP 房间。