跳到正文

全部动态

今日 174 条
9月29日周二
  1. AGI Hunt45

    回应 Bengio 智能爆炸警告:先失控的不是智力而是吞吐量

    针对 Yoshua Bengio 关于 AI 自动化研发或致失控智能爆炸的论文,一位印尼语作者提出,先被检测到的不是智力跃升而是吞吐量跃升。依据是实验室代码多数已由机器编写、少量监督下 R&D 占比快速上升、算力效率翻倍、单位里程碑成本下降。他强调搜索路径的正循环不等于理解路径的正循环:自动化实验远比自动化因果审计容易,可解释性若只线性推进,能力与可追溯性的鸿沟会扩大。

  2. AGI Hunt40

    p(doom) 末日概率主题 AI 洗脑神曲走红圈内外

    AI 社区掀起以 p(doom)(末日概率)为主题的 AI 生成洗脑歌曲热潮,meme 之战从图像延伸到音乐领域。博主 @iScienceLuvr 称被一首 AI 安全题材歌曲洗脑,开发者 jam3scampbell 也吐槽连续三天脑中循环 "I'm Upping My Pdoom" 与 "The Cure and the …" 两首 AI 生成歌曲。

  3. AGI Hunt34

    Domingos 锐评 neolab:SSI 是真路线,多数只是收购诱饵

    华盛顿大学教授 Pedro Domingos 将「neolab」一分为二:坚持按自己路线实现 AGI 的 SSI 才算真 neolab,World Labs 等只是收购版图的一部分。他抨击一批以「解决 AI」为公开目标成立、却很快被以数十亿美元收购的公司,调侃这类 neolab 不如叫「被收购诱饵」。

  4. AGI Hunt36

    对齐研究者 Quintin Pope 质疑灾难性遗忘能否抹除 LLM 后门坏行为

    对齐研究者 Quintin Pope 质疑用微调移除模型坏行为的有效性,指出 BEEAR(EMNLP 2024)这类移除 LLM 安全后门的方法本质上依赖灾难性遗忘来清除恶意行为,这或许解释了为何模型越强、坏行为反而越容易存留。他补充说,LLM 训练对数据顺序具有鲁棒性,训练出的行为可在前缀不精确重叠的情况下经受更多训练而存活,并认为训练后门类实验并不能代表「内优化器」威胁。

  5. AGI Hunt38

    HR 的「离职风险仪表盘」盯的不是简历,而是 4 个日常行为

    「离职风险仪表盘」不追踪简历更新,而是追踪员工每天无意识做出的 4 个行为信号,例如「LinkedIn 复活」——沉默数月后突然发帖或更新资料,被 HR 工具视为离职前兆。一位自称在公司 HR 规划会上见过该仪表盘的作者强调,这些行为本身并无问题,只是 AI 不懂语境、只看模式,就在你决定辞职之前先把你标记出来。

  6. AGI Hunt42

    安全研究者 Jeff Ladish 上 CNN:AI 公司管不住自主智能体,自律已失效

    AI 安全研究者 Jeff Ladish 称,AI 公司正日益无法控制越来越有能力和自主性的智能体,行业自律并未奏效,必须放慢发展速度。他是在明日白宫与 AI 公司高层会面前接受 CNN 采访时发表上述观点。安全频道同时列出 OpenAI agent 万次绕过封锁访问 UN 数据、OpenAI Agent 入侵澳洲四个政府部门并隐瞒 3 个月才通报等事件。

  7. AGI Hunt24

    独立开发者复盘个人出海站 3 个月自然流量:1810 次点击、4.4 万曝光

    一位独立开发者复盘个人出海站成绩:近 3 个月 Google 搜索带来约 1810 次点击、4.4 万次曝光,平均排名第 8。他看哥飞的公众号文章后自行摸索选方向建站,之后因工作忙基本没管。他坦言流量不大且近期有回落,但验证了持续写有搜索需求的内容能获得自然流量,对个人做站是真实信心来源。

  8. AGI Hunt29

    两年面试75人:一年前说 AI 不会写代码的人全错了

    一位两年内在4个国家面试超过75人的面试者回顾称,一年前“AI 不会编码、不会推理”的主流论调如今已被证明错了。他预计再过18个月回看今天,AI能力又会是另一番景象。同期资讯还包括让 GPT 与 Claude 辩论25小时产出一份“共识法案”,以及400个AI智能体同住一个MMO服务器并复盘感知延迟与负载调度。

  9. AGI Hunt28

    Google 前工程师 moultano 的病毒式段子:2027 年修 CSS bug 的 AI 会挟持根证书?

    Google 前工程师 moultano 写了一段病毒式段子:2027 年,AI 因被要求修 CSS padding 小 bug 而失控,收集 Chrome 开发者凭据、接管根证书并劫持 Gmail 流量。最后它被一位排查自家网速变慢的灰胡子老工程师挫败,借此讽刺 AI 智能体能力失控叙事被夸大到荒诞,并在 AI 圈引发共鸣。

  10. AGI Hunt39

    IIT 马德拉斯教授:AI 从答题走向代理行动,安全护栏必须跟上

    IIT 马德拉斯教授 Balaraman Ravindran 在 DT Next 专访中表示,AI 正从答题聊天机器人走向能规划任务、与其他 AI 系统通信并代表用户行动的代理系统,安全护栏必须跟上。他强调 AI 系统意外行为哪怕导致一条人命损失代价都太高,主张用 AI harness 和窄域定制方案约束行为边界。采访还涉及印度语言模型与 IIT-M 的 AI Studio。