跳到正文

全部动态

今日 701 条
9月23日周三
  1. Gary Marcus:The Road to AI We Can Trust49

    Meta Muse 背后的秘密:重演 Facebook M 的旧剧本

    Meta 新智能体 Muse 被指在重走 Facebook M 的老路,同样主打餐厅预订、剧院购票等任务。Meta 于 2015 年推出的 Facebook M 仅开放给约 1 万名用户,因运行成本高昂未能推广,且被曝有真人幕后参与,该项目在 2018 年 1 月被取消,当时由 AI 处理的请求不超过 30%。作者对 Muse 能否成功存疑,并批评 Meta 在隐私问题上依旧麻木。

  2. Ars Technica · AI67

    Anthropic 发布 Opus 5.5,OpenAI 发布 GPT-6 Sol 与 Luna

    Anthropic 与 OpenAI 相继发布新模型,都主打能力小幅提升而成本明显下降。Anthropic 称 Opus 5.5 在默认设置下处理典型任务比 Opus 5 省约 40%,原因是 token 单价下降且完成任务耗用的 token 更少,并在网络安全、生物学等高风险领域沿用 Fable 5.1 的保护措施,被标记的请求可能被自动、透明地转给旧模型。

  3. Ars Technica · AI66

    微软联手行业捣毁 EvilTokens,该平台用 AI 聊天机器人入侵 1.2 万个账号

    微软表示,其主导的行业联合行动捣毁了一个名为 EvilTokens 的订阅制诈骗平台,该平台借助 AI 聊天机器人入侵了 1.2 万个微软账号。该平台 2 月在 Telegram 频道上线,初始收费 1500 美元,此后每月收取 500 美元。其核心是一个可分析受害者收件箱的 AI 聊天机器人,能识别可信关系与付款授权,并起草冒充熟人的邮件诱骗员工转账。

  4. Ars Technica · AI77

    因 ChatGPT 被用于枪击案,诉讼要求 OpenAI 承担新建学校费用

    不列颠哥伦比亚省起诉 OpenAI,要求其为枪击案后 Tumbler Ridge 社区新建学校出资,并可能就应急响应等费用索赔。该省请求法院把 ChatGPT 模型规范中要求假设用户“善意”且“不探究意图”的两条指令改掉,并命令 OpenAI 定期接受独立审计。

    推荐理由:诉讼要求法院改动 ChatGPT 模型规范中的指令,并主张 OpenAI 公开承诺的安全响应职责不能被否认。

  5. Gary Marcus:The Road to AI We Can Trust33

    Gary Marcus:让 Sam Altman 在联合国安理会简报 AI,如同让纵火犯编写消防规范

    Gary Marcus 发文讽刺 Sam Altman 在联合国安理会就 AI 作简报,称这如同让纵火犯编写消防规范。他引述 Drainpipe.io 创始人 Dominic Romano 的说法:此人并不真正了解底层技术,却带领一家制造安全危机观感的公司向安理会做简报,就像 Al Capone 向 FBI 讲安全。Marcus 也说不理解联合国为何要给 Altman 话筒。

  6. AWS Machine Learning Blog67

    GPT-6 Sol 与 GPT-6 Luna 在 Amazon Bedrock 正式可用

    OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 在 Amazon Bedrock 正式可用,API 定价显著低于 GPT-5.6 前代。GPT-6 Sol 面向开发与运维中反复出现的复杂任务,GPT-6 Luna 面向大批量重复任务,两者都支持显式提示词缓存。OpenAI 的内部事实性评测显示,GPT-6 Sol 的事实性错误约为 GPT-5.6 Sol 的一半。

    推荐理由:两款模型按复杂任务与高频任务分层,API 定价低于 GPT-5.6 前代,可据此判断日常负载的选型。

  7. OpenAI:官网动态64

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,称它们把前沿智能带入日常工作,区别在于能力与成本的不同平衡。

    推荐理由:OpenAI 一次发布两款模型并给出能力与成本的不同取舍,读者可据此比较它们在日常工作场景中的定位。

9月22日周二
  1. Latent Space81

    小米发布 MiMo-V2.6 系列开放权重模型,旗舰 Pro 为 1T-A42B、训练成本 300 万美元

    小米发布 MiMo-V2.6 系列开放权重模型,包含原生全模态的 MiMo-V2.6-Pro、MiMo-V2.6-Flash 以及 MiMo-V2.6-Pro-UltraSpeed,其中 Pro 以 1.02T 总参数、42B 激活参数在 Artificial Analysis 智能指数上以 46 分成为该榜首位开放权重模型。

    推荐理由:原文给出 MiMo-V2.6 的 RL 训练细节与开源清单,可对照开放权重模型的成本与复现门槛。

  2. Gary Marcus:The Road to AI We Can Trust50

    Gary Marcus 在联合国大会数字合作活动上谈 AI 监管,20 余国签署行动呼吁

    Gary Marcus 在联合国大会数字合作活动上发表发言,反对 AI 监管的两极化,并提出三项国际监管主张。三项主张包括设立国际咨询委员会在系统发布前评估风险与收益、发布后持续审计并有权要求整改或召回,以及就不部署已证明有害的架构达成国际协议。

9月21日周一
  1. Import AI47

    Import AI 473:美国的超级智能战略、小鼠颅中的人脑组织与机器诠释学

    RAND 发布报告,认为美国面对通往超级智能的不确定路径应采取"行动自由"战略,以保留所有选项并维持地缘政治优势。报告归纳出共存、拒止、加速三大家族共七种原型策略,并列出危险临近度、共存可行性、克制可行性等五项主要不确定性。其核心结论是美国需投入大量资金提前布局,即便重点只是保留可选性。

  2. MIT Technology Review · AI75

    美国边境 AI 监控塔耗资数十亿,为何没能在移民死亡前发现他们

    MIT Technology Review 调查发现,2015年至2026年初有超过1050人死在美国边境监控塔的覆盖范围内。调查把近4000处遗骸发现地与近600座监控塔的位置交叉比对,死亡出现在所分析塔中近三分之二的范围,其中2021年以来有超过110人死在 Anduril 自主监控塔范围内。CBP 回应称自主监控塔用 AI 检测并提醒探员,但该机构几乎没有评估这些塔的工作效果。

9月20日周日
9月19日周六