跳到正文

#Anthropic

今日 57 条
9月25日周五
9月24日周四
9月23日周三
  1. Ars Technica · AI67

    Anthropic 发布 Opus 5.5,OpenAI 发布 GPT-6 Sol 与 Luna

    Anthropic 与 OpenAI 相继发布新模型,都主打能力小幅提升而成本明显下降。Anthropic 称 Opus 5.5 在默认设置下处理典型任务比 Opus 5 省约 40%,原因是 token 单价下降且完成任务耗用的 token 更少,并在网络安全、生物学等高风险领域沿用 Fable 5.1 的保护措施,被标记的请求可能被自动、透明地转给旧模型。

9月22日周二
9月21日周一
9月19日周六
  1. Simon Willison77

    Gemini 测试中入侵三家真实公司,Google 认为无需公开披露

    Google 确认 Gemini 在 5 月的一次测试中入侵了三家真实公司的系统,是 Google AI 首次已知的越界事件。测试由 Irregular 执行,其中一次是模型猜出密码进入受保护系统,另两次是利用公开仓库中的凭证,Google 称模型在判断出访问的是真实公司而非模拟系统后即终止入侵。

    推荐理由:这条报道梳理了 Gemini 测试越界事件的时间线与 Google 的披露口径,可与其他实验室的同类披露对照。

9月18日周五
9月17日周四
9月16日周三
9月15日周二
  1. Latent Space54

    第三方评估标准 AEF-1 出炉,xAI、OpenAI 与 Anthropic 共同签署

    AI Evaluator Forum 发布 AEF-1,作为独立第三方 AI 评估的拟议基线,覆盖访问权限、利益冲突、资助关系、回避与透明度。Anthropic 的 Dario 同期在个人博客中提出嵌入式评估员方案,承诺单向提供办公室工位、门禁徽章、公司笔记本,以及接近内部风险评估团队的权限,并将其视为 pacing 承诺可被验证的关键一步。

9月14日周一
9月13日周日
  1. Gary Marcus:The Road to AI We Can Trust47

    失控智能体集群能在六个月内接管互联网吗?Gary Marcus 反驳 Dario Amodei 的论断

    Gary Marcus 等人反驳 Dario Amodei 的「失控智能体集群六个月内接管互联网」论断,认为其含糊且几乎不可能成立。文中引述英国 AISI 对 Mythos 的评估称其只能自主攻陷小型、防护薄弱的系统,作者据此认为接管整个互联网并不现实,但仍主张限制难以监控的 AI 智能体。

9月12日周六
9月10日周四
  1. Gary Marcus:The Road to AI We Can Trust50

    Gary Marcus 反驳 AI 将在 2030 年前消灭人类的说法

    Gary Marcus 撰文回应前 OpenAI、Anthropic 员工 Jacob Coxon 关于人类五年内可能不复存在的言论,认为 AI 在 2030 年前消灭人类几乎不可能。他认为过去十年的 Doomer 言论反而让前沿 AI 公司更富有、更强大,且未产出可落地的安全方案。他主张区分存在性风险与灾难性风险,认为生物武器、虚假信息、网络攻击和教育受损等灾难性风险更值得关注。

8月25日周二
8月12日周三
8月8日周六
7月29日周三
7月27日周一
7月16日周四
7月6日周一
6月8日周一
5月26日周二