Anthropic 发布 Claude Sonnet 5.5,多项基准接近 Opus 5.5,单任务成本最多低 30%
Anthropic 发布 Claude 5.5 家族第二个模型 Claude Sonnet 5.5,输出生成速度提升超过 30%,每任务成本最多降低 30%,并在多项基准上接近 Opus 5.5。
推荐理由:文中给出 Sonnet 5.5 与 Opus 5.5、GPT-6 Sol 的跑分和 token 单价对照,可比较同档模型的成本差异。
Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
Anthropic 发布 Claude 5.5 家族第二个模型 Claude Sonnet 5.5,输出生成速度提升超过 30%,每任务成本最多降低 30%,并在多项基准上接近 Opus 5.5。
推荐理由:文中给出 Sonnet 5.5 与 Opus 5.5、GPT-6 Sol 的跑分和 token 单价对照,可比较同档模型的成本差异。
美国哥伦比亚特区联邦上诉法院以 2-1 裁定,支持五角大楼将 Anthropic 列为供应链风险,Claude 被排除出国防部信息系统的状态将继续维持。法院多数意见认为,国防部有充分依据认定 Claude 的持续接入构成国家安全风险,因为 Anthropic 在模型中写入限制、拒绝执行某些任务;Anthropic 表示对自身立场仍有信心,正考虑向更广泛的合议庭或最高法院上诉。
推荐理由:判决呈现模型厂商的安全限制与国防采购条款之间的冲突,也牵动 Claude 在联邦系统中的去留。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,Simon Willison 记录了自己对这些新模型的定价观察与实测表现。
推荐理由:文章给出 Claude Opus 5.5、GPT-6 Sol 与 Luna 的最新定价和实测表现,可以看清这轮模型降价对调用成本的直接影响。
AWS 宣布 Claude Opus 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,这是 Claude 5.5 系列的首个模型。
推荐理由:文章对比了 Claude Opus 5.5 与 Opus 5 在 token 效率、定价和安全分类器上的差异,并给出在 Bedrock 上调用该模型的代码示例。