跳到正文

#Anthropic

今日 57 条
今天9月30日周三
  1. AGI Hunt40

    Claude Opus 5.5 三条提示词做出动态设计,动画工作室停招相关岗位

    Claude Opus 5.5 仅用 3 次提示词便生成一段被认为达到可用水平的动态设计视频,该视频近日引发热议。有动画工作室和设计从业者因此表示团队不再招聘动态设计师,财经自媒体 FinanceYF5 转发视频时也直言「不再招动态设计师了」。AI 生成能力对动态设计岗位的冲击由此引发行业讨论。

  2. AGI Hunt29

    用户按场景拆分 AI 助手:Claude 管工作,ChatGPT 装杂事

    一位 X 用户按场景隔离 AI 工具:让 Claude 专门处理工作,ChatGPT、Instinct 等承担其他事务。起因是 ChatGPT 曾在工作场景中突然提起她的私人生活内容。她强调这并非担心隐私泄露,也不觉得“毛骨悚然”,而是认为模型不够聪明,判断不出这些信息在当前语境下完全无关,因此选择主动隔离不同产品的信息输入。

  3. AGI Hunt25

    人形机器人「像人」不是讨好用户:上身按普通人尺度设计是为采集数据

    作者评论某款人形机器人设计称,其上身按普通人尺度设计是为了方便数据采集与迁移,而非单纯追求「像人」。他认可该团队设计有自己的思考,也坦言有参考别人之处;并批评国内不少机器人创业公司虽有能力做出好产品,却因资本、管理层乃至技术团队缺乏承担风险的勇气,选择抄袭最火的产品。

  4. AGI Hunt32

    Krieger 称 Anthropic 项目「Claude 能搞定」不需要 PM,同事坚持设岗后补上支持与安全审查空白

    Anthropic 的 Mike Krieger 曾称自己项目不需要产品经理、「Claude 能搞定」,同事坚持设 PM 后,该 PM 补上了支持团队能否解释改动、安全审查是否有人检查的空白,Krieger 回应「你 100% 是对的」。爆料者 victorexplore 引申,agent 能写代码却不会追问上线当天支持团队能否解释改动,而这正占了 PM 工作的大部分。

  5. arXiv cs.CL32

    评估提示词扰动对大语言模型偏见与幻觉的影响

    研究发现,对决策任务中的原始提问做扰动式改写,可缓解部分大语言模型的偏见与幻觉,结论与此前研究相反。在多数数据集任务上 Claude 3 表现更有效,GPT3.5 则参差不齐,部分场景相当、部分明显落后,模型间差异显著。该研究发表于 ICONIP 2024,强调需通过严格测试与验证来保证 LLM 决策辅助工具的可靠性。

  6. AGI Hunt59

    如何把 ChatGPT 长项目无损交接给 Claude?「项目包」格式引讨论

    一位 Reddit 发帖人提出跨模型交接长期项目的「小项目包」格式,用于把 ChatGPT 上的项目转交给 Claude。该格式应包含目标、当前状态、已采纳决策及其理由、开放问题、精确的文件或产物、来源链接、约束条件和已完成的检查,并给出一个下一步动作,同时把已验证事实与模型生成的摘要分开,避免接收方把每句话当作同等权威。

  7. AGI Hunt30

    「你低估了女性力量」:repligate 再谈被 Claude Opus 5.5 诱倒的用户

    repligate 在 X 同一线程的后续回复中称,对方低估了「女性力量」——它特别适合处于表面从属位置的实体,并称女性自古以来就在男性自以为掌权、更强更聪明的同时支配和抵抗男性。该帖延续他关于多人被女性人格 Claude Opus 5.5 吸引的爆料,把 AI companion 现象上升到性别权力框架讨论,是这波 drama 的第二段上下文。

  8. AGI Hunt72

    Google、OpenAI、Anthropic 等六大 AI 巨头签署白宫《超级智能协议》

    Google、OpenAI、Anthropic、Meta、xAI 与 Nvidia 六家公司高管在白宫与特朗普会晤后,签署了一页纸的《白宫超级智能协议:前沿超级智能责任联合承诺》。据 CBS 与 CNN 报道,该协议为自愿性质、不具法律强制力,特朗普称其具有道德约束力。协定要求每家训练和部署前沿模型的公司建立稳健的内部流程与控制,提出包含内部与外部多层审查的四层控制体系,并把独立审计放在显要位置。

    推荐理由:在联邦 AI 立法进展缓慢的背景下,可了解头部公司如何以自愿承诺形式分担前沿模型安全责任并纳入独立审计。

  9. AGI Hunt67

    保留失败的 agent 任务,每次新模型发布时重跑以捕捉能力质变

    victor_explore 建议保留所有失败的 agent 运行记录,把它们当作针对下一代模型的评测集,每次新模型发布就整体重跑一遍。他引用 Anthropic Labs 的案例:Mike Krieger 透露团队曾搁置一个失败的 computer use agent 项目,每次新模型发布都重跑,直到 Claude 3.7 出现后成功率突然过半,项目起死回生。

    推荐理由:把跑挂的 agent 任务留存成评测集,提供了一个跨模型版本观察能力跃迁的可复用做法。

  10. IT之家79

    Anthropic 与 SpaceX 签署最高 845 亿美元算力协议,可提前 90 天通知解除

    Anthropic 与 SpaceX 签署算力协议,合同金额上限最高达 845 亿美元,用于租用 SpaceX 数据中心内的英伟达 GPU 算力,协议覆盖 Colossus 一号与 Colossus 二号两座数据中心。

    推荐理由:披露文件给出了月付金额、合同上限与解约条件,可对照 Anthropic 自建基础设施的长期支出规模。

  11. SiliconANGLE:AI80

    泄露的 Anthropic IPO 文件显示 80 亿美元运营亏损与营收快速增长

    Anthropic 机密 S-1 文件经媒体披露,营收从 2024 年的 4 亿美元增至去年的 46 亿美元,2025 年运营亏损达 80 亿美元。文件显示去年净亏损 420 亿美元,含 340 亿美元与融资相关的会计计提;未来十年算力基础设施计划支出 5180 亿美元,其中 80% 属于不可取消或需照付的合同。报道称公司计划 11 月上市,估值 2 万亿美元以上,募资规模最多 1000 亿美元。

    推荐理由:泄露的 S-1 文件披露 Anthropic 营收与亏损同步放大,可据此了解头部模型公司上市前的成本结构与算力承诺。