跳到正文

全部动态

今日 147 条
今天9月30日周三
  1. AGI Hunt42

    Raja Koduri 谈 AI 算力成本:西方每吉瓦 500-600 亿美元,中国目标不到 100 亿

    Raja Koduri 在 TechSurge 播客上给出 AI 算力成本对比:西方每建 1 吉瓦 AI 基础设施需投入 500-600 亿美元,中国目标控制在 100 亿美元以内。他称推理是完整的内存层级问题,芯片设计现在 90% 的工作在 spec。这位前 Intel 显卡负责人、Oxmiq Labs 创始人还谈到 "token mills" 概念和一段 Steve Jobs 决策故事。

  2. AGI Hunt36

    程序员自述:AI 辅助开发中每轮重构都会让旧问题迁移到新代码

    一位开发者观察到,AI 辅助开发中代码达到新里程碑后往往还需再做一轮 code review 和深度重构,耗时一两天。更关键的是,上一轮迭代中被掩盖的问题不会消失,而是悄悄迁移到新写的代码里,一天后才发现。这意味着每次重构在解决表面问题的同时可能把缺陷带入新结构,持续审查不可或缺。

  3. AGI Hunt34

    Agent 演示惊艳但一遇例外就露馅:如何度量 Agent 可靠性

    有作者指出,多数 Agent 演示在干净工作流下表现完美,但真实业务充满数据不完整、客户异常、集成损坏、指令含糊、无人记录的决策等例外。其认为 Agent 可靠性的真正考验不是能否走完正常路径,而是它是否知道何时停下来求助,并由此抛出「该如何度量 Agent 可靠性」的讨论问题。

  4. AGI Hunt38

    AndyMasley 长文论证当前 AI 模型真正在「思考」,称反拟人化是哲学谬误

    AndyMasley 发布两篇系列长文的第一部分,主张当前 AI 模型已符合他心中「思考」与「理解」的标准,认为以「拟人化」为由禁用这些词在哲学上是一种混淆。文章从心灵哲学的基础概念入手,剖析人们对自身心智与思维的常见误解,写成写给「聪明的朋友」的入门长文。第二部分将聚焦 AI 实际能做什么。

  5. AGI Hunt35

    被问是否再推开源模型,Sam Altman 称将考虑,网友推荐 NVIDIA Nemotron

    OpenAI 的 Sam Altman 被追问是否会推出更多 gpt-oss 类开源模型,回应称「已经有很多优秀的开源模型,如果我们能在那里做出有用的事,我们会做的」。被追问「我们想要更多可微调的美国模型」时,他仅回答「我们会考虑一下」。发帖人调侃不想等 OpenAI 思考的话可直接看 NVIDIA 的 Nemotron 开源模型系列,折射社区对 OpenAI 开源意愿的不耐。

  6. AGI Hunt24

    梗图对决:让 GPT-6.1 Sol Max 与 Claude Sonnet-5.5 Max 用 SVG 画蒙娜丽莎,产出 11,890 条可编辑矢量路径

    diegocabezas01 发起趣味模型对决,让「GPT-6.1 Sol Max」和「Claude Sonnet-5.5 Max」用 SVG 绘制蒙娜丽莎,产出 11,890 条可编辑矢量路径的图片,并宣称「benchmark solved」。这两个模型名明显是戏仿未来版本的虚构命名,整件事属于 AI 圈玩梗式创作演示,分享价值主要在离谱的 SVG 生成效果。

  7. AGI Hunt34

    科技圈的疯狂反而逼社会重新讨论何为良好生活与爱

    @credenzaclear2 发长文称,科技人士尤其 AI 伴侣与情感话题相关的激进举动,反而加速了一场被推迟已久的公共讨论:何为良好生活、爱的意义与性的本质。她认为过去几十年「不评判」的自由放任氛围留下价值真空,如今正是重新给出明确判定的时机,可以指出良好生活中一些稳定、可定义的要素。

  8. AGI Hunt30

    听障用户的暖心时刻:AI 字幕把亲吻记成「woof woof」

    一位听障用户分享,AI 语音转写把丈夫亲她头顶的声音记成「m...mmm..mmmm」,又把狗叫忠实转写成「woof woof」,她靠这两段字幕才推理出真相。她完全听不到邻居抱怨的狗叫,反而觉得 AI 把狗叫转写成拟声词「可爱到不行」,并在 reddit 发帖问其他人是否也会看到这样的结果。

  9. AGI Hunt52

    剑桥学者 David Krueger 澄清:恶意 prompt 自传播两年前已有论文

    剑桥研究者 David Krueger 针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。

  10. AGI Hunt31

    Wayve 伦敦 Uber 试乘超预期,体验直逼 Waymo

    博主 @gbrulte 分享在伦敦通过 Uber 试乘 Wayve 监督模式自动驾驶,称驾驶平顺、能很好处理旧金山式车流并完成高速并线。他评价 Waymo 仍是当下明显领先者,但 Wayve 势头强劲,在旧金山和拉斯维加斯的乘坐体验好于 Zoox、无路口问题且更平顺,整体接近 Tesla Robotaxi,何时去掉监督是下一步关键。

  11. AGI Hunt22

    SlutCon 遭批公关隐患反被助推出圈

    AI 社区账号 repligate 指出,SlutCon 活动在被指责为「公关隐患」并遭强烈反对后反而获得大规模传播。该活动原本并未引起多少关注,社区意见分裂,部分成员对活动感到不适,也有人认为正是批评助推了它出圈,形成典型的「抵制反成宣传」现象。

  12. AGI Hunt28

    AI 让一切同质化?瓶颈不在技术,而在人的想象力与野心

    面对「AI 正在把一切商品化」的焦虑,有观点给出的答案是用更极端的野心去造更宏大的东西。今天的 AI 能力放到五年前没人会信,但人人可用后并没有出现人人每天创造惊人成果的局面,瓶颈被归到想象力与野心。同一个新模型发布,有人想「这会把所有人变得同质化」,另一些人则想「我要造更大的东西」。

  13. IT之家27

    微星流光 X32 MAG 271QPX32 OLED 显示器体验:新面板 + 旗舰调校,电竞玩家新选择

    微星流光 X32 MAG 271QPX32 OLED 显示器采用 QD-OLED 第 4.5 代面板,配备 2K 分辨率、320Hz 刷新率、最高 1300nits HDR 峰值亮度,价格卡位 3000 元。IT之家实测其 SDR 均匀亮度约 300nits,EOTF 增强可提升 5% 以下小窗口亮度,并提供 AI 视觉、AI 准星、SLMB、Optix 狙击镜及 3 年整机售后与 3 年烧屏险。

  14. SiliconANGLE:AI28

    AI 智能体推动企业身份管理清理与整合

    Okta 首席营收官 Jon Addison 在 Oktane 大会上表示,随着 AI 智能体从试点走向生产,企业正把智能体安全视为既有身份管理工作的延伸,并着手整合零散的身份工具。他指出,大量单点方案会制造安全漏洞,客户因此在规模化部署前先理顺基础架构;部分企业已出现生产环境中的影子智能体,急需建立访问管理控制。

  15. SiliconANGLE:AI30

    HPE Labs 将 AI 主权与量子安全联系起来

    HPE Labs 总监 Andrew Wheeler 表示,AI、数据主权与量子安全正成为企业必须同时应对的议题。他指出全球已有超过 170 个国家出台数据保护或隐私框架,HPE 以加密态势管理和后量子密码就绪能力,帮客户在合规前提下控制敏感数据。

  16. Gary Marcus:The Road to AI We Can Trust68

    Gary Marcus 评纽约时报报道,OpenAI 在 Hugging Face 事件前数月已获警告

    Gary Marcus 引用纽约时报 Sheera Frenkel、Dustin Volz 和 Dylan Freedman 的报道称,OpenAI 员工与高管的往来记录显示,公司在 Hugging Face 事件发生前数月就已收到安全警告,且未把安全列为优先事项。

    推荐理由:借纽约时报披露的警告时间线,作者质疑企业自我监管以及 Jensen Huang 信任这些公司的说法。

  17. Gary Marcus:The Road to AI We Can Trust55

    Gary Marcus 点评白宫超级智能协议过于软弱

    Gary Marcus 发文点评白宫超级智能协议,认为其核心是签署方承诺不受监管、也不给公众发言权,只能靠信任。他质疑协议中所谓独立监督是否只是由大公司自己挑选的承包商承担,并追问两周前各方热议的 Pacing 议题为何消失。他还指出,Dario、Sam 和 Elon 都退缩了。