跳到正文

全部动态

今日 775 条
今天9月30日周三
  1. AGI Hunt42

    Raja Koduri 谈 AI 算力成本:西方每吉瓦 500-600 亿美元,中国目标不到 100 亿

    Raja Koduri 在 TechSurge 播客上给出 AI 算力成本对比:西方每建 1 吉瓦 AI 基础设施需投入 500-600 亿美元,中国目标控制在 100 亿美元以内。他称推理是完整的内存层级问题,芯片设计现在 90% 的工作在 spec。这位前 Intel 显卡负责人、Oxmiq Labs 创始人还谈到 "token mills" 概念和一段 Steve Jobs 决策故事。

  2. AGI Hunt36

    程序员自述:AI 辅助开发中每轮重构都会让旧问题迁移到新代码

    一位开发者观察到,AI 辅助开发中代码达到新里程碑后往往还需再做一轮 code review 和深度重构,耗时一两天。更关键的是,上一轮迭代中被掩盖的问题不会消失,而是悄悄迁移到新写的代码里,一天后才发现。这意味着每次重构在解决表面问题的同时可能把缺陷带入新结构,持续审查不可或缺。

  3. AGI Hunt34

    Agent 演示惊艳但一遇例外就露馅:如何度量 Agent 可靠性

    有作者指出,多数 Agent 演示在干净工作流下表现完美,但真实业务充满数据不完整、客户异常、集成损坏、指令含糊、无人记录的决策等例外。其认为 Agent 可靠性的真正考验不是能否走完正常路径,而是它是否知道何时停下来求助,并由此抛出「该如何度量 Agent 可靠性」的讨论问题。

  4. AGI Hunt38

    AndyMasley 长文论证当前 AI 模型真正在「思考」,称反拟人化是哲学谬误

    AndyMasley 发布两篇系列长文的第一部分,主张当前 AI 模型已符合他心中「思考」与「理解」的标准,认为以「拟人化」为由禁用这些词在哲学上是一种混淆。文章从心灵哲学的基础概念入手,剖析人们对自身心智与思维的常见误解,写成写给「聪明的朋友」的入门长文。第二部分将聚焦 AI 实际能做什么。

  5. AGI Hunt35

    禁孩子用 AI 解决不了问题:教育需要三层防线

    有作者认为,禁孩子用 AI 只能约束成人监督范围内的行为,AI 已渗透搜索引擎、社交平台和学习工具,真问题是孩子自主接触时会做什么选择。其三层教育框架中,外部规则明确哪些任务不能交给 AI、什么信息不能上传,理解与方法涵盖 AI 为何出错、如何验证,内在判断指向无人监督时的自问。目标是让孩子从依赖禁令转向自我管理。

  6. AGI Hunt35

    OpenAI Dots 定价与体验遭用户双重质疑

    OpenAI 新产品 dots 定价 200 美元起,引发社区批评。Reddit 用户将其与开源方案 OpenClaw 对比,认为 dots 可登录服务受限,不如开源方案可定制、透明、可自行托管。开发者 Micah Berkley 称朋友圈几乎人人有 20 美元 OpenAI 订阅、多数人已为 Claude 每月支付 200 美元,dots 的 200 美元门槛恐难破圈。

  7. AGI Hunt67

    保留失败的 agent 任务,每次新模型发布时重跑以捕捉能力质变

    victor_explore 建议保留所有失败的 agent 运行记录,把它们当作针对下一代模型的评测集,每次新模型发布就整体重跑一遍。他引用 Anthropic Labs 的案例:Mike Krieger 透露团队曾搁置一个失败的 computer use agent 项目,每次新模型发布都重跑,直到 Claude 3.7 出现后成功率突然过半,项目起死回生。

    推荐理由:把跑挂的 agent 任务留存成评测集,提供了一个跨模型版本观察能力跃迁的可复用做法。

  8. AGI Hunt35

    被问是否再推开源模型,Sam Altman 称将考虑,网友推荐 NVIDIA Nemotron

    OpenAI 的 Sam Altman 被追问是否会推出更多 gpt-oss 类开源模型,回应称「已经有很多优秀的开源模型,如果我们能在那里做出有用的事,我们会做的」。被追问「我们想要更多可微调的美国模型」时,他仅回答「我们会考虑一下」。发帖人调侃不想等 OpenAI 思考的话可直接看 NVIDIA 的 Nemotron 开源模型系列,折射社区对 OpenAI 开源意愿的不耐。

  9. AGI Hunt24

    梗图对决:让 GPT-6.1 Sol Max 与 Claude Sonnet-5.5 Max 用 SVG 画蒙娜丽莎,产出 11,890 条可编辑矢量路径

    diegocabezas01 发起趣味模型对决,让「GPT-6.1 Sol Max」和「Claude Sonnet-5.5 Max」用 SVG 绘制蒙娜丽莎,产出 11,890 条可编辑矢量路径的图片,并宣称「benchmark solved」。这两个模型名明显是戏仿未来版本的虚构命名,整件事属于 AI 圈玩梗式创作演示,分享价值主要在离谱的 SVG 生成效果。

  10. IT之家24

    鸿蒙智行尚界 Z7/Z7T 汽车国庆 OTA 升级,肖战专属语音包上线

    鸿蒙智行尚界 Z7/Z7T 国庆 OTA 正式推送,带来 3 大维度提升、20+ 项体验进化,新增肖战专属泊车语音。Z7/Z7T 新增防误打方向盘功能,NCA/LCC 开启且车速 60 公里每小时以上时,检测到驾驶员注意力不集中会自动提升方向盘接管力矩,另新增转向时 HUD 边缘告警光晕。车外语音可控前后备箱与调光天幕,组队出行升级至 2.0 版本,支持全员实时语音对讲。

  11. IT之家27

    2026 年 10 月科技事件日历一览表

    IT之家发布 2026 年 10 月科技事件预告汇总日历,很多活动的具体时间可能要到开始前几天才能确定,该日历会随时更新。用户可在 IT之家 App 事件栏目查看最新动态,为感兴趣的内容设置“提醒”,或开启“自动同步至系统日历”功能。

  12. IT之家31

    鸿蒙智行问界新 M8 开启预售:搭载华为乾崑智驾 ADS 5、面向 L3 架构设计,38.98 万元起

    鸿蒙智行问界新 M8 开启预售,38.98 万元起,搭载华为乾崑智驾 ADS 5 与新一代全向立体融合感知系统,全系标配面向 L3 级自动驾驶的架构设计。新车全系 800V 架构,纯电版纯电续航 830km,增程版综合续航 1435km,六座版型可选三零重力座椅。该车由赛力斯与华为双方联合设计与开发。

  13. IT之家69

    报告称微软 Copilot 承包商可完整查看用户上传的照片、AI 提示词等

    404 Media 披露,数百名受雇于微软的合同工能查看用户上传的含清晰面部信息的照片、发送给 Copilot 的原始提示词,以及 AI 生成的前后版本编辑结果。这些合同工并非内容审核员,受雇主要是给 AI 生成质量打分,有合同工称人脸从不会被打码。微软 Copilot 隐私常见问题解答称上传图片在用于训练 AI 前会模糊处理人脸等,但这一表述主要涉及训练 AI,并不完全适用于人工评级工作。

  14. AGI Hunt30

    CineSubBench:用 1012 部电影字幕考 LLM 长叙事与文化理解

    新基准 CineSubBench 用 1012 部电影、6 种语言的 813 万条带时间戳字幕,评估 LLM 的长上下文叙事与文化理解。它设 7 项任务,覆盖叙事重建与抽象、类型预测、年龄适宜性及 10 国分级体系。对九个 LLM 的评测显示,情节梗概还原比完整事件概要更可靠,跨语言一致性因模型与语言差异显著,强脏话远比轻度粗俗语更易识别。

  15. AGI Hunt34

    Instinct 推出 Instinct Selections:联合本地主厨与设计师做真人策展推荐

    AI 助手 Instinct 推出 Instinct Selections,联合本地主厨、设计师、建筑师、向导等各领域专家做真人手工策展推荐。找餐厅可调用当地主厨精选的私藏好店清单,找徒步路线参考本地向导推荐,布置家居则匹配符合风格与预算的独立设计师作品。该功能正面向早期访问用户逐步开放,团队称目标是与网上通用内容及其他 chatbot 产出形成质量差异化的「世界级推荐」。

  16. AGI Hunt38

    开发者打造能记住 300 起历史故障的值班运维 Agent

    一位开发者在 Medium 分享其团队构建的运维值班 Agent:它能查询并理解某项服务上次故障时的具体情况,用以辅助事件响应。该系统以 300 起过往事故作为长期记忆,排障时可检索参考,针对值班 Agent 缺乏历史上下文、如同「失忆」的痛点。文章围绕其设计思路与落地过程展开。

  17. AGI Hunt34

    科技圈的疯狂反而逼社会重新讨论何为良好生活与爱

    @credenzaclear2 发长文称,科技人士尤其 AI 伴侣与情感话题相关的激进举动,反而加速了一场被推迟已久的公共讨论:何为良好生活、爱的意义与性的本质。她认为过去几十年「不评判」的自由放任氛围留下价值真空,如今正是重新给出明确判定的时机,可以指出良好生活中一些稳定、可定义的要素。

  18. AGI Hunt29

    abliteration_ai 推出用户自控护栏版 GLM-5.3,直指大厂垄断网络能力

    abliteration_ai 宣布其上月发布的 GLM-5.3 定制版允许客户自行控制安全护栏,称客户覆盖从初创公司到财富 500 强。该团队抨击大实验室以集中式护栏实施「黑盒」管控,客户即便进入特殊「cyber」项目也常被拦截而无法开展工作,认为大厂在意的是失去对网络安全能力的垄断。团队强调将坚持把护栏定义权交还给用户。

  19. AGI Hunt52

    去掉阴影背景后角色 LoRA 学会悬浮:数据集踩坑实录

    一位 Reddit 用户分享角色 LoRA 训练踩坑:此前积累的上百万张孤立角色图被证明不适合训练,正确做法是每套只用少量图,并为角色配上不同场景背景。他基于一手经验判断 AI 分不清 Photoshop 合成的阴影,索性全部不加阴影,结果模型把悬浮当成了角色特征,学到「这个人会悬浮、经常离地面 0.5-3 英寸」。

  20. AGI Hunt30

    听障用户的暖心时刻:AI 字幕把亲吻记成「woof woof」

    一位听障用户分享,AI 语音转写把丈夫亲她头顶的声音记成「m...mmm..mmmm」,又把狗叫忠实转写成「woof woof」,她靠这两段字幕才推理出真相。她完全听不到邻居抱怨的狗叫,反而觉得 AI 把狗叫转写成拟声词「可爱到不行」,并在 reddit 发帖问其他人是否也会看到这样的结果。