token 价格走低,H100 租金半年上涨 16%-30%
开发者 julsimon 对比多家供应商数据发现,H100 SXM 按需租用价格半年内上涨 16%-30%,RunPod Secure Cloud 单卡时价格从 3 月的 $2.69 涨至 9 月的 $3.49。这一走势与持续下降的 token 价格形成反差,作者认为反映算力供需紧张。他还发布了覆盖 106 个模型、116 种实例的比价计算器,用于评估不同推理方案的成本。
开发者 julsimon 对比多家供应商数据发现,H100 SXM 按需租用价格半年内上涨 16%-30%,RunPod Secure Cloud 单卡时价格从 3 月的 $2.69 涨至 9 月的 $3.49。这一走势与持续下降的 token 价格形成反差,作者认为反映算力供需紧张。他还发布了覆盖 106 个模型、116 种实例的比价计算器,用于评估不同推理方案的成本。
AAOI(应用光电)被指在美国做过度的垂直整合,CW 激光器产线烧掉大量资本开支后良率依然很差。引用的分析师观点更激进,称只关心 UHP 激光器,Coherent、除源杰外的中国激光公司、Source Photonics(东山精密)与 AAOI 都不行,这批公司是被不懂激光的人推起来的。这折射出 AI 光模块供应链的垂直整合之争与良率隐忧。
Oracle 算力交付进度显示,Project Jupiter 大概率延期约 6 个月至 2027 年产能,但管理层重申不影响营收指引。不含 Jupiter 的本年度节奏为 Q1 交付超 400MW、Q2 再交付 400-500MW、Q3 计划交付 850MW、Q4 计划交付 1.1GW。
DeepSeek 批量更新其大部分开源库,新增对华为昇腾(Huawei Ascend)的支持。eliebakouch 指出了这一更新,yacineMTB 以夸张的戏剧化反应转发,暗示这一 NVIDIA 生态替代信号值得关注。
独立开发者、Ice Cubes 作者 Dimillian 宣布,他加入 OpenAI 后作为 onboarding 工程师的首个项目已合入主分支,这次修复将磁盘写入量减少 50%、存储文件体积缩小 4 倍。他开玩笑希望 Neo 在 DevDay 演讲中提及此事,但 Neo 没看他发的 Slack 私信。
戴尔 AI 领导力峰会上专家总结出企业 AI 部署的四大洞察:成本与控制正取代模型和 GPU 成为核心议题。戴尔称依托长期芯片合作可在两周内交付 350 个机架,Deepgram 的语音模型将从数据中心走向在 AI 笔记本上物理隔离运行。token 预算被数周耗尽,推动负载回流本地并让 CPU 在智能体 AI 中重新受重视,运行时治理成为企业智能体的准入门槛。
新华三发布 UniPoD S81000 X1 超节点,单 Scale-Up 域最大支持 40 张国产加速卡。该产品通过 4 个 Scale-Up 专用交换 Tray 实现一级 CLOS 全互联,任意两卡间 P2P 带宽达 448GB/s,40 卡聚合为 5760GB 统一编址显存池,支持 FP8,总算力可达 28P FLOPS。
Vercel 创始人 Guillermo Rauch 宣布团队已把梅赛德斯-AMG PETRONAS F1 车队官网迁移到 Vercel,构建速度提升约 70%,页面绘制(paint)速度提升约 75%。这是一个包含大量原服务商特有模式的成熟生产级站点,迁移以尽量少人工干预为原则,实际工作不到一周完成。团队还从迁移过程中提炼出两个 AI skills,计划随后开源。
吉利智充 C12 在杭州、上海、宁波、嘉兴、西安五城同步落地,单枪峰值功率 2250 千瓦,10% 至 97% 补能平均用时 8 分 40 秒。该技术依托吉利与阶跃星辰联合开发的全域能源大模型“星睿 PowerMind 能源大脑”,AI“边充边养”使充电最高温度低于 65℃,电池循环寿命提升 20% 以上。领克 10、极氪 001 搭载 900V 神盾金砖超短刀电池,最高充电倍率 12C。
Autoheal 完成 $7.9M 种子轮融资,由 Innovation Endeavors 领投,其平台用 Evaluator agent 和 Healer agent 评估并修复企业软件工厂中的 AI 智能体。
SK 海力士凭借在 CoWoS 2.5D 先进封装平台上的 HBM5 内存验证,获台积电“3DFabric-HBM 集成”类别年度合作伙伴奖,连续第二年获奖。该公司还在活动上展示 12Hi 48GB HBM4E 等新品,并表示正为 PCIe Gen6 / Gen7 固态硬盘准备基于 Chiplet、以 UCIe 互连的控制器方案。
Dell Technologies 将于 10 月 6–7 日举办“AI Data Platform Event: From Ambition to AI at Scale”线上活动,theCUBE 同步直播并由分析师 Dave Vellante、John Furrier 进行独家访谈。
theCUBE 将于 9 月 29 日直播 Dell AI Leadership Symposium,Dell 与 Deepgram、Intel 等企业代表将讨论把 AI 推向生产环境所需的基础设施与运营决策。
CoreWeave 完成 Nvidia Vera Rubin NVL72 在 CoreWeave Cloud 上的行业首次 bring-up 与验证,推进面向智能体 AI 的全栈 AI 云布局。
Airbnb 扩大对 GPT-6 Astra 及 OpenAI 前沿模型的接入范围,帮助工程团队排查 bug、设计系统并加快交付。
曼彻斯特大学用 NVIDIA Earth-2 生成式模型训练出覆盖全英的空气污染模型,分辨率 2-3 平方公里,在 Isambard-AI 的单个八卡节点上仅用两天完成训练。
Cloudera 与 Mistral 宣布合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中运行推理并保留完全控制权。企业还可在受控环境内用大量专有数据训练自定义模型,并以开放权重拥有数据和模型智能。Cloudera 平台承载着 30 exabytes 的客户管理数据。
Meta 发布 MetaRoCE,这是一款为 AI 工作负载在通用以太网上从零设计的 RDMA 传输协议,并通过 OCP 开放协议规范、软件参考实现 libsoftmetaroce 和合规测试套件。
Meta 公布 MTIA 300,这是其自研芯片家族中首款面向推荐与排序模型训练优化的加速器。芯片封装内集成两个网络 chiplet,各含 6 个定制 800 Gbps RDMA NIC,总 I/O 带宽 1.2 TB/s,另有 16 个消息引擎(ME)独立承担通信,使大 GEMM 与集合通信并发时计算吞吐下降小于 0.5%。
Mistral AI 宣布推出 Mistral Compute,为客户提供私有的集成 AI 基础设施栈,涵盖 GPU、编排、API、产品与服务,形态从裸金属服务器到全托管 PaaS。