热点事件持续更新
Google 多模态嵌入模型须弃用 FP16
2 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
Google 发布多模态嵌入模型并给出使用规范:视频默认每秒采样 1 帧,音频需为 16 kHz 单声道,每张图像或帧的视觉 soft token 预算可在 70 至 1120 之间配置。模型卡同时警告,运行该模型时应弃用 FP16,改用 BF16 或 FP32,原因是模型激活值范围超出 FP16 动态范围,否则会出现 NaN 或嵌入向量静默退化。同一时间的另一篇报道称,tomaarsen 也提醒 EmbeddingGemma 2 不要使用 FP16,理由相同,必须改用 BF16 或 FP32,模型卡同样警告会出现 NaN 或嵌入质量静默退化。目前尚未见 Google 方面对这些警告作出回应。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 00:26
模型卡警告:多模态嵌入模型须弃用 FP16,改用 BF16 或 FP32,否则 NaN 或静默退化。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- AGI Hunttomaarsen 提醒 EmbeddingGemma 2 不要用 FP16,会 NaN 或静默降质
EmbeddingGemma 2 必须使用 BF16 或 FP32,不能使用 FP16。tomaarsen 指出该模型的激活范围超出 FP16 的动态范围,模型卡警告会出现 NaN 或静默退化的嵌入质量。
- AGI HuntGoogle 多模态嵌入模型发布,推理须弃用 FP16
Google 发布多模态嵌入模型,视频默认每秒采样 1 帧,音频需为 16 kHz 单声道,每个图像或帧的视觉 soft token 预算可在 70 至 1120 之间配置。运行该模型时应弃用 FP16,改用 BF16 或 FP32,因模型激活值范围超出 FP16 动态范围。模型卡警告会出现 NaN 或嵌入向量静默退化。
本事件热度走势
当前热度 9·可比范围峰值 10(10月7日 01:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。