跳到正文
热点事件持续更新

Google 发布免训练视觉记忆框架 KeyRec

1 篇报道1 个报道来源11 小时前更新

先了解这件事

AI 综述

Google 发布免训练视觉记忆框架 KeyRec,面向视觉语言模型(VLM)的长视频与流式理解。据 2026 年 10 月 6 日报道,该框架借助视觉缓存与结构化事件库保存历史信息,读取时由纯文本路由器在固定 readout 预算内自适应分配记忆,因而无需重新处理历史帧。实验方面,报道称其在 4 个流式/长视频 benchmark、3 个 VLM 骨干共 15 个设置中,有 13 个取得最佳压缩性能;仅使用 10% 的密集视觉 token 预算,实时问题得分超过最强压缩基线 2.21 至 18.37 分。此事件此前已知的信息为 Google 发布 KeyRec 这一框架本身,最新报道补充了方法细节与 benchmark 结果,目前进展仍处于方法与实验数据公布阶段。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    Google 发布 KeyRec:仅用 10% 视觉 token 预算搞定长视频与流式理解

    Google 提出免训练视觉记忆框架 KeyRec,用视觉缓存与结构化事件库支持 VLM 长视频与流式理解,读取时由纯文本路由器在固定 readout 预算内自适应分配记忆,无需重处理历史帧。在 4 个流式/长视频 benchmark、3 个 VLM 骨干的 15 个设置中,13 个取得最佳压缩性能,仅用 10% 密集视觉 token 预算,实时问题超最强压缩基线 2.21-18.37 分。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。