跳到正文
热点事件持续更新

MEMO:流式视频多级实体感知记忆框架

1 篇报道1 个报道来源7 小时前更新

先了解这件事

AI 综述

2026年10月1日,arXiv cs.CV 刊出一篇报道,介绍 MEMO——一个面向流式视频理解的多层级实体感知记忆框架。据该报道,MEMO 免训练、即插即用,以多层级实体感知的结构化记忆接入现有多模态大语言模型。它将视频切分为语义片段,用轻量的全局表示与实体级表示作为检索索引,高分辨率视觉内容则另行存储、按需召回。报道称,在 StreamingBench 与 OVO-Bench 上,MEMO 对多个基座模型均有持续提升,并达到 SOTA。目前该消息仅见于此篇报道,暂无其他来源的复现或对比信息。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv cs.CV
    MEMO:面向流式视频理解的多层级实体感知记忆框架

    MEMO 是免训练、即插即用的流式视频理解框架,以多层级实体感知的结构化记忆接入现有多模态大语言模型。它将视频切为语义片段,用轻量全局与实体级表示作检索索引,高分辨率视觉内容另存按需召回。在 StreamingBench 与 OVO-Bench 上,MEMO 持续提升多个基座模型并达到 SOTA。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。