跳到正文
热点事件持续更新

Foveated Compression:视觉token压缩

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月7日,arXiv cs.CV 的报道介绍了 Foveated Compression 这一视觉 token 高效压缩方法。报道称,该方法只对全分辨率图像编码一次,并以原生分辨率与压缩分辨率混合的 token 来表示图像;其中 Foveated Selector 会从九个空间单元中选择一个,对该单元保留原生分辨率。报道称,该设计面向 Token 高效的视觉语言模型(VLM),目的是选择性保留高分辨率信息。截至该篇最新报道,公开内容仍为方法层面的描述,尚未提及实验结果等更多细节。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.CV
    Foveated Compression:为 Token 高效的 VLM 选择性保留高分辨率

    Foveated Compression 只编码一次全分辨率图像,以原生与压缩分辨率混合的 token 表示,由 Foveated Selector 从九个空间单元中择一保留原生分辨率。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。