跳到正文
热点事件持续更新

ViT物体绑定信号随距离指数衰减

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月2日,arXiv cs.CV 一篇论文报告:在 DINO 与 CLIP 等预训练 Vision Transformer 中,可从冻结的 patch embedding 以高准确率解码出 IsSameObject(是否属于同一物体)信号,说明物体绑定信息已在预训练表征中涌现。但该绑定具有有限的空间视野:同一物体的两个 patch 被判为绑定的概率随两者距离增大而呈指数衰减,并最终停在一个非零下限,而非降至零。截至最新报道,未出现与上述结论相矛盾的说法。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv cs.CV
    DINO 与 CLIP 中涌现的物体绑定存在有限空间视野

    预训练 Vision Transformer 的 IsSameObject 信号可从冻结 patch embedding 高准确率解码,但绑定是局部的:同一物体两个 patch 被判为绑定的概率随距离指数衰减,并停在非零下限。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。