跳到正文
原文
arXiv cs.CV· Minsu Kim, Jaesung Choe, Jiwoo Lee, Yu-Chiang Frank Wang, Seon Joo Kim·· 4 小时前AI 评分35

RelationVGGT:面向 3D 空间关系分割的视觉几何 Transformer

RelationVGGT: Visual Geometry Transformers for 3D Spatial Relation Segmentation

AI 导读

RelationVGGT 提出前馈、无需相机位姿的多视角 3D 空间关系分割框架,可在不接收目标类别名称的情况下,按视觉指定的主体与关系文本查询跨视角分割目标。

来源:arXiv cs.CV · arxiv.org