arXiv cs.CV· Minsu Kim, Jaesung Choe, Jiwoo Lee, Yu-Chiang Frank Wang, Seon Joo Kim·· 4 小时前AI 评分35
RelationVGGT:面向 3D 空间关系分割的视觉几何 Transformer
RelationVGGT: Visual Geometry Transformers for 3D Spatial Relation Segmentation
AI 导读
RelationVGGT 提出前馈、无需相机位姿的多视角 3D 空间关系分割框架,可在不接收目标类别名称的情况下,按视觉指定的主体与关系文本查询跨视角分割目标。
来源:arXiv cs.CV · arxiv.org