跳到正文
热点事件持续更新

Exo2EgoHOI:手物交互感知的视角转换视频生成

1 篇报道1 个报道来源7 小时前更新

先了解这件事

AI 综述

2026年10月1日,arXiv cs.CV 刊登 Exo2EgoHOI 论文,提出一种手-物交互(HOI)感知的第三人称到第一人称(Exo2Ego)视频生成框架。该框架可将第三人称操作视频转换为第一人称观测视频。为保留细粒度的手-物交互,它采用统一的 4D HOI 先验,并设计双分支残差适配器;为维持物体一致性,引入 Decomposed Gated Cross-Attention(分解门控交叉注意力)。报道未给出所用数据集、定量指标或对比结果等更多细节。目前仅有这一篇报道,尚无后续进展或不同说法。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv cs.CV
    Exo2EgoHOI:保持手-物交互的第三人称到第一人称视频生成框架

    Exo2EgoHOI 是 HOI 感知的第三人称到第一人称视频生成框架,可将第三人称操作视频转为第一人称观测。它用统一 4D HOI 先验和双分支残差适配器保留细粒度手-物交互,并以 Decomposed Gated Cross-Attention 维持物体一致性。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。