跳到正文
原文
arXiv cs.CV· Jungmin Lee, Niamat Ullah, Yoseob Han·· 4 小时前AI 评分38

EyeTAG:视线轨迹感知的注视估计框架

EyeTAG: Eye Trajectory-Aware Gaze Estimation

AI 导读

EyeTAG 提出一种因果多帧注视估计框架,把对自身近期预测做差分得到的一阶视线轨迹作为显式运动 token 反馈回模型。该框架在 Gaze360 上把平均角度误差降低约 1.0°,在 EVE 上取得 2.56°(最强基线为 2.58°)。由于差分在视线空间具平移不变性,这一 token 携带的是主体无关的运动信息而非个人视线偏移,代码已开源,论文被 BMVC 2026 接收。

来源:arXiv cs.CV · arxiv.org