跳到正文
原文
arXiv cs.CV· Chang-Bae Bang, Hyungjin Chung, Byung-Hoon Kim·· 8 小时前AI 评分40

视频扩散模型:未来视频生成比观察视频更贴合人类视觉皮层

Future Video Generation Better Aligns with the Human Visual Cortex than Observed Video

AI 导读

比较 AR 视频扩散模型与其非 AR 基座模型的内部表征和人类视觉皮层 fMRI 响应的对齐后发现,面向未来视频生成的表征比观察视频本身的表征更贴合视觉皮层。观察视频重建的对齐集中在低级视觉皮层,未来视频生成的对齐则集中在高级视觉皮层。人类行为实验还显示,受试者更偏好放大与视觉皮层对齐更好的单层贡献后生成的视频。

来源:arXiv cs.CV · arxiv.org