arXiv cs.CV· Yu Yuan, Yawen Lu, Guoxian Song, Kevin Duarte, Ratheesh Kalarot, Di Chang, Xijun Wang, Stanley H. Chan·· 4 小时前AI 评分34
Reimagine Video Dynamics(RVD):解耦可编辑动态 token 的视频动态编辑框架
Reimagine Video Dynamics
AI 导读
Reimagine Video Dynamics(RVD)框架从视觉上下文中解耦出紧凑、可编辑的动态 token,并通过自监督重建学习该 token。其语言引导的动态 token 编辑器可将源动态转换为目标动态,训练使用可扩展的反事实视频对管线和两阶段策略。实验显示 RVD 支持视频动态编辑、免训练 retiming 和外观受控重渲染。
来源:arXiv cs.CV · arxiv.org