热点事件持续更新
RVD:解耦视频动态的可编辑框架
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026 年 9 月 30 日,arXiv cs.CV 刊出 Reimagine Video Dynamics(RVD)框架。该框架的核心思路是把视频中的动态从视觉上下文中解耦出来,形成紧凑、可编辑的动态 token,并通过自监督重建来学习这一表示。在编辑环节,RVD 使用一个语言引导的动态 token 编辑器,把源动态转换为目标动态;训练则依赖一条可扩展的反事实视频对管线与两阶段策略。报道称,实验结果显示 RVD 能够支持视频动态编辑、免训练 retiming 以及外观受控的重渲染。截至目前,该工作以论文形式公开,暂无后续版本或其他来源的进一步报道。
AI 根据报道生成 · 3 小时前更新
最新进展9月30日 12:00
arXiv 发布 RVD 框架,以自监督动态 token 与语言引导编辑实现视频动态编辑。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv cs.CVReimagine Video Dynamics(RVD):解耦可编辑动态 token 的视频动态编辑框架
Reimagine Video Dynamics(RVD)框架从视觉上下文中解耦出紧凑、可编辑的动态 token,并通过自监督重建学习该 token。其语言引导的动态 token 编辑器可将源动态转换为目标动态,训练使用可扩展的反事实视频对管线和两阶段策略。实验显示 RVD 支持视频动态编辑、免训练 retiming 和外观受控重渲染。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。