跳到正文
热点事件持续更新

RVD:解耦视频动态的可编辑框架

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026 年 9 月 30 日,arXiv cs.CV 刊出 Reimagine Video Dynamics(RVD)框架。该框架的核心思路是把视频中的动态从视觉上下文中解耦出来,形成紧凑、可编辑的动态 token,并通过自监督重建来学习这一表示。在编辑环节,RVD 使用一个语言引导的动态 token 编辑器,把源动态转换为目标动态;训练则依赖一条可扩展的反事实视频对管线与两阶段策略。报道称,实验结果显示 RVD 能够支持视频动态编辑、免训练 retiming 以及外观受控的重渲染。截至目前,该工作以论文形式公开,暂无后续版本或其他来源的进一步报道。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.CV
    Reimagine Video Dynamics(RVD):解耦可编辑动态 token 的视频动态编辑框架

    Reimagine Video Dynamics(RVD)框架从视觉上下文中解耦出紧凑、可编辑的动态 token,并通过自监督重建学习该 token。其语言引导的动态 token 编辑器可将源动态转换为目标动态,训练使用可扩展的反事实视频对管线和两阶段策略。实验显示 RVD 支持视频动态编辑、免训练 retiming 和外观受控重渲染。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。