跳到正文
热点事件持续更新

VidScribe:视频文本渲染与编辑基准发布

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年9月30日,arXiv 计算机视觉(cs.CV)板块出现 VidScribe,一个统一视频生成中视觉文本渲染与原位编辑的评测基准。该基准覆盖 T2V、R2V、I2V、V2V 四种生成范式,包含 803 个人工核验样本与 11 项共享指标。研究团队据此对 11 个商业与开源系统进行评测,结果显示:内容识别与笔画级字形正确性相互解耦;I2V 最能稳定保持文本;V2V 原位编辑是主要瓶颈;性能退化集中在少数文本结构与时序因素上,而非恶劣成像条件。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.CV
    VidScribe:统一视频生成中视觉文本渲染与原位编辑的基准评测

    VidScribe 是统一视频文本基准,覆盖 T2V、R2V、I2V、V2V 四种生成范式,含 803 个人工核验样本与 11 项共享指标。对 11 个商业与开源系统的评测显示,内容识别与笔画级字形正确性解耦,I2V 最能稳定保持文本,V2V 原位编辑是主要瓶颈。退化集中在少数文本结构与时序因素,而非恶劣成像条件。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。