热点事件持续更新
FigAct:把科学图表变成可讲解的视觉画布
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026年9月30日,arXiv cs.AI 刊出 FigAct 相关研究:该方法可将静态科学图表转化为“问题条件下”的可视化演示,通过生成简短旁白、把每句旁白定位到对应的视觉证据,并施加视觉动作来引导观众注意力。技术层面,其分层搜索策略据称可将 token 用量降低约 40 倍;团队以 grounding 准确率、搜索效率、渲染质量三项奖励训练出 FigAct-8B 模型。此外,团队基于真实科学论文图表构建了经人工核验的 benchmark,用于评测多模态大模型生成有依据视觉解释的能力。目前进展停留在论文与方法、模型及评测集发布阶段。
AI 根据报道生成 · 3 小时前更新
最新进展9月30日 12:00
arXiv 新论文披露 FigAct:静态科学图表可转为带旁白与视觉定位的演示,token 用量降约 40 倍。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv cs.AIFigAct:把科学图表变成可主动解释的演示画布
FigAct 可将静态科学图表转化为问题条件下的可视化演示,通过生成简短旁白、将每句旁白定位到对应视觉证据并施加视觉动作来引导注意力。其分层搜索策略让 token 用量降低约 40×,并用 grounding 准确率、搜索效率、渲染质量三项奖励训练出 FigAct-8B。团队还基于真实科学论文图表构建了人工核验 benchmark,评测 MLLMs 生成有依据视觉解释的能力。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。