跳到正文
原文
AGI Hunt· Monash·· 3 小时前AI 评分32

HLA-WM:免训练混合注意力,长视频世界模型记忆省12倍

AI 导读

HLA-WM 是免训练的混合线性注意力框架,缓解长时程视频世界模型的远程遗忘。它缓存 GDN 的分块转移摘要,用相机几何检索相关历史分块并重组为查询特定的循环状态。在 60 秒 SANA-WM-Bench 上 6 项指标全部提升,含 +0.74 dB PSNR、旋转误差降 28.5%;60 秒上下文下历史状态内存较全 KV cache 减少 12 倍,推理吞吐仅降最多 1.6%。

来源:AGI Hunt · agihunt.info