AGI Hunt· TejasKumar_·· 3 小时前AI 评分57
Tavus 发布实时数字人模型 Griffin,音到画延迟仅 0.43 秒
Tavus 发布 Griffin:开口先于生成完成,音画延迟仅 0.43 秒
AI 导读
Tavus 发布实时数字人模型 Griffin,它全程听、全程看,持续决定该说话、反应还是等待,按你说了什么接管话轮,而不是等声音停下。语音部分把每 10ms 音频压缩成 40 个数字的 latent,模型一知道要说什么就立刻写出下一个 latent 并即时播放,还可用约 10 秒音频克隆声音。
来源:AGI Hunt · agihunt.info