跳到正文
原文
AGI Hunt· AlchainHust·· 5 小时前AI 评分41

豆包与 Qwen 语音模型:10 秒语音即可低成本复刻音色

AI 导读

AI 圈博主 Alchain 称,豆包和 Qwen 的语音模型只需投喂约 10 多秒语音样本,就能把音色复刻得相当好,而且价格便宜。他建议让自己的 agent 调用这类语音克隆能力,若 VoxCPM 效果不理想,可换这些方案尝试。

来源:AGI Hunt · agihunt.info