AGI Hunt· RisingSayak·· 2 小时前AI 评分61
MIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers
MIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers
AI 导读
MIT 推出开源权重视频模型 Kandinsky,支持视频与音频联合生成。模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,发布当天即可直接调用。
来源:AGI Hunt · agihunt.info