热点事件持续更新
MIT开源Kandinsky视频音频联合生成模型
1 篇报道1 个报道来源1 小时前更新
先了解这件事
AI 综述
2026年10月6日,MIT 推出开源权重的视频模型 Kandinsky,支持视频与音频联合生成。该模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,模型发布当天即可直接调用。目前尚无其他来源的报道,关于模型参数规模、训练数据与授权条款等细节均未提及。
AI 根据报道生成 · 58 分钟前更新
最新进展10月6日 21:12
MIT 开源视频音频联合生成模型 Kandinsky,6 个变体已被 Diffusers 完成 day0 集成。报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- AGI HuntMIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers
MIT 推出开源权重视频模型 Kandinsky,支持视频与音频联合生成。模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,发布当天即可直接调用。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。