跳到正文
热点事件持续更新

MIT开源Kandinsky视频音频联合生成模型

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月6日,MIT 推出开源权重的视频模型 Kandinsky,支持视频与音频联合生成。该模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,模型发布当天即可直接调用。目前尚无其他来源的报道,关于模型参数规模、训练数据与授权条款等细节均未提及。

AI 根据报道生成 · 58 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    MIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers

    MIT 推出开源权重视频模型 Kandinsky,支持视频与音频联合生成。模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,发布当天即可直接调用。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。