热点事件持续更新
Sony AI 等发布 ST-AudioLM 音频语义与轨迹模型
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026 年 10 月 1 日,AGI Hunt 报道,POSTECH 与 Sony AI 等机构发布音频模型 ST-AudioLM,相关论文入选 EMNLP 2026 Main,代码与 demo 已开源。报道称,该模型采用 1 个语义 token 加 40 个轨迹 token 的设计,将声音语义理解、空间定位与声源移动轨迹建模统一在同一框架内,即同时刻画“是什么声音”与“声音如何移动”。截至目前,报道仅披露上述信息,未提及更多技术细节或后续计划,暂无其他机构或时间点的报道可作对照,也未见与早先报道相矛盾的数字或说法。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- AGI HuntSony AI 等发布 ST-AudioLM:统一建模声音语义与声源移动轨迹,代码已开源
POSTECH 与 Sony AI 等机构发布 ST-AudioLM(EMNLP 2026 Main)并开源代码与 demo,该模型用 1 个语义 token 加 40 个轨迹 token 统一声音语义理解、空间定位与轨迹建模。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。