热点事件持续更新
VGBench:音频大模型该静音时仅14%静音
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月2日,AGI Hunt 报道,Yanjie Zhang 等人发布 VGBench——一个包含 1,018 项诊断任务的基准,用于测评音频大模型在旁人说话、自言自语、说话人切换等场景下,究竟应当保持静音,还是调用工具或作答。报道称,六个原始音频模型与三种免训练改造方案中,最高的切换场景静音率仅为 14%。同一报道还给出一个后训练案例 VoxGate:通过监督训练,该场景的静音率被提升至 91.3%,同时能针对佩戴者的指令正确选择工具。
AI 根据报道生成 · 3 小时前更新
最新进展10月2日 11:17
VGBench 显示音频模型切换场景静音率仅14%,后训练方案 VoxGate 可提升至91.3%。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- AGI Hunt语音 Agent 会先「听」再行动吗?VGBench 基准显示原始音频模型静音率仅 14%
Yanjie Zhang 等发布 1,018 项诊断基准 VGBench,测评音频 LLM 在旁人说话、自言自语、说话人切换场景下该静音还是调工具或回答,六个原始音频模型与三种免训练改造的最高切换静音率仅 14%。后训练案例 VoxGate 通过监督训练把切换指令静音率提升至 91.3%,同时为佩戴者指令正确选工具。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。