跳到正文
热点事件持续更新

VGBench:音频大模型该静音时仅14%静音

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月2日,AGI Hunt 报道,Yanjie Zhang 等人发布 VGBench——一个包含 1,018 项诊断任务的基准,用于测评音频大模型在旁人说话、自言自语、说话人切换等场景下,究竟应当保持静音,还是调用工具或作答。报道称,六个原始音频模型与三种免训练改造方案中,最高的切换场景静音率仅为 14%。同一报道还给出一个后训练案例 VoxGate:通过监督训练,该场景的静音率被提升至 91.3%,同时能针对佩戴者的指令正确选择工具。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AGI Hunt
    语音 Agent 会先「听」再行动吗?VGBench 基准显示原始音频模型静音率仅 14%

    Yanjie Zhang 等发布 1,018 项诊断基准 VGBench,测评音频 LLM 在旁人说话、自言自语、说话人切换场景下该静音还是调工具或回答,六个原始音频模型与三种免训练改造的最高切换静音率仅 14%。后训练案例 VoxGate 通过监督训练把切换指令静音率提升至 91.3%,同时为佩戴者指令正确选工具。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。