跳到正文
热点事件持续更新

FABLE数据集评测非母语英语对LLM回答的影响

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年9月30日,arXiv cs.CL 刊出论文《迷失在翻译中:测量非母语英语对大语言模型终端用户表现的影响》。研究构建 FABLE 数据集,用 174K 条真实用户提示词生成 190,911 条英文提示词变体,用以测量非母语英语对大语言模型用户表现的影响。在 34 个开放权重 LLM 上的评测显示,模型不会把拼写错误带入输出,却会复制提示词中更高层的修辞与词汇特征;最流畅与最不流畅提示词的答案质量差异显著,非母语英语用户获得质量更低、流畅度更差的回答。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.CL
    迷失在翻译中:测量非母语英语对大语言模型终端用户表现的影响

    FABLE 数据集用 174K 条真实用户提示词生成 190,911 条英文提示词变体,测量非母语英语对大语言模型用户表现的影响。在 34 个开放权重 LLM 上的评测显示,模型不会把拼写错误带入输出,却会复制提示词中更高层的修辞与词汇特征。最流畅与最不流畅提示词的答案质量差异显著,非母语英语用户得到质量更低、流畅度更差的回答。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。