跳到正文
原文
AGI Hunt· StellaLisy·· 3 小时前AI 评分49

NormViz 基准:最强模型跨16国文化规范理解仅得25.3%

AI 导读

入选 COLM 2026 的论文发布 NormViz 基准,用于衡量多模态模型对 16 个国家视觉文化规范的理解,表现最好的 Gemini 3 Flash 也仅得 25.3%。测试场景包括在日本送四条锦鲤的盘子属冒犯、在中国把筷子竖插米饭不合礼仪,说明顶级模型对视觉文化禁忌的理解仍然很差。

来源:AGI Hunt · agihunt.info