AGI Hunt· MaartenSap·2026-10-07 00:11· 2 小时前AI 评分28CMW 研究:CCBench 用健康问句测 LLM 隐性文化规范理解力AI 导读NLP 研究者 Maarten Sap 在会议现场展示学生项目 CCBench,用健康查询中的隐含信号评估 LLM 的文化胜任力,测试模型能否在用户从未明确说明时识别出文化相关规范。该工作以海报形式在会议第 6 场展示。来源:AGI Hunt · agihunt.info#论文/研究#评测/基准查看事件全部后续