跳到正文
原文
AGI Hunt· MaartenSap·· 2 小时前AI 评分28

CMW 研究:CCBench 用健康问句测 LLM 隐性文化规范理解力

AI 导读

NLP 研究者 Maarten Sap 在会议现场展示学生项目 CCBench,用健康查询中的隐含信号评估 LLM 的文化胜任力,测试模型能否在用户从未明确说明时识别出文化相关规范。该工作以海报形式在会议第 6 场展示。

来源:AGI Hunt · agihunt.info