arXiv cs.CL· Tobias Hallmen, Elisabeth Andr\'e·· 4 小时前AI 评分40
语言承载专家印象:量表锚定的 LLM 评判器跨域迁移咨询质量评估并超越域内训练
Language Carries the Expert's Impression: Instrument-Anchored LLM Judges Transfer Counseling-Quality Assessment and Beat In-Domain Training
AI 导读
跨域训练的 LLM 评判器在三个德语模拟咨询语料(n=195 专家评分会话)上预测专家整体印象,留一域迁移嵌套 Spearman ρ 达 0.54,超过域内训练的 ≤0.48,训练集规模匹配后差距仍为 +0.12。最关键的是源自专家评分工具的会话级构念分数:单一评判器从 0.32 提升到 0.41,三个模型家族集成后语言模态达 0.51。
来源:arXiv cs.CL · arxiv.org