arXiv cs.CL· Pranav Darshan, Pranav A, Sravan Karthick T, Minal Moharir, Ivan P. Yamshchikov·· 4 小时前AI 评分39
可检测性差距:语言模型幻觉检测中的隐藏异质性
The Detectability Gap: Hidden Heterogeneity in Hallucination Detection Across Language Models
AI 导读
研究在四个语言模型与三个数据集上按答案一致性区分高一致(Ghost)与低一致(Flickering)幻觉,测得 0.35 至 0.46 AUC 的可检测性差距。
来源:arXiv cs.CL · arxiv.org