跳到正文
原文
arXiv cs.CL· Pranav Darshan, Pranav A, Sravan Karthick T, Minal Moharir, Ivan P. Yamshchikov·· 4 小时前AI 评分39

可检测性差距:语言模型幻觉检测中的隐藏异质性

The Detectability Gap: Hidden Heterogeneity in Hallucination Detection Across Language Models

AI 导读

研究在四个语言模型与三个数据集上按答案一致性区分高一致(Ghost)与低一致(Flickering)幻觉,测得 0.35 至 0.46 AUC 的可检测性差距。

来源:arXiv cs.CL · arxiv.org