跳到正文
原文
AGI Hunt· juliusadml·· 3 小时前AI 评分39

PRISM 新方法:单次前向传播即可追溯 LLM 输出来源

AI 导读

COLM 论文提出原型语言模型 PRISM,其 next token 预测可在单次前向传播中直接追溯到预训练数据。该工作采用「设计即归因」(training data attribution by design)思路,认为传统事后归因方法难以满足的结构性质,可以通过改变模型训练方式从设计层面解决。这一思路为训练数据归因提供了新范式。

来源:AGI Hunt · agihunt.info