跳到正文
原文
AGI Hunt· USC·· 2 小时前AI 评分46

单次生成胜过 64 候选采样:USC 提出 OPPD 蒸馏法

AI 导读

USC 团队提出 on-policy power distillation(OPPD),将幂分布采样的能力蒸馏进模型,让模型一次生成即产出锐化后的答案,省去多次采样打分。

来源:AGI Hunt · agihunt.info