跳到正文
原文
AGI Hunt· ricklamers·· 7 小时前AI 评分40

扩散语言模型追平离散基线:数学代码成绩接近 AR 模型

扩散语言模型追平离散基线:数学代码成绩接近 AR 模型

AI 导读

扩散式语言模型(dLM)预训练后在数学与代码任务上,与 masked dLM 和自回归(AR)基线相比具有竞争力,覆盖 GSM8K、Minerva、HumanEval、MBPP。经 SFT 后,它在困难推理上接近基线,并在指令遵循与通用知识上略有优势。相关结果来自 ricklamers 转发的 10 条线程中的第 6 条,完整结果需查看原线程。

来源:AGI Hunt · agihunt.info