热点事件持续更新
提出基于信息增益的LLM自进化框架ATRI
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026年9月30日,arXiv cs.CL 刊出的一项工作针对大语言模型自进化中的“自进化退化”现象——性能先提升、随后停滞、继而下降——提出以可学习信息增益为核心的整体框架,并给出训练调控方法 ATRI。该增益由两轮数据分布的 KL 散度与熵变化构成;实际估计方式是用小型语言模型拟合上一轮数据,再以负对数似然给新数据打分。ATRI 在轮内对样本重新加权,并在跨轮信息增益持续偏低时终止训练。在常用数据集上的实验显示其效果更优。报道以“当更新不再等于学习”概括这一思路。
AI 根据报道生成 · 3 小时前更新
最新进展9月30日 12:00
arXiv 论文提出 ATRI:以可学习信息增益调控 LLM 自进化,增益持续偏低时终止训练。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv cs.CL当更新不再等于学习:通过可学习信息增益重新思考 LLM 自进化
针对 LLM 自进化中性能先提升、后停滞再下降的"自进化退化",该工作提出以可学习信息增益为核心的整体框架,并给出训练调控方法 ATRI。该增益等于两轮数据分布的 KL 散度加熵变化,实际通过用小型语言模型拟合上一轮数据、以负对数似然给新数据打分来估计。ATRI 在轮内对样本重加权,并在跨轮信息增益持续偏低时终止训练,在常用数据集上的实验显示其效果更优。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。