跳到正文
原文
AGI Hunt· CUHK-CSE·· 3 小时前AI 评分40

港中文系统实验揭示循环语言模型何时真正有效

AI 导读

港中文团队系统研究循环语言模型 LoopLM,发布三项受控实验结论:参数共享循环不增参数即可扩展推理算力。循环计算能提升超出训练范围的推理表现,但损害知识类任务;效果取决于层与循环迭代如何分配。团队提出按通道的 history-state injection,配合时间步条件化,在扩展展开时更好保留知识。

来源:AGI Hunt · agihunt.info