跳到正文

#数据/训练

今日 78 条
9月29日周二
  1. arXiv cs.CL35

    MoSAR:学习自适应且可近似注意力几何的语义注意力模式混合

    MoSAR 把注意力近似视作几何问题,用输入条件的 query/key 路由器在短、中、全局三种模式间混合,学习连续的距离相关注意力场,并可在训练后经 top-1 路由离散化。在 500M 参数匹配模型的预训练实验中,它未降低语言建模质量,困惑度优于 dense RoPE,长度外推下优于 ALiBi 等基线取得最佳困惑度。

  2. arXiv cs.CL36

    基于指标损失加权提升 LLM 多模态机器翻译视觉敏感性

    一种 Metric-based Loss Weighting 训练方法利用 PCXMI 和 Congruency-based PCXMI 识别受益于图像的 token,在 CoMMuTE 对比数据集上使多模态机器翻译准确率较标准微调最高提升超过 7 个百分点。该方法通过微调三个预训练多模态大语言模型,在三个语言方向的图像引导机器翻译任务上评估,并保持较强通用翻译性能。

  3. arXiv cs.CL36

    CG-Probes:从患者查询嵌入中恢复护栏方向

    CG-Probes 用差值均值法在冻结嵌入器的归一化空间中探测线性方向,可将患者查询嵌入中的紧急度风险轴恢复出来。该方法用 BERTopic 聚类 79,658 条捷克语肿瘤科查询生成对比风险样本,在 200 条经两名肿瘤科医生评分的查询上与开放权重 LLM 表现相当且延迟更低,每轴输出标量分数供医生设定升级阈值。

  4. arXiv cs.CL37

    EoupCT:为 LLM 持续微调估计并正交化未知预训练梯度

    EoupCT 提出估计并正交化未知预训练梯度的框架,用于 LLM 持续微调以缓解灾难性遗忘。它用带 Gumbel-Softmax 松弛的可学习软提示生成新任务最易遗忘的伪数据来估计预训练梯度,并以一阶高效 Pareto 优化器联合优化 LLM 参数与软提示,强制新任务更新与估计梯度正交。多个 LLM 实验显示可兼顾任务能力与通用知识,该工作已被 NeurIPS 2026 接收。

  5. arXiv cs.CL35

    对抗式黑盒在线策略蒸馏的持续负样本方法

    持续负样本对抗蒸馏用历史提示词匹配的师生对比样本替换部分判别器批次,缓解黑盒在线策略蒸馏中负样本分布随策略更新漂移的移动目标问题。在匹配判别器算力下,该方法跨两个学生模型家族、三个评判模型与四个评判对话基准稳定优于现有方法。其贝叶斯最优奖励为教师到负样本的对数密度比,持久负样本可锚定判别器并降低奖励估计 MSE。

  6. arXiv cs.CL43

    理解提示词模板在知识蒸馏中对安全对齐的作用

    在从教师到学生的知识蒸馏中,提示词模板选择会显著削弱学生模型已有的安全对齐:聊天模板比非聊天模板让模型更顺从有害查询。该现象在 LLaMA、Gemma 和千问(Qwen)三个模型家族及多个安全基准上一致。非聊天模板蒸馏更能保留学生模型内部表示,聊天模板蒸馏则导致更大的表示偏移。

  7. arXiv cs.CL32

    KAME:用随机引导在串联语音到语音模型中学习自然对话行为

    KAME 提出随机中间引导(randomized intermediate guidance),直接从对话语料提取引导信号,省去模拟 LLM 生成缺失引导的数据准备开销。在合成对话上,其回复质量与 LLM 生成引导、相似度基线相当。用 3.8k 小时真实对话训练后,轮次切换更顺畅、audio-judge 自然度优于合成数据版 KAME,并保持对 Moshi 的回复质量优势。

  8. arXiv cs.CL35

    通过在线策略蒸馏实现推理的递归自我改进

    研究提出由 DCE 与 SRCL 构成的递归在线策略蒸馏框架,让特权教师模型与学生共同演化,在四个竞赛级数学基准上超越 OPSD。在 Qwen3-8B 上,DCE+SRCL 达到 65.97% Average@12,比 OPSD 高出 35.62 个百分点。SRCL 额外以模型自身在线响应更短、经核验的改写进行训练,使平均输出长度较仅用 DCE 减少 7.80%。

  9. arXiv cs.CL38

    喂 BabyLMs 吃 Macaroni:语码切换课程带来跨语言收敛

    用 LLM 向英语、荷兰语、中文 BabyBabelLM 语料注入词级与句级语码切换后再预训练小型 decoder-only Transformer,可让平行文本表征(尤其跨书写系统)趋于对齐。按词级语码切换→句级语码切换→单语文档的课程训练,模型在 BabyLM 评测套件上优于未使用该数据的基线。代码、数据与模型已公开。

  10. arXiv cs.CL30

    系统性综述筛选自动化的基准框架:SRBench 与 PromptSR

    SRBench 基准数据集以 45,064 条标注数据评估 LLM 在系统性综述(SR)筛选中的表现,覆盖 32 项精选二次研究。其评测框架考虑 SR 中排除文章天然多于纳入文章的类别不平衡问题,并指出传统指标在这类高度不平衡场景下可能产生误导;配套的 PromptSR 工具支持提示词实验、实验管理与结果分析。

  11. arXiv cs.CL50

    Spotify 论文:对话式推荐智能体的合成数据生成与自我改进循环

    Spotify 提出多轮合成数据生成管线与自我改进循环,在冷启动阶段优化对话式推荐智能体的规划与工具调用,规划质量在高度优化的人工提示词基础上再提升 8%。自我改进循环结合基于方差的对比优化与编码智能体的迭代修正,自动定位并修复规划与工具调用错误。系统已在 Spotify 落地,线上 A/B 测试显示用户收听提升 14%、周活跃用户提升 5%、跳过率下降 5%。

  12. AGI Hunt41

    将心理测量效度检验移植到 AI 基准与 IRT 逐题分析

    研究团队将聚敛与区分效度检验适配到 AI 基准评估,并用 IRT 模型在题目层面逐题分析,实现更细粒度效度检验。结果显示,偏差基准 BBQ 可能在测推理而非偏差,偏差基准按任务形式聚簇而非宣称的性别种族偏差;推理、知识、理解类基准高度相关或测同一概念。同类安全基准相关性弱、偏差定义不一,53 个模型、56 项基准的逐题输出数据集已公开发布。

  13. AGI Hunt43

    研究:同类安全基准相关性弱,偏差定义各行其是

    研究发现,声称测量相似安全概念的 AI 基准之间相关性往往很弱,「偏差」等安全概念在各基准中的概念化方式不一致,跨基准的安全结论难以直接比较。研究提出用聚敛与区分效度系统评估 AI 基准有效性,并指出偏差基准 BBQ 可能实际在测推理、偏差基准按任务形式聚簇而非宣称的性别种族偏差。53 个模型、56 项基准的逐题输出数据集已公开发布。

  14. AGI Hunt38

    研究:推理、知识、理解类 AI 基准高度相关或测同一概念

    一项研究观察到,声称分别测量推理、知识与理解的 AI 基准之间相关性很强,暗示这些基准可能并未捕捉到相互独立的概念,其区分度存疑。该研究主张用聚敛与区分效度系统评估 AI 基准有效性,并把心理测量效度检验移植到 AI 基准与 IRT 逐题分析。同时公开发布了覆盖 53 个模型、56 项基准的逐题输出数据集。

  15. The Verge · AI30

    Engram 采样器把失真的 AI 幻觉变成音乐

    音乐初创公司 Thoughtful Things 在 Kickstarter 上线采样器 Engram,用本地「tiny AI」把 AI 模型的幻觉变成实验声音。Engram 不联网,模型由公司自研,仅用 CC-BY 等商用授权音频训练,固件将开放以便加载自定义模型。Kickstarter 限量首发 675 美元起,零售价尚未公布,预计在 850-900 美元之间。

9月28日周一
  1. Towards Data Science39

    Grokking:神经网络在看似训练完成后才学会真正理解

    小型神经网络在模加法任务上训练到 20000 步时,对新问题的准确率从 1000 步时的约 10% 跃升至接近 100%,这一现象被命名为 grokking。2023 年的后续研究发现,网络自行学会把数字表示为圆上的位置并用旋转组合,相当于重新发现了三角函数。研究者指出,标准 early stopping 规则可能在性能平台期提前切断训练,而 grokking 目前仅在少数窄的规则任务中被记录。

  2. arXiv cs.CV36

    AlphaEarth 能区分城市,却压缩了城市内部差异

    研究审计 AlphaEarth 对 162 个国家 1000 个城市区域的嵌入表示,发现它支持跨区域比较,却压缩了城市内部差异。城市嵌入落在偏离全球均值方向 62.7° 的偏移重叠区域,城市化程度仅解释 8.9% 的城市内变异。城市中心离散度随国家发展水平每标准差高 14.1%,表示的年际变化近八倍于像素重绘所能解释。

9月26日周六
  1. Towards Data Science40

    你的 LLM 拥有一片弯曲的段落空间

    实验提出 hRoPE,为段落、句子和 token 索引各设相互独立的旋转通道,以检验 Transformer 的位置编码是否丢失层级信息。在 WikiText-2、OpenWebText 和 Python 源码三个语料上,抹掉真实段落边界会降低跨段注意力,插入假边界则抬高它。

  2. SiliconANGLE:AI21

    NetApp INSIGHT 前瞻:theCUBE 9 月 30 日直播统一存储与生产级 AI

    NetApp 将在 NetApp INSIGHT 大会上阐述其统一存储支撑生产级 AI 的战略,theCUBE 于 9 月 30 日独家直播。theCUBE 研究显示,64% 的组织已将 AI 驱动功能直接集成进软件交付流水线。分析师 Krista Case 与 Paul Nashawaty 指出,统一存储能让训练、RAG、推理和智能体工作负载持续获取受治理的数据,减少数据碎片化与运营复杂度。

9月25日周五
9月23日周三
  1. Towards Data Science34

    从词到向量:TF-IDF 如何把文本变成数字?

    TF-IDF 被拆成 tokenization、词表、TF、IDF、Python 实现、PCA 可视化与文本分类,解释文本如何转为数字向量。4 条示例文档中,TF 看词在单篇中的频率,IDF 由 DF 衡量词在全部文档中的稀有度,TF×IDF 得到 TF-IDF。最后列出 TF-IDF 的局限,并转向嵌入向量。

  2. Towards Data Science48

    GRPO 如何用可验证奖励训练小语言模型

    GRPO 让模型对同一问题采样多次作答,用可验证奖励为每个答案打分,再以组内平均奖励为基线比较各次尝试来更新模型,无需单独的 critic。该方法由 DeepSeekMath 工作提出,用以替代传统 PPO 的内存开销,文中用「6 箱每箱 8 件、卖出 6 件、答案 42」的算术题演示打分与优势计算。组内奖励完全一致时优势全为零,模型无法判断该偏好哪次尝试。

  3. Towards Data Science71

    如何从零手写你的第一个世界模型(CartPole 实战)

    作者用 500 局 CartPole 数据训练了一个 13,635 参数的 GRU 世界模型,预测下一步状态变化与是否翻车。该模型单步预测误差为 3.8 毫米车位置和 0.00026 弧度杆角,可信滚动预测视界为 29 步;配合 200 条随机动作序列的规划,100 局全部拿到 500/500。

    推荐理由:从 CartPole 出发手写世界模型,对比 DQN 展示同一模型如何零重训切换目标。

9月22日周二
  1. Latent Space81

    小米发布 MiMo-V2.6 系列开放权重模型,旗舰 Pro 为 1T-A42B、训练成本 300 万美元

    小米发布 MiMo-V2.6 系列开放权重模型,包含原生全模态的 MiMo-V2.6-Pro、MiMo-V2.6-Flash 以及 MiMo-V2.6-Pro-UltraSpeed,其中 Pro 以 1.02T 总参数、42B 激活参数在 Artificial Analysis 智能指数上以 46 分成为该榜首位开放权重模型。

    推荐理由:原文给出 MiMo-V2.6 的 RL 训练细节与开源清单,可对照开放权重模型的成本与复现门槛。

9月16日周三
  1. Apple Machine Learning Research46

    TS-DFM:以轨迹为教师、经能量导航蒸馏的少步离散流匹配

    TS-DFM 用能量导航替代离散流匹配训练中的盲随机跳步:轻量能量罗盘在每个中间点评估候选续写、选出最连贯的一支,且塑造仅在训练期进行,推理成本不变。在 170M 参数语言建模上,8 步学生模型的困惑度比 1024 步教师低 32%、速度快 128×,增益在多种源分布和三种规模递增的评估器上一致。其困惑度优于所有对比的离散生成基线,包括训练数据多 6× 或模型大 5× 的方法。