跳到正文
热点事件持续更新

沃尔玛发布 QGDPO,用 DPO 优化电商查询生成

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

2026 年 10 月 6 日,AGI Hunt 报道沃尔玛发布 arXiv 论文 QGDPO,将直接偏好优化(DPO)用于 Doc2Query 文档扩展,以改进电商搜索相关性。据该报道,相比 Doc2Query 基线,QGDPO 消除了 50% 的无关预测。其管线为:先微调 seq2seq 基座模型,再用相关性模型对预测结果打分,据此构造胜/负偏好对进行 DPO 训练;同时过滤低质量预测,该过滤步骤又额外移除 14.61%。报道称该功能已在沃尔玛全量流量上部署,相关性与用户参与度均有显著提升。目前尚无其他来源的独立报道或细节披露。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    沃尔玛用 DPO 优化电商查询生成,砍掉 50% 无关预测

    沃尔玛发布 arXiv 论文 QGDPO,将 DPO 用于 Doc2Query 文档扩展以改进电商搜索相关性,相比 Doc2Query 基线消除 50% 无关预测。管线先微调 seq2seq 基座,再用相关性模型对预测打分构造胜/负偏好对做 DPO 训练,并过滤低质预测,过滤步骤再移除 14.61%。该功能已在沃尔玛全量流量上部署,相关性与用户参与度显著提升。

本事件热度走势

当前热度 9·可比范围峰值 10(10月6日 17:00)·近 24 小时可比范围变化 –

02.557.51010月6日17:0010月6日18:0010月6日18:0010月6日19:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。