跳到正文
原文
AGI Hunt· _reachsumit·· 6 小时前AI 评分35

Airbnb 用重排序得分做 RL 奖励,训练供给侧感知的旅行查询推荐模型 SCOUT

AI 导读

Airbnb 团队发布论文 SCOUT,以搜索重排序器分数作为 RL 奖励训练生成式查询推荐模型,解决旅行搜索的冷启动问题。旅行搜索受物理库存约束,传统分面搜索缺少自由文本查询和历史查询日志,请求时没有种子查询。SCOUT 用供给侧系统反馈替代缺失的需求侧用户反馈,使推荐与可用房源对齐,服务时无需额外调用。

来源:AGI Hunt · agihunt.info