跳到正文
原文
arXiv cs.CV· Yunzhe Xu, Zhe Liu·· 4 小时前AI 评分42

系统性多智能体视觉语言导航:形式化、MAVLN 基准与 TRISS 方法

Systematic Multi-Agent Vision-and-Language Navigation: Formulation, Benchmark, and Method

AI 导读

作者称首次将多智能体 VLN 形式化为带依赖与资源约束的协同问题,并发布 MAVLN 基准与 TRISS 协作导航系统。MAVLN 含 11,724 条 episode、145 个场景,覆盖最多四个智能体与三种指令设定,配套约束感知指标。TRISS 由基于 LLM 的子任务调度器、共享拓扑记忆与冲突感知执行机制构成,实验显示其可作为综合基线,调度、规划与执行仍有较大提升空间。

来源:arXiv cs.CV · arxiv.org