跳到正文
原文
arXiv cs.CV· Wenping Yin, Fabian Desuer, Ziqi Liu, Naixia Mou, Weijia Li, Pedram Ghamisi, Xiao Xiang Zhu, Hao Li·· 4 小时前AI 评分31

GRDisaster:基于 VLM 与众包影像的多任务地理空间推理灾害测绘框架

Decoding the Disaster: Multi-Task Geospatial Reasoning with Vision-Language Models and Crowdsourced Imagery for Disaster Mapping

AI 导读

研究提出多任务地理空间推理灾害测绘框架 GRDisaster,用 VLM 对众包灾害影像做理解、地理定位与推理。该框架基于 PhotoMappers 构建的 26,340 张图像基准,组织为人工验证的 VGI、街景影像与遥感影像跨视角三元组,覆盖 2018 至 2024 年多起灾害事件。它结合确定性与概率式跨视角地理定位及多视角融合,并引入两组空间推理指标,用于跨视角定位验证与灾害损毁严重度评估。

来源:arXiv cs.CV · arxiv.org