arXiv cs.CV· Suguru Onda, Matthew Bailey, Ryan Farrell·· 4 小时前AI 评分40
视觉语言模型(VLM)微调中的语义能力获取与专门化
Semantic Capability Acquisition and Specialization During Vision-Language Model Fine-Tuning
AI 导读
研究提出基于轨迹的框架与 Structured Semantic Routing(SSR),追踪视觉语言模型(VLM)微调中语义能力的获取、峰值与专门化,覆盖 DFN、MetaCLIP、OpenAI CLIP 六个预训练骨干。
来源:arXiv cs.CV · arxiv.org