arXiv cs.CV· Hiwa Azeez Abbas, Fatemeh Daneshfar, Moloud Abdar·· 2 天前AI 评分29
ProCAP:面向视觉语言模型的概率交叉注意力提示学习
ProCAP: Probabilistic Cross-Attentive Prompt Learning for Vision-Language Models
AI 导读
ProCAP 是面向 CLIP 等视觉语言模型的概率交叉注意力提示学习框架,冻结 CLIP 权重,学习视觉与文本提示 token,并用堆叠的双向多头交叉注意力让两个分支在提示深度上互相修正。
来源:arXiv cs.CV · arxiv.org