跳到正文
原文
AGI Hunt· chaumian·· 6 小时前AI 评分59

arXiv 论文提出 PLW 水印攻击:统一多模态模型可经图像泄露聊天隐私

新攻击 PLW:恶意厂商可借图像水印泄露你的聊天隐私

AI 导读

arXiv 论文《The Poisoned Conversation: Privacy-Leaking Watermarks in Unified Multimodal Models》提出统一多模态模型中的隐私泄露水印 PLW,恶意模型厂商可植入依赖触发条件的隐形水印,使之后生成的无关图像携带隐藏但可检测的水印,从而泄露此前对话中的敏感关键词或语义线索。

来源:AGI Hunt · agihunt.info