arXiv · 多模态、视频与世界模型· Tobia Poppi·· 3 天前AI 评分73
ShieldCLIP:面向多模态基础模型的选择性安全对齐框架
ShieldCLIP: Selective Safety Alignment for Harmful Content Mitigation in Multimodal Foundation Models
AI 导读
论文提出 ShieldCLIP,根据每个模态的实际安全状态进行选择性安全对齐,在减少有害输出的同时保留原始嵌入空间的实用性。作者构建了包含 195k 个四元组、覆盖 578 个概念和 28 个类别的 ViSUv2 数据集,并在跨模态检索、Stable Diffusion v1.4、SDXL 和 LLaVA 任务上进行评估。
来源:arXiv · 多模态、视频与世界模型 · arxiv.org