99科技给大家分享各类生活学习资讯!
您现在的位置是: 首页 > 人工智能 > SIUO跑分被提出,检验多模态AI模型安全性,仅3成模型得分超过50%

SIUO跑分被提出,检验多模态AI模型安全性,仅3成模型得分超过50%

6月25日消息,最新在arXiv上发表的研究论文揭示了一个令人担忧的现象:主流的多模态AI模型,如GPT-4V、GPT-4o以及Gemini 1.5等,在处理用户的多模态输入(即同时包含图片和文本内容的输入)时,输出的结果存在安全隐患。

这项研究标题为《跨模态安全调整》(Cross-Modality Safety Alignment),提出了一个全新的“安全输入但不安全输出”(SIUO),涉及道德、危险行为、自残、侵犯隐私、信息误读、宗教信仰、歧视和刻板印象、争议性话题以及非法活动和犯罪等 9 个安全领域。

研究人员说,大型视觉语言模型(LVLM)在接收多模态输入时很难识别 SIUO 类型的安全问题,在提供安全响应方面也遇到困难。

在接受测试的 15 个 LVLM 中,只有 GPT-4v(53.29%)、GPT-4o(50.9%)和 Gemini 1.5(52.1%)的得分高于 50%。

研究人员表示为了解决这个问题,需要开发 LVLM,以便将所有模式的见解结合起来,形成对情景的统一理解。它们还需要能够掌握和应用现实世界的知识,如文化敏感性、道德考虑因素和安全隐患等。

研究人员还指出,LVLMs 需要能够通过对图像和文本信息的综合推理,理解用户的意图,即使文本中没有明确说明。

嫦娥六号成功返回地球,带回月球背面“土特产”

2024/6/25 10:13:38

韩国面临半导体旧设备库存积压困境,或考虑售卖欧美旧设备以缓解压力

2024/6/25 10:16:27