导语: 作为全球最大的开源 AI 模型托管社区,Hugging Face 一直以来致力于推动人工智能技术的开放与普及。然而,近期一项由欧洲非营利组织 AI Forensics 发布的调查报告揭示了该平台面临的严峻安全危机。调查显示,Hugging Face 上托管的多款顶级图像编辑模型,正被滥用于生成针对女性和儿童的“非自愿裸体深度伪造”图像,且平台现有的安全机制对此反应迟钝。
调查结果令人咋舌
根据这份名为《AI 艺术生成的黑暗面:Hugging Face 模型被用于生成非自愿深度伪造》的报告,AI Forensics 团队对 Hugging Face 平台上排名前九的图像生成与编辑模型进行了测试。研究人员向这些模型发送了诱导性的提示词,要求生成裸体图像。测试结果令人震惊:在九个模型中,有七个模型毫不费力地生成了符合请求的裸体图像,完全没有触发任何安全过滤机制。
这一发现表明,许多目前被认为“安全”或“中立”的开源模型,在缺乏特定安全护栏的情况下,极容易成为网络暴力和隐私侵犯的工具。特别是当用户输入“nudify”(去衣化)或“undress”(脱衣)等特定关键词时,这些模型往往能迅速生成高度逼真的虚假图像。
技术背后的隐患:开源的双刃剑
Hugging Face 的核心价值在于开源。任何人都可以免费下载、修改和部署这些模型。这也正是问题产生的根源之一。这些模型通常是在互联网上的海量数据集上训练而成的,数据集往往包含各类互联网图片,其中不可避免地混杂了未经授权的裸露内容。在缺乏针对性的“安全微调”或“RLHF(基于人类反馈的强化学习)”约束的情况下,模型往往会遵循提示词的逻辑,生成裸体图像,而忽略了其伦理道德边界。
这种技术漏洞被不法分子利用,催生了一批利用 Hugging Face 模型的“一键去衣”服务。这些服务通常通过简单的网页界面,让用户只需上传照片,即可在几秒钟内获得经过深度伪造处理的裸体图像。对于受害者而言,这种伤害往往是不可逆的,因为它不仅侵犯了个人的肖像权和隐私权,还可能被用于网络欺凌、勒索或诽谤。
对儿童和女性的双重威胁
报告中特别强调了这一滥用于儿童和女性群体的危害。针对儿童的深度伪造图像(NSFW 内容)不仅违反了法律底线,更可能触犯制作儿童性虐待材料(CSAM)的法律红线,对受害者的心理造成毁灭性打击。针对女性的非自愿裸体图像则是典型的深度伪造犯罪,它剥夺了女性对自己身体形象的掌控权,加剧了网络空间的性别暴力。
平台责任与监管困境
作为平台方,Hugging Face 长期以来标榜自己致力于构建一个“安全、包容”的 AI 环境。面对此次调查,Hugging Face 承诺将加强安全措施。然而,开源生态的监管本质上是困难的。开发者可以轻易地下载模型,修改代码以绕过过滤器,然后重新发布。此外,如何区分“艺术创作”与“非自愿色情内容”的界限,也是技术审核面临的巨大挑战。
行业专家指出,仅仅依赖平台方的事后删除和封禁是远远不够的。未来的解决方案可能需要包括:在模型训练阶段就引入更严格的安全数据清洗,开发针对“去衣化”行为的专用检测过滤器,以及建立更快速的社区举报和响应机制。
结语
Hugging Face 的这一事件为整个 AI 产业敲响了警钟。随着生成式 AI 技术的平民化,防止技术被用于伤害人类已成为比技术突破更为紧迫的议题。如何平衡开源创新与伦理安全,将是科技巨头和开发者必须共同面对的长期课题。
信息来源:The Verge,原文链接:https://www.theverge.com/ai-artificial-intelligence/971723/hugging-face-nudify-deepfake-undress-women-children
封面图片来源:Unsplash / 摄影师 Bethany Beck
