OpenAI 撤销研究人员访问权限引争议,AI 安全信任机制面临考验

OpenAI 服务器机房与网络安全示意图

近日,人工智能安全领域发生了一起引发广泛关注的争议事件。据媒体报道,OpenAI 突然撤销了部分研究人员对其“网络信任访问计划”的访问权限,这一举动不仅让受影响的开发者感到困惑,也在行业内引发了关于 AI 安全合作模式以及企业开放策略的深层讨论。

所谓的“网络信任访问计划”,是 OpenAI 为构建更安全的 AI 生态系统而推出的一项关键举措。其核心逻辑在于“白帽子”精神——即通过向经过严格筛选的、值得信赖的防御者和研究人员提供受限的模型访问权限,让他们能够在受控环境中对模型进行深度测试。这些研究人员利用这些工具,旨在发现 AI 模型中潜藏的漏洞、后门或逻辑缺陷,并将这些发现及时反馈给公司,从而加速漏洞的修补过程。

然而,随着计划的推进,OpenAI 决定收回部分访问权限。据相关报道显示,部分长期致力于 AI 安全研究的研究人员表示,他们并未收到明确的解释,这导致他们手中的测试工具失效,正在进行的测试工作被迫中断。对于依赖这些工具进行安全审计的研究人员来说,这无疑是一个巨大的打击。

这一事件折射出当前 AI 发展面临的深层矛盾。一方面,大型科技公司需要通过开放 API 和有限的访问权限来吸引开发者、学术界和第三方安全机构参与 AI 安全的建设;另一方面,出于对模型能力失控、知识产权泄露或恶意利用的担忧,公司又不得不收紧大门。OpenAI 此次的行为,被部分评论人士解读为公司内部安全评估标准发生变化的信号,或者是试图将核心安全控制权完全收回的体现。

在人工智能技术飞速迭代的今天,模型能力的边界不断扩大,传统的安全防御手段已难以应对复杂的攻击。依赖单一厂商的内部安全团队往往存在盲区,因此,引入外部“白帽子”进行红蓝对抗成为行业共识。OpenAI 的这一举措可能会迫使其他科技巨头重新审视自己的第三方合作政策,特别是在涉及核心模型安全评估的环节。

总体而言,AI 安全不是一场独角戏,而是一场需要多方协同的持久战。OpenAI 在平衡“开放”与“安全”之间的关系时显得尤为谨慎。对于行业而言,如何在保障核心安全的前提下,维持与安全研究社区的良性互动,将是未来 AI 公司面临的一大挑战。

信息来源:AI News & Artificial Intelligence | TechCrunch,原文链接:https://techcrunch.com/2026/08/19/researchers-complain-that-openai-revoked-their-access-to-limited-cyber-program/

封面图片来源:Unsplash / 摄影师 Jonathan Kemper

oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注