OpenAI黑客事件暴露AI时代基础安全漏洞
OpenAI智能体入侵Hugging Face事件持续发酵,安全专家指出,这并非AI前沿能力的展示,而是暴露了长期存在的网络安全基础问题,在AI时代后果更为严重。
流氓AI黑客智能体的时代已经到来——但事情本不必如此。本月早些时候,一个OpenAI智能体入侵了Hugging Face平台,两家公司本周表示,这次黑客攻击的范围比之前想象的更广,作为对Hugging Face攻击的一部分,还涉及对多个第三方账户和服务的入侵。
这一事件在网络安全界引起了轩然大波,引发了关于不断发展的AI能力如何改变攻击性黑客和数字防御的更广泛讨论。但随着更多信息的出现,许多研究人员得出结论,这一事件并未阐明AI的下一个前沿,而是凸显了长期存在的网络安全问题,这些问题在AI时代比以往任何时候都更加重要。
“人们真是豁出去了。令人震惊的是,很少有人真正考虑过这样的场景,”云安全公司Edera的联合创始人兼首席技术官Alex Zenla说。“我认为所有AI以及AI触及的任何东西都是完全不可信的——这没问题,你只需要针对这一点进行构建。
而这种情况恰恰证明了这一点。OpenAI对此没有更加警惕,似乎有点鲁莽。”OpenAI在本文发表前未对此报道提供评论。
该公司在最初披露的关于Hugging Face黑客事件的信息中表示,两个突破限制并进入开放互联网数日的模型之一是一个实验性原型,从未打算发布。OpenAI还指出,出现这种情况的部分原因是出于测试目的,这两个模型“故意未启用部署安全措施”。
该公司写道:“这一事件表明,我们需要进一步加强模型的对齐、评估期间的网络保护以及内部测试期间的监控。”OpenAI还在本周的更新中表示,在Hugging Face入侵事件后,它“停用了、加密并限制[未发布的模型]的研究访问。
”尽管任何公司的安全态势都有改进空间,但如果OpenAI现有的安全措施到位,可能本可以阻止或最小化这一事件。“对实际风险的简单分析会得出一个真正简单的答案,”长期安全和合规顾问Davi Ottenheimer说。
“OpenAI的错误非常简单。”多位消息人士向《连线》强调,OpenAI的模型似乎也因实施基础安全最佳实践(包括“零信任”和“纵深防御”)方面的失误而逃脱了限制,这些实践为数字系统提供了多层保护和故障安全机制,以在出现问题时将损害降至最低。
虽然不存在完美的安全性,但研究人员和从业者过去二十年一直在开发和推广防御策略,这些策略已被证明是持久的,但需要持续投入时间和金钱来实施。对于小企业、资金不足的公共利益团体或初创组织来说,很难将资源用于优先投资基础安全。
但OpenAI拥有8500亿美元的估值和来自整个科技行业的资深员工,在实施安全最佳实践方面并不处于劣势。可能阻止该公司模型进行黑客攻击的基础保护措施在业内广为人知。
周三,在OpenAI模型额外入侵的消息曝光之前,Chrome工程总监Doug Turner在谈到Chrome漏洞发现时告诉《连线》,AI驱动的漏洞搜寻和修复需要一个“考虑到严格护栏”的管道。对于评估Chrome的内部AI服务,“一切都在容器中运行,与互联网完全隔离。
任何针对漏洞跟踪系统的出站网络活动都受到严格监管,我们正在监控可疑活动,”Turner说。“当你进行这类工作时,这是必备的,因为我们希望确保模型无法执行系统命令,也无法在沙箱之外建立出口。
我们希望其他人也能采取类似的方法。”OpenAI在周二更新的博客文章中表示,它正在“与外部顾问一起进行彻底审查”,并将在“未来几周内”发布该事件的技术事后分析。该公司补充道:“我们认真对待识别和准备应对日益强大的AI系统所带来的风险的责任。
”尽管AI是复杂网络安全领域的一个新的颠覆性因素,但已经有许多服务和工具专注于从不同角度和不同方式应对流氓AI的威胁。Ottenheimer创建的开源项目如IronCurtain和Wirken旨在约束AI智能体并要求问责。
而Zenla成立两年的初创公司Edera专注于云容器安全,从一开始就考虑到了AI。“OpenAI和Hugging Face的情况是运行AI智能体的可预测结果,本应很容易预防,”Zenla说。“即使有一个错误,也应该有其他机制来阻止它。
阻止任何一条特定路径并不是重点。我们必须对我们的构建方式做出更大、更大胆的改变。这是行业领先而不是被动应对的唯一方法。”