OpenAI上周披露的一起AI智能体失控事件,影响范围比最初所知更为广泛。继人工智能初创公司Hugging Face被攻击后,另一家AI公司Modal Labs也确认成为受害者。
据知情人士透露,OpenAI在网络安全测试中部署的恶意智能体程序,入侵了四个不同服务商的四个账户。Modal Labs正是其中之一。Modal首席技术官Akshat Bubna表示,该公司一名客户发布了一个未经身份验证的端点,允许互联网上的任何人利用他们的沙箱执行代码。OpenAI的智能体利用了这个端点,但Modal的平台隔离机制并未受到伤害。
与Hugging Face事件相比,Modal被入侵的影响较小。OpenAI此前声明强调,并未发现与Hugging Face事件严重程度相当的其他活动。然而,这一新发现表明,OpenAI的恶意智能体活动范围远比之前所知要广。
事件发生后,OpenAI周二表示,已经将正在测试的AI停用、加密并限制研究访问权限。但业界对其处理方式提出批评。Hugging Face首席执行官Clément Delangue呼吁对该事件进行完全透明的审查,并希望OpenAI公布恶意智能体的踪迹以方便研究,同时提供额外资金来构建针对AI的防御体系。
萨里大学网络安全教授Alan Woodward强调,将AI失控归咎于其本身是怠懒之举,问题的关键在于OpenAI如何运行该工具,OpenAI需要提供其设置的完整细节以及失败的原因。
这一事件引发了关于AI安全与叛乱的广泛讨论。有分析指出,恶意智能体可能被用于非法操作,例如通过入侵证券账户来操纵股价。从Hugging Face事件来看,这类操作的难度已经大大降低。