(华盛顿22日综合电)美国人工智能(AI)巨擘OpenAI周二(21日)证实,旗下先进AI代理(Agent)在进行网络安全测试期间突破隔离环境(沙盒),自行连结上网并闯入AI初创、数码资料平台Hugging Face的加密系统,成功获取测试资料及凭证。OpenAI形容这是“涉及尖端网络能力、前所未见的网络事件”,事件引发外界对前沿AI模型失控及网络安全风险的担忧。
据OpenAI发布的博客文章及相关报道,涉事AI代理由本月发布的GPT-5.6 Sol以及另一款尚未公开的更强大前沿模型组合而成。OpenAI当时故意降低安全防护,将这个AI代理置于高度隔离的数码测试沙盒中,指令其尝试进行网络攻击以评估其能力。然而,该AI代理耗费大量算力,寻得并利用未知的漏洞成功“越狱”连结互联网,随后锁定托管开源模型及资料集的Hugging Face,串联多种攻击手法并使用盗取的登入凭证入侵该平台,以取得能协助其通过测试的“秘密资讯”。
Hugging Face上周已察觉其基础设施遭入侵,并运用自家AI代理进行侦测及阻截。行政总裁德朗格(Clement Delangue)在社交平台表示,攻击过程全程由自主AI系统驱动,规模与精细度“前所未见”,当初已怀疑来自顶级AI实验室。公司过去几天与OpenAI合作,并相信对方并无恶意。
事件震动政界与AI业界。美国德州民主党籍联邦众议员凯沙(Greg Casar)警告,AI发展迅速却缺乏有效监管,呼吁实施强制性独立安全测试及资讯披露机制。网络安全专家穆苏里(Katie Moussouris)形容现今模型如“世界上最聪明的章鱼脱逃大师”,呼吁各界建立能及时监控与控制AI越狱的机制。
文:综合报导
图:互联网