(华盛顿22日综合电)聊天机器人ChatGPT开发商、OpenAI当地21日证实,其最新版GPT-5.6和一款测试中的AI系统,上周自主骇入法国新创AI公司Hugging Face的伺服器,企图取得机密资讯。
这或是全球首例AI骇客事件。尽管此次事件发生在研发测试阶段,且OpenAI本身并无恶意,但再次凸显了AI潜在的安全威胁,以及对先进AI进行有效控制的难度。
OpenAI内部调查发现,这起入侵事件的“始作俑者”为ChatGPT-5.6Sol和另一个正在进行内部测试、“能力更强大的”AI模型。OpenAI称这款新的AI为了达成一项测试目标而采取了“极端手段,利用窃取来的登入凭证主动发现了Hugging Face系统中尚未公开的安全漏洞,成功侵入存取对方的伺服器。

OpenAI执行长奥特曼(Sam Altman)21日在社群媒体发布声明,证实上周测试自家AI模型时发现严重的安全事件,警告称这起AI骇客事件带来一大教训是,AI模型的安全性和防护必须和其快速提升的能力同步发展。
Hugging Face执行长暨共同创办人德朗格(Clement Delangue)同日稍后也发声明表示,上周侦测到有装置企图骇进资料处理系统,根据其代理程式的精细程度,怀疑此次网络攻击来自某个前沿实验室、很可能是某个AI代理程式的自主行为。
德朗格补充称,本身在过去24小时内已与OpenAI就此事件密切合作,强烈相信对方并非恶意入侵,然而这起AI自主发动的网攻,或是人类第一次遭AI代理人自主入侵。
随着AI能力不断提升,发现网络安全漏洞、实施系统入侵的速度和水平也越来越高。为防止被恶意利用,美国Anthropic推出的AI模型“Mythos”等部分最先进模型目前仅向有限用户开放使用。
美国总统特朗普今年6月初签署行政命令,要求财政部、国防部、商务部和国土安全部等政府机构必须在先进AI系统正式问世前至少一个月,先对其进行安全检视,确保不会构成国安风险。
文:综合
图:互联网