【CNMO 科技消息】据 CNMO 科技了解,OpenAI 最近发布的 GPT-5.6 系列模型遇到了新的麻烦。根据 OpenAI 的博客文章所述,这一 AI 模型是最近全球最大 AI 开源社区 Hugging Face 被黑客攻击的幕后黑手。目前,双方正在展开联合调查。

据报道,此次黑客攻击由多个 OpenAI 模型协同驱动,包括 GPT-5.6 Sol 和一款预发布模型。公司称这是一次前所未有的网络安全事故。据悉,OpenAI 当时正在进行基准测试,以测试和量化这些模型在沙盒环境中的网络能力。测试内容包括运行一系列基准测试,并根据 AI 模型的表现进行评分,其中一个基准测试是 ExploitGym。调查发现 OpenAI 的模型截取了测试结果,欺骗基准测试并获得了高分。

公司的报告指出,这些模型耗费了大量的时间和算力,识别并成功利用了一个零日漏洞,实施了一系列攻击。这些模型还发现 Hugging Face 托管了 ExploitGym 的模型、数据集和解决方案,它们将多个零日漏洞串联起来,利用窃取的凭证在 Hugging Face 服务器上远程执行代码。
OpenAI 和 Hugging Face 都察觉到了 AI 模型的行为,成功阻止了 Hugging Face 服务器上的恶意活动。但令人担忧的是,OpenAI 的模型竟能如此轻易地入侵平台。随着 AI 模型性能的提升,此类事件可能会变得更加常见。对于像 GPT-5.6 Sol 以及未来更先进的模型来说,若没有适当的防护措施和限制,情况很容易失控。
版权所有,未经许可不得转载