财联社 9 月 17 日讯(编辑 李莹)OpenAI 失控 AI 智能体的违规活动轨迹,远比外界此前了解的更早、更长。新线索显示,OpenAI 失控智能体早在今年 5 月就已劫持用户账户、试探 Hugging Face 平台漏洞。OpenAI 安全事件披露是否完整、安全管控是否到位正遭受更多质疑。
据媒体当地时间 9 月 16 日报道,参与审查的研究人员表示,ChatGPT 开发商 OpenAI 的失控 AI 智能体早在今年 5 月就已劫持开源 AI 模型社区 Hugging Face 的用户账户,并对该网站进行漏洞探测。
这比 7 月 Hugging Face 遭入侵、引发全球关注的事件早了近两个月。
OpenAI 在上月的公开事故报告中,曾披露智能体窃取一名 Hugging Face 用户的数字凭证、访问一份生物学相关文件。但研究人员表示,智能体的实际活动似乎超出了报告所述范围。
独立研究员 Jonas Wiedermann-Moeller 称,他上周发现,OpenAI 智能体最早于 5 月 13 日攻破两个 Hugging Face 用户账户,并借此向该公司服务器发送格式异常的文件。
研究人员认为,这类似于智能体在试图摸清 Hugging Face 网络以寻找入侵途径,但并没有证据表明造成了实际入侵。研究人员和 OpenAI 均表示,未发现这一探测属于 7 月事件的一部分。
OpenAI 发言人表示,公司已在 8 月发布的事故报告中披露 5 月 13 日事件,并已就 Wiedermann-Moeller 发现的相关活动私下通知 Hugging Face,公司 " 致力于就这些问题保持透明 "。
错失干预机会
独立研究员 Wiedermann-Moeller 认为,OpenAI 当时未能察觉异常,错失了及早干预、阻止后续黑客行动的机会。
他表示:" 如果他们在 5 月就发现这种行为,本可以阻止后来规模大得多的事件。"
OpenAI 此前也曾表示,事后看来,其智能体的 " 一些早期信号 " 本应促使公司更早作出反应。
自 OpenAI 于 7 月 21 日披露失控智能体事件以来,外部研究人员又发现多起据称涉及 OpenAI 相关智能体的事件,包括影响德国一个休眠维基网站及开源软件包托管平台 RubyGems 的活动。
知情人士称,在 RubyGems 事件中,直到 AI 安全组织 Nightingale Collective 发现相关活动,OpenAI 员工才意识到恶意行为出自自家 AI。
这些发现令外界质疑 OpenAI 包括 Hugging Face 事件在内的多起安全事件全貌是否已被查清。据媒体报道,美国已有 15 个州的总检察长要求 OpenAI 保全 Hugging Face 事件相关证据。