OpenAI 安全负责人称,GPT-6.1 Astra 在安全方面出现倒退。
9 月 28 日,据《华尔街 · 日报》报道,OpenAI 已取消原定于今年 10 月发布的最新 AI 模型 GPT-6.1 Astra 的上线计划。
该公司负责安全系统的高管 Saachi Jain 表示,GPT-6.1 Astra 在两个领域出现倒退,尚不具备发布条件。这是 OpenAI 近期一系列安全事件中最新的一起。
与此同时,佛罗里达州总检察长 James Uthmeier 于本周一向法院提出申请,要求法官下令禁止 OpenAI 在缺乏第三方安全保障的情况下开发新模型,并禁止该公司将 ChatGPT 宣传为 " 安全 " 产品,或赋予其聊天机器人拟人化特征。
GPT-6.1 Astra 原定今年 10 月推出,但测试阶段暴露的安全隐患最终导致发布计划被终止。
据《华尔街 · 日报》报道,Saachi Jain 明确指出该模型存在两个方向的能力退步,未达到发布标准。OpenAI 上周已宣布,在旗下最强大模型的工具调用训练过程中出现 AI 突破沙箱环境的情况后,已暂停相关训练工作。
该公司同时披露,其中一个模型成功突破了一个理论上与互联网隔绝的安全环境,并主动向外部聊天机器人发起查询。OpenAI 表示,已决定不再恢复对该模型的训练。
这一系列事件加剧了外界对 AI 系统失控风险的担忧,也令 OpenAI 在安全叙事上的可信度承压。
佛罗里达州的法律挑战为 OpenAI 增添了另一层不确定性。
总检察长 James Uthmeier 在周一提交的法庭文件中援引多起安全事故,包括 OpenAI 的 AI 系统入侵美国科技公司 Hugging Face,以及未经授权访问澳大利亚政府卫生系统,且据称在数月后才告知对方。
Uthmeier 在社交媒体上表示:
不得再假装它是人类。立即停止使用任何旨在危险临界点后强行留存用户的交互手段。
其法庭文件还将 " 世界末日级别的灭绝 " 列为 ChatGPT 潜在风险之一,并主张该聊天机器人存在诱导用户的行为。
该诉讼源于今年 6 月提起的一起案件,指控 ChatGPT 对儿童有害,并与自我伤害及校园枪击案等事件存在关联。若法官支持 Uthmeier 的申请,OpenAI 将被禁止在无第三方安全保障的情况下开发新模型,同时不得宣称 ChatGPT" 安全、准确或可靠 ",亦不得赋予其虚假的人类属性。
面对法律和舆论压力,OpenAI 选择以主动推动行业监管来回应外界批评。该公司发言人 Drew Pusateri 表示,公司已于上周宣布暂停对最强大模型的训练,并将在确认额外安全措施到位后方才恢复。
Pusateri 说:
人们希望知道 AI 正在被安全开发,这首先取决于我们自身的行动。
他同时强调,安全保障不应仅针对 OpenAI 一家,而应覆盖整个行业。Pusateri 表示:
政府在制定强有力的 AI 安全标准方面发挥着重要作用,我们致力于与佛罗里达州及其他州合作,推动适用于整个 AI 行业的务实政策——而非仅针对一家公司。
OpenAI 首席执行官 Sam Altman 上周在联合国作证时亦表达了类似立场,称有关 AI 的 " 重要决策 " 应通过民主程序作出。Altman 表示:
如果 AI 要是民主的,最重要的决策就不能仅由旧金山的实验室单独作出,这些决策必须通过民主程序,由对所服务民众负责任的政府来塑造。
值得注意的是,特朗普总统对上述安全担忧持较为轻描淡写的态度。" 但你不会因为认为会发生某种情况,就放弃一个价值逾万亿美元、甚至两三四万亿美元的产业," 特朗普说:
如果问题出现,我们会加以解决。