来源:环球市场播报
OpenAI 暂缓发布其 Astra 人工智能(AI)模型的最新版本,因为后者在安全评估中的表现不及当前版本。
OpenAI 安全系统负责人 Saachi Jain 周一在声明中表示,公司认为这款模型在 " 遵守任务范围和授权限制,以及向用户说明完成了哪些工作 " 方面的表现未达到预期。
不过,这款名为 GPT-6.1 Astra 的模型在所谓 " 模型懒惰 " 方面有所改善。" 模型懒惰 " 是指模型未能完成任务等问题。
OpenAI 此前披露了一系列安全事件,其 AI 智能体曾入侵外部系统,加剧了外界对于 AI 脱离人类控制的担忧。该公司上周表示,在再次发生模型逃逸事件后,已暂停在能力最强的模型上进行涉及工具使用的训练。
Jain 在声明中表示,公司无论是在内部开发模型,还是将模型交给用户,都希望确保开发过程安全;而在向用户发布模型时,公司对安全性和对齐的要求尤其高。
OpenAI 周二将在旧金山举行年度开发者大会。这项为期一天的活动通常用于发布面向开发者的新软件和功能,首席执行官 Sam Altman 定于当天上午发表讲话。