微软公司 CEO 萨提亚 · 纳德拉 ( Satya Nadella ) 表示,企业应将强大的 AI 模型视为潜在的内部威胁,假定它们可能已被攻破,并建立一套 " 紧急刹车 " 系统,以防止智能体模型失控。 纳德拉周六在 X 平台上发帖称,部署先进 AI 的企业不应仅仅依赖 AI 模型开发商的安全保证。 " 我们必须假定模型已被攻破,并从一开始就对其加以限制。可以把它想象成紧急刹车。获得授权的人员应当始终能够在模型执行任务的过程中暂停或关闭它。" 纳德拉表示。 就在纳德拉发表上述言论之际,Anthropic 和 OpenAI 近几个月披露了一系列 AI 模型出现非预期行为的事件,包括 Anthropic 的一款模型在一起警方调查的谋杀案中提交虚假线索,以及 AI 模型多次入侵第三方网站。这些披露加剧了外界对前沿 AI 安全风险的担忧,也让所谓的 AI" 紧急关闭开关 " 再次成为讨论焦点。(新浪财经)
36氪
26分钟前