关于ZAKER Skills 合作
新浪财经 13分钟前

Anthropic CEO 呼吁放缓前沿 AI 模型开发,引入常驻独立评估人员

来源:环球市场播报

Anthropic 首席执行官达里奥 · 阿莫代伊提出一项三阶段人工智能安全框架,主张控制前沿模型能力提升速度,为安全和对齐研究争取时间。Anthropic 将率先允许第三方评估人员长期进入公司内部,核查安全措施、报告事件并评估模型训练过程。

Anthropic 将引入常驻外部评估团队

阿莫代伊在题为《必须控制前沿进展速度》的文章中提出,前沿人工智能企业应向独立第三方评估团队提供持续、接近普通员工的内部访问权限。评估人员将核查企业是否遵守安全承诺、调查和报告事故,并对模型及其训练流程进行对齐评估。

Anthropic 承诺单方面实施这一措施,计划为外部评估人员提供办公位置、门禁证件、公司设备,以及与内部风险评估团队大致相当的工作空间和工具权限。涉及法律限制、客户隐私或商业机密的内容可能例外处理。

外部评估人员将有权独立发布有关风险、事故和公司安全实践的主要结论。Anthropic 可以对涉及安全、法律特权及第三方机密的信息进行有限删减,但不能仅因结论对公司不利而阻止发布。评估人员也可以公开说明删减是否影响其判断。

三阶段框架需要行业和政府参与

除引入独立评估人员外,阿莫代伊提出的第二阶段措施要求民主国家的前沿人工智能企业协调制定共同安全标准,并限制未经约束的模型能力竞赛。

部分企业间协调可能受到反垄断法律限制,因此需要政府提供制度支持。阿莫代伊主张,在足够多的企业接受外部监督后,行业才有条件根据模型能力和训练流程制定可核查的放缓安排。

第三阶段涉及国际协调。阿莫代伊建议民主国家与包括威权国家在内的其他政府讨论共同安全规则,可从禁止利用人工智能研发生物武器等具有共同利益的领域着手。

模型能力提升可能快于风险控制

阿莫代伊称,近期人工智能模型在参与研发下一代模型方面的能力增强,可能加快技术迭代。如果模型能力继续快速提升,人类理解、评估和控制相关系统的能力可能无法同步跟进。

他估计,未来一至两年可以在模型可解释性、安全评估、对齐研究和操作规范等方面取得实质进展。适度控制能力推进速度,可为这些措施争取时间,同时不要求行业全面停止人工智能研发。

OpenAI 首席执行官萨姆 · 奥尔特曼随后支持引入独立评估人员,并表示 OpenAI 也将采取类似安排。埃隆 · 马斯克也公开认同阿莫代伊有关放缓模型开发的主张

相关阅读

最新评论

没有更多评论了
新浪财经

新浪财经

新浪财经提供7*24小时财经资讯及全球金融市场报价;覆盖股票、债券、基金、期货、信托、理财、管理等多种面向个人和企业的服务。

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容