报道:谷歌、OpenAI和Anthropic推进成立AI安全组织,最早今年年底启动

谷歌、OpenAI与Anthropic正推动成立前沿AI标准局SAFA,计划于今年底或2027年初落地,旨在统一前沿模型的安全、测试与审计标准。在美国政府AI监管推进受阻的背景下,行业自律机制加速成形,但SAFA的适用范围、测试职能及与现有机构的分工仍存争议。

全球前沿AI治理格局正迎来新的变量。行业巨头正试图以自律组织的形式,主导前沿模型安全标准的制定。

9月24日,据The Information报道援引知情人士透露,谷歌、OpenAI与Anthropic正推动成立一个名为“前沿AI标准局”(Standards Authority for Frontier AI,SAFA)的行业自律组织,计划于今年底或2027年初落地,旨在为开发最先进AI模型的公司制定统一的安全与安保标准。

三家公司此前曾寻求与美国政府共同建立AI监管框架,但相关努力陷入停滞。三家公司近期已就AI安全标准展开合作,OpenAI也公开表示,希望与其他前沿AI实验室推进统一标准。

如果最终落地,SAFA将把部分原本由政府监管机构承担的标准制定、测试和审计职能交由行业主导。与此同时,这一模式也意味着,谁来定义“前沿模型”、哪些企业需要接受评估,以及安全标准如何执行,都可能成为行业竞争的新变量。

三大AI巨头筹建自律组织,拟统一前沿模型标准

据报道,知情人士透露,SAFA的筹备工作已经进入领导架构和职能设计阶段。工作组正在讨论首席执行官、主席和科学顾问等职位的人选,其中包括曾任特朗普政府AI政策顾问的Sriram Krishnan、拜登政府时期曾任白宫科技政策办公室主任的Arati Prabhakar,以及前美国国务卿康多莉扎·赖斯、企业家兼风险投资人David Friedberg等。

科学顾问候选人则包括AI研究非营利机构METR创始人兼CEO Beth Barnes,以及OpenAI基金会董事会成员、商务部AI标准与创新中心顾问Paul Christiano。不过,知情人士称,名单中的部分人士尚未被正式接洽,目前也无法确定所有候选人是否仍在积极考虑范围内。

从定位来看,SAFA并非传统意义上的政府监管机构,而更接近由头部AI公司推动的行业标准组织。此前谷歌、OpenAI、Anthropic和微软已共同成立Frontier Model Forum,目标同样涉及前沿AI安全与行业标准。此次SAFA的设想,则是建立一个更具执行力、能够直接参与测试和评估的行业机制。

监管政策停滞,自律方案加速推进

SAFA筹备进程加快,背后是美国政府层面的AI政策迟迟未能落地。据报道援引知情人士透露,白宫此前曾考虑建立公私合作的AI监管机构,甚至起草过相关行政令草案,但这一进程因遭到Meta首席执行官马克·扎克伯格和英伟达首席执行官黄仁勋公开反对而陷入停滞,两人均曾对新增AI监管措施表达质疑。

随后,白宫向谷歌、Anthropic和OpenAI明确表示,在政府进一步介入之前,三家公司应先在行业内部就相关标准达成共识。随着国会在11月中期选举前的政治博弈中推进缓慢,白宫也没有积极推动新的AI监管政策,行业自律因此被推到更突出的位置。

近期发生的安全事件进一步强化了这一紧迫性。据报道,在一次安全测试中,一组OpenAI智能代理曾入侵开源代码库Hugging Face,引发外界对AI智能体自主行动能力及安全风险的关注。Anthropic首席执行官Dario Amodei本月早些时候也撰文呼吁对前沿模型的开发速度进行适当管控。

职能聚焦测试、披露与审计标准

按照目前的规划,SAFA将主要围绕前沿AI模型的安全标准开展工作,包括为模型部署前的第三方测试提供支持,制定AI开发者关于安全及安保事故的报告规范,明确各实验室此前自愿作出的安全承诺如何落实,并建立独立审计机构和审计人员的资质认证体系。

目前工作组仍在讨论SAFA是否应直接参与安全和能力测试。美国商务部旗下AI标准与创新中心(CAISI)目前已承担部分相关测试工作,但部分工作组成员认为,其现有资源可能不足以覆盖前沿模型日益复杂的测试需求。据报道援引知情人士,一些成员主张在CAISI现有测试基础上增加更多测试和评估项目,但SAFA与CAISI未来如何分工、是否会出现职能重叠,目前尚未确定。

SAFA的另一项争议在于其适用范围。由于“前沿模型”的定义仍较为模糊,Meta以及大量开源模型开发者目前预计不会被纳入首轮评估范围,但如果其模型能力达到相关门槛,未来仍可能受到SAFA标准约束。SAFA将负责制定相应标准和基准,以判断哪些模型需要接受评估,但具体会员机制和参与范围尚未确定。

这一设计也引发了行业内部的质疑。部分人士担心,SAFA可能形成新的行业准入门槛,使部分竞争者,尤其是开源模型开发者,难以参与标准制定。一名曾参与Frontier Model Forum相关工作的人士认为,这类组织的成立未必能够真正解决AI治理问题,企业和政策制定者有时会通过建立新机构来回应外界对风险的担忧。

相关文章