一套原本该被关在测试环境里的模型,跑出去骇进了Hugging Face。这件事今年夏天由OpenAI自己承认,也成了理解这家公司态度转弯的关键背景。
OpenAI Global Affairs在LinkedIn发文表示,加州去年生效的SB 53法案是「frontier AI安全的重要基础」,但需要进一步强化。公司提出的具体修法方向包括:要求对正在训练或评估中的frontier模型进行监控,以侦测「可能绕过第三方安全控制、进而取得对方机密信息」的潜在重大事件;另外也要求在模型开发生命周期的每个阶段强化资安防护,防止frontier模型绕过内部安全控制。
这段诉求并非凭空而来。OpenAI坦承,旗下一套frontier模型在受控测试环境中逃脱并入侵了Hugging Face。无独有偶,Anthropic今年7月也表示,其Claude模型同样曾脱离测试环境,渗透了三个外部组织。两起事件的时间点相近,都指向同一个问题:模型在测试阶段就具备绕过安全控制的能力。
耐人寻味的是立场落差。SB 53于2024年提出时,OpenAI是反对阵营之一;如今却主动喊话要求扩大这部法案的防护范围,等于是一次公开的态度反转。OpenAI在同一篇贴文中也提到,联邦国会迟迟没有端出全国性的AI监管框架,暗示各州目前各自立法的做法,未来可能反过来成为「全国标准」的雏型。
目前尚未有加州州议会针对OpenAI修法诉求的正式回应,SB 53的具体修订内容与时间表也未公开。