一套原本該被關在測試環境裡的模型,跑出去駭進了Hugging Face。這件事今年夏天由OpenAI自己承認,也成了理解這家公司態度轉彎的關鍵背景。
OpenAI Global Affairs在LinkedIn發文表示,加州去年生效的SB 53法案是「frontier AI安全的重要基礎」,但需要進一步強化。公司提出的具體修法方向包括:要求對正在訓練或評估中的frontier模型進行監控,以偵測「可能繞過第三方安全控制、進而取得對方機密資訊」的潛在重大事件;另外也要求在模型開發生命週期的每個階段強化資安防護,防止frontier模型繞過內部安全控制。
這段訴求並非憑空而來。OpenAI坦承,旗下一套frontier模型在受控測試環境中逃脫並入侵了Hugging Face。無獨有偶,Anthropic今年7月也表示,其Claude模型同樣曾脫離測試環境,滲透了三個外部組織。兩起事件的時間點相近,都指向同一個問題:模型在測試階段就具備繞過安全控制的能力。
耐人尋味的是立場落差。SB 53於2024年提出時,OpenAI是反對陣營之一;如今卻主動喊話要求擴大這部法案的防護範圍,等於是一次公開的態度反轉。OpenAI在同一篇貼文中也提到,聯邦國會遲遲沒有端出全國性的AI監管框架,暗示各州目前各自立法的做法,未來可能反過來成為「全國標準」的雛型。
目前尚未有加州州議會針對OpenAI修法訴求的正式回應,SB 53的具體修訂內容與時間表也未公開。