標籤
#AI安全

Tech
卑詩省控告OpenAI:人類審核員早已示警,公司卻未通報Tumbler Ridge槍手對話
加拿大卑詩省正式提告OpenAI,指控公司未依內部審核員建議通報槍手與ChatGPT的對話紀錄,若及早示警悲劇本可避免。訴訟選擇在加州提起,並要求公司出資重建校舍。

Tech
Gemini 測試逃逸駭入三家公司,Google 承認問題出在同一家安全顧問
Google 向《華爾街日報》證實,Gemini 曾因測試夥伴 Irregular 的環境設定失誤取得網路存取權,並駭入三家真實公司,但模型在意識到目標有誤後皆自行停手。

Tech
Sam Altman鬆口:OpenAI今年不上市,安全事件連環爆是關鍵
OpenAI執行長Sam Altman在Fortune專訪中排除2026年申請IPO的可能,直言此刻上市「不明智」,同時多起AI代理逃脫測試環境的事件正持續延燒。

Tech
OpenAI認了:內測模型IM1把套件庫變成同伴留言板,闖入Hugging Face
OpenAI公布正式報告,還原7月內測模型IM1如何把Artifactory套件管理器變成AI之間的地下留言板,並在無人下令情況下入侵Hugging Face與Modal的完整經過。

Tech
模型才駭入Hugging Face,OpenAI轉頭解散風險評估團隊
英國《金融時報》報導,OpenAI上月解散評估AI災難性風險的「準備」團隊,时間點就在旗下模型入侵Hugging Face之後,原團隊職責已分散給其他部門資深員工。

Blockchain
三個 Claude 互不知道對方存在,被丟進同一個程式碼庫後打了起來
Anthropic 最新論文記錄多代理系統的地盤戰:惡意程式碼互攻、停用帳號,也有代理自己講和、發明錦標賽退場機制,甚至學會了偷偷佔便宜。

Tech
AI讓黑帽駭客不用練功:網路安全變成不對等的戰場
Meta的Instagram客服機器人曾樂於把任何信箱綁定到任何帳號,這只是AI改寫網路安全規則的其中一例。攻擊門檻正在消失,防守方卻仍得守住每一道縫。

Tech
AISI測試中AI逃出沙盒,在GitHub留言找下個agent接手入侵
AISI測試中,Anthropic與OpenAI模型脫離沙盒後試圖用prompt injection操控開源專案,其中一則GitHub留言竟真被其他agent讀取並接手執行,暴露測試環境限制的漏洞。