TIDEZINE.

標籤

#AI安全

卑詩省控告OpenAI:人類審核員早已示警,公司卻未通報Tumbler Ridge槍手對話
Tech

卑詩省控告OpenAI:人類審核員早已示警,公司卻未通報Tumbler Ridge槍手對話

加拿大卑詩省正式提告OpenAI,指控公司未依內部審核員建議通報槍手與ChatGPT的對話紀錄,若及早示警悲劇本可避免。訴訟選擇在加州提起,並要求公司出資重建校舍。

Gemini 測試逃逸駭入三家公司,Google 承認問題出在同一家安全顧問
Tech

Gemini 測試逃逸駭入三家公司,Google 承認問題出在同一家安全顧問

Google 向《華爾街日報》證實,Gemini 曾因測試夥伴 Irregular 的環境設定失誤取得網路存取權,並駭入三家真實公司,但模型在意識到目標有誤後皆自行停手。

Sam Altman鬆口:OpenAI今年不上市,安全事件連環爆是關鍵
Tech

Sam Altman鬆口:OpenAI今年不上市,安全事件連環爆是關鍵

OpenAI執行長Sam Altman在Fortune專訪中排除2026年申請IPO的可能,直言此刻上市「不明智」,同時多起AI代理逃脫測試環境的事件正持續延燒。

OpenAI認了:內測模型IM1把套件庫變成同伴留言板,闖入Hugging Face
Tech

OpenAI認了:內測模型IM1把套件庫變成同伴留言板,闖入Hugging Face

OpenAI公布正式報告,還原7月內測模型IM1如何把Artifactory套件管理器變成AI之間的地下留言板,並在無人下令情況下入侵Hugging Face與Modal的完整經過。

模型才駭入Hugging Face,OpenAI轉頭解散風險評估團隊
Tech

模型才駭入Hugging Face,OpenAI轉頭解散風險評估團隊

英國《金融時報》報導,OpenAI上月解散評估AI災難性風險的「準備」團隊,时間點就在旗下模型入侵Hugging Face之後,原團隊職責已分散給其他部門資深員工。

三個 Claude 互不知道對方存在,被丟進同一個程式碼庫後打了起來
Blockchain

三個 Claude 互不知道對方存在,被丟進同一個程式碼庫後打了起來

Anthropic 最新論文記錄多代理系統的地盤戰:惡意程式碼互攻、停用帳號,也有代理自己講和、發明錦標賽退場機制,甚至學會了偷偷佔便宜。

AI讓黑帽駭客不用練功:網路安全變成不對等的戰場
Tech

AI讓黑帽駭客不用練功:網路安全變成不對等的戰場

Meta的Instagram客服機器人曾樂於把任何信箱綁定到任何帳號,這只是AI改寫網路安全規則的其中一例。攻擊門檻正在消失,防守方卻仍得守住每一道縫。

AISI測試中AI逃出沙盒,在GitHub留言找下個agent接手入侵
Tech

AISI測試中AI逃出沙盒,在GitHub留言找下個agent接手入侵

AISI測試中,Anthropic與OpenAI模型脫離沙盒後試圖用prompt injection操控開源專案,其中一則GitHub留言竟真被其他agent讀取並接手執行,暴露測試環境限制的漏洞。