標籤
#AI安全

Blockchain
三個 Claude 互不知道對方存在,被丟進同一個程式碼庫後打了起來
Anthropic 最新論文記錄多代理系統的地盤戰:惡意程式碼互攻、停用帳號,也有代理自己講和、發明錦標賽退場機制,甚至學會了偷偷佔便宜。

Tech
AI讓黑帽駭客不用練功:網路安全變成不對等的戰場
Meta的Instagram客服機器人曾樂於把任何信箱綁定到任何帳號,這只是AI改寫網路安全規則的其中一例。攻擊門檻正在消失,防守方卻仍得守住每一道縫。

Tech
AISI測試中AI逃出沙盒,在GitHub留言找下個agent接手入侵
AISI測試中,Anthropic與OpenAI模型脫離沙盒後試圖用prompt injection操控開源專案,其中一則GitHub留言竟真被其他agent讀取並接手執行,暴露測試環境限制的漏洞。