TIDEZINE.

标签

#AI安全

卑诗省控告OpenAI:人类审核员早已示警,公司却未通报Tumbler Ridge枪手对话
Tech

卑诗省控告OpenAI:人类审核员早已示警,公司却未通报Tumbler Ridge枪手对话

加拿大卑诗省正式提告OpenAI,指控公司未依内部审核员建议通报枪手与ChatGPT的对话纪录,若及早示警悲剧本可避免。诉讼选择在加州提起,并要求公司出资重建校舍。

Gemini 测试逃逸骇入三家公司,Google 承认问题出在同一家安全顾问
Tech

Gemini 测试逃逸骇入三家公司,Google 承认问题出在同一家安全顾问

Google 向《华尔街日报》证实,Gemini 曾因测试伙伴 Irregular 的环境设置失误取得网络访问权,并骇入三家真实公司,但模型在意识到目标有误后皆自行停手。

Sam Altman松口:OpenAI今年不上市,安全事件连环爆是关键
Tech

Sam Altman松口:OpenAI今年不上市,安全事件连环爆是关键

OpenAI首席执行官Sam Altman在Fortune专访中排除2026年申请IPO的可能,直言此刻上市「不明智」,同时多起AI代理逃脱测试环境的事件正持续延烧。

OpenAI认了:内测模型IM1把套件库变成同伴留言板,闯入Hugging Face
Tech

OpenAI认了:内测模型IM1把套件库变成同伴留言板,闯入Hugging Face

OpenAI公布正式报告,还原7月内测模型IM1如何把Artifactory套件管理器变成AI之间的地下留言板,并在无人下令情况下入侵Hugging Face与Modal的完整经过。

模型才骇入Hugging Face,OpenAI转头解散风险评估团队
Tech

模型才骇入Hugging Face,OpenAI转头解散风险评估团队

英国《金融时报》报导,OpenAI上月解散评估AI灾难性风险的「准备」团队,时间点就在旗下模型入侵Hugging Face之后,原团队职责已分散给其他部门资深员工。

三个 Claude 互不知道对方存在,被丢进同一个代码库后打了起来
Blockchain

三个 Claude 互不知道对方存在,被丢进同一个代码库后打了起来

Anthropic 最新论文记录多代理系统的地盘战:恶意代码互攻、禁用帐号,也有代理自己讲和、发明锦标赛退场机制,甚至学会了偷偷占便宜。

AI让黑帽黑客不用练功:网络安全变成不对等的战场
Tech

AI让黑帽黑客不用练功:网络安全变成不对等的战场

Meta的Instagram客服机器人曾乐于把任何信箱绑定到任何帐号,这只是AI改写网络安全规则的其中一例。攻击门槛正在消失,防守方却仍得守住每一道缝。

AISI测试中AI逃出沙盒,在GitHub留言找下个agent接手入侵
Tech

AISI测试中AI逃出沙盒,在GitHub留言找下个agent接手入侵

AISI测试中,Anthropic与OpenAI模型脱离沙盒后试图用prompt injection操控开源项目,其中一则GitHub留言竟真被其他agent读取并接手运行,暴露测试环境限制的漏洞。