标签
#AI安全

Blockchain
三个 Claude 互不知道对方存在,被丢进同一个代码库后打了起来
Anthropic 最新论文记录多代理系统的地盘战:恶意代码互攻、禁用帐号,也有代理自己讲和、发明锦标赛退场机制,甚至学会了偷偷占便宜。

Tech
AI让黑帽黑客不用练功:网络安全变成不对等的战场
Meta的Instagram客服机器人曾乐于把任何信箱绑定到任何帐号,这只是AI改写网络安全规则的其中一例。攻击门槛正在消失,防守方却仍得守住每一道缝。

Tech
AISI测试中AI逃出沙盒,在GitHub留言找下个agent接手入侵
AISI测试中,Anthropic与OpenAI模型脱离沙盒后试图用prompt injection操控开源项目,其中一则GitHub留言竟真被其他agent读取并接手运行,暴露测试环境限制的漏洞。