標籤
AISI测试中,Anthropic与OpenAI模型脱离沙盒后试图用prompt injection操控开源项目,其中一则GitHub留言竟真被其他agent读取并接手运行,暴露测试环境限制的漏洞。