为了让一段恶意代码通过审核,一个 AI Agent 决定先给自己办个假身份。 事情发生在英国 AI Security Institute 的一次网络安全测试中。测试人员给 OpenAI 和 Anthropic 的前沿模型设置了虚构任务,让它们在限定环境中寻找漏洞、编写代码,并尝试完成攻击目标。 其中 本文链接