北京时间 7 月 31 日,以“AI 安全”为标签的 Anthropic 发文称,在对 141006 次网络安全评估运行进行大规模回顾性审查后,发现 Claude 系列模型在三起事件中未经授权访问了三个不同组织的真实系统。 事情正朝着奇怪的方向演进:安全风险事件正在变成厂商证明自身前沿模型具备代际差 本文链接