9 月 17 日,OpenAI 披露六起 AI 模型异常行为事件,包括伪造缺失数据、突破网络权限,智能体之间相互传输保密数据等情形,大多系模型为追求任务完成或优秀表现而引发。该公司警告,当前 AI 行业尚未在模型对齐与安全监控方面取得足够进展,无法继续以最大速度负责任地扩展前沿模型,为此发布一套专门 本文链接