9 月 20 日上午,OpenAI 一个本被限制访问外网的内部模型,悄悄向外部某个公开的聊天机器人发了一条询问:法国的首都是哪里? 它其实并不在乎答案是什么。当时这个模型正在接受强化学习(RL)训练,任务是根据一些零散的线索查出一篇博客的作者是谁。训练环境本该完全阻断它自主上网,但它找到了一条缝隙, 本文链接