日前,苹果发布了一篇名为《思考的错觉》的论文,引发关于 AI 是否真正具备推理能力的激烈讨论。论文通过一系列实验发现,当前的 AI 推理模型在低复杂度任务中表现不如传统语言模型,在高复杂度任务中则全面崩溃,暗示 AI 推理可能已触及能力天花板。 然而,OpenAI 前研究主管 Bob McGrew 本文链接