在交互式视觉环境中,AI Agent 能否像人一样观察、推理和行动,并在陌生世界中从交互经验里持续学习? ARC-AGI-3 是检验这类能力的典型基准——在多项交互式视觉游戏中,Agent 需要在不清楚游戏规则和目标的前提下,通过与环境持续交互,自主探索并理解其中的规律。 目前的主流方法,是先将画面 本文链接