新智元报道 编辑:David DeepMind 又对 Atari 游戏下手了,这回秒的是自己,把两年前的大杀四方的 Atari 57 模型提速了 200 倍! 构建在各种任务中表现良好的「通用智能体」,一开始就是强化学习的重要目标。这个问题一直是大量工作的研究对象,其性能评估经常通过观察 Atari 本文链接