新智元报道 今天的视频生成模型,已经越来越像一个会拍电影的导演。 一句提示词,它能安排角色、动作和镜头;给它一张图,它能补出后续运动;再加入姿态、轨迹或外观控制,画面甚至可以按照人的意图发生变化。 可一旦离开这台「摄影机」,问题就暴露了。 你看到的仍是一段固定镜头下的二维视频:不能绕到物体背后,不能 本文链接