新智元报道 编辑:LRST 中科院自动化所提出 BridgeVLA 模型,通过将 3D 输入投影为 2D 图像并利用 2D 热图进行动作预测,实现了高效且泛化的 3D 机器人操作学习。实验表明,BridgeVLA 在仿真和真实场景中均展现出卓越的性能和数据效率,仅需 3 条轨迹即可在基础任务中达到 本文链接