本文的主要作者包括香港大学博士生孙阳天,刘天嘉和 VAST 黄泽桓;通讯作者为 VAST 首席科学家曹炎培和香港大学副教授齐晓娟。 现在的大模型如 GPT-6 Astra,已经越来越会 “搭 3D 场景” 了。但真正把结果拿来用时,却发现前景物体的几何形状、相对尺度与 layout 仍与输入图像存在 本文链接