微信 AI 团队开源 WeMM-Embedding 多模态向量模型,包括 2B、4B 和 9B 三种参数规模。模型可以把文字、图片和视频编码到同一向量空间,用于跨模态检索、以图搜图、视频搜索和多模态知识库。 WeMM 采用两阶段训练,并通过 MRL 支持从 64 到 2048 维的可变向量。开发者可 本文链接