腾讯微信视觉团队已开源通用多模态嵌入模型WeMM-Embedding,该模型支持文本、图像等多模态输入,有2B、4B、9B三个版本。它采用统一架构、两阶段训练及知识蒸馏技术,已大规模部署于微信推荐与搜索系统,线上日调用量达十亿级,将为AI应用开发者提供技术支撑,推动AI在垂直领域的创新应用。