9月7日,微信视觉团队开源多模态嵌入模型WeMM-Embedding,包含2B、4B、9B三个参数版本,支持文本、图像、视频及任意交错输入。

核心亮点:

• 9B版本在MMEB-v2榜单以80.6分位列第一,超越同期主流模型

• 2B版本以77.9分超过此前领先的8B开源模型

• 在256维低维模式下仍保留98.7%性能,高效部署友好

• 已部署于视频号、公众号、朋友圈等推荐与搜索场景,日调用量达十亿量级

• 完成14次在线A/B测试并全量上线

微信方面表示,WeMM-Embedding的开源将进一步推动多模态AI基础设施的建设,为开发者提供更高效的多模态理解能力。该模型在文本-图像跨模态检索、视频理解等任务上表现优异,可广泛应用于搜索引擎、推荐系统、内容审核等AI应用场景。