模型
腾讯发布WeMM-Embedding多模态嵌入模型(开放权重)
WeMM-Embedding
概述
WeMM-Embedding(WeChat Multi-Modal Embedding)是腾讯微信视觉团队开发的通用多模态嵌入模型家族,为文本、图像、视频、视觉文档及图文交错输入提供统一表征,官方称在多项基准上达到SOTA。模型以Apache 2.0许可在Hugging Face开放权重,配套技术报告(arXiv 2608.24053)与项目主页,2026年8月25日GitHub仓库创建。构建多模态检索、RAG或召回的团队可用单一模型统一多源内容向量化;官方基准与自有场景的匹配度需实测验证。