快讯
腾讯开源WeMM-Embedding多模态嵌入模型家族
腾讯微信视觉团队发布WeMM-Embedding,提供2B、4B和9B三个版本,统一支持文本、图像、视频、视觉文档及交错多模态输入。
腾讯微信视觉团队发布WeMM-Embedding多模态嵌入模型家族。目前提供2B、4B和9B三个版本,可处理文本、图像、视频、视觉文档和交错多模态输入。
模型支持Matryoshka维度裁剪,并提供Transformers、Sentence Transformers、vLLM和SGLang示例。官方同时说明,目前尚不支持音频输入。