AB
AiBoss站
快讯

腾讯开源WeMM-Embedding多模态嵌入模型家族

腾讯微信视觉团队发布WeMM-Embedding,提供2B、4B和9B三个版本,统一支持文本、图像、视频、视觉文档及交错多模态输入。

腾讯微信视觉团队发布WeMM-Embedding多模态嵌入模型家族。目前提供2B、4B和9B三个版本,可处理文本、图像、视频、视觉文档和交错多模态输入。

模型支持Matryoshka维度裁剪,并提供Transformers、Sentence Transformers、vLLM和SGLang示例。官方同时说明,目前尚不支持音频输入。

参考:腾讯WeMM-Embedding仓库