腾讯发布了 WeMM-Embedding-2B,这是一个基于 Qwen3.5 构建的通用多模态嵌入模型,可接受文本、图像、视频、视觉文档和交错输入,以返回 2,048 维的 L2 归一化嵌入。
该模型支持对任何内容子集进行独立编码,并利用马特廖什卡维度(Matryoshka dimensions),其中 256 维嵌入在 MMEB-v2 上保留了 98.7% 的全维性能。
它在 Apache License 2.0 许可下可用,代码和权重已公开,并包含 sentence-transformers、vLLM 和 SGLang 的集成示例。