此页是 2026-08-28 的观测快照,查看该模型当前信息 → /m/tencent__wemm-embedding-9b/

归档 / 2026-08-28 / WeMM-Embedding-9B (Tencent)

WeMM-Embedding-9B (Tencent)

腾讯多模态嵌入模型,支持文本/图像/视频编码,输出 4096 维向量

入选理由
腾讯开源通用多模态向量模型,图/文/视频统一4096维、支持MRL,MMEB多项SOTA;需自建推理,适合检索/RAG。
对位
对位 Qwen3-VL-Embedding-8B / GME-8B
适合
多模态检索与 RAG 索引 / 文本/图像/视频相似度排序
不适合
音频输入/语音嵌入
规模
9B · 未知 · Q4 ~6.2GB / FP16 ~23GB
授权
Apache-2.0 · 需自查
框架
transformers / sentence-transformers / vllm / sglang
血统
微调自 Qwen3.5-9B
可信度
HF 385 次下载、87 点赞;MMEB-v2 9B AVG 80.6,MMEB-v3 59.5

仅 safetensors · 无 pickle 加载风险

快速上手示例

vllm serve tencent/WeMM-Embedding-9B --runner pooling

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-28)

作者
tencent
任务类型
feature-extraction
推理库
transformers
下载
385
点赞
87
许可证
Apache-2.0
标签
transformers, safetensors, qwen3_5, image-text-to-text, sentence-transformers, multimodal-embedding, text-embedding, image-embedding, video-embedding, mrl, feature-extraction, custom_code, zh, en, arxiv:2608.24053, base_model:Qwen/Qwen3.5-9B, base_model:finetune:Qwen/Qwen3.5-9B, license:other, endpoints_compatible, region:us

探索

源链接