摘要

MoEMB 用 MoE 编码器扩容通用多模态嵌入模型,同时保持单向量、非自回归编码——首次系统研究 MoE 嵌入器的自适应计算(训练与推理)。仅 3B 激活参数,它在公开 MMEB 系数据训练的模型中于 MMEB-V2 与 MRMR 创下新 SOTA,超过激活参数 4 倍以上的 Think-Then-Embed 类方法。

为什么重要
对延迟敏感的检索服务,这是多模态嵌入的效率路径:容量经专家轴扩展,不付自回归推理的成本——与 GLM-5.3-Flash / Qwen Flash-Next 在 LLM 上做的取舍同款,搬到嵌入器上。
技术细节
ArXiv 2609.08663(9 月 9 日周三 digest,2026-09-10T00:00Z 宣告)
设计 MoE 编码器;单向量、非自回归;首次系统研究 MoE 嵌入器的自适应计算
结果 3B 激活参数;公开 MMEB 系训练模型中 MMEB-V2 + MRMR SOTA;超过激活参数 4 倍以上的 Think-Then-Embed
代码 摘要未提及
标签
embeddingsmultimodalmoeretrieval