腾讯开源多模态嵌入模型 WeMM-Embedding,多项基准达 SOTA
腾讯微信视觉团队开源 WeMM-Embedding 多模态嵌入模型系列,提供 2B、4B、9B 三种规格,统一支持文本、图像、视频、视觉文档及混合多模态输入的表示与检索,采用 Apache 2.0 协议。模型在多个基准上取得领先表现,暂不支持音频输入。
Telegram 评论区
11 条回复,可以前往 Telegram 继续讨论。
腾讯微信视觉团队开源 WeMM-Embedding 多模态嵌入模型系列,提供 2B、4B、9B 三种规格,统一支持文本、图像、视频、视觉文档及混合多模态输入的表示与检索,采用 Apache 2.0 协议。模型在多个基准上取得领先表现,暂不支持音频输入。
Telegram 评论区
11 条回复,可以前往 Telegram 继续讨论。