分享微信团队开源的多模态Embedding模型,可以把文本、图片、视频、视觉文档都Embedding到同一个向量空间。
WeMM-Embedding,微信视觉团队的通用多模态 Embedding 模型
微信视觉团队的通用多模态 embedding。同一套向量覆盖文本、图片、视频、视觉文档和交错输入,2B / 4B / 9B,支持 Matryoshka 截断。向量取最后一层
🔗 链接:http://t.cn/AXpHmjRA(项目)
🤗 Hugging Face:http://t.cn/AXpHmjRZ(合集)
📄 论文:http://t.cn/AXper7bm(论文)
#HOW I AI# #ai生活指南# #效率工具#
发布于 广西
