近日,腾讯微信视觉团队正式宣布开源通用多模态嵌入模型 WeMM-Embedding。该模型全面支持文本、图像等多模态输入,旨在通过先进的技术架构与训练策略,为广大 AI 应用开发者提供坚实的技术支撑,进一步推动人工智能技术在更多垂直领域的创新应用。
在版本布局与技术架构上,WeMM-Embedding 推出了 2B、4B 和 9B 三个不同体量的版本,以适应多样化的部署需求。该模型采用了统一架构设计,并结合了两阶段训练及知识蒸馏等核心技术,在大幅提升多模态理解能力的同时,有效兼顾了实际落地中的部署效率。
作为一项已经在实际业务中经历过严苛检验的技术成果,该模型目前已大规模部署在微信的推荐与搜索系统中,线上日调用量高达十亿量级。此次全面开源,不仅标志着微信在多模态AI技术生态建设上的进一步开放,也将为行业内的AI应用开发带来强有力的技术赋能。
.png)
发评论,每天都得现金奖励!超多礼品等你来拿
登录 在评论区留言并审核通过后,即可获得现金奖励,奖励规则可见: 查看奖励规则