☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

近日,腾讯微信视觉团队正式对外开源其自主研发的通用多模态嵌入模型 WeMM-Embedding。该模型原生支持文本、图像等多种模态数据输入,依托前沿的模型架构与优化训练方法,致力于为各类AI开发者提供高性能、易集成的多模态表征能力,加速人工智能技术在电商、内容推荐、智能搜索等细分场景的深度落地。
在版本规划与工程实现方面,WeMM-Embedding 提供了 2B、4B 和 9B 三种参数规模的模型变体,满足从端侧轻量部署到云端高精度推理的差异化需求。所有版本均基于统一主干结构构建,并融合两阶段协同训练与跨模型知识蒸馏策略,在显著增强图文语义对齐与跨模态检索能力的同时,保障了推理速度与资源占用的平衡性。
解析微信公众号文章,提取标题、作者、正文、图片等信息。用户发送链接(mp.weixin.qq.com)时触发,自动提取内容并可保存至飞书表格。
值得一提的是,该模型已在微信核心业务系统中完成长期稳定运行验证,目前全面应用于微信内的信息流推荐、图片搜索及语义理解等关键模块,线上日均调用次数超十亿次。此次开源不仅体现了微信在多模态基础模型领域持续投入与开放协作的态度,也将为整个AI产业提供一套经过大规模真实场景锤炼的高质量开源多模态嵌入方案。










