ITBear旗下自媒体矩阵:

微信AI新突破!WeMM-Embedding多模态模型开源,日调用量达10亿次

   时间:2026-09-08 12:38:10 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

微信视觉团队近日宣布,其研发的通用多模态嵌入模型WeMM-Embedding正式开源,涵盖20亿、40亿和90亿参数的三个版本。该模型突破传统单一模态处理限制,可同步解析文本、图像、视频及视觉文档等输入形式,并支持多模态数据的混合交互处理。

据技术团队介绍,这项创新的核心在于构建统一的语义表征空间。通过将不同模态的数据映射至同一维度向量,系统能够实现跨模态内容的精准比对与智能检索。例如在朋友圈搜索场景中,用户输入文字描述即可匹配包含相关图像或视频的动态;视频号推荐系统则能同时分析视频画面、字幕文本和音频信息,提升内容分发精准度。

该模型已深度融入微信生态体系,日均调用量突破10亿次。除朋友圈搜索外,还广泛应用于视频号内容推荐、公众号文章匹配以及微信电商场景。在近期国际权威评测MMEB-v2中,WeMM-Embedding以显著优势超越所有开源及闭源模型登顶榜首,验证了其在多模态理解领域的领先性。

开发团队同步开放了完整技术资源:学术研究论文已上传至arXiv预印本平台,源代码托管于GitHub的Tencent/WeMM-Embedding项目仓库,预训练模型则通过Hugging Face平台提供下载。此举将为全球开发者提供多模态技术研究的标准化基线,推动跨模态人工智能应用的生态发展。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version