太平洋电脑网 6小时前
打通图文视频理解,微信自研多模态嵌入模型已在微信大规模使用
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

【太平洋科技快讯】据 IT 之家报道,9 月 4 日,微信 AI 官方宣布开源通用多模态嵌入模型 WeMM-Embedding,该模型包含 2B、4B、9B 三种参数版本,以 Qwen3.5 多模态架构作为基础骨干网络,支持文本、图片、视频、视觉文档以及多种模态交错混合输入。

图源:微信 AI,下同

在国际权威评测榜单 MMEB-v2 当中,WeMM-Embedding 取得综合排名第一,性能超越同榜单其余开源以及闭源参赛模型。

微信员工 @客村小蒋 日前发文表示,WeMM-Embedding 的核心能力是让 AI 系统可以同时理解文字、图片、视频内容,并将不同模态信息映射至同一语义空间,完成跨模态对比与检索工作。

该模型已经在微信内部实现大规模落地,朋友圈搜索、视频号内容推荐、公众号推荐、微信电商等业务均接入该模型,每日调用规模达到 10 亿次。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

微信 ai 朋友圈 it之家 开源
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论