能订咖啡也能搭建工具 微信自研大模型 WeLM 公开亮相
A
Alice

2026-08-13 · 11 [[ $t('article.detail.read') ]]

能订咖啡也能搭建工具 微信自研大模型 WeLM 公开亮相

「帮我订杯咖啡」「把这份文件总结一下」——在微信里说这么一句,剩下的事有人替你做完。

8 月 13 日,微信团队在社交平台上正式对外介绍了自研大模型系列 WeLM,同时第一次公开了这个系列的两档配置。

介绍语只有一句:「WeLM 是微信团队打造的大模型家族,核心是资源效率。」


两档配置

微信团队这次公开了两个型号,分工很清楚:一个已经投放使用,一个则是则是为将来准备的。

WeLM-80B 采用 MoE 架构,总参数 800 亿,每次推理只激活其中 30 亿。这个型号已经投入使用,支撑着微信的原生 AI 助手「小微」,负责聊天与搜索、调用微信原生功能、接通小程序服务。

WeLM-617B 同样是 MoE 架构,总参数 6170 亿,每次激活 230 亿,目前仍在开发中。按照官方的说法,这一档用更大的激活参数换取更强的通用理解与推理能力,目标是应对微信生态里更复杂的任务——具体点名了两个方向:智能小程序开发,以及「小微」的工具生成。

换句话说,80B 负责把用户现在提出的需求接住,617B 想做的是让「小微」自己造出新东西来。

你的微信智能管家

想知道 WeLM 有什么用,看「小微」就够了。

「小微」在 2026 年 6 月 20 日开启小范围内测,入口藏在微信主界面的左上角,图标是两只小眼睛。它被不少人称作微信史上最大的一次更新,原因不在于多了一个聊天框,而在于它能动手。

它能操作微信本身。你用文字或者语音说一句话,它就去调微信的原生功能——调整设置、发消息、拨电话,这些原本要点好几层菜单的事,一句话就能完成。

它能“穿过”小程序去办事。帮你挂号、买咖啡、调出登机牌,这些动作分散在不同的小程序里,过去要一个个点进去。现在你把需求说出来,它替你走完流程。

它还能协助生产内容。生成图片、创建笔记、总结文件、设置提醒、推荐音乐,甚至根据你的一句描述,直接搭出一个简单的小工具。

这几类能力串起来看,「小微」想做的不是一个更聪明的聊天窗口,而是一个装在微信里的执行者:你说,它做。

目前它还不支持自己开通或关闭,只有部分用户拿到了测试资格,其余人得等后续版本。


资源效率:每次只用不到 4% 的参数

理解了「小微」要干的活,就能理解微信为什么把资源效率放在第一位。

800 亿参数里每次只激活 30 亿,激活率不到 4%。横向比一下就知道这个数字有多克制:DeepSeek V4 Pro 的总参数是 1.6 万亿,每次激活 490 亿,激活率约 3%;腾讯自家的混元 Hy3 总参数 2950 亿,每次激活 210 亿,约 7%。

官方技术博客还给出了另一个数字:这个 80B-A3B 模型训练时用掉的数据不到 14 万亿 token,但性能可以和同等规模、甚至更大的模型掰手腕。

原因其实很直白。微信的月活是十几亿,用户说一句「帮我订杯咖啡」,模型要听懂、要规划步骤、要调起小程序、要走完下单流程——这一整套跑下来,每省下的一点算力都要乘以一个极其庞大的调用量。何况订咖啡这种事,用户等超过两三秒就会不耐烦。


亮相之后

这次亮相,微信公开的是参数、架构和用途,没有公开的东西同样值得留意:WeLM 有没有开源计划,API 什么时候开放,以及任何一项第三方可以核验的基准测试成绩。

至于这个大模型究竟处在什么水平,外界目前能依据的只有一件事:它已经在小微上跑起来了,而且跑在十几亿人的手机里。


本文信息来自微信团队的公开介绍、官方技术博客与公开报道。本文不构成投资或采购建议。