
8月12日晚上,微信憋了 4 年的大模型 WeLM,自己官宣了。发推的是微信官方账号 Weixin_WeChat,文案是一句英文,大意是这是微信团队做的大语言模型家族,主打资源效率。配了 3 张图,把两个模型一次摆上台面。图一(封面),标题Meet the WeLM models,两个绿色贴纸标签各标了一个版本。/WeLM-80B(80B parameters · 3B active,已上线)/WeLM-617B(617B parameters · 23B active,在研,MoE 架构)图二80B 版本。3B 激活,已经部署在小微(Xiaowei,微信的原生 AI 助手)里,能干三件事,聊天与搜索、调微信原生功能、调用小程序服务。覆盖的是用户日常发消息、查聊天记录、点外卖这种高频轻量场景。图三617B 版本。23B 激活,MoE 架构,还在研发,瞄准微信生态里的复杂任务,主打智能小程序开发和小微小工具生成。WeLM 这个名字,过去四年几乎没对外说过话。2022 年 10 月它出了第一版,ChatGPT 那时候还没上线,圈内没人注意到。后面三年,它就悄悄迭代、悄悄训练,外界基本把它忘了。这次的官宣,算是给这四年补一个公开交代。首发平台选了 X,不是微信自己。评论区直接炸了,有人问我们居然要在 X 上获知微信发布自家模型的消息,而在微信里完全没有声音;有人调侃神了,你们微信没有自己的朋友圈吗。推文浏览量已经超过 6 万。数字背后有算账的意思。微信月活 14 亿,假设给每个用户都跑大参数模型,每天推理成本可能几个亿。WeLM 的架构设计正好回答这道题,80B 总量保证能力上限,3B 激活压低单次推理成本,每次回答只动用不到 4% 的脑细胞。遇到硬骨头怎么办?小微里留了切换通道,DeepSeek 或混元都能兜底。微信目前没在国内渠道同步发 WeLM 的正式公告,模型也没开放下载或 API。对普通用户来说,WeLM 的存在感还藏在搜一搜的 AI 问答背后,以及灰度中的小微里。