腾讯混元徐灿转岗微信WeLM,两套大模型体系加速并行
知情人士透露,腾讯混元资深研究员徐灿加入微信WeLM团队,专注后训练与Agent方向,腾讯两套大模型体系并行运转。
腾讯混元大语言模型团队与微信WeLM团队之间,正在发生新一轮核心人才流动。36氪从多位知情人士处获悉,混元资深研究员徐灿近期加入微信WeLM团队,从事大模型研发相关工作。徐灿长期专注于合成数据、指令数据构造及大模型后训练研究,与WeLM当前强化模型训练及复杂任务能力的方向契合度较高。
徐灿在加入腾讯之前,最具行业辨识度的工作是2023年4月以第一作者身份发布WizardLM论文,提出Evol-Instruct方法——让大模型自动增加已有任务的难度、限制条件与推理步骤,再用生成的复杂指令训练模型。这套方法随后被用于WizardCoder、WizardMath等项目,并逐步扩展至代码、数学、模型评估与强化学习方向。2025年5月,徐灿宣布离开微软加入腾讯混元。
混元后训练体系中的徐灿
徐灿加入混元后,在大语言模型后训练方向承担了重要职责。2025年下半年,姚顺雨加入腾讯并接手相关业务,混元原有的技术与组织格局开始迅速调整。同年12月,腾讯正式官宣重组大模型研发架构:姚顺雨兼任AI Infra部和大语言模型部负责人,王迪继续担任大语言模型部副总经理并向姚顺雨汇报,徐灿也在此时转向后训练方向。
值得注意的是,混元后训练业务当时已被拆分成多个小组,徐灿仅负责其中一个方向。知情人士表示,后训练团队几个小组之间曾围绕数据组织、系统提示词和产品工程路径等方向展开探索。在混元几经调整后,徐灿近期公开身份仍为混元Principal Researcher(资深研究员),今年仍时常以作者身份出现在混元相关论文中。
WeLM作为独立大模型团队的布局
WeLM长期保持相对独立的大模型研发路径,与混元形成两套并行的基模体系。
- 2022年,微信团队发布中文预训练语言模型WeLM,论文披露其拥有100亿参数,在18项中文任务上超过多个同等规模模型。
- 2025年8月,微信团队公开WeChat-YATT,一套面向大语言模型与多模态模型的RLHF训练框架,主要解决控制器扩展、动态采样与GPU资源调度问题。
- 2026年的技术文档显示,新一代WeLM转向高度稀疏的MoE架构,其中一个基础版本总参数约800亿、每次推理激活约30亿;团队随后扩展出约1300亿参数、激活约49亿的变体。
- 2026年7月9日,微信AI团队公开Hidden Decoding研究,披露WeLM-HD4-80B与WeLM-HD4-617B两个模型,首次将长度维度扩展方法应用到100B参数以上的MoE模型。
与此同时,微信原生AI助手「小微」于今年6月进入小范围灰度测试,可通过文字或语音操作微信原生功能,并调用小程序完成服务任务。微信开放平台已开始允许小程序接入微信AI生态,部分行业反馈显示,「小微」主模型为微信自研WeLM,部分回答会调用DeepSeek。
腾讯C端AI入口的双线竞争
腾讯内部两套大模型体系背后,指向C端AI入口之争。
混元体系拥有更集中的算力、数据与模型研发资源,由姚顺雨主导整合;WeLM则依托微信的原生入口、内容生态、小程序服务与真实用户反馈。今年年初上线的元宝派功能让两大体系在产品层出现交集——元宝派支持群聊总结、图片生成、共同娱乐等,传播资源可经由微信好友、群聊与朋友圈扩散。腾讯方面披露,截至今年2月18日,元宝日活超过5000万,月活达到1.14亿。但QuestMobile数据显示,红包活动结束后,元宝日活迅速回落,至今年3月独立App月活为5735万,未进入亿级AI应用阵营(仅豆包、千问、DeepSeek三款产品月活过亿)。
在混元之外,WeLM长期保留独立的语言模型与强化学习研发能力,也需要合成数据、奖励模型与后训练经验。徐灿过去数年积累的技术经验,恰好可以在这支团队中找到新的承接空间。知情人士透露,WeLM和混元团队此前已共享了部分算力资源分配,此次人才转岗进一步指向两套大模型研发体系在模型与产品层面的同步运转。
