阿里Qwen3.8-Max预览版发布:2.4万亿参数旗舰重回开源
阿里发布2.4万亿参数MoE旗舰模型Qwen3.8-Max预览版,采用日更模式并承诺开源,林俊旸离职140天后Qwen系…
7月19日傍晚,在Kimi K3炸榜2天后,阿里云正式发布Qwen3.8-Max预览版。这款旗舰模型以「预览版+日更模式」亮相,承诺以天为单位持续进化。预览版期间定价大幅折扣:白天调用1折,夜间低至0.2折。
模型规格与官方数据
Qwen3.8-Max总参数量达2.4万亿,采用MoE架构,是阿里首次突破万亿参数的原生多模态模型。官方数据显示,在代码工程和协同办公两大核心场景中,预览版相较前代Qwen3.7-Max分别提升22.8%和44.4%。模型宣称在全栈开发、数据分析、Office办公工作流等复杂长程任务中具备领先的综合能力。
实际测试表现参差不齐
在办公场景测试中,Qwen3.8-Max预览版对《具身智能发展报告(2025年)》提出的三道问题均能在约10秒思考后给出清晰答案并辅以表格展示。但在生成宇宙星系介绍HTML页面时,出现了行星公转速度一致、相对位置不变等常识性错误。
独立开发者反馈显示,模型在长任务执行时表现尚可——一位开发者在清晰列出功能模块、交互逻辑与页面结构后,用其生成的昆虫科普网站效果接近BBC纪录片水平,整体耗时约17分钟,远低于同类任务的Kimi K3(52分钟)。但在30分钟级别的连续推理或大规模代码生成任务中,Qwen3.8-Max预览版的稳定性「还差口气」。
综合评估,当前游戏功能代码生成与基于MCP协议的工具调用控制方面,GPT-5.6 Sol处于第一梯队;Kimi K3与GLM 5.2为第二梯队;Qwen3.8-Max预览版则再降一档,核心竞争力集中在上下文窗口容量、单位调用成本及响应延迟的平衡,适合高频辅助开发场景。
林俊旸离职140天后的路线回归
Qwen3系列是林俊旸在职期间主导的大模型,Qwen3.5是其离开前发布的最后一个版本。据《晚点LatePost》报道,阿里内部有高管对除夕夜发布的Qwen3.5并不满意,甚至称之为「半成品」。林俊旸坚持开源,后因阿里组织架构调整离开。
林俊旸离职后的一周内,阿里在3月30日至4月2日间连续发布Qwen3.5-Omni、Wan2.7-Image和Qwen3.6-Plus三款模型,且全部闭源,与Qwen系列过去「开源优先」的传统形成鲜明对比。此番Qwen3.8-Max预览版明确承诺开源,标志着阿里旗舰大模型再次回归开源路线。
三次组织架构调整的内在逻辑
林俊旸离开后,通义实验室经历三次重大调整:
- 3月:成立ATH事业群(Alibaba Token Hub),由吴泳铭亲自带队,确立「Token生产、分发和变现」核心战略。
- 4月:设立集团技术委员会,吴泳铭任组长、周靖人任首席AI架构师,通义实验室升级为通义大模型事业部。
- 6月:将通义大模型事业部与未来生活实验室合并,成立Token Foundry事业部,周靖人转任集团首席科学家。
三次调整的核心主线,是将AI业务从「技术驱动」逐步改造为「商业化驱动」的Token工厂。7月22日,「阿里云开发者」公众号正式更名为「千问AI平台」,将Qwen开发者生态从依赖个人魅力维系的开源互动,转移至阿里官方直接运营的标准化平台。
商业化压力与开源博弈
阿里2026财年第四季度财报显示,AI相关产品在阿里云外部收入中占比首次突破30%,达89.71亿元,ARR超358亿元,绝大部分来自百炼MaaS平台的API收入。当「卖Token」成为最大收入来源时,结构性矛盾随之浮现:开源旗舰模型在API付费墙之外搭建了免费替代品,每一个能本地部署Qwen的开发者,都天然减少付费API调用需求。
过去一年,阿里并未推出Qwen4这样的跨代基座版本,主要聚焦推理性能微调与长文本能力优化。相比之下,Claude一年内完成3.5到4.0再到4.5的跨越,Gemini发布1.5改进版、2.0、2.5三代,Llama不到一年从3.3跨至4.1且保持开源。在全球大模型进入按周迭代的竞速期,Kimi K3发布仅3天后阿里即推出Qwen3.8-Max预览版,被外界视为抢占窗口期的关键动作。
行业背景:开源与闭源力量对比逆转
Mozilla《开源AI现状报告》显示,开源模型与闭源模型的平均性能差距已缩至3.3%,在编码、指令执行等核心能力上已基本持平。OpenRouter数据显示,开源模型处理的Token占比从2026年1月的34%飙升至6月的65%,全球API调用月消耗量前五名已全部被开源模型包揽。中国大模型在全球调用量中连续十一周领跑,开源模型下载量占比达41%。
在这一背景下,Qwen3.8-Max预览版选择回归开源,既是阿里经历内部路线分歧后的战略回调,也是在当下激烈市场竞争中做出的商业选择。
