小米 MiMo 两年逆袭,登顶全球大模型调用量榜首
OpenRouter 数据显示小米 MiMo-V2.5 以 10.5 万亿 Tokens 居全球调用量榜首,文章回顾其从…
OpenRouter 近日披露的全球大模型调用量榜单显示,前五名全部被中国大模型包揽,其中小米 MiMo-V2.5 以 10.5 万亿 Tokens 的单周调用量位居榜首。2026 年 7 月,其月度总调用量进一步攀升至 31.20 万亿 Tokens,成为全球月调用榜单的第一名。从 2024 年初立项的边缘项目,到登顶全球,小米 MiMo 仅用两年时间完成了一次行业罕见的逆袭。
战略转向:从辅助到核心
2023 年第一季度,正值 ChatGPT 引爆全球大模型浪潮、中国「百模大战」开启之际,小米集团合伙人兼总裁卢伟冰在分析师会议上明确表态:通用大模型不是小米未来的主赛道。雷军彼时也公开表示,小米内部一致决定不在大模型上追加重投入,将资源集中在新能源汽车这条更紧迫的战线上。
这一决策的背后是双重压力:
- 新能源汽车如同「吞金兽」,在 SU7 量产前夕已消耗小米逾 300 亿元现金;
- 大模型训练成本高企,OpenAI 单次训练投入已突破 10 亿美元。
因此,小米大模型 Core 团队在早期被定位为辅助角色,主要任务是升级小爱同学、为手机和音箱等硬件产品提供智能化能力,而非打造独立的通用大模型产品。
关键转折:业务重心重新排序
2024 年,小米 SU7 全年销量达 13.5 万辆,新能源汽车业务贡献 328 亿元营收,成为公司第三增长曲线。资金压力缓解的同时,DeepSeek 验证了「算法优先、低成本训练」的可行路径,让小米看到了弯道超车的机会。
雷军此后在直播中表示,将把更多精力投向 AI 领域,并将其作为小米生态的重要布局。2024 年小米在 AI 研发上投入约 70 亿元,并搭建了 GPU 万卡集群。2025 年 4 月,小米发布首款通用大模型 Xiaomi MiMo-70B,主打轻量化和易部署。然而由于参数规模仅 70 亿,该模型在开放式对话、长文档分析、多模态处理等通用场景中与一线厂商存在明显差距,市场反响不及预期。
产品跃迁:从 70B 到 3090B
2025 年下半年起,小米对 MiMo 路线做出关键调整:放弃单纯追求轻量化的差异化定位,转向与主流厂商正面竞争的「极致推理效率 + 高性价比」路线。
- 2025 年 12 月:推出 MiMo-V2-Flash,总参数量达 3090 亿,是 MiMo-70B 的约 44 倍,数学推理、编程能力、科学知识等指标追平行业第一梯队,发布后周调用量迅速升至全球第六;
- 2026 年 4 月:发布 MiMo-V2.5,单周调用量从 1.5 万亿 Tokens 一路涨至 10.5 万亿 Tokens,并在 7 月以 31.20 万亿 Tokens 的月度总量登顶全球。
小米方面透露,MiMo 系列模型的核心用户群体是独立个人开发者、三到五人规模的初创团队,以及专注 AI 编程与智能体工具开发的中小厂商,低廉的推理成本与稳定的智能体运行能力恰好契合这些场景的需求。
格局与挑战
沙利文发布的《中国 GenAI 市场洞察》报告显示,2025 年上半年国内大模型日均调用量同比增长 363%,突破 10 万亿 Tokens,其中阿里通义占 17.7%、字节豆包占 14.1%、DeepSeek 占 10.3%,前三名合计超过 40%。在这一格局下,MiMo 的快速崛起既反映了中小开发者对低成本模型的旺盛需求,也体现了小米在性价比路线上的执行力。
不过登顶并不意味着终局。DeepSeek、阿里通义、字节豆包等对手仍在持续迭代,大模型竞争的下半场将围绕持续降本、场景深耕与开发者生态展开。小米仍需用下一代产品证明,MiMo 的崛起是可复制的产品方法论,而非阶段性爆款。
