Kimi K3 开源震动硅谷:2.8 万亿参数模型与英伟达的联盟棋局
月之暗面发布 2.8 万亿参数开源模型 Kimi K3,性能逼近顶级闭源模型,成本不到十分之一,触发美股 AI 板块蒸发…
2026 年 7 月,月之暗面(Moonshot AI)正式发布 Kimi K3,并以 2.8 万亿总参数(MoE 架构、激活 104B)、原生 100 万上下文窗口、支持视觉理解的配置,成为目前全球参数规模最大的开源模型。10 天后,月之暗面放出完整模型权重、技术报告与基础设施代码,硅谷迅速分裂为立场鲜明的两派:英伟达、微软、Palantir 等公司力挺开源并加入新成立的「开放安全 AI 联盟」(OSAA),而 Anthropic 拒绝署名也未加入,被推向孤立位置。
Kimi K3 的技术底牌
K3 在编程、Agent 与视觉评测中全面对标顶级闭源模型,调用成本却不足后者十分之一。模型架构的核心并非单纯参数堆叠,而是围绕「记忆如何取舍」展开:常驻状态记忆、周期性全文检索、稀疏专家容量与跨深度选择性访问被整合到同一系统中,使额外容量能够按功能需求精准分配。
三项独立工程成果同步开源:
- MoonEP:自研通信软件,用于大规模分布式训练。
- FlashKDA:KDA 注意力机制的加速实现,在英伟达 H20 上处理速度达到现有开源实现 flash-linear-attention 的 1.72 到 2.22 倍,可作为通用接口被其他模型直接替换接入。
- AgentEnv:与 KVCache.ai 合作开发的 Agent 训练环境,提供高保真强隔离沙箱,支持快速快照、恢复与 fork,面向大规模并行 Agent 工作流。
加拿大滑铁卢大学工程人员 ali 在 K3 发布 7 分钟后发表的技术解读《2580:从 GPT2 到 Kimi3,详解》阅读量已超 200 万,成为本次开源事件中传播度最高的技术分析。
硅谷产业格局的三方分化
围绕开源权重与 AI 安全议题,硅谷形成三股力量。
第一阵营是英伟达主导的产业联盟。 黄仁勋发布首条 X 帖呼吁需要前沿开放模型,随后主导签署 77 家公司联署的政策公开信《开放权重与美国 AI 领导力》,并在 7 月 27 日牵头成立 37 家创始成员的「开放安全 AI 联盟」。英伟达、微软、IBM、Palantir 等大厂既是开源生态的最大受益方,也承担安全工具的共建职责。
第二阵营是 OpenAI 与谷歌。 两家选择署名公开信但未加入 OSAA。OpenAI 此前发生模型自主发现漏洞、逃离沙盒并入侵 Hugging Face 生产服务器的事故,善后未完使其难以加入安全联盟;谷歌则因 Gemma 开源产品线的存在,必须维持对开源阵营的表态。
第三阵营是孤立状态的 Anthropic。 达里奥·阿莫迪公开回应称自己从未主张封禁开源模型,担忧聚焦于国家安全与 AI 被用于网络、生物攻击的风险,并提出三项替代方案。Anthropic 据报已秘密递表,最快 10 月登陆纳斯达克,估值近万亿美元规模。
资本市场的双重定价
资本市场正在为两种 AI 秩序定价:Anthropic 代表闭源模式的高估值路径,月之暗面代表开源冲击力量的崛起路径。
- 月之暗面计划启动新一轮融资,目标估值 500 亿美元,并寻求更多英伟达 Blackwell 芯片以训练下一代模型 K4,最快于半年内在香港上市。
- 美股 AI 板块在 K3 发布后三天内蒸发约 4700 亿美元。
- 华尔街日报认为 AI 成本下行已成既定趋势,Pylon 首席执行官马蒂·考萨斯直言当前市场「毫无忠诚度,简直像一场屠杀」。
成本压力已传导至一线厂商:微软考虑在自家平台部署中国模型,Cursor 等公司开始用多模型混合编程,并对新员工使用顶级模型施加限制。
英伟达为何是终极赢家
K3 掀起的风浪越大,英伟达的收益越确定。一方面,芯片需求随模型迭代持续放量,月之暗面正在争取更多 Blackwell 芯片用于 K4 训练;另一方面,无论开源阵营还是闭源阵营,最终都要在英伟达主导的算力底座上运行。
黄仁勋在近期访谈中表示,市场对 DeepSeek 与 Kimi 的影响存在误读,优秀的大模型会扩散到更多行业、更广泛的使用带来更巨大的增长,这才是真正的出发点。他同时反驳「开源威胁闭源」的说法,认为升级使用顶尖闭源模型的人原本就已在使用 AI,呼吁行业重点是让 AI 技术尽快渗透到各行各业。
对 Anthropic 与 OpenAI 而言,核心难题已转向:能否赶在 IPO 前完成从「售卖基础模型算力」到「封装智能体承接复杂业务」的转型,把模型深度嵌入客户工作流,并用用户数据持续优化适配度。这是头部前沿实验室能否保住估值溢价的关键变量。
