Kimi K3 开放权重,Anthropic 澄清开源立场
月之暗面开放 Kimi K3 模型权重,Anthropic 否认主张禁止开放权重,开放权重政策之争持续升温。
北京时间 7 月 27 日晚,月之暗面(Moonshot AI)正式开放了旗舰模型 Kimi K3 的模型权重、技术报告及关键基础设施细节。几乎同一时间,Anthropic 联合创始人兼 CEO Dario Amodei 发布长文,对近期围绕开放权重模型的讨论做出回应,并明确表示:「Anthropic 从未主张禁止开放权重模型。」
Anthropic 的三条政策主张
Amodei 在回应中重申了自己长期关注的两类风险:一是其他国家可能开发出比美国更强大的 AI 模型,并由此获得军事或压制性优势;二是强大的开放权重模型一旦泄露,将难以收回,且更难设置有效的安全护栏。但他同时强调:「禁止美国企业使用这些模型并不能解决风险,因为恶意行为者本来就不太可能是合法经营的美国企业。这样的禁令或许可以保护美国 AI 公司免受竞争,但这从来不是我的目标。」
在此基础上,Amodei 给出三项政策建议:
- 不向中国出售高性能芯片或制造设备,并打击规避行为;
- 打击工业规模的模型蒸馏活动;
- 所有能力足够强的模型,无论开放还是闭源,都应接受强制性安全测试,且测试须在全球范围内执行。
他特别补充:「全面禁止开放权重模型既不是正确的解决办法,也不是我们曾经主张过的措施。」
「Open Weights and American AI Leadership」公开信
此次表态的背景,是 7 月 24 日黄仁勋在 X 上首度发帖并转发的开放权重公开信。该信呼吁美国政府不要限制可下载的 AI 模型,理由是开放权重可降低供应商锁定风险,提升企业对模型、数据与基础设施的控制权。
公开信首批签署方为 25 家企业,随后迅速扩容:
- 首批 25 家签署;
- 一日内扩至约 50 家,新增 OpenAI、Google、AMD、Cisco、Cloudflare、GitHub、Block、Ollama 等;
- 截至发稿已达 77 家。
值得注意的是,Anthropic 与其最大投资方之一 Amazon 均未出现在签署名单中,两家公司尚未解释缺席原因。Amodei 表示认同公开信中关于竞争与客户控制权的部分观点,但不认同「开放权重模型必然更有利于安全防护」等论述。
Kimi K3 的开源与部署门槛
Kimi K3 此次开源引发广泛关注。模型文件约 1.56 TB,总参数 2.8T,每次生成仅激活约 104B 参数,采用 MXFP4 格式与混合专家架构,共 896 个专家,每个 Token 选择其中 16 个参与计算。月之暗面同步公布的开源许可允许个人开发者与普通企业免费使用、部署、微调及商业化 K3,但针对大型商业使用设有门槛:若企业通过 API 对外提供 K3 推理或微调服务,且企业及关联方任意连续 12 个月总收入超过 2000 万美元,须另行签署协议。
随着参数规模进入「T 级」,K3 的部署门槛也大幅抬升。根据 AMD 与 vLLM 已验证的方案,公开配置中成本最低的部署方式是 8 张 MI355X 加速卡,单卡 288GB HBM 显存,8 卡合计约 2.304TB,硬件成本估算约 170 万至 240 万元人民币,但该配置仅能「把模型加载起来」,首日测试最大上下文仅为 16K。其他可选方案包括:
- 16 张 H200:约 435 万–570 万元,需跨两台服务器;
- 16 张 B200:约 540 万–680 万元,需跨两台服务器;
- 24 张 H100:约 1.92TB 显存,运行余量较小,云租赁年成本或超 870 万元。
Kimi 官方技术文章建议的「64 张以上、同一高速互联域」部署方案,按 8 卡服务器计需 8 台,硬件投入约 1360 万至 1900 万元;若使用云资源,按 Vultr 价格估算年成本可达 986 万元,电力开销亦接近百万元。这意味着对于绝大多数普通企业与个人开发者而言,「能够下载权重」与「能够提供生产级服务」是截然不同的两件事,直接调用 API 仍是更现实的选择。
T 级开放权重模型的到来,正在改变「开源模型能够普惠本地部署」的传统认知——它更可能成为大型云服务商、头部互联网企业、科研机构乃至国家级 AI 基础设施的基座,并通过围绕模型构建的工具与生态,逐步演变为「事实上的标准」。
