开源
Ling-3.0 一次性公开 6 个基础权重检查点
AntLing 发布 Ling-3.0 完整 2 尺寸 × 3 阶段共 6 个基础 checkpoint,全部 MIT…
2026.08.21 · 周五约 2 分钟阅读
AntLing 近日一次性放出了 Ling-3.0 基础模型的全部六个权重检查点,按「2 种尺寸 × 3 个训练阶段」组合排列,全部以 MIT 协议开源、无访问限制。这是该模型基础层的完整矩阵式发布,而非单个端点的多版本拷贝。
发布矩阵:两尺寸、三阶段
本次公开的六个检查点可拆分为两条产品线:
- tiny:预训练(pretrained)、中训练(mid-trained)、WSM 合并(WSM-merged)
- flash:预训练、中训练、WSM 合并
每个检查点对应一个独立的官方仓库,六个仓库均可直接访问,许可证声明均为 MIT。需要强调的是:本次释放的内容全部为 base checkpoints,没有任何后训练阶段——也就是说,并不包含对话或指令微调版本。
定位与适用场景
官方将这些权重明确定位为「继续预训练、微调与研究」用途,而非可直接拿来聊天的即用模型。这与近期主流开源社区倾向于先释放 instruct 版本的节奏有所不同,更偏向研究者和基模型开发者。
对下游用户而言,释放矩阵的价值在于提供了多个训练节点的入口选择:
- 预训练阶段检查点:适合从较早期阶段继续训练或做长链路实验
- 中训练阶段检查点:适合在更接近收敛的权重基础上做适配
- WSM 合并端点:对应一次权重空间合并后的产物,适合希望直接使用合并后权重的场景
需要注意的边界
发布本身并未给出以下问题的答案,包括:不同阶段在常见下游任务上的对比表现、各阶段在量化后的质量变化、以及某一阶段是否在所有任务上最优。换言之,「base」在本项目中是一个「家族」而非单一制品,用户仍需根据自身场景自行评估。
总体来看,这是一次结构完整、授权清晰的开源基模型发布,对正在做基础模型训练与小规模继续预训练的社区有一定参考价值,但对终端对话应用开发者的直接意义有限。
