桃子桃子快讯
返回首页
开源

IBM 发布 Granite 4.2 系列开源模型,主打内置推理与 512K 上下文

IBM 在 Hugging Face 开源 Granite 4.2 系列三款模型(3B/8B/30B),均内置思维链推理…

2026.08.25 · 周二3 分钟阅读

IBM 在 Hugging Face 平台正式开源 Granite 4.2 系列大语言模型,共包含 Granite-4.2-30B、Granite-4.2-8B 与 Granite-4.2-3B 三款权重,覆盖从紧凑到旗舰的不同部署场景。该系列主打内置推理能力,并支持 512K 超长上下文,三款模型均以 Apache 2.0 协议发布,可免费用于商业与研究用途。

模型矩阵与定位

Granite 4.2 系列按参数规模划分为三档:

  • Granite-4.2-30B:系列旗舰,针对推理密集型任务提供最强性能。
  • Granite-4.2-8B:中量级型号,在性能与部署成本之间取得平衡。
  • Granite-4.2-3B:紧凑型号,参数规模小,但保留同款推理能力,适合资源受限环境。

三款模型共享相同的核心能力与架构设计,用户可根据算力与延迟需求灵活选用。

核心能力

Granite 4.2 系列在功能层面统一具备以下特性:

  • 内置思维链推理:原生 chain-of-thought 机制,可显著提升数学、代码及多步复杂问题的表现。
  • 可切换思考模式:支持 full thinking(默认)、non-thinking 与 low-effort 三种模式,用户可在单次调用中按需权衡推理深度与响应延迟。
  • 推理增强的工具调用:模型会先推理「该调用哪个工具以及为什么」,再产出更准确的 function call。
  • 512K 上下文窗口:可处理长文档、多轮对话与复杂的智能体工作流。
  • Apache 2.0 许可:完全开放,允许商业与研究使用。

技术架构

Granite 4.2-30B 采用 decoder-only 密集 Transformer 架构,关键组件包括:

  • 注意力机制:Grouped Query Attention(GQA),32 个注意力头、8 个 KV 头。
  • 位置编码:RoPE,θ = 10,000,000。
  • 前馈网络:MLP + SwiGLU 激活,隐藏层维度 32768。
  • 归一化:RMSNorm,ε = 1e-5。
  • 词嵌入:输入与输出词嵌入分离(不共享权重)。
  • 精度:bfloat16。

8B 与 3B 版本沿用同一架构设计思路,以便在更小参数量下保持推理能力的一致性。

获取与许可

三款权重文件均已上传至 Hugging Face,仓库地址分别为:

  • ibm-granite/granite-4.2-30b
  • ibm-granite/granite-4.2-8b
  • ibm-granite/granite-4.2-3b

所有权重采用 Apache 2.0 协议发布,开发者可直接下载用于本地部署、微调或二次分发。需要注意的是,本次发布页面尚未公开具体 benchmark 数据,性能表现有待后续独立评测验证。

信源