桃子桃子快讯
返回首页
模型发布

Together AI 发布 Inkling-Small:276B 总参数 MoE,多模态推理

Together AI 在 X 平台公布 Inkling-Small 模型,采用 276B 总参数 / 12B 激活的…

2026.07.31 · 周五2 分钟阅读

Together AI 在 X 平台公布了一款名为 Inkling-Small 的新模型,主打「以更低成本提供旗舰级推理能力」。官方以要点形式披露了该模型的核心参数与性能定位,信息来源为 Together AI 官方账号一手发布。

核心架构与参数

Inkling-Small 采用 MoE(混合专家)架构,总参数规模为 276B,单次推理激活参数为 12B。这意味着模型在保持较大知识容量的同时,单次前向计算仅调用约 4% 的参数,旨在兼顾能力与推理成本。

多模态与长上下文

  • 支持文本、图像、音频的原生跨模态推理,模型在输入层面即按多模态融合处理,而非简单的模态拼接。
  • 上下文长度最高可达 1M tokens,并支持「可变思考强度」(variable thinking effort),允许调用方根据任务复杂度动态调整推理深度。

性能与成本定位

官方声称 Inkling-Small 在 Terminal-Bench 2.1 基准上可达到旗舰级 Inkling 同等表现,成本约为后者的五分之一。该基准聚焦终端 / 代理任务(agentic tasks),常用于衡量模型在真实命令执行场景中的能力。

信息限度与待观察点

截至目前,Together AI 仅在 X 平台发布了上述要点,尚未公开技术报告、完整 benchmark 对比表格、训练数据来源或开放 / 商用许可安排。是否提供开源权重、API 接入方式及定价细节尚未明确。对于关注该模型的开发者而言,建议持续关注 Together AI 后续的官方文档与发布说明。

信源