开源
Swiss AI 发布 Apertus 1.5 全开源多模态模型
Swiss AI 开源 Apertus 1.5 系列,8B 与 70B 双规格,首次支持图像与音频输入。
2026.07.24 · 周五约 2 分钟阅读
Swiss AI 在 Hugging Face 正式开源了 Apertus 1.5 系列大模型,包含 8B 与 70B 两种规格,主打完全开放的权重与训练数据,并首次引入图像与音频多模态输入能力。
模型规格与训练
Apertus 1.5 是在上一代 Apertus 1.0 基础上的继续预训练成果:8B 模型新增 4 万亿 token 训练数据,70B 模型新增 2 万亿 token。模型沿用原版的 decoder-only Transformer 架构,激活函数采用 xIELU,训练优化器为 AdEMAMix。上下文长度默认支持 262,144 token,较 Apertus 1.0 提升约四倍。
主要特性包括:
- 完全开放:开放权重、开放数据,并公开完整训练配方与数据细节
- 大规模多语言:覆盖多种语言
- 负责任训练:尽量尊重数据所有者的退出意愿(含追溯性退出),并加入防止训练数据被记忆的方法
- 长上下文:默认 262,144 token
多模态与推理能力
Apertus 1.5 是该系列首次原生支持多模态输入的版本,模型可接收图像、音频和文本作为输入,输出仍为文本,为开发者带来更丰富的应用场景。同时新增「思考模式」(thinking mode)开关,可在推理类任务上启用以获得更强的表现。
此外,改进的后训练流程显著提升了模型的指令遵循能力与工具调用稳定性,使其在外部 API 与工具集成场景下表现更可控。
后续计划
官方表示,详细的技术报告、benchmark 结果、训练流水线以及中间 checkpoint 将在未来几周内陆续发布,届时可对模型能力有更量化的评估。
模型权重已在 Hugging Face 开放下载:
- swiss-ai/Apertus-v1.5-70B
- swiss-ai/Apertus-v1.5-8B
