开源
AMD 上线开源 MoE 模型 Instella-16B-A3B
AMD 在 HuggingFace 发布 Instella-MoE-16B-A3B 及其 Think 推理版本,正式加入…
2026.07.25 · 周六约 2 分钟阅读
AMD 近日在 HuggingFace 平台上线了 Instella-MoE-16B-A3B 模型,并同步推出其推理版本 Instella-MoE-16B-A3B-Think。这是从社区发现并分享的消息,模型由 AMD 官方账号(amd)上传,距公开约一天时间,标志着这家 GPU 芯片厂商正式进入开源大模型赛道。
模型基本信息
- 名称:Instella-MoE-16B-A3B(另有 Think 推理变体)
- 架构:MoE(混合专家),总参数约 16B,激活参数约 3B
- 发布平台:HuggingFace(amd 组织下)
- 同步上线「Think」版本,命名暗示面向推理 / 长链路思考场景
发布背景
Instella 是 AMD 自研的开源大模型系列。在此之前,AMD 在 AI 软件生态上的动作主要集中在 ROCm、GPU 适配等基础设施层面,自研开源模型的声量相对有限。此次直接在 HuggingFace 上以官方名义挂出 MoE 权重,被视为 AMD 软硬件协同布局的一次延伸。
行业意义
- AMD 作为主流 GPU 供应商推出原生模型,为其硬件用户提供官方参考实现
- 进一步丰富开源社区在 MoE 架构上的可选权重
- 与 NVIDIA、Intel 等在「芯片厂商自研模型」赛道形成呼应
待观察
- 当前社区尚未公布独立基准测试结果,性能定位仍不清晰
- Think 版本是否提供完整推理链路、长上下文支持等细节,暂无公开说明
- 是否配套发布技术报告、训练数据说明与许可协议,需要查阅 HuggingFace 模型卡确认
- 与同期主流开源 MoE(如 DeepSeek、Qwen3 MoE 系列)的实际对比尚未出炉
目前该模型尚处于「被发现」阶段,后续是否被主流社区采纳,关键取决于实测质量、推理吞吐与 AMD ROCm 生态下的部署友好度。
