韩国 Upstage 开源 Solar Open 2:250B 总参数 / 15B 激活
韩国 AI 公司 Upstage 发布开源权重模型 Solar Open 2,采用 250B 总参数 / 15B 激活的…
韩国 AI 公司 Upstage 近日在 Hugging Face 上发布了开源权重模型 Solar Open 2,提供 250B 总参数 / 15B 激活参数的规格,在 r/LocalLLaMA 等社区引发关注与讨论。这是 Upstage 在开源大模型领域的又一次重要动作,也使得韩国在大模型开源生态中占据了一席之地。
模型基本信息
Solar Open 2 采用 Mixture of Experts(MoE)架构,总参数量达到 250B,但每次推理仅激活约 15B 参数。这种「以大带小」的设计旨在兼顾模型容量与推理效率,是当前主流大模型(如 Mixtral、DeepSeek、Qwen 等)常见的架构选择。模型权重已在 Hugging Face 平台开源,仓库地址为 upstage/Solar-Open2-250B。
社区关注焦点
原帖发起者将其定位为 DeepSeek「V4 Flash」的潜在对标产品,并希望了解二者在同尺寸、同激活参数规模下的表现差异。需要指出的是,DeepSeek 目前并未发布名为「V4 Flash」的模型,社区讨论中涉及的对照对象应为 DeepSeek V3 系列中的轻量化版本(如 DeepSeek-V3-Flash 或同类蒸馏版本)。这一表述偏差也反映出该帖更多是社区用户自发组织的初步信息收集,而非系统性的模型评测。
韩国开源生态背景
Upstage 总部位于首尔,专注于企业级大模型与文档智能(Document AI)解决方案,此前已发布过 Solar 系列多个版本。Solar Open 2 的开源发布意味着韩国厂商正在加速参与全球开源大模型竞争,与中国的 DeepSeek、阿里 Qwen、智谱 GLM 等形成更丰富的开源生态格局。对于关注非英语市场大模型发展的开发者和研究者而言,该模型提供了一个新的可选基座。
评测尚待补充
截至原帖发布时,社区尚未形成系统性的对比评测结论。对于希望实际部署该模型的用户而言,显存占用、推理吞吐量、中文与英文能力、多轮对话稳定性等指标仍有待进一步基准测试验证。
