桃子桃子快讯
返回首页
开源

腾讯发布 Hy4 Preview:770B 参数开源大模型,支持百万级上下文

腾讯推出开源权重模型 Hy4 Preview,总参数 770B、激活 49B,上下文窗口达 100 万 token,权重…

2026.08.30 · 周日3 分钟阅读

中国互联网巨头腾讯于近日通过 Hugging Face 开源发布了其新一代大语言模型 Hy4 Preview,这是继今年 7 月 Hy3 之后的一次大幅规模升级,也是当前中文开源生态中参数量最大的稠密-MoE 混合架构模型之一。

模型规模与架构

Hy4 Preview 是一款纯文本输入(不含视觉模态)的开源权重大模型,关键参数如下:

  • 总参数:770B
  • 激活参数:49B
  • 上下文窗口:1,000,000 token
  • 权重体积:1.56 TB(Hugging Face)

作为对比,腾讯在 2025 年 7 月发布的上一代 Hy3 总参数为 295B、激活 21B、上下文仅 25.6 万 token、权重体积 598GB。Hy4 在三项核心指标上均实现了约 2 倍以上的跃升,尤其上下文窗口从 25.6 万提升到 100 万,是该模型最直观的能力升级。

推理模式与 chat 模板

Hy4 Preview 支持可配置的推理强度设置,模型在 Hugging Face 上发布的 chat_template.jinja 文件中明确了两个推理 effort 档位:

  • high:默认档位,启用完整推理
  • no_think:关闭推理

若调用方传入 reasoning_effort 为其他值或留空但未定义,模板会直接抛出异常,提示应使用 highno_think。这意味着腾讯在部署层面做了严格约束,避免出现非预期的推理行为。开发者可通过 OpenRouter 等第三方平台快速试用,运行时推理 trace 会以英文呈现并保留一定的截断风格,提示内部隐藏推理文本并未追求语法完美,更多为 token 效率服务。

实际体验与社区反响

Simon Willison 在拿到 OpenRouter 接口后,使用其经典提示词「Generate an SVG of a pelican riding a bicycle」对默认 high 推理档进行了测试。模型在推理阶段细致地权衡了是否添加头盔、墨镜、背景水景等额外元素,最终产出了符合要求的鹈鹕骑自行车 SVG 图。

这一测试反映出两点:

  • Hy4 的指令遵循与多轮自我修正能力达到主流水平
  • 默认开启的强推理模式使其在需要规划的生成任务(如 SVG、代码)中表现更稳

小结

腾讯选择以 Apache 风格的开源权重形式而非仅提供 API 接入,将 Hy4 Preview 直接推上 Hugging Face,对中文及全球开源社区意义明显。770B/49B 的 MoE 规模叠加 100 万 token 上下文,使其在长文档分析、代码库理解、多轮 Agent 等场景中具备较强竞争力。后续值得关注的指标包括 MMLU、HumanEval、LongBench 等基准表现,以及推理速度与显存占用等部署层面的实测数据。

信源