桃子桃子快讯
返回首页
产品功能

Qwen3.8-Flash 上线 Qwen Cloud,公布输入输出与缓存命中价格

通义千问在 Qwen Cloud 上推出 Qwen3.8-Flash 模型,输入 $0.15/1M、输出 $0.47/1…

2026.08.27 · 周四2 分钟阅读

阿里通义千问通过官方 X 账号宣布,旗下 Qwen3.8-Flash 模型已在 Qwen Cloud 开放调用,并同步公布了三档与 token 用量相关的费率。这是该模型在通义自家云平台上首次给出明确的对外计价信息。

价格结构

根据官方披露,Qwen3.8-Flash 的计费分为以下三类:

  • 输入 tokens:$0.15 / 1M
  • 输出 tokens:$0.47 / 1M
  • 缓存命中(cache hits):$0.016 / 1M

输出与输入之间的价差约为 3.1 倍,缓存命中价格相对输入价格压缩至约一成,适合多轮对话、批量请求等存在大量上下文复用的场景。

定位与背景

Qwen3.8-Flash 属于 Qwen 系列的轻量级(Flash)档位,主打低成本、低延迟。在 Qwen Cloud 体系中,Flash 档通常承担高频调用、长上下文处理以及与 Plus / Max 等更高档模型搭配使用的角色。官方在贴文中并未同时披露上下文窗口长度、模型规模、最大输出长度等关键参数,也未给出与同档位其他模型的横向 benchmark 对比。

信息边界

本次公告仅以一条社交媒体贴文形式发布,缺乏以下配套信息:

  • 模型具体参数量与架构信息
  • 支持的模态(文本 / 多模态 / 工具调用等)
  • 与 Qwen3 系列其他版本的差异说明
  • 可用区域、速率限制与企业级 SLA

读者如需将 Qwen3.8-Flash 用于生产环境,建议进一步参考 Qwen Cloud 官方文档与控制台计价页面以确认细节。

小结

总体来看,Qwen3.8-Flash 在 Qwen Cloud 的定价属常规产品迭代层面,发布渠道为官方一手,但公告本身信息颗粒度较粗,适合作为关注通义云服务定价的用户做初步参考,尚不足以支撑对该模型能力的全面判断。

信源