桃子桃子快讯
返回首页
工具

145 个 AI 模型价格一表对比:LLM / STT / TTS 全收录

开源项目 HAIL.SO/DISPATCH v0.2.0 收录 25 家厂商 145 个模型的定价与上下文窗口数据,涵盖…

2026.07.19 · 周日4 分钟阅读

2026 年 7 月,开源项目 HAIL.SO/DISPATCH 发布 v0.2.0 版本模型定价聚合表,统一收录并比对了来自 25 家厂商的 145 个模型,覆盖大语言模型(LLM)、语音转文字(STT)、文字转语音(TTS)以及短信(SMS)四大类别,所有数据均标注核验日期,并以 CC-BY-4.0 协议公开。

资源覆盖范围

表格按类别组织,核验日期统一为 2026-07-19:

  • 大语言模型:77 个,输出价格区间 $0.10 – $180.00 / 百万 token
  • STT 模型:37 个,价格区间 $0.000667 – $0.0170 / 分钟
  • TTS 模型:31 个,价格区间 $4 – $160 / 百万字符
  • SMS 服务:5 个,价格区间 $0.00400 – $0.00860 / 条
  • 数字订阅服务:105 个,月费 $1.00 – $135.00

每一行同时记录输入价、缓存命中价、上下文窗口与最大单次输出容量,便于横向比较。

LLM 定价分布

LLM 输出价格跨度高达 1800 倍。最便宜的是 Mistral 的 Ministral 3 3B($0.10 / Mtok),最贵的为 Claude Opus 系列($25 / Mtok)。中间档位的代表包括:

  • DeepSeek V3 / V4 Flash / R1:输出 $0.28,输入 $0.14,缓存价 $0.0028
  • GPT-5 nano:输出 $0.40,输入 $0.05,缓存价 $0.005
  • Gemini 2.5 Flash-Lite:输出 $0.40,输入 $0.10
  • Llama 4 Scout:输出 $0.59,输入 $0.18

旗舰档($10 / Mtok 输出)则汇集了 GPT-5、Gemini 2.5 Pro、GPT-4o、Claude Sonnet 5、Command A / R+ 等主流模型,反映出当前顶级模型定价高度趋同。

缓存折扣与上下文窗口

表格显式列出缓存命中价和上下文窗口,是该资源的另一亮点:

  • DeepSeek 系列以 $0.0028 / Mtok 的缓存价成为表中最低
  • GPT-4o 缓存价 $1.25 / Mtok,明显高于其他高端模型
  • 上下文窗口最大的是 Llama 4 Scout,达 10,485,760 token(约 1000 万)
  • 多数旗舰模型上下文为 1,000,000 – 1,050,000 token,包括 GPT-5.6 Luna、GPT-5.6 Terra、Gemini 3.1 Pro Preview、Claude Sonnet 4.6/5、Claude Opus 4.7/4.8、Grok 4.20 系列
  • 小模型上下文普遍偏小,如 Mistral Small 3 仅 32,768 token

xAI 与多档位产品

xAI 的 Grok 系列被拆分为多个版本,价格梯度细致:

  • Grok Code Fast 1:$1.50 / Mtok
  • Grok Build 0.1:$2.00 / Mtok
  • Grok 4.3 / 4.20 系列:$2.50,区分 Reasoning、Non-Reasoning 与 Multi-Agent
  • Grok 4.5:$6.00
  • Grok 4 / 3:$15.00

其中 Grok 4.3 与 4.20 系列上下文达到 1,000,000 token,输出上限也同步为 1,000,000 token。

使用建议

该资源以结构化表格方式呈现定价与上下文参数,可直接用于成本估算与厂商比价。所有数据均来自厂商公开定价页面并附核验日期。需要注意的是,模型定价变化较快,建议使用时关注对应核验日期,并以官网最新报价为准。

信源