价格计算器

在投入之前先估算你的 LLM API 成本

选择模型,输入每月 token 用量,设置缓存命中率。计算器基于 0.4 CNY / 1M token 的基准价,采用我们真实公布的倍率,无需注册。

这个计算器和拍脑袋估算有何不同

大多数成本估算都是信手一算。这个计算器用的是网关实际计费时所采用的同一套按模型倍率。

这个计算器粗略估算
费率来源实时公布的按模型倍率凭记忆或一篇博文
缓存建模可调缓存命中率,自 0.1x 下限起算通常被忽略
币种CNY,与你的实际计费一致USD/CNY 混用
模型覆盖网关路由的每一个文本模型仅一两个模型

适合谁用

如果你符合以下情况会很有用

  • 想在把流量迁移到某个模型之前,得到一个站得住脚的成本估算
  • 需要在相同用量下对比 0.5x 模型与前沿模型
  • 想了解更高的缓存命中率如何降低你的有效费率
  • 正在以 CNY 编制每月 LLM 支出预算

如果你符合以下情况则用处不大

  • 需要 USD 数字 —— 本计算器只按 CNY 计算
  • 按图片或按调用次数计费,而非按 token(这些条目已排除)
  • 想要一个有保障的报价 —— 实际用量取决于你的提示词与输出
  • 需要网关未路由模型的厂商原生定价

如何解读结果

计算简单透明,但估算终归是估算。

  • 成本 = 有效费率 × 你的 token 用量。有效费率按你的缓存命中百分比,将正常费率与缓存费率混合计算。
  • 缓存费率采用文档所述的模型倍率 0.1x 下限;真实的缓存节省取决于你的提示词复用程度。
  • token 数量需由你自行估算 —— 输入加输出。真实用量随提示词与回复长度而变化。
  • 图片与按调用计费的模型已排除,因为它们不按 token 计费。

数字背后的规则

这里没有任何隐藏内容。每个模型的费率都是其倍率乘以基准价。

基准费率0.4 CNY / 1M1x 倍率对应的费率;100M tokens = 40 CNY。
最便宜的模型0.5x0.20 CNY 每 1M tokens —— 文本模型中的最低档。
缓存下限0.1x缓存输入按正常每 token 费率的 10% 起算。
额度有效期永不过期预付额度不会过期,也不会清零。

这是基于公布费率与你的输入得出的估算,并非报价。实际成本取决于你工作负载中真实的 token 用量与缓存行为。

每 1M tokens 费率¥0.20
每 1M 有效费率¥0.20
预计每月成本¥20.00

仅为估算,基于公布倍率与你的输入。图片与按调用计费的模型已排除。

价格计算器 —— 常见问题

费率从何而来?

来自网关公布的按模型倍率,应用于 0.4 CNY / 1M token 的基准价。与定价页列出的是同一套规则。

缓存命中率有什么作用?

缓存输入按模型倍率的 0.1x 下限起算。提高缓存命中百分比会降低你的混合有效费率。

结果是有保障的价格吗?

不是。这是一个估算。你的真实成本取决于实际的输入与输出 token 数量,以及有多少输入被缓存。

为什么全部以 CNY 计价?

因为计费与预付额度都以 CNY 计价。计算器与你实际被扣费的方式保持一致。

对估算结果满意吗?

购买密钥即可开始 —— 预付额度,永不过期。