这个计算器和拍脑袋估算有何不同
大多数成本估算都是信手一算。这个计算器用的是网关实际计费时所采用的同一套按模型倍率。
| 这个计算器 | 粗略估算 | |
|---|---|---|
| 费率来源 | 实时公布的按模型倍率 | 凭记忆或一篇博文 |
| 缓存建模 | 可调缓存命中率,自 0.1x 下限起算 | 通常被忽略 |
| 币种 | CNY,与你的实际计费一致 | USD/CNY 混用 |
| 模型覆盖 | 网关路由的每一个文本模型 | 仅一两个模型 |
适合谁用
如果你符合以下情况会很有用
- 想在把流量迁移到某个模型之前,得到一个站得住脚的成本估算
- 需要在相同用量下对比 0.5x 模型与前沿模型
- 想了解更高的缓存命中率如何降低你的有效费率
- 正在以 CNY 编制每月 LLM 支出预算
如果你符合以下情况则用处不大
- 需要 USD 数字 —— 本计算器只按 CNY 计算
- 按图片或按调用次数计费,而非按 token(这些条目已排除)
- 想要一个有保障的报价 —— 实际用量取决于你的提示词与输出
- 需要网关未路由模型的厂商原生定价
如何解读结果
计算简单透明,但估算终归是估算。
- 成本 = 有效费率 × 你的 token 用量。有效费率按你的缓存命中百分比,将正常费率与缓存费率混合计算。
- 缓存费率采用文档所述的模型倍率 0.1x 下限;真实的缓存节省取决于你的提示词复用程度。
- token 数量需由你自行估算 —— 输入加输出。真实用量随提示词与回复长度而变化。
- 图片与按调用计费的模型已排除,因为它们不按 token 计费。
数字背后的规则
这里没有任何隐藏内容。每个模型的费率都是其倍率乘以基准价。
基准费率0.4 CNY / 1M1x 倍率对应的费率;100M tokens = 40 CNY。
最便宜的模型0.5x0.20 CNY 每 1M tokens —— 文本模型中的最低档。
缓存下限0.1x缓存输入按正常每 token 费率的 10% 起算。
额度有效期永不过期预付额度不会过期,也不会清零。
这是基于公布费率与你的输入得出的估算,并非报价。实际成本取决于你工作负载中真实的 token 用量与缓存行为。
每 1M tokens 费率¥0.20
每 1M 有效费率¥0.20
预计每月成本¥20.00
仅为估算,基于公布倍率与你的输入。图片与按调用计费的模型已排除。
价格计算器 —— 常见问题
费率从何而来?
来自网关公布的按模型倍率,应用于 0.4 CNY / 1M token 的基准价。与定价页列出的是同一套规则。
缓存命中率有什么作用?
缓存输入按模型倍率的 0.1x 下限起算。提高缓存命中百分比会降低你的混合有效费率。
结果是有保障的价格吗?
不是。这是一个估算。你的真实成本取决于实际的输入与输出 token 数量,以及有多少输入被缓存。
为什么全部以 CNY 计价?
因为计费与预付额度都以 CNY 计价。计算器与你实际被扣费的方式保持一致。
对估算结果满意吗?
购买密钥即可开始 —— 预付额度,永不过期。