Estima el coste de tu LLM API antes de comprometerte
Elige un modelo, introduce tu volumen mensual de tokens y fija una tasa de aciertos de caché. La calculadora usa nuestros multiplicadores reales publicados sobre una base de 0.4 CNY por 1M de tokens, sin registro.
En qué se diferencia esta calculadora de adivinar
La mayoría de las estimaciones de coste son cálculos al vuelo. Esta funciona con los mismos multiplicadores por modelo que la pasarela factura de verdad.
| Esta calculadora | Una estimación aproximada | |
|---|---|---|
| Fuente de la tarifa | Multiplicadores por modelo publicados en tiempo real | La memoria o una entrada de blog |
| Modelado de caché | Tasa de aciertos ajustable desde el suelo de 0.1x | Suele ignorarse |
| Moneda | CNY, igual que se te factura | Mezcla de USD/CNY |
| Cobertura de modelos | Cada modelo de texto que enruta la pasarela | Uno o dos modelos |
Para quién es
Útil si
- Quieres una estimación de coste defendible antes de mover tráfico a un modelo
- Necesitas comparar un modelo 0.5x con uno de frontera al mismo volumen
- Quieres ver cómo una tasa de aciertos de caché más alta reduce tu tarifa efectiva
- Estás presupuestando un gasto mensual de LLM en CNY
Menos útil si
- Necesitas cifras en USD: esta calculadora trabaja en CNY
- Facturas por imagen o por llamada en lugar de por token (esas filas se excluyen)
- Quieres un presupuesto garantizado: el uso real depende de tus prompts y salidas
- Necesitas el precio nativo del proveedor para un modelo que la pasarela no enruta
Cómo leer el resultado
El cálculo es simple y transparente, pero las estimaciones son estimaciones.
- Coste = tarifa efectiva × tu volumen de tokens. La tarifa efectiva combina la tarifa normal y la de caché según tu porcentaje de aciertos.
- La tarifa de caché usa el suelo documentado de 0.1x del multiplicador del modelo; el ahorro real depende de tu reutilización de prompts.
- Los recuentos de tokens los estimas tú: entrada más salida. El uso real varía con la longitud del prompt y la respuesta.
- Los modelos por imagen y por llamada se excluyen porque no se facturan por token.
La regla detrás de las cifras
Aquí no hay nada oculto. La tarifa de cada modelo es su multiplicador por la base.
Esto es una estimación basada en tarifas publicadas y tus datos, no un presupuesto. El coste real depende del uso real de tokens y del comportamiento de la caché en tu carga de trabajo.
Solo una estimación, basada en multiplicadores publicados y tus datos. Los modelos por imagen y por llamada se excluyen.
Calculadora de precios — Preguntas frecuentes
¿De dónde salen las tarifas?
De los multiplicadores por modelo publicados por la pasarela, aplicados a una base de 0.4 CNY por 1M de tokens. La misma regla que figura en la página de precios.
¿Qué hace la tasa de aciertos de caché?
La entrada en caché se factura desde el suelo de 0.1x del multiplicador del modelo. Subir el porcentaje de aciertos reduce tu tarifa efectiva combinada.
¿El resultado es un precio garantizado?
No. Es una estimación. Tu coste real depende del recuento real de tokens de entrada y salida y de cuánta entrada se almacena en caché.
¿Por qué todo está en CNY?
Porque la facturación y los créditos prepago están denominados en CNY. La calculadora coincide con lo que realmente se te cobra.
¿Conforme con la estimación?
Compra una clave y empieza: créditos prepago, sin caducidad.