Estimez le coût de votre LLM API avant de vous engager
Choisissez un modèle, saisissez votre volume mensuel de tokens et fixez un taux de cache. Le calculateur utilise nos multiplicateurs réels publiés sur une base de 0.4 CNY par 1M de tokens, sans inscription.
En quoi ce calculateur diffère d'une simple estimation
La plupart des estimations de coût se font au doigt mouillé. Celui-ci s'appuie sur les mêmes multiplicateurs par modèle que la passerelle facture réellement.
| Ce calculateur | Une estimation grossière | |
|---|---|---|
| Source du tarif | Multiplicateurs par modèle publiés en direct | La mémoire ou un article de blog |
| Modélisation du cache | Taux de cache ajustable à partir du plancher de 0.1x | Souvent ignorée |
| Devise | CNY, comme on vous facture | Mélange USD/CNY |
| Couverture des modèles | Chaque modèle texte que la passerelle route | Un ou deux modèles |
À qui cela s'adresse
Utile si vous
- Voulez une estimation de coût défendable avant de basculer du trafic vers un modèle
- Devez comparer un modèle 0.5x à un modèle de pointe sur le même volume
- Voulez voir comment un taux de cache plus élevé abaisse votre tarif effectif
- Budgétez une dépense LLM mensuelle en CNY
Moins utile si vous
- Avez besoin de chiffres en USD : ce calculateur travaille en CNY
- Facturez par image ou par appel plutôt que par token (ces lignes sont exclues)
- Voulez un devis garanti : l'usage réel dépend de vos prompts et de vos sorties
- Avez besoin du tarif natif du fournisseur pour un modèle que la passerelle ne route pas
Comment lire le résultat
Le calcul est simple et transparent, mais une estimation reste une estimation.
- Coût = tarif effectif × votre volume de tokens. Le tarif effectif mélange le tarif normal et celui du cache selon votre pourcentage de cache.
- Le tarif de cache utilise le plancher documenté de 0.1x du multiplicateur du modèle ; l'économie réelle dépend de la réutilisation de vos prompts.
- Le nombre de tokens, c'est à vous de l'estimer : entrée plus sortie. L'usage réel varie avec la longueur du prompt et de la réponse.
- Les modèles par image et par appel sont exclus car ils ne sont pas facturés au token.
La règle derrière les chiffres
Rien n'est caché ici. Le tarif de chaque modèle est son multiplicateur fois la base.
Ceci est une estimation fondée sur les tarifs publiés et vos données, pas un devis. Le coût réel dépend de l'usage réel des tokens et du comportement du cache dans votre charge de travail.
Estimation seulement, fondée sur les multiplicateurs publiés et vos données. Les modèles par image et par appel sont exclus.
Calculateur de prix — FAQ
D'où viennent les tarifs ?
Des multiplicateurs par modèle publiés par la passerelle, appliqués à une base de 0.4 CNY par 1M de tokens. La même règle que celle listée sur la page des prix.
À quoi sert le taux de cache ?
L'entrée en cache est facturée à partir du plancher de 0.1x du multiplicateur du modèle. Augmenter le pourcentage de cache abaisse votre tarif effectif mélangé.
Le résultat est-il un prix garanti ?
Non. C'est une estimation. Votre coût réel dépend du nombre réel de tokens en entrée et en sortie et de la part de l'entrée mise en cache.
Pourquoi tout est-il en CNY ?
Parce que la facturation et les crédits prépayés sont libellés en CNY. Le calculateur reflète la façon dont on vous facture réellement.
Satisfait de l'estimation ?
Achetez une clé et démarrez : crédits prépayés, sans expiration.