Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Calculateur de prix

Estimez le coût de votre LLM API avant de vous engager

Choisissez un modèle, saisissez votre volume mensuel de tokens et fixez un taux de cache. Le calculateur utilise nos multiplicateurs réels publiés sur une base de 0.4 CNY par 1M de tokens, sans inscription.

En quoi ce calculateur diffère d'une simple estimation

La plupart des estimations de coût se font au doigt mouillé. Celui-ci s'appuie sur les mêmes multiplicateurs par modèle que la passerelle facture réellement.

Ce calculateurUne estimation grossière
Source du tarifMultiplicateurs par modèle publiés en directLa mémoire ou un article de blog
Modélisation du cacheTaux de cache ajustable à partir du plancher de 0.1xSouvent ignorée
DeviseCNY, comme on vous factureMélange USD/CNY
Couverture des modèlesChaque modèle texte que la passerelle routeUn ou deux modèles

À qui cela s'adresse

Utile si vous

  • Voulez une estimation de coût défendable avant de basculer du trafic vers un modèle
  • Devez comparer un modèle 0.5x à un modèle de pointe sur le même volume
  • Voulez voir comment un taux de cache plus élevé abaisse votre tarif effectif
  • Budgétez une dépense LLM mensuelle en CNY

Moins utile si vous

  • Avez besoin de chiffres en USD : ce calculateur travaille en CNY
  • Facturez par image ou par appel plutôt que par token (ces lignes sont exclues)
  • Voulez un devis garanti : l'usage réel dépend de vos prompts et de vos sorties
  • Avez besoin du tarif natif du fournisseur pour un modèle que la passerelle ne route pas

Comment lire le résultat

Le calcul est simple et transparent, mais une estimation reste une estimation.

  • Coût = tarif effectif × votre volume de tokens. Le tarif effectif mélange le tarif normal et celui du cache selon votre pourcentage de cache.
  • Le tarif de cache utilise le plancher documenté de 0.1x du multiplicateur du modèle ; l'économie réelle dépend de la réutilisation de vos prompts.
  • Le nombre de tokens, c'est à vous de l'estimer : entrée plus sortie. L'usage réel varie avec la longueur du prompt et de la réponse.
  • Les modèles par image et par appel sont exclus car ils ne sont pas facturés au token.

La règle derrière les chiffres

Rien n'est caché ici. Le tarif de chaque modèle est son multiplicateur fois la base.

Tarif de base0.4 CNY / 1MLe tarif du multiplicateur 1x ; 100M tokens = 40 CNY.
Modèles les moins chers0.5x0.20 CNY par 1M de tokens : le palier texte le plus bas.
Plancher de cache0.1xL'entrée en cache est facturée à partir de 10% du tarif normal par token.
Expiration du créditJamaisLes crédits prépayés n'expirent pas et ne sont pas réinitialisés.

Ceci est une estimation fondée sur les tarifs publiés et vos données, pas un devis. Le coût réel dépend de l'usage réel des tokens et du comportement du cache dans votre charge de travail.

Tarif par 1M de tokens¥0.20
Tarif effectif par 1M¥0.20
Coût mensuel estimé¥20.00

Estimation seulement, fondée sur les multiplicateurs publiés et vos données. Les modèles par image et par appel sont exclus.

Calculateur de prix — FAQ

D'où viennent les tarifs ?

Des multiplicateurs par modèle publiés par la passerelle, appliqués à une base de 0.4 CNY par 1M de tokens. La même règle que celle listée sur la page des prix.

À quoi sert le taux de cache ?

L'entrée en cache est facturée à partir du plancher de 0.1x du multiplicateur du modèle. Augmenter le pourcentage de cache abaisse votre tarif effectif mélangé.

Le résultat est-il un prix garanti ?

Non. C'est une estimation. Votre coût réel dépend du nombre réel de tokens en entrée et en sortie et de la part de l'entrée mise en cache.

Pourquoi tout est-il en CNY ?

Parce que la facturation et les crédits prépayés sont libellés en CNY. Le calculateur reflète la façon dont on vous facture réellement.

Satisfait de l'estimation ?

Achetez une clé et démarrez : crédits prépayés, sans expiration.