Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Preisrechner

Schätze deine LLM-API-Kosten, bevor du dich festlegst

Wähle ein Modell, gib dein monatliches Token-Volumen ein und lege eine Cache-Trefferquote fest. Der Rechner nutzt unsere realen veröffentlichten Multiplikatoren auf einer Basis von 0.4 CNY pro 1M Token, ohne Anmeldung.

Wie sich dieser Rechner vom Raten unterscheidet

Die meisten Kostenschätzungen sind über den Daumen gepeilt. Dieser läuft mit denselben Multiplikatoren pro Modell, die das Gateway tatsächlich abrechnet.

Dieser RechnerEine grobe Schätzung
TarifquelleLive veröffentlichte Multiplikatoren pro ModellGedächtnis oder ein Blogbeitrag
Cache-ModellierungAnpassbare Cache-Trefferquote ab der 0.1x-UntergrenzeMeist ignoriert
WährungCNY, genau wie dir abgerechnet wirdMischung aus USD/CNY
ModellabdeckungJedes Textmodell, das das Gateway routetEin oder zwei Modelle

Für wen das gedacht ist

Nützlich, wenn du

  • Eine belastbare Kostenschätzung willst, bevor du Traffic auf ein Modell verlagerst
  • Ein 0.5x-Modell mit einem Frontier-Modell beim gleichen Volumen vergleichen musst
  • Sehen willst, wie eine höhere Cache-Trefferquote deinen effektiven Tarif senkt
  • Eine monatliche LLM-Ausgabe in CNY budgetierst

Weniger nützlich, wenn du

  • Zahlen in USD brauchst, dieser Rechner arbeitet in CNY
  • Pro Bild oder pro Aufruf statt pro Token abrechnest (diese Zeilen sind ausgeschlossen)
  • Ein garantiertes Angebot willst, die echte Nutzung hängt von deinen Prompts und Ausgaben ab
  • Den anbietereigenen Preis für ein Modell brauchst, das das Gateway nicht routet

So liest du das Ergebnis

Die Rechnung ist einfach und transparent, aber Schätzungen bleiben Schätzungen.

  • Kosten = effektiver Tarif × dein Token-Volumen. Der effektive Tarif mischt Normal- und Cache-Tarif nach deinem Cache-Trefferprozentsatz.
  • Der Cache-Tarif nutzt die dokumentierte 0.1x-Untergrenze des Modell-Multiplikators; die echte Cache-Ersparnis hängt von deiner Prompt-Wiederverwendung ab.
  • Die Token-Zahlen schätzt du selbst: Eingabe plus Ausgabe. Die echte Nutzung variiert mit der Länge von Prompt und Antwort.
  • Modelle pro Bild und pro Aufruf sind ausgeschlossen, da sie nicht pro Token abgerechnet werden.

Die Regel hinter den Zahlen

Hier ist nichts versteckt. Der Tarif jedes Modells ist sein Multiplikator mal die Basis.

Basistarif0.4 CNY / 1MDer Tarif des 1x-Multiplikators; 100M tokens = 40 CNY.
Günstigste Modelle0.5x0.20 CNY pro 1M Token, die niedrigste Textmodell-Stufe.
Cache-Untergrenze0.1xGecachte Eingabe wird ab 10% des normalen Tarifs pro Token berechnet.
Guthaben-AblaufNieVorausbezahltes Guthaben verfällt nicht und wird nicht zurückgesetzt.

Dies ist eine Schätzung auf Basis veröffentlichter Tarife und deiner Eingaben, kein Angebot. Die echten Kosten hängen von der realen Token-Nutzung und dem Cache-Verhalten deiner Workload ab.

Tarif pro 1M Token¥0.20
Effektiver Tarif pro 1M¥0.20
Geschätzte monatliche Kosten¥20.00

Nur eine Schätzung, basierend auf veröffentlichten Multiplikatoren und deinen Eingaben. Modelle pro Bild und pro Aufruf sind ausgeschlossen.

Preisrechner — FAQ

Woher kommen die Tarife?

Aus den vom Gateway veröffentlichten Multiplikatoren pro Modell, angewendet auf eine Basis von 0.4 CNY pro 1M Token. Dieselbe Regel, die die Preisseite auflistet.

Was bewirkt die Cache-Trefferquote?

Gecachte Eingabe wird ab der 0.1x-Untergrenze des Modell-Multiplikators berechnet. Ein höherer Cache-Trefferprozentsatz senkt deinen gemischten effektiven Tarif.

Ist das Ergebnis ein garantierter Preis?

Nein. Es ist eine Schätzung. Deine echten Kosten hängen von der tatsächlichen Anzahl der Eingabe- und Ausgabe-Token ab und davon, wie viel der Eingabe gecacht wird.

Warum ist alles in CNY?

Weil Abrechnung und vorausbezahltes Guthaben in CNY ausgewiesen sind. Der Rechner entspricht dem, was dir tatsächlich berechnet wird.

Zufrieden mit der Schätzung?

Kauf einen Schlüssel und leg los: vorausbezahltes Guthaben, kein Ablauf.