Schätze deine LLM-API-Kosten, bevor du dich festlegst
Wähle ein Modell, gib dein monatliches Token-Volumen ein und lege eine Cache-Trefferquote fest. Der Rechner nutzt unsere realen veröffentlichten Multiplikatoren auf einer Basis von 0.4 CNY pro 1M Token, ohne Anmeldung.
Wie sich dieser Rechner vom Raten unterscheidet
Die meisten Kostenschätzungen sind über den Daumen gepeilt. Dieser läuft mit denselben Multiplikatoren pro Modell, die das Gateway tatsächlich abrechnet.
| Dieser Rechner | Eine grobe Schätzung | |
|---|---|---|
| Tarifquelle | Live veröffentlichte Multiplikatoren pro Modell | Gedächtnis oder ein Blogbeitrag |
| Cache-Modellierung | Anpassbare Cache-Trefferquote ab der 0.1x-Untergrenze | Meist ignoriert |
| Währung | CNY, genau wie dir abgerechnet wird | Mischung aus USD/CNY |
| Modellabdeckung | Jedes Textmodell, das das Gateway routet | Ein oder zwei Modelle |
Für wen das gedacht ist
Nützlich, wenn du
- Eine belastbare Kostenschätzung willst, bevor du Traffic auf ein Modell verlagerst
- Ein 0.5x-Modell mit einem Frontier-Modell beim gleichen Volumen vergleichen musst
- Sehen willst, wie eine höhere Cache-Trefferquote deinen effektiven Tarif senkt
- Eine monatliche LLM-Ausgabe in CNY budgetierst
Weniger nützlich, wenn du
- Zahlen in USD brauchst, dieser Rechner arbeitet in CNY
- Pro Bild oder pro Aufruf statt pro Token abrechnest (diese Zeilen sind ausgeschlossen)
- Ein garantiertes Angebot willst, die echte Nutzung hängt von deinen Prompts und Ausgaben ab
- Den anbietereigenen Preis für ein Modell brauchst, das das Gateway nicht routet
So liest du das Ergebnis
Die Rechnung ist einfach und transparent, aber Schätzungen bleiben Schätzungen.
- Kosten = effektiver Tarif × dein Token-Volumen. Der effektive Tarif mischt Normal- und Cache-Tarif nach deinem Cache-Trefferprozentsatz.
- Der Cache-Tarif nutzt die dokumentierte 0.1x-Untergrenze des Modell-Multiplikators; die echte Cache-Ersparnis hängt von deiner Prompt-Wiederverwendung ab.
- Die Token-Zahlen schätzt du selbst: Eingabe plus Ausgabe. Die echte Nutzung variiert mit der Länge von Prompt und Antwort.
- Modelle pro Bild und pro Aufruf sind ausgeschlossen, da sie nicht pro Token abgerechnet werden.
Die Regel hinter den Zahlen
Hier ist nichts versteckt. Der Tarif jedes Modells ist sein Multiplikator mal die Basis.
Dies ist eine Schätzung auf Basis veröffentlichter Tarife und deiner Eingaben, kein Angebot. Die echten Kosten hängen von der realen Token-Nutzung und dem Cache-Verhalten deiner Workload ab.
Nur eine Schätzung, basierend auf veröffentlichten Multiplikatoren und deinen Eingaben. Modelle pro Bild und pro Aufruf sind ausgeschlossen.
Preisrechner — FAQ
Woher kommen die Tarife?
Aus den vom Gateway veröffentlichten Multiplikatoren pro Modell, angewendet auf eine Basis von 0.4 CNY pro 1M Token. Dieselbe Regel, die die Preisseite auflistet.
Was bewirkt die Cache-Trefferquote?
Gecachte Eingabe wird ab der 0.1x-Untergrenze des Modell-Multiplikators berechnet. Ein höherer Cache-Trefferprozentsatz senkt deinen gemischten effektiven Tarif.
Ist das Ergebnis ein garantierter Preis?
Nein. Es ist eine Schätzung. Deine echten Kosten hängen von der tatsächlichen Anzahl der Eingabe- und Ausgabe-Token ab und davon, wie viel der Eingabe gecacht wird.
Warum ist alles in CNY?
Weil Abrechnung und vorausbezahltes Guthaben in CNY ausgewiesen sind. Der Rechner entspricht dem, was dir tatsächlich berechnet wird.
Zufrieden mit der Schätzung?
Kauf einen Schlüssel und leg los: vorausbezahltes Guthaben, kein Ablauf.