Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Modellpreise und Abrechnung

Multiplikatoren, Preisumrechnung, einheitliche Abrechnungsregeln und Modellkosten im Überblick.

1. Abrechnungsregeln

Grundlage der Abrechnung: Die Plattform rechnet in Einheiten von 100 Millionen Tokens ab. Dabei gilt 1× = 40 Yuan / 100 Millionen Tokens, entsprechend 0.4 Yuan / 1 Million Tokens. Die Multiplikatoren und Preise pro 1 Million Tokens in der folgenden Tabelle beruhen auf derselben Umrechnung.

AbrechnungspostenStandardErläuterung
40 Yuan / 100 Millionen TokensEntspricht 0.4 Yuan / 1 Million Tokens und bildet die Grundlage der Preistabelle.
80 Yuan / 100 Millionen TokensDer Preis wird linear aus dem Basismultiplikator berechnet; auch der Preis pro 1 Million Tokens verdoppelt sich.
200 Yuan / 100 Millionen TokensFür Modelle mit höheren Kosten oder größerem Ressourcenbedarf.
10×400 Yuan / 100 Millionen TokensKostenintensive Modelle verwenden höhere Multiplikatoren. Maßgeblich ist die jeweilige Modellpreisliste.

Ein API-Key gilt für alle Modelle. Der Multiplikator bildet lediglich die Kostenunterschiede zwischen den Modellen ab; Sie benötigen für einen Modellwechsel keinen anderen Key.

Maßgeblich sind die tatsächlichen Abrechnungsdaten des Systems. Bei vorübergehenden Subventionen, Aktionspreisen oder geänderten Multiplikatoren wird die Preisliste in diesem Artikel aktualisiert.


2. Abrechnung von Cache-Treffern

Was ist ein Cache-Treffer? Wenn aufeinanderfolgende Anfragen große Teile desselben Kontexts enthalten, kann das System bereits verarbeitete Inhalte wiederverwenden. Der wiederverwendete Anteil wird nicht erneut als vollständige Eingabe berechnet. Typische Szenarien sind lange Unterhaltungen, aufeinanderfolgende Rückfragen, Codevervollständigung, Agenten-Workflows und mehrstufige Tool-Aufrufe.

KategorieAbrechnungErläuterung
Eingabe mit Cache-TrefferIn der Regel 0.1×Der getroffene Anteil kostet etwa 10 % einer regulären Eingabe. Bei langen Kontexten kann die Ersparnis besonders groß sein.
Eingabe ohne Cache-TrefferMultiplikator des jeweiligen ModellsNeue Inhalte und stark veränderte Kontexte werden als normale Eingabe berechnet.
Sondermodelle / instabile PhasenMöglicherweise 0.2× oder vorübergehend ohne CacheBei kostenintensiven Modellen oder einem instabilen Upstream kann die Cache-Abrechnung an die tatsächlich verfügbare Funktion angepasst werden.

Beispiel: Bei einer längeren Unterhaltung können wiederholt übermittelte Kontextabschnitte aus dem Cache bedient und zum Cache-Multiplikator abgerechnet werden. Neue Fragen und Ausgaben werden weiterhin mit dem Multiplikator des jeweiligen Modells berechnet.

Ob ein Cache-Treffer zustande kommt, hängt vom Anfrageinhalt, den Modellfunktionen, der Caching-Strategie des Upstreams und der aktuellen Systemverfügbarkeit ab. Maßgeblich ist der endgültige Abrechnungsdatensatz.


3. Modellliste und Preistabelle (alle Modelle)

So lesen Sie die Tabelle: Prüfen Sie zuerst den Modellnamen, dann den Multiplikator und zuletzt den Preis pro 1 Million Tokens. Je niedriger der Multiplikator, desto niedriger sind die Kosten pro Token. Multiplikator und Preis verwenden dieselbe Berechnungsgrundlage.

FeldErläuterung
ModellnameVerwenden Sie in Clients, Workflows und API-Aufrufen exakt die in der Tabelle angegebene Modell-ID einschließlich Groß- und Kleinschreibung.
MultiplikatorBildet die unterschiedlichen Modellkosten ab. Niedrige Multiplikatoren eignen sich für häufige Alltagsaufgaben, hohe Multiplikatoren eher für besonders anspruchsvolle Aufgaben.
Preis pro 1 Million TokensIst bereits anhand des Multiplikators umgerechnet und kann direkt zur Kostenschätzung verwendet werden.
Vorübergehende Subvention / AktionspreisBei zeitlich begrenzten Aktionen zeigt die Tabelle den aktuellen Multiplikator. Nach Ende der Aktion kann er wieder geändert werden.
AnbieterAnzeigenameModell-IDMultiplikator / AbrechnungPreisKontextBildfunktionen
LLM API Gateway / China-AggregationClaude Sonnet 4.6 (Gateway-optimiert)claude-sonnet-4-60.5×¥0.2 / 1 Mio. Tokens1MUnterstützt
OpenAIGPT-5.4gpt-5.4¥0.8 / 1 Mio. Tokens1MUnterstützt
OpenAIGPT-5.5gpt-5.5¥1.6 / 1 Mio. Tokens258KUnterstützt
OpenAI / CodexGPT-5.3 Codex Sparkgpt-5.3-codex-spark¥0.4 / 1 Mio. Tokens128KNicht unterstützt
OpenAIGPT Image 2gpt-image-2Pro Bild¥0.05–0.10 / Bild1–2K AusgabeGenerierungsmodell
OpenAIGPT Image 2 4Kgpt-image-2-4kPro Bild¥0.5–1 / Bild4K-BildGenerierungsmodell
OpenAIGPT-5.6 Solgpt-5.6-sol¥2.4 / 1 Mio. Tokens258KUnterstützt
OpenAIGPT-5.6 Terragpt-5.6-terra¥0.4 / 1 Mio. Tokens258KUnterstützt
xAI / GrokGrok 4.6grok-4.610×¥4 / 1 Mio. Tokens500KBestätigung ausstehend
xAI / GrokGrok 4.5grok-4.5¥2 / 1 Mio. Tokens500KUnterstützt
AnthropicClaude Haiku 4.5claude-haiku-4-5-20251001¥0.4 / 1 Mio. Tokens256KUnterstützt
AnthropicClaude Sonnet 5claude-sonnet-510×¥4 / 1 Mio. Tokens1MUnterstützt
AnthropicClaude Fable 5claude-fable-540×¥16 / 1 Mio. Tokens1MUnterstützt
AnthropicClaude Opus 4.6claude-opus-4-615×¥6 / 1 Mio. Tokens1MUnterstützt
AnthropicClaude Opus 4.7claude-opus-4-715×¥6 / 1 Mio. Tokens1MUnterstützt
AnthropicClaude Opus 4.8claude-opus-4-815×¥6 / 1 Mio. Tokens1MUnterstützt
AnthropicClaude Opus 5claude-opus-515×¥6 / 1 Mio. Tokens1MUnterstützt
Alibaba Cloud / QwenQwen 3.6 Plusqwen3.6-plus¥1.2 / 1 Mio. Tokens1MUnterstützt
Alibaba Cloud / QwenQwen 3.7 Plusqwen3.7-plus¥1.6 / 1 Mio. Tokens1MUnterstützt
Alibaba Cloud / QwenQwen 3.7 Maxqwen3.7-max10×¥4 / 1 Mio. Tokens1MNicht unterstützt
Alibaba Cloud / QwenQwen 3.8 Maxqwen3.8-max20×¥8 / 1 Mio. Tokens1MUnterstützt
Meituan / LongCatLongCat 2.0LongCat-2.0¥0.4 / 1 Mio. Tokens1MNicht unterstützt
Tencent HunyuanHunyuan 3hy3¥0.4 / 1 Mio. Tokens256KNicht unterstützt
MiniMaxMiniMax M3MiniMax-M3¥0.4 / 1 Mio. Tokens1MUnterstützt
MiniMaxImage 01image-01Pro Bild¥0.2 / BildGenerierungsmodell
MiniMaxImage 01 Liveimage-01-livePro Sekunde¥2 / SekundeGenerierungsmodell
StepFunStep 3.7 Flashstep-3.7-flash¥0.4 / 1 Mio. Tokens256KUnterstützt
ByteDance / DoubaoDoubao Seed 2.1 Turbodoubao-seed-2.1-turbo¥1.2 / 1 Mio. Tokens128KUnterstützt
Xiaomi / MiMoMiMo V2.5 Promimo-v2.5-pro¥1.6 / 1 Mio. Tokens1MNicht unterstützt
Xiaomi / MiMoMiMo V2.5mimo-v2.5¥0.8 / 1 Mio. Tokens1MUnterstützt
DeepSeekDeepSeek V4 Prodeepseek-v4-pro7.5×¥3 / 1 Mio. Tokens1MNicht unterstützt
DeepSeekDeepSeek V4 Flashdeepseek-v4-flash2.5×¥1 / 1 Mio. Tokens1MNicht unterstützt
Moonshot AI / KimiKimi K3kimi-k325×¥10 / 1 Mio. Tokens1MUnterstützt
Zhipu / Z.aiGLM 5.1glm-5.1¥2 / 1 Mio. Tokens256KUnterstützt
Zhipu / Z.aiGLM 5.2glm-5.2¥3.2 / 1 Mio. Tokens1MUnterstützt

API-Adresse: Verwenden Sie vorzugsweise https://api.llm-token.cn/v1. Falls ein Client die Adresse mit /v1 nicht unterstützt, versuchen Sie https://api.llm-token.cn. API-Gateways, Clients und Erweiterungen können unterschiedliche Anforderungen an die Base URL stellen. Testen Sie nach einem Modellwechsel zunächst mit einer kleinen Anfrage.

Skill zur Überwachung von Preislistenänderungen installieren

Der Skill zur Preislistenüberwachung wurde auf Version 1.0.4 aktualisiert. Die neue Version kann große Tabellen in öffentlichen Feishu-Dokumenten zuverlässiger lesen und erkennt vorrangig die eigentliche Modellpreisliste, damit Erläuterungstabellen nicht fälschlich als Preisliste interpretiert werden.

FunktionErläuterung
Änderungen automatisch erkennenÜberwacht Modell-, Multiplikator- und Preistabellen in öffentlichen Feishu-Dokumenten und erkennt neue oder entfernte Modelle sowie Änderungen an Multiplikatoren und Preisen pro 1 Million Tokens.
Benachrichtigungen automatisch aufbereitenGibt bei Änderungen eine Markdown-Benachrichtigung aus, die direkt an WeChat-Gruppen, Telegram, interne Unternehmensgruppen oder Bots gesendet werden kann.
Für die Kundenbetreuung geeignetVertriebspartner, Teamadministratoren und Verantwortliche für Kundengruppen können Preisänderungen verfolgen, ohne die Dokumente täglich manuell zu vergleichen.
Keine Änderung, keine NachrichtGibt bei unveränderten Daten NO_REPLY aus und eignet sich dadurch für OpenClaw, cron und andere automatisierte Aufgaben.

Ein-Klick-Installation

clawhub install feishu-public-table-monitor

Vorhandene Installation auf die neueste Version aktualisieren

clawhub update feishu-public-table-monitor --force

Empfohlener Update-Befehl für einen OpenClaw-/Lobster-Workspace

clawhub --workdir ~/.openclaw/workspace update feishu-public-table-monitor --force

Beispielbefehl zum Überwachen dieser Preisliste

Aktivieren Sie vor der Ausführung in Feishu die öffentliche Internetfreigabe für das Zieldokument. Ersetzen Sie anschließend PASTE_YOUR_PUBLIC_FEISHU_DOC_URL_HERE durch die öffentliche Feishu-URL. Links mit Anmeldepflicht können nicht überwacht werden.

FEISHU_PUBLIC_DOC_URL='PASTE_YOUR_PUBLIC_FEISHU_DOC_URL_HERE'
python3 ~/.openclaw/workspace/skills/feishu-public-table-monitor/scripts/monitor_feishu_price_table.py \
  "$FEISHU_PUBLIC_DOC_URL" \
  --section-title "三、模型列表与倍率价格表(所有模型可用)"

Verwendung: Beim ersten Lauf wird eine Baseline erstellt. Danach kann der Skill regelmäßig ausgeführt werden. Die Ausgabe NO_REPLY bedeutet, dass sich die Preisliste nicht geändert hat. Andernfalls wird automatisch eine Benachrichtigung über neue oder entfernte Modelle sowie Multiplikator- und Preisänderungen erstellt.

Anwendungsbereich: Dieser Skill ist für öffentlich zugängliche Preislisten in Feishu-Dokumenten vorgesehen. Prüfen Sie vor der Anbindung privater oder anmeldungspflichtiger Seiten die Zugriffsrechte und Datenschutzanforderungen.