Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Modellliste

Direkt nutzbare Modell-IDs, empfohlene Standardmodelle und typische Einsatzszenarien.

Die folgenden Modell-IDs können derzeit direkt mit dem LLM API Gateway verwendet werden. Kopieren Sie die Modell-IDs exakt wie angegeben und verändern Sie weder Groß- und Kleinschreibung noch Suffixe. Maßgeblich für Multiplikator, Preis, Kontextfenster und Bildfunktionen sind die Angaben unter Modellpreise und Abrechnung.


Empfohlenes Standardmodell

claude-sonnet-4-6

Beschreibung: Gateway-optimiertes Modell für hohe Parallelität. Es bietet ein 1M-Kontextfenster, unterstützt Bildverständnis und eignet sich für Agenten, Workflows, lange Dokumente und stark parallelisierte Skripte.

claude-sonnet-4-6 ist ein für das LLM API Gateway optimiertes Aggregationsmodell mit hoher Parallelität. Seine Stärken liegen in schnellen Antworten, flüssiger Textausgabe, einem 1M-Kontextfenster, Agenten-Tool-Aufrufen und Bildverständnis. Es eignet sich als dauerhaftes Standardmodell für Tools wie OpenClaw, Claude Code, Hermes, WorkBuddy, n8n und Coze.


Internationale Modelle

OpenAI (besonders empfohlen) 🌟🌟🌟🌟🌟

gpt-5.4

Beschreibung: Vielseitiges OpenAI-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für alltägliche Fragen, Code, lange Dokumente und Agentenaufgaben.

gpt-5.5

Beschreibung: Leistungsstarkes OpenAI-Modell. Die Plattform weist derzeit ein 258K-Kontextfenster und Bildverständnis aus. Geeignet für komplexes Schlussfolgern, Codeplanung, anspruchsvolles Schreiben und geschäftskritische Ausgaben.

gpt-5.3-codex-spark

Beschreibung: Echtzeit-Coding-Modell aus der Codex-Familie mit 128K-Kontextfenster. Seine Stärke ist die schnelle Reaktion bei Codeerstellung und -bearbeitung, kleinen Patches, UI-Feinschliff und leichteren Entwicklungsaufgaben.

gpt-image-2

Beschreibung: Hochwertiges Modell für Bildgenerierung und -bearbeitung mit Abrechnung pro Bild. Geeignet für Produktbilder, Poster, Designmaterialien, Cover und anspruchsvolle kreative Motive.

gpt-image-2-4k

Beschreibung: Hochauflösendes 4K-Bildmodell mit Kosten von 0.5–1 Yuan pro Bild. Geeignet für detailreiche Poster, Produktbilder, Cover, finale Designentwürfe und kommerzielle Visualisierungen.

GPT-5.6-Serie 🌟🌟🌟🌟

gpt-5.6-sol

Beschreibung: Leistungsstarkes Modell der GPT-5.6-Serie mit 258K-Kontextfenster und Bildverständnis. Geeignet für komplexe Fragen, Code, umfangreiche Dokumente und multimodale Aufgaben.

gpt-5.6-terra

Beschreibung: Ausgewogenes Modell der GPT-5.6-Serie mit 258K-Kontextfenster und Bildverständnis. Geeignet für alltägliche Fragen, Codeunterstützung, Dokumentenverarbeitung und multimodale Aufgaben.

xAI / Grok 🌟🌟🌟🌟

grok-4.6

Beschreibung: Auf dieser Plattform verfügbare Grok-Gateway-Route. Sie bietet ein 500K-Kontextfenster und einen einheitlichen 10×-Faktor (ca. ¥4 / 1 Mio. Tokens), ohne Preisstaffel nach Kontextlänge. Geeignet für komplexes Schlussfolgern, Programmierung, lange Dokumente und Agent-Aufgaben. Bildverständnis muss noch bestätigt werden.

grok-4.5

Beschreibung: Vielseitiges leistungsstarkes Modell von xAI mit 500K-Kontextfenster und Bildverständnis. Geeignet für komplexe Fragen, Code, lange Dokumente und Bildanalyse.

Anthropic (für komplexe Aufgaben empfohlen) 🌟🌟🌟🌟🌟

claude-haiku-4-5-20251001

Beschreibung: Leichtes, schnelles Claude-Modell mit 256K-Kontextfenster und Bildverständnis. Geeignet für Zusammenfassungen, Klassifikation, schnelle Fragen und kostengünstige Aufrufe mit hoher Frequenz.

claude-sonnet-5

Beschreibung: Leistungsstarkes Claude-Modell der neuen Generation mit 1M-Kontextfenster und Bildverständnis. Geeignet für komplexes Schlussfolgern, Coding, mehrstufige Agenten, anspruchsvolles Schreiben und lange Dokumente.

claude-fable-5

Beschreibung: Claude-Spitzenmodell mit hoher Leistungsfähigkeit, 1M-Kontextfenster und Bildverständnis. Geeignet für besonders wertvolle komplexe Analysen, Tiefenrecherche, langfristige Agentenaufgaben, umfangreiches Schreiben und kritische technische Arbeit.

claude-opus-4-6

Beschreibung: Stabiles leistungsstarkes Opus-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für komplexes Schlussfolgern, anspruchsvolles Schreiben, Coding-Lösungen und die Analyse langer Dokumente.

claude-opus-4-7

Beschreibung: Weiterentwickeltes Modell der Opus-Serie mit 1M-Kontextfenster und Bildverständnis. Besonders geeignet für tiefgehende Codearbeit sowie komplexe Planungs- und Analyseaufgaben mit mehreren sorgfältigen Denkschritten.

claude-opus-4-8

Beschreibung: Hochwertiges Opus-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für besonders anspruchsvolle Aufgaben, langfristige Agenten, fundierte Berichte und hochwertige Projektarbeit.

claude-opus-5

Beschreibung: Hochwertiges Opus-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für besonders anspruchsvolle Aufgaben, langfristige Agenten, fundierte Berichte und hochwertige Projektarbeit.


Chinesische Modelle

Gateway-optimiertes Aggregationsmodell (für hohe Parallelität empfohlen) 🌟🌟🌟🌟🌟

claude-sonnet-4-6

Beschreibung: Vom LLM API Gateway für hohe Parallelität optimiertes und besonders empfohlenes Modell. Es bietet ein 1M-Kontextfenster, Bildverständnis und schnelle Textausgabe und eignet sich für Agenten, Workflows, automatisierte Skripte und große Aufrufmengen.

Tongyi Qianwen / Qwen (für lange Kontexte und Agenten empfohlen) 🌟🌟🌟🌟🌟

qwen3.6-plus

Beschreibung: Kostengünstiges Qwen-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für lange Dokumente, Code-Repositories, Fragen an Wissensdatenbanken, Agenten-Tool-Aufrufe und multimodale Büroaufgaben.

qwen3.7-plus

Beschreibung: Ausgewogenes Qwen-Agentenmodell der neuen Generation mit 1M-Kontextfenster, Bildverständnis und umfassenden Tool-Aufrufen. Geeignet für OpenClaw, Claude Code, Hermes, große Codebasen und Dokumentenverarbeitung.

qwen3.7-max

Beschreibung: Qwen-Flaggschiff für Schlussfolgerungsaufgaben mit 1M-Kontextfenster. Geeignet für komplexes Schlussfolgern, tiefgehende Codeplanung, Architekturentwurf, langfristige Agenten und hochwertige Analysen. In der offiziellen Beschreibung werden derzeit Schlussfolgern und Textgenerierung genannt, nicht jedoch Bildverständnis.

qwen3.8-max

Beschreibung: Die neueste leistungsstarke Qwen-Route dieses Gateways. Sie bietet ein 1M-Kontextfenster und Bildverständnis und eignet sich für komplexes Schlussfolgern, Coding, langfristige Agenten, Recherche und multimodale Aufgaben. qwen3.8-max ist eine Plattform-Routen-ID und muss vom Namen qwen3-max in der öffentlichen Qwen-Dokumentation unterschieden werden.

Meituan / LongCat (für lange Kontexte und Coding-Agenten empfohlen) 🌟🌟🌟🌟

LongCat-2.0

Beschreibung: Meituans wichtigstes Agentic-Coding-Modell mit 1M-Kontextfenster. Derzeit für Texteingaben verfügbar und geeignet für große Code-Repositories, komplexe Planung, lange Dokumente und langfristige Agentenaufgaben.

Tencent Hunyuan / Hunyuan 🌟🌟🌟🌟

hy3

Beschreibung: Schlussfolgerungs- und Agentenmodell Tencent Hunyuan 3 mit 256K-Kontextfenster. Geeignet für chinesischsprachiges Schlussfolgern, Coding, lange Dokumente und Automatisierung; derzeit als Textmodell verfügbar.

MiniMax (für lange Kontexte und Agenten empfohlen) 🌟🌟🌟🌟

MiniMax-M3

Beschreibung: Multimodales Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für lange Dokumente, Code-Repositories, Multi-Agenten-Systeme und Tool-Aufrufe.

image-01

Beschreibung: Text-zu-Bild-Modell mit Abrechnung pro Bild. Geeignet für Poster, Artikelillustrationen, Produktbilder, Avatare, kreative Materialien und die Bildgenerierung in großen Mengen.

image-01-live

Beschreibung: Dynamische visuelle Generierung mit Abrechnung pro Sekunde. Geeignet für animierte Bilder, Figurenanimationen, Echtzeitvisuals und kreative Videoszenarien.

StepFun 🌟🌟🌟🌟

step-3.7-flash

Beschreibung: Schnelles Vision-Language-Modell mit 256K-Kontextfenster und Bildverständnis. Geeignet für Code, Chats, suchgestützte Antworten, Bildanalyse und einfache Agentenaufgaben.

ByteDance / Doubao 🌟🌟🌟🌟

doubao-seed-2.1-turbo

Beschreibung: Kosteneffizientes multimodales Modell mit 128K-Kontextfenster und Bildverständnis. Geeignet für Agenten, Softwareentwicklung, Bild- und Videoverständnis sowie umfangreiche Stapelverarbeitung.

Xiaomi MiMo (für lange Kontexte empfohlen) 🌟🌟🌟🌟🌟

mimo-v2.5-pro

Beschreibung: Professionelles Xiaomi-Modell mit 1M-Kontextfenster. Geeignet für lange Texte, komplexe Analysen, Codeplanung und Automatisierungsaufgaben in Unternehmen.

mimo-v2.5

Beschreibung: Kostengünstiges vielseitiges Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für alltägliche Chats, Umschreibungen, Zusammenfassungen, Dokumentenverarbeitung und Aufgaben in großen Mengen.

DeepSeek (für Schlussfolgern und Code empfohlen) 🌟🌟🌟🌟🌟

deepseek-v4-pro

Beschreibung: Leistungsstarkes MoE-Modell von DeepSeek mit 1M-Kontextfenster. Geeignet für Code, Mathematik, komplexe Planung, tiefgehende Analysen und besonders anspruchsvolle Schlussfolgerungsaufgaben.

deepseek-v4-flash

Beschreibung: Leichte und schnelle DeepSeek-Variante mit 1M-Kontextfenster. Geeignet für häufige Fragen, Zusammenfassungen, schnelle Codeunterstützung und kostenbewusste Schlussfolgerungsaufgaben.

Kimi / Moonshot AI 🌟🌟🌟🌟🌟

kimi-k3

Beschreibung: Kimi-Modell der nächsten Generation mit langem 1M-Kontextfenster, multimodalen Fähigkeiten und Bildverständnis. Geeignet für komplexe Coding- und Agentenaufgaben, die Analyse sehr langer Dokumente, Wissensfragen und Bildanalyse.

Zhipu / Z.ai 🌟🌟🌟🌟

glm-5.1

Beschreibung: Vielseitiges Zhipu-Flaggschiff mit 256K-Kontextfenster und Bildverständnis. Geeignet für Schreiben, Analysen, Coding, Agentenentwicklung und multimodale Aufgaben.

glm-5.2

Beschreibung: Neues leistungsstarkes multimodales Zhipu-Modell mit 1M-Kontextfenster und Bildverständnis. Geeignet für komplexes Schreiben, Analysen, Coding, Agentenentwicklung und multimodale Aufgaben.


Nutzungsempfehlungen

Wenn Sie unsicher sind, wählen Sie zuerst nach dem Einsatzszenario. Bevorzugen Sie für alltägliche Aufgaben kostengünstige und stabile Modelle und für komplexe Aufgaben ein leistungsstärkeres Modell mit höherem Multiplikator.

  • Alltag / hohe Parallelität: claude-sonnet-4-6, gpt-5.6-terra, MiniMax-M3
  • Komplexes Schlussfolgern / hochwertige Ausgaben: gpt-5.6-sol, qwen3.8-max, deepseek-v4-pro
  • Langfristige Aufgaben auf Spitzenniveau: claude-fable-5 für besonders anspruchsvolle, langfristige Agenten-, Code- und Forschungsaufgaben
  • Schnelle Code-Iteration: gpt-5.3-codex-spark, LongCat-2.0, qwen3.7-plus
  • Lange Dokumente und große Kontexte: MiniMax-M3, qwen3.7-plus, LongCat-2.0, deepseek-v4-pro, kimi-k3, glm-5.2
  • Bildverständnis: Bevorzugen Sie Modelle, deren Beschreibung Bildverständnis ausdrücklich als unterstützt ausweist.
  • Bildgenerierung: gpt-image-2, gpt-image-2-4k, image-01, image-01-live