LLM-API-FAQ
Praktische Antworten zu Einrichtung, regionalem Routing, Abrechnung, Fehlerbehebung und sicherem Support. Aktuelle Modellverfügbarkeit und Preise finden Sie auf der Preisseite.
Erste Schritte und Zustellung
Zugang kaufen oder aufladen und anschließend Zustellung sowie verfügbares Guthaben prüfen.
Wie kaufe ich einen API-Schlüssel?
Öffnen Sie die Zugangsseite, wählen Sie ein Paket aus, geben Sie die E-Mail-Adresse für die Zustellung ein und schließen Sie die Zahlung ab. Neue Zugangsdaten werden gemäß den Hinweisen beim Bezahlvorgang zugestellt; prüfen Sie auch den Spam-Ordner.
Wie lade ich einen vorhandenen API-Schlüssel auf?
Verwenden Sie die Aufladeseite und geben Sie den vorhandenen Schlüssel sorgfältig ein. Fügen Sie einen vollständigen Schlüssel niemals in ein öffentliches Ticket, einen Gruppenchat, einen Screenshot oder ein freigegebenes Dokument ein.
Ich habe bezahlt, aber den Schlüssel nicht erhalten. Was soll ich tun?
Prüfen Sie den Zahlungsstatus, die Schreibweise der Zustell-E-Mail-Adresse, den Posteingang und den Spam-Ordner. Fehlt der Schlüssel nach einer kurzen Wartezeit weiterhin, wenden Sie sich privat mit Bestellnummer und Zahlungszeitpunkt an den Support.
Wo kann ich Guthaben und Nutzung prüfen?
Nutzen Sie das auf dieser Website verlinkte offizielle Kontingentportal. Geben Sie den Schlüssel nur auf dieser offiziellen Seite ein und senden Sie die vollständigen Zugangsdaten niemals an den Support.
Verfällt gekauftes Guthaben?
Standardmäßiges Prepaid-Guthaben bleibt derzeit verfügbar, bis es verbraucht ist. Gelten für eine Aktion, einen Vertrag oder einen individuellen Tarif andere Bedingungen, haben die Angaben auf der Bezahlseite oder die unterzeichnete Vereinbarung Vorrang.
Regionale Endpunkte und API-Formate
Wählen Sie nach Bereitstellungsregion und verwenden Sie dann das von Ihrem Client oder SDK benötigte Protokoll.
Welche regionale Base URL sollte ich verwenden?
Verwenden Sie https://gpt-agent.cc/v1 für Nord- und Südamerika, https://eu.gpt-agent.cc/v1 für Europa und Afrika, https://hk.gpt-agent.cc/v1 für Südostasien, Hongkong, Macau, Taiwan, Japan, Korea, Australien und Neuseeland sowie https://api.llm-token.cn/v1 für Festlandchina.
Was ist der Unterschied zwischen einer Base URL und einem vollständigen Endpunkt?
Eine Base URL endet mit /v1. Ein vollständiger Endpunkt ergänzt /chat/completions, /responses oder /messages. Beachten Sie die Feldbezeichnung in Ihrem Client und hängen Sie denselben Pfad nicht doppelt an.
Welche API-Formate werden unterstützt?
Kompatible Formate für Chat Completions, Responses und Messages sind verfügbar. Wählen Sie das Format, das Ihre Bibliothek, Ihr Client oder Ihr Agenten-Workflow erwartet.
Wo gebe ich den API-Schlüssel ein?
Verwenden Sie das Feld API Key, Token oder Authorization. Unverarbeitete HTTP-Anfragen senden normalerweise Authorization: Bearer YOUR_API_KEY. Entfernen Sie Anführungszeichen, Platzhaltertext und versehentlich eingefügte Leerzeichen.
Wo finde ich die genaue Modell-ID?
Kopieren Sie sie aus dem aktuellen Modellkatalog oder von der Preisseite. Anzeigenamen können von Anfrage-IDs abweichen; übernehmen Sie daher Groß- und Kleinschreibung, Bindestriche und Versionssuffixe exakt.
Modelle, Multimodalität und Entwicklerwerkzeuge
Modellversionen ändern sich im Laufe der Zeit; der aktuelle Katalog ist die maßgebliche Quelle.
Welche Modellfamilien sind verfügbar?
Der Katalog umfasst die wichtigsten Familien GPT, Claude, Grok, DeepSeek, Qwen, Doubao, Kimi, GLM, MiniMax, Hunyuan, StepFun, MiMo und LongCat. Aktuelle Versionen, Funktionen und Preise finden Sie auf der Preisseite.
Wie wähle ich ein Modell für Programmierung, logisches Denken, lange Kontexte oder Stapelverarbeitung?
Wählen Sie zuerst nach der benötigten Fähigkeit und vergleichen Sie dann Qualität, Latenz, Preis, Kontextgröße und Werkzeugunterstützung. Testen Sie dieselbe kurze Eingabe mit zwei oder drei Kandidaten, bevor Sie Produktionsdatenverkehr umstellen.
Werden Bildgenerierung und multimodale Eingaben unterstützt?
Ja, bei Modellen, die im aktuellen Katalog entsprechend gekennzeichnet sind. Prüfen Sie, ob das gewählte Modell Bild-URLs oder Base64-Eingaben akzeptiert beziehungsweise Bilder erzeugt, und verwenden Sie das dafür vorgesehene Anfrageformat.
Welche Clients und Agentenwerkzeuge kann ich verbinden?
Zu den gängigen Einrichtungen zählen Codex CLI, Claude Code, OpenCode, OpenClaw, Cursor, Cline, Roo Code, Kilo Code, Windsurf, Cherry Studio, OpenWebUI, Dify, n8n, LangChain und LM Studio. Die genauen Feldnamen finden Sie im jeweiligen Tutorial.
Was ist zu tun, wenn ein Modell umbenannt, vorübergehend nicht verfügbar oder entfernt wurde?
Prüfen Sie zuerst den aktuellen Katalog und die Servicehinweise. Schlägt nur ein Modell fehl, wechseln Sie vorübergehend zu einem vergleichbaren Modell; schlagen mehrere Modelle fehl, deutet dies eher auf ein Routing- oder Wartungsproblem hin.
Abrechnung, Kontingent und Geschäftskonten
Die Abrechnung richtet sich nach den aktuellen Modellregeln und der tatsächlichen Nutzung; Aktionspreise gelten nicht dauerhaft.
Wie werden die Preise berechnet?
Guthaben wird im Voraus bezahlt und nach dem aktuellen Tarif des jeweiligen Modells abgezogen, einschließlich Ein- und Ausgabetokens, Multiplikatoren oder gegebenenfalls Gebühren pro Aufgabe. Prüfen Sie vor dem Kauf oder Produktionseinsatz die Preisseite.
Was beeinflusst die Kosten für Tokens und multimodale Funktionen?
Lange Gesprächsverläufe, große Ausgaben, automatische Wiederholungen, Werkzeugschleifen von Agenten, Bilder und das Cache-Verhalten können die Nutzung verändern. Halten Sie Eingaben und gespeicherten Kontext so klein, wie es die Aufgabe zulässt.
Warum wurde mehr Guthaben als erwartet verbraucht?
Prüfen Sie auf wiederholte Verläufe, hohe Ausgabelimits, parallele Anfragen, SDK-Wiederholungen oder Agentenschleifen. Vergleichen Sie den Zeitraum im Kontingentportal mit den Anwendungsprotokollen, ohne den vollständigen API-Schlüssel offenzulegen.
Unterstützen Sie Rechnungen, Beschaffungsprozesse oder Tarife für hohe Volumen?
Teams können den Support zu Volumen, Parallelität, Beschaffung, Rechnungsstellung und Supportbedarf kontaktieren. Individuelle Preise oder Servicezusagen müssen privat in der jeweils geltenden Vereinbarung bestätigt werden.
Häufige Fehler beheben
Notieren Sie die genaue Fehlermeldung, das Modell und den Zeitpunkt, bevor Sie mehrere Einstellungen gleichzeitig ändern.
Wie behebe ich Authentifizierungsfehler 401 oder 403?
Prüfen Sie, ob der Schlüssel vollständig ist, keine Leerzeichen enthält, im richtigen Feld steht und mit einer Base URL dieses Dienstes verwendet wird. Wurde er möglicherweise offengelegt, verwenden Sie ihn nicht weiter und ersetzen Sie ihn.
Wie behebe ich 404 oder „model not found“?
Prüfen Sie die genaue Modell-ID und den Endpunktpfad. Häufige Ursachen sind ein Anzeigename, ein doppelt angehängtes /v1 oder eine Responses- beziehungsweise Messages-Nutzlast, die an einen Chat-Completions-Pfad gesendet wird.
Was bedeutet 429 oder eine Ratenbegrenzung?
Prüfen Sie zuerst das verbleibende Guthaben und verringern Sie anschließend Parallelität und Wiederholungsrate. Besteht 429 trotz ausreichenden Guthabens fort, halten Sie Modell, Zeitpunkt und einen Screenshot der Fehlermeldung für den Support fest.
Was kann ich bei Zeitüberschreitungen oder Netzwerkfehlern tun?
Testen Sie den Endpunkt, der der Bereitstellungsregion am nächsten liegt, kürzen Sie Kontext und Ausgabe und senden Sie eine minimale Anfrage. Schlägt nur ein Client fehl, prüfen Sie dessen Proxy-, Zertifikat- und Zeitüberschreitungseinstellungen.
Was kann ich bei 500, 502 oder Bad Gateway tun?
Wiederholen Sie die Anfrage nach einer kurzen Pause einmal und testen Sie ein anderes Modell. Fehler bei nur einem Modell weisen meist auf dessen Route hin; Fehler bei mehreren Modellen können auf gemeinsames Routing oder Wartungsarbeiten hindeuten.
Wie erkenne ich, ob ein Modell oder die gesamte Route ausfällt?
Senden Sie dieselbe minimale Anfrage mit demselben Schlüssel und derselben Base URL und ändern Sie nur die Modell-ID. Ein einzelner Fehler deutet auf eine Modellroute hin; mehrere Fehler rechtfertigen eine Eskalation an den Support.
Sicherheit, Erstattungen und Support
Veröffentlichen Sie bei der Fehlerbehebung niemals vollständige Zugangsdaten, Bestelldetails oder Identitätsangaben.
Was soll ich tun, wenn ein API-Schlüssel offengelegt wurde?
Löschen oder widerrufen Sie die betreffende Nachricht, verwenden Sie den Schlüssel nicht weiter und kontaktieren Sie den Support für einen Ersatz oder eine Risikoprüfung. Maskieren Sie in Screenshots bis auf wenige Zeichen am Anfang und Ende alles.
Benötigt der Support meinen vollständigen API-Schlüssel?
Nein. Für eine öffentliche Fehleranalyse werden nur der Modellname und ein Screenshot der Fehlermeldung benötigt. Kontoprüfungen mit Zugangsdaten müssen über einen privaten, sicheren Supportkanal erfolgen.
Welche Informationen soll ich bei einer Problemmeldung angeben?
Geben Sie höchstens zwei Dinge an: (1) den Modellnamen und (2) einen Screenshot der Fehlermeldung, möglichst mit Zeitpunkt oder Anfrage-ID. Senden Sie niemals den vollständigen Schlüssel, ein Passwort, Zahlungsdaten oder unmaskierte Identitätsdaten.
Wie prüfe ich den Wartungsstatus und wiederhole eine Anfrage sicher?
Prüfen Sie zuerst die Servicehinweise. Senden Sie nach der Wiederherstellung eine einzelne minimale Anfrage, statt unbegrenzte Wiederholungen zu aktivieren. Schlägt sie weiterhin fehl, melden Sie das Modell und den neuesten Fehler-Screenshot.
Kann ich eine Erstattung oder eine Nutzungsprüfung beantragen?
Erstattungen und strittige Nutzung richten sich nach der Erstattungsrichtlinie und dem tatsächlichen Bestellstatus. Stoppen Sie weitere Aufrufe und kontaktieren Sie den Support anschließend privat mit Bestellnummer und relevantem Zeitpunkt zur Prüfung.