OpenClaw: Kontextfenster und Rate-Limit-Probleme diagnostizieren
Unterscheiden Sie 429 Rate-Limits, überschrittene Kontextgrenzen und lokale Fehler in der Modellmetadaten, und passen Sie anschließend contextWindow, contextTokens und maxTokens sicher an.
Zuerst die Art des Fehlers bestimmen
API rate limit reached bedeutet in der Regel, dass der Upstream 429, eine Parallelitätsbegrenzung oder eine Kontingentgrenze zurückgibt. Allein anhand dieser Meldung lässt sich nicht feststellen, dass die 16k-Kontextkonfiguration die Ursache ist. Prüfen Sie zunächst den Statuscode und den ursprünglichen Fehler, bevor Sie entscheiden, ob die Konfiguration geändert wird.
| Erscheinung | Wahrscheinlichere Ursache | Was zuerst zu tun ist |
|---|---|---|
429, rate_limit, quota, too many requests | Upstream-Rate-Limit, Parallelitätsbegrenzung oder Kontingentmangel | Parallelität verringern und später erneut versuchen, Kontingent und Upstream-Status prüfen |
context_length_exceeded, Anfrage zu groß, Eingabegrenze überschritten | Eingabe zuzüglich reservierter Ausgabe überschreitet die Modell- oder Gateway-Grenze | Konversation kürzen, Komprimierung aktivieren, dann die Kontextkonfiguration prüfen |
| OpenClaw lokales Fenster zu klein | Benutzerdefinierte Modellmetadaten fehlen oder alte Konfiguration ist übrig geblieben | contextWindow, contextTokens und maxTokens prüfen |
| Nur ein Modell schlägt fehl | Problem mit dem Modell-Routing oder den Parametern dieses Modells | Mit demselben Key und derselben Base URL ein anderes Modell für eine minimale Anfrage verwenden |
![Position des Model Window auf der OpenClaw-Einstellungsseite. Die konkreten Feldnamen können sich je nach Version ändern; maßgeblich sind die aktuelle Seite und die Konfigurationsdatei.]](/tutorials-media/context-window/image-03.jpg)
Was die drei Felder jeweils bedeuten
contextWindow: Metadaten zum nativen Kontextfenster des Modells.contextTokens: Die Obergrenze, die OpenClaw tatsächlich für die Eingabe zulässt; sie kann kleiner sein als das native Fenster.maxTokens: Maximale Anzahl an Ausgabe-Tokens für eine einzelne Antwort, nicht die Gesamtgröße des Kontexts.
Tragen Sie nicht beliebig 1M ein, nur um ein „größeres Kontextfenster“ zu erreichen. Die eingetragenen Werte müssen zugleich der Modellfähigkeit, den aktuellen Routenbeschränkungen des LLM API Gateway und der Client-Version entsprechen.
Konfigurationsort
Die Hauptkonfiguration befindet sich in der Regel unter:
~/.openclaw/openclaw.jsonBei einer Konfiguration pro Agent lautet der Pfad in der Regel:
~/.openclaw/agents/<agentId>/agent/models.jsonWenn OPENCLAW_AGENT_DIR gesetzt ist, suchen Sie die entsprechende Agent-Konfiguration in diesem Verzeichnis.
Sicheres Änderungsbeispiel
Die folgenden Werte veranschaulichen nur die Beziehung zwischen den Feldern und stellen keine realen Obergrenzen für alle Modelle dar. Bestätigen Sie die Werte zuerst in der Modellliste dieser Website und in der aktuellen Routenbeschreibung:
{
models: {
mode: "merge",
providers: {
guishu: {
baseUrl: "https://api.llm-token.cn/v1",
apiKey: "YOUR_API_KEY",
api: "openai-completions",
models: [
{
id: "YOUR_MODEL_ID",
name: "YOUR_MODEL_ID",
contextWindow: 128000,
contextTokens: 96000,
maxTokens: 8192,
input: ["text"]
}
]
}
}
}
}Behalten Sie einen Teil des Fensters für System-Prompt, Tool-Ergebnisse und Modellausgabe. Falls der Upstream nur kleinere Eingaben oder Ausgaben zulässt, sollten Sie weiter nach unten korrigieren und nicht nur die vom Modellhersteller beworbenen Werte eintragen.
Reihenfolge von Änderung und Überprüfung
- Sichern Sie die aktuelle Konfigurationsdatei; überschreiben Sie nicht die einzige Kopie.
- Ändern Sie nur den aktuellen Provider- und Modell-Eintrag; bewahren Sie die übrige Konfiguration.
- Führen Sie
openclaw models listaus, um zu bestätigen, dass das Modell erkannt wird. - Führen Sie
openclaw models set guishu/YOUR_MODEL_IDaus, um zu bestätigen, dass der ausgewählte Provider/Modell korrekt ist. - Starten Sie den Gateway neu:
openclaw gateway restart. - Senden Sie zuerst eine sehr kurze Testanfrage und erhöhen Sie dann schrittweise den Kontext.
Wenn bereits die kurze Anfrage 429 zurückgibt, hilft ein weiteres Vergrößern des Kontextfensters nicht; wenden Sie sich stattdessen der Parallelität, dem Kontokontingent und dem Upstream-Status zu. Schlägt nur die lange Anfrage fehl, prüfen Sie anschließend Eingabelänge, Komprimierungsstrategie und die drei Kontextfelder.
Konfigurationsscreenshots und Logs können API-Keys enthalten. Verbergen Sie vor der Übermittlung an den Support den vollständigen Key; geben Sie nur Fehlerzeitpunkt, Statuscode, Modell-ID und Request-ID an.