OpenClaw Kiểm tra cửa sổ ngữ cảnh và giới hạn tốc độ
Phân biệt 429 giới hạn tốc độ, vượt ngữ cảnh và lỗi siêu dữ liệu model cục bộ, sau đó điều chỉnh an toàn contextWindow, contextTokens và maxTokens.
Trước tiên hãy xác định loại lỗi
API rate limit reached thường cho biết phía thượng nguồn trả về 429, giới hạn đồng thời hoặc hạn mức, không thể chỉ dựa vào câu này để kết luận là do 16k cấu hình ngữ cảnh gây ra. Trước tiên hãy xem mã trạng thái và lỗi gốc, rồi mới quyết định có sửa cấu hình hay không.
| Hiện tượng | Nguyên nhân có thể | Làm gì trước |
|---|---|---|
429, rate_limit, quota, too many requests | Thượng nguồn giới hạn tốc độ, đồng thời hoặc thiếu hạn mức | Hạ đồng thời và thử lại sau, kiểm tra hạn mức và trạng thái thượng nguồn |
context_length_exceeded, yêu cầu quá lớn, vượt giới hạn đầu vào | Đầu vào cộng đầu ra dự trữ vượt giới hạn model hoặc gateway | Rút gọn hội thoại, bật nén, rồi đối chiếu cấu hình ngữ cảnh |
| OpenClaw cửa sổ nhắc cục bộ quá nhỏ | Thiếu siêu dữ liệu model tùy chỉnh hoặc còn sót cấu hình cũ | Kiểm tra contextWindow, contextTokens, maxTokens |
| Chỉ một model lỗi | Vấn đề định tuyến model hoặc tham số của model đó | Dùng cùng Key và Base URL đổi sang model khác làm yêu cầu tối thiểu |
OpenClaw Vị trí Model Window trong trang cài đặt. Tên trường cụ thể có t…
Ba trường tương ứng với ý nghĩa gì
contextWindow: siêu dữ liệu cửa sổ ngữ cảnh nguyên bản của model.contextTokens: OpenClaw giới hạn thực tế được phép dùng cho đầu vào, có thể nhỏ hơn cửa sổ nguyên bản.maxTokens: giới hạn Token đầu ra tối đa của một lần phản hồi, không phải tổng kích thước ngữ cảnh.
Đừng nhập 1M bừa bãi chỉ để “có được ngữ cảnh lớn hơn”. Giá trị nhập phải đồng thời phù hợp với khả năng model, giới hạn định tuyến hiện tại của LLM API Gateway và phiên bản client.
Vị trí cấu hình
Cấu hình chính thường nằm tại:
~/.openclaw/openclaw.jsonKhi cấu hình riêng theo Agent thường nằm tại:
~/.openclaw/agents/<agentId>/agent/models.jsonNếu đã đặt OPENCLAW_AGENT_DIR, hãy đến thư mục đó để tìm cấu hình Agent tương ứng.
Ví dụ sửa an toàn
Các giá trị dưới đây chỉ minh họa mối quan hệ giữa các trường, không đại diện cho giới hạn thực tế của mọi model. Trước tiên hãy xác nhận giá trị trong danh sách model của trang này và hướng dẫn định tuyến hiện tại:
{
models: {
mode: "merge",
providers: {
guishu: {
baseUrl: "https://api.llm-token.cn/v1",
apiKey: "YOUR_API_KEY",
api: "openai-completions",
models: [
{
id: "YOUR_MODEL_ID",
name: "YOUR_MODEL_ID",
contextWindow: 128000,
contextTokens: 96000,
maxTokens: 8192,
input: ["text"]
}
]
}
}
}
}Giữ lại một phần cửa sổ cho system prompt, kết quả công cụ và đầu ra model. Nếu thượng nguồn chỉ cho phép đầu vào hoặc đầu ra nhỏ hơn, nên tiếp tục hạ xuống, không chỉ điền theo thông số quảng bá của hãng model.
Thứ tự sửa và xác minh
- Sao lưu tệp cấu hình hiện tại, đừng ghi đè trực tiếp bản sao duy nhất.
- Chỉ sửa mục provider và model hiện tại, giữ nguyên các cấu hình khác.
- Chạy
openclaw models list, xác nhận model được nhận diện. - Chạy
openclaw models set guishu/YOUR_MODEL_ID, xác nhận provider/model đang chọn là đúng. - Khởi động lại gateway:
openclaw gateway restart. - Trước tiên gửi một yêu cầu kiểm tra rất ngắn, rồi từ từ tăng ngữ cảnh.
Nếu yêu cầu ngắn vẫn trả về 429, tiếp tục tăng cửa sổ ngữ cảnh không giúp ích; nên chuyển sang kiểm tra đồng thời, hạn mức tài khoản và trạng thái thượng nguồn. Nếu chỉ yêu cầu dài mới lỗi, hãy kiểm tra độ dài đầu vào, chiến lược nén và ba trường ngữ cảnh.
Ảnh chụp cấu hình và log có thể chứa API Key. Trước khi gửi cho bộ phận hỗ trợ hãy che kín toàn bộ Key, chỉ giữ lại thời gian lỗi, mã trạng thái, ID model và ID yêu cầu.