Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

OpenClaw Kiểm tra cửa sổ ngữ cảnh và giới hạn tốc độ

Phân biệt 429 giới hạn tốc độ, vượt ngữ cảnh và lỗi siêu dữ liệu model cục bộ, sau đó điều chỉnh an toàn contextWindow, contextTokens và maxTokens.

Trước tiên hãy xác định loại lỗi

API rate limit reached thường cho biết phía thượng nguồn trả về 429, giới hạn đồng thời hoặc hạn mức, không thể chỉ dựa vào câu này để kết luận là do 16k cấu hình ngữ cảnh gây ra. Trước tiên hãy xem mã trạng thái và lỗi gốc, rồi mới quyết định có sửa cấu hình hay không.

Hiện tượngNguyên nhân có thểLàm gì trước
429, rate_limit, quota, too many requestsThượng nguồn giới hạn tốc độ, đồng thời hoặc thiếu hạn mứcHạ đồng thời và thử lại sau, kiểm tra hạn mức và trạng thái thượng nguồn
context_length_exceeded, yêu cầu quá lớn, vượt giới hạn đầu vàoĐầu vào cộng đầu ra dự trữ vượt giới hạn model hoặc gatewayRút gọn hội thoại, bật nén, rồi đối chiếu cấu hình ngữ cảnh
OpenClaw cửa sổ nhắc cục bộ quá nhỏThiếu siêu dữ liệu model tùy chỉnh hoặc còn sót cấu hình cũKiểm tra contextWindow, contextTokens, maxTokens
Chỉ một model lỗiVấn đề định tuyến model hoặc tham số của model đóDùng cùng Key và Base URL đổi sang model khác làm yêu cầu tối thiểu

OpenClaw Vị trí Model Window trong trang cài đặt. Tên trường cụ thể có thể thay đổi theo phiên bản, lấy trang hiện tại và tệp cấu hình làm chuẩn.OpenClaw Vị trí Model Window trong trang cài đặt. Tên trường cụ thể có t…

Ba trường tương ứng với ý nghĩa gì

  • contextWindow: siêu dữ liệu cửa sổ ngữ cảnh nguyên bản của model.
  • contextTokens: OpenClaw giới hạn thực tế được phép dùng cho đầu vào, có thể nhỏ hơn cửa sổ nguyên bản.
  • maxTokens: giới hạn Token đầu ra tối đa của một lần phản hồi, không phải tổng kích thước ngữ cảnh.

Đừng nhập 1M bừa bãi chỉ để “có được ngữ cảnh lớn hơn”. Giá trị nhập phải đồng thời phù hợp với khả năng model, giới hạn định tuyến hiện tại của LLM API Gateway và phiên bản client.

Vị trí cấu hình

Cấu hình chính thường nằm tại:

~/.openclaw/openclaw.json

Khi cấu hình riêng theo Agent thường nằm tại:

~/.openclaw/agents/<agentId>/agent/models.json

Nếu đã đặt OPENCLAW_AGENT_DIR, hãy đến thư mục đó để tìm cấu hình Agent tương ứng.

Ví dụ sửa an toàn

Các giá trị dưới đây chỉ minh họa mối quan hệ giữa các trường, không đại diện cho giới hạn thực tế của mọi model. Trước tiên hãy xác nhận giá trị trong danh sách model của trang này và hướng dẫn định tuyến hiện tại:

{
  models: {
    mode: "merge",
    providers: {
      guishu: {
        baseUrl: "https://api.llm-token.cn/v1",
        apiKey: "YOUR_API_KEY",
        api: "openai-completions",
        models: [
          {
            id: "YOUR_MODEL_ID",
            name: "YOUR_MODEL_ID",
            contextWindow: 128000,
            contextTokens: 96000,
            maxTokens: 8192,
            input: ["text"]
          }
        ]
      }
    }
  }
}

Giữ lại một phần cửa sổ cho system prompt, kết quả công cụ và đầu ra model. Nếu thượng nguồn chỉ cho phép đầu vào hoặc đầu ra nhỏ hơn, nên tiếp tục hạ xuống, không chỉ điền theo thông số quảng bá của hãng model.

Thứ tự sửa và xác minh

  1. Sao lưu tệp cấu hình hiện tại, đừng ghi đè trực tiếp bản sao duy nhất.
  2. Chỉ sửa mục provider và model hiện tại, giữ nguyên các cấu hình khác.
  3. Chạy openclaw models list, xác nhận model được nhận diện.
  4. Chạy openclaw models set guishu/YOUR_MODEL_ID, xác nhận provider/model đang chọn là đúng.
  5. Khởi động lại gateway: openclaw gateway restart.
  6. Trước tiên gửi một yêu cầu kiểm tra rất ngắn, rồi từ từ tăng ngữ cảnh.

Nếu yêu cầu ngắn vẫn trả về 429, tiếp tục tăng cửa sổ ngữ cảnh không giúp ích; nên chuyển sang kiểm tra đồng thời, hạn mức tài khoản và trạng thái thượng nguồn. Nếu chỉ yêu cầu dài mới lỗi, hãy kiểm tra độ dài đầu vào, chiến lược nén và ba trường ngữ cảnh.

Ảnh chụp cấu hình và log có thể chứa API Key. Trước khi gửi cho bộ phận hỗ trợ hãy che kín toàn bộ Key, chỉ giữ lại thời gian lỗi, mã trạng thái, ID model và ID yêu cầu.