Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Quay lại blog

GLM-5.3 API 2026: Ngữ cảnh 1M và giá 8x

GLM-5.3GLM APImô hình lập trìnhcoding agentngữ cảnh 1M

GLM-5.3 được phát hành ngày 14 tháng 8 năm 2026 và hiện có trên cổng này với ID mô hình glm-5.3 cùng cửa sổ ngữ cảnh 1M token. Cách tính phí giống GLM-5.2: một hệ số thống nhất 8x, khoảng CNY 3,2 cho mỗi triệu token. Cổng này không niêm yết mức 37,5x cho GLM-5.3.

Z.ai cho biết GLM-5.3 dùng cùng mô hình nền với GLM-5.2 và đạt cải thiện nhờ hậu huấn luyện tập trung vào lập trình phức tạp, agent chạy dài và năng lực an ninh mạng mới nổi. Bài viết tách riêng tuyên bố năng lực và benchmark chính thức của Z.ai với dữ liệu tuyến và giá của cổng này. Các điểm số công bố không phải thử nghiệm độc lập của trang web.

Hãy thử một yêu cầu nhỏ trước: kiểm tra giá mô hình trực tiếp hoặc bắt đầu tại trang mua API. Khả dụng, trọng số đầu ra và sổ phí tài khoản tại thời điểm gọi mới là căn cứ cuối cùng.

Thông số chính của GLM-5.3

Hạng mục Thông tin đã xác minh
Phát hành chính thức 14 tháng 8 năm 2026
ID mô hình API glm-5.3
Cửa sổ ngữ cảnh 1M token
Hệ số cổng 8x thống nhất, giống glm-5.2
Giá tham khảo trên cổng Khoảng CNY 3,2 mỗi triệu token
Tham số suy nghĩ thinking.type: "enabled"
Mức suy luận low, high hoặc max; mặc định chính thức là max
Trọng tâm Lập trình phức tạp, agent dài hạn, tác vụ terminal và nghiên cứu an ninh mạng
Định dạng tương thích Danh mục cổng liệt kê OpenAI và Anthropic
Đầu vào hình ảnh Chưa được xác nhận trên cổng này; không nên giả định có hỗ trợ

Xác minh lần cuối ngày 14 tháng 8 năm 2026. Hãy kiểm tra lại trang giá trực tiếp và danh mục mô hình trước khi triển khai production.

Tổng quan chính thức của Z.ai về năng lực lập trình, agent và an ninh mạng của GLM-5.3

Nguồn: bản phát hành GLM-5.3 chính thức của Z.ai. Các số liệu do nhà cung cấp công bố, không phải thử nghiệm độc lập của trang web này.

GLM-5.3 thay đổi gì so với GLM-5.2?

GLM-5.3 không phải một mô hình thay thế được xây trên nền lớn hơn. Theo Z.ai, nó dùng chung mô hình nền với GLM-5.2 và cải thiện nhờ hậu huấn luyện. Vì vậy, câu hỏi quan trọng là mô hình hoàn thành công việc khó đáng tin cậy đến đâu, chứ không chỉ là kích thước.

So sánh GLM-5.2 GLM-5.3
Mô hình nền Nền GLM-5.2 Giống GLM-5.2
Cập nhật chính Năng lực tổng quát, lập trình và agent hiện có Hậu huấn luyện mạnh hơn cho mã phức tạp và tác vụ dài hạn
Cửa sổ ngữ cảnh 1M token 1M token
Hệ số cổng 8x 8x
Giá tham khảo Khoảng CNY 3,2/M token Khoảng CNY 3,2/M token
Cấu hình suy nghĩ Xác nhận trên tuyến đang dùng Bắt buộc suy nghĩ; effort low/high/max

Nếu GLM-5.2 đang chạy ổn định trong production, chỉ riêng số phiên bản mới chưa phải lý do chuyển toàn bộ ngay. Hãy so sánh hai mô hình trên cùng repository, quyền công cụ, timeout, mức suy luận và lệnh nghiệm thu với một phần lưu lượng nhỏ.

Cách đọc benchmark chính thức của Z.ai

Z.ai gọi GLM-5.3 là mô hình lập trình mạnh nhất của họ dự kiến phát hành với trọng số mở và công bố nhiều mức tăng đáng kể. Đây là tuyên bố của nhà cung cấp, không phải kết luận độc lập. Tính đến ngày 14 tháng 8 năm 2026, trọng số vẫn chỉ được dự kiến công bố khoảng hai tuần sau khi ra mắt. Một số dữ liệu trong bản phát hành:

Benchmark do nhà cung cấp công bố GLM-5.2 GLM-5.3
Terminal Bench 3.0 4.6 28.3
DeepSWE v1.1 46.2 66.9
Agents' Last Exam 23.8 28.5
CyberGym 77.2 84.5
ExploitBench 24.4 54.4
ExploitGym 2h / 6h 29 / 39 105 / 130

Các số liệu này đến từ bản phát hành của Z.ai, không phải lần chạy lại độc lập của trang web. Harness, quyền dùng công cụ, ngân sách suy luận và phiên bản benchmark có thể khác nhau, nên không thể đổi trực tiếp chênh lệch thành tỷ lệ thành công trên repository của bạn. Z.ai còn báo cáo cải thiện 50% so với GLM-5.2 trên Code Bench nội bộ. Hãy xem đó là bằng chứng về hướng tối ưu của nhà cung cấp, không phải bảng xếp hạng trung lập.

Biểu đồ Code Bench và hiệu quả token GLM-5.3 chính thức của Z.ai

Biểu đồ Code Bench nội bộ của Z.ai. Hãy bổ sung bài kiểm thử nghiệm thu trên repository trước khi chọn mô hình production.

“Năng lực an ninh mạng mới nổi” nghĩa là gì?

Z.ai nhấn mạnh GLM-5.3 có thể thực hiện chuỗi phát hiện và xác minh lỗ hổng dài hơn khi được cấp mã, terminal và phản hồi. Điều này hữu ích cho đánh giá bảo mật được ủy quyền, môi trường CTF, xác minh nâng cấp dependency và red-team nội bộ. Nó không phải quyền kiểm thử hệ thống khi chưa được phép.

Với agent bảo mật, hãy giới hạn rõ domain, repository, thông tin xác thực, lưu lượng ra ngoài và lệnh thực thi. Duy trì phê duyệt của con người cho việc xóa dữ liệu, đổi quyền, triển khai production và thao tác mạng bên ngoài. Năng lực mạnh hơn đòi hỏi sandbox tốt hơn, log kiểm toán đầy đủ và cơ chế dừng đáng tin cậy.

Biểu đồ chính thức của Z.ai về tác vụ an ninh mạng và lỗ hổng GLM-5.3

Biểu đồ năng lực an ninh mạng chính thức của Z.ai. Biểu đồ mô tả hướng năng lực do nhà cung cấp công bố, không khuyến nghị kiểm thử trái phép.

Giá GLM-5.3: giống GLM-5.2 trên cổng này

Cổng này hiện gán cho cả glm-5.3glm-5.2 một hệ số thống nhất 8x, giá tham khảo khoảng CNY 3,2 mỗi triệu token. GLM-5.3 không được niêm yết ở mức 37,5x, và hệ số không đổi khi prompt dài hơn.

8x và CNY 3,2 là điều khoản tính phí của cổng này, không phải giá API trực tiếp của Z.ai. Trọng số completion, nhóm tài khoản, cache, khuyến mãi hoặc thay đổi giá sau này có thể ảnh hưởng sổ phí. Bắt đầu bằng yêu cầu ngắn, không stream và ghi lại token đầu vào, token đầu ra cùng chi phí thực tế.

Cần kiểm tra chi phí có kiểm soát? Mở số dư nhỏ tại trang mua API, hoặc nạp tiền cho key hiện có, rồi chạy một yêu cầu smoke trước khi tăng lưu lượng.

Cách gọi GLM-5.3 API

Dùng đúng ID glm-5.3. GLM-5.3 bắt buộc duy trì suy nghĩ ở trạng thái bật. Nếu ứng dụng cũ gửi thinking.type: "disabled", hãy đổi trước khi chuyển mô hình, nếu không yêu cầu sẽ thất bại.

curl https://api.llm-token.cn/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3",
    "messages": [
      {"role": "user", "content": "Phân tích các bài kiểm thử đang lỗi trong repository này. Giải thích nguyên nhân gốc trước khi thay đổi."}
    ],
    "thinking": {"type": "enabled"},
    "reasoning_effort": "max"
  }'

reasoning_effort nhận low, high hoặc max, với mặc định chính thức là max. Z.ai khuyến nghị max cho lập trình, nhưng đội production vẫn cần đo độ trễ và lượng token. Router thực tế có thể dùng low cho phân loại và chỉnh sửa nhỏ, dành high hoặc max cho debug khó, triển khai cấp repository và đánh giá bảo mật.

Danh mục cổng liệt kê định dạng tương thích OpenAI và Anthropic. Khi cấu hình Claude Code, OpenCode, ZCode hoặc agent khác, hãy kiểm tra riêng base URL, ID mô hình, tool call, streaming, trường usage và timeout. Một phản hồi văn bản thành công chưa phải kiểm thử tương thích đầy đủ.

Trường hợp dùng coding agent GLM-5.3 phù hợp nhất

  • Triển khai cấp repository qua nhiều tệp và module
  • Agent dài hạn liên tục đọc, sửa, kiểm thử và khắc phục
  • Chẩn đoán terminal, build và xung đột dependency phức tạp
  • Nghiên cứu lỗ hổng được ủy quyền, hồi quy bảo mật và CTF
  • Quy trình ngữ cảnh 1M trên repository hoặc bộ tài liệu lớn
  • Tác vụ nhiều công cụ cần lập kế hoạch, thực thi và xác minh dài hạn

Phân loại, tóm tắt ngắn, điền mẫu và chat đơn giản số lượng lớn có thể rẻ hơn với effort thấp hoặc mô hình có hệ số thấp hơn. So sánh các tuyến trong danh sách mô hình, đồng thời đối chiếu ngữ cảnh 1M và điều khoản phí trong hướng dẫn DeepSeek-V4-Pro-0813.

Danh sách kiểm tra đánh giá production

  1. Sao chép glm-5.3 từ danh mục trực tiếp thay vì đoán alias có ngày.
  2. Xóa hoặc đổi thinking.type: "disabled" trong payload cũ.
  3. Đo tỷ lệ nghiệm thu, độ trễ và usage ở low, high, max.
  4. Cố định commit repository, câu chữ tác vụ, quyền công cụ và lệnh nghiệm thu.
  5. Giới hạn số tool call, đầu ra tối đa, timeout mỗi lần gọi và tổng ngân sách.
  6. Ghi request ID, tuyến, trạng thái, thời gian đến token đầu tiên, tổng thời lượng, usage và kết quả được chấp nhận.
  7. Giữ phê duyệt thủ công cho ghi tệp, triển khai, thanh toán, quyền tài khoản và hệ thống bên ngoài.
  8. Duy trì tuyến dự phòng cho timeout, thiếu dung lượng và sự cố upstream.

Điểm chính

  • ID chính xác là glm-5.3, với cửa sổ ngữ cảnh 1M token.
  • Trên cổng này, GLM-5.3 giống GLM-5.2: hệ số thống nhất 8x, khoảng CNY 3,2 mỗi triệu token.
  • Phải bật thinking; GLM-5.3 nhận low, high, max và mặc định max.
  • Kết quả lập trình, agent và an ninh mạng của Z.ai là bằng chứng do nhà cung cấp công bố, không phải thử nghiệm độc lập của trang web.
  • Cửa sổ 1M không đảm bảo mọi client gửi được chính xác 1M token đầu vào.
  • Chọn cho production cần đo tác vụ được chấp nhận, token, độ trễ và công sức sửa lại trên tải thực.

Câu hỏi thường gặp

GLM-5.3 đã chính thức phát hành chưa?

Có. Z.ai phát hành GLM-5.3 ngày 14 tháng 8 năm 2026 và cổng này hiện đã liệt kê tuyến glm-5.3.

Cửa sổ ngữ cảnh GLM-5.3 là bao nhiêu?

1M token. Đầu vào sử dụng được còn phụ thuộc system instruction, transcript công cụ, giới hạn client và phần dành cho đầu ra.

Hệ số GLM-5.3 trên cổng này là bao nhiêu?

Một hệ số thống nhất 8x, giống GLM-5.2, giá tham khảo khoảng CNY 3,2 mỗi triệu token. Không phải 37,5x và không chia bậc theo độ dài ngữ cảnh.

Tôi có thể tắt thinking cho GLM-5.3 không?

Không. Bản phát hành chính thức yêu cầu thinking.typeenabled; disabled không còn được hỗ trợ. Hãy sửa payload cũ trước khi di chuyển.

Nên chọn reasoning_effort nào?

Bắt đầu với low cho việc đơn giản và thử high hoặc max được khuyến nghị chính thức cho lập trình phức tạp. Dùng bộ nghiệm thu của bạn để cân bằng chất lượng, độ trễ và chi phí.

GLM-5.3 có dùng được với Claude Code hoặc OpenCode không?

Z.ai liệt kê Claude Code, OpenCode và ZCode. Cổng này có tuyến tương thích OpenAI và Anthropic; hãy xác minh message, tool, streaming, timeout và tính phí trên đúng client.

Trọng số mở GLM-5.3 đã được phát hành chưa?

Chưa, tại thời điểm bài viết được xác minh. Z.ai cho biết dự kiến công bố trọng số khoảng hai tuần sau khi ra mắt, sau công việc an toàn và gia cố bổ sung. Hãy kiểm tra repository chính thức để biết trạng thái thực tế.

Tôi có thể mua hoặc nạp quyền truy cập GLM-5.3 API ở đâu?

Người dùng mới có thể bắt đầu tại trang mua API. Người đã có key có thể nạp tiền.

Nguồn chính