GLM-5.3 API 2026: контекст 1M и тариф 8x
GLM-5.3 выпущена 14 августа 2026 года и уже доступна на этом шлюзе под идентификатором glm-5.3 с контекстным окном 1M токенов. Тарификация шлюза совпадает с GLM-5.2: единый множитель 8x, примерно CNY 3,2 за миллион токенов. Для GLM-5.3 здесь нет тарифа 37,5x.
По данным Z.ai, GLM-5.3 использует ту же базовую модель, что и GLM-5.2, а улучшения получены за счет постобучения для сложного программирования, длительных агентных задач и формирующихся возможностей в кибербезопасности. В статье официальные заявления и бенчмарки Z.ai отделены от данных этого шлюза о маршруте и цене. Опубликованные результаты не являются независимыми тестами этого сайта.
Сначала выполните небольшой тест: проверьте актуальную цену модели или начните со страницы покупки API. На момент запроса решающее значение имеют фактическая доступность, вес вывода и журнал списаний аккаунта.
Основные характеристики GLM-5.3
| Параметр | Проверенные сведения |
|---|---|
| Официальный выпуск | 14 августа 2026 года |
| Идентификатор API | glm-5.3 |
| Контекстное окно | 1M токенов |
| Множитель шлюза | Единый 8x, как у glm-5.2 |
| Ориентировочная ставка шлюза | Около CNY 3,2 за миллион токенов |
| Параметр мышления | thinking.type: "enabled" |
| Интенсивность рассуждения | low, high или max; официальный вариант по умолчанию — max |
| Основное назначение | Сложное программирование, длительные агенты, терминальные задачи и исследования безопасности |
| Совместимые форматы | В каталоге шлюза указаны OpenAI и Anthropic |
| Ввод изображений | На этом шлюзе не подтвержден; не следует считать его доступным |
Последняя проверка — 14 августа 2026 года. Перед производственным запуском снова сверьтесь со страницей цен и каталогом моделей.

Источник: официальный релиз GLM-5.3 от Z.ai. На диаграмме показаны результаты, опубликованные поставщиком, а не независимые тесты этого сайта.
Что изменилось между GLM-5.2 и GLM-5.3?
GLM-5.3 не является заменой на базе более крупной модели. По заявлению Z.ai, она использует ту же основу, что GLM-5.2, а прирост обеспечен постобучением. Поэтому важнее оценивать надежность выполнения сложной работы, а не только размер модели.
| Сравнение | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Базовая модель | База GLM-5.2 | Та же, что у GLM-5.2 |
| Главное обновление | Существующие общие, программные и агентные возможности | Усиленное постобучение для сложного кода и длительных задач |
| Контекстное окно | 1M токенов | 1M токенов |
| Множитель шлюза | 8x | 8x |
| Ориентировочная ставка | Около CNY 3,2/M токенов | Около CNY 3,2/M токенов |
| Настройка мышления | Уточняйте на активном маршруте | Мышление обязательно; effort low/high/max |
Если GLM-5.2 уже стабильно работает в продакшене, одно новое имя версии не требует немедленной полной миграции. Сравните обе модели на одинаковых репозиториях, правах инструментов, таймаутах, уровне рассуждения и командах приемки, начав с небольшой доли трафика.
Как читать официальные бенчмарки Z.ai
Z.ai позиционирует GLM-5.3 как свою наиболее способную модель для программирования, предназначенную к выпуску с открытыми весами, и публикует заметный прирост. Это заявление поставщика, а не независимое заключение. По состоянию на 14 августа 2026 года веса еще не были опубликованы: выпуск планировался примерно через две недели после запуска. Выборочные данные релиза:
| Бенчмарк, опубликованный поставщиком | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Terminal Bench 3.0 | 4.6 | 28.3 |
| DeepSWE v1.1 | 46.2 | 66.9 |
| Agents' Last Exam | 23.8 | 28.5 |
| CyberGym | 77.2 | 84.5 |
| ExploitBench | 24.4 | 54.4 |
| ExploitGym 2h / 6h | 29 / 39 | 105 / 130 |
Эти цифры взяты из релиза Z.ai и не воспроизводились независимо этим сайтом. Среды, доступ к инструментам, бюджеты рассуждения и версии бенчмарков могут различаться, поэтому разницу нельзя напрямую превращать в вероятность успеха на вашем репозитории. Z.ai также сообщает о росте на 50% относительно GLM-5.2 во внутреннем Code Bench. Это свидетельство направления оптимизации поставщика, но не нейтральный рейтинг.

Внутренняя диаграмма Z.ai Code Bench. Перед выбором производственной модели добавьте приемочные тесты на своем репозитории.
Что означает «формирующаяся способность к кибербезопасности»?
Z.ai подчеркивает способность GLM-5.3 выполнять более длинные цепочки поиска и проверки уязвимостей при наличии кода, терминала и обратной связи. Это может быть полезно для авторизованных проверок безопасности, CTF, валидации обновлений зависимостей и внутренних red-team задач. Это не разрешение тестировать чужие системы.
Для агентов безопасности явно ограничьте домены, репозитории, учетные данные, исходящий трафик и исполняемые команды. Сохраняйте одобрение человеком для удаления данных, изменения прав, развертывания в продакшене и внешних сетевых действий. Более сильная модель требует надежной песочницы, полных журналов аудита и работающего аварийного выключателя.

Официальная диаграмма Z.ai по кибервозможностям. Она показывает опубликованное поставщиком направление возможностей и не рекомендует несанкционированное тестирование.
Цена GLM-5.3: здесь такая же, как у GLM-5.2
На этом шлюзе glm-5.3 и glm-5.2 сейчас имеют единый множитель 8x и ориентировочную ставку около CNY 3,2 за миллион токенов. GLM-5.3 не указана с множителем 37,5x, и он не меняется с увеличением длины запроса.
8x и CNY 3,2 — условия этого шлюза, а не официальная прямая цена API Z.ai. Итоговое списание может зависеть от веса вывода, группы аккаунта, кэша, акций и будущих изменений. Начните с короткого нестримингового запроса и запишите входные токены, выходные токены и реальную сумму.
Нужна контролируемая проверка стоимости? Откройте небольшой баланс на странице покупки API или пополните существующий ключ, затем выполните один smoke-запрос до увеличения трафика.
Как вызвать GLM-5.3 API
Используйте точный идентификатор glm-5.3. GLM-5.3 требует включенного мышления. Если приложение отправляет thinking.type: "disabled", исправьте это до смены модели, иначе запрос завершится ошибкой.
curl https://api.llm-token.cn/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [
{"role": "user", "content": "Проанализируй падающие тесты в этом репозитории. До изменений объясни первопричину."}
],
"thinking": {"type": "enabled"},
"reasoning_effort": "max"
}'
reasoning_effort принимает low, high или max; официальный вариант по умолчанию — max. Z.ai рекомендует max для программирования, но в продакшене все равно следует измерять задержку и расход токенов. Практический маршрутизатор может применять low для классификации и мелких правок, а high или max — для сложной отладки, работ на уровне репозитория и аудита безопасности.
В каталоге шлюза указаны совместимые форматы OpenAI и Anthropic. Настраивая Claude Code, OpenCode, ZCode или другой агент, отдельно проверьте базовый URL, идентификатор модели, инструменты, потоковую передачу, поля usage и таймауты. Один успешный текстовый ответ не доказывает полную совместимость.
Лучшие сценарии для агента программирования GLM-5.3
- Реализация на уровне репозитория через несколько файлов и модулей
- Длительные агенты, которые читают, изменяют, тестируют и исправляют
- Диагностика сложных терминальных, сборочных и зависимостных ошибок
- Авторизованный поиск уязвимостей, регрессии безопасности и CTF
- Рабочие процессы с контекстом 1M для больших репозиториев или документов
- Многоинструментальные задачи с длительным планированием, выполнением и проверкой
Для классификации, коротких резюме, заполнения шаблонов и массового простого чата могут быть выгоднее меньший effort или модель с меньшим множителем. Сравните маршруты в списке моделей и условия контекста 1M в руководстве DeepSeek-V4-Pro-0813.
Чек-лист производственной оценки
- Копируйте
glm-5.3из актуального каталога, а не угадывайте псевдоним с датой. - Удалите или измените
thinking.type: "disabled"в старых запросах. - Измерьте приемку, задержку и usage при
low,highиmax. - Зафиксируйте commit репозитория, формулировку задачи, права инструментов и команды приемки.
- Ограничьте число инструментов, максимальный вывод, таймаут вызова и общий бюджет.
- Логируйте request ID, маршрут, статус, время до первого токена, общую длительность, usage и результат приемки.
- Оставьте одобрение человеком для записи файлов, развертывания, платежей, прав аккаунта и внешних действий.
- Подготовьте резервный маршрут на случай таймаута, нехватки мощности или сбоя upstream.
Главное
- Точный идентификатор —
glm-5.3, контекстное окно — 1M токенов. - На этом шлюзе GLM-5.3 совпадает с GLM-5.2: единый множитель 8x, около CNY 3,2 за миллион токенов.
- Мышление должно быть включено; доступны
low,high,max, по умолчаниюmax. - Результаты Z.ai по коду, агентам и киберзадачам опубликованы поставщиком и не являются независимыми тестами сайта.
- Окно 1M не гарантирует, что каждый клиент сможет отправить ровно 1M входных токенов.
- Для продакшена измеряйте принятые задачи, токены, задержку и доработки инженеров на реальной нагрузке.
Часто задаваемые вопросы
GLM-5.3 официально выпущена?
Да. Z.ai выпустила GLM-5.3 14 августа 2026 года, и на этом шлюзе уже указан маршрут glm-5.3.
Какое контекстное окно у GLM-5.3?
1M токенов. Полезный объем входа также зависит от системных инструкций, истории инструментов, ограничений клиента и зарезервированного вывода.
Какой множитель GLM-5.3 на этом шлюзе?
Единый 8x, как у GLM-5.2, с ориентировочной ценой около CNY 3,2 за миллион токенов. Это не 37,5x, и тариф не зависит от длины контекста.
Можно ли отключить мышление в GLM-5.3?
Нет. В официальном релизе указано, что thinking.type должен быть enabled; disabled больше не поддерживается. Исправьте старые payload до миграции.
Какой reasoning_effort выбрать?
Начните с low для простых задач и проверьте high либо официально рекомендуемый max для сложного кода. Балансируйте качество, задержку и стоимость по своей приемочной системе.
Работает ли GLM-5.3 с Claude Code или OpenCode?
Z.ai перечисляет Claude Code, OpenCode и ZCode. Шлюз предоставляет маршруты, совместимые с OpenAI и Anthropic; проверьте сообщения, инструменты, стриминг, таймауты и списания в своем клиенте.
Открытые веса GLM-5.3 уже опубликованы?
На момент проверки статьи — нет. Z.ai планировала опубликовать веса примерно через две недели после запуска, после дополнительной работы над безопасностью и усилением. Проверяйте фактический статус в официальном репозитории.
Где купить или пополнить доступ к GLM-5.3 API?
Новые пользователи могут начать на странице покупки API, а владельцы ключей — использовать пополнение.
Основные источники
- Z.ai: GLM-5.3: Frontier Coding with Emergent Cyber Capabilities: дата выпуска, общая база, постобучение, параметры мышления, оценки кода и киберзадач, план публикации весов
- Z.ai: GLM-5.2: сведения о базовой модели и контексте 1M
- Руководство по моделям шлюза: актуальный маршрут, контекст 1M, множитель 8x и форматы API