GLM-5.3 или GLM-5.2 для программирования
GLM-5.3 сохраняет базовую модель и официальную цену GLM-5.2, но меняет выбор за счет усиленного post-training, новых уровней effort и несовместимой миграции thinking.
GLM-5.3 или GLM-5.2 для программирования - это прежде всего сравнение post-training, а не двух разных базовых моделей. Z.ai сообщает, что обе версии используют одну основу. GLM-5.3 получает дополнительное обучение в исполняемых long-horizon средах и показывает заявленный рост в coding, agent и security тестах.
Практический ответ теперь яснее, чем в день запуска. Для сложной и долгой работы GLM-5.3 выглядит более сильным кандидатом на оценку: API, открытые веса и маршрут OmniaKey уже доступны. Но это не безрисковая замена model ID: reasoning всегда включен, thinking.type: "disabled" отклоняется, а поведение нужно проверять в том же harness и с теми же правами, что у 5.2.
Проверено 18 сентября 2026 года. Характеристики, benchmark-значения, параметры reasoning, endpoints, цены, Coding Plan, открытые веса и доступность OmniaKey сверены с документацией и прайсингом Z.ai, анонсом, официальной карточкой модели и живым каталогом OmniaKey. Ниже приведены результаты Z.ai, а не независимый benchmark.
GLM-5.3 и GLM-5.2 в одном сравнении
| Критерий | GLM-5.3 | GLM-5.2 |
|---|---|---|
| Базовая модель | Та же, что у 5.2 | Общая основа обеих версий |
| Главное изменение | Больше post-training на длинных expert workflows | Предыдущий stack и baseline |
| Контекст | 1M токенов | 1M токенов |
| Максимальный output | 128K токенов | 128K токенов |
| Thinking | Всегда включен | Можно включать и отключать |
| Reasoning effort | low, high, max; default max | Имеющиеся настраиваемые уровни |
| Coding Plan | Доступен в день запуска | Доступен |
| Developer API | Доступен как glm-5.3 | Доступен как glm-5.2 |
| Официальная цена | $1.40 input / $0.26 cached input / $4.40 output за 1M токенов | Такая же |
| Открытые веса | Опубликованы как zai-org/GLM-5.3 | Доступны по текущему пути |
| Каталог OmniaKey | Доступен как glm-5.3 | Доступен как glm-5.2 |
Нужно разделить два вопроса:
- Стоит ли оценивать GLM-5.3? Да, особенно для long-horizon coding.
- Стоит ли сегодня переводить весь production API? Нет, пока не измерены совместимость, effort, latency и стоимость принятой задачи.
Страницы GLM-5.3 и GLM-5.2 отвечают за текущую цену, пример запроса и доступность OmniaKey. Руководство по цене API GLM-5.2 сохраняет расчеты. Эта статья отвечает только за решение об обновлении.
Что действительно изменилось в GLM-5.3?
Z.ai прямо пишет, что GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Заявленный прогресс обеспечен масштабированием post-training на длинных задачах.
Новый номер не обязательно означает большее окно, новую архитектуру или другой pretraining corpus. Здесь заявлен рост качества поведения после обучения на большем числе сред, разнообразных задач и длинных профессиональных workflows.
Z.ai описывает целые инженерные единицы работы, а не отдельные упражнения. Модель может читать codebase и документацию, работать с compute и storage, диагностировать узкое место, вносить изменения, запускать эксперименты и сохранять корректность до поставки.
Именно такую цепочку следует тестировать:
понять цель
-> изучить среду
-> спланировать и изменить
-> запустить tools и tests
-> разобрать ошибки
-> проверить результат
Короткий autocomplete prompt не измерит главное заявленное отличие.
Официальное сравнение coding benchmarks
В отчете опубликованы следующие значения:
| Benchmark | GLM-5.3 | GLM-5.2 | Заявленная разница |
|---|---|---|---|
| Terminal-Bench 2.1 | 88.2 | 81.0 | +7.2 пункта |
| Terminal-Bench 3.0 | 28.3 | 4.6 | +23.7 пункта |
| DeepSWE v1.1 | 66.9 | 46.2 | +20.7 пункта |
| NL2Repo | 58.0 | 48.9 | +9.1 пункта |
| FrontierSWE | 78.1 | 67.5 | +10.6 пункта |
| SWE-Marathon v1.1 | 42.5 | 19.4 | +23.1 пункта |
| PostTrainBench | 39.8 | 31.7 | +8.1 пункта |
| Agents' Last Exam CLI | 28.5 | 23.8 | +4.7 пункта |
Z.ai также заявляет рост на 50% относительно GLM-5.2 в закрытом Z.ai Code Bench. При Max effort график показывает 34.5% примерно с 75K output-токенов на задачу для 5.3 против 23.4% с 96K для 5.2.
Этого достаточно, чтобы поставить 5.3 в очередь тестов, но недостаточно для универсального обещания 50%. Закрытый benchmark нельзя воспроизвести из анонса, а публичные зависят от конкретных harness, timeout, token limit, sampling и scoring.
Например, Terminal-Bench 3.0 использовал Claude Code 2.1.207, reasoning_effort=max, 400K контекста, до 128K output, до 600 agent turns, десятичасовой timeout и три запуска на задачу. Пятиминутный smoke test - другой эксперимент.
Меняется и граница безопасности
Z.ai добавил среды поиска уязвимостей и сообщил:
| Security benchmark | GLM-5.3 | GLM-5.2 |
|---|---|---|
| CyberGym | 84.5 | 77.2 |
| ExploitBench | 54.4 | 24.4 |
| ExploitGym, два часа | 105 задач | 29 задач |
| ExploitGym, шесть часов | 130 задач | 39 задач |
Это полезно для разрешенного defensive review, но требует более строгих мер: минимальные permissions, изолированное выполнение, ограниченная сеть, журналы tools и ручное подтверждение чувствительных изменений.
Возможность benchmark не дает разрешения. Найденный exploit нельзя проверять на чужой системе без полномочий.
Миграция API ломает одну настройку thinking
GLM-5.3 поддерживает три уровня:
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}
Разрешены low, high, max; Z.ai указывает max как default и рекомендует его для coding.
Больше не поддерживается:
"thinking": { "type": "disabled" }
Z.ai предупреждает, что такой запрос завершится ошибкой. До смены model ID настройте:
{
"thinking": { "type": "enabled" },
"reasoning_effort": "low"
}
Если thinking раньше был выключен, начните с low, затем тестируйте high и max на реальной работе. Не меняйте одновременно модель и effort без измерения latency, output и acceptance.
API, Coding Plan и открытые веса уже доступны
Сроки запуска различались, но на 18 сентября 2026 года доступны все три пути:
- GLM Coding Plan: доступен всем пользователям плана.
- Developer API: официальная страница документирует
glm-5.3для OpenAI Chat Completions, OpenAI Responses и Anthropic Messages. - Открытые веса: Z.ai опубликовала карточку
zai-org/GLM-5.3и инструкции по развертыванию.
Эти варианты по-прежнему не взаимозаменяемы: Coding Plan, тарифицируемый API и self-hosting имеют разные биллинг, квоты, операционные требования и поддержку.
Каталог OmniaKey теперь перечисляет glm-5.3 и glm-5.2 как отдельные ID. OmniaKey не подменяет модели молча, поэтому запрошенный ID виден в usage и billing.
У GLM-5.3 и GLM-5.2 одинаковая официальная цена API
Z.ai указывает для обеих моделей $1.40 за миллион uncached input, $0.26 за cached input и $4.40 за output; хранение cache отмечено как временно бесплатное.
Одинаковая ставка убирает один фактор сравнения, но не делает стоимость задачи одинаковой: различаются reasoning/output tokens, retries и human correction. Points Coding Plan, прямой API и gateway — разные биллинговые отношения.
Перед production migration нужны:
- официальные ставки input, cached input и output;
- условия cache storage или write;
- региональная доступность модели и API;
- rate limits и concurrency;
- фактический token usage каждого reasoning effort.
OmniaKey сейчас применяет к обеим моделям одну ценовую связь с Z.ai; точную котировку проверяйте на странице каждой модели. Руководство по цене полезно для cache-арифметики, но не заменяет живой каталог.
Стоит ли обновляться с GLM-5.2?
Оценивайте GLM-5.3, когда
- задача проходит через много файлов, систем или этапов проверки;
- GLM-5.2 теряет план в длинной цепочке tools;
- основная нагрузка - сложный debugging и repository-level изменения;
- выполняется разрешенный security review;
- можно провести matched test через поддерживаемый путь.
Оставайтесь на GLM-5.2, когда
- production стабилен, а цена известна;
- клиент зависит от
thinking.type: "disabled"; - задача короткая и уже надежно проходит;
- для 5.3 пока нельзя повторить permissions, tools и acceptance.
Номер версии не является решением. Обновляйтесь, когда новая модель улучшает accepted-task cost или надежность вашей нагрузки.
Как провести честный тест
Зафиксируйте условия:
| Контроль | Что оставить одинаковым |
|---|---|
| Репозиторий | Один commit и состояние dependencies |
| Prompt | Одна цель, ограничения и definition of done |
| Harness | Одна версия клиента и context policy |
| Permissions | Одинаковые filesystem, shell, network и approvals |
| Tools | Один набор и внешние сервисы |
| Budget | Сопоставимые timeout, turn cap и effort |
| Проверка | Одинаковые tests, lint, build и review rubric |
Записывайте pass rate, время, input, cache, output, retries, tool failures, ручную коррекцию и billed cost. Повторяйте тест, потому что long-horizon agents дают вариативные результаты.
Руководство по coding-моделям объясняет routing классов задач вместо выбора универсального победителя.
Итог
GLM-5.3 - содержательный coding release, а не косметический номер. Масштаб заявленных улучшений оправдывает приоритетную проверку на сложной repository-работе.
Это не универсальная drop-in замена GLM-5.2: API, цена, веса и маршрут OmniaKey уже доступны, но thinking config требует миграции, а production-поведение — парного теста.
Начинайте новые тесты long-horizon coding с GLM-5.3. Оставляйте 5.2, если workflow зависит от отключаемого thinking или доказательств регрессии пока недостаточно.
Частые вопросы
GLM-5.3 лучше GLM-5.2 для программирования?
Z.ai сообщает более высокие результаты в закрытом Code Bench и нескольких публичных тестах. Это делает 5.3 более сильным кандидатом, но не универсальной гарантией.
GLM-5.3 использует новую базовую модель?
Нет. Z.ai сообщает об одной базе с GLM-5.2 и улучшениях за счет дополнительного post-training.
Доступен ли API GLM-5.3?
Да. Developer-страница содержит endpoints и примеры для glm-5.3; Coding Plan, metered API и self-hosting остаются разными путями.
Сколько стоит API GLM-5.3?
Z.ai указывает для GLM-5.3 $1.40 за миллион uncached input, $0.26 за cached input и $4.40 за output — столько же, сколько для GLM-5.2 на дату проверки.
Что ломается при миграции?
GLM-5.3 не поддерживает thinking.type: "disabled". Нужно включить thinking и поставить reasoning_effort в low до смены model ID.
Можно ли уже использовать GLM-5.3 через OmniaKey?
Да. OmniaKey перечисляет glm-5.3 и glm-5.2 как отдельные ID; перед production migration проверьте живую котировку.
Проверенные источники
- Z.ai: отчет о запуске GLM-5.3
- Z.ai: developer-страница GLM-5.3
- Z.ai: цены developer API
- Z.ai: страница GLM-5.2
- Z.ai: официальная карточка GLM-5.3
- Живой каталог OmniaKey
Факты проверены 18 сентября 2026 года. Доступ, availability, pricing, benchmark docs и client support могут измениться. Перед production migration проверяйте первичные источники.