GPT-6 Sol и Claude Opus 5.5 уже доступныGPT-6 Sol вдвое дешевле 5.6 Sol
Блог
Сравнение

GLM-5.3 или GLM-5.2 для программирования

GLM-5.3 сохраняет базовую модель и официальную цену GLM-5.2, но меняет выбор за счет усиленного post-training, новых уровней effort и несовместимой миграции thinking.

12 мин чтенияOmniaKey
GLM-5.3GLM-5.2AI codingmodel comparison

GLM-5.3 или GLM-5.2 для программирования - это прежде всего сравнение post-training, а не двух разных базовых моделей. Z.ai сообщает, что обе версии используют одну основу. GLM-5.3 получает дополнительное обучение в исполняемых long-horizon средах и показывает заявленный рост в coding, agent и security тестах.

Практический ответ теперь яснее, чем в день запуска. Для сложной и долгой работы GLM-5.3 выглядит более сильным кандидатом на оценку: API, открытые веса и маршрут OmniaKey уже доступны. Но это не безрисковая замена model ID: reasoning всегда включен, thinking.type: "disabled" отклоняется, а поведение нужно проверять в том же harness и с теми же правами, что у 5.2.

Проверено 18 сентября 2026 года. Характеристики, benchmark-значения, параметры reasoning, endpoints, цены, Coding Plan, открытые веса и доступность OmniaKey сверены с документацией и прайсингом Z.ai, анонсом, официальной карточкой модели и живым каталогом OmniaKey. Ниже приведены результаты Z.ai, а не независимый benchmark.

GLM-5.3 и GLM-5.2 в одном сравнении

КритерийGLM-5.3GLM-5.2
Базовая модельТа же, что у 5.2Общая основа обеих версий
Главное изменениеБольше post-training на длинных expert workflowsПредыдущий stack и baseline
Контекст1M токенов1M токенов
Максимальный output128K токенов128K токенов
ThinkingВсегда включенМожно включать и отключать
Reasoning effortlow, high, max; default maxИмеющиеся настраиваемые уровни
Coding PlanДоступен в день запускаДоступен
Developer APIДоступен как glm-5.3Доступен как glm-5.2
Официальная цена$1.40 input / $0.26 cached input / $4.40 output за 1M токеновТакая же
Открытые весаОпубликованы как zai-org/GLM-5.3Доступны по текущему пути
Каталог OmniaKeyДоступен как glm-5.3Доступен как glm-5.2

Нужно разделить два вопроса:

  1. Стоит ли оценивать GLM-5.3? Да, особенно для long-horizon coding.
  2. Стоит ли сегодня переводить весь production API? Нет, пока не измерены совместимость, effort, latency и стоимость принятой задачи.

Страницы GLM-5.3 и GLM-5.2 отвечают за текущую цену, пример запроса и доступность OmniaKey. Руководство по цене API GLM-5.2 сохраняет расчеты. Эта статья отвечает только за решение об обновлении.

Что действительно изменилось в GLM-5.3?

Z.ai прямо пишет, что GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Заявленный прогресс обеспечен масштабированием post-training на длинных задачах.

Новый номер не обязательно означает большее окно, новую архитектуру или другой pretraining corpus. Здесь заявлен рост качества поведения после обучения на большем числе сред, разнообразных задач и длинных профессиональных workflows.

Z.ai описывает целые инженерные единицы работы, а не отдельные упражнения. Модель может читать codebase и документацию, работать с compute и storage, диагностировать узкое место, вносить изменения, запускать эксперименты и сохранять корректность до поставки.

Именно такую цепочку следует тестировать:

text
понять цель
  -> изучить среду
  -> спланировать и изменить
  -> запустить tools и tests
  -> разобрать ошибки
  -> проверить результат

Короткий autocomplete prompt не измерит главное заявленное отличие.

Официальное сравнение coding benchmarks

В отчете опубликованы следующие значения:

BenchmarkGLM-5.3GLM-5.2Заявленная разница
Terminal-Bench 2.188.281.0+7.2 пункта
Terminal-Bench 3.028.34.6+23.7 пункта
DeepSWE v1.166.946.2+20.7 пункта
NL2Repo58.048.9+9.1 пункта
FrontierSWE78.167.5+10.6 пункта
SWE-Marathon v1.142.519.4+23.1 пункта
PostTrainBench39.831.7+8.1 пункта
Agents' Last Exam CLI28.523.8+4.7 пункта

Z.ai также заявляет рост на 50% относительно GLM-5.2 в закрытом Z.ai Code Bench. При Max effort график показывает 34.5% примерно с 75K output-токенов на задачу для 5.3 против 23.4% с 96K для 5.2.

Этого достаточно, чтобы поставить 5.3 в очередь тестов, но недостаточно для универсального обещания 50%. Закрытый benchmark нельзя воспроизвести из анонса, а публичные зависят от конкретных harness, timeout, token limit, sampling и scoring.

Например, Terminal-Bench 3.0 использовал Claude Code 2.1.207, reasoning_effort=max, 400K контекста, до 128K output, до 600 agent turns, десятичасовой timeout и три запуска на задачу. Пятиминутный smoke test - другой эксперимент.

Меняется и граница безопасности

Z.ai добавил среды поиска уязвимостей и сообщил:

Security benchmarkGLM-5.3GLM-5.2
CyberGym84.577.2
ExploitBench54.424.4
ExploitGym, два часа105 задач29 задач
ExploitGym, шесть часов130 задач39 задач

Это полезно для разрешенного defensive review, но требует более строгих мер: минимальные permissions, изолированное выполнение, ограниченная сеть, журналы tools и ручное подтверждение чувствительных изменений.

Возможность benchmark не дает разрешения. Найденный exploit нельзя проверять на чужой системе без полномочий.

Миграция API ломает одну настройку thinking

GLM-5.3 поддерживает три уровня:

json
{
  "model": "glm-5.3",
  "thinking": { "type": "enabled" },
  "reasoning_effort": "max"
}

Разрешены low, high, max; Z.ai указывает max как default и рекомендует его для coding.

Больше не поддерживается:

json
"thinking": { "type": "disabled" }

Z.ai предупреждает, что такой запрос завершится ошибкой. До смены model ID настройте:

json
{
  "thinking": { "type": "enabled" },
  "reasoning_effort": "low"
}

Если thinking раньше был выключен, начните с low, затем тестируйте high и max на реальной работе. Не меняйте одновременно модель и effort без измерения latency, output и acceptance.

API, Coding Plan и открытые веса уже доступны

Сроки запуска различались, но на 18 сентября 2026 года доступны все три пути:

  • GLM Coding Plan: доступен всем пользователям плана.
  • Developer API: официальная страница документирует glm-5.3 для OpenAI Chat Completions, OpenAI Responses и Anthropic Messages.
  • Открытые веса: Z.ai опубликовала карточку zai-org/GLM-5.3 и инструкции по развертыванию.

Эти варианты по-прежнему не взаимозаменяемы: Coding Plan, тарифицируемый API и self-hosting имеют разные биллинг, квоты, операционные требования и поддержку.

Каталог OmniaKey теперь перечисляет glm-5.3 и glm-5.2 как отдельные ID. OmniaKey не подменяет модели молча, поэтому запрошенный ID виден в usage и billing.

У GLM-5.3 и GLM-5.2 одинаковая официальная цена API

Z.ai указывает для обеих моделей $1.40 за миллион uncached input, $0.26 за cached input и $4.40 за output; хранение cache отмечено как временно бесплатное.

Одинаковая ставка убирает один фактор сравнения, но не делает стоимость задачи одинаковой: различаются reasoning/output tokens, retries и human correction. Points Coding Plan, прямой API и gateway — разные биллинговые отношения.

Перед production migration нужны:

  1. официальные ставки input, cached input и output;
  2. условия cache storage или write;
  3. региональная доступность модели и API;
  4. rate limits и concurrency;
  5. фактический token usage каждого reasoning effort.

OmniaKey сейчас применяет к обеим моделям одну ценовую связь с Z.ai; точную котировку проверяйте на странице каждой модели. Руководство по цене полезно для cache-арифметики, но не заменяет живой каталог.

Стоит ли обновляться с GLM-5.2?

Оценивайте GLM-5.3, когда

  • задача проходит через много файлов, систем или этапов проверки;
  • GLM-5.2 теряет план в длинной цепочке tools;
  • основная нагрузка - сложный debugging и repository-level изменения;
  • выполняется разрешенный security review;
  • можно провести matched test через поддерживаемый путь.

Оставайтесь на GLM-5.2, когда

  • production стабилен, а цена известна;
  • клиент зависит от thinking.type: "disabled";
  • задача короткая и уже надежно проходит;
  • для 5.3 пока нельзя повторить permissions, tools и acceptance.

Номер версии не является решением. Обновляйтесь, когда новая модель улучшает accepted-task cost или надежность вашей нагрузки.

Как провести честный тест

Зафиксируйте условия:

КонтрольЧто оставить одинаковым
РепозиторийОдин commit и состояние dependencies
PromptОдна цель, ограничения и definition of done
HarnessОдна версия клиента и context policy
PermissionsОдинаковые filesystem, shell, network и approvals
ToolsОдин набор и внешние сервисы
BudgetСопоставимые timeout, turn cap и effort
ПроверкаОдинаковые tests, lint, build и review rubric

Записывайте pass rate, время, input, cache, output, retries, tool failures, ручную коррекцию и billed cost. Повторяйте тест, потому что long-horizon agents дают вариативные результаты.

Руководство по coding-моделям объясняет routing классов задач вместо выбора универсального победителя.

Итог

GLM-5.3 - содержательный coding release, а не косметический номер. Масштаб заявленных улучшений оправдывает приоритетную проверку на сложной repository-работе.

Это не универсальная drop-in замена GLM-5.2: API, цена, веса и маршрут OmniaKey уже доступны, но thinking config требует миграции, а production-поведение — парного теста.

Начинайте новые тесты long-horizon coding с GLM-5.3. Оставляйте 5.2, если workflow зависит от отключаемого thinking или доказательств регрессии пока недостаточно.

Частые вопросы

GLM-5.3 лучше GLM-5.2 для программирования?

Z.ai сообщает более высокие результаты в закрытом Code Bench и нескольких публичных тестах. Это делает 5.3 более сильным кандидатом, но не универсальной гарантией.

GLM-5.3 использует новую базовую модель?

Нет. Z.ai сообщает об одной базе с GLM-5.2 и улучшениях за счет дополнительного post-training.

Доступен ли API GLM-5.3?

Да. Developer-страница содержит endpoints и примеры для glm-5.3; Coding Plan, metered API и self-hosting остаются разными путями.

Сколько стоит API GLM-5.3?

Z.ai указывает для GLM-5.3 $1.40 за миллион uncached input, $0.26 за cached input и $4.40 за output — столько же, сколько для GLM-5.2 на дату проверки.

Что ломается при миграции?

GLM-5.3 не поддерживает thinking.type: "disabled". Нужно включить thinking и поставить reasoning_effort в low до смены model ID.

Можно ли уже использовать GLM-5.3 через OmniaKey?

Да. OmniaKey перечисляет glm-5.3 и glm-5.2 как отдельные ID; перед production migration проверьте живую котировку.

Проверенные источники

Факты проверены 18 сентября 2026 года. Доступ, availability, pricing, benchmark docs и client support могут измениться. Перед production migration проверяйте первичные источники.