GLM-5.3 показывает, насколько далеко можно продвинуть уже существующую базовую модель одним лишь постобучением. На той же 753B-параметрической базе, что и GLM-5.2, результат DeepSWE вырос с 46,2 до 66,9 — без новой архитектуры. Но через три дня после релиза есть два нюанса: API с тарификацией по токенам пока нет, а веса «open-weights» модели задержали примерно на две недели для проверки безопасности.
Что представляет собой GLM-5.3
GLM-5.3 — новый флагман Z.ai для длительных задач в программной инженерии и агентных сценариев, выпущенный 14 августа 2026 года. В официальной документации модели раскрыта ключевая особенность релиза: базовая модель здесь та же, что у GLM-5.2. Все заявленные улучшения получены на этапе постобучения на реалистичных инженерных процессах — от выявления проблемы до реализации, проверки и поставки результата.
Поэтому GLM-5.3 — не архитектурный преемник, а родственная модель GLM-5.2. Последняя вышла в середине июня 2026 года как Mixture-of-Experts-модель на 753B параметров под лицензией MIT; её веса доступны на Hugging Face с 17 июня, как сообщал TechTimes после релиза.
| Характеристика | GLM-5.3 | GLM-5.2 |
|---|---|---|
| Базовая модель | Та же 753B MoE, по данным Z.ai | 753B MoE, лицензия MIT |
| Контекстное окно | 1 млн токенов | 1 млн токенов |
| Максимальный вывод | 128K токенов | 128K токенов |
| Ввод / вывод | Текст / текст | Текст / текст |
| Поддержка инструментов | Function calling, MCP, JSON output, context caching, thinking modes | Тот же набор (документация GLM-5.2) |
| Веса | Пока не опубликованы — релиз отложен на время проверки безопасности | Доступны на Hugging Face с 17 июня |
| Доступ сейчас | Только GLM Coding Plan; API «скоро появится» | Coding Plan + API с оплатой по токенам |
Что говорят бенчмарки — и чего они не доказывают
Все цифры ниже взяты напрямую из документации Z.ai к релизу. Для сравнения приведены результаты GLM-5.2 и GLM-5.3.
| Бенчмарк | GLM-5.2 | GLM-5.3 | Изменение |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6 | 28,3 | +23,7 |
| DeepSWE v1.1 | 46,2 | 66,9 | +20,7 |
| Agents' Last Exam | 23,8 | 28,5 | +4,7 |
| ExploitBench | 24,4% | 54,4% | +30,0 п. п. |
Именно прибавка в 20,7 пункта на DeepSWE за счёт одного постобучения стала главным предметом обсуждения в день релиза. В популярном разборе на Reddit её назвали подтверждением того, «сколько скрытых возможностей ещё может быть в крупнейших современных базовых моделях». На той же странице запуска указаны 1 769 баллов в GDPval-AA v2 по 44 профессиональным категориям, что выводит GLM-5.3 за пределы сугубо программирования. Z.ai также заявляет, что возможности модели в кодинге «сопоставимы с Claude Fable 5».
Общий вектор выглядит убедительно, но точность цифр пока не подтверждена. Результаты опубликованы самим поставщиком без деталей harness и доверительных интервалов, а в ветке сообщества о бенчмарках отмечают отсутствие независимых воспроизведений. Самая полезная внешняя сверка на сегодня — составленное пользователем сравнение в r/ZaiGLM: у GPT-5.6 Luna Max 67,2 на DeepSWE v1.1 против 66,9 у GLM-5.3. Разрыв в 0,3 пункта говорит скорее о конкуренции на границе фронтира в агентном программировании, а не о безоговорочном лидерстве. Проверить такую пару уже сейчас можно через GPT-5.6 Luna; а GLM-5.2 остаётся флагманом семейства с доступным API до выхода API для 5.3. Это не замена поведению GLM-5.3 после постобучения, но та же базовая модель.
Почему публикацию весов отложили
Как сообщил Axios в день запуска, Z.ai удерживает веса GLM-5.3 примерно две недели, чтобы усилить защитные механизмы. Причина — показатели модели в задачах кибербезопасности, которые сама компания описывает как «превзошедшие ожидания» по мере расширения среды для долгосрочных задач.
В CyberGym — бенчмарке на поиск известных уязвимостей — GLM-5.3 набрала 84,5%. В сравнительной таблице Z.ai это выше Mythos 5 с 83,8% и GPT-5.6 Sol с 83,6%. В ExploitBench, где проверяется рассуждение при разработке реальных эксплойтов, GLM-5.3 получила 54,4%: более чем вдвое больше 24,4% у GLM-5.2, но всё ещё ниже Claude Fable 5 и GPT-5.6 Sol, согласно интерпретации результатов Axios. В документации Z.ai прямо указывает и пределы: преимущество сосредоточено на ранних стадиях цепочки эксплуатации, а более глубокая эксплуатация и полные наступательные/оборонительные сценарии «требуют улучшения».
Контекст задержки дополняют два факта:
- По данным Axios, в тот же день Z.ai запустила сайт раскрытия информации, где указано, что модели GLM нашли более 2 400 уязвимостей — свыше 1 000 из них критического или высокого уровня — в том числе в ядре Linux, проектах VMware и Apache. Мейнтейнеры open-source-проектов могут отправлять репозитории на сканирование ошибок с помощью GLM.
- Как пишет Axios, вместо немедленной публикации весов Z.ai запускает многоуровневую программу с контролируемым доступом для выбранных партнёров по безопасности на период проверки. Это отдельный канал, не связанный с Coding Plan.
После открытой публикации весов Z.ai уже не сможет контролировать последующие модификации модели. В собственном анонсе компания сформулировала ставку так: «В открытом мире не должно быть только открытых поверхностей для атак».
Как получить доступ к GLM-5.3 сейчас
Для широкой аудитории GLM-5.3 пока доступна только по подписке GLM Coding Plan. Официальная документация помечает API как «coming soon», а в таблице тарифов Z.ai по состоянию на 17 августа 2026 года для GLM-5.3 нет отдельной строки. Тарифы указаны для GLM-5.2, GLM-5.1 и GLM-5 — значит, 5.3 в биллинг ещё просто не включили.
Тарифы подписки с официальной страницы оформления:
| Тариф | Базовая цена | Отображаемая цена | Лимит | Для каких задач |
|---|---|---|---|---|
| Lite | $18/мес. | $12.60/мес. | 10 000 кредитов в неделю | Небольшие репозитории, лёгкие итерации |
| Pro | $80/мес. | $56/мес. | В 6 раз больше Lite | Ежедневная разработка, репозитории среднего размера |
| Max | $168/мес. | $117.60/мес. | В 14 раз больше Lite | Средние и крупные репозитории, интенсивная работа агентов |
На странице рядом указаны более высокие ориентировочные цены, однако условия скидки не подписаны. Поэтому $18/$80/$168 стоит считать месячными базовыми ценами, а меньшие значения — текущей скидкой. Для настройки нужна одна команда: npx @z_ai/coding-helper. Она подключает план к выбранному инструменту. Z.ai перечисляет более 20 поддерживаемых агентных инструментов, включая Claude Code, OpenClaw и собственный ZCode; доступ к MCP-инструментам начинается с Pro. Тариф Max обещает первоочередной доступ к новым флагманам, а все уровни Coding Plan получают скользящий доступ к текущему флагману.
Что изменилось в ценах вместе с релизом
Вокруг запуска GLM-5.3 Z.ai пересмотрела цены на Coding Plan, и активные пользователи заметили это сразу. Один из подписчиков в r/ZaiGLM сравнил новые тарифы с прежними планами V2. Это данные сообщества, а не официальная таблица Z.ai, поэтому перед любыми решениями стоит проверить собственный кабинет.
| Тариф | Старая цена | Старый лимит токенов/неделю | Новая цена | Новый лимит токенов/неделю |
|---|---|---|---|---|
| Pro | $65 | ~500M | $80 | ~526M |
| Max | $144 | ~2B | $168 | ~1,22B |
«Новый Max даёт примерно на 39% меньше токенов, при этом стоит примерно на 17% дороже». — u/x-primez-x, r/ZaiGLM
По расчётам автора поста, на Max стоимость токена ухудшилась примерно в 1,9 раза: около 7,26M токенов на доллар в неделю вместо прежних ~13,89M. У Pro изменение мягче: лимит увеличился примерно на 5%, а цена — примерно на 23%, то есть токенов на доллар стало ориентировочно на 14% меньше. При этом саму модель автор оценивает высоко, но добавляет предупреждение:
«GLM-5.3 выглядит потрясающе… но этот новый coding plan, вероятно, окончательно оттолкнёт меня от Z.AI». — u/x-primez-x, r/ZaiGLM
Для ориентира по API: когда у GLM-5.3 появится тарификация по токенам, текущей опорной точкой в семействе будет GLM-5.2. На официальной странице цен для неё указаны $1.40 за 1M входных токенов, $0.26 за кэшированные и $4.40 за выходные; хранение кэшированного ввода пока бесплатно. Один из комментаторов в той же ветке уже считает, что в сравнении подписки и API выгоднее pay-as-you-go: «Гибкость того стоит, когда новые модели выходят раз в неделю или две».
Стоит ли переходить на GLM-5.3
Ответ зависит от того, чем вы пользуетесь сейчас:
| Ваш сценарий | Переходить сейчас? | Почему |
|---|---|---|
| Подписчик Coding Plan Pro | Да | Тот же тариф за $80 и немедленный доступ к GLM-5.3; прирост DeepSWE заявлен поставщиком, поэтому сначала проверьте модель на собственном репозитории |
| Активный пользователь Coding Plan Max | Сначала посчитайте | Примерно на 39% меньше токенов в неделю, чем у прежнего Max, при более высокой цене; производительность на доллар может оказаться ниже вашей точки безубыточности |
| Пользователь API с оплатой по факту | Подождать | Цены за токены ещё нет; единственный флагман GLM с измеряемой стоимостью — GLM-5.2 по $1.40/$4.40 за 1M |
| Локальный запуск | Ждать веса | До завершения проверки примерно через две недели запускать нечего; та же база 753B MoE означает серверное multi-GPU-железо, а поддержка vLLM/SGLang лишь ожидается из-за общей базы, но не подтверждена Z.ai |
| Нужна работа со зрением | Нет | GLM-5.3 принимает и выдаёт только текст, как и GLM-5.2; vision остаётся в отдельной закрытой линейке GLM-5V |
Последний пункт особенно важен: это был самый громкий запрос сообщества до релиза. Опрос Jie Tang от 29 июня о том, что должна получить GLM-5.3, набрал 466 000 просмотров, и подавляющее большинство выбрало vision. Но вышедшая модель по-прежнему не получила визуальный энкодер. Если в вашем процессе есть скриншоты, PDF или UI-макеты, обходным вариантом станет GLM-5V-Turbo за $1.20/$4.00 за 1M токенов через API Z.ai, а не GLM-5.3.
Главный нерешённый компромисс такой: подписка даёт GLM-5.3 немедленно, но привязывает к пересмотренным квотам; ожидание ничего не стоит, кроме отсутствия доступа. Для весов Z.ai указала срок проверки, а для API есть только пометка «coming soon» — без цены и даты. Если прямо сейчас вы не упираетесь в пропускную способность агентного кодинга, двухнедельное окно до публикации весов достаточно короткое, чтобы просто переждать.
FAQ
Когда выйдут веса GLM-5.3?
Z.ai отложила публикацию весов примерно на две недели после запуска 14 августа для проверки безопасности. Если график сохранится, это указывает на конец августа. Следите за организацией zai-org на Hugging Face: именно там веса GLM-5.2 появились в течение нескольких дней после июньского релиза.
GLM-5.3 — это open source?
GLM-5.3 позиционируется как open-weights-модель, но сами веса ещё не опубликованы, а в документации к запуску не указана лицензия. GLM-5.2 вышла под MIT, поэтому сообщество предполагает такую же лицензию для GLM-5.3. Однако это предположение, а не обязательство Z.ai.
Поддерживает ли GLM-5.3 изображения и vision?
Нет. Официальная документация указывает только текстовый ввод и текстовый вывод, контекст в 1M токенов и максимальный вывод 128K токенов. Нативная работа со зрением остаётся в отдельном семействе GLM-5V — GLM-5V-Turbo и GLM-4.6V, которые Z.ai предоставляет через API, а не в виде открытых весов.
Сколько стоит GLM-5.3 за токен?
Потокеновой цены пока нет: API помечен как «coming soon», а GLM-5.3 отсутствует в таблице цен Z.ai. Сейчас модель доступна только через GLM Coding Plan с базовыми ценами $18/$80/$168 в месяц; в настоящее время отображаются $12.60/$56/$117.60.
Можно ли запустить GLM-5.3 локально?
Не до публикации весов. GLM-5.2 вышла с поддержкой vLLM, SGLang и KTransformers в model card (по данным TechTimes); в документации к запуску GLM-5.3 пока ничего не сказано о стеке развёртывания. Поэтому ориентируйтесь на серверное multi-GPU-оборудование, а не на потребительские системы.