AIREITER

GLM-5.3 от Z.ai: бенчмарки, цены и способы доступа к новой модели

Последнее обновление: 2026-08-17 07:46:43

GLM-5.3 показывает, насколько далеко можно продвинуть уже существующую базовую модель одним лишь постобучением. На той же 753B-параметрической базе, что и GLM-5.2, результат DeepSWE вырос с 46,2 до 66,9 — без новой архитектуры. Но через три дня после релиза есть два нюанса: API с тарификацией по токенам пока нет, а веса «open-weights» модели задержали примерно на две недели для проверки безопасности.

Что представляет собой GLM-5.3

GLM-5.3 — новый флагман Z.ai для длительных задач в программной инженерии и агентных сценариев, выпущенный 14 августа 2026 года. В официальной документации модели раскрыта ключевая особенность релиза: базовая модель здесь та же, что у GLM-5.2. Все заявленные улучшения получены на этапе постобучения на реалистичных инженерных процессах — от выявления проблемы до реализации, проверки и поставки результата.

Поэтому GLM-5.3 — не архитектурный преемник, а родственная модель GLM-5.2. Последняя вышла в середине июня 2026 года как Mixture-of-Experts-модель на 753B параметров под лицензией MIT; её веса доступны на Hugging Face с 17 июня, как сообщал TechTimes после релиза.

ХарактеристикаGLM-5.3GLM-5.2
Базовая модельТа же 753B MoE, по данным Z.ai753B MoE, лицензия MIT
Контекстное окно1 млн токенов1 млн токенов
Максимальный вывод128K токенов128K токенов
Ввод / выводТекст / текстТекст / текст
Поддержка инструментовFunction calling, MCP, JSON output, context caching, thinking modesТот же набор (документация GLM-5.2)
ВесаПока не опубликованы — релиз отложен на время проверки безопасностиДоступны на Hugging Face с 17 июня
Доступ сейчасТолько GLM Coding Plan; API «скоро появится»Coding Plan + API с оплатой по токенам

Что говорят бенчмарки — и чего они не доказывают

Все цифры ниже взяты напрямую из документации Z.ai к релизу. Для сравнения приведены результаты GLM-5.2 и GLM-5.3.

БенчмаркGLM-5.2GLM-5.3Изменение
Terminal-Bench 3.04,628,3+23,7
DeepSWE v1.146,266,9+20,7
Agents' Last Exam23,828,5+4,7
ExploitBench24,4%54,4%+30,0 п. п.

Именно прибавка в 20,7 пункта на DeepSWE за счёт одного постобучения стала главным предметом обсуждения в день релиза. В популярном разборе на Reddit её назвали подтверждением того, «сколько скрытых возможностей ещё может быть в крупнейших современных базовых моделях». На той же странице запуска указаны 1 769 баллов в GDPval-AA v2 по 44 профессиональным категориям, что выводит GLM-5.3 за пределы сугубо программирования. Z.ai также заявляет, что возможности модели в кодинге «сопоставимы с Claude Fable 5».

Общий вектор выглядит убедительно, но точность цифр пока не подтверждена. Результаты опубликованы самим поставщиком без деталей harness и доверительных интервалов, а в ветке сообщества о бенчмарках отмечают отсутствие независимых воспроизведений. Самая полезная внешняя сверка на сегодня — составленное пользователем сравнение в r/ZaiGLM: у GPT-5.6 Luna Max 67,2 на DeepSWE v1.1 против 66,9 у GLM-5.3. Разрыв в 0,3 пункта говорит скорее о конкуренции на границе фронтира в агентном программировании, а не о безоговорочном лидерстве. Проверить такую пару уже сейчас можно через GPT-5.6 Luna; а GLM-5.2 остаётся флагманом семейства с доступным API до выхода API для 5.3. Это не замена поведению GLM-5.3 после постобучения, но та же базовая модель.

Почему публикацию весов отложили

Как сообщил Axios в день запуска, Z.ai удерживает веса GLM-5.3 примерно две недели, чтобы усилить защитные механизмы. Причина — показатели модели в задачах кибербезопасности, которые сама компания описывает как «превзошедшие ожидания» по мере расширения среды для долгосрочных задач.

В CyberGym — бенчмарке на поиск известных уязвимостей — GLM-5.3 набрала 84,5%. В сравнительной таблице Z.ai это выше Mythos 5 с 83,8% и GPT-5.6 Sol с 83,6%. В ExploitBench, где проверяется рассуждение при разработке реальных эксплойтов, GLM-5.3 получила 54,4%: более чем вдвое больше 24,4% у GLM-5.2, но всё ещё ниже Claude Fable 5 и GPT-5.6 Sol, согласно интерпретации результатов Axios. В документации Z.ai прямо указывает и пределы: преимущество сосредоточено на ранних стадиях цепочки эксплуатации, а более глубокая эксплуатация и полные наступательные/оборонительные сценарии «требуют улучшения».

Контекст задержки дополняют два факта:

  • По данным Axios, в тот же день Z.ai запустила сайт раскрытия информации, где указано, что модели GLM нашли более 2 400 уязвимостей — свыше 1 000 из них критического или высокого уровня — в том числе в ядре Linux, проектах VMware и Apache. Мейнтейнеры open-source-проектов могут отправлять репозитории на сканирование ошибок с помощью GLM.
  • Как пишет Axios, вместо немедленной публикации весов Z.ai запускает многоуровневую программу с контролируемым доступом для выбранных партнёров по безопасности на период проверки. Это отдельный канал, не связанный с Coding Plan.

После открытой публикации весов Z.ai уже не сможет контролировать последующие модификации модели. В собственном анонсе компания сформулировала ставку так: «В открытом мире не должно быть только открытых поверхностей для атак».

Как получить доступ к GLM-5.3 сейчас

Для широкой аудитории GLM-5.3 пока доступна только по подписке GLM Coding Plan. Официальная документация помечает API как «coming soon», а в таблице тарифов Z.ai по состоянию на 17 августа 2026 года для GLM-5.3 нет отдельной строки. Тарифы указаны для GLM-5.2, GLM-5.1 и GLM-5 — значит, 5.3 в биллинг ещё просто не включили.

Тарифы подписки с официальной страницы оформления:

ТарифБазовая ценаОтображаемая ценаЛимитДля каких задач
Lite$18/мес.$12.60/мес.10 000 кредитов в неделюНебольшие репозитории, лёгкие итерации
Pro$80/мес.$56/мес.В 6 раз больше LiteЕжедневная разработка, репозитории среднего размера
Max$168/мес.$117.60/мес.В 14 раз больше LiteСредние и крупные репозитории, интенсивная работа агентов

На странице рядом указаны более высокие ориентировочные цены, однако условия скидки не подписаны. Поэтому $18/$80/$168 стоит считать месячными базовыми ценами, а меньшие значения — текущей скидкой. Для настройки нужна одна команда: npx @z_ai/coding-helper. Она подключает план к выбранному инструменту. Z.ai перечисляет более 20 поддерживаемых агентных инструментов, включая Claude Code, OpenClaw и собственный ZCode; доступ к MCP-инструментам начинается с Pro. Тариф Max обещает первоочередной доступ к новым флагманам, а все уровни Coding Plan получают скользящий доступ к текущему флагману.

Что изменилось в ценах вместе с релизом

Вокруг запуска GLM-5.3 Z.ai пересмотрела цены на Coding Plan, и активные пользователи заметили это сразу. Один из подписчиков в r/ZaiGLM сравнил новые тарифы с прежними планами V2. Это данные сообщества, а не официальная таблица Z.ai, поэтому перед любыми решениями стоит проверить собственный кабинет.

ТарифСтарая ценаСтарый лимит токенов/неделюНовая ценаНовый лимит токенов/неделю
Pro$65~500M$80~526M
Max$144~2B$168~1,22B

«Новый Max даёт примерно на 39% меньше токенов, при этом стоит примерно на 17% дороже». — u/x-primez-x, r/ZaiGLM

По расчётам автора поста, на Max стоимость токена ухудшилась примерно в 1,9 раза: около 7,26M токенов на доллар в неделю вместо прежних ~13,89M. У Pro изменение мягче: лимит увеличился примерно на 5%, а цена — примерно на 23%, то есть токенов на доллар стало ориентировочно на 14% меньше. При этом саму модель автор оценивает высоко, но добавляет предупреждение:

«GLM-5.3 выглядит потрясающе… но этот новый coding plan, вероятно, окончательно оттолкнёт меня от Z.AI». — u/x-primez-x, r/ZaiGLM

Для ориентира по API: когда у GLM-5.3 появится тарификация по токенам, текущей опорной точкой в семействе будет GLM-5.2. На официальной странице цен для неё указаны $1.40 за 1M входных токенов, $0.26 за кэшированные и $4.40 за выходные; хранение кэшированного ввода пока бесплатно. Один из комментаторов в той же ветке уже считает, что в сравнении подписки и API выгоднее pay-as-you-go: «Гибкость того стоит, когда новые модели выходят раз в неделю или две».

Стоит ли переходить на GLM-5.3

Ответ зависит от того, чем вы пользуетесь сейчас:

Ваш сценарийПереходить сейчас?Почему
Подписчик Coding Plan ProДаТот же тариф за $80 и немедленный доступ к GLM-5.3; прирост DeepSWE заявлен поставщиком, поэтому сначала проверьте модель на собственном репозитории
Активный пользователь Coding Plan MaxСначала посчитайтеПримерно на 39% меньше токенов в неделю, чем у прежнего Max, при более высокой цене; производительность на доллар может оказаться ниже вашей точки безубыточности
Пользователь API с оплатой по фактуПодождатьЦены за токены ещё нет; единственный флагман GLM с измеряемой стоимостью — GLM-5.2 по $1.40/$4.40 за 1M
Локальный запускЖдать весаДо завершения проверки примерно через две недели запускать нечего; та же база 753B MoE означает серверное multi-GPU-железо, а поддержка vLLM/SGLang лишь ожидается из-за общей базы, но не подтверждена Z.ai
Нужна работа со зрениемНетGLM-5.3 принимает и выдаёт только текст, как и GLM-5.2; vision остаётся в отдельной закрытой линейке GLM-5V

Последний пункт особенно важен: это был самый громкий запрос сообщества до релиза. Опрос Jie Tang от 29 июня о том, что должна получить GLM-5.3, набрал 466 000 просмотров, и подавляющее большинство выбрало vision. Но вышедшая модель по-прежнему не получила визуальный энкодер. Если в вашем процессе есть скриншоты, PDF или UI-макеты, обходным вариантом станет GLM-5V-Turbo за $1.20/$4.00 за 1M токенов через API Z.ai, а не GLM-5.3.

Главный нерешённый компромисс такой: подписка даёт GLM-5.3 немедленно, но привязывает к пересмотренным квотам; ожидание ничего не стоит, кроме отсутствия доступа. Для весов Z.ai указала срок проверки, а для API есть только пометка «coming soon» — без цены и даты. Если прямо сейчас вы не упираетесь в пропускную способность агентного кодинга, двухнедельное окно до публикации весов достаточно короткое, чтобы просто переждать.

FAQ

Когда выйдут веса GLM-5.3?

Z.ai отложила публикацию весов примерно на две недели после запуска 14 августа для проверки безопасности. Если график сохранится, это указывает на конец августа. Следите за организацией zai-org на Hugging Face: именно там веса GLM-5.2 появились в течение нескольких дней после июньского релиза.

GLM-5.3 — это open source?

GLM-5.3 позиционируется как open-weights-модель, но сами веса ещё не опубликованы, а в документации к запуску не указана лицензия. GLM-5.2 вышла под MIT, поэтому сообщество предполагает такую же лицензию для GLM-5.3. Однако это предположение, а не обязательство Z.ai.

Поддерживает ли GLM-5.3 изображения и vision?

Нет. Официальная документация указывает только текстовый ввод и текстовый вывод, контекст в 1M токенов и максимальный вывод 128K токенов. Нативная работа со зрением остаётся в отдельном семействе GLM-5V — GLM-5V-Turbo и GLM-4.6V, которые Z.ai предоставляет через API, а не в виде открытых весов.

Сколько стоит GLM-5.3 за токен?

Потокеновой цены пока нет: API помечен как «coming soon», а GLM-5.3 отсутствует в таблице цен Z.ai. Сейчас модель доступна только через GLM Coding Plan с базовыми ценами $18/$80/$168 в месяц; в настоящее время отображаются $12.60/$56/$117.60.

Можно ли запустить GLM-5.3 локально?

Не до публикации весов. GLM-5.2 вышла с поддержкой vLLM, SGLang и KTransformers в model card (по данным TechTimes); в документации к запуску GLM-5.3 пока ничего не сказано о стеке развёртывания. Поэтому ориентируйтесь на серверное multi-GPU-оборудование, а не на потребительские системы.