Версии GLM: чем отличаются 4.5, 4.6, 4.7, 5, 5.1 и 5.2
Разбор линейки Z.ai: какие модели реально существуют в прайсе вендора, что означают суффиксы в названиях, что поменялось в 5.2 по сравнению с 5.1 и где заканчиваются подтверждённые данные.
Все версии, которые есть в прайсе вендора
Ориентироваться удобнее не по маркетинговым анонсам, а по списку моделей, за которые вендор берёт деньги. Ниже — состав прайса Z.ai со ставками за миллион токенов.
| Модель | Параметры | Лицензия | Контекст | Вход, $/1M | Выход, $/1M |
|---|---|---|---|---|---|
| GLM-5.2 | 753 млрд | MIT | 1 000 000 | 1.40 | 4.40 |
| GLM-5.1 | 754 млрд | MIT | 200 000 | 1.40 | 4.40 |
| GLM-5 | нет данных | нет данных | нет данных | 1.00 | 3.20 |
| GLM-5-Turbo | нет данных | нет данных | нет данных | 1.20 | 4.00 |
| GLM-4.7 | нет данных | нет данных | нет данных | 0.60 | 2.20 |
| GLM-4.7-FlashX | нет данных | нет данных | нет данных | 0.07 | 0.40 |
| GLM-4.7-Flash | нет данных | нет данных | нет данных | бесплатно | бесплатно |
| GLM-4.5-Flash | нет данных | нет данных | нет данных | бесплатно | бесплатно |
| GLM-4.5-Air | нет данных | нет данных | нет данных | 0.20 | 1.10 |
«Нет данных» в таблице — не пропуск, а факт: параметры и длину контекста вендор раскрывает только для тех моделей, чьи веса опубликовал. Для закрытых остаётся цена.
Что означают суффиксы
- Flash — самая лёгкая ветка. Две модели с этим суффиксом отдаются в API за ноль, что для рынка редкость: обычно бесплатным делают пробный лимит, а не саму модель.
- FlashX — Flash с более высокой пропускной способностью, стоит 0,07 и 0,40 доллара за миллион токенов.
- Air — промежуточный размер: дороже Flash, заметно дешевле старших.
- Turbo — ускоренный вариант, в прайсе есть у пятой версии.
- Max — не позиция прайса. Так в независимых замерах помечают верхний режим рассуждения: в таблицах arena.ai и Artificial Analysis модель числится как GLM-5.2 (max).
- V — модель со зрением. У пятого поколения это GLM-5V-Turbo, у четвёртого — GLM-4.6V.
Что изменилось в 5.2 против 5.1
| Параметр | GLM-5.1 | GLM-5.2 |
|---|---|---|
| Параметры | 754 млрд, активных 40 млрд | 753 млрд |
| Контекст | 200 000 | 1 000 000 |
| SWE-Bench Pro | 58.4 | 62.1 |
| Архитектура внимания | разрежённое внимание | то же + IndexShare |
| Лицензия | MIT | MIT |
Прирост по размеру нулевой — модель осталась той же весовой категории. Работа велась в двух других направлениях. Первое — длина контекста: пятикратный рост окна вместе с механизмом IndexShare, который переиспользует индексатор каждыми четырьмя слоями и снижает число операций на токен примерно в 2,9 раза при работе на миллионе токенов. Второе — качество на инженерных задачах: плюс 3,7 пункта на SWE-Bench Pro, где модели чинят настоящие баги в открытых репозиториях.
У версии 5.1 отдельно заявлялись Terminal-Bench 2.0 — 63,5, NL2Repo — 42,7 и AIME 2026 — 95,3, а также способность держать оптимизацию «на сотнях раундов и тысячах вызовов инструментов». Именно эта устойчивость на длинных агентских сессиях — линия развития всей пятой линейки, а не отдельная фича версии 5.2.
Почему в прайсе одновременно четыре поколения
Список моделей вендора — не хронология. Версии 4.5, 4.7, 5 и 5.2 продаются одновременно, старое с выходом нового не отключают: у лёгких моделей своя ниша, и Flash четвёртого поколения дешевле любой модели пятого. Отсюда правило чтения прайса: номер говорит о поколении, суффикс — о размере, а вместе они дают цену. Модель с большим номером не обязана лучше решать вашу задачу — она обязана быть новее.
Второе следствие: слово «GLM» в чате и в API означает разное. На chat.z.ai анонимному пользователю по умолчанию отвечает GLM-4.7, на китайском chatglm.cn — GLM-5.2, а в API модель называется поимённо. Прежде чем сравнивать «GLM» с другой нейросетью, стоит убедиться, какую именно версию вам отдали.
Что под маркой Z.ai выходит помимо текстовых моделей — зрение, генерация изображений, распознавание речи, агент управления интерфейсом — разобрано в разделе Zhipu AI и Z.ai.
Открытые веса по версиям
Публикация весов у Zhipu — не разовая акция, а политика: под MIT выложены и флагманы, и предыдущие поколения. На 27 июля 2026 года карточки Hugging Face показывали лицензию MIT у GLM-5.2 (обновлена 2 июля), GLM-5.1 (13 мая) и GLM-4.6. Текст LICENSE — канонический MIT с копирайтом Zhipu AI, без дополнительных оговорок про размер бизнеса или сферу применения, которые встречаются у других вендоров.
Что с этим делать практически — разобрано на странице скачать и доступ: там же про то, какого железа требует запуск модели такого размера.
Версий старше 5.2 не анонсировано
Запросы про следующие номера линейки идут стабильно, но подтвердить их нечем: в релиз-нотах docs.z.ai на 20 августа 2026 года старших записей, чем GLM-5.2, нет, блог z.ai анонсов тоже не публиковал. Пока в релиз-нотах вендора не появится строка с датой, любая новая версия — слух. Проверять стоит там же, где подтверждалась 5.2: страница релиз-нот и карточка организации zai-org на Hugging Face, где репозиторий новой модели появляется в день выпуска.
Короткие ответы
Чем GLM 5.2 отличается от GLM 5.1?
Окно контекста выросло с 200 тысяч токенов до миллиона, появился механизм IndexShare, снижающий вычисления на длинном контексте в 2,9 раза, и вырос результат на SWE-Bench Pro: 62,1 против 58,4. Размер моделей практически совпадает — 753 и 754 млрд параметров.
Что значит Flash, Air, FlashX и Turbo в названии?
Это облегчённые варианты, а не отдельные поколения. Flash — самые лёгкие, две из них (GLM-4.7-Flash и GLM-4.5-Flash) в прайсе Z.ai стоят ноль. Air дороже Flash, но дешевле старших моделей, Turbo — ускоренный вариант GLM-5.
Существует ли GLM 5.3 или более старшая версия?
В релиз-нотах Z.ai на 20 августа 2026 года старших версий, чем 5.2, нет. Всё, что встречается о более новых номерах, — вторичные источники и слухи.
У каких версий GLM открыты веса?
По данным карточек Hugging Face на 27 июля 2026 года лицензию MIT имеют GLM-5.2, GLM-5.1 и GLM-4.6. Файл LICENSE — канонический MIT с указанием Copyright (c) 2026 Zhipu AI.
Почему в прайсе Z.ai одновременно четыре поколения GLM?
Потому что список моделей вендора — не хронология: версии 4.5, 4.7, 5 и 5.2 продаются одновременно, старое с выходом нового не отключают. У лёгких моделей своя ниша, и Flash четвёртого поколения дешевле любой модели пятого. Правило чтения прайса: номер говорит о поколении, суффикс — о размере, а вместе они дают цену.
Что означают буква V и приписка max в названиях GLM?
V — модель со зрением: у пятого поколения это GLM-5V-Turbo, у четвёртого — GLM-4.6V. А max — вообще не позиция прайса: так в независимых замерах помечают верхний режим рассуждения, поэтому в таблицах arena.ai и Artificial Analysis модель числится как GLM-5.2 (max).
Дальше по теме
- API и цены — сколько стоит каждая версия из прайса
- Скачать и доступ — какие версии выложены с открытыми весами
- Zhipu AI и Z.ai — кто выпускает линейку и как устроены два контура