glm52.ru справочник по нейросети GLM от Z.ai данные на 20 августа 2026
glm52.ru / версии

Версии GLM: чем отличаются 4.5, 4.6, 4.7, 5, 5.1 и 5.2

Разбор линейки Z.ai: какие модели реально существуют в прайсе вендора, что означают суффиксы в названиях, что поменялось в 5.2 по сравнению с 5.1 и где заканчиваются подтверждённые данные.

Все версии, которые есть в прайсе вендора

Ориентироваться удобнее не по маркетинговым анонсам, а по списку моделей, за которые вендор берёт деньги. Ниже — состав прайса Z.ai со ставками за миллион токенов.

МодельПараметрыЛицензияКонтекстВход, $/1MВыход, $/1M
GLM-5.2753 млрдMIT1 000 0001.404.40
GLM-5.1754 млрдMIT200 0001.404.40
GLM-5нет данныхнет данныхнет данных1.003.20
GLM-5-Turboнет данныхнет данныхнет данных1.204.00
GLM-4.7нет данныхнет данныхнет данных0.602.20
GLM-4.7-FlashXнет данныхнет данныхнет данных0.070.40
GLM-4.7-Flashнет данныхнет данныхнет данныхбесплатнобесплатно
GLM-4.5-Flashнет данныхнет данныхнет данныхбесплатнобесплатно
GLM-4.5-Airнет данныхнет данныхнет данных0.201.10

«Нет данных» в таблице — не пропуск, а факт: параметры и длину контекста вендор раскрывает только для тех моделей, чьи веса опубликовал. Для закрытых остаётся цена.

Что означают суффиксы

Что изменилось в 5.2 против 5.1

ПараметрGLM-5.1GLM-5.2
Параметры754 млрд, активных 40 млрд753 млрд
Контекст200 0001 000 000
SWE-Bench Pro58.462.1
Архитектура вниманияразрежённое вниманието же + IndexShare
ЛицензияMITMIT

Прирост по размеру нулевой — модель осталась той же весовой категории. Работа велась в двух других направлениях. Первое — длина контекста: пятикратный рост окна вместе с механизмом IndexShare, который переиспользует индексатор каждыми четырьмя слоями и снижает число операций на токен примерно в 2,9 раза при работе на миллионе токенов. Второе — качество на инженерных задачах: плюс 3,7 пункта на SWE-Bench Pro, где модели чинят настоящие баги в открытых репозиториях.

У версии 5.1 отдельно заявлялись Terminal-Bench 2.0 — 63,5, NL2Repo — 42,7 и AIME 2026 — 95,3, а также способность держать оптимизацию «на сотнях раундов и тысячах вызовов инструментов». Именно эта устойчивость на длинных агентских сессиях — линия развития всей пятой линейки, а не отдельная фича версии 5.2.

Почему в прайсе одновременно четыре поколения

Список моделей вендора — не хронология. Версии 4.5, 4.7, 5 и 5.2 продаются одновременно, старое с выходом нового не отключают: у лёгких моделей своя ниша, и Flash четвёртого поколения дешевле любой модели пятого. Отсюда правило чтения прайса: номер говорит о поколении, суффикс — о размере, а вместе они дают цену. Модель с большим номером не обязана лучше решать вашу задачу — она обязана быть новее.

Второе следствие: слово «GLM» в чате и в API означает разное. На chat.z.ai анонимному пользователю по умолчанию отвечает GLM-4.7, на китайском chatglm.cn — GLM-5.2, а в API модель называется поимённо. Прежде чем сравнивать «GLM» с другой нейросетью, стоит убедиться, какую именно версию вам отдали.

Что под маркой Z.ai выходит помимо текстовых моделей — зрение, генерация изображений, распознавание речи, агент управления интерфейсом — разобрано в разделе Zhipu AI и Z.ai.

Открытые веса по версиям

Публикация весов у Zhipu — не разовая акция, а политика: под MIT выложены и флагманы, и предыдущие поколения. На 27 июля 2026 года карточки Hugging Face показывали лицензию MIT у GLM-5.2 (обновлена 2 июля), GLM-5.1 (13 мая) и GLM-4.6. Текст LICENSE — канонический MIT с копирайтом Zhipu AI, без дополнительных оговорок про размер бизнеса или сферу применения, которые встречаются у других вендоров.

Что с этим делать практически — разобрано на странице скачать и доступ: там же про то, какого железа требует запуск модели такого размера.

Версий старше 5.2 не анонсировано

Запросы про следующие номера линейки идут стабильно, но подтвердить их нечем: в релиз-нотах docs.z.ai на 20 августа 2026 года старших записей, чем GLM-5.2, нет, блог z.ai анонсов тоже не публиковал. Пока в релиз-нотах вендора не появится строка с датой, любая новая версия — слух. Проверять стоит там же, где подтверждалась 5.2: страница релиз-нот и карточка организации zai-org на Hugging Face, где репозиторий новой модели появляется в день выпуска.

Короткие ответы

Чем GLM 5.2 отличается от GLM 5.1?

Окно контекста выросло с 200 тысяч токенов до миллиона, появился механизм IndexShare, снижающий вычисления на длинном контексте в 2,9 раза, и вырос результат на SWE-Bench Pro: 62,1 против 58,4. Размер моделей практически совпадает — 753 и 754 млрд параметров.

Что значит Flash, Air, FlashX и Turbo в названии?

Это облегчённые варианты, а не отдельные поколения. Flash — самые лёгкие, две из них (GLM-4.7-Flash и GLM-4.5-Flash) в прайсе Z.ai стоят ноль. Air дороже Flash, но дешевле старших моделей, Turbo — ускоренный вариант GLM-5.

Существует ли GLM 5.3 или более старшая версия?

В релиз-нотах Z.ai на 20 августа 2026 года старших версий, чем 5.2, нет. Всё, что встречается о более новых номерах, — вторичные источники и слухи.

У каких версий GLM открыты веса?

По данным карточек Hugging Face на 27 июля 2026 года лицензию MIT имеют GLM-5.2, GLM-5.1 и GLM-4.6. Файл LICENSE — канонический MIT с указанием Copyright (c) 2026 Zhipu AI.

Почему в прайсе Z.ai одновременно четыре поколения GLM?

Потому что список моделей вендора — не хронология: версии 4.5, 4.7, 5 и 5.2 продаются одновременно, старое с выходом нового не отключают. У лёгких моделей своя ниша, и Flash четвёртого поколения дешевле любой модели пятого. Правило чтения прайса: номер говорит о поколении, суффикс — о размере, а вместе они дают цену.

Что означают буква V и приписка max в названиях GLM?

V — модель со зрением: у пятого поколения это GLM-5V-Turbo, у четвёртого — GLM-4.6V. А max — вообще не позиция прайса: так в независимых замерах помечают верхний режим рассуждения, поэтому в таблицах arena.ai и Artificial Analysis модель числится как GLM-5.2 (max).