Скачать GLM 5.2: веса, локальный запуск и веб-чат
Четыре разных способа получить доступ к модели — чат вендора, приложение, API и собственный сервер с открытыми весами. Различаются они не удобством, а тем, что вообще возможно: «скачать нейросеть» и «открыть чат» — это принципиально разные сценарии.
Официальные сайты и чат
Тонкость, из-за которой возникает половина путаницы: в бесплатном международном чате по умолчанию отвечает не флагман, а предыдущее поколение. Если нужна именно 5.2, версию следует выбрать в переключателе моделей или идти в API.
Приложения
Отдельного клиента для Windows, macOS, iOS или Android у международного контура не заявлено: ни на chat.z.ai, ни в документации ссылок на загрузку нет, веб-версия — единственный интерфейс. В китайском App Store существует приложение Zhipu с платной подпиской (79 юаней в месяц, 219 за квартал, 859 за год), но какая именно модель работает внутри, вендор не заявляет, поэтому считать его «приложением GLM 5.2» некорректно. Если вопрос стоит именно про мобильный доступ к нейросетям, полезнее смотреть модели с мобильным приложением.
Что значит «скачать GLM»
Скачивается не программа, а веса — файлы обученной модели. Они лежат на Hugging Face в репозитории zai-org/GLM-5.2 под лицензией MIT: копирайт Zhipu AI, 2026 год, никаких дополнительных ограничений на коммерческое использование или размер компании. Репозиторий создан 16 июня 2026 года, карточка обновлялась 2 июля. Под той же лицензией опубликованы GLM-5.1 и GLM-4.6, разбор линейки — на странице версии GLM.
MIT здесь важнее, чем кажется. Он разрешает разворачивать модель в закрытом контуре, дообучать, встраивать в продукт и не раскрывать изменения. У большинства открытых моделей лицензии заметно строже, а у флагманов такого класса открытых весов чаще всего нет вовсе.
Чем запускать
- vLLM и SGLang — серверы инференса, штатный способ поднять модель как сервис с собственным HTTP-эндпоинтом.
- Transformers — библиотека Hugging Face, годится для экспериментов и дообучения.
- KTransformers — вариант для конфигураций, где часть слоёв уходит на процессор и в оперативную память.
Это те четыре способа, которые называет сам вендор. Форматов вроде GGUF, на которых работают настольные запускалки, в этом списке нет — то есть официальных сборок под такой сценарий Zhipu не публикует.
Какого железа это требует
Считается в одну строчку. У модели 753 млрд параметров; при восьми битах на параметр веса занимают около 750 гигабайт, при четырёх — порядка 375. Архитектура со смесью экспертов экономит вычисления, потому что на каждый токен активируется лишь часть сети, но хранить в памяти нужно всю модель целиком. Отсюда простой вывод: домашняя видеокарта на 24 гигабайта не подходит, речь идёт о сервере с несколькими ускорителями или об аренде GPU.
Как выбрать способ доступа
| Сценарий | Что подходит | Во что упирается |
|---|---|---|
| Попробовать модель | веб-чат вендора | лимиты не публикуются, версия по умолчанию — не флагман |
| Встроить в продукт | API z.ai или open.bigmodel.cn | оплата в валюте вендора, ставки меняются |
| Массовые дешёвые задачи | Flash-модели в API | лимиты частоты запросов неизвестны |
| Закрытый контур | свои веса под MIT | железо: сотни гигабайт памяти под веса |
| Разработка и агенты | подписка Coding Plan | от 18 долларов в месяц |
Короткие ответы
Можно ли скачать GLM 5.2?
Да, скачиваются веса модели с Hugging Face, репозиторий zai-org/GLM-5.2, лицензия MIT. Установщика или программы для обычного компьютера у модели нет — это файлы весов для серверного запуска.
Чат GLM бесплатный и нужна ли регистрация?
Веб-чат вендора бесплатен, регистрация не требуется. На chat.z.ai анонимному пользователю по умолчанию отвечает GLM-4.7, на китайском chatglm.cn по умолчанию стоит GLM-5.2. Лимиты бесплатного доступа вендор не публикует.
Есть ли приложение GLM для телефона или компьютера?
У международного контура на chat.z.ai и в docs.z.ai ссылок на приложения для iOS, Android или десктопа нет. В китайском App Store есть приложение Zhipu, но какая модель работает внутри, вендор не заявляет.
Какое железо нужно для локального запуска GLM 5.2?
Модель на 753 млрд параметров: даже при восьми битах на параметр веса занимают порядка 750 гигабайт, при четырёх — около 375. Это конфигурация из нескольких серверных ускорителей, на одну потребительскую видеокарту модель не помещается.
Чем запускать GLM 5.2 на своём сервере?
Вендор называет четыре способа: vLLM и SGLang — серверы инференса, штатный путь поднять модель как сервис с собственным HTTP-эндпоинтом; Transformers — библиотека Hugging Face для экспериментов и дообучения; KTransformers — вариант, когда часть слоёв уходит на процессор и в оперативную память. Формата GGUF, на котором работают настольные запускалки, в этом списке нет.
Что делать, если сервера под GLM 5.2 нет?
Три работающих варианта. Бесплатный веб-чат вендора — только помните, что анонимному пользователю на chat.z.ai по умолчанию отвечает GLM-4.7, а не флагман. Бесплатные модели GLM-4.7-Flash и GLM-4.5-Flash в API — они стоят ноль и на вход, и на выход. Или младшие открытые версии линейки, которые заметно легче флагмана.
Дальше по теме
- API и цены — если сервера нет: бесплатные модели в API
- Версии GLM — у каких версий открыты веса
- Zhipu AI и Z.ai — чья это модель и под каким правом работает