
Компания Z.ai представила GLM-5.2 — новую ведущую модель, созданную для задач, требующих продолжительного удержания контекста: работа с объемными проектами, связывание множества этапов и написание кода с учетом заданных условий.
С выходом новой версии в Z.ai Chat появился AI-агент, который помогает в создании презентаций. Вам нужно лишь описать тему, и агент соберет структуру, подготовит содержание и оформит материал в формате слайдов.
Эта модель уже доступна на Hugging Face под лицензией MIT. Z.ai также предлагает доступ через API и чат-бота. Более подробная информация представлена в статье на Postium.
Читайте также: ТОП-5 нейросетей для повседневной работы
Что может GLM-5.2 и как она функционирует
GLM-5.2 обладает контекстным окном на 1 миллион токенов. Это необходимо для работы с большими хранилищами данных, длинными документами и задачами, где модель должна запоминать не только последний запрос, но и структуру проекта, требования и правила разработки.
Z.ai считает GLM-5.2 значительным улучшением по сравнению с GLM-5.1, особенно в контексте длительных задач. В модели введены уровни «thinking effort»: разработчик может выбирать, что важно в конкретной ситуации — более качественный ответ, меньшая задержка или снижение вычислительной нагрузки.
Кроме того, Z.ai сообщает, что GLM-5.2 стала более экономичной при обработке длинных запросов. Это стало возможным благодаря изменению внутреннего механизма внимания: модель не пересчитывает часть данных на каждом слое, а повторно использует уже найденные связи в тексте. По словам Z.ai, это уменьшает нагрузку при работе с контекстом до 1 миллиона токенов.
Еще одно нововведение ускоряет процесс генерации ответов. Модель заранее предлагает несколько токенов, которые могут следовать, а затем проверяет, какие из них можно оставить. Z.ai утверждает, что в GLM-5.2 этот механизм стал принимать до 20% больше предсказанных токенов, что позволяет модели отвечать быстрее.
На бенчмарках для кода и задач с агентами GLM-5.2 продемонстрировала следующие результаты: 62.1 на SWE-bench Pro, 81.0 на Terminal-Bench 2.1, 77.0 на MCP-Atlas и 54.7 на Humanity’s Last Exam с tools. По данным Z.ai, модель значительно обходит GLM-5.1 и в ряде тестов конкурирует с закрытыми моделями уровня GPT-5.5, Gemini 3.1 Pro и Claude Opus 4.8.

Как бесплатно пользоваться GLM-5.2
Перейдите на сайт чат-бота Z.ai. GLM-5.2 уже доступна там по умолчанию, дополнительный выбор модели не требуется.

В запросном окне можно настроить уровень ответа и выбрать, насколько детально модель должна прорабатывать задание. Также здесь можно активировать или деактивировать функцию Deep Think.
Для создания презентации перейдите в раздел AI PPT в левом меню. Затем опишите задание в чате: тему, формат, целевую аудиторию и содержание слайдов. Агент подготовит презентацию по вашему запросу.

Если вы хотите запустить GLM-5.2 на своем компьютере, откройте страницу модели на Hugging Face, скачайте веса и разверните их на своем ПК, сервере или в собственной инфраструктуре. Для запуска можно использовать Transformers, vLLM или SGLang. В карточке модели также доступны Docker Model Runner и квантизированные версии для запуска с меньшими требованиями к ресурсам.
Почему это важно? GLM-5.2 — открытая модель с контекстом до 1 миллиона токенов. Это уникальное сочетание: высокие результаты в задачах на код и агентных сценариях, длинный контекст и возможность развернуть модель на своем оборудовании, а не использовать только через сторонний чат или API.
Итог: GLM-5.2 стала новой открытой моделью Z.ai для продолжительных задач в программировании с контекстным окном до 1 миллиона токенов.


