Z.ai20-е место в рейтингеоткрытые веса

GLM 5.2

GLM 5.2 от Z.ai: открытые веса под лицензией MIT, миллион токенов контекста, сильные результаты на кодовых бенчмарках. Есть и бесплатная версия.

Открыть в чате
Общая
46.8
Рассуждения
46.1
Код
38.4
Агенты
32.3

Метод TrueSkill по совокупности бенчмарков, учтено 19. Длина полоски — доля от оценки лидера рейтинга. Источник — LLM Stats.

Вышла
16 июня 2026
Параметров
753 млрд
Контекстное окно
1 млн токенов
Максимальный ответ
131 тыс. токенов
Понимает
текст
Режим рассуждений
есть, уровни: xhigh, high
Цена ответа
0,26 ₽ за ответ на 1 000 токенов вопроса и 500 токенов ответа
За миллион токенов
101 ₽ на входе, 316 ₽ на выходе
Открытые веса
zai-org/GLM-5.2

Характеристики сверены с каталогом 22.08.2026. Цены пересчитаны в рубли по курсу списания токенов Krisana.

GLM 5.2 — флагман китайской лаборатории Z.ai, выложенный под чистой лицензией MIT. Это редкость: большинство «открытых» моделей раздают под собственными лицензиями с оговорками, а MIT не ограничивает почти ничего, включая коммерческое использование.

Чем сильна

Кодом и длинными задачами. Разработчики приводят 81,0 на Terminal-Bench 2.1 и 62,1 на SWE-bench Pro — на момент выхода это были лучшие результаты среди моделей с открытыми весами. Отдельно они отмечают устойчивость на «марафонах»: агент, работающий часами над одной задачей, не разваливается к середине.

Контекст — 1 млн токенов. Модель текстовая: картинки и видео она не принимает, и это главное её ограничение против соседей по рейтингу.

Что под капотом

753 млрд параметров в архитектуре «смеси экспертов». Из инженерных решений интересен IndexShare: один лёгкий индексатор переиспользуется на каждые четыре слоя разреженного внимания, что снижает расход вычислений на длинном контексте почти втрое. Для пользователя это выражается в том, что миллион токенов у GLM стоит недорого.

Режим размышления — два уровня, high и max.

Бесплатная версия

У нас в каталоге есть и бесплатный вариант GLM 5.2: та же модель, без оплаты за токены, с ограничениями по нагрузке. Если задача не срочная, начните с неё, а на платную переходите, когда упрётесь в лимиты.

Где спотыкается

Только текст на входе. И, как у моделей китайских лабораторий вообще, русский язык корректен, но менее живой, чем у Claude или GPT — на технических задачах это незаметно, на текстах для читателя заметно.

Как начать

Нажмите «Открыть в чате»: русский язык, без VPN и зарубежной карты, оплата токенами Krisana по факту.

Страница обновлена 23.08.2026.

Рядом в рейтинге

Весь рейтинг из 50 моделей