GLM-5.2: открытая модель, которая обошла Claude — и доступна без VPN
6 июня 2026 года китайская лаборатория Z.ai (выросла из Zhipu AI при Университете Цинхуа) выпустила GLM-5.2 — и произошло кое-что, чего раньше не случалось: открытая модель впервые заняла первое место в Design Arena, обойдя закрытый Claude Fable 5 от Anthropic.
Разберёмся, что это за модель, почему она важна и как её попробовать прямо сейчас — без VPN и иностранной карты.
Что такое GLM-5.2 и чем она выделяется
GLM-5.2 построена на архитектуре Mixture of Experts (MoE): суммарно 753 млрд параметров, но на каждый запрос активируется только ~98 млрд. Это означает высокую скорость при разумной стоимости токенов.
Главное, что отличает её от предшественников:
- Контекстное окно 1 000 000 токенов — в пять раз больше, чем у GLM-5.1. Это позволяет загрузить целую кодовую базу, многолетний архив переписки или объёмный договор и работать со всем этим как с одним документом.
- Механизм IndexShare — один индексатор на четыре слоя внимания, что сократило количество операций на токен почти в три раза по сравнению с GLM-5.1. Длинный контекст теперь не убивает скорость.
- MIT-лицензия с открытыми весами — модель можно скачать, развернуть локально, дообучить под свои задачи без каких-либо отчислений.
Как она обучалась: Asynchronous Agent RL
Z.ai применили нестандартный подход к обучению с подкреплением: вместо оптимизации отдельных ответов модель обучалась на длинных цепочках действий. На практике это значит, что GLM-5.2 умеет планировать, последовательно вызывать инструменты и не теряет нить рассуждения на многошаговых задачах.
Тестирование проходило в 10 000+ проверяемых средах на 9 языках программирования. Демо-кейсы: сборка Chrome-расширения с нуля и перевод трёхлетнего React-проекта на TypeScript — без подсказок и промежуточных правок.
Два режима работы
Модель переключается между двумя режимами рассуждения:
- High — быстрый ответ, меньше токенов, минимальная задержка. Подходит для рутинных задач и чата.
- Max — глубокий анализ с развёрнутой цепочкой рассуждений. Для архитектурных решений, сложного кода, аналитики.
Бенчмарки: где впереди, где отстаёт
Z.ai честно позиционируют модель как «между Opus 4.7 и Opus 4.8». Вот реальные цифры:
| Бенчмарк | GLM-5.2 | Claude Opus 4.8 |
|---|---|---|
| Design Arena (Elo) 🥇 | 1360 | 1350 |
| Bridgebench (рассуждения) 🥇 | 42,8 | 41,5 |
| Terminal-Bench 2.1 | 81,0% | 85,0% |
| FrontierSWE | 74,4% | 75,1% |
| SWE-bench Pro | 62,1% | 69,2% |
По кодингу GLM-5.2 чуть уступает Opus 4.8, но разрыв минимальный — и это первая открытая модель, которая вообще оказалась в этой весовой категории.
Что можно делать с миллионом токенов контекста
Миллион токенов — это не маркетинг, а рабочий инструмент:
- Загрузить всю кодовую базу проекта и найти архитектурные проблемы за один запрос
- Скормить трёхлетний legacy-проект и получить пошаговый план миграции на современный стек
- Анализировать объёмные базы данных, многостраничные договоры и технические спецификации — без потери контекста между частями
- Вести длинные агентские сессии, где модель помнит всё сделанное с самого начала
Как получить доступ из России — без VPN и иностранной карты
Официальный путь через Z.ai требует иностранной карты и VPN. Проще и быстрее — через kosareva.cloud.
Вы получаете доступ к GLM-5.2 через стандартный OpenAI-совместимый API: меняете base_url на https://api.kosareva.cloud/v1, указываете модель — и работаете. Никакого VPN, оплата в рублях по счёту, полный пакет закрывающих документов для бухгалтерии (счёт, акт, инвойс).
В личном кабинете доступны все топовые модели — Claude, GPT-5, Gemini, DeepSeek и теперь GLM-5.2 — в одном месте, с единым ключом и балансом.