kosareva.cloud
kosareva.cloud/ news/ glm-5-2-otkrytaya-model-oboshla-claude-dostup-iz-rossii
Новые модели ·23 июля 2026 ·4

GLM-5.2: открытая модель, которая обошла Claude — и доступна без VPN

GLM-5.2: открытая модель, которая обошла Claude — и доступна без VPN

6 июня 2026 года китайская лаборатория Z.ai (выросла из Zhipu AI при Университете Цинхуа) выпустила GLM-5.2 — и произошло кое-что, чего раньше не случалось: открытая модель впервые заняла первое место в Design Arena, обойдя закрытый Claude Fable 5 от Anthropic.

Разберёмся, что это за модель, почему она важна и как её попробовать прямо сейчас — без VPN и иностранной карты.

Что такое GLM-5.2 и чем она выделяется

GLM-5.2 построена на архитектуре Mixture of Experts (MoE): суммарно 753 млрд параметров, но на каждый запрос активируется только ~98 млрд. Это означает высокую скорость при разумной стоимости токенов.

Главное, что отличает её от предшественников:

  • Контекстное окно 1 000 000 токенов — в пять раз больше, чем у GLM-5.1. Это позволяет загрузить целую кодовую базу, многолетний архив переписки или объёмный договор и работать со всем этим как с одним документом.
  • Механизм IndexShare — один индексатор на четыре слоя внимания, что сократило количество операций на токен почти в три раза по сравнению с GLM-5.1. Длинный контекст теперь не убивает скорость.
  • MIT-лицензия с открытыми весами — модель можно скачать, развернуть локально, дообучить под свои задачи без каких-либо отчислений.

Как она обучалась: Asynchronous Agent RL

Z.ai применили нестандартный подход к обучению с подкреплением: вместо оптимизации отдельных ответов модель обучалась на длинных цепочках действий. На практике это значит, что GLM-5.2 умеет планировать, последовательно вызывать инструменты и не теряет нить рассуждения на многошаговых задачах.

Тестирование проходило в 10 000+ проверяемых средах на 9 языках программирования. Демо-кейсы: сборка Chrome-расширения с нуля и перевод трёхлетнего React-проекта на TypeScript — без подсказок и промежуточных правок.

Два режима работы

Модель переключается между двумя режимами рассуждения:

  • High — быстрый ответ, меньше токенов, минимальная задержка. Подходит для рутинных задач и чата.
  • Max — глубокий анализ с развёрнутой цепочкой рассуждений. Для архитектурных решений, сложного кода, аналитики.

Бенчмарки: где впереди, где отстаёт

Z.ai честно позиционируют модель как «между Opus 4.7 и Opus 4.8». Вот реальные цифры:

БенчмаркGLM-5.2Claude Opus 4.8
Design Arena (Elo) 🥇13601350
Bridgebench (рассуждения) 🥇42,841,5
Terminal-Bench 2.181,0%85,0%
FrontierSWE74,4%75,1%
SWE-bench Pro62,1%69,2%

По кодингу GLM-5.2 чуть уступает Opus 4.8, но разрыв минимальный — и это первая открытая модель, которая вообще оказалась в этой весовой категории.

Что можно делать с миллионом токенов контекста

Миллион токенов — это не маркетинг, а рабочий инструмент:

  • Загрузить всю кодовую базу проекта и найти архитектурные проблемы за один запрос
  • Скормить трёхлетний legacy-проект и получить пошаговый план миграции на современный стек
  • Анализировать объёмные базы данных, многостраничные договоры и технические спецификации — без потери контекста между частями
  • Вести длинные агентские сессии, где модель помнит всё сделанное с самого начала

Как получить доступ из России — без VPN и иностранной карты

Официальный путь через Z.ai требует иностранной карты и VPN. Проще и быстрее — через kosareva.cloud.

Вы получаете доступ к GLM-5.2 через стандартный OpenAI-совместимый API: меняете base_url на https://api.kosareva.cloud/v1, указываете модель — и работаете. Никакого VPN, оплата в рублях по счёту, полный пакет закрывающих документов для бухгалтерии (счёт, акт, инвойс).

В личном кабинете доступны все топовые модели — Claude, GPT-5, Gemini, DeepSeek и теперь GLM-5.2 — в одном месте, с единым ключом и балансом.

Получить доступ к GLM-5.2 →

Для бизнеса

Подключите бизнес ко всем нейросетям

Один договор с закрывающими документами, выделенный менеджер, ЭДО через Контур.Диадок или СБИС и специальные цены при больших объёмах. Оставьте контакты — пришлём проект договора и тестовый ключ.

  • Персональный менеджер с реакцией до 15 минут в рабочее время
  • Кастомный SLA с финансовыми санкциями за нарушение uptime
  • ЭДО через Контур.Диадок / СБИС
  • Постоплата по факту, акты раз в квартал
  • Защищённый канал + IP-белый список + аудит-логи
  • SSO через SAML / OIDC для корпоративных аккаунтов

Ответим за 4 рабочих часа проектом договора в PDF.
Не передаём данные третьим лицам и не звоним без вашей просьбы.

Отправляя заявку, вы соглашаетесь с политикой обработки персональных данных.