Вышел Grok 4.7: новая модель xAI для кода и долгих задач
Кратко: xAI выпустила Grok 4.7 — модель для программирования, инженерных и многошаговых рабочих задач. Протестировать её можно через kosareva.cloud: с оплатой в рублях, без VPN и с OpenAI-совместимым API. Базовая цена составляет 216 ₽ за миллион входных и 648 ₽ за миллион выходных токенов.
Что изменилось в Grok 4.7
Grok 4.7 — новая флагманская модель xAI для кода и интеллектуальной работы. По данным разработчика, она дольше удерживает сложную задачу, внимательнее проверяет собственный результат и лучше управляет большим контекстом.
В основе версии 4.7 лежит новая, более крупная базовая модель. Для обучения xAI увеличила этап обучения с подкреплением и добавила больше задач, выполнение которых занимает несколько часов. Поэтому основной сценарий Grok 4.7 — не короткий ответ в чате, а длинная последовательность действий: разобраться в проекте, внести изменения, проверить их и подготовить итоговый материал.
Модель также обучали работе с Grok Bot. Это должно помочь ей в диалоговых сценариях, при подготовке документов и в общих задачах, где нужно последовательно использовать несколько инструментов.
Результаты Grok 4.7 в бенчмарках
По опубликованной xAI таблице Grok 4.7 не лидирует во всех тестах, но заметно прибавляет относительно Grok 4.6. Она вышла на первое место среди сравниваемых моделей в двух категориях:
- EEBench: 64,0% — задачи по электротехнике и проектированию оборудования;
- Harvey Legal Agent Benchmark: 19,6% — многошаговая юридическая работа с документами.
В программировании результаты смешанные. В DeepSWE v1.1 Grok 4.7 набрала 71,0% в режиме High Effort, немного уступив GPT‑5.6 Sol Max с 72,7%. В CursorBench 4.0 результат Grok 4.7 составил 46,3%, тогда как Fable 5.1 Max набрала 51,8%.
Стоимость моделей:
- Grok 4.7 и Grok 4.6: 216 ₽ за миллион входных и 648 ₽ за миллион выходных токенов;
- GPT‑5.6 Sol: 432 ₽ за миллион входных и 2 160 ₽ за миллион выходных токенов;
- Fable 5.1: 1 080 ₽ за миллион входных и 5 400 ₽ за миллион выходных токенов.
Сравнение цен и результатов Grok 4.7, Grok 4.6, GPT‑5.6 Sol и Fable 5.1
Сравнение стоимости и результатов моделей. Рублёвые цены приведены выше. Звёздочка у DeepSWE означает режим High Effort.
Таблица показывает важное ограничение анонса: лидер зависит от типа задачи. Fable 5.1 Max остаётся впереди в CursorBench 4.0, AA‑Briefcase v1.1, Terminal‑Bench 4.0 и HealthBench Professional. GPT‑5.6 Sol Max лидирует в DeepSWE v1.1. Поэтому результаты xAI стоит читать не как абсолютный рейтинг, а как набор отдельных сценариев.
Цена Grok 4.7
Базовая цена Grok 4.7 составляет 216 ₽ за миллион входных токенов и 648 ₽ за миллион выходных токенов — столько же, сколько стоила Grok 4.6 на старте. Ускоренный вариант с удвоенной скоростью вывода обойдётся в 432 ₽ за миллион входных и 1 296 ₽ за миллион выходных токенов.
В самом анонсе xAI отдельно не указала размер контекстного окна Grok 4.7. У предыдущей версии Grok 4.6 оно составляло 500 тыс. токенов, но переносить эту характеристику на новую модель без обновлённой документации пока рано.
Где попробовать Grok 4.7
Grok 4.7 можно протестировать через kosareva.cloud. Модель доступна по единому API вместе с другими зарубежными нейросетями — с оплатой в рублях и без VPN.
Для первого теста достаточно войти в кабинет kosareva.cloud, создать
API-ключ и выбрать Grok 4.7. API совместим с форматом OpenAI, поэтому
модель можно подключить к существующему приложению, скрипту или агенту
заменой базового адреса на
https://api.kosareva.cloud/v1.
Расходы списываются в рублях по фактическому количеству токенов. Для команд можно выпускать отдельные ключи под проекты и сотрудников, задавать лимиты и отслеживать расход по каждому ключу.
Что важно учитывать
Опубликованные показатели — результаты тестов в конкретных конфигурациях и режимах рассуждения. Они не гарантируют такого же соотношения качества в вашем коде, документах или юридических задачах. Особенно это заметно по таблице: Grok 4.7 лидирует в инженерии и юридической работе, но уступает другим моделям в части программных, терминальных и клинических тестов.
Практический вывод простой: Grok 4.7 стоит тестировать на длинных задачах, где модели нужно работать с большим объёмом материалов, использовать инструменты и проверять результат. Для коротких запросов разница с предыдущей версией может быть менее заметной.
Источники
Заведите аккаунт за минуту
Один ключ ко всем моделям из статьи. Пополнение от 50 ₽ картой или по счёту, списание по факту, без абонентской платы.