Claude Opus 5.5 вышел: сильнее в агентном коде и на 20% дешевле Opus 5
Кратко
Claude Opus 5.5 — новая флагманская модель Anthropic для агентного программирования, сложных рабочих задач и управления инструментами. В сравнительной таблице к запуску она лидирует в семи из девяти дисциплин, а через kosareva.cloud стоит 432 ₽ за миллион входных и 2 160 ₽ за миллион выходных токенов — на 20% меньше, чем Opus 5.
Модель уже доступна через OpenAI-совместимый API без VPN. Карточка с актуальной ценой, контекстом и калькулятором расходов находится в разделе Claude Opus 5.5 — цены.
Что такое Claude Opus 5.5
Claude Opus 5.5 — флагманская модель Anthropic с контекстным окном до 1 млн токенов, созданная для длинных агентных сценариев, программирования, исследований и профессиональной работы с документами.
Главное изменение здесь не в одном рекордном тесте. Модель стала ровнее сразу в нескольких типах задач: пишет и исправляет код, выполняет команды в терминале, работает с интерфейсами, анализирует графики и дольше удерживает многошаговый план.
Это важно для задач, где нейросеть не просто отвечает в чате, а получает цель и действует: изучает репозиторий, меняет несколько файлов, запускает тесты, исправляет ошибки и проверяет результат. Именно на таких сценариях разница между поколениями обычно заметнее всего.
Что показали тесты Claude Opus 5.5
По данным сравнительной таблицы к запуску, Opus 5.5 занял первое место в семи из девяти представленных дисциплин. Два исключения тоже важны: GPT-6 Astra оказался выше в автоматизации бизнес-процессов и агентных научных исследованиях. Поэтому говорить об абсолютном лидерстве во всех задачах было бы неточно.
Задача Тест Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol Агентное программирование Terminal-Bench 4.0 66,4% 55,8% 52,3% 57,9% 37,3% Агентное программирование FrontierCode v1.1 54,4% 50,3% 48,0% 53,3% 47,5% Агентное программирование CursorBench 4.0 57,8% 51,8% 46,6% — 41,7% Рабочие задачи GDPval-AA v2.1 1846 1735 1708 1542 1588 Бизнес-процессы AutomationBench 40,0% 31,4% 26,9% 41,4% 28,8% Междисциплинарные рассуждения Humanity’s Last Exam 67,7% 65,6% 63,6% 57,2% — Агентные научные исследования Terminal-Bench-Science 0.1 58,7% 52,6% 29,0% 64,6% 22,4% Работа с компьютером OSWorld 2.0 81,8% 80,7% 74,0% — — Распознавание графиков Chartography 89,0% 88,4% 83,4% — —
Сравнение Claude Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra и GPT-5.6 Sol
Агентное программирование
На Terminal-Bench 4.0 модель получила 66,4%. Это на 10,8 процентного пункта выше Fable 5.1 и на 8,5 пункта выше GPT-6 Astra в конфигурациях из таблицы.
На FrontierCode v1.1 результат составил 54,4%. Отрыв от GPT-6 Astra здесь небольшой — 1,1 пункта, — но Opus 5.5 всё равно вышел вперёд. В CursorBench 4.0 новая модель набрала 57,8%, опередив Fable 5.1 на 6 пунктов и Opus 5 на 11,2 пункта.
Для разработчика это означает не «модель теперь сама сделает весь продукт», а более практичные вещи: меньше потерянных зависимостей при изменениях в нескольких файлах, более устойчивое выполнение длинной последовательности действий и выше шанс получить рабочий результат после проверки тестами.
Знания и междисциплинарное рассуждение
В GDPval-AA v2.1 Claude Opus 5.5 получил 1846 баллов. У Fable 5.1 — 1735, у Opus 5 — 1708, у GPT-6 Astra — 1542.
В Humanity’s Last Exam с инструментами результат достиг 67,7%. Здесь новая модель обошла Fable 5.1 на 2,1 пункта и GPT-6 Astra на 10,5 пункта. Такие тесты проверяют не бытовые знания, а способность собирать ответ на сложный вопрос из нескольких областей и пользоваться внешними инструментами.
Работа с компьютером и графиками
На OSWorld 2.0 модель набрала 81,8% в режиме partial — против 80,7% у Fable 5.1 и 74% у Opus 5. На Chartography результат составил 89% с инструментами.
Это полезно для агентов, которые работают не только с текстом. Например, открывают приложения, извлекают данные из интерфейса, сверяют графики, заполняют формы или последовательно выполняют действия в браузере и на рабочем столе.
Где GPT-6 Astra оказался сильнее
В AutomationBench GPT-6 Astra получил 41,4%, а Opus 5.5 — 40%. В Terminal-Bench-Science 0.1 разница заметнее: 64,6% против 58,7%.
Именно поэтому выбирать модель лучше по своему сценарию, а не по общему месту в таблице. Для агентного кода Opus 5.5 выглядит особенно сильным. Для узких научных пайплайнов и автоматизации процессов результат стоит проверять на собственном наборе задач.
Что изменилось в цене
В kosareva.cloud Claude Opus 5.5 стоит:
432 ₽ за 1 млн входных токенов;
2 160 ₽ за 1 млн выходных токенов;
21,6 ₽ за 1 млн токенов при чтении кэша;
без абонентской платы, списание — по фактическому числу токенов.
Для Opus 5 цены составляли 540 ₽ за вход и 2 700 ₽ за выход. Снижение в обоих случаях — ровно 20%.
Это меняет экономику длинных агентных запусков. В них модель часто тратит много выходных токенов на рассуждение, код, отчёты инструментов и исправления. Чем длиннее цепочка, тем заметнее становится разница между 2 700 и 2 160 ₽ за миллион выходных токенов.
Кэширование особенно полезно для больших системных инструкций, документации и частей репозитория, которые повторно отправляются в каждом запросе. Но кэш сам по себе не возникает: приложение должно корректно размечать повторяемые блоки и использовать поддерживаемый механизм провайдера.
Что Opus 5.5 меняет для разработки и геймдева
Сильные результаты в Terminal-Bench, FrontierCode и CursorBench делают модель интересной для задач, где нужно не написать один фрагмент кода, а довести изменение до работающего состояния.
Практические сценарии:
рефакторинг нескольких модулей с запуском тестов;
поиск причины ошибки по логам и исходникам;
создание прототипа браузерной игры с последующей отладкой;
генерация механик, интерфейса и вспомогательных инструментов для игрового проекта;
миграция зависимостей и исправление несовместимостей;
ревью большого pull request с проверкой связанных файлов.
Но «модель пошатнёт геймдев» — слишком сильное обещание. Даже хороший игровой прототип не заменяет геймдизайн, арт-дирекцию, тестирование баланса, оптимизацию и работу с платформенными ограничениями. Opus 5.5 скорее сокращает путь от идеи до проверяемого прототипа и помогает небольшой команде быстрее перебирать варианты.
Как подключить Claude Opus 5.5 через API в России
В kosareva.cloud модель вызывается по идентификатору claude-opus-5-5. Используется единый OpenAI-совместимый адрес https://api.kosareva.cloud/v1, поэтому для существующего проекта обычно достаточно заменить базовый URL, ключ и название модели.
Пример cURL
curl https://api.kosareva.cloud/v1/chat/completions \
-H "Authorization: Bearer $KOSAREVA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5-5",
"messages": [
{
"role": "user",
"content": "Проверь архитектуру проекта и предложи план безопасного рефакторинга"
}
]
}'
Пример на Python
from openai import OpenAI
client = OpenAI(
api_key="YOUR_KOSAREVA_API_KEY",
base_url="https://api.kosareva.cloud/v1",
)
response = client.chat.completions.create(
model="claude-opus-5-5",
messages=[
{
"role": "user",
"content": "Найди потенциальные ошибки в этом коде и предложи тесты",
}
],
)
print(response.choices[0].message.content)
Запросы проходят без VPN, оплата идёт в рублях. Для команд можно выпускать отдельные ключи, задавать лимиты и смотреть расход по каждому проекту.
Чего пока не стоит ждать
Первые таблицы хорошо показывают направление, но не гарантируют такой же разницы в вашем проекте. Результат зависит от агентной обвязки, уровня effort, набора инструментов, лимита токенов и правил конкретного теста.
Кроме того, Opus 5.5 не выиграл все дисциплины. На двух тестах из таблицы лидирует GPT-6 Astra, а преимущества в OSWorld и Chartography измерены в режимах с дополнительными условиями — partial или with tools. Эти подписи нельзя отбрасывать при сравнении.
И ещё одно ограничение — цена. Снижение на 20% делает Opus доступнее, но это всё ещё флагман для сложных задач. Для простой классификации, коротких ответов и массовой обработки однотипных запросов разумнее использовать более лёгкую модель, а Opus 5.5 подключать там, где ошибка или лишний цикл агента обходятся дороже токенов.
FAQ
Сколько стоит Claude Opus 5.5 через kosareva.cloud?
Ввод стоит 432 ₽ за 1 млн токенов, вывод — 2 160 ₽ за 1 млн токенов. Чтение кэша стоит 21,6 ₽ за миллион токенов. Абонентской платы нет.
Какой идентификатор модели использовать в API?
Укажите claude-opus-5-5 в поле model. Базовый адрес OpenAI-совместимого API kosareva.cloud — https://api.kosareva.cloud/v1.
Нужен ли VPN для Claude Opus 5.5?
Нет. Через kosareva.cloud API доступен без VPN, запросы можно оплачивать в рублях российской картой, через СБП или по счёту для юридического лица.
Подходит ли Claude Opus 5.5 для программирования?
Да. В таблице к запуску модель лидирует в Terminal-Bench 4.0, FrontierCode v1.1 и CursorBench 4.0, поэтому особенно интересна для длинных агентных задач, отладки и изменений в нескольких файлах.
Claude Opus 5.5 лучше GPT-6 Astra?
Зависит от задачи. Opus 5.5 лидирует в большинстве представленных тестов, включая три теста агентного программирования. GPT-6 Astra выше в AutomationBench и Terminal-Bench-Science 0.1.
Попробовать можно прямо сейчас. Claude Opus 5.5 уже подключена на kosareva.cloud: модель доступна в чате кабинета и по API, с оплатой в рублях и без VPN. Цена и примеры кода — на странице модели.
Вывод
Claude Opus 5.5 выглядит не как косметическое обновление, а как шаг в сторону более надёжных рабочих агентов. Самый заметный прогресс — в программировании, длинных цепочках действий, работе с компьютером и анализе визуальных данных.
Снижение цены на 20% делает модель практичнее для регулярных запусков, но главный вопрос остаётся прежним: сколько задач она доведёт до проверенного результата именно в вашем пайплайне. Ответ на него даст не общий рейтинг, а небольшой набор собственных тестов с реальным кодом, инструментами и ограничениями.
Источники
Заведите аккаунт за минуту
Один ключ ко всем моделям из статьи. Пополнение от 50 ₽ картой или по счёту, списание по факту, без абонентской платы.