kosareva.cloud
kosareva.cloud/ news/ claude-opus-5-5-vyshel-silnee-v-agentnom-kode-i-na-20-deshevle-opus-5
Новые модели · · ·9 мин

Claude Opus 5.5 вышел: сильнее в агентном коде и на 20% дешевле Opus 5

Claude Opus 5.5 вышел: сильнее в агентном коде и на 20% дешевле Opus 5

Кратко

Claude Opus 5.5 — новая флагманская модель Anthropic для агентного программирования, сложных рабочих задач и управления инструментами. В сравнительной таблице к запуску она лидирует в семи из девяти дисциплин, а через kosareva.cloud стоит 432 ₽ за миллион входных и 2 160 ₽ за миллион выходных токенов — на 20% меньше, чем Opus 5.

Модель уже доступна через OpenAI-совместимый API без VPN. Карточка с актуальной ценой, контекстом и калькулятором расходов находится в разделе Claude Opus 5.5 — цены.

Что такое Claude Opus 5.5

Claude Opus 5.5 — флагманская модель Anthropic с контекстным окном до 1 млн токенов, созданная для длинных агентных сценариев, программирования, исследований и профессиональной работы с документами.

Главное изменение здесь не в одном рекордном тесте. Модель стала ровнее сразу в нескольких типах задач: пишет и исправляет код, выполняет команды в терминале, работает с интерфейсами, анализирует графики и дольше удерживает многошаговый план.

Это важно для задач, где нейросеть не просто отвечает в чате, а получает цель и действует: изучает репозиторий, меняет несколько файлов, запускает тесты, исправляет ошибки и проверяет результат. Именно на таких сценариях разница между поколениями обычно заметнее всего.

Что показали тесты Claude Opus 5.5

По данным сравнительной таблицы к запуску, Opus 5.5 занял первое место в семи из девяти представленных дисциплин. Два исключения тоже важны: GPT-6 Astra оказался выше в автоматизации бизнес-процессов и агентных научных исследованиях. Поэтому говорить об абсолютном лидерстве во всех задачах было бы неточно.

ЗадачаТестOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Агентное программированиеTerminal-Bench 4.066,4%55,8%52,3%57,9%37,3%
Агентное программированиеFrontierCode v1.154,4%50,3%48,0%53,3%47,5%
Агентное программированиеCursorBench 4.057,8%51,8%46,6%41,7%
Рабочие задачиGDPval-AA v2.118461735170815421588
Бизнес-процессыAutomationBench40,0%31,4%26,9%41,4%28,8%
Междисциплинарные рассужденияHumanity’s Last Exam67,7%65,6%63,6%57,2%
Агентные научные исследованияTerminal-Bench-Science 0.158,7%52,6%29,0%64,6%22,4%
Работа с компьютеромOSWorld 2.081,8%80,7%74,0%
Распознавание графиковChartography89,0%88,4%83,4%
Замеры Anthropic на день выхода модели. Жирным — где Opus 5.5 впереди. Часть тестов запускалась с доступом к инструментам, OSWorld — в режиме частичного зачёта.

Сравнение Claude Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra и GPT-5.6 Sol

Агентное программирование

На Terminal-Bench 4.0 модель получила 66,4%. Это на 10,8 процентного пункта выше Fable 5.1 и на 8,5 пункта выше GPT-6 Astra в конфигурациях из таблицы.

На FrontierCode v1.1 результат составил 54,4%. Отрыв от GPT-6 Astra здесь небольшой — 1,1 пункта, — но Opus 5.5 всё равно вышел вперёд. В CursorBench 4.0 новая модель набрала 57,8%, опередив Fable 5.1 на 6 пунктов и Opus 5 на 11,2 пункта.

Для разработчика это означает не «модель теперь сама сделает весь продукт», а более практичные вещи: меньше потерянных зависимостей при изменениях в нескольких файлах, более устойчивое выполнение длинной последовательности действий и выше шанс получить рабочий результат после проверки тестами.

Знания и междисциплинарное рассуждение

В GDPval-AA v2.1 Claude Opus 5.5 получил 1846 баллов. У Fable 5.1 — 1735, у Opus 5 — 1708, у GPT-6 Astra — 1542.

В Humanity’s Last Exam с инструментами результат достиг 67,7%. Здесь новая модель обошла Fable 5.1 на 2,1 пункта и GPT-6 Astra на 10,5 пункта. Такие тесты проверяют не бытовые знания, а способность собирать ответ на сложный вопрос из нескольких областей и пользоваться внешними инструментами.

Работа с компьютером и графиками

На OSWorld 2.0 модель набрала 81,8% в режиме partial — против 80,7% у Fable 5.1 и 74% у Opus 5. На Chartography результат составил 89% с инструментами.

Это полезно для агентов, которые работают не только с текстом. Например, открывают приложения, извлекают данные из интерфейса, сверяют графики, заполняют формы или последовательно выполняют действия в браузере и на рабочем столе.

Где GPT-6 Astra оказался сильнее

В AutomationBench GPT-6 Astra получил 41,4%, а Opus 5.5 — 40%. В Terminal-Bench-Science 0.1 разница заметнее: 64,6% против 58,7%.

Именно поэтому выбирать модель лучше по своему сценарию, а не по общему месту в таблице. Для агентного кода Opus 5.5 выглядит особенно сильным. Для узких научных пайплайнов и автоматизации процессов результат стоит проверять на собственном наборе задач.

Что изменилось в цене

В kosareva.cloud Claude Opus 5.5 стоит:

  • 432 ₽ за 1 млн входных токенов;

  • 2 160 ₽ за 1 млн выходных токенов;

  • 21,6 ₽ за 1 млн токенов при чтении кэша;

  • без абонентской платы, списание — по фактическому числу токенов.

Для Opus 5 цены составляли 540 ₽ за вход и 2 700 ₽ за выход. Снижение в обоих случаях — ровно 20%.

Это меняет экономику длинных агентных запусков. В них модель часто тратит много выходных токенов на рассуждение, код, отчёты инструментов и исправления. Чем длиннее цепочка, тем заметнее становится разница между 2 700 и 2 160 ₽ за миллион выходных токенов.

Кэширование особенно полезно для больших системных инструкций, документации и частей репозитория, которые повторно отправляются в каждом запросе. Но кэш сам по себе не возникает: приложение должно корректно размечать повторяемые блоки и использовать поддерживаемый механизм провайдера.

Что Opus 5.5 меняет для разработки и геймдева

Сильные результаты в Terminal-Bench, FrontierCode и CursorBench делают модель интересной для задач, где нужно не написать один фрагмент кода, а довести изменение до работающего состояния.

Практические сценарии:

  • рефакторинг нескольких модулей с запуском тестов;

  • поиск причины ошибки по логам и исходникам;

  • создание прототипа браузерной игры с последующей отладкой;

  • генерация механик, интерфейса и вспомогательных инструментов для игрового проекта;

  • миграция зависимостей и исправление несовместимостей;

  • ревью большого pull request с проверкой связанных файлов.

Но «модель пошатнёт геймдев» — слишком сильное обещание. Даже хороший игровой прототип не заменяет геймдизайн, арт-дирекцию, тестирование баланса, оптимизацию и работу с платформенными ограничениями. Opus 5.5 скорее сокращает путь от идеи до проверяемого прототипа и помогает небольшой команде быстрее перебирать варианты.

Как подключить Claude Opus 5.5 через API в России

В kosareva.cloud модель вызывается по идентификатору claude-opus-5-5. Используется единый OpenAI-совместимый адрес https://api.kosareva.cloud/v1, поэтому для существующего проекта обычно достаточно заменить базовый URL, ключ и название модели.

Пример cURL

curl https://api.kosareva.cloud/v1/chat/completions \
  -H "Authorization: Bearer $KOSAREVA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "messages": [
      {
        "role": "user",
        "content": "Проверь архитектуру проекта и предложи план безопасного рефакторинга"
      }
    ]
  }'

Пример на Python

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_KOSAREVA_API_KEY",
    base_url="https://api.kosareva.cloud/v1",
)

response = client.chat.completions.create(
    model="claude-opus-5-5",
    messages=[
        {
            "role": "user",
            "content": "Найди потенциальные ошибки в этом коде и предложи тесты",
        }
    ],
)

print(response.choices[0].message.content)

Запросы проходят без VPN, оплата идёт в рублях. Для команд можно выпускать отдельные ключи, задавать лимиты и смотреть расход по каждому проекту.

Чего пока не стоит ждать

Первые таблицы хорошо показывают направление, но не гарантируют такой же разницы в вашем проекте. Результат зависит от агентной обвязки, уровня effort, набора инструментов, лимита токенов и правил конкретного теста.

Кроме того, Opus 5.5 не выиграл все дисциплины. На двух тестах из таблицы лидирует GPT-6 Astra, а преимущества в OSWorld и Chartography измерены в режимах с дополнительными условиями — partial или with tools. Эти подписи нельзя отбрасывать при сравнении.

И ещё одно ограничение — цена. Снижение на 20% делает Opus доступнее, но это всё ещё флагман для сложных задач. Для простой классификации, коротких ответов и массовой обработки однотипных запросов разумнее использовать более лёгкую модель, а Opus 5.5 подключать там, где ошибка или лишний цикл агента обходятся дороже токенов.

FAQ

Сколько стоит Claude Opus 5.5 через kosareva.cloud?

Ввод стоит 432 ₽ за 1 млн токенов, вывод — 2 160 ₽ за 1 млн токенов. Чтение кэша стоит 21,6 ₽ за миллион токенов. Абонентской платы нет.

Какой идентификатор модели использовать в API?

Укажите claude-opus-5-5 в поле model. Базовый адрес OpenAI-совместимого API kosareva.cloud — https://api.kosareva.cloud/v1.

Нужен ли VPN для Claude Opus 5.5?

Нет. Через kosareva.cloud API доступен без VPN, запросы можно оплачивать в рублях российской картой, через СБП или по счёту для юридического лица.

Подходит ли Claude Opus 5.5 для программирования?

Да. В таблице к запуску модель лидирует в Terminal-Bench 4.0, FrontierCode v1.1 и CursorBench 4.0, поэтому особенно интересна для длинных агентных задач, отладки и изменений в нескольких файлах.

Claude Opus 5.5 лучше GPT-6 Astra?

Зависит от задачи. Opus 5.5 лидирует в большинстве представленных тестов, включая три теста агентного программирования. GPT-6 Astra выше в AutomationBench и Terminal-Bench-Science 0.1.

Попробовать можно прямо сейчас. Claude Opus 5.5 уже подключена на kosareva.cloud: модель доступна в чате кабинета и по API, с оплатой в рублях и без VPN. Цена и примеры кода — на странице модели.

Вывод

Claude Opus 5.5 выглядит не как косметическое обновление, а как шаг в сторону более надёжных рабочих агентов. Самый заметный прогресс — в программировании, длинных цепочках действий, работе с компьютером и анализе визуальных данных.

Снижение цены на 20% делает модель практичнее для регулярных запусков, но главный вопрос остаётся прежним: сколько задач она доведёт до проверенного результата именно в вашем пайплайне. Ответ на него даст не общий рейтинг, а небольшой набор собственных тестов с реальным кодом, инструментами и ограничениями.

Источники

/ Попробовать

Заведите аккаунт за минуту

Один ключ ко всем моделям из статьи. Пополнение от 50 ₽ картой или по счёту, списание по факту, без абонентской платы.

Дальше — ФИО и телефон в кабинете. Нажимая «Продолжить», вы соглашаетесь с офертой и политикой конфиденциальности.

или быстрый вход
Для бизнеса

Подключите бизнес ко всем нейросетям

Один договор с закрывающими документами, выделенный менеджер, ЭДО через Контур.Диадок или СБИС и специальные цены при больших объёмах. Оставьте контакты — пришлём проект договора и тестовый ключ.

  • Персональный менеджер с реакцией до 15 минут в рабочее время
  • Кастомный SLA с финансовыми санкциями за нарушение uptime
  • ЭДО через Контур.Диадок / СБИС
  • Постоплата по факту, акты раз в квартал
  • Защищённый канал + IP-белый список + аудит-логи
  • SSO через SAML / OIDC для корпоративных аккаунтов

Ответим за 4 рабочих часа проектом договора в PDF.
Не передаём данные третьим лицам и не звоним без вашей просьбы.

Отправляя заявку, вы соглашаетесь с политикой обработки персональных данных.