Новинка: Grom Zvuk — наша музыкальная модельПослушать и попробовать

Claude Opus 5.5 вышла: цена, бенчмарки и что ломается при переезде с Opus 5

Claude Opus 5.5 вышла: цена, бенчмарки и что ломается при переезде с Opus 5

22 сентября 2026 года Anthropic выпустила Claude Opus 5.5 — новый флагман основной линейки, преемник Opus 5. В GPTunneL модель появилась через три минуты после анонса: в нашем API она называется claude-opus-5.5, в API Anthropic — claude-opus-5-5.

Коротко о главном: модель дешевле Opus 5 за токен, сильнее в агентном коде и работе с компьютером, но при переезде ломает четыре вещи в запросе. Ниже — цена, бенчмарки, список правок и то, что мы проверили через свой шлюз в день релиза.

Цена и доступ

ПараметрЗначение
ID в API Anthropicclaude-opus-5-5
ID в GPTunneLclaude-opus-5.5
Вход / выход$4 / $20 за 1M токенов (у Opus 5 — $5 / $25)
Кэшчтение $0,20, запись $5 (5 минут) и $8 (1 час) за 1M
Batchвдвое дешевле: $2 / $10
Fast modeдо 2,5× скорости за $8 / $40, только в Claude API, research preview
Рассуждениявсегда включены, глубина — через effort, по умолчанию medium
ОблакаAWS Bedrock, Google Cloud, Microsoft Foundry

Anthropic оценивает экономию на типовой нагрузке примерно в 40% относительно Opus 5: к снижению цены добавляется более быстрая выдача (на 30%+) и меньше лишнего текста в ответах. Считать это стоит на своих запросах: при одном и том же effort Opus 5.5 рассуждает дольше, чем Opus 5, и часть экономии съедают токены размышлений.

Бенчмарки

Цифры из анонса Anthropic.

БенчмаркOpus 5.5Для сравнения
Terminal-Bench 4.066,4%Opus 5 — 52,3%
FrontierCode v1.154,4%GPT-6 Astra — 53,3%
CursorBench 4.057,8%Fable 5.1 — 51,8%
GDPval-AA v2.11846 EloFable 5.1 — 1735, Opus 5 — 1708
Humanity's Last Exam (с инструментами)67,7%Opus 5 — 63,6%
OSWorld 2.081,8%

Интереснее строки не про Opus 5, а про соседей по цене. На FrontierCode Opus 5.5 обходит GPT-6 Astra, которая стоит $10 / $50 за миллион токенов, а на CursorBench — Fable 5.1, модель классом выше. По устойчивости к prompt injection на бенчмарке Gray Swan она наравне с Fable 5.1.

Из кейсов тестировщиков в анонсе: миграция на 680 тысяч строк кода меньше чем за сутки, перевод HAProxy с C на Rust за 9,5 часа против 12 у Fable 5.1 и на 51% дешевле. Это отчёты партнёров Anthropic, а не воспроизводимые замеры — ориентир, а не гарантия.

Что ломается при переезде с Opus 5

Замена имени модели — не всё. По гайду Anthropic четыре изменения валят запрос с 400:

Что былоЧто сталоЧто делать
thinking: {"type": "disabled"}400 — рассуждения не отключаютсяубрать поле или поставить adaptive, понизить effort
thinking: {"type": "enabled", "budget_tokens": N}400 — ручного бюджета неттот же рецепт: effort вместо бюджета
tool_choice: any или конкретный инструмент400 — принудительного вызова нетauto + strict: true или structured outputs
computer_20251124 (Claude API, Google Cloud)400переезд на computer_toolset_20260801

Ещё три изменения ничего не роняют, но меняют поведение:

  • Дефолтный effortmedium, у Opus 5 был high. Запрос без параметра теперь идёт на другом уровне, чем раньше, — и по качеству, и по счёту. Задай уровень явно и прогони свой eval заново — настройку от Opus 5 не переносить.
  • Текст между вызовами инструментов приходит в блоках thinking, а не text, и при дефолтном display: "omitted" он пустой. Если твой интерфейс показывал пользователю «сейчас ищу в базе…», он молча замолчит.
  • Блоки рассуждений привязаны к модели и к префиксу диалога. Для аккаунтов, созданных с 31 августа 2026 года, повтор блока после правки system, tools или старого сообщения даёт 400. Диалог держи append-only, инструкции меняй системными сообщениями посреди разговора.

Схема: запрос проходит через шлюз к модели, внутри которой всегда горит блок рассуждений с регулятором глубины, инструменты отвечают сбоку

Что мы проверили через шлюз GPTunneL

В день релиза прогнали через наш OpenAI-совместимый API три запроса:

  • reasoning_effort: "low" принимается, простой вопрос обошёлся в 28 токенов.
  • tool_choice: "required" не вернул 400: шлюз отдал обычный tool_calls с finish_reason: "tool_calls". На прямом API Anthropic тот же запрос упадёт, так что при переезде с нас на прямой ключ это место придётся переписать.
  • Без tool_choice, с просьбой в промпте «используй get_weather», модель вызвала инструмент сама — именно так Anthropic и рекомендует добиваться вызова.

Минимальный запрос:

bash
curl https://gptunnel.ru/v1/chat/completions \
  -H "Authorization: $GPTUNNEL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5.5",
    "reasoning_effort": "medium",
    "messages": [{"role": "user", "content": "Найди ошибку в этом SQL: ..."}]
  }'

Параметра thinking в запросе к нам нет вообще — глубиной управляет reasoning_effort, как и у остальных рассуждающих моделей каталога. Имя модели и уровень держи в переменных окружения: тогда переключение между Opus 5, Opus 5.5 и Fable 5.1 — одна строка конфига. Для долгих ответов на high и выше нужен стриминг, иначе упрёшься в таймауты — пример парсера SSE со служебными keepalive-строками шлюза разбирали в статье про GPT-6 Astra.

Отказы и безопасность

Anthropic называет Opus 5.5 самой согласованной моделью из протестированных: в автоматическом аудите поведения она попыталась обойти ограничения среды примерно на 85% реже, чем Opus 5. Защитные механизмы повторяют Fable 5.1:

  • Кибербезопасность. Большую часть задач этой категории Anthropic перенаправляет на Opus 4.8. Обычная отладка и исправление уязвимостей в своём коде работают.
  • Биология. Работает отдельный классификатор, расширенный доступ — через программу верификации.
  • Извлечение рассуждений. Просьбы вывести внутренние размышления в ответ могут отклоняться с категорией reasoning_extraction.

На прямом API отказ приходит как HTTP 200 со stop_reason: "refusal". Это штатный ответ, а не сетевая ошибка: ретрай того же запроса на ту же модель ничего не даст, нужен фоллбек на другую модель.

Что дальше: Sonnet 5.5, Haiku 5.5 и ответ OpenAI

Anthropic обещает Sonnet 5.5 и Haiku 5.5 «в ближайшие недели» с тем же набором улучшений. Для большинства продакшен-пайплайнов это новость важнее самого Opus: основная нагрузка обычно идёт на средний тир.

OpenAI ответила в тот же день: примерно через полтора часа после Opus 5.5 вышли GPT-6 Sol и GPT-6 Luna — средняя и лёгкая модели поколения GPT-6 рядом с Astra, вдвое дешевле предшественниц из GPT-5.6. Обе уже в каталоге GPTunneL; что они умеют и на какие задачи их ставить — в отдельном разборе.

Частые вопросы о Claude Opus 5.5

Claude Opus 5.5 уже вышла? Да, 22 сентября 2026 года: Claude API, AWS, Google Cloud и Microsoft Foundry. В GPTunneL — с того же дня.

Сколько стоит Opus 5.5? У Anthropic — $4 за миллион входных токенов и $20 за миллион выходных. В GPTunneL — 1,2 ₽ за 1K входных и 6 ₽ за 1K выходных токенов, на 20% дешевле Opus 5, без подписки. Актуальные цены — на странице цен.

Можно пользоваться бесплатно? Постоянного бесплатного доступа нет, API Anthropic платный. В GPTunneL платишь только за израсходованные токены.

Opus 5.5 или Fable 5.1? По бенчмаркам Anthropic Opus 5.5 обходит Fable 5.1 на CursorBench и GDPval-AA и стоит дешевле. Fable 5.1 остаётся моделью для самых длинных и сложных задач. Сравнить на своём промпте проще всего в одном чате.

Как отключить рассуждения? Никак — у Opus 5.5 они всегда включены. Минимальная глубина — effort: "low" (в нашем API — reasoning_effort: "low").

Нужен ли VPN? Нет: в GPTunneL модель работает из России без VPN, оплата российскими картами в рублях.

Итог

Opus 5.5 — редкий релиз, где флагман стал одновременно дешевле и сильнее предшественника. Цена переезда — ревизия слоя интеграции: убрать отключение рассуждений и ручной бюджет, отказаться от принудительного tool_choice, явно выставить effort и проверить, не пропали ли у пользователей промежуточные сообщения агента.

Открой Claude Opus 5.5 в GPTunneL и прогони свой набор запросов рядом с Opus 5 и Fable 5.1 — на одном балансе и одним ключом. Спецификация запросов и лимитов — в документации и на docs.gptunnel.ru.