Claude Opus 5.5 шықты: бағасы, бенчмарктары және Opus 5-тен көшкенде не бұзылады

Claude Opus 5.5 шықты: бағасы, бенчмарктары және Opus 5-тен көшкенде не бұзылады

2026 жылғы 22 қыркүйекте Anthropic Claude Opus 5.5 моделін шығарды — негізгі желінің жаңа флагманы, Opus 5 ізбасары. GPTunneL-де модель анонстан үш минуттан кейін пайда болды: біздің API-де ол claude-opus-5.5, Anthropic API-інде — claude-opus-5-5.

Қысқасы: модель токен бойынша Opus 5-тен арзан, агенттік код пен компьютермен жұмыста күштірек, бірақ көшкенде сұраудағы төрт нәрсені бұзады. Төменде — бағасы, бенчмарктар, түзетулер тізімі және релиз күні өз шлюзіміз арқылы не тексергеніміз.

Бағасы мен қолжетімділігі

ПараметрМәні
Anthropic API-дегі IDclaude-opus-5-5
GPTunneL-дегі IDclaude-opus-5.5
Кіріс / шығыс1M токенге $4 / $20 (Opus 5-те — $5 / $25)
Кэшоқу $0,20, жазу $5 (5 минут) және $8 (1 сағат), 1M үшін
Batchекі есе арзан: $2 / $10
Fast mode2,5× дейін жылдам, $8 / $40, тек Claude API-де, research preview
Ойлауәрқашан қосулы, тереңдігі effort арқылы, әдепкісі medium
БұлттарAWS Bedrock, Google Cloud, Microsoft Foundry

Anthropic әдеттегі жүктемедегі үнемді Opus 5-пен салыстырғанда шамамен 40% деп бағалайды: баға төмендеуіне қоса шығару 30%-дан астам жылдам, жауаптарда артық мәтін аз. Мұны өз сұрауларыңда есепте: бірдей effort кезінде Opus 5.5 Opus 5-тен ұзағырақ ойлайды, үнемнің бір бөлігін ойлау токендері жейді.

Бенчмарктар

Сандар Anthropic анонсынан.

БенчмаркOpus 5.5Салыстыру үшін
Terminal-Bench 4.066,4%Opus 5 — 52,3%
FrontierCode v1.154,4%GPT-6 Astra — 53,3%
CursorBench 4.057,8%Fable 5.1 — 51,8%
GDPval-AA v2.11846 EloFable 5.1 — 1735, Opus 5 — 1708
Humanity's Last Exam (құралдармен)67,7%Opus 5 — 63,6%
OSWorld 2.081,8%

Қызығырақ жолдар Opus 5 туралы емес, көршілер туралы. FrontierCode-та Opus 5.5 миллион токенге $10 / $50 тұратын GPT-6 Astra-ны басып озады, ал CursorBench-те — бір сынып жоғары модель Fable 5.1-ді. Prompt injection-ға төзімділік бойынша (Gray Swan бенчмаркі) Fable 5.1-мен тең.

Анонстағы тестерлер кейстері: 680 мың жол кодты бір тәуліктен аз уақытта көшіру және HAProxy-ді C-дан Rust-қа 9,5 сағатта аудару — Fable 5.1-де 12 сағат, әрі 51% арзан. Бұл Anthropic серіктестерінің есептері, қайталанатын өлшеулер емес — бағдар, кепілдік емес.

Opus 5-тен көшкенде не бұзылады

Модель атын ауыстыру жеткіліксіз. Anthropic нұсқаулығы бойынша төрт өзгеріс сұрауды 400-мен құлатады:

БұрынҚазірНе істеу керек
thinking: {"type": "disabled"}400 — ойлау өшірілмейдіөрісті алып таста немесе adaptive қой, effort-ты төмендет
thinking: {"type": "enabled", "budget_tokens": N}400 — қолмен бюджет жоқсол рецепт: бюджеттің орнына effort
tool_choice: any немесе нақты құрал400 — мәжбүрлі шақыру жоқauto + strict: true немесе structured outputs
computer_20251124 (Claude API, Google Cloud)400computer_toolset_20260801-ге көшу

Тағы үш өзгеріс ештеңені құлатпайды, бірақ мінез-құлықты өзгертеді:

  • Әдепкі effortmedium, Opus 5-те high болған. Параметрсіз сұрау енді бұрынғыдан басқа деңгейде жүреді — сапа бойынша да, шот бойынша да. Деңгейді анық қой және eval-ды қайта айда, Opus 5 баптауын көшірме.
  • Құрал шақырулары арасындағы мәтін text емес, thinking блоктарында келеді, ал әдепкі display: "omitted" кезінде ол бос. Интерфейсің пайдаланушыға «базадан іздеп жатырмын…» деп көрсетсе, ол үнсіз қалады.
  • Ойлау блоктары модельге және диалог префиксіне байланған. 2026 жылғы 31 тамыздан кейін құрылған аккаунттарда system, tools немесе ескі хабарламаны өзгерткеннен кейін блокты қайталау 400 береді. Диалогты тек толықтыру арқылы жүргіз, нұсқауларды диалог ортасындағы жүйелік хабарламалармен өзгерт.

Сызба: сұрау шлюз арқылы модельге өтеді, оның ішінде тереңдік реттегіші бар ойлау блогы әрқашан жанып тұрады, құралдар бүйірден жауап береді

GPTunneL шлюзі арқылы не тексердік

Релиз күні OpenAI-үйлесімді API-міз арқылы үш сұрау жібердік:

  • reasoning_effort: "low" қабылданады, қарапайым сұрақ 28 токен тұрды.
  • tool_choice: "required" 400 қайтармады: шлюз finish_reason: "tool_calls" бар кәдімгі tool_calls берді. Anthropic API-інде тікелей бұл сұрау құлайды, сондықтан бізден тікелей кілтке көшсең, бұл жерді қайта жазуға тура келеді.
  • tool_choice-сыз, промптта «get_weather қолдан» деген өтінішпен модель құралды өзі шақырды — Anthropic шақыруға дәл осылай жетуді ұсынады.

Ең аз сұрау:

bash
curl https://gptunnel.ru/v1/chat/completions \
  -H "Authorization: $GPTUNNEL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5.5",
    "reasoning_effort": "medium",
    "messages": [{"role": "user", "content": "Осы SQL-дегі қатені тап: ..."}]
  }'

Бізге жіберілетін сұрауда thinking параметрі мүлде жоқ — тереңдікті каталогтағы басқа ойлайтын модельдер сияқты reasoning_effort басқарады. Модель аты мен деңгейді орта айнымалыларында ұста: сонда Opus 5, Opus 5.5 және Fable 5.1 арасында ауысу — конфигтің бір жолы. high және одан жоғары деңгейдегі ұзақ жауаптарға стриминг керек, әйтпесе таймауттарға тірелесің — шлюздің keepalive жолдарын өңдейтін SSE парсері GPT-6 Astra туралы мақалада.

Бас тартулар және қауіпсіздік

Anthropic Opus 5.5-ті сыналған модельдердің ішіндегі ең келісілгені деп атайды: мінез-құлықтың автоматты аудитінде ол орта шектеулерін айналып өтуге Opus 5-тен шамамен 85% сирек тырысты. Қорғаныс механизмдері Fable 5.1-ді қайталайды:

  • Киберқауіпсіздік. Бұл санаттағы тапсырмалардың көбі Opus 4.8-ге бағытталады. Кәдімгі жөндеу және өз кодыңдағы осалдықтарды түзету жұмыс істейді.
  • Биология. Бөлек классификатор жұмыс істейді, кеңейтілген қолжетімділік — верификация бағдарламасы арқылы.
  • Ойлауды шығарып алу. Ішкі пайымдауды жауапқа шығаруды сұрау reasoning_extraction санатымен қабылданбауы мүмкін.

Тікелей API-де бас тарту stop_reason: "refusal" бар HTTP 200 ретінде келеді. Бұл желілік қате емес, штаттық жауап: сол сұрауды сол модельге қайталау көмектеспейді, басқа модельге фоллбек керек.

Әрі қарай: Sonnet 5.5, Haiku 5.5 және OpenAI жауабы

Anthropic Sonnet 5.5 пен Haiku 5.5-ті ұқсас жақсартулармен «алдағы апталарда» шығаруға уәде береді. Көп продакшен-пайплайн үшін бұл Opus-тың өзінен маңыздырақ: негізгі жүктеме әдетте орта тирге түседі.

OpenAI сол күні жауап берді: Opus 5.5-тен шамамен бір жарым сағаттан кейін GPT-6 Sol және GPT-6 Luna шықты — Astra қатарындағы GPT-6 буынының орта және жеңіл модельдері, GPT-5.6-дағы алдыңғыларынан екі есе арзан. Екеуі де GPTunneL каталогында бар; не істей алатыны және қандай тапсырмаларға қою керегі — бөлек талдауда.

Claude Opus 5.5 туралы жиі қойылатын сұрақтар

Claude Opus 5.5 шықты ма? Иә, 2026 жылғы 22 қыркүйектен: Claude API, AWS, Google Cloud және Microsoft Foundry. GPTunneL-де — сол күннен бастап.

Opus 5.5 қанша тұрады? Anthropic-те миллион кіріс токенге $4 және миллион шығыс токенге $20. GPTunneL-де 1K кіріс токенге 6 ₸ және 1K шығыс токенге 30 ₸, Opus 5-тен 20% арзан, жазылымсыз. Нақты бағалар — бағалар бетінде.

Тегін қолдануға бола ма? Тұрақты тегін қолжетімділік жоқ, Anthropic API ақылы. GPTunneL-де тек жұмсалған токендер үшін төлейсің.

Opus 5.5 әлде Fable 5.1? Anthropic бенчмарктары бойынша Opus 5.5 CursorBench пен GDPval-AA-да Fable 5.1-ден озады және арзанырақ. Fable 5.1 ең ұзақ әрі күрделі тапсырмаларға арналған модель болып қалады. Өз промптыңда бір чатта салыстыру ең оңай.

Ойлауды қалай өшіруге болады? Болмайды — Opus 5.5-те ол әрқашан қосулы. Ең аз тереңдік — effort: "low" (біздің API-де reasoning_effort: "low").

VPN керек пе? Жоқ: GPTunneL VPN-сіз жұмыс істейді және жергілікті төлем тәсілдерін қабылдайды.

Қорытынды

Opus 5.5 — флагман алдыңғысынан бір мезгілде арзан әрі күшті болған сирек релиз. Көшудің құны — интеграция қабатын қайта қарау: өшірілген ойлау мен қолмен бюджетті алып тастау, мәжбүрлі tool_choice-тан бас тарту, effort-ты анық қою және пайдаланушылар агенттің аралық хабарламаларын әлі көретінін тексеру.

GPTunneL-де Claude Opus 5.5-ті аш та, өз сұраулар жиынтығыңды Opus 5 және Fable 5.1-мен қатар айдап шық — бір баланста, бір кілтпен. Сұраулар мен лимиттердің спецификациясы — құжаттамада және docs.gptunnel.ru сайтында.