Grok 4.6 API арқылы: бенчмарктер, баға және 200K токен шегі

Grok 4.6 API арқылы: бенчмарктер, баға және 200K токен шегі

xAI 12 тамызда Grok 4.6 моделін шығарды. Өнімде модельдің жаңаруы — жаңалық емес, тапсырма: конфигтегі бір жолды ауыстырып, содан кейін не қозғалатынын түсіну керек. Төменде — бірден іске қосылатын минималды сұрау, ешкімнің пайдасына дөңгелектенбеген бенчмарк сандары және Grok 4.6 прайстағыдан қымбатқа түсетін үш тұс.

Минималды сұрау

GPTunneL API-і OpenAI-мен үйлесімді, сондықтан Grok 4.6-ға көшу деген — base_url мен модель атауы:

bash
curl https://gptunnel.ru/v1/chat/completions \
  -H "Authorization: <СІЗДІҢ_API_КІЛТІҢІЗ>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.6",
    "messages": [
      {"role": "user", "content": "Осы стектрейсті талда және патч ұсын"}
    ]
  }'

Ресми OpenAI клиентімен дәл сол:

Python
from openai import OpenAI

client = OpenAI(
    api_key="<СІЗДІҢ_API_КІЛТІҢІЗ>",
    base_url="https://gptunnel.ru/v1",
)

resp = client.chat.completions.create(
    model="grok-4.6",
    messages=[{"role": "user", "content": "Осы стектрейсті талда және патч ұсын"}],
)
print(resp.choices[0].message.content)

Жарты сағат ұрлайтын бір бөлшек: модель идентификаторы әр жерде әртүрлі жазылады. GPTunneL каталогында ол — grok-4.6, тікелей xAI API-інде — grok-4-6, OpenRouter-де — x-ai/grok-4-6. Кодың екі провайдерге бірден баратын болса, сәйкестікті кодтағы жол литералдарында емес, конфигте ұста.

Grok 4.5-пен салыстырғанда не өзгерді

Grok 4.6 — жаңа базалық модель емес. xAI ашық айтады: бұл Grok 4.5 моделімен ортақ 1,5 трлн параметрлі база үстіндегі post-training — қосымша оқыту жүрісі, қайта жасалған SFT-траекториялар және код, веб-әзірлеу, CAD пен ядро оптимизациясы бойынша агенттік RL. Модель үлкейген жоқ.

Техникалық шекаралар:

  • контекст — 500 000 токен;
  • білім шегі — 2026 жылдың 1 ақпаны, одан кейінгінің бәрі тек веб-іздеу мен құралдар арқылы;
  • мәлімделген фокус — ұзақ жұмыс істейтін агенттер, үлкен кодбазамен жұмыс, интерактивті және визуалды тапсырмалар.

Іс жүзінде байқалатын мінез өзгерісі — өзін-өзі тексеру. Модель жоспар бойынша әрі қарай жүрер алдында кодты іске қосады, ал файлды түзеткен соң өз diff-іне сенбей, оны қайта оқиды. Агент үшін бұл — аяғына жеткен тапсырмалар үлесінің өсуі және бюджетке соққы: сол тапсырмаға қадам көбейеді, ал сен нәтиже үшін емес, токен үшін төлейсің.

Бенчмарктер

Сандар xAI мен Artificial Analysis кестелерінен, қасында — сол тесттегі бәсекелестің үздік нәтижесі:

БенчмаркGrok 4.5Grok 4.6Үздік бәсекелес
AA Intelligence Index5661Fable 5 Max — 62
DeepSWE54%65,9%GPT-5.6 Sol — 73%
Terminal-Bench v3.015,7%26%34–35%
APEX-Agents47,1%57,5%
AA-Briefcase1577Fable 5 Max — 1574
Harvey LAB15,8%Fable 5 Max — 11,3%

Мұны былай оқу керек. Жиынтық индекс бойынша Grok 4.6 GPT-5.6 Sol-дың максималды ойлау режимімен теңесті және Fable 5 Max-тан бір ұпай ғана қалыс қалды — яғни топ модельдер арасындағы «жалпы ақыл» айырмасы енді шу шегінде. Көп құжатты аударып-төңкеріп, нәтижені құрылымдау керек жерде 4.6 алда: AA-Briefcase пен заңгерлік Harvey LAB-та ол екі бәсекелесін де ұтады. Терминалда өмір сүру керек жерде — айқын ұтылады: 26% қарсы 34–35%.

Бүкіл релиз содан басталған жол — CursorBench 3.2: тапсырмасы $2,81-ден 70,8%, ал Fable 5-те $17,32-ден 70,5%, Opus 5-те $8,23-тен 70%. Сапасы бірдей, шоттағы айырма 3–6 есе.

Шотты екі есе өсіретін 200K токен шегі

Сұраудың құн сатылары: 200 мың токен шегінен кейін мөлшерлеме күрт екі есе өседі

Бұл релиздің нағыз тұзағы сапада емес, тариф торында. xAI Grok 4.6 бағасын екі бэндке бөледі:

Промпттағы токенInputCached inputOutput
200 000-ға дейін$2 / 1M$0,50 / 1M$6 / 1M
200 000-нан бастап$4 / 1M$1 / 1M$12 / 1M

Тұзақ мынада: екі еселенген мөлшерлеме асып кеткен бөлікке емес, сұраудағы барлық токенге қолданылады. 201 000 токендік сұрау артық мыңы үшін емес, бүкіл 201 000 үшін екі есе төлейді. 199K пен 201K промптының мазмұны 1%-ға, ал бағасы дәл екі есе ерекшеленеді.

Содан қарапайым ереже: жібермес бұрын промпт ұзындығын санап, шешімді саналы қабылда.

Python
LONG_CTX_BAND = 200_000

def will_double(prompt_tokens: int) -> bool:
    return prompt_tokens >= LONG_CTX_BAND

# агент ішінде: не тарихты ықшамдаймыз, не 2x-ті саналы қабылдаймыз
if will_double(estimated):
    history = compact(history, target=180_000)

Екінші тұс — кештелген кіріс. Бұл — 4.6-ның 4.5-тен қымбат жалғыз бағанасы: миллионына $0,50 қарсы $0,30. Егер сенде үлкен жүйелік промпт кеште тұрып, тәулігіне мыңдаған рет шақырылса, тек нұсқаны көтерудің өзі шотты өсіреді — қалғанының бәрі өзгермесе де.

GPTunneL каталогында grok-4.6 үшін 1K токенге бір ғана мөлшерлеме бар, бэндсіз — өзекті сандар мәтін қасындағы модель картасында және бағалар бетінде.

Стриминг

Ұзақ агенттік жауаптар стримсіз тұрып қалған сұрау сияқты көрінеді, оны бірінші болып пайдаланушы емес, прокси таймауты байқайды. Node-тағы минималды стрим:

JavaScript
const res = await fetch("https://gptunnel.ru/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: process.env.GPTUNNEL_API_KEY,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "grok-4.6",
    stream: true,
    messages: [{ role: "user", content: "auth модулін рефакторлау жоспарын сипатта" }],
  }),
});

for await (const chunk of res.body) {
  for (const line of chunk.toString().split("\n")) {
    if (!line.startsWith("data: ")) continue;
    const payload = line.slice(6);
    if (payload === "[DONE]") break;
    process.stdout.write(JSON.parse(payload).choices[0]?.delta?.content ?? "");
  }
}

Өнімде не сынады

  • Таймауттар. 4.6-дағы агенттік жүрістер 4.5-тегіден ұзақ — өзін-өзі тексеру уақыт алады. HTTP-клиенттегі әдепкі 60 секунд жауапты ортасынан кеседі; 600 қой және стримді қос, сонда байланыс үнсіз қалмайды.
  • Ретрайлар. 429 бен 5xx-те джиттерлі экспонента, 4xx-те ретрай жоқ. Белгісіз модель туралы 400 — желі ақауы емес, дәл сол grok-4.6 қарсы grok-4-6, оны қайталаудың мәні жоқ.
  • Бюджет токенге емес, тапсырмаға саналады. Өзін қайта тексеретін модель токенді көбірек жағады және тапсырманы жиірек аяғына жеткізеді. Аяқталған жүрістің құнын, адам араласуының санын және дайын нәтижеге дейінгі уақытты өлше — миллионға шаққан баға бойынша қате модель таңдайсың.
  • 500K — көршілердегіден аз. GPT-5.6 Sol-да 1,05M, Fable 5-те 1M. Миллион токен контекске есептелген RAG-құбыры Grok 4.6-да қысқартуды талап етеді, әрі 200K-дан төмен қысқартқан жөн (жоғарыдан қара).
  • Жаңа деректер. Білім шегі — 2026 жылдың ақпаны. Одан кейінгінің бәрін модель тек веб-іздеуден және сен берген құралдардан біледі.

Grok 4.6 Cursor-да және басқа орталарда

Модель Cursor мен Grok Build-те қолжетімді, сондай-ақ xAI API, OpenRouter, Vercel және Cloudflare арқылы жұмыс істейді. Шыққаннан кейінгі бірінші аптада, 19 тамызға дейін, xAI Grok Build пен Cursor-дағы Grok 4.6 қосылған көлемін екі есе арттырады — оны өз репозиторийіңде Composer немесе Fable-мен салыстырғың келсе, бұл — ең арзан терезе.

Cursor-ға қосудың саналы сценарийі — 4.6-ны әдепкі модель қылу емес, оған ұзақ жұмыстарды беру: үлкен репозиторийді талдау, миграциялар, фичаны issue-ден PR-ға дейін жеткізу. Қысқа түзетулерді жылдам модельдерде айдаған арзан, оның үстіне роутер бұл бөлуді өзі істейді.

Өзің байқап көр

Grok 4.6 GPTunneL каталогында бар: ол чатта да, қалған модельдермен бірдей OpenAI-үйлесімді API арқылы да жұмыс істейді — бір кілт, бір баланс, жазылымсыз, пайдаланғаның үшін ғана төлейсің. Кабинеттен кілт ал, model мәнін grok-4.6 етіп ауыстыр және өзіңнің нақты сценарийіңде айда: issue → жоспар → патч → тесттер. Эндпоинттер, лимиттер мен параметрлер — құжаттамада, желінің қалған модельдері — Grok бетінде.