Gemini 3.8 Flash: не өзгерді және API арқылы қалай шақыру керек

Gemini 3.8 Flash: не өзгерді және API арқылы қалай шақыру керек

Google Gemini 3.8 Flash моделін 2026 жылғы 2 қыркүйекте шығарды — алты аптадағы үшінші Flash релизі. Модель GPTunneL каталогында gemini-3.8-flash id-імен тұр. Қысқаша: API-де бірде-бір параметр өзгерген жоқ, шектеулер сол күйінде, өсім — ұзақ агенттік тапсырмалар мен кәсіби салаларда. Кодың 3.7 Flash үшін жазылған болса, көшу — модель атауы тұрған бір жолды ауыстыру.

Не шықты

Модель карточкасынан:

ПараметрМәні
Кірісмәтін, сурет, видео, аудио, PDF
Шығысмәтін
Кіріс шегі1 048 576 токен
Шығыс шегі65 536 токен
Ойлауlow, medium, high; minimal қате қайтарады
Барfunction calling, structured outputs, code execution, search grounding, context caching, Batch
Previewcomputer use
Жоқсурет пен аудио генерациясы, Live API

Кесте 3.7 Flash-пен жол-жолымен сәйкес келеді. Google өз API-інде жылдамдық пен бағаның өзгермегенін тура айтады; өзгергені — мінез-құлық: модель жауап бермес бұрын көбірек ойлау қадамын жасайды және құралдарды қайта-қайта шақырады.

Минималды сұрау

GPTunneL шлюзі OpenAI-мен үйлесімді, кілт Authorization-ға Bearer префиксінсіз жазылады:

bash
curl https://gptunnel.ru/v1/chat/completions \
  -H "Authorization: <СЕНІҢ_API_КІЛТІҢ>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.8-flash",
    "messages": [{"role": "user", "content": "Бір сөзбен жауап бер: Францияның астанасы?"}]
  }'

Жариялау алдында алған жауабым:

JSON
{
  "model": "gemini-3.8-flash",
  "choices": [{"message": {"role": "assistant", "content": "Париж"}, "finish_reason": "stop"}],
  "usage": {
    "prompt_tokens": 11,
    "completion_tokens": 108,
    "total_tokens": 119,
    "prompt_cost": 0.0033,
    "completion_cost": 0.162,
    "total_cost": 0.1653,
    "prompt_tokens_details": {"cached_tokens": 0}
  }
}

Бір сөз — 108 шығыс токен. Ойлау шығыс ретінде тарифтеледі, ал Google-дің жоспары бойынша 3.8 Flash-та ол көбейді. Шығынды көрінетін жауаптың ұзындығымен емес, usage-дегі total_cost бойынша есепте.

Шлюз арқылы ойлау тереңдігі low, medium, high мәндері бар reasoning_effort параметрімен беріледі; Google-дің thinking_level параметрін шлюз үнсіз елемейді. 3.7 Flash-тағы деңгей бойынша өлшемдер — алдыңғы мақалада, 3.8-де механика сол.

Бенчмарктарда не өсті

Google 3.8 Flash-ты алдыңғы нұсқамен емес, бәсекелестердің флагмандарымен салыстырады:

Бенчмарк3.7 Flash3.8 FlashClaude Opus 5GPT-5.6 Sol
Vals Finance Agent v259,0%61,4%58,6%53,8%
Harvey Legal Agent8,8%10,0%6,7%2,5%
HLE-Verified53,6%54,9%54,4%54,5%

DeepSWE v1.1-де — тапсырма қойылғаннан дайын патчқа дейінгі ұзақ әзірлеу тапсырмаларында — Google 70%-дан жоғары нәтижені ірі модельдерден әлдеқайда төмен бағамен көрсетеді; анонста нақты сан жоқ. Тәуелсіз шолулар Terminal-Bench 2.1 бойынша 90,8% келтіреді, 3.7 Flash-та — 81,6%.

Мұны салқын оқу керек. 3.7 Flash-тан өсім — кәсіби агенттік тесттерде 1–2 пайыздық пункт, бір ай бұрынғы DeepSWE 49% → 65% секірісі емес. Opus 5 пен Sol-ды басып озу — қаржы мен құқықтың тар салалық бенчмарктарында. OSWorld сияқты жалпы агенттік тапсырмаларда, тәуелсіз шолулар бойынша, флагмандар алда қалады. Белгілі бір салада құралдары бар көпқадамды агентің болса — қайта жүргізіп көрген жөн. Классификатор немесе қысқаша мазмұндау болса — айырмашылықты байқамайсың.

3.8 Flash Cyber

Негізгі модельмен бірге Google киберқауіпсіздікке арналған нұсқасын шығарды: жиырма тілде осалдықтарды 70%-дан жоғары табысты іздеу және CWE-Bench-те 47,2% pass@1 деңгейінде автопатчинг. Ол ашық API-ге түскен жоқ: қолжетімділік тек мемлекеттік органдарға, инфрақұрылым операторларына және мейнтейнерлерге арналған Fairwind бағдарламасы арқылы. GPTunneL-де ол жоқ және Google модельді жария ашпайынша болмайды.

Ауысар алдында нені тексеру керек

  • max_tokens. Шек жауаптан бұрын ойлауды жеп қояды: 3.7 Flash-та max_tokens: 16 кезінде finish_reason: "length" белгісімен бос контент келетін. 3.8-де ойлау көбірек — қорды одан да молырақ қой.
  • Таймауттар. Қосымша қадамдар мен құралдарды қайта шақыру — бұл уақыт. 30 секундтық клиенттік таймаут high деңгейінде қалыпты жауаптарды үзеді; 180 секунд және экспоненциалды үзіліспен қайталау керек.
  • Шот. Токен бағасы сол күйінде, ойлау көбірек — тапсырмаға токен де көбірек. Каталогтағы тарифтерді емес, өз сұрауларыңдағы total_cost-ты бұрын және кейін салыстыр.
  • Structured outputs пен стриминг бұрынғыдай жұмыс істейді: схемасы бар response_format және stream: true. Шлюз бірінші чанктың алдында : HELLO және : PROCESSING keepalive-комментарийлерін әлі жібереді — парсер data: жоқ жолдарды өткізіп жіберуі тиіс.

Бағасы қанша

GPTunneL-де Gemini 3.8 Flash токен бойынша тарифтеледі: 1M кіріс токен үшін 1500 ₸ және 1M шығыс токен үшін 7500 ₸, контекст — 1M токен. Бұл каталогта 750 ₸ және 3750 ₸ бағасымен қалып отырған 3.7 Flash-тан екі есе қымбат — сондықтан 3.8-дің өсімі байқалмайтын тапсырмаларда ескі модельді қалдырған жөн. Google-дің өзінде 2026 жылғы 31 желтоқсанға дейін 1M токенге $0,75 және $3,75 кіріспе бағасы қолданылады, қаңтардан бастап — $1,50 және $7,50. Барлық модельдің өзекті бағасы — бағалар бетінде. Жазылым қажет емес, төлем нақты токен бойынша, жергілікті төлем әдістері.

Өзің байқап көр

Кодыңа base_url=https://gptunnel.ru/v1 қойып, gemini-3.7-flash орнына gemini-3.8-flash дегенді қой да, сол агенттік циклді жүргіз. Екі санды салыстыр: total_cost және аяғына дейін жеткізілген тапсырмалардың үлесі. Немесе GPTunneL-де Gemini 3.8 Flash-ты аш және чатта өз тапсырмаңда тексер.