Grom 1.5
GPTunneL осы модельден басталады. Бірінші болып жауап береді, суретті көреді, ұзын контексті ұстайды және бөтен бұлтта емес, өз темірімізде жұмыс істейді.
Басқалары ойланып жатқанда, ол жаза бастайды
Алғашқы токен жарты секундтай уақытта кетеді, одан кейін ағын секундына 120 токенге дейін үдейді. Ірі модельдер сұранысты ұзақ қыздырады — қысқа сұрақта бұл кідіріс жауап мәтініндегі айырмашылықтан гөрі анық сезіледі.
Біздің өлшеулеріміз: пайымдау режимінсіз қысқа промпт, бөтен модельдер GPTunneL арқылы шақырылды, Grom — өз инференсімізде. Нақты сандар жүктемеге, сұраныс ұзындығына және вендор жағындағы жағдайға байланысты.
Мәтінді ғана емес, суретті де көреді
Скриншот, құжаттың фотосы немесе график тастай бер. Модель суретте не бар екенін талдап, мәтінмен жауап береді — бөлек OCR қажет емес.

- Скриншоттар мен құжаттар.Фотодағы мәтін, кесте, чек, қате шыққан экран — бәрі суреттен тікелей оқылады.
- Сурет ортақ контекстке түседі.Файлды қайта тіркемей, әңгімені жалғастыра беруге болады.
- Чатта да, API арқылы да жұмыс істейді.Сұраныс форматы платформаның басқа модельдеріндегідей.
Бір диалогта 256 000 токен
Бұл шамамен алты жүз бет мәтін. Толық шарт, құрастыру логтары, айлық хат алмасу — құжатты бөлшектемей диалогқа салып, сол бойынша сұрай беруге болады.
- 60 беттік шарт18%
- Бір күндік құрастыру логтары23%
- Диалог тарихы12%
- Жауаптар мен нақтылауларға бос орын47%
GPU жадындағы префикс кэші
Ұзын құжат әр сұраққа қайта есептелмейді: есептелген назар кілттері мен мәндері үдеткіш жадында қалады. Файл бойынша алғашқы сұрақ өңдеуді төлейді, келесілері қызып қалған контекстен басталады.
Grom қай жерде ұтады, қай жерде — жоқ
Шынын айтқанда: бұл — орташа өлшемдегі модель. Ол жылдамдығымен, бағасымен және бізде жұмыс істейтінімен ұтады. Күрделі талдау мен үлкен кодты фронтир-модельдерге беру дұрыс — олар сол чат терезесінде, бір басуда.
| Grom 1.5біздің инференс | Claude Sonnet-5anthropic | GPT 5openai | Qwen 3.5 Plusalibaba | |
|---|---|---|---|---|
| Алғашқы токен | ~500 мс | 1,3–1,8 с | 1,5–2 с | 1,8–2,5 с |
| Генерация жылдамдығы | 120 ток/с дейін | ~70 ток/с | ~60 ток/с | ~55 ток/с |
| Контекст терезесі | 256K | 1M | 400K | 1M |
| Кірістегі суреттер | иә | иә | иә | иә |
| Күрделі пайымдау, үлкен код | базалық деңгей | айтарлықтай күшті | айтарлықтай күшті | күштірек |
| Чаттағы баға | толтырусыз бастау | прайс бойынша | прайс бойынша | прайс бойынша |
| Сұраныс қайда есептеледі | біздің серверлер | вендор бұлты | вендор бұлты | вендор бұлты |
Жылдамдық — пайымдау режимінсіз қысқа промптта GPTunneL ішінде жүргізілген өз өлшеулеріміз; фронтир-модельдерде сандар вендор жүктемесіне қарай қатты өзгереді. Контекст терезелері — жеткізушілердің 2026 жылғы шілдедегі деректері бойынша.
Ауыр сұраныс жеңілін тежемейді
Модельдің алдында балансировщик тұр. Ол сұраныстың салмағын қарайды — кірісте қанша токен бар, ұзын контекст керек пе — және оны қай темірде есептеу керегін шешеді.
Парктің бір бөлігі — өз серверлеріміз, бір бөлігін дата-орталықтардан жалға аламыз. Grom — орташа өлшемдегі модель: кванттау кезінде салыстырмалы қарапайым карталарға сыяды, сондықтан оны бірнеше пулда бірден ыстық ұстап, шыңдарды кезексіз өткереміз.
Grom API арқылы — сұраныс бойынша
Модель тек чатта өмір сүрмейді. Командаларға түсінікті лимиттермен және міндеттемелермен API-қолжетімділік ашамыз.
Сол бір кілт
Grom платформаның басқа модельдері сияқты сол GPTunneL API-кілтімен қосылады. Бөлек интеграция қажет емес.
Міндетке сай TPM
Минутына токен лимитін келісіп, ортақ кезек емес, сізге арналған қуат ұстаймыз.
Шарттағы SLA
Қолжетімділік, жауап беру уақыты және өңдеу басымдығы жазбаша бекітіледі.
On-premise
Деректерді сыртқа шығаруға болмаса — Grom-ды сіздің контурыңызда, өз теміріңізде орнатамыз.
Grom API арқылы керек пе?
Жазыңыз — жүктемені, лимиттерді, SLA мен бағаны талқылаймыз.
Gromға қатысты сұрақтар
Grom-ды дәл қазір байқап көр
Тіркелу бір минут алады, алғашқы жауап — жарты секунд. Қасында — бүкіл Гром желісі және тағы екі жүз модель.