GPT — Generative Pre-trained Transformer, яғни «генеративті алдын ала оқытылған трансформер». Бұл мәтінді келесі қандай бөлік тұруы керек екенін қайта-қайта болжау арқылы жазатын нейрожелі түрі. Термин 2018 жылы OpenAI-дың алғашқы моделімен бірге пайда болды, ал бүгін осы принциппен ChatGPT, GPT-6 Astra және басқа компаниялардың ондаған моделі жұмыс істейді.
Қиындығы — GPT әріптері қазір барлық жерде: ChatGPT, GPT-5.6, BloombergGPT, GPT Image. Бір қысқартудың артында модель де, қосымша да, сурет генераторы да, OpenAI-ға еш қатысы жоқ әзірлемелер де жасырынып тұр. Мұны ретімен ажыратпайынша, нені таңдау керек екені де түсініксіз.
GPT толық атауы: әр сөз нені білдіреді
Сексенінші жылдардағы фильмдегі роботтың атына ұқсайды, бірақ мұнда әр сөздің өз мағынасы бар.
Generative — генеративті. Модель жауапты дайын базадан алмайды, мәтінді бөлік-бөлігімен жаңадан жасайды. Сондықтан бір сұраққа екі рет әртүрлі тұжырым келеді — бұл ақау емес, генерацияның табиғи салдары.
Pre-trained — алдын ала оқытылған. Пайдаланушының алғашқы сұрағына дейін модель орасан көп мәтінді оқып шыққан: кітаптар, мақалалар, код, сайттар. Осыдан кейін оның тіл мен әлем туралы білімі бар, бірақ сыпайы жауап беру дағдысы әлі жоқ — оған бөлек үйретеді.
Transformer — трансформер. Google зерттеушілері 2017 жылы Attention Is All You Need жұмысында сипаттаған нейрожелі архитектурасы. Басты механизмі — назар (attention): әр сөзді өңдегенде модель бүкіл мәтінге бірден қарап, ол үшін қай сөздер маңыздырақ екенін шешеді. «Кубок чемоданға сыймады, себебі ол тым үлкен» деген сөйлемде «ол» кім екенін грамматика айтпайды, ал назар механизмі оны кубокпен байланыстырады. Құрылымы туралы толығырақ — трансформерлер туралы гайдта.
GPT пен ChatGPT — бір нәрсе емес
GPT — модель: мәтін қабылдап, жалғасын береді. ChatGPT — OpenAI-дың модель айналасында құрылған қосымшасы: чат терезесі, диалог тарихы, файл жүктеу, интернеттен іздеу, дауыс режимі. Ұқсатсақ, GPT — қозғалтқыш, ал ChatGPT — оны орнатқан көліктердің бірі. ChatGPT ішінде әр кезде әртүрлі «қозғалтқыш» тұрды: 2022 жылдың қарашасында іске қосылғанда GPT-3.5, кейін GPT-4, GPT-4o, GPT-5 және келесі нұсқалар.

Бұдан практикалық қорытынды: GPT модельдерін ChatGPT-сіз де пайдалануға болады — API және оларға қосылатын сервистер арқылы. GPTunneL да осылай құрылған: сол OpenAI модельдері, бірақ өз интерфейсінде және басқа компаниялардың модельдерімен қатар.
Кері тұзақ — GPT Image. Бұл нақ OpenAI, бірақ мультимодальді GPT-4o-дан өсіп шыққан сурет генераторы. Демек атаудағы GPT әріптері модель мәтін жазады дегенге кепіл емес.
GPT термині қайдан шықты: қысқаша тарих
«Алдымен модельді белгіленбеген мәтіннің тауында оқытып, содан кейін нақты тапсырмаға баптау» идеясы OpenAI-да пайда болған жоқ — машиналық оқытуда бұл тәсіл GPT-ден көп бұрын белгілі еді. 2018 жылға қарай болашақ технологияның екі бөлігі тоғысты.
2017 — трансформер. Google мәтінді тұтастай және параллель өңдейтін архитектураны жариялайды, ал бұл оның орасан көп деректерге жақсы масштабталатынын білдіреді.
2018 жылдың басы — тілдік модельдерді алдын ала оқыту. Екі маңызды жұмыс шығады: қаңтарда ULMFiT, ақпанда ELMo. Екеуі де көп мәтінде алдын ала оқытылған модель нақты тапсырмаларды жақсырақ орындайтынын көрсетеді. Бірақ олар трансформерде емес, рекуррентті желілерде құрылған.
2018 жылғы 11 маусым — алғашқы GPT. OpenAI Improving Language Understanding by Generative Pre-Training жұмысын жариялап, екі бөлікті біріктіреді: генеративті алдын ала оқыту плюс трансформер. Модель — 12 қабат және 117 млн параметр, қазір оны GPT-1 деп атайды. Бүгінгі өлшеммен кішкентай: екі жылдан кейін GPT-3-те параметр шамамен бір жарым мың есе көп болды. Қызығы, жұмыстың тақырыбында қысқарту жоқ — тек «генеративті алдын ала оқыту».
2018 жылғы қазан — қысқарту кең қолданысқа енеді. Google зерттеушілері BERT туралы жұмысында өз модельдерін «Generative Pre-trained Transformer (OpenAI GPT)»-пен салыстырады. Осы сәттен GPT — бүкіл отбасының үйреншікті атауы, ал әр жаңа буын терминді тек бекіте түсті.
Басқа нейрожелілерді GPT деп атауға бола ма — Gemini, DeepSeek, Claude
Қысқа жауап: құрылымы бойынша — иә, атауы бойынша — жоқ.
Құрылымы бойынша. GPT-ні технологияның сипаттамасы ретінде оқысақ — генеративті, алдын ала оқытылған, трансформерге негізделген, — оған кез келген заманауи тілдік модель дерлік сай келеді. Gemini Google-дың техникалық есебі бойынша трансформер декодерлеріне негізделген — GPT-мен бірдей схема. DeepSeek-V3 — ол да трансформер, тек «сарапшылар қоспасымен»: 671 млрд параметрдің әр токенге 37 млрд-ы жұмыс істейді. Claude, Qwen және басқа үлкен тілдік модельдер мәтінді дәл осылай — келесі токенді болжау арқылы жазады.
Атауы бойынша. GPT — OpenAI модельдерінің фирмалық атауы. Google өз моделін Gemini, DeepSeek — DeepSeek деп атайды. «Gemini — бұл GPT» деу кез келген жол талғамайтын көлікті «джип» деп атағанмен бірдей: түсінікті, бірақ дәл емес. Барлығына ортақ дұрыс атау — үлкен тілдік модель немесе LLM.
Заң жағынан мәселе даулы. 2023 жылдың сәуірінде OpenAI бренд ережелерін жаңартып, оның API-і арқылы жұмыс істейтін компанияларға өнім атауларында GPT қолдануға тыйым салды. Бірақ АҚШ-та GPT-ні тауар белгісі ретінде тіркеу мүмкін болмады: 2023 жылы ведомство өтінімді қабылдамады, ал 2024 жылғы 6 ақпанда бас тарту түпкілікті болды — термин бүкіл индустрия қолданатын нейрожелілер отбасының жалпы атауы деп танылды. ЕО-да OpenAI тіркеуді 2023 жылы алды, бірақ 2024 жылдан бері оған дау айтылып жатыр, ал Қытайда тіркеуден бас тартылды.
Сондықтан атауында GPT бар модельдер басқаларда да бар: EleutherAI зерттеу тобының GPT-J және GPT-NeoX модельдері (2021 және 2022), Bloomberg компаниясының BloombergGPT (2023). Олардың OpenAI-ға қатысы жоқ — әріптер тек модель түрін көрсетеді.
Ал ауызекі сөйлеуде «GPT» әлдеқашан кез келген чат-боттың атауына айналды: «GPT-ден сұра» деп Gemini туралы да айтуы мүмкін. Күнделікті әңгімеде бұл қалыпты, бірақ модель таңдағанда немесе бағаларды салыстырғанда модельдерді өз атымен атаған дұрыс — айырмашылық дәл сол ұсақ-түйекте.
GPT басқа нейрожелі түрлерінен немен ерекшеленеді
«Нейрожелі» — астында мүлде әртүрлі жүйелер тұратын қолшатыр, ал тілдік модельдер — соның бір тармағы ғана. Айырмашылықты екі сұрақ арқылы көру оңай: жүйе шығысында не береді және оған қалай жетеді.
| Нейрожелі түрі | Не істейді | Нәтижені қалай алады | Мысалдар |
|---|---|---|---|
| GPT және басқа үлкен тілдік модельдер | Мәтін мен код жазады, сұрақтарға жауап береді | Мәтіннің келесі бөлігін бір-бірден болжайды | GPT-6 Astra, Claude, Gemini, DeepSeek |
| Диффузиялық модельдер | Сурет пен видео салады | Кездейсоқ шудан бастап, суретті қадам-қадаммен тұтастай «шығарады» | Stable Diffusion, Flux, Midjourney |
| BERT сияқты энкодерлер | Мәтінді түсінеді, бірақ жазбайды | Сөйлемді екі бағытта тұтас оқып, сандық көрініске айналдырады | Іздеу, пікірлерді сұрыптау, спам-сүзгілер |
| Тану желілері | Фотода немесе дыбыста не бар екенін анықтайды | Кірісті үйренген белгілермен салыстырып, белгі береді | Бет арқылы құлыптан ашу, нөмірлерді тану |
| Классикалық машиналық оқыту | Кесте бойынша сан немесе класс болжайды | Құрылымдалған деректерден заңдылық іздейді | Кредиттік скоринг, тауар ұсыныстары |
Кестеден GPT-ні дәл GPT ететін үш нәрсе көрінеді.
Жіктемейді, жасайды. Тану желісі «фотода мысық» дейді. GPT сол мысық туралы өлең жазады — әрі тұқымын қателесіп, сенімді түрде айтып салуы мүмкін.
Қатаң ретімен жазады. Әр келесі бөлік алдыңғылардың бәріне тәуелді. BERT сөйлемді тұтас көреді, бірақ жалғастыра алмайды; диффузиялық модель әр қадамда бүкіл суретті бірден түзетеді.
Бір модель — жүздеген тапсырма. Аударма, код, клиентке хат және шартты талдау GPT үшін бір нәрсеге келеді — «мәтінді жалғастыр». Әр тапсырмаға бөлек желі оқытудың қажеті жоқ, сондықтан да тілдік модельдер барлық сервистерге тез тарады.
GPT жауапты қалай жазады: келесі бөлікті болжайды
Алдымен мәтін токендерге — сөз бөліктеріне бөлінеді. Ағылшын сөзі көбіне бір токенге сыяды, ал қазақ сөзі әдетте бірнеше бөлікке бөлінеді, сондықтан бір мағына қазақ тілінде көбірек токен жұмсайды.
Содан кейін модель диалогтың бүкіл мәтінін — сұрақты хат алмасу тарихымен бірге — алып, әр ықтимал келесі токен үшін ықтималдық есептейді. Біреуін таңдап, соңына жазады да, бәрін қайталайды. Жауап экранда бөлік-бөлігімен сән үшін шықпайды: ол шынымен бір-бір токеннен туады.

«Францияның астанасы — » дегеннен кейін «Париж» нұсқасының ықтималдығы жүз пайызға жуық, ал «Лионда» — түк жоқ. Ал «Кофеханаға атау ойлап тап» дегенге ықтималдығы жақын лайықты жалғастар көп, және модель аздаған кездейсоқтықпен таңдап, әр жолы жаңасын береді.
Маңызды салдар: GPT фактіні тексермейді, шындыққа ұқсайтын жалғасты таңдайды. Білім жетпегенде, ең шындыққа ұқсас жалғас — сенімді естілетін ойдан шығарылған нәрсе. Нейрожелі галлюцинациялары осылай пайда болады.
GPT-5.6 және GPT-6 Astra сияқты заманауи нұсқалар алдымен «ойлана» алады: пайымдаудың жасырын жобасын жасап, содан кейін ғана жауап береді. Механизм сол — токендерді болжау, тек олардың бір бөлігі ойлануға жұмсалады.
GPT қалай оқиды: алдымен оқиды, содан кейін көмектесуді үйренеді
Алдын ала оқыту. Модельге орасан мол мәтін көрсетіледі — GPT-3 үшін бұл шамамен 300 миллиард токен болды — және келесі токенді қайта-қайта болжау сұралады. Әр қатеден кейін параметрлер — желінің ішінде үйренген заңдылықтар сақталатын сандар — сәл түзетіледі. GPT-3-те олар 175 миллиард болды. Нәтижесінде тілді және көп фактіні білетін, бірақ автотолтыру сияқты әрекет ететін модель шығады: «Құймақ қалай пісіріледі?» дегенге ол «Бауырсақ қалай пісіріледі? Торт қалай пісіріледі?» деп жалғастыруы әбден мүмкін, сұрақтар форумын парақтап отырғандай.
Нұсқаулықтармен баптау. Адамдар сұрауларға жақсы жауап мысалдарын жазады, ал модель тізімді жалғастыруды емес, жауап беруді үйренеді.
Адамдардың бағалауымен оқыту. Модель бірнеше нұсқа береді, адамдар ең жақсысын таңдайды, ал ол сол қалауларға бейімделеді. OpenAI бұл тәсілді 2022 жылы InstructGPT туралы жұмысында сипаттады: адамдар 1,3 миллиард параметрлі бапталған модельдің жауаптарын одан жүз еседен астам үлкен бастапқы GPT-3 жауаптарынан артық көрді. Дәл осы кезең GPT-ні әңгімелесушіге айналдырды — бірнеше айдан кейін ChatGPT шықты.
Оқытудың аяқталу күні бар. Одан кейін болған нәрсені модель білмейді — егер қосымша оны іздеуге қоспаса.
GPT буындары: GPT-1-ден GPT-6 Astra-ға дейін
| Жыл | Модель | Не өзгерді |
|---|---|---|
| 2018 | GPT-1 | 117 млн параметр. Мәтінде алдын ала оқыту плюс тапсырмаға баптау жұмыс істейтінін дәлелдеді |
| 2019 | GPT-2 | 1,5 млрд параметр, бірнеше абзацқа созылатын байланысты мәтін. OpenAI теріс пайдаланудан сақтанып, толық нұсқасын бірден жарияламады |
| 2020 | GPT-3 | 175 млрд параметр. Сұраудағы бірнеше мысал бойынша тапсырма шешуді үйренді |
| 2022 | GPT-3.5 негізіндегі ChatGPT | Диалогтар мен адам бағалауында баптау — модель әңгімелесушіге айналды |
| 2023 | GPT-4 | Кірісте суреттерді түсінеді, күрделі тапсырмаларда айтарлықтай дәлірек. OpenAI модель көлемін енді ашпайды |
| 2024 | GPT-4o, o1 | «o» — omni: мәтін, дыбыс және сурет бір модельде. o1 — OpenAI-дың алғашқы пайымдаушы моделі |
| 2025 | GPT-5, gpt-oss | GPT-5 жылдам жауап беру немесе ұзағырақ ойлануды өзі шешеді. gpt-oss — GPT-2-ден бергі OpenAI-дың алғашқы ашық модельдері |
| 2026 | GPT-5.6, GPT-6 Astra | Әртүрлі бюджетке арналған Sol, Terra және Luna желісі; GPT-6 Astra 3 қыркүйекте шықты — ұзақ агенттік тапсырмаларға арналған флагман |
Екпіннің ауысуы кестеден-ақ көрінеді: алдымен буындар параметр санымен жарысты, кейін OpenAI оны ашуды тоқтатып, пайымдау, құралдар және шешілген тапсырманың құны туралы айта бастады.
GPT неге қабілетсіз
Шындықты шындыққа ұқсастан ажырату. Сенімді үн — дұрыстықтың белгісі емес: GPT көбейту кестесін де, жоқ заң бабының мазмұнын да бірдей сергек айтып береді. Жауаптағы сандарды, дәйексөздерді және сілтемелерді тексерген жөн.
Соңғы оқиғаларды білу. Оқыту аяқталған күннен кейінгінің бәрі модель үшін жоқ, оған іздеу берілмейінше.
Сені чаттар арасында есте сақтау. Модельдің өзі тек ағымдағы контексті көреді — жаңа GPT-де бұл шамамен миллион токен, бірден бірнеше қалың кітап. Өткен әңгімелерді есте сақтау — модельдің емес, қосымшаның функциясы.
Қазір қай GPT модельді таңдау керек
Флагман әрқашан қажет емес. Күнделікті тапсырмалардың көбіне орташа модель жетеді, ал ең қымбаттарын арзаны анық шамасы келмейтін тапсырмаларға қалдырған жөн.
| Модель | Неге лайық | Контекст | Кіріс / шығыс, 1000 токенге ₸ |
|---|---|---|---|
| GPT-6 Astra | Ұзақ күрделі тапсырмалар: агенттер, код, ғылым, үлкен құжаттар | 1,05 млн | 10 / 50 |
| GPT-5.6 Sol | Astra артық болғанда күрделі талдау және код | 1,05 млн | 5 / 30 |
| GPT-5.6 Terra | Күнделікті жұмыс: мәтіндер, хаттар, материалдарды талдау | 1,05 млн | 2 / 12 |
| GPT-5.6 Luna | Жаппай қарапайым сұраулар және автоматтандыру | 1,05 млн | 0,2 / 1,2 |
| GPT OSS 120B | Ашық модель: арзан және өзіңде орнатуға болады | 131 мың | 0,15 / 0,75 |
Бағалар шамамен берілген, өзектілері — прайста.
Astra-ның бір токен бағасы Sol-дан жоғары, бірақ OpenAI деректері бойынша күрделі тапсырмаларда ол жауапқа азырақ токен жұмсайды — сондықтан модельдерді прайспен емес, шешілген тапсырманың құнымен салыстырған әділірек. Таңдауды ортадан бастаған ыңғайлы: Terra-дан баста, жауап үстірт шықса, сол сұрауды Sol немесе Astra-ға жібер.
Жиі қойылатын сұрақтар
GPT қалай ашылады?
Generative Pre-trained Transformer — генеративті алдын ала оқытылған трансформер. Модель мәтін жасайды, үлкен деректер көлемінде алдын ала оқытылған және «трансформер» архитектурасында құрылған.
GPT термині қашан пайда болды?
2018 жылы. 11 маусымда OpenAI отбасының алғашқы моделі туралы жұмысты жариялады, ал сол жылдың күзінде GPT қысқартуын басқа компаниялардың ғылыми мақалалары да қолданып жүрді.
Gemini немесе DeepSeek-ті GPT деп атауға бола ма?
Құрылымы бойынша бұлар бір түрдегі модельдер: генеративті, алдын ала оқытылған, трансформерге негізделген. Бірақ GPT — OpenAI модельдерінің атауы, сондықтан «үлкен тілдік модель» деу немесе модельді өз атымен атау дұрысырақ.
GPT және жасанды интеллект — бір нәрсе ме?
Жоқ. Жасанды интеллект — тұтас сала, нейрожелілер — оның ішіндегі бір тәсіл, ал GPT — нейрожелілердің бір түрі, OpenAI-дың тілдік модельдері.
GPT-ні тегін пайдалануға бола ма?
ChatGPT-де шектеулері бар тегін жоспар бар. GPTunneL-де тұрақты тегін тариф жоқ: төлем пайдаланылған токендер үшін жүреді, толтыру — 250 ₸-ден, ал GPT-5.6 Luna-мен қысқа диалог 1 теңгеден де арзанға түседі.
GPT-ні қайдан байқап көруге болады
Кестедегі барлық модельдер — GPT-6 Astra, GPT-5.6 желісі және GPT OSS — GPTunneL-де Claude, Gemini және DeepSeek-пен бірге бір балансқа қолжетімді. Жазылымсыз, тек пайдаланғаныңа төлейсің. Буындар арасындағы айырмашылықты іс жүзінде сезіну оңай: Luna мен Astra-ға бір сұрақты қойып, жауаптарын салыстыр.



