Composer 3: Cursor-дың келесі үлкен қадамы

Composer 3: Cursor-дың келесі үлкен қадамы

Composer 3 — бұл әзірге Cursor-дағы батырма да, жарияланған model ID де емес. Бірақ айналасында күшті сигнал бар: Cursor SpaceXAI-мен бірге нөлден бастап әлдеқайда үлкен модельді оқытып жатқанын тікелей айтады, шамамен 10x көп total compute пайдаланып. Нарық оны Composer 3 деп атап үлгерді.

Егер бұл атау бекітілсе, Composer 3 әдеттегі IDE жаңартуынан маңыздырақ болуы мүмкін. Cursor coding agents үшін интерфейсті ғана емес, нақты Cursor сессияларын бәрінен жақсы түсінетін модельді де иеленуге тырысады.

Қазір қайда тұрмыз: Composer 2.5

Composer 2.5 қазірдің өзінде Cursor-да қолжетімді. Ресми бет оны ұзақ жұмыс істейтін агенттерге арналған price-efficient coding model деп сипаттайды. Стандартты нұсқаның бағасы — 1M input үшін $0.50 және 1M output үшін $2.50; fast mode — $3.00 / $15.00.

Техникалық тұрғыдан Composer 2.5 Moonshot Kimi K2.5 негізінде құрылған және Cursor-дың proprietary training/RL арқылы күшейтілген. Cursor-дың айтуынша, compute-тың 85%-ы base model үстіндегі жеңіл қабатқа емес, қосымша оқыту мен RL-ге жұмсалады.

Cursor мәлімдеген бенчмарктар бойынша:

  • Terminal-Bench 2.0: 69.3%;
  • SWE-Bench Multilingual: 79.8%;
  • CursorBench v3.1: 63.2%.

Бұл "жалпы алғанда ең күшті модель" емес, керісінше жақсы trade-off бар модель: жеткілікті ақылды, жылдам, арзан және Cursor-дың жұмыс циклына кірістірілген.

Composer 3 неге басқаша

Күтіліп отырған Composer 3-тің басты айырмашылығы — нөлден оқыту (training from scratch). Composer 2 және 2.5 Kimi K2.5-ке сүйенген болатын. Cursor-дың айтуынша, келесі модель SpaceXAI-мен бірге әлдеқайда үлкен жүйе ретінде оқытылып жатыр.

Егер бұл рас болса, Composer 3 "бөтен базаның үстіндегі coding fine-tune" болудан қалып, өз алдына frontier coding model болады. Cursor үшін бұл стратегиялық маңызды: OpenAI, Anthropic, Google және Moonshot-қа тәуелділік азаяды, cost, latency, behavior және product integration үстінен бақылау артады.

Екінші маңызды қабат — деректер. Cursor-да қарапайым LLM-зертханада жоқ нәрсе бар: нағыз coding-agent сессияларының, diffs, tool calls, user interventions, сәтсіз әрекеттер мен қабылданған өзгерістердің орасан көлемі. Дұрыс анонимдеп, дұрыс пайдаланса, бұл RL үшін алтын құнды дерек.

Көлемі туралы қауесеттер

Compile 2026 талдауында 1.5T параметр және SpaceX Colossus кластерінде оқыту нұсқасы айтылды. Бұл — екінші дереккөз, ресми model card емес. Cursor-дың ресми тұжырымы сақтықпен берілген: SpaceXAI-мен бірге "significantly larger model from scratch" және "10x more total compute".

Сондықтан адал ұстаным мынадай:

  • Composer 3 атауы ресми түрде расталған жоқ;
  • Cursor/SpaceXAI-дың жаңа үлкен моделі бағыт ретінде расталған;
  • нақты өлшемі, архитектурасы, context window, бағасы және шығу күні жарияланған жоқ.

Composer 3 нені жақсартуы керек

Біріншісі — ұзақ агенттік тапсырмалар. Cursor қазірдің өзінде өнімін параллель агенттер, cloud/local handoff, Slack/GitHub/Linear триггерлері және review flows айналасында құрып жатыр. Модель тек код жазып қана қоймай, осы runtime ішінде "өмір сүре" білуі керек.

Екіншісі — tool discipline. Жақсы coding agent көп ойлайтын емес, дұрыс құралдарды шақыратын, қажетті файлдарды оқитын, гипотезаларды тексеретін және хаостық жаппай өзгерістер жасамайтын агент.

Үшіншісі — review және self-correction. Болашақ Composer diff, тесттер, регрессиялар, стиль, архитектуралық шекаралар мен тәуекелдерді жақсырақ түсінуі керек. Cursor қазірдің өзінде Bugbot, PR review және multi-agent workflows бағытында қозғалып жатыр; күшті верификациясыз модель бұл жерде тез тоқтап қалады.

Төртіншісі — құн. Composer тек аз ақшаға frontier-like coding беретін болса ғана мағыналы. Егер Composer 3 үздік жабық модельдер сияқты қымбат болып шықса, ол өз сиқырының бір бөлігін жоғалтады.

Router ойынды өзгертеді

22 шілдеде Cursor Cursor Router-ды шығарды: енді Auto mode сұранысты талдап, оны сәйкес модельге жібереді. Cost, Balance және Intelligence режимдері бар, ал әкімшілер рұқсат етілген модельдерді басқара алады.

Бұл Composer 3 үшін маңызды. Мұндай архитектурада жаңа модель әрбір сұранысқа жауап беруге міндетті емес. Ол high-value specialist бола алады: тапсырма жеткілікті күрделі болғанда қосылып, қалғанын Composer 2.5 немесе Grok 4.5 сияқты арзан модельдерге беруге болады.

Дәл роутинг үлкен модельді экономикалық тұрғыдан орынды етеді. Флагманды әрбір ұсақ түзетуге пайдаланудың қажеті жоқ. Оны өзін-өзі ақтайтын жерде шақыру керек.

Пікір

Cursor product-model fit-пен қателеспесе, Composer 3 жылдың ең қызықты coding-релиздерінің біріне айналуы мүмкін. OpenAI, Anthropic және Google-дың күшті әмбебап модельдері бар. Cursor-дың нақты даму ортасын — файлдарды, diff, PR, terminal, browser, cloud agents, review, handoff-ты — бәрінен жақсы түсінетін модель жасауға мүмкіндігі бар.

Әлсіз тұсы да айқын: модель тым мамандандырылған немесе Cursor-ға тым тәуелді болып шығуы мүмкін. Cursor-да жұмыс істейтін пайдаланушылар үшін бұл тіпті артықшылық. API нарығы үшін бұл әлі ашық сұрақ.

Composer 3 шыққанда, оны "React-компонентін жаса" деген деңгейде емес, нағыз workflow-да тексеру керек: issue → жоспар → patch → тесттер → PR → review fixes. GPTunneL платформасында мұндай coding-модельдерді "ақылды сияқты көрінеді" деген сезім бойынша емес, аяқталған тапсырмалар мен нәтиже құны бойынша салыстырған дұрыс.