4 қыркүйекте Higgsfield 3D Jutsu шығарды: браузердегі 3D-редактор, онда GPT-6 Astra-дағы агент сипаттама бойынша сахна жинайды, сосын оны видеомодель рендерлейді. Біз де сол міндетті қатар шештік, енді GPTunneL воркфлоуында «3D-сахна» нодасы бар: примитивтер, камералар, анимация кілттері, каттар, ассистентпен чат және браузердің өзінде mp4-ке рендер. Рендерленген превиз Seedance 2.5 немесе Hailuo H3-ке референс ретінде кетеді, модель камера қозғалысын дәл қайталайды.
Креаторға текшелер не үшін керек, нода қалай құрылған, 3D Jutsu-дан несімен ерекшеленеді және 50–500 ₸-ге жиналған сахна генерацияда неге мыңдаған теңге үнемдейді, соны талдаймын.
Видеомодельдер камераны неге тыңдамайды
Видеомодельдер әдемі сурет жасауды үйренді, бірақ режиссёрлік нұсқауларды нашар орындайды. «Камера жер астынан көтеріледі, бүркітті фокусқа алады да, соның артынан егістікке қарай сүңгиді» деген промптты модель оқиды, бірақ өзінше жасайды: бүркіт болады, егістік болады, ал ұшу болмайды. Әр дубль ақша мен минуттар тұрады, бесіншісінен кейін модельге не айтқыңыз келгенін жай көрсеткіңіз келеді.
Киноде мұны әлдеқашан шешкен: түсірілім алдында сахнаны сұр примитивтермен блоктап, мизансцена мен камера қозғалысын келіседі. Бұл превиз деп аталады. Генеративті видеоға ол одан да қажет, себебі модельде алаңдағы режиссёр жоқ, оған эталон керек.
Мультимодальді модельдер, ең алдымен Seedance 2.5 және MiniMax Hailuo H3, видео-референс қабылдайды. Референс тек камераны, таймингті және объектілердің орнын белгілейтінін, ал сыртқы түрді мәтін мен суреттерден алу керегін дұрыс түсіндірсең, модель оператор жұмысын дәл қайталайды: жақындау, айналып өту, пландардың кілт ауысуы. Нода дәл сондай референс жасайды.

Мысал: жер астындағы құмырсқадан егістіктегі тракторға дейін
Ноданы жөндеген сахнамыз 15 секундтық бір үздіксіз ұшу ретінде ойластырылған:
- 0:00–0:03. Топырақ туннеліндегі макроплан: құмырсқа мұртшаларын қимылдатады, өткірлік тереңдігі аз, жұмсақ шашыраңқы жарық.
- 0:03–0:05. Камера топырақ арқылы кілт жоғары кетеді, көртышқан інінде бір сәт баяулайды: көртышқан топырақты табандарымен ысырады, төбеден кесектер түседі.
- 0:05–0:08. Шөп арқылы аспанға шығу, кадрды бір секунд күн жарығы басады, алда қанатын жайған бүркіт. Камера оны қуып жетіп, сәл артында және бүйірінде тұрады.
- 0:08–0:11. Аңғар үстімен ұшу: бүркіт қанатын бір қатты қағады, айналада жартасты таулар, төменде егістік пен топырақ жол.
- 0:11–0:15. Камера құстан бұрылып, егістікке қарай сүңгиді, сүңгуден шығып, трактордың артына дөңгелектерінен сәл жоғары орналасады: шаң, атыздар, өңделген жердің тегіс жолақтары.
Мәтінмен бұл бес абзац және сантиметрден километрге дейін масштабтың төрт ауысуы. Бірде-бір видеомодель мұндай ұшуды бірінші промпттан жасамайды, оныншысынан да жасамауы мүмкін. Нодада бұл раскадровка түгелімен ассистент чатына кетеді (бүркітті воркфлоу шаблон ретінде ашылады, байланыстар мен баптауларды бөлшектеп қарауға болады), жарты минуттан кейін кенепте 120 объектіден тұратын сахна тұрады: туннель, ін, беткей, дене, қанаттар мен құйрықтан жасалған бүркіт, тракторлы аңғар, бүкіл жол бойынша кілттері бар бір камера және таймкод бойынша каттар.

Ассистент қате түсінгенін қолмен түзейсің: объектіні гизмомен жылжыту, камераны қайта қою, кілт қою, ойнату. Сосын рендер, нода шығыстары Seedance 2.5-ке қосылады, кіріске бүркіт пен трактордың референс суреттері қосылады, генерация іске қосылады.
Дайын роликтегі ракурс, тайминг және пландар реті превизбен сәйкес келеді: сахнада текше топырақ жазықтығы арқылы жоғары кеткен жерде роликте камера шөп арқылы аспанға атылып шығады.
Нода ішінде не бар
Сахна нода деректерінде кәдімгі құжат ретінде сақталады: ұзақтық, фон, объектілер, камералар, жарық және каттар тізімі. Объектілердің төрт түрі бар: текше, шар, пирамида және топ. Топ көрінбейді, бұл пивот: оның локальді координаттары бар балалары болады, сондықтан шанақ, кабина және дөңгелектерден тұратын трактор біртұтас жүреді, ал дене мен қанаттардан тұратын бүркіт бұрылыста қанатын жоғалтпайды.
Анимация — позиция, бұрылыс және масштаб бойынша уақыттағы кілттер, камераларда қосымша қарау нүктесі мен көру бұрышы, жарықта жарықтық. Кілттер арасында easing-пен интерполяция. Камера бірнеше болуы мүмкін, таймлайндағы каттар белсендісін ауыстырады. Бәрі тышқанмен өңделеді: гизмо, инспекторы бар объектілер ағашы, таңдалған элементтің таймлайны, undo және redo.
Рендер браузерде жүреді, сервер қатыспайды. Кадрларды бөлек WebGL-рендерер детерминистік түрде салады, i нөмірлі кадр i/fps уақытында есептеледі, ал WebCodecs арқылы олар аппараттық H.264-кодерге кетеді; ffmpeg.wasm ағынды mp4-ке ғана орайды, 720p-де сегіз секунд бірнеше секунд алады. Сахнаның уақыт мезетіндегі күйін бір функция есептейді, оны вьюпорттағы алдын ала қарау да, рендер де пайдаланады, сондықтан файл ойнатқанда көргеніңмен құрылымы бойынша сәйкес келеді.
Ассистент сахнаны 300 токенге қалай жинайды
Ассистенттің бірінші нұсқасы айқын жолмен жұмыс істеді: промптқа құжаттың JSON-схемасы мен ағымдағы сахнаны салып, жаңа құжатты түгел қайтаруды сұрадық. «Адам бөлмеге кіріп, төсекке жатады» деген тест міндетінде жауап шамамен 9 500 шығыс токен мен бір жарым минут алды, ал «төсекті солға жылжыт» нөлден жиналған сахнамен бірдей тұрды. Жүздеген саны бар ұзын JSON-ды модель үнемі бұзды, ал иерархиясыз бұрылғанда бас денеден ажырап кетті.
Біз міндеттер жиынтығы, геометриялық эвристика бойынша автоматты бағалау және токен есебі бар стенд жинап, жауап форматын өзгерте бастадық. JSON орнына модель әр мәнге бір жол жазады, әдепкі мәндер жазылмайды, анимация кілттері шегіністі жолдармен кетеді. Құжатты түгел емес, модель патчтармен жауап береді: белгілі идентификаторы бар жол мәнді ауыстырады, жаңасы қосады, бөлек команда жояды. Ең бастысы, типтік құрылымдар код ашатын макростарға шығарылды: есігі бар бөлме, пивоты аяғында адам, «нүктелер бойынша жүру», «төсекке жату», «объектіге таза көру сызығы бар бөлме ішіндегі камера». Модель не істеу керегін жақсы таңдайды, бірақ геометрияны нашар есептейді, сондықтан геометрияны модель есептемейді.
Сол міндетте жауап шамамен 300 токенге дейін қысқарды: 30 есе аз, 12 есе арзан және 13 есе жылдам, ал стенд эвристикасы бойынша сапа «кейде» деңгейінен 10-нан 10-ға өсті. Қалған қателерді жауап қолданылғаннан кейін линт ұстайды: еден астындағы объект, қабырға арқылы қарайтын камера, жиһаз арқылы өтетін жол. Ескертулер модельге бір қысқа сұраумен кетеді, бір қайталау дерлік әрқашан жеткілікті.
Пайымдауға төмен күш деңгейі шығынды тағы бірнеше есе қысқартады: ойлаудың жасырын токендері де төленеді, ал сахнаны макростардан жинауға олар керек емес. Баға осы экономикадан құралады: ассистент арқылы сахна 50-ден 500 ₸-ге дейін тұрады, күрделілігі мен түзетулер санына байланысты. mp4-ке рендер тегін, ол сенің компьютеріңде жүреді.
Жауап стриминг барысында сахнаға жол-жолымен қолданылады: соңғы жақшаны күтпей, сахнаның жиналғанын көресің. Модель соңында қателессе, сахна кері қайтады, бәрі жақсы болса, түзету ортақ undo тарихына түседі.
Видеомодельге арналған промпт жинақта бар
Превиз тегіс фондағы түрлі-түсті текшелер сияқты көрінеді. Оны түсіндірмей модельге берсең, ол video-to-video жасайды: текшелерді «жақсартады», текстура қосады да, сол текшелерді қайтарады. Сондықтан нодада екі шығыс бар: video және prompt. Екіншісінде дайын нұсқаулық жатыр: видеодан тек камераны, пландарды, таймингті және объектілердің орнын алу, әр примитивті сипаттамадағы нақты объектінің орынбасары деп санау, примитив түсін объект түсі деп санамау.
Тұжырымды Seedance 2.5 және Hailuo H3-те іріктедік: екеуінде де референс видеоның рөлін айқын тағайындау конвенциясы бар, онсыз ролик сыртқы түр көзі ретінде түсіндіріледі. Ұзын тыйым тізімдері «оператор жұмысын референстен, объектілер мен атмосфераны сипаттамадан ал» деген қысқа позитивті нұсқаулықтан нашар жұмыс істеді. Оған өз сахна сипаттамаң мен кейіпкер референстерін қосасың.
Higgsfield 3D Jutsu-дан айырмашылығы
Higgsfield сол міндетті сол сценариймен шешеді: агент сахнаны сұр примитивтермен блоктайды, экспорт референс-видео береді, кейіпкерлер мен локациялар бөлек генерацияланады, сосын бәрі чатта жиналып, рендерленеді. Айырмашылық қайда өмір сүретінінде және қанша тұратынында.
| Higgsfield 3D Jutsu | GPTunneL-дегі 3D-сахна | |
|---|---|---|
| Қайда өмір сүреді | бөлек қосымша, файлдарды құралдар арасында тасисың | видео генерациясы мен монтаждың қасындағы воркфлоу кенебіндегі нода |
| Сахнаны кім жинайды | GPT-6 Astra-дағы агент; Auto-дағы хабарламалар тегін, нақты LLM кредит шегереді (GPT-6 Astra хабарламаға шамамен 17 кредит) | ықшам патч форматы мен макростардағы ассистент, сахнаға 50–500 ₸ |
| Ассеттер | GLB импорты, Mixamo кейіпкерлері, GLB және mp4 экспорты | примитивтер мен топтар, mp4 экспорты |
| Финал рендері | Higgsfield видеомодельдері, жазылым кредиттерімен төлем | Seedance 2.5, Hailuo H3 және каталогтың қалғаны, факті бойынша төлем |
| Жазылым | айына 270 кредитке $19-дан | жоқ, пайдаланғаның үшін төлейсің |
| Түзетулер | қайта генерациясыз: объектілер қолмен және чат арқылы қозғалады | қайта генерациясыз: гизмо, инспектор, чат, undo |
Higgsfield-те ассеттер кітапханасы кеңірек: дайын GLB-модельдер мен анимацияланған Mixamo кейіпкерлері сахнаға бірден танымал силуэттер береді. Бізде әзірге примитивтер, есесіне сахна видеомодель, монтаж және кадр алумен бір кенепте тұр.
Бұл қанша үнемдейді
720p-дегі Seedance 2.5 секунды 231 ₸ тұрады, 15 секундтық ролик референссіз бір өтуге шамамен 3 500 ₸, сол ұзақтықтағы видео-референспен шамамен 4 150 ₸ шығады. Күрделі ұшуды промптпен он әрекетте алу 35 000 ₸ және бір-екі сағат күту тұрады, оның өзінде кепілдіксіз. Ассистент арқылы сахна 50–500 ₸, рендер тегін, сосын референс бойынша видеомодельдің бір-екі өтуі. Hailuo H3-те пропорция сол: 768p секундына 60 ₸ тұрады, бес артық дубль бәрібір сахнадан қымбат.
Мысалдағы ролик 15 секундтық референспен 480p-де генерацияланды, мұндай өту шамамен 1 850 ₸ тұрады. Өз ұзақтығың мен ажыратымдылығыңа нақты есеп бағалар бетіндегі калькуляторда; видеомодельдер тарифтері өзгереді, өзекті сандар әрқашан жеке кабинетте.
Тағы бір мысал: 70 ₸-ге қуғын
Екінші воркфлоу қысқарақ, есесіне онда бүкіл жол көрінеді: сахнаны ассистент жинайды, референстер сыртқы түрді береді, видеомодель кино қайтарады. Сюжет — машина жол бойымен адамды қуады, үш кат: жалпы план, жүгіріп бара жатқанның ірі планы, кері шегінетін жалпы көрініс. 50 объектіден тұратын сахна ассистент арқылы 70 ₸ тұрды.
Видеомодельге кеткен превиз былай көрінеді: сұр жолдағы қызыл шанақ, ағаштардың орнына жасыл шарлар, машинаның артындағы камера.
Оған адам мен машинаның референс суреттері қосылған, Seedance 2.5 іңірдегі қысқы жолды, соғылған ескі седанды және дөңгелек астынан ұшқан қар шаңын қайтарды. Превиздегі каттар мен камера орны сақталды.
Бұл нені өзгертеді
3D-сахна өздігінен емес, воркфлоу редакторындағы тағы бір нода ретінде пайда болды: сурет пен видео генерациясы, LLM-нодалар, кадр алу және таймлайны бар видеоредактордың қасында. Бұрын сахна бір сервисте жиналып, референстер екіншісінде дайындалып, ролик үшіншісінде генерацияланып, монтаж төртіншісінде жасалатын. Енді бұл бір экран, әр қадамды файлдарды сыртқа шығармай қайта ойнатуға болады.
Higgsfield те, біз де бір қорытындыға дерлік бір уақытта келдік: видеомодельдерді басқарудың келесі қадамы промпттарда емес, геометрияда. Модель айтылғаннан гөрі көрсетілгенді дәлірек қайталайды.
Қайдан байқап көруге болады
«3D-сахна» нодасы воркфлоу конструкторында GPTunneL-дің барлық пайдаланушыларына қолжетімді: оны кенепке қос, сахнаны чатта сипатта немесе қолмен жина, шығыстарды Seedance 2.5 немесе Hailuo H3-ке қос. Ең жылдамы — бүркіт пен тракторлы дайын шаблонды ашып, өз раскадровкаңды қою. Жазылымсыз, жергілікті төлем әдістерімен факті бойынша төлем.
Сұрақтар
3D-редакторларды білу керек пе? Жоқ. Сахнаны мәтіндік сипаттама бойынша ассистент жинайды, қолмен объектіні жылжыту немесе камераны қайта қою ғана қалады. Гизмо мен таймлайн кез келген 3D-пакеттегідей құрылған, бірақ Blender білу талап етілмейді.
Қай видеомодельдер видео-референсті түсінеді? Нода промпты Seedance 2.5 және MiniMax Hailuo H3-те іріктелген, екеуінде де референс видеоны камера көзі ретінде айқын тағайындауға болады. Басқа модельдермен нәтиже олардың кіріске видео қабылдайтынына байланысты.
Өз 3D-моделімді жүктеуге бола ма? Әзірге жоқ, сахна примитивтер мен топтардан жиналады. Объектілердің сыртқы түрі геометриямен емес, видеомодель кірісіндегі референс суреттермен беріледі.
Превиз рендері қанша тұрады? Ештеңе. Рендер браузерде WebCodecs арқылы жүреді, тек ассистентке (сахнаға 50–500 ₸) және видеомодель генерациясына төлейсің.
Бұл Higgsfield 3D Jutsu баламасы ма? Міндеті бойынша иә: видеомодель камера референсі ретінде пайдаланатын примитивтерден жасалған превиз. Айырмашылығы — бізде сахна генерация мен монтаждың қасында воркфлоуға кірістірілген және жазылым жоқ.



