Przejdź do treści

Dwie nowe postacie w jednym filmie: Genjutsu Motion Transfer krok po kroku

Jak podmienić dwoje bohaterów w istniejącym klipie AI: nagranie źródłowe, referencje, prompt, storyboard i kontrola twarzy, gestów oraz dźwięku.

Wolisz zapytać niż czytać dalej?

Otwórz asystenta AI i zadaj pytanie do tego poradnika.

Masz jedno nagranie dwóch osób i chcesz zachować jego rytm, gesty oraz ujęcia, ale obsadzić scenę nowymi bohaterami? W tym poradniku przejdziemy od materiału źródłowego i kart postaci do promptu dla Higgsfield Genjutsu Motion Transfer. Przykład to krótki muzyczny dialog w zaparkowanym aucie. Dostajesz gotowe prompty, storyboard, plan kontroli wyniku i wariant dla zwykłej rozmowy.

Ilustracje przedstawiają zamierzony efekt na fikcyjnych postaciach; nie są klatkami z przetestowanego renderu wideo. Polecenia typu „zachowaj dokładnie” wyrażają cel, a nie gwarancję działania modelu. Stan funkcji narzędzia sprawdzono 4 października 2026.

Co oznacza „recast” w filmie AI?

To ponowne obsadzenie istniejącego ujęcia. Film źródłowy daje ruch ciała, tempo gestów, ustawienie kamery, długość i momenty cięć. Zdjęcia referencyjne określają wygląd nowych bohaterów. Higgsfield Genjutsu opisuje dwa tryby: Motion Transfer odtwarza ruch w nowej obsadzie lub otoczeniu, a Object Swap służy do bardziej punktowej podmiany elementu istniejącego filmu. W naszym przykładzie chcemy zmienić dwie osoby, dlatego zaczynamy od Motion Transfer. Jeśli zależy Ci przede wszystkim na nienaruszonym oryginalnym wnętrzu samochodu, przetestuj również Object Swap i porównaj wyniki.

W praktyce model musi odtworzyć twarze pod zmieniającym się kątem, dopasować ubrania do ruchu, zachować pasy na właściwych miejscach i dopasować usta do dźwięku. To trudniejsze niż podmiana jednego nieruchomego przedmiotu. Najpierw zrób krótką próbę, a potem oceń film w ruchu oraz na zatrzymanych klatkach.

Ilustracja źródłowego nagrania dwóch fikcyjnych osób siedzących w zaparkowanym aucie nad wodą
Plan źródła: dwa miejsca, dwa pasy, jedna kamera na desce rozdzielczej.
Ilustracja docelowego kadru z dwiema nowymi fikcyjnymi postaciami w tym samym zaparkowanym aucie
Wizualizacja celu: inna obsada, ten sam układ sceny. To nie jest wynik renderowania wideo.

Najpierw nagraj dobry materiał źródłowy

Na pierwszą próbę wybierz 6–10 sekund. Ustaw telefon stabilnie na uchwycie, najlepiej szeroko tak, by całe twarze, barki, pasy i przynajmniej część dłoni obu osób były widoczne. Światło powinno odsłaniać rysy twarzy; ostre migające refleksy utrudnią późniejszą edycję. Zapisz plik źródłowy przed kompresją komunikatora. Nie trzeba nagrywać nowej sceny specjalnie dla każdego nowego stroju, ale im bardziej zasłonięta twarz, tym mniej informacji model ma do odtworzenia.

W tym przykładzie samochód stoi na parkingu. Dwie osoby mogą swobodnie zaśpiewać krótką własną frazę i wykonać drobne gesty. Nikt nie prowadzi pojazdu podczas odgrywania sceny. Jeżeli filmujesz samochód w ruchu, kierowca zachowuje uwagę na drodze i ręce przy kierownicy; dynamiczne gesty zostaw pasażerowi. Recast nie powinien dopisywać zachowania, którego nie ma w materiale źródłowym.

Element źródłaUstal przed generacjąDlaczego
Strony kadruPasażerka jest po lewej stronie obrazu, kierowca po prawej.„Lewa strona auta” może znaczyć coś innego przy różnych układach kierownicy.
KameraStały uchwyt na desce, jedno szerokie ujęcie.Mniej nieznanych kątów twarzy i prostsza kontrola ciągłości.
RuchJedna krótka wypowiedź lub własna zaśpiewana fraza, drobne gesty.Model łatwiej utrzyma usta i dłonie niż przy gwałtownym tańcu.
DźwiękOddzielna kopia oryginalnego audio.W razie artefaktów można je podłożyć w montażu.
CięcieNa start bez cięcia, potem ewentualnie jedno zbliżenie.Łatwiej wykryć moment zmiany twarzy, ubrania lub pozycji pasów.

Dwie referencje zamiast jednego ogólnego opisu

Każda osoba potrzebuje osobnej, wyraźnej referencji. Nasza fikcyjna pasażerka ma krótkie miedziane włosy, brązowe oczy i turkusowy satynowy żakiet. Kierowca ma krótkie włosy z siwizną, krótki zarost i bordową aksamitną marynarkę. Zdjęcie od pasa w górę pokazuje twarz, fryzurę i strój w jednym pliku. Jeżeli masz tylko portret, dołącz drugi obraz stroju i wyraźnie napisz, że nie dostarcza twarzy.

Dwa osobne portrety fikcyjnej pasażerki w turkusowym żakiecie i kierowcy w bordowej marynarce
Ilustracja dwóch referencji. Do narzędzia najlepiej wgrać je jako dwa oddzielne pliki, w ustalonej kolejności.

Jeśli pracujesz z jedną planszą postaci, wyeksportuj z niej osobny portret każdej osoby. Małe twarze w wielopolowej siatce mogą być dla modelu mniej użyteczne. W poradniku o kartach referencyjnych znajdziesz pełny prompt na obroty, mimikę i opis stroju.

Prompt obrazowy A · pasażerka

Fotorealistyczny portret referencyjny fikcyjnej dorosłej kobiety, 28 lat, od pasa w górę, twarz pod niewielkim kątem trzech czwartych, obie dłonie widoczne i puste. Krótki miedzianoczerwony bob z delikatną falą, brązowe oczy, małe znamię obok lewego policzka, naturalna struktura skóry. Turkusowy satynowy żakiet i jasna koszula, bez biżuterii i logo. Równe miękkie światło studyjne, jasnoszare tło, realistyczne proporcje, wyraźna twarz i ubranie. Jedna osoba, bez napisów, rekwizytów i alternatywnych strojów.

Prompt obrazowy B · kierowca

Fotorealistyczny portret referencyjny fikcyjnego dorosłego mężczyzny, 30 lat, od pasa w górę, twarz pod niewielkim kątem trzech czwartych, obie dłonie widoczne i puste. Krótkie włosy z siwizną, schludny krótki zarost, niebieskoszare oczy, naturalna struktura skóry. Bordowa aksamitna marynarka na kremowym golfie, bez krawata, okularów i logo. Równe miękkie światło studyjne, jasnoszare tło, realistyczne proporcje, wyraźna twarz i ubranie. Jedna osoba, bez napisów, rekwizytów i alternatywnych strojów.

Przed użyciem sprawdź parę portretów obok siebie: czy ubrania są łatwe do odróżnienia, czy włosy nie zasłaniają twarzy, czy nie ma dodatkowych dłoni. Jeżeli dany kadr źródłowy pokazuje profil, przyda się dodatkowy profil tej samej osoby, ale zacznij od prostego zestawu dwóch zdjęć.

Prompt do Genjutsu Motion Transfer

W Higgsfield wybierz Genjutsu i Motion Transfer. Wgraj klip jako @Video 1, portret pasażerki jako @Image 1, portret kierowcy jako @Image 2. Oznaczenia w interfejsie mogą się różnić: przed generacją sprawdź miniatury i kolejność plików. Oficjalny opis Genjutsu podaje źródłowe wideo o długości 3–30 sekund; dostępne ustawienia jakości i koszt konkretnego uruchomienia sprawdź w panelu przed zatwierdzeniem.

Główny prompt · podmiana dwojga bohaterów

Wykorzystaj @Video 1 jako źródło ruchu i czasu. To krótki występ dwóch dorosłych osób w zaparkowanym samochodzie, nagrany nieruchomą kamerą na desce rozdzielczej. Obsadzaj tę samą scenę dwiema fikcyjnymi postaciami. Nie twórz nowej choreografii.

MAPA: osoba na miejscu pasażera, po LEWEJ stronie obrazu, ma wygląd z @Image 1: krótki miedziany bob, brązowe oczy, małe znamię obok lewego policzka, turkusowy satynowy żakiet i jasna koszula. Osoba na miejscu kierowcy, po PRAWEJ stronie obrazu, ma wygląd z @Image 2: krótkie siwiejące włosy, krótki zarost, niebieskoszare oczy, bordowa aksamitna marynarka i kremowy golf. Nie zamieniaj osób miejscami i nie mieszaj cech twarzy ani ubrań.

Zachowaj kolejność gestów, kierunek spojrzeń, rytm wypowiedzi, ruch ust, długość klipu, nieruchomą kamerę, szerokość kadru, wnętrze tego samego auta, deszcz na szybach i wieczorny widok nabrzeża. Dwa pasy bezpieczeństwa pozostają widoczne, biegną przed nowymi ubraniami i zachowują logiczne położenie przy ruchu ciała. Kierowca trzyma dłonie przy kierownicy zgodnie z filmem źródłowym. Nowe ubrania reagują na ruch naturalnie, bez przeskoków między klatkami.

Zachowaj dźwięk źródłowy, jeśli wybrana opcja edycji go przenosi. Nie dodawaj nowej muzyki, dialogu, logo ani tekstu. Nie zmieniaj ustawienia kamery, układu siedzeń, kierunku ruchu rąk i momentów akcji. Te same dwie nowe twarze od pierwszej do ostatniej klatki, realistyczna skóra i spójne oświetlenie z otoczeniem auta.

To świadomie konkretny, ale nie przesadnie długi prompt. Pierwszy akapit ustala zadanie; mapa przypisuje osoby; kolejne zdania blokują elementy łatwe do pomylenia. Jeśli narzędzie nie obsługuje przeniesienia oryginalnego dźwięku, pobierz wynik obrazu i podłóż wcześniej zachowaną ścieżkę w edytorze. Sprawdź synchronizację, zanim opublikujesz film.

Storyboard: zaplanuj kontrolę w ośmiu momentach

Storyboard nie musi być osobnym obrazem wygenerowanym przez AI. Możesz zatrzymać źródło w ośmiu punktach i zanotować, co dzieje się na ekranie. To lepsza podstawa kontroli niż ładna siatka, której gesty nie zgadzają się z nagraniem. Przykład dla własnego klipu długości ośmiu sekund:

CzasCo widaćCo sprawdzić w wyniku
0,0 sObie osoby widoczne, kamera stoi.Właściwe twarze po właściwych stronach.
1,0 sPasażerka zaczyna frazę.Usta i mikroekspresja nie zamrażają się.
2,0 sPasażerka podnosi dłoń.Rękaw, palce i pas pozostają logiczne.
3,0 sKierowca reaguje spojrzeniem.Głowa zmienia kąt, twarz nadal ta sama.
4,0 sObie osoby w jednym kadrze.Nie zamieniły się rysami ani miejscami.
5,0 sKrótka wspólna fraza.Ruch ust dwóch osób nie jest identyczną kopią.
6,5 sPasażerka opiera dłoń.Dłoń nie przenika fotela ani pasa.
8,0 sKoniec gestu i klipu.Strój, wnętrze i obie twarze nadal spójne.

Jeżeli potrzebujesz wizualnej planszy dla ekipy, utwórz ją po obejrzeniu filmu źródłowego. Poniższy prompt pomaga uporządkować kadry, ale generowane obrazki są projektem, nie dowodem, że dokładnie takie klatki występują w wideo.

Opcjonalny prompt · plansza ośmiu klatek

Na podstawie dołączonej klatki źródłowej oraz osobnych portretów dwóch fikcyjnych postaci przygotuj poziomą planszę 4 × 2 z ośmioma kadrami w proporcji 16:9. W każdym kadrze to samo zaparkowane auto, nieruchoma kamera na desce, pasażerka po lewej stronie obrazu, kierowca po prawej, oboje z pasami. Zachowaj tożsamość i stroje z portretów. Pokaż wyłącznie osiem stanów akcji wypisanych poniżej: [TU WPISZ OSIEM RZECZYWISTYCH MOMENTÓW ZE ŹRÓDŁA]. Zachowaj porządek czasu, wnętrze auta, deszcz za oknami i kierunek światła. Białe odstępy między panelami, bez napisów i dodatkowych osób. Nie dodawaj gestów, których nie ma w filmie źródłowym.

Jeśli chcesz zmienić tylko ubrania albo tylko jedną osobę

Nie trzeba wtedy od razu robić całego recastu. W Genjutsu Object Swap wskaż jeden obiekt lub jedną postać i daj jej referencję. Jedna zmiana na zdanie ułatwia ocenę efektu. Przykładowo:

Wariant Object Swap · tylko pasażerka

W @Video 1 zmień wyłącznie dorosłą pasażerkę siedzącą po lewej stronie obrazu na fikcyjną osobę z @Image 1. Zachowaj jej miejsce, skalę, gesty i czas wypowiedzi. Jej pas bezpieczeństwa pozostaje na wierzchu ubrania i porusza się naturalnie. Kierowca, wnętrze samochodu, deszcz, kamera, długość, montaż i dźwięk pozostają takie jak w materiale źródłowym.

Sprawdź, który tryb lepiej trzyma resztę sceny. Opis produktu rozróżnia Motion Transfer i Object Swap, lecz w złożonym dwupostaciowym kadrze żaden tryb nie zwalnia z kontroli wyniku.

Kontrola jakości: obejrzyj film trzy razy

  1. Bez dźwięku: śledź twarze, dłonie, krawędzie włosów, pasy i ubrania. Zatrzymuj obraz przy obrotach głowy, nakładaniu dłoni na twarz i mocniejszych gestach.
  2. Sam dźwięk: odsłuchaj, czy nie zniknęła fraza, nie powtórzył się sylaba lub nie pojawił się nowy głos. Porównaj długość ze źródłem.
  3. Razem: sprawdź, czy początek i koniec każdej wypowiedzi pasują do ust właściwej osoby. Upewnij się, że jedna osoba nie „śpiewa” głosem drugiej.

Najczęstsze błędy mają konkretną poprawkę. Gdy bohaterowie zamieniają się miejscami, dopisz stronę obrazu i kolor ubrania każdej osoby w mapie. Gdy znika pas, użyj kadru źródłowego z dobrze widocznymi pasami i powtórz blokadę w promptcie. Gdy twarz zmienia się przy obrocie, przygotuj dodatkową referencję trzech czwartych tej samej osoby albo skróć próbny fragment. Gdy audio nie pasuje, wykorzystaj oryginalną ścieżkę w edytorze; jeśli usta nadal się rozmijają, popraw sam fragment obrazu zamiast maskować problem muzyką.

Jeżeli źródło ma cięcie na zbliżenie, wpisz jego dokładny czas w prompt i sprawdź kilka klatek po obu stronach. Taki montaż odsłania zwykle największą zmianę geometrii twarzy. Na pierwszą próbę jedno stabilne ujęcie daje czytelniejszą diagnozę.

Wariant bez samochodu: rozmowa przy stole

Ta metoda nie jest przywiązana do auta ani do śpiewania. Dwie osoby mogą rozmawiać przy stole, podawać sobie produkt albo reagować na żart. Zamień mapę miejsc na „osoba bliżej okna” i „osoba bliżej lampy”, a pasy na istotny rekwizyt. Wystarczy zmienić część opisującą scenę; zachowaj kolejność referencji, informację o ruchu, długości oraz warunki kontroli twarzy i dźwięku.

Krótki wariant · rozmowa dwóch osób

@Video 1 wyznacza dokładny rytm rozmowy, gesty, ustawienie kamery i czas. Zamień tylko osobę przy oknie na postać z @Image 1, a osobę bliżej lampy na postać z @Image 2. Nie zamieniaj ich miejscami ani nie przenoś elementów stroju między nimi. Zachowaj stół, kubki, kierunek światła, gest podania kubka i oryginalną ścieżkę dźwiękową. Bez nowych zdań, osób, rekwizytów i cięć.

Granice metody i publikacja

Używaj własnego filmu albo materiału, do którego masz odpowiednie prawa, i referencji postaci, które możesz wykorzystywać. Jeżeli podmieniasz rozpoznawalną prawdziwą osobę, uzyskaj zgodę na użycie wizerunku; nie przedstawiaj syntetycznego występu jako jej autentycznej wypowiedzi lub rekomendacji. Przy śpiewanym fragmencie własne nagranie i własny podkład najprościej rozwiązują kwestię praw do muzyki. Zachowaj źródło, referencje i wersję promptu obok eksportu, żeby można było wrócić do konkretnej próby.

Dobry pierwszy eksperyment to osiem sekund, dwie wyraźne referencje i jedno ujęcie. Jeśli chcesz lepiej przygotować twarze i stroje, zacznij od karty postaci AI. Więcej o edycji pojedynczych elementów znajdziesz w poradniku Genjutsu Object Swap, a o nowych miejscach i kątach kamery w przewodniku Genjutsu i Seedance.

Oficjalne źródła

Powiązane tematy:

← Wróć do Poradnika AI

Czy ten poradnik był pomocny?

Komentarze (0)

Brak komentarzy. Bądź pierwszy!


Dodaj komentarz

Zaloguj się aby uniknąć weryfikacji emaila przy każdym komentarzu, lub komentuj jako gość:

Komentarz może być moderowany przed publikacją.