- Co sprawia, że narzędzie AI jest dobre dla spójnych postaci?
- Dreamina: najlepsza do tworzenia postaci opartych na referencjach i elastycznej edycji
- FLUX.2: najlepszy do kontroli znaków z wieloma odniesieniami
- Midjourney: najlepsze dla stylizowanych postaci i spójności ukierunkowanej na sztukę
- Adobe Firefly: najlepszy dla zespołów projektowych i kontrolowanych przepływów pracy komercyjnej
- Jak zachować tę samą postać na wielu obrazach AI
- Dlaczego spójność postaci AI wciąż może być trudna
- Najlepsze praktyki dotyczące spójnych postaci AI
- Które narzędzie AI wybrać?
Stworzenie jednej silnej postaci AI jest stosunkowo łatwe. Tworzenie tej samej postaci raz za razem - w różnych pozach, lokalizacjach, strojach, kątach kamery lub scenach opowiadania historii - jest znacznie trudniejsze.
Problemem jest dryf postaci. Twarz nieznacznie się zmienia. Przesuwa się długość włosów. Strój traci detal. Maskotka zyskuje inny kształt ciała. Nawet jeśli monit wygląda prawie identycznie, model może ponownie zinterpretować postać od podstaw.
Najbardziej niezawodne przepływy pracy AI rozwiązują ten problem, dając modelowi coś więcej niż tekst. Obrazy referencyjne, prowadzenie dla wielu obrazów, kontrolowana edycja i starannie ustrukturyzowane podpowiedzi pomagają określić, co powinno pozostać stałe, a co może ulec zmianie.
W tym przewodniku przyjrzymy się narzędziom AI i praktycznym przepływom pracy, które najlepiej nadają się do tworzenia spójnych postaci na wielu obrazach, a następnie omówimy, jak krok po kroku poprawiać spójność.
Co sprawia, że narzędzie AI jest dobre dla spójnych postaci?
Spójność postaci to nie tylko dwukrotne generowanie tej samej twarzy. Przydatne narzędzie musi zachować kilka zmiennych wizualnych jednocześnie:
- Tożsamość i proporcje twarzy
- Kształt, kolor i długość włosów
- Proporcje ciała
- Detale odzieży
- Akcesoria i obiekty do podpisu
- Styl artystyczny
- Paleta kolorów
- Wiek postaci i ogólne wrażenie wizualne
Najlepsze narzędzia robią to poprzez generowanie oparte na referencjach, a nie poleganie wyłącznie na tekście.
Monit tekstowy może opisywać "młodą kobietę z krótkimi czarnymi włosami, czerwoną kurtką i srebrnymi kolczykami", ale ten opis wciąż pozostawia setki decyzji wizualnych otwartych. Obraz referencyjny daje modelowi znacznie silniejszą kotwicę.
Z tego powodu narzędzia z odwołaniami do obrazów, danymi wejściowymi z wieloma odniesieniami, interaktywną edycją lub kontrolkami specyficznymi dla znaków ogólnie działają lepiej w przypadku wielokrotnego tworzenia znaków.
Dreamina: najlepsza do tworzenia postaci opartych na referencjach i elastycznej edycji
Dreamina to dobry wybór, gdy chcesz stworzyć tę samą postać na wielu obrazach, jednocześnie zmieniając scenę, pozę, kompozycję lub kierunek wizualny.
Przepływ pracy z obrazami AI obsługuje monity tekstowe wraz z obrazami referencyjnymi, umożliwiając twórcom pokazanie modelowi, jak powinna wyglądać postać, zamiast próbować opisywać każdą funkcję wizualną z pamięci.
Możesz użyć Dreamina AI Image Generator , aby zbudować podstawową postać, przesłać obrazy referencyjne, wygenerować nowe odmiany i kontynuować udoskonalanie poszczególnych szczegółów bez przebudowywania całej kompozycji od podstaw.
Zacznij od jednego zatwierdzonego znaku odniesienia, a następnie użyj go ponownie, aby wygenerować nowe sceny, zachowując jednocześnie stabilną tożsamość i strój.
Użyj obrazu referencyjnego jako kotwicy tożsamości
Najważniejszym krokiem jest rozpoczęcie od silnego odniesienia.
Wybierz obraz, na którym twarz postaci, fryzura, ubiór i sylwetka są wyraźnie widoczne. Jeśli odniesienie jest zbyt ciemne, mocno przycięte lub wizualnie niejednoznaczne, model ma mniej wiarygodne informacje do pracy.
Kiedy generujesz następny obraz, zachowaj odniesienie i opisz tylko to, co chcesz zmienić.
Prześlij obraz referencyjny do Dreaminy, a następnie trzymaj referencję dołączoną, zmieniając tylko pozę, scenę, kompozycję lub oświetlenie.
Wypróbuj ten monit
Użyj tej samej kobiety z obrazu referencyjnego. Zachowaj jej tożsamość twarzy, owalną twarz, krótką czarną fryzurę bobową, brązowe oczy, mały ślad urody w pobliżu zewnętrznego kącika lewego oka, czerwoną skórzaną kurtkę z długim rękawem, srebrne kolczyki i szczupłe proporcje ciała bez zmian. Umieść ją w minimalistycznym studiu fotograficznym z czystym, neutralnym tłem. Użyj ujęcia w trzech czwartych, nieco innej pozy i miękkiego, profesjonalnego oświetlenia studyjnego. Zmieniaj tylko pozę, kompozycję, tło i oświetlenie. Zachowaj tę samą tożsamość postaci, fryzurę, strój, dodatki i proporcje ciała.
Ten monit oddziela stałe cechy postaci od zmiennych sceny.
To rozróżnienie ma znaczenie. Jeśli każda część postaci zostanie przepisana od podstaw w każdym monicie, model ma więcej okazji do dryfowania.
Użyj wielu odniesień, gdy jeden obraz nie wystarczy
Pojedynczy portret może dobrze definiować twarz, ale dostarcza niewiele informacji o pełnym stroju postaci, profilu bocznym lub proporcjach ciała.
Gdy pozwala na to przepływ pracy, wiele odniesień może nadać modelowi szerszą wizualną definicję postaci.
Możesz użyć:
- Jedno zbliżenie na twarz
- Jeden obraz całego ciała dla proporcji i odzieży
- Profil jednostronny
- Jedno zdjęcie przedstawiające charakterystyczne akcesorium lub fryzurę
- Jeden obraz przedstawiający zamierzony styl artystyczny
Wypróbuj ten monit o wiele odniesień
Użyj załączonych obrazów referencyjnych razem, aby zdefiniować jeden spójny znak. Użyj portretu zbliżeniowego jako głównego punktu odniesienia dla tożsamości twarzy. Użyj obrazu całego ciała, aby określić proporcje ciała, ubiór i sylwetkę. Użyj obrazu z profilu bocznego do fryzury, profilu nosa, linii szczęki i ułożenia ucha. Stwórz tę samą postać w nowej scenie. Zachowaj: - tożsamość i proporcje twarzy - krótką fryzurę na czarno - brązowe oczy - mały ślad urody w pobliżu zewnętrznego kącika lewego oka - czerwoną skórzaną kurtkę z długim rękawem - srebrne kolczyki w kształcie koła - smukłe proporcje ciała Zmień tylko żądaną scenę, pozę, kąt kamery i oświetlenie. Nie przeprojektowuj postaci ani stroju.
Jest to szczególnie przydatne w przypadku ilustrowanych postaci, maskotek, powieści wizualnych, paneli komiksowych i postaci z kampanii, które muszą pojawiać się wielokrotnie.
Edytuj konkretne szczegóły zamiast regenerować wszystko
Spójność często pęka, ponieważ twórcy regenerują cały obraz tylko po to, by naprawić jeden mały problem.
Jeśli postać wygląda poprawnie, ale tło, poza, szczegóły ubioru lub oświetlenie wymagają dostosowania, ukierunkowana edycja jest zwykle bezpieczniejsza niż rozpoczynanie od nowa.
Interaktywne narzędzia do edycji Dreaminy pozwalają modyfikować wybrane części obrazu, zachowując jednocześnie nienaruszoną szerszą kompozycję i kierunek postaci. Ułatwia to zachowanie udanej twarzy lub projektu podczas iteracji po otaczającej scenie.
Jest to szczególnie przydatne, gdy masz już wizerunek postaci "bohatera", który określa wygląd, który chcesz zachować.
FLUX.2: najlepszy do kontroli znaków z wieloma odniesieniami
FLUX.2 to kolejna silna opcja spójności znaków, szczególnie gdy projekt korzysta z kilku obrazów referencyjnych.
Jego przepływ pracy z wieloma odniesieniami może łączyć wiele obrazów źródłowych i wykorzystywać je do zachowania tożsamości postaci, stylu, pozy, ubioru lub innych informacji wizualnych w nowych generacjach.
Może to działać dobrze, gdy postać musi przejść przez wiele scen, pozostając rozpoznawalną.
Na przykład możesz podać:
- Portret przodem do kierunku jazdy
- Odniesienie do całego ciała
- Odniesienie do pozy
- Odniesienie do garderoby
Następnie poproś modelkę o utworzenie nowej sceny przy użyciu tej samej osoby, jednocześnie zmieniając otoczenie i kąt kamery.
FLUX.2 jest szczególnie przydatny w procesach produkcyjnych, w których postać musi pozostać stabilna w większym zestawie obrazów, a nie tylko w dwóch lub trzech odmianach.
Midjourney: najlepsze dla stylizowanych postaci i spójności ukierunkowanej na sztukę
Midjourney pozostaje przydatna dla twórców, którym bardzo zależy na stylu wizualnym, nastroju i kierunku artystycznym.
Jego obecne przepływy pracy związane z edycją i odniesieniami mogą wykorzystywać przesłane obrazy, aby pomóc przenieść osobę, postać lub obiekt do nowych pokoleń.
W przypadku stylizowanych ilustracji, sztuki fantasy, obrazów redakcyjnych i grafiki koncepcyjnej może to stworzyć spójną wizualnie serię postaci o silnej estetyce.
Kompromis polega na tym, że bardzo małe szczegóły postaci mogą się nadal zmieniać, zwłaszcza gdy nowa scena znacznie różni się od odniesienia.
Aby uzyskać lepsze wyniki, utrzymuj stabilny opis podstawowych znaków i unikaj zmiany zbyt wielu zmiennych wizualnych jednocześnie.
Adobe Firefly: najlepszy dla zespołów projektowych i kontrolowanych przepływów pracy komercyjnej
Adobe Firefly jest przydatny, gdy spójność znaków musi pasować do większego przepływu pracy projektowej.
Obrazy referencyjne mogą pomóc w kierowaniu stylem wizualnym, kompozycją i wyglądem obiektów, a integracja Firefly z narzędziami Adobe ułatwia przejście od generacji do edycji, układu i produkcji.
Jest to szczególnie przydatne w przypadku zespołów marketingowych tworzących powtarzające się postacie kampanii, markowe obrazy redakcyjne lub historie wizualne oparte na produktach.
Firefly to także praktyczna opcja, gdy generowanie to tylko jeden etap w szerszym przepływie pracy Photoshopa lub Creative Cloud.
Jak zachować tę samą postać na wielu obrazach AI
Wybór odpowiedniego narzędzia ma znaczenie, ale równie ważny jest przepływ pracy.
Nawet silny model może dryfować, jeśli definicja znaku zmieni się z monitu na monit.
Poniższy proces jest bardziej niezawodny.
Krok 1: Stwórz jeden silny obraz postaci głównej
Nie zaczynaj od wygenerowania dziesięciu scen.
Najpierw stwórz jeden obraz, który wyraźnie określa postać.
Idealne odniesienie główne powinno ułatwić dostrzeżenie najważniejszych cech tożsamości:
- Twarz
- Włosy
- Odcień skóry
- Proporcje ciała
- Odzież
- Akcesoria
- Charakterystyczne detale projektowe
Potraktuj ten obraz jako swoje wizualne źródło prawdy.
Jeśli postać jest na tyle ważna, że pojawia się w długim projekcie, przed wygenerowaniem końcowych scen utwórz mały arkusz referencyjny z wieloma kątami i wyrażeniami.
Krok 2: Oddziel stałe cechy od cech zmiennych
Zanim napiszesz monity, zdecyduj, co nigdy nie może się zmienić.
Na przykład:
Naprawiono
- Owalna twarz
- Krótki czarny bob
- Brązowe oczy
- Czerwona skórzana kurtka
- Srebrne kolczyki koła
- Mały ślad urody pod lewym okiem
Zmienna
- Pozycja
- Tło
- Kąt kamery
- OŚWIETLENIE
- Wyraz twarzy
- Aktywność
To proste rozróżnienie znacznie ułatwia kontrolowanie podpowiedzi.
Zamiast za każdym razem inaczej opisywać całą postać, zachowujesz stabilny blok tożsamości i zmieniasz tylko blok sceny.
Krok 3: Użyj ponownie tego samego języka tożsamości
Szybki dryf może powodować dryf wizualny.
Jeśli jeden monit mówi "krótki czarny bob", inny "ciemne włosy do brody", a inny "gładka czarna fryzura", te opisy mogą brzmieć jak człowiek, ale nadal zachęcają różne pokolenia.
W miarę możliwości używaj tego samego sformułowania dla ważnych danych identyfikacyjnych.
Dobrze sprawdza się struktura wielokrotnego użytku:
Ten sam znak co obraz referencyjny. Zachowaj niezmienioną tożsamość twarzy, fryzurę, proporcje ciała, odzież i akcesoria. [Nowa scena]. [Nowa poza]. [Kadrowanie kamery]. [Oświetlenie]. [Styl].
Daje to modelowi stabilną hierarchię.
Krok 4: Zmieniaj jedną główną zmienną na raz
Jeśli jednocześnie zmienisz lokalizację, ubiór, fryzurę, pozę, obiektyw, styl artystyczny i oświetlenie, postać będzie bardziej dryfować.
W przypadku trudnych projektów buduj zmiany stopniowo.
Zacznij od:
- 1
- Ta sama postać, nowa poza 2
- Ta sama postać, nowe tło 3
- Ta sama postać, nowy kąt kamery 4
- Ta sama postać, nowy strój 5
- Ta sama postać, nowy styl
Gdy model wykaże, że może zachować tożsamość poprzez mniejsze zmiany, przejdź do bardziej złożonych scen.
Krok 5: Użyj poprzednich udanych generacji jako nowych referencji
Twój pierwszy obraz referencyjny nie zawsze musi pozostać jedyną kotwicą.
Jeśli wygenerujesz udany obraz całego ciała, profil boczny lub nową odmianę kostiumu, zapisz go.
Ten obraz może stać się kolejnym punktem odniesienia dla późniejszych scen.
Z biegiem czasu tworzysz małą wizualną bibliotekę postaci pod wieloma kątami. Daje to modelowi więcej kontekstu i może poprawić spójność scen, które różnią się od oryginalnego obrazu.
Krok 6: Popraw dryf z ukierunkowaną edycją
Jeśli twarz jest prawidłowa, ale kolor kurtki jest zły, napraw kurtkę.
Jeśli strój jest odpowiedni, ale oczy się zmieniły, edytuj twarz.
Jeśli znak jest poprawny, ale tło nie działa, zmień tło.
Unikaj wyrzucania pomyślnego obrazu za każdym razem, gdy zlokalizowana edycja może rozwiązać problem.
Im więcej zaakceptowanego obrazu zachowasz, tym mniej informacji o tożsamości model musi wymyślić na nowo.
Dlaczego spójność postaci AI wciąż może być trudna
Nawet w przypadku obrazów referencyjnych nie gwarantuje się doskonałej powtarzalności.
Generowanie obrazów AI jest zasadniczo generatywne. Model tworzy nowy obraz, a nie kopiuje i wkleja stały model postaci na nowe tło.
To wprowadza kilka typowych problemów.
Odniesienie
Spójny wynik
Strój Drift
Odniesienie i spójny efekt zachowują tę samą tożsamość postaci i stroju, podczas gdy dryfujący efekt zmienia krój kurtki i osłabia spójność wizualną.
Monit o korektę stroju
"
Zachowaj twarz kobiety, fryzurę, wyraz twarzy, pozę, proporcje ciała, srebrne kolczyki, oświetlenie, kąt kamery i tło bez zmian. Popraw tylko ubranie. Zastąp obecny strój dokładnie taką samą czerwoną skórzaną kurtką z długim rękawem, jak pokazano na obrazku referencyjnym. Dopasuj pełne rękawy, kształt kołnierza, przedni zamek błyskawiczny, boczne kieszenie na suwak, dopasowany krój, fakturę skóry i całkowitą długość. Nie zmieniaj tożsamości postaci ani żadnej innej części obrazu.
Dryf tożsamości
Małe różnice w twarzy są najbardziej oczywistą formą dryfu.
Kształt szczęki, rozstaw oczu, kształt nosa, wiek lub wyraz twarzy mogą się zmienić na tyle, że postać zacznie wyglądać jak inna osoba.
Zwykle pomaga wyraźne odniesienie do twarzy i powściągliwe zmiany scen.
Dryf strój
Skomplikowana odzież jest trudna, ponieważ zawiera wiele oddzielnych detali wizualnych.
Guziki, wzory, paski, biżuteria, logo, fałdy i akcesoria mogą zniknąć lub mutować.
Jeśli strój jest niezbędny dla postaci, użyj odniesienia do całego ciała i wyraźnie wymień najważniejsze szczegóły ubioru.
Dryf stylu
Postać może pozostać rozpoznawalna podczas zmiany stylu ilustracji.
Dzieje się tak często, gdy monity wprowadzają nowe słowa stylu w każdym pokoleniu.
Zachowaj stabilność instrukcji stylu lub użyj dedykowanego odwołania do stylu obok odwołania do znaku, gdy narzędzie je obsługuje.
Ciśnienie pozycji i kamery
Ekstremalne pozy, profile boczne, widoki z góry na dół i nietypowe soczewki zmuszają model do rekonstrukcji części postaci, które mogą nie być widoczne w oryginalnym odniesieniu.
To jeden z powodów, dla których wiele odniesień może przewyższyć jeden portret.
Im więcej kątów widział model, tym mniej musi zgadywać.
Najlepsze praktyki dotyczące spójnych postaci AI
Gdy znajdziesz działający przepływ pracy, spraw, aby był powtarzalny.
Zbuduj arkusz odniesienia do postaci
W przypadku ważnych postaci utwórz mały arkusz zawierający:
- Widok z przodu
- Widok z boku
- Widok w trzech czwartych
- Widok całego ciała
- Neutralna ekspresja
- Dwa lub trzy kluczowe wyrażenia
- Strój sygnowany
- Ważne akcesoria
Daje to wizualną podstawę wielokrotnego użytku dla przyszłych pokoleń.
Monit o widok arkusza referencyjnego:
Użyj tego samego znaku z obrazu referencyjnego. Zachowaj dokładnie tę samą tożsamość twarzy, fryzurę, proporcje ciała, czerwoną skórzaną kurtkę z długim rękawem, srebrne kolczyki i charakterystyczny znak urody. Utwórz czysty obraz studyjny przedstawiający postać w widoku [przód / trzy czwarte / profil / całe ciało]. Użyj neutralnego tła i miękkiego, równomiernego oświetlenia. Nie przeprojektowuj postaci. Zmień tylko kąt widzenia lub wyrażenie.
Arkusz odniesienia do postaci daje modelowi kilka widoków tej samej tożsamości, stroju, proporcji i odniesień do scen do ponownego wykorzystania w późniejszych generacjach.
Utwórz monit główny
Zachowaj jeden zatwierdzony monit zawierający stałe cechy tożsamości.
Zduplikuj go dla każdej nowej sceny i edytuj tylko sekcję zmiennej.
Zmniejsza to przypadkowe zmiany w sformułowaniach i znacznie ułatwia przepływ pracy zespołowej.
Utrzymuj swój model i ustawienia stabilne
Zmiana modeli w połowie projektu może zmienić sposób interpretacji rysów twarzy, oświetlenia, tekstury i stylu.
Aby uzyskać spójną serię obrazów, w miarę możliwości używaj tego samego modelu i podobnych ustawień generowania.
Utrzymuj udane referencje w porządku
Nie polegaj na pamięci.
Zapisz zatwierdzone obrazy w folderze znaków i oznacz je celowo, na przykład:
- mistrzowska twarz
- całe ciało
- profil boczny
- strój zimowy
- akcja-poza
- arkusz wyrażeń
Gdy potrzebujesz nowej sceny, wybierz odniesienie, które poda modelowi najistotniejsze informacje.
Traktuj spójność jako kontrolowany przepływ pracy, a nie pojedynczy monit
Największym błędem jest oczekiwanie jednego doskonałego podpowiedzi, aby rozwiązać cały problem.
Spójne generowanie znaków to zwykle sekwencja:
Odniesienie → Generuj → Porównaj → Edytuj → Zapisz zatwierdzoną odmianę → Ponowne użycie jako odniesienia
Gdy pracujesz w ten sposób, proces staje się znacznie bardziej przewidywalny.
Które narzędzie AI wybrać?
Najlepsze narzędzie zależy od tego, jak tworzysz.
Dreamina jest szczególnie przydatna, jeśli potrzebujesz elastycznego przepływu pracy, który łączy generowanie postaci, tworzenie oparte na odniesieniach, wiele kierunków wizualnych i ukierunkowaną edycję w jednym miejscu. Działa dobrze dla twórców tworzących postacie fabularne, seriale anime, treści społecznościowe, wizualizacje kampanii, grafiki koncepcyjne lub powtarzające się postacie markowe.
FLUX.2 jest mocnym dopasowaniem, gdy kontrola wielu odniesień jest priorytetem.
Midjourney doskonale nadaje się do wysoce artystycznej, stylizowanej pracy z postaciami.
Adobe Firefly ma sens, gdy tworzenie postaci musi znaleźć się w szerszym, profesjonalnym procesie projektowania.
Niezależnie od tego, które narzędzie wybierzesz, obowiązuje ta sama zasada: model nie powinien za każdym razem zgadywać, jak wygląda Twoja postać.
Zapewnij mu stabilne odniesienie wizualne, zachowaj spójność instrukcji dotyczących tożsamości, zmieniaj tylko ważne zmienne i zachowaj udane generacje jako część ewoluującej biblioteki znaków.
Jeśli chcesz zbudować postać i zacząć testować nowe pozy, sceny, stroje i wskazówki wizualne z tego samego odniesienia, możesz zacząć od Generatora obrazów AI Dreaminy i stamtąd udoskonalić wyniki.