Jak generować obrazy w czacie Whizi

Krótka odpowiedź

Aby wygenerować obraz w czacie Whizi, otwórz selektor modeli, przełącz go z Tekstu na Obraz i wideo (Image & Video), wybierz Whizi Image, Nano Banana, Flux lub Stable Diffusion, i opisz obraz. Generowanie obrazów jest wliczone w plany Pro (100 miesięcznie) i Powerhouse (500). Iteruj w tym samym wątku, a na końcu pobierz wynik.

Krótka odpowiedź

Otwórz selektor modeli, przełącz przełącznik u góry z Tekstu na Obraz i wideo (Image & Video), wybierz model obrazu i opisz obraz. Podpowiedź w polu wiadomości zmienia się na „Opisz obraz, który chcesz wygenerować...”, a wynik pojawia się w tej samej rozmowie.

ModelDo czego służy
Whizi ImageDo tworzenia dowolnego obrazu; pierwszy wiersz w kreatywnym selektorze
Nano BananaDo edytowania załączonego zdjęcia
FluxOstra fotorealistyczna grafika
Stable DiffusionModel obrazów od Stability AI

Generowanie obrazów jest wliczone w plan Pro, w wysokości 100 obrazów miesięcznie, oraz w plan Powerhouse, w wysokości 500. Konta Free i Starter mają limit obrazów równy zero. Prompt do obrazu może mieć od 1 do 4000 znaków, a wygenerowane obrazy są przechowywane przez 30 dni, z przyciskiem pobierania przy każdym z nich. Jeśli generowanie zakończy się błędem zamiast wyrenderować obraz, treść komunikatu wskazuje przyczynę; zobacz generowanie obrazu nie powiodło się.

Dlaczego generowanie w czacie jest inne

Typowy proces tworzenia obrazów to osobny produkt, osobna subskrypcja i osobne puste pole, które nic nie wie o tym, nad czym pracujesz. Generowanie wewnątrz rozmowy zmienia dwie praktyczne rzeczy.

Po pierwsze, model ma już cały kontekst. Jeśli właśnie spędziłeś dwadzieścia wiadomości na opracowywaniu koncepcji kampanii, polecenie „wygeneruj do tego obraz główny” niesie ze sobą wszystko. Nie musisz na nowo opisywać briefu innemu narzędziu.

Po drugie, możesz użyć modelu tekstowego do napisania promptu do obrazu. To sztuczka, którą większość ludzi pomija: poproś Claude lub GPT, żeby zamienił twój surowy pomysł w prawidłowo skonstruowany prompt do obrazu, a potem go uruchom. Modele językowe są znacznie lepsze w pisaniu promptów do obrazów niż większość ludzi, bo format jest im znany i widziały mnóstwo jego przykładów.

Prompt: niech model tekstowy napisze prompt do obrazu

Napisz prompt do generowania obrazu dla: [surowy pomysł]. Zostanie użyty do [cel i miejsce publikacji]. Zbuduj go jako: temat, czynność lub stan, otoczenie, oświetlenie, kompozycja i kadrowanie, medium lub obiektyw, potraktowanie koloru, nastrój. Dodaj listę negatywną tego, co nie może się pojawić. Podaj mi trzy warianty różniące się kompozycją, a nie przymiotnikami.

Struktura promptu, która działa

Niemal każdy dobry prompt do obrazu ma te same siedem części, mniej więcej w tej kolejności. Brakujące części model wypełnia swoimi domyślnymi ustawieniami, i to właśnie te domyślne wartości sprawiają, że ogólne prompty dają ogólne, stockowe obrazy. Jeśli piszesz taki prompt po raz pierwszy, jak tworzyć obrazy AI omawia to samo od podstaw.

CzęśćCo napisaćEfekt, jeśli to pominiesz
TematKonkretna rzecz, z istotnym szczegółemOtrzymujesz najbardziej ogólną wersję rzeczownika
Czynność lub stanCo robi lub jak się układaStatyczne, pozowane, bez życia
OtoczenieGdzie, i jak dużo z tego widaćPuste lub zagracone domyślne tło
OświetlenieKierunek, jakość, pora dniaPłaskie, równomiernie oświetlone, bez charakteru
KompozycjaKąt, dystans, miejsce tematu w kadrzeZawsze wyśrodkowane ujęcie średnie
Medium lub obiektywZdjęcie i ogniskowa, albo styl ilustracjiDomyślnie skłania się ku błyszczącej grafice cyfrowej
Kolor i nastrójPaleta i odczuciePrzesycone, wysoki kontrast

Przykład praktyczny. Słaby: osoba pracująca w biurze. Mocny: Kobieta po pięćdziesiątce przegląda wydrukowane rysunki przy biurku stojącym, późnopopołudniowe światło z okna po jej lewej stronie, ujęcie lekko zza ramienia na wysokości oczu, 50mm, stonowane zielenie i ciepłe neutralne barwy, spokojnie i bez pośpiechu. Negatyw: stockowy uśmiech do kamery, zagracone biurko, widoczne logotypy marek, tekst.

Lista negatywna liczy się bardziej, niż większość osób się spodziewa. To, co sprawia, że wygenerowane obrazy wyglądają na wygenerowane, to zwykle niewielki zestaw powtarzających się artefaktów, a nazwanie ich usuwa je: stockowy uśmiech, przesycenie, tekst, znak wodny, dodatkowe palce, symetryczna korporacyjna kompozycja.

Wybór modelu

  • Whizi Image do tworzenia dowolnego obrazu. To domowy generator i pierwszy wiersz w kreatywnym selektorze.
  • Nano Banana do edytowania zdjęcia, które już masz. Załącz zdjęcie i opisz zmianę; podpowiedź w polu wiadomości przełącza się z generowania na edycję, gdy tylko dołączysz obraz.
  • Flux do ostrej, fotorealistycznej grafiki i wszystkiego, co musi znaleźć się obok prawdziwej fotografii.
  • Stable Diffusion, model od Stability AI, jako druga opinia: wynagradza precyzyjne prompty i daje inny wygląd przy tych samych słowach.

Możesz przełączać się między nimi w tym samym czacie, co jest najszybszym sposobem, by odpowiedzieć na jedyne pytanie, które się liczy: uruchom ten sam prompt w dwóch modelach i porównaj wyniki obok siebie. Jakość modeli różni się ogromnie w zależności od tematu, a zwycięzca w portretach często nie wygrywa we wnętrzach czy w płaskiej ilustracji.

Iterowanie bez kręcenia się w kółko

Częstym błędem jest wielokrotne generowanie tego samego promptu w nadziei na lepszy wynik. Część tego jest nieunikniona, ale większość zmarnowanych prób bierze się ze zmieniania kilku rzeczy naraz i gubienia tego, co faktycznie pomogło.

  • Zmieniaj jedną zmienną na próbę. Oświetlenie, kadrowanie albo paletę. Nie wszystkie trzy naraz.
  • Zapisuj słowami to, co zadziałało. Gdy obraz jest bliski oczekiwanego, opisz w kolejnym prompcie, co jest w nim dobre, zamiast zakładać, że model to pamięta.
  • Napraw kompozycję, zanim zajmiesz się szczegółami. Ustawienie kadru i światła na początku jest o wiele efektywniejsze niż dopracowywanie tematu, który znajduje się w złej części kadru.
  • Generuj od razu w docelowych proporcjach. Przycinanie kwadratu do szerokiego baneru niszczy kompozycję, o którą prosiłeś. Poproś od razu o proporcje, których faktycznie potrzebujesz.
  • Zapisuj prompty, które zadziałały. Osiem sprawdzonych promptów w stylu twojej marki, które możesz wkleić ponownie, jest warte więcej niż pojedynczy obraz, a ich ponowne użycie sprawia, że zestaw materiałów wygląda jak zestaw.

Aby edytować obraz, który już masz, prześlij go i opisz zmianę. Sprawdza się to dobrze przy korektach tła, oświetlenia i palety, a gorzej przy precyzyjnych zmianach strukturalnych, które wciąż szybciej wykonasz w prawdziwym edytorze obrazów.

Z czym modele obrazów wciąż sobie nie radzą

Tekst. Renderowane słowa pozostają najsłabszym punktem każdego modelu. Krótkie słowa czasem się udają; nagłówek, logo czy etykieta zwykle nie. Wygeneruj obraz bez tekstu i dodaj go w swoim narzędziu projektowym.

Dłonie, liczby i małe powtarzające się szczegóły. Palce, zęby, nogi krzeseł i okna w budynku to miejsca, w których modele gubią liczenie. Przybliż obraz, zanim czegokolwiek użyjesz.

Precyzyjne instrukcje przestrzenne. „Dokładnie trzy obiekty, czerwony po lewej” jest zawodne. Jeśli układ naprawdę ma znaczenie, skomponuj go w swoim edytorze.

Spójność między obrazami. Sprawienie, by ta sama postać lub produkt wyglądały identycznie w całej serii, jest trudne. Pomagają szczegółowe, powtarzane opisy; identyczne rezultaty nie są gwarantowane.

Jeśli chodzi o wykorzystanie: sprawdź swoje prawa, zanim cokolwiek wygenerowanego trafi do płatnej publikacji, i zachowaj szczególną ostrożność przy wszystkim, co przypomina prawdziwą osobę, rozpoznawalne miejsce lub charakterystyczny styl kojarzony z żyjącym artystą. Warunki dostawców się różnią, a ryzyko komercyjne ponosi ten, kto publikuje obraz.

Lista kontrolna
  • Poproś model tekstowy o napisanie promptu do obrazu na podstawie twojego surowego pomysłu
  • Uwzględnij wszystkie siedem części: temat, czynność, otoczenie, oświetlenie, kompozycję, medium, nastrój
  • Dodaj listę negatywną, wymieniającą artefakty, których nigdy nie chcesz
  • Generuj w proporcjach, których faktycznie użyjesz
  • Zmieniaj jedną zmienną na iterację
  • Uruchom ten sam prompt w dwóch modelach i porównaj wyniki
  • Dodawaj tekst w narzędziu projektowym, nie w modelu obrazu
  • Zapisuj sprawdzone prompty jako gotowe do ponownego użycia szablony

Najczęstsze pytania

Ile obrazów mogę wygenerować w miesiącu?

Plan Pro obejmuje 100 generacji obrazów miesięcznie, a Powerhouse 500. Konta Free i Starter mają limit obrazów równy zero, więc Pro to najniższy plan z generowaniem obrazów. Przy tygodniowym cyklu rozliczeniowym limit to wartość miesięczna podzielona przez cztery, zaokrąglona w górę. Ponieważ to iteracja zużywa generacje, napisanie najpierw uporządkowanego promptu (najlepiej z pomocą modelu tekstowego) wyraźnie zmniejsza liczbę prób potrzebnych do uzyskania użytecznego obrazu.

Czy mogę edytować istniejący obraz?

Tak. W trybie Obraz i wideo (Image & Video) załącz zdjęcie i opisz zmianę; podpowiedź w polu wiadomości przełącza się z generowania na edycję, gdy tylko dołączysz zdjęcie, a Nano Banana to model stworzony do edycji zdjęć. Sprawdza się to dobrze przy korektach tła, oświetlenia, palety i stylu. Gorzej radzi sobie z precyzyjnymi zmianami strukturalnymi, takimi jak przesunięcie obiektu o konkretną odległość czy zmiana tekstu, co wciąż szybciej wykonasz w zwykłym edytorze obrazów.

Którego modelu obrazów powinienem użyć?

Whizi Image do tworzenia dowolnego obrazu, Nano Banana do edytowania załączonego zdjęcia, Flux do ostrej, fotorealistycznej grafiki, która ma sąsiadować z prawdziwą fotografią, i Stable Diffusion dla innego wyglądu przy tym samym prompcie. Ponieważ jakość modeli mocno różni się w zależności od tematu, najszybszym sposobem wyboru jest uruchomienie tego samego promptu w dwóch z nich w tym samym czacie i porównanie wyników.

Dlaczego tekst na moim obrazie wychodzi źle?

Renderowany tekst wciąż jest najsłabszym punktem każdego modelu obrazów i żaden prompt nie naprawia tego niezawodnie. Krótkie pojedyncze słowa czasem się udają; nagłówki, logotypy i etykiety zwykle nie. Wygeneruj obraz bez tekstu i dodaj typografię w swoim narzędziu projektowym, co dodatkowo da ci właściwą czcionkę i pełną kontrolę nad umiejscowieniem.

Czy potrzebuję osobnej subskrypcji do obrazów oprócz Whizi?

Do większości prac nad kampaniami, treściami i koncepcjami, nie. Generowanie obrazów jest wliczone w plany Pro (100 miesięcznie) i Powerhouse (500), co pokrywa te same potrzeby, co osobna subskrypcja przy typowych materiałach marketingowych i social media. Dedykowane narzędzie wciąż ma sens dla zespołów z bardzo specyficznymi wymaganiami stylistycznymi lub obszerną biblioteką promptów, której nie chcą odtwarzać od nowa.