Sådan laver du billeder med chatgpt inde i en Whizi-chat

Kort svar

For at lave billeder med chatgpt eller andre modeller i en Whizi-chat skal du åbne modelvælgeren, skifte den fra Tekst til Billede & Video, vælge Whizi Image, Nano Banana, Flux eller Stable Diffusion og beskrive billedet. Billedgenerering er inkluderet på Pro (100 om måneden) og Powerhouse (500). Iterér i samme tråd, og download derefter resultatet.

Det korte svar

Åbn modelvælgeren, skift knappen i toppen fra Tekst til Billede & Video, vælg en billedmodel, og beskriv billedet. Composerens hint skifter til "Beskriv det billede, du vil generere...", og resultatet strømmer tilbage ind i den samme samtale.

ModelHvad den bruges til
Whizi ImageAt lave et hvilket som helst billede; den første række i den kreative vælger
Nano BananaAt redigere et foto, du vedhæfter
FluxSkarp fotorealistisk kunst
Stable DiffusionStability AI's billedmodel

Billedgenerering er inkluderet på Pro, med 100 billeder pr. månedlig periode, og Powerhouse, med 500. Free og Starter-konti har en billedgrænse på nul. En billedprompt kan være 1 til 4.000 tegn, og genererede billeder gemmes i 30 dage, med en downloadknap på hver enkelt. Hvis en generering giver fejl i stedet for at rendere, forklarer teksten årsagen; se billedgenerering mislykkedes.

Hvorfor generering i chatten er anderledes

Den almindelige billedarbejdsgang er et separat produkt, et separat abonnement og en separat tom boks, der intet ved om det, du arbejder på. At generere inde i samtalen ændrer to praktiske ting.

For det første har modellen allerede konteksten. Hvis du lige har brugt tyve beskeder på at udvikle et kampagnekoncept, bærer "generer heltebilledet til dette" hele historien med sig. Du skal ikke genfortælle briefen til et andet værktøj.

For det andet kan du bruge en tekstmodel til at skrive billedpromptet. Det er tricket, de fleste går glip af: bed Claude eller GPT om at gøre din løse idé til et ordentligt struktureret billedprompt, og køre det derefter. Sprogmodeller er betydeligt bedre til at skrive billedprompts end de fleste mennesker, fordi formatet er velkendt, og de har set utrolig mange eksempler på det.

Prompt: lad tekstmodellen skrive billedpromptet

Skriv et billedgenereringsprompt for: [løs idé]. Det skal bruges til [formål og placering]. Strukturer det som: motiv, handling eller tilstand, omgivelser, lys, komposition og billedudsnit, medie eller linse, farvebehandling, stemning. Tilføj en negativliste over, hvad der ikke må optræde. Giv mig tre variationer, der adskiller sig i komposition frem for i adjektiver.

Promptstrukturen, der virker

Næsten hvert godt billedprompt har de samme syv dele i nogenlunde denne rækkefølge. Manglende dele udfyldes af modellen med dens standardvalg, og standardvalgene er årsagen til, at generiske prompts giver generiske stockbilleder. Hvis det er første gang, du skriver et, gennemgår sådan skaber du AI-billeder det samme fra bunden.

DelHvad du skal sigeEffekt hvis du udelader det
MotivDen konkrete ting, med den detalje der betyder nogetDu får den mest generiske version af navneordet
Handling eller tilstandHvad det gør, eller hvordan det sidderStatisk, poseret, livløst
OmgivelserHvor, og hvor meget af det er synligtEn tom eller rodet standardbaggrund
LysRetning, kvalitet, tidspunkt på dagenFladt, jævnt oplyst, karakterløst
KompositionVinkel, afstand, hvor motivet sidder i billedetCentreret mellemtotal hver gang
Medie eller linseFotografi og brændvidde, eller illustrationsstilGår som standard mod glat digital kunst
Farve og stemningPalet og følelseOvermættet, høj kontrast

Et gennemarbejdet eksempel. Svagt: en person, der arbejder på et kontor. Stærkt: En kvinde i halvtredserne, der gennemgår printede tegninger ved et ståbord, sent eftermiddagslys fra et vindue til hendes venstre, taget lidt fra bag hendes skulder i øjenhøjde, 50mm, dæmpede grønne og varme neutrale toner, rolig og uhastet. Negativ: stockfoto-smil til kameraet, rodet skrivebord, synlige brandlogoer, tekst.

Negativlisten betyder mere end folk forventer. Det meste af det, der får genererede billeder til at se genererede ud, er et lille sæt tilbagevendende artefakter, og at nævne dem fjerner dem: stockfoto-smil, overmættet, tekst, vandmærke, ekstra fingre, symmetrisk virksomhedskomposition.

Valg af model

  • Whizi Image til at lave et hvilket som helst billede. Det er husets egen generator og den første række i den kreative vælger.
  • Nano Banana til at redigere et foto, du allerede har. Vedhæft billedet, og beskriv ændringen; composeren skifter sit hint fra generering til redigering, så snart et billede er vedhæftet.
  • Flux til skarp fotorealistisk kunst og alt, der skal stå side om side med rigtig fotografi.
  • Stable Diffusion, Stability AI's model, som den anden mening: den belønner specifik prompting og giver et andet look ud fra de samme ord.

Du kan skifte mellem dem i samme chat, hvilket er den hurtigste måde at besvare det eneste spørgsmål, der betyder noget: kør det samme prompt gennem to modeller, og se på dem side om side. Modelkvaliteten varierer enormt fra emne til emne, og vinderen på portrætter er ofte ikke vinderen på interiør eller flad illustration.

Sådan itererer du uden at gå i ring

Den almindelige fejl er at gengenerere det samme prompt igen og igen i håb om et bedre kast. Noget af det er uundgåeligt, men de fleste spildte forsøg kommer af at ændre flere ting på én gang og tabe overblikket over, hvad der hjalp.

  • Ændr én variabel pr. forsøg. Lys, eller billedudsnit, eller palet. Ikke alle tre.
  • Bevar det, der virkede, i ord. Når et billede er tæt på, beskriv da det, der er rigtigt ved det, i dit næste prompt frem for at gå ud fra, at modellen husker det.
  • Ret komposition før detalje. At få billedudsnittet og lyset rigtigt først er langt mere effektivt end at perfektionere et motiv, der sidder i den forkerte del af billedet.
  • Generer i det endelige billedformat. At beskære et kvadrat til et bredt banner smider den komposition væk, du bad om. Bed om det format, du faktisk skal bruge, fra starten.
  • Gem de prompts, der virkede. Otte solide, husets-egne prompts, du kan indsætte igen, er værd mere end noget enkelt billede, og at genbruge dem er det, der gør et sæt aktiver til at ligne et sæt.

For at redigere et billede, du allerede har, skal du uploade det og beskrive ændringen. Det virker godt til justeringer af baggrund, lys og palet, og mindre godt til præcise strukturelle ændringer, som stadig er hurtigere i en rigtig billedredigering.

Det billedmodeller stadig ikke kan finde ud af

Tekst. Renderet tekst er stadig det svageste område i alle modeller. Korte ord kommer nogle gange rigtigt ud; en overskrift, et logo eller en label gør det som regel ikke. Generer billedet uden tekst, og tilføj tekst i dit designværktøj.

Hænder, antal og små gentagne detaljer. Fingre, tænder, stolebens og vinduer i en bygning er alle steder, hvor modeller taber tællingen. Zoom ind, før du bruger noget.

Præcise rumlige instruktioner. "Præcis tre objekter, det røde til venstre" er upålideligt. Sammensæt selv i dit redigeringsprogram, hvis placeringen virkelig betyder noget.

Konsistens mellem billeder. At få den samme karakter eller det samme produkt til at fremstå identisk i en serie er svært. Detaljerede, gentagne beskrivelser hjælper; identiske resultater er ikke garanteret.

Om brug: check dine rettigheder, før noget genereret går ind i en betalt placering, og vær særligt forsigtig med alt, der ligner en rigtig person, et genkendeligt sted eller en distinkt stil forbundet med en levende kunstner. Udbyderes vilkår varierer, og den kommercielle risiko ligger hos den, der udgiver billedet.

Tjekliste
  • Bed en tekstmodel om at skrive billedpromptet fra din løse idé
  • Inkludér alle syv dele: motiv, handling, omgivelser, lys, komposition, medie, stemning
  • Tilføj en negativliste, der nævner de artefakter, du aldrig vil have
  • Generer i det billedformat, du faktisk kommer til at bruge
  • Ændr én variabel pr. iteration
  • Kør det samme prompt gennem to modeller, og sammenlign
  • Tilføj tekst i dit designværktøj, ikke i billedmodellen
  • Gem de prompts, der virkede, som genbrugelige skabeloner

Ofte stillede spørgsmål

Hvor mange billeder kan jeg generere om måneden?

Pro inkluderer 100 billedgenereringer pr. månedlig periode, og Powerhouse inkluderer 500. Free og Starter-konti har en billedgrænse på nul, så Pro er den billigste plan med billedgenerering. Ved ugentlig fakturering er grænsen den månedlige værdi delt med fire og rundet op. Da iteration er der, hvor genereringer bliver brugt, reducerer det mærkbart, hvor mange forsøg et brugbart billede tager, hvis du først skriver et struktureret prompt (gerne med en tekstmodel).

Kan jeg redigere et eksisterende billede?

Ja. I tilstanden Billede & Video skal du vedhæfte fotoet og beskrive ændringen; composeren skifter sit hint fra generering til redigering, så snart et billede er vedhæftet, og Nano Banana er modellen bygget til fotoredigering. Det virker godt til justeringer af baggrund, lys, palet og stil. Det virker mindre godt til præcise strukturelle ændringer, som at flytte et objekt en bestemt afstand eller ændre tekst, som stadig er hurtigere i en almindelig billedredigering.

Hvilken billedmodel bør jeg bruge?

Whizi Image til at lave et hvilket som helst billede, Nano Banana til at redigere et foto, du vedhæfter, Flux til skarp fotorealistisk kunst, der skal stå side om side med rigtig fotografi, og Stable Diffusion til et andet look ud fra det samme prompt. Fordi modelkvaliteten varierer meget fra emne til emne, er den hurtigste måde at afgøre det på at køre det samme prompt gennem to af dem i samme chat og sammenligne resultaterne.

Hvorfor kommer teksten i mit billede forkert ud?

Renderet tekst er stadig det svageste område i alle billedmodeller, og intet prompt løser det pålideligt. Korte, enkelte ord virker nogle gange; overskrifter, logoer og labels gør det som regel ikke. Generer billedet uden tekst, og tilføj typografi i dit designværktøj, som også giver dig den rigtige skrifttype og ordentlig kontrol over placeringen.

Skal jeg have et separat billedabonnement udover Whizi?

Til det meste kampagne-, indholds- og konceptarbejde, nej. Billedgenerering er inkluderet på Pro (100 om måneden) og Powerhouse (500), hvilket dækker samme grund, som et selvstændigt abonnement ville til typisk markedsførings- og socialt indhold. Et dedikeret værktøj giver stadig mening for teams med meget specifikke stilkrav eller et omfattende eksisterende promptbibliotek, de ikke vil genopbygge.