Det korte svar
Åbn modelvælgeren, skift knappen i toppen fra Tekst til Billede & Video, vælg en billedmodel, og beskriv billedet. Composerens hint skifter til "Beskriv det billede, du vil generere...", og resultatet strømmer tilbage ind i den samme samtale.
| Model | Hvad den bruges til |
|---|---|
| Whizi Image | At lave et hvilket som helst billede; den første række i den kreative vælger |
| Nano Banana | At redigere et foto, du vedhæfter |
| Flux | Skarp fotorealistisk kunst |
| Stable Diffusion | Stability AI's billedmodel |
Billedgenerering er inkluderet på Pro, med 100 billeder pr. månedlig periode, og Powerhouse, med 500. Free og Starter-konti har en billedgrænse på nul. En billedprompt kan være 1 til 4.000 tegn, og genererede billeder gemmes i 30 dage, med en downloadknap på hver enkelt. Hvis en generering giver fejl i stedet for at rendere, forklarer teksten årsagen; se billedgenerering mislykkedes.
Hvorfor generering i chatten er anderledes
Den almindelige billedarbejdsgang er et separat produkt, et separat abonnement og en separat tom boks, der intet ved om det, du arbejder på. At generere inde i samtalen ændrer to praktiske ting.
For det første har modellen allerede konteksten. Hvis du lige har brugt tyve beskeder på at udvikle et kampagnekoncept, bærer "generer heltebilledet til dette" hele historien med sig. Du skal ikke genfortælle briefen til et andet værktøj.
For det andet kan du bruge en tekstmodel til at skrive billedpromptet. Det er tricket, de fleste går glip af: bed Claude eller GPT om at gøre din løse idé til et ordentligt struktureret billedprompt, og køre det derefter. Sprogmodeller er betydeligt bedre til at skrive billedprompts end de fleste mennesker, fordi formatet er velkendt, og de har set utrolig mange eksempler på det.
Prompt: lad tekstmodellen skrive billedpromptet
Skriv et billedgenereringsprompt for: [løs idé]. Det skal bruges til [formål og placering]. Strukturer det som: motiv, handling eller tilstand, omgivelser, lys, komposition og billedudsnit, medie eller linse, farvebehandling, stemning. Tilføj en negativliste over, hvad der ikke må optræde. Giv mig tre variationer, der adskiller sig i komposition frem for i adjektiver.
Promptstrukturen, der virker
Næsten hvert godt billedprompt har de samme syv dele i nogenlunde denne rækkefølge. Manglende dele udfyldes af modellen med dens standardvalg, og standardvalgene er årsagen til, at generiske prompts giver generiske stockbilleder. Hvis det er første gang, du skriver et, gennemgår sådan skaber du AI-billeder det samme fra bunden.
| Del | Hvad du skal sige | Effekt hvis du udelader det |
|---|---|---|
| Motiv | Den konkrete ting, med den detalje der betyder noget | Du får den mest generiske version af navneordet |
| Handling eller tilstand | Hvad det gør, eller hvordan det sidder | Statisk, poseret, livløst |
| Omgivelser | Hvor, og hvor meget af det er synligt | En tom eller rodet standardbaggrund |
| Lys | Retning, kvalitet, tidspunkt på dagen | Fladt, jævnt oplyst, karakterløst |
| Komposition | Vinkel, afstand, hvor motivet sidder i billedet | Centreret mellemtotal hver gang |
| Medie eller linse | Fotografi og brændvidde, eller illustrationsstil | Går som standard mod glat digital kunst |
| Farve og stemning | Palet og følelse | Overmættet, høj kontrast |
Et gennemarbejdet eksempel. Svagt: en person, der arbejder på et kontor. Stærkt: En kvinde i halvtredserne, der gennemgår printede tegninger ved et ståbord, sent eftermiddagslys fra et vindue til hendes venstre, taget lidt fra bag hendes skulder i øjenhøjde, 50mm, dæmpede grønne og varme neutrale toner, rolig og uhastet. Negativ: stockfoto-smil til kameraet, rodet skrivebord, synlige brandlogoer, tekst.
Negativlisten betyder mere end folk forventer. Det meste af det, der får genererede billeder til at se genererede ud, er et lille sæt tilbagevendende artefakter, og at nævne dem fjerner dem: stockfoto-smil, overmættet, tekst, vandmærke, ekstra fingre, symmetrisk virksomhedskomposition.
Valg af model
- Whizi Image til at lave et hvilket som helst billede. Det er husets egen generator og den første række i den kreative vælger.
- Nano Banana til at redigere et foto, du allerede har. Vedhæft billedet, og beskriv ændringen; composeren skifter sit hint fra generering til redigering, så snart et billede er vedhæftet.
- Flux til skarp fotorealistisk kunst og alt, der skal stå side om side med rigtig fotografi.
- Stable Diffusion, Stability AI's model, som den anden mening: den belønner specifik prompting og giver et andet look ud fra de samme ord.
Du kan skifte mellem dem i samme chat, hvilket er den hurtigste måde at besvare det eneste spørgsmål, der betyder noget: kør det samme prompt gennem to modeller, og se på dem side om side. Modelkvaliteten varierer enormt fra emne til emne, og vinderen på portrætter er ofte ikke vinderen på interiør eller flad illustration.
Sådan itererer du uden at gå i ring
Den almindelige fejl er at gengenerere det samme prompt igen og igen i håb om et bedre kast. Noget af det er uundgåeligt, men de fleste spildte forsøg kommer af at ændre flere ting på én gang og tabe overblikket over, hvad der hjalp.
- Ændr én variabel pr. forsøg. Lys, eller billedudsnit, eller palet. Ikke alle tre.
- Bevar det, der virkede, i ord. Når et billede er tæt på, beskriv da det, der er rigtigt ved det, i dit næste prompt frem for at gå ud fra, at modellen husker det.
- Ret komposition før detalje. At få billedudsnittet og lyset rigtigt først er langt mere effektivt end at perfektionere et motiv, der sidder i den forkerte del af billedet.
- Generer i det endelige billedformat. At beskære et kvadrat til et bredt banner smider den komposition væk, du bad om. Bed om det format, du faktisk skal bruge, fra starten.
- Gem de prompts, der virkede. Otte solide, husets-egne prompts, du kan indsætte igen, er værd mere end noget enkelt billede, og at genbruge dem er det, der gør et sæt aktiver til at ligne et sæt.
For at redigere et billede, du allerede har, skal du uploade det og beskrive ændringen. Det virker godt til justeringer af baggrund, lys og palet, og mindre godt til præcise strukturelle ændringer, som stadig er hurtigere i en rigtig billedredigering.
Det billedmodeller stadig ikke kan finde ud af
Tekst. Renderet tekst er stadig det svageste område i alle modeller. Korte ord kommer nogle gange rigtigt ud; en overskrift, et logo eller en label gør det som regel ikke. Generer billedet uden tekst, og tilføj tekst i dit designværktøj.
Hænder, antal og små gentagne detaljer. Fingre, tænder, stolebens og vinduer i en bygning er alle steder, hvor modeller taber tællingen. Zoom ind, før du bruger noget.
Præcise rumlige instruktioner. "Præcis tre objekter, det røde til venstre" er upålideligt. Sammensæt selv i dit redigeringsprogram, hvis placeringen virkelig betyder noget.
Konsistens mellem billeder. At få den samme karakter eller det samme produkt til at fremstå identisk i en serie er svært. Detaljerede, gentagne beskrivelser hjælper; identiske resultater er ikke garanteret.
Om brug: check dine rettigheder, før noget genereret går ind i en betalt placering, og vær særligt forsigtig med alt, der ligner en rigtig person, et genkendeligt sted eller en distinkt stil forbundet med en levende kunstner. Udbyderes vilkår varierer, og den kommercielle risiko ligger hos den, der udgiver billedet.
- Bed en tekstmodel om at skrive billedpromptet fra din løse idé
- Inkludér alle syv dele: motiv, handling, omgivelser, lys, komposition, medie, stemning
- Tilføj en negativliste, der nævner de artefakter, du aldrig vil have
- Generer i det billedformat, du faktisk kommer til at bruge
- Ændr én variabel pr. iteration
- Kør det samme prompt gennem to modeller, og sammenlign
- Tilføj tekst i dit designværktøj, ikke i billedmodellen
- Gem de prompts, der virkede, som genbrugelige skabeloner
Ofte stillede spørgsmål
Hvor mange billeder kan jeg generere om måneden?
Pro inkluderer 100 billedgenereringer pr. månedlig periode, og Powerhouse inkluderer 500. Free og Starter-konti har en billedgrænse på nul, så Pro er den billigste plan med billedgenerering. Ved ugentlig fakturering er grænsen den månedlige værdi delt med fire og rundet op. Da iteration er der, hvor genereringer bliver brugt, reducerer det mærkbart, hvor mange forsøg et brugbart billede tager, hvis du først skriver et struktureret prompt (gerne med en tekstmodel).
Kan jeg redigere et eksisterende billede?
Ja. I tilstanden Billede & Video skal du vedhæfte fotoet og beskrive ændringen; composeren skifter sit hint fra generering til redigering, så snart et billede er vedhæftet, og Nano Banana er modellen bygget til fotoredigering. Det virker godt til justeringer af baggrund, lys, palet og stil. Det virker mindre godt til præcise strukturelle ændringer, som at flytte et objekt en bestemt afstand eller ændre tekst, som stadig er hurtigere i en almindelig billedredigering.
Hvilken billedmodel bør jeg bruge?
Whizi Image til at lave et hvilket som helst billede, Nano Banana til at redigere et foto, du vedhæfter, Flux til skarp fotorealistisk kunst, der skal stå side om side med rigtig fotografi, og Stable Diffusion til et andet look ud fra det samme prompt. Fordi modelkvaliteten varierer meget fra emne til emne, er den hurtigste måde at afgøre det på at køre det samme prompt gennem to af dem i samme chat og sammenligne resultaterne.
Hvorfor kommer teksten i mit billede forkert ud?
Renderet tekst er stadig det svageste område i alle billedmodeller, og intet prompt løser det pålideligt. Korte, enkelte ord virker nogle gange; overskrifter, logoer og labels gør det som regel ikke. Generer billedet uden tekst, og tilføj typografi i dit designværktøj, som også giver dig den rigtige skrifttype og ordentlig kontrol over placeringen.
Skal jeg have et separat billedabonnement udover Whizi?
Til det meste kampagne-, indholds- og konceptarbejde, nej. Billedgenerering er inkluderet på Pro (100 om måneden) og Powerhouse (500), hvilket dækker samme grund, som et selvstændigt abonnement ville til typisk markedsførings- og socialt indhold. Et dedikeret værktøj giver stadig mening for teams med meget specifikke stilkrav eller et omfattende eksisterende promptbibliotek, de ikke vil genopbygge.