Det korte svaret
Åpne modellvelgeren, bytt bryteren øverst fra Tekst til Bilde og video, velg en bildemodell, og beskriv bildet. Hint-teksten i skrivefeltet endres til «Beskriv bildet du vil generere...», og resultatet strømmer tilbake inn i samme samtale.
| Modell | Hva den brukes til |
|---|---|
| Whizi Image | Å lage et hvilket som helst bilde; den første raden i den kreative velgeren |
| Nano Banana | Å redigere et bilde du legger ved |
| Flux | Skarp fotorealistisk kunst |
| Stable Diffusion | Stability AIs bildemodell |
Bildegenerering er inkludert i Pro, med 100 bilder per månedsperiode, og Powerhouse, med 500. Free- og Starter-kontoer har en bildekvote på null. En bildeprompt kan være mellom 1 og 4000 tegn, og genererte bilder blir lagret i 30 dager, med en nedlastingsknapp på hvert av dem. Hvis en generering feiler i stedet for å bli rendret, forklarer meldingen årsaken; se bildegenerering feilet.
Hvorfor det er annerledes å generere i chatten
Den vanlige bildearbeidsflyten er et eget produkt, et eget abonnement og en egen tom boks som ikke vet noe om hva du jobber med. Å generere inne i samtalen endrer to praktiske ting.
Først har modellen allerede konteksten. Hvis du nettopp har brukt tjue meldinger på å utvikle et kampanjekonsept, bærer «lag heltebildet for dette» med seg alt av det. Du beskriver ikke oppdraget på nytt for et annet verktøy.
Deretter kan du bruke en tekstmodell til å skrive bildeprompten. Dette er trikset de fleste går glipp av: be Claude eller GPT om å gjøre den grove ideen din til en riktig strukturert bildeprompt, og kjør den. Språkmodeller er betydelig bedre enn de fleste mennesker til å skrive bildeprompter, fordi formatet er kjent og de har sett svært mange eksempler på det.
Prompt: la tekstmodellen skrive bildeprompten
Skriv en bildegenereringsprompt for: [grov idé]. Den skal brukes til [formål og plassering]. Strukturer den som: motiv, handling eller tilstand, omgivelser, lys, komposisjon og innramming, medium eller linse, fargebehandling, stemning. Legg til en negativliste over hva som ikke skal vises. Gi meg tre varianter som skiller seg i komposisjon i stedet for i adjektiver.
Promptstrukturen som fungerer
Nesten hver gode bildeprompt har de samme syv delene, i grove trekk i denne rekkefølgen. Mangler du deler, fylles de inn av modellen med standardvalg, og disse standardvalgene er grunnen til at generiske prompter gir generiske arkivbilder. Hvis dette er første gang du skriver en, dekker hvordan lage AI-bilder samme grunn fra bunnen.
| Del | Hva du skal si | Effekt hvis du utelater den |
|---|---|---|
| Motiv | Den konkrete tingen, med detaljen som betyr noe | Du får den mest generiske versjonen av substantivet |
| Handling eller tilstand | Hva den gjør, eller hvordan den sitter | Statisk, oppstilt, livløs |
| Omgivelser | Hvor, og hvor mye av det som er synlig | En tom eller overfylt standardbakgrunn |
| Lys | Retning, kvalitet, tid på døgnet | Flatt, jevnt opplyst, uten karakter |
| Komposisjon | Vinkel, avstand, hvor motivet sitter i bildet | Sentrert halvfigur hver gang |
| Medium eller linse | Fotografi og brennvidde, eller illustrasjonsstil | Trekker mot glatt digital kunst |
| Farge og stemning | Palett og følelse | Overmettet, høy kontrast |
Et eksempel. Svakt: en person som jobber på et kontor. Sterkt: En kvinne i femtiårene som går gjennom utskrevne tegninger ved et ståbord, sent ettermiddagslys fra et vindu til venstre for henne, tatt litt bak skulderen hennes i øyenhøyde, 50mm, dempede grønntoner og varme neutrale farger, rolig og uhastig. Negativ: arkivbilde-smil mot kamera, rotete skrivebord, synlige varemerker, tekst.
Negativlisten betyr mer enn folk tror. Det meste av det som gjør genererte bilder gjenkjennelige, er et lite sett med gjentakende artefakter, og å nevne dem ved navn fjerner dem: arkivbilde-smil, overmettet, tekst, vannmerke, ekstra fingre, symmetrisk bedriftskomposisjon.
Velge modell
- Whizi Image for å lage et hvilket som helst bilde. Det er husets generator og den første raden i den kreative velgeren.
- Nano Banana for å redigere et bilde du allerede har. Legg ved bildet og beskriv endringen; skrivefeltet bytter hintet sitt fra generering til redigering så snart et bilde er lagt ved.
- Flux for skarp fotorealistisk kunst og alt som må stå side om side med ekte fotografi.
- Stable Diffusion, Stability AIs modell, som den andre meningen: den belønner konkret prompting og gir et annet resultat fra de samme ordene.
Du kan bytte mellom dem i samme chat, som er den raskeste måten å svare på det eneste spørsmålet som betyr noe: kjør samme prompt gjennom to modeller og se dem side om side. Modellkvaliteten varierer enormt etter motiv, og vinneren på portretter er ofte ikke vinneren på interiør eller flate illustrasjoner.
Å iterere uten å gå i sirkler
Det vanligste feilen er å generere samme prompt om og om igjen i håp om et bedre resultat. Noe av det er uunngåelig, men de fleste bortkastede forsøk kommer av at man endrer flere ting samtidig og mister oversikten over hva som hjalp.
- Endre én variabel per forsøk. Lys, innramming eller palett. Ikke alle tre.
- Behold det som fungerte, i ord. Når et bilde er nære, beskriv hva som er riktig med det i neste prompt i stedet for å tro at modellen husker det.
- Fiks komposisjonen før detaljene. Å få innramming og lys riktig først er langt mer effektivt enn å perfeksjonere et motiv som er i feil del av bildet.
- Generer i det endelige bildeformatet. Å beskjære et kvadrat til et bredt banner ødelegger komposisjonen du ba om. Be om formatet du faktisk trenger, fra starten.
- Lagre prompter som fungerte. Åtte pålitelige husstilprompter du kan lime inn igjen, er verdt mer enn noe enkeltbilde, og å gjenbruke dem er det som gjør et sett med ressurser til å se ut som et sett.
For å redigere et bilde du allerede har, laster du det opp og beskriver endringen. Dette fungerer godt for justeringer av bakgrunn, lys og palett, og mindre godt for presise strukturelle endringer, som fortsatt er raskere i et ekte bilderedigeringsverktøy.
Hva bildemodeller fremdeles bommer på
Tekst. Rendret tekst er fortsatt det svakeste området hos alle modeller. Korte ord kommer noen ganger riktig ut; en overskrift, en logo eller en etikett gjør det vanligvis ikke. Generer bildet rent og legg til tekst i designverktøyet ditt.
Hender, antall og små gjentatte detaljer. Fingre, tenner, stolbein og vinduer i en bygning er alle steder der modeller mister oversikten. Zoom inn før du bruker noe.
Presise romlige instruksjoner. «Nøyaktig tre objekter, det røde til venstre» er upålitelig. Sett sammen i redigeringsverktøyet ditt hvis plasseringen virkelig betyr noe.
Konsistens over flere bilder. Å få samme karakter eller produkt til å se identisk ut i en serie er vanskelig. Detaljerte, gjentatte beskrivelser hjelper; identiske resultater er ikke garantert.
Om bruk: sjekk rettighetene dine før noe generert går inn i en betalt plassering, og vær spesielt forsiktig med alt som ligner en ekte person, et gjenkjennelig sted eller en distinkt stil knyttet til en levende kunstner. Leverandørvilkårene er forskjellige, og det kommersielle ansvaret ligger hos den som publiserer bildet.
- Be en tekstmodell om å skrive bildeprompten fra din grove idé
- Ta med alle syv delene: motiv, handling, omgivelser, lys, komposisjon, medium, stemning
- Legg til en negativliste som nevner artefaktene du aldri vil ha
- Generer i formatet du faktisk skal bruke
- Endre én variabel per iterasjon
- Kjør samme prompt gjennom to modeller og sammenlign
- Legg til tekst i designverktøyet ditt, ikke i bildemodellen
- Lagre prompter som fungerte som gjenbrukbare maler
Vanlige spørsmål
Hvor mange bilder kan jeg generere per måned?
Pro inkluderer 100 bildegenereringer per månedsperiode, og Powerhouse inkluderer 500. Free- og Starter-kontoer har en bildekvote på null, så Pro er den lavest planen med bildegenerering. Ved ukentlig fakturering er kvoten den månedlige summen delt på fire, rundet opp. Siden iterasjon er der genereringer brukes opp, reduserer det å skrive en strukturert prompt først (ideelt med en tekstmodell) merkbart hvor mange forsøk et brukbart bilde krever.
Kan jeg redigere et eksisterende bilde?
Ja. I modusen Bilde og video legger du ved bildet og beskriver endringen; skrivefeltet bytter hintet sitt fra generering til redigering så snart et bilde er lagt ved, og Nano Banana er modellen bygget for bilderedigering. Dette fungerer godt for justeringer av bakgrunn, lys, palett og stil. Det fungerer mindre godt for presise strukturelle endringer, som å flytte et objekt en bestemt avstand eller endre tekst, som fortsatt er raskere i et vanlig bilderedigeringsverktøy.
Hvilken bildemodell bør jeg bruke?
Whizi Image for å lage et hvilket som helst bilde, Nano Banana for å redigere et bilde du legger ved, Flux for skarp fotorealistisk kunst som skal stå side om side med ekte fotografi, og Stable Diffusion for et annet resultat fra samme prompt. Fordi modellkvaliteten varierer mye etter motiv, er den raskeste måten å bestemme seg på å kjøre samme prompt gjennom to av dem i samme chat og sammenligne resultatene.
Hvorfor blir teksten i bildet mitt feil?
Rendret tekst er fortsatt det svakeste området hos alle bildemodeller, og ingen prompt løser det pålitelig. Korte enkeltord fungerer noen ganger; overskrifter, logoer og etiketter gjør det vanligvis ikke. Generer bildet uten tekst og legg til typografi i designverktøyet ditt, som også gir deg riktig font og god kontroll over plassering.
Trenger jeg et eget bildeabonnement i tillegg til Whizi?
For det meste av kampanje-, innholds- og konseptarbeid, nei. Bildegenerering er inkludert i Pro (100 per måned) og Powerhouse (500), som dekker samme grunn som et frittstående abonnement ville gjort for typisk markedsføring og sosiale medier. Et dedikert verktøy er fortsatt fornuftig for team med svært spesifikke stilkrav eller et stort eksisterende promptbibliotek de ikke vil bygge opp på nytt.