Så skapar du bilder i ai direkt i en Whizi-chatt

Snabbt svar

För att skapa bilder i ai i en Whizi-chatt öppnar du modellväljaren, byter den från Text till Bild och video, väljer Whizi Image, Nano Banana, Flux eller Stable Diffusion och beskriver bilden. Bildgenerering ingår i Pro (100 per månad) och Powerhouse (500). Iterera i samma tråd och ladda sedan ner resultatet.

Det korta svaret

Öppna modellväljaren, byt reglaget högst upp från Text till Bild och video, välj en bildmodell och beskriv bilden. Ledtexten i skrivfältet ändras till "Beskriv bilden du vill skapa...", och resultatet strömmas tillbaka in i samma konversation.

ModellVad den är till för
Whizi ImageAtt skapa vilken bild som helst; den första raden i den kreativa väljaren
Nano BananaAtt redigera ett foto du bifogar
FluxSkarp fotorealistisk konst
Stable DiffusionStability AI:s bildmodell

Bildgenerering ingår i Pro, med 100 bilder per månadsperiod, och Powerhouse, med 500. Free och Starter har en bildkvot på noll. En bildprompt kan vara 1 till 4 000 tecken, och genererade bilder sparas i 30 dagar, med en nedladdningsknapp på varje. Om en generering felar istället för att rendera anger texten orsaken; se bildgenerering misslyckades.

Varför det är annorlunda att skapa i chatten

Det vanliga arbetsflödet för bilder är en separat produkt, en separat prenumeration och en separat tom ruta som inte vet något om vad du arbetar med. Att skapa bilder direkt i konversationen förändrar två praktiska saker.

För det första har modellen redan kontexten. Om du precis har lagt tjugo meddelanden på att utveckla ett kampanjkoncept bär "skapa hjältebilden för det här" med sig allt det. Du behöver inte återberätta briefen till ett annat verktyg.

För det andra kan du använda en textmodell för att skriva bildprompten. Det här är knepet flest missar: be Claude eller GPT att göra din ungefärliga idé till en ordentligt strukturerad bildprompt, och köra den sedan. Språkmodeller är betydligt bättre på att skriva bildprompter än de flesta människor är, eftersom formatet är känt och de har sett väldigt många exempel på det.

Prompt: låt textmodellen skriva bildprompten

Skriv en bildgenereringsprompt för: [ungefärlig idé]. Den ska användas för [syfte och placering]. Strukturera den som: motiv, handling eller tillstånd, miljö, ljussättning, komposition och beskärning, medium eller objektiv, färgbehandling, känsla. Lägg till en negativlista över vad som inte får synas. Ge mig tre varianter som skiljer sig i komposition snarare än i adjektiv.

Promptstrukturen som fungerar

Nästan alla bra bildprompter har samma sju delar i ungefär denna ordning. Delar som saknas fylls i av modellen med dess standardval, och det är just standardvalen som gör att generiska prompter ger generisk stockbildskänsla. Om det är första gången du skriver en, går hur man skapar ai-bilder igenom samma mark från grunden.

DelVad du ska sägaEffekt om du utelämnar den
MotivDet specifika, med den detalj som spelar rollDu får den mest generiska versionen av substantivet
Handling eller tillståndVad det gör, eller hur det sitterStatiskt, poserat, livlöst
MiljöVar, och hur mycket av den som synsEn tom eller rörig standardbakgrund
LjussättningRiktning, kvalitet, tid på dygnetPlatt, jämnt belyst, karaktärslöst
KompositionVinkel, avstånd, var motivet sitter i bildenCentrerad halvbild varje gång
Medium eller objektivFotografi och brännvidd, eller illustrationsstilLutar mot glansig digital konst
Färg och känslaPalett och stämningÖvermättat, hög kontrast

Ett genomarbetat exempel. Svagt: en person som arbetar på ett kontor. Starkt: En kvinna i femtioårsåldern som granskar utskrivna ritningar vid ett ståbord, sent eftermiddagsljus från ett fönster till vänster om henne, tagen lite bakom hennes axel i ögonhöjd, 50mm, dova gröna toner och varma neutrala nyanser, lugnt och avslappnat tempo. Negativ: leende mot kameran i stockbildsstil, rörigt skrivbord, synliga varumärkeslogotyper, text.

Negativlistan spelar en större roll än folk förväntar sig. Det mesta som får genererade bilder att se genererade ut är en liten mängd återkommande artefakter, och att namnge dem tar bort dem: leende i stockbildsstil, övermättat, text, vattenstämpel, extra fingrar, symmetrisk företagskomposition.

Välja modell

  • Whizi Image för att skapa vilken bild som helst. Det är husets egen generator och den första raden i den kreativa väljaren.
  • Nano Banana för att redigera ett foto du redan har. Bifoga bilden och beskriv ändringen; skrivfältets ledtext byter från att skapa till att redigera så snart en bild är bifogad.
  • Flux för skarp fotorealistisk konst och allt som behöver placeras bredvid riktig fotografi.
  • Stable Diffusion, Stability AI:s modell, som en andra åsikt: den belönar specifika prompter och ger ett annat utseende från samma ord.

Du kan växla mellan dem i samma chatt, vilket är det snabbaste sättet att besvara den enda frågan som betyder något: kör samma prompt genom två modeller och jämför dem sida vid sida. Modellkvaliteten varierar enormt beroende på motiv, och vinnaren på porträtt är ofta inte vinnaren på interiörer eller platt illustration.

Att iterera utan att gå i cirklar

Det vanliga misstaget är att generera om samma prompt om och om igen i hopp om ett bättre slumpresultat. En del av det går inte att undvika, men de flesta bortkastade försök beror på att man ändrar flera saker samtidigt och tappar bort vad som faktiskt hjälpte.

  • Ändra en variabel per försök. Ljussättning, eller beskärning, eller palett. Inte alla tre.
  • Behåll det som fungerade i ord. När en bild är nära, beskriv vad som är rätt med den i nästa prompt istället för att anta att modellen minns.
  • Fixa kompositionen före detaljerna. Att få beskärningen och ljuset rätt först är betydligt mer effektivt än att fullända ett motiv som sitter i fel del av bilden.
  • Generera i det slutgiltiga bildformatet. Att beskära en kvadrat till en bred banner slänger bort kompositionen du bad om. Be om det format du faktiskt behöver från början.
  • Spara prompterna som fungerade. Åtta pålitliga prompter i husets stil som du kan klistra in igen är värda mer än någon enskild bild, och att återanvända dem är det som gör en samling material till just en samling.

För att redigera en bild du redan har, laddar du upp den och beskriver ändringen. Det fungerar bra för justeringar av bakgrund, ljus och palett, och mindre bra för precisa strukturella ändringar, som fortfarande går snabbare i en riktig bildredigerare.

Vad bildmodeller fortfarande missar

Text. Renderade ord är fortfarande det svagaste området hos alla modeller. Korta ord kommer ibland ut rätt; en rubrik, en logotyp eller en etikett gör det oftast inte. Skapa bilden utan text och lägg till text i ditt designverktyg.

Händer, antal och små upprepade detaljer. Fingrar, tänder, stolsben och fönster på en byggnad är alla ställen där modeller tappar räkningen. Zooma in innan du använder något.

Precisa rumsliga instruktioner. "Exakt tre föremål, det röda till vänster" är opålitligt. Sätt ihop det i ditt redigeringsverktyg om placeringen verkligen spelar roll.

Konsekvens mellan bilder. Att få samma karaktär eller produkt att se identisk ut genom en serie är svårt. Detaljerade, upprepade beskrivningar hjälper; identiska resultat garanteras inte.

Om användning: kontrollera dina rättigheter innan något genererat går in i en betald placering, och var särskilt försiktig med allt som liknar en verklig person, en igenkännbar plats eller en särskild stil kopplad till en levande konstnär. Villkoren skiljer sig mellan leverantörer, och det kommersiella ansvaret ligger hos den som publicerar bilden.

Checklista
  • Be en textmodell skriva bildprompten utifrån din ungefärliga idé
  • Inkludera alla sju delar: motiv, handling, miljö, ljussättning, komposition, medium, känsla
  • Lägg till en negativlista som namnger artefakterna du aldrig vill ha
  • Generera i det bildformat du faktiskt kommer använda
  • Ändra en variabel per iteration
  • Kör samma prompt genom två modeller och jämför
  • Lägg till text i ditt designverktyg, inte i bildmodellen
  • Spara prompterna som fungerade som återanvändbara mallar

Vanliga frågor

Hur många bilder kan jag skapa i ai per månad?

Pro inkluderar 100 bildgenereringar per månadsperiod och Powerhouse inkluderar 500. Free och Starter har en bildkvot på noll, så Pro är den lägsta planen med bildgenerering. Vid faktureringscykel per vecka är kvoten den månatliga siffran delad med fyra, avrundad uppåt. Eftersom iteration är där genereringar går åt, minskar det tydligt hur många försök en användbar bild kräver om du skriver en strukturerad prompt först (gärna med en textmodell).

Kan jag redigera en befintlig bild?

Ja. I läget Bild och video bifogar du fotot och beskriver ändringen; skrivfältets ledtext byter från att skapa till att redigera så snart en bild är bifogad, och Nano Banana är modellen byggd för fotoredigering. Det fungerar bra för justeringar av bakgrund, ljus, palett och stil. Det fungerar mindre bra för precisa strukturella ändringar, som att flytta ett objekt en specifik sträcka eller ändra text, vilket fortfarande går snabbare i en vanlig bildredigerare.

Vilken bildmodell ska jag använda?

Whizi Image för att skapa vilken bild som helst, Nano Banana för att redigera ett foto du bifogar, Flux för skarp fotorealistisk konst som placeras bredvid riktig fotografi, och Stable Diffusion för ett annat utseende från samma prompt. Eftersom modellkvaliteten varierar mycket beroende på motiv är det snabbaste sättet att bestämma sig att köra samma prompt genom två av dem i samma chatt och jämföra resultaten.

Varför blir texten i min bild fel?

Renderad text är fortfarande det svagaste området hos alla bildmodeller, och ingen prompt löser det på ett pålitligt sätt. Korta ensamma ord fungerar ibland; rubriker, logotyper och etiketter gör det oftast inte. Skapa bilden utan text och lägg till typografi i ditt designverktyg, vilket också ger dig rätt typsnitt och riktig kontroll över placeringen.

Behöver jag en separat bildprenumeration utöver Whizi?

För det mesta av kampanj-, innehålls- och konceptarbete, nej. Bildgenerering ingår i Pro (100 per månad) och Powerhouse (500), vilket täcker samma mark som en fristående prenumeration skulle för typiskt marknadsförings- och sociala flöden. Ett dedikerat verktyg är fortfarande motiverat för team med väldigt specifika stilkrav eller ett stort befintligt promptbibliotek de inte vill bygga om.