Cum generezi imagini direct într-un chat Whizi

Răspuns rapid

Ca să generezi imagini într-un chat Whizi, deschide selectorul de modele, comută-l de pe Text pe Imagine și Video, alege Whizi Image, Nano Banana, Flux, sau Stable Diffusion, și descrie imaginea. Generarea de imagini e inclusă în planurile Pro (100 pe lună) și Powerhouse (500). Iterează în același fir de discuție, apoi descarcă rezultatul.

Răspunsul pe scurt

Deschide selectorul de modele, comută butonul din partea de sus de pe Text pe Imagine și Video, alege un model de imagine, și descrie imaginea. Indiciul din câmpul de scris se schimbă în "Descrie imaginea pe care vrei să o generezi...", iar rezultatul se încarcă direct în aceeași conversație.

ModelPentru ce e folosit
Whizi ImagePentru orice tip de imagine; primul rând din selectorul creativ
Nano BananaPentru editarea unei fotografii pe care o atașezi
FluxArtă fotorealistă de mare finețe
Stable DiffusionModelul de imagine al Stability AI

Generarea de imagini e inclusă în planul Pro, la 100 de imagini pe perioadă lunară, și în Powerhouse, la 500. Conturile Free și Starter au o alocație de imagini de zero. Un prompt de imagine poate avea între 1 și 4.000 de caractere, iar imaginile generate se păstrează 30 de zile, cu un buton de descărcare pentru fiecare. Dacă o generare dă eroare în loc să se producă, textul afișat numește cauza; vezi generarea imaginii a eșuat.

De ce generarea în chat e diferită

Fluxul obișnuit pentru imagini presupune un produs separat, un abonament separat, și o casetă goală separată care nu știe nimic despre ce lucrezi. Generarea direct în conversație schimbă două lucruri practice.

În primul rând, modelul are deja contextul. Dacă tocmai ai petrecut douăzeci de mesaje dezvoltând un concept de campanie, "generează imaginea principală pentru asta" duce cu ea tot acel context. Nu mai trebuie să redescrii brief-ul unui alt instrument.

În al doilea rând, poți folosi un model de text ca să scrii promptul de imagine. Acesta e trucul pe care majoritatea oamenilor îl ratează: cere-i lui Claude sau GPT să transforme ideea ta neșlefuită într-un prompt de imagine structurat corect, apoi rulează-l. Modelele de limbaj sunt considerabil mai bune la a scrie prompturi de imagine decât majoritatea oamenilor, pentru că formatul e unul cunoscut și au văzut foarte multe exemple de acest fel.

Prompt: lasă modelul de text să scrie promptul de imagine

Scrie un prompt de generare de imagine pentru: [idee neșlefuită]. Va fi folosit pentru [scop și plasare]. Structurează-l astfel: subiect, acțiune sau stare, decor, iluminare, compoziție și cadraj, mediu sau obiectiv, tratament de culoare, atmosferă. Adaugă o listă negativă cu ce nu trebuie să apară. Dă-mi trei variante care diferă prin compoziție, nu prin adjective.

Structura de prompt care funcționează

Aproape orice prompt de imagine bun are aceleași șapte părți, în această ordine aproximativă. Părțile lipsă sunt completate de model cu valorile lui implicite, și tocmai de aceea prompturile generice produc imagini de stoc generice. Dacă e prima dată când scrii unul, cum să creezi imagini AI acoperă aceleași noțiuni de la zero.

ParteCe să spuiEfect dacă o omiți
SubiectLucrul specific, cu detaliul care conteazăObții cea mai generică versiune a substantivului
Acțiune sau stareCe face, sau cum stăStatic, pozat, lipsit de viață
DecorUnde, și cât de mult se vedeUn fundal implicit gol sau aglomerat
IluminareDirecție, calitate, momentul zileiPlat, iluminat uniform, fără caracter
CompozițieUnghi, distanță, unde stă subiectul în cadruUn prim-plan mediu centrat de fiecare dată
Mediu sau obiectivFotografie și distanță focală, sau stil de ilustrațieSe orientează implicit spre artă digitală lucioasă
Culoare și atmosferăPaletă și senzațieSuprasaturat, contrast ridicat

Un exemplu lucrat. Slab: o persoană care lucrează într-un birou. Puternic: O femeie la cincizeci și ceva de ani examinând desene tipărite la un birou înalt, lumină de după-amiază târzie dintr-o fereastră din stânga ei, cadru filmat ușor din spatele umărului ei la nivelul ochilor, 50mm, verzuri șterse și neutre calde, calm și fără grabă. Negativ: zâmbet de tip stoc-foto spre cameră, birou aglomerat, sigle de brand vizibile, text.

Lista negativă contează mai mult decât se așteaptă oamenii. O mare parte din ceea ce face ca imaginile generate să pară generate e un set mic de artefacte recurente, iar numirea lor le elimină: zâmbet de tip stoc-foto, suprasaturat, text, filigran, degete în plus, compoziție corporatistă simetrică.

Alegerea modelului

  • Whizi Image pentru orice tip de imagine. E generatorul propriu al casei și primul rând din selectorul creativ.
  • Nano Banana pentru editarea unei fotografii pe care o ai deja. Atașează poza și descrie schimbarea; câmpul de scris își schimbă indiciul de la generare la editare de îndată ce o imagine e atașată.
  • Flux pentru artă fotorealistă de mare finețe și orice trebuie să stea alături de fotografie reală.
  • Stable Diffusion, modelul Stability AI, ca a doua opinie: recompensează un prompt specific și produce un aspect diferit din aceleași cuvinte.

Poți comuta între ele în același chat, ceea ce e cea mai rapidă cale de a răspunde la singura întrebare care contează: rulează același prompt prin două modele și pune-le alături. Calitatea modelului variază enorm în funcție de subiect, iar câștigătorul la portrete adesea nu e câștigătorul la interioare sau la ilustrație plată.

Iterarea fără să te învârți în cerc

Eșecul comun e regenerarea aceluiași prompt iar și iar, sperând la o rulare mai bună. O parte din asta e inevitabilă, dar majoritatea încercărilor irosite vin din schimbarea mai multor lucruri deodată și pierderea evidenței a ce a ajutat.

  • Schimbă o singură variabilă pe încercare. Iluminarea, sau cadrajul, sau paleta. Nu toate trei.
  • Păstrează în cuvinte ce a funcționat. Când o imagine e aproape de ce vrei, descrie în următorul prompt ce e corect la ea, în loc să presupui că modelul își amintește.
  • Fixează compoziția înainte de detaliu. Să obții cadrajul și lumina corecte întâi e mult mai eficient decât să perfecționezi un subiect care e în partea greșită a cadrului.
  • Generează la raportul de aspect final. Decuparea unui pătrat într-un banner lat aruncă la gunoi compoziția pe care ai cerut-o. Cere de la început raportul de care ai cu adevărat nevoie.
  • Salvează prompturile care au funcționat. Opt prompturi de stil propriu, de încredere, pe care le poți lipi din nou valorează mai mult decât orice imagine singulară, iar reutilizarea lor e ceea ce face ca un set de materiale să arate ca un set.

Pentru editarea unei imagini pe care o ai deja, încarc-o și descrie schimbarea. Asta funcționează bine pentru ajustări de fundal, iluminare, și paletă, și mai puțin bine pentru editări structurale precise, care sunt tot mai rapide într-un editor de imagini adevărat.

Ce încă greșesc modelele de imagine

Text. Textul redat rămâne cea mai slabă zonă la toate modelele. Cuvintele scurte ies uneori corect; un titlu, o siglă, sau o etichetă de obicei nu. Generează imaginea curată și adaugă textul în instrumentul tău de design.

Mâini, numărători, și detalii mici repetate. Degete, dinți, picioare de scaun, și ferestre ale unei clădiri sunt toate locuri unde modelele pierd șirul numărătorii. Mărește imaginea înainte să folosești orice.

Instrucțiuni spațiale precise. "Exact trei obiecte, cel roșu în stânga" nu e de încredere. Compune în editorul tău dacă aranjamentul chiar contează.

Consistența între imagini. Să obții același personaj sau produs apărând identic într-o serie e dificil. Descrierile detaliate și repetate ajută; rezultatele identice nu sunt garantate.

Despre utilizare: verifică-ți drepturile înainte ca orice imagine generată să ajungă într-un plasament plătit, și ai grijă în mod special cu orice seamănă cu o persoană reală, o locație recognoscibilă, sau un stil distinctiv asociat unui artist în viață. Termenii furnizorilor diferă, iar expunerea comercială revine celui care publică imaginea.

Listă de verificare
  • Cere unui model de text să scrie promptul de imagine din ideea ta neșlefuită
  • Include toate cele șapte părți: subiect, acțiune, decor, iluminare, compoziție, mediu, atmosferă
  • Adaugă o listă negativă care numește artefactele pe care nu le vrei niciodată
  • Generează la raportul de aspect pe care îl vei folosi cu adevărat
  • Schimbă o singură variabilă pe iterație
  • Rulează același prompt prin două modele și compară
  • Adaugă textul în instrumentul tău de design, nu în modelul de imagine
  • Salvează prompturile care au funcționat ca șabloane reutilizabile

Întrebări frecvente

Câte imagini pot genera pe lună?

Pro include 100 de generări de imagini pe perioadă lunară, iar Powerhouse include 500. Conturile Free și Starter au o alocație de imagini de zero, deci Pro e cel mai mic plan cu generare de imagini. Pe un ciclu de facturare săptămânal, alocația e cifra lunară împărțită la patru, rotunjită în sus. Cum iterarea e locul unde se consumă generările, scrierea unui prompt structurat mai întâi (ideal cu un model de text) reduce vizibil câte încercări îi ia unei imagini utilizabile.

Pot edita o imagine existentă?

Da. În modul Imagine și Video, atașează fotografia și descrie schimbarea; câmpul de scris își schimbă indiciul de la generare la editare de îndată ce o poză e atașată, iar Nano Banana e modelul construit pentru editări de fotografii. Asta funcționează bine pentru ajustări de fundal, iluminare, paletă, și stil. Funcționează mai puțin bine pentru editări structurale precise, cum ar fi mutarea unui obiect la o distanță specifică sau schimbarea textului, care sunt tot mai rapide într-un editor de imagini obișnuit.

Ce model de imagine ar trebui să folosesc?

Whizi Image pentru orice tip de imagine, Nano Banana pentru editarea unei fotografii pe care o atașezi, Flux pentru artă fotorealistă de mare finețe care stă alături de fotografie reală, și Stable Diffusion pentru un aspect diferit din același prompt. Cum calitatea modelului variază mult în funcție de subiect, cea mai rapidă cale de a decide e să rulezi același prompt prin două dintre ele în același chat și să compari rezultatele.

De ce iese greșit textul din imaginea mea?

Textul redat rămâne cea mai slabă zonă la toate modelele de imagine, și niciun prompt nu o rezolvă cu încredere. Cuvintele scurte, unice, funcționează uneori; titlurile, siglele, și etichetele de obicei nu. Generează imaginea fără text și adaugă tipografia în instrumentul tău de design, ceea ce îți dă și fontul corect și control real asupra plasării.

Am nevoie de un abonament separat pentru imagini pe lângă Whizi?

Pentru majoritatea lucrărilor de campanie, conținut, și concept, nu. Generarea de imagini e inclusă în Pro (100 pe lună) și Powerhouse (500), ceea ce acoperă același teren pe care l-ar acoperi un abonament separat pentru producția tipică de marketing și social media. Un instrument dedicat rămâne util pentru echipele cu cerințe stilistice foarte specifice sau o bibliotecă de prompturi existentă și bogată pe care nu vor să o reconstruiască.