La risposta breve
Apri il selettore dei modelli, sposta l'interruttore in alto da Text a Image & Video, scegli un modello di immagini e descrivi l'immagine. Il suggerimento nel compositore cambia in "Descrivi l'immagine che vuoi generare...", e il risultato viene trasmesso nella stessa conversazione.
| Modello | A cosa serve |
|---|---|
| Whizi Image | Creare qualsiasi immagine; la prima riga nel selettore creativo |
| Nano Banana | Modificare una foto che alleghi |
| Flux | Arte fotorealistica nitida |
| Stable Diffusion | Il modello di immagini di Stability AI |
La generazione di immagini è inclusa nel piano Pro, con 100 immagini per periodo mensile, e nel Powerhouse, con 500. Gli account Free e Starter hanno un'allocazione di immagini pari a zero. Un prompt per immagini può avere da 1 a 4.000 caratteri, e le immagini generate vengono conservate per 30 giorni, con un controllo di download su ciascuna. Se una generazione va in errore invece di produrre un risultato, il messaggio indica la causa; vedi generazione immagine non riuscita.
Perché generare nella chat è diverso
Il flusso di lavoro tradizionale per le immagini è un prodotto separato, un abbonamento separato e una casella vuota separata che non sa nulla di ciò su cui stai lavorando. Generare all'interno della conversazione cambia due cose pratiche.
Primo, il modello ha già il contesto. Se hai appena passato venti messaggi a sviluppare un concept di campagna, "genera l'immagine hero per questo" porta con sé tutto quel contesto. Non stai ridescrivendo il brief a uno strumento diverso.
Secondo, puoi usare un modello di testo per scrivere il prompt dell'immagine. Questo è il trucco che la maggior parte delle persone si perde: chiedi a Claude o a GPT di trasformare la tua idea grezza in un prompt per immagini strutturato correttamente, poi eseguilo. I modelli linguistici sono decisamente più bravi a scrivere prompt per immagini della maggior parte delle persone, perché il formato è noto e ne hanno visti moltissimi esempi.
Prompt: lascia che il modello di testo scriva il prompt dell'immagine
Scrivi un prompt di generazione immagine per: [idea grezza]. Verrà usato per [scopo e posizionamento]. Strutturalo così: soggetto, azione o stato, ambientazione, illuminazione, composizione e inquadratura, mezzo o obiettivo, trattamento del colore, atmosfera. Aggiungi un elenco negativo di ciò che non deve comparire. Dammi tre varianti che differiscano nella composizione piuttosto che negli aggettivi.
La struttura del prompt che funziona
Quasi ogni buon prompt per immagini ha le stesse sette parti, più o meno in questo ordine. Le parti mancanti vengono riempite dal modello con i suoi valori predefiniti, ed è per questo che i prompt generici producono immagini stock generiche. Se è la prima volta che ne scrivi uno, come creare immagini AI copre lo stesso terreno da zero.
| Parte | Cosa dire | Effetto se la ometti |
|---|---|---|
| Soggetto | La cosa specifica, con il dettaglio che conta | Ottieni la versione più generica del sostantivo |
| Azione o stato | Cosa sta facendo, o come è posizionato | Statico, in posa, senza vita |
| Ambientazione | Dove, e quanto se ne vede | Uno sfondo predefinito vuoto o disordinato |
| Illuminazione | Direzione, qualità, ora del giorno | Piatta, uniforme, senza carattere |
| Composizione | Angolo, distanza, dove si trova il soggetto nell'inquadratura | Sempre un piano medio centrato |
| Mezzo o obiettivo | Fotografia e lunghezza focale, o stile illustrativo | Tende verso un'arte digitale patinata di default |
| Colore e atmosfera | Palette e sensazione | Sovrasaturato, contrasto elevato |
Un esempio pratico. Debole: una persona che lavora in ufficio. Forte: Una donna sulla cinquantina che esamina disegni stampati a una scrivania in piedi, luce di tarda pomeriggio da una finestra alla sua sinistra, ripresa leggermente da dietro la spalla ad altezza occhi, 50mm, verdi tenui e neutri caldi, calma e senza fretta. Negativo: sorriso da foto stock verso la camera, scrivania disordinata, loghi di marca visibili, testo.
L'elenco negativo conta più di quanto ci si aspetti. Gran parte di ciò che fa sembrare generate le immagini generate è un piccolo insieme di artefatti ricorrenti, e nominarli li rimuove: sorriso da foto stock, sovrasaturato, testo, filigrana, dita in più, composizione aziendale simmetrica.
Scegliere il modello
- Whizi Image per creare qualsiasi immagine. È il generatore interno e la prima riga nel selettore creativo.
- Nano Banana per modificare una foto che hai già. Allega l'immagine e descrivi la modifica; il compositore cambia il suo suggerimento da generazione a modifica non appena viene allegata un'immagine.
- Flux per arte fotorealistica nitida e per qualsiasi cosa debba stare accanto a fotografia reale.
- Stable Diffusion, il modello di Stability AI, come secondo parere: premia un prompting specifico e produce un look diverso dalle stesse parole.
Puoi passare da uno all'altro nella stessa chat, che è il modo più rapido per rispondere all'unica domanda che conta: esegui lo stesso prompt su due modelli e guardali uno accanto all'altro. La qualità dei modelli varia enormemente in base al soggetto, e chi vince sui ritratti spesso non vince sugli interni o sull'illustrazione piatta.
Iterare senza girare in tondo
L'errore comune è rigenerare lo stesso prompt più e più volte sperando in un risultato migliore. Un po' di questo è inevitabile, ma la maggior parte dei tentativi sprecati deriva dal cambiare più cose contemporaneamente e perdere traccia di cosa ha aiutato.
- Cambia una variabile per tentativo. Illuminazione, o inquadratura, o palette. Non tutte e tre.
- Tieni traccia a parole di ciò che ha funzionato. Quando un'immagine è vicina al risultato, descrivi cosa è giusto in essa nel prompt successivo invece di assumere che il modello se lo ricordi.
- Sistema la composizione prima del dettaglio. Ottenere prima l'inquadratura e la luce giuste è molto più efficiente che perfezionare un soggetto che si trova nella parte sbagliata dell'inquadratura.
- Genera già nell'aspect ratio finale. Ritagliare un quadrato in un banner largo butta via la composizione che avevi richiesto. Chiedi fin da subito il rapporto di cui hai davvero bisogno.
- Salva i prompt che hanno funzionato. Otto prompt di stile aziendale affidabili che puoi incollare di nuovo valgono più di qualsiasi singola immagine, e riutilizzarli è ciò che fa sembrare un insieme di asset un vero e proprio set.
Per modificare un'immagine che hai già, caricala e descrivi la modifica. Funziona bene per aggiustamenti a sfondo, illuminazione e palette, e meno bene per modifiche strutturali precise, che sono ancora più rapide in un vero editor di immagini.
Cosa i modelli di immagini sbagliano ancora
Testo. Le parole renderizzate restano il punto debole di ogni modello. Parole brevi a volte riescono; un titolo, un logo o un'etichetta di solito no. Genera l'immagine pulita e aggiungi il testo nel tuo strumento di design.
Mani, conteggi e piccoli dettagli ripetuti. Dita, denti, gambe di sedie e finestre di un edificio sono tutti punti in cui i modelli perdono il conto. Zooma prima di usare qualsiasi cosa.
Istruzioni spaziali precise. "Esattamente tre oggetti, quello rosso a sinistra" non è affidabile. Componi nel tuo editor se la disposizione conta davvero.
Coerenza tra le immagini. Far apparire lo stesso personaggio o prodotto in modo identico in una serie è difficile. Descrizioni dettagliate e ripetute aiutano; risultati identici non sono garantiti.
Sull'uso: verifica i tuoi diritti prima che qualsiasi cosa generata finisca in un posizionamento a pagamento, e presta particolare attenzione a tutto ciò che assomiglia a una persona reale, un luogo riconoscibile o uno stile distintivo associato a un artista vivente. I termini dei fornitori differiscono, e l'esposizione commerciale ricade su chi pubblica l'immagine.
- Chiedi a un modello di testo di scrivere il prompt dell'immagine a partire dalla tua idea grezza
- Includi tutte e sette le parti: soggetto, azione, ambientazione, illuminazione, composizione, mezzo, atmosfera
- Aggiungi un elenco negativo che nomini gli artefatti che non vuoi mai
- Genera nell'aspect ratio che userai davvero
- Cambia una variabile per iterazione
- Esegui lo stesso prompt su due modelli e confronta
- Aggiungi il testo nel tuo strumento di design, non nel modello di immagini
- Salva i prompt che hanno funzionato come modelli riutilizzabili
Domande frequenti
Quante immagini posso generare al mese?
Pro include 100 generazioni di immagini per periodo mensile e Powerhouse ne include 500. Gli account Free e Starter hanno un'allocazione di immagini pari a zero, quindi Pro è il piano più basso con generazione di immagini. Su un ciclo di fatturazione settimanale l'allocazione è la cifra mensile divisa per quattro, arrotondata per eccesso. Poiché l'iterazione è dove si spendono le generazioni, scrivere prima un prompt strutturato (idealmente con un modello di testo) riduce sensibilmente quanti tentativi richiede un'immagine utilizzabile.
Posso modificare un'immagine esistente?
Sì. In modalità Image & Video, allega la foto e descrivi la modifica; il compositore cambia il suo suggerimento da generazione a modifica non appena viene allegata un'immagine, e Nano Banana è il modello costruito per le modifiche fotografiche. Funziona bene per sfondo, illuminazione, palette e aggiustamenti di stile. Funziona meno bene per modifiche strutturali precise come spostare un oggetto di una distanza specifica o cambiare il testo, che sono ancora più rapide in un normale editor di immagini.
Quale modello di immagini dovrei usare?
Whizi Image per creare qualsiasi immagine, Nano Banana per modificare una foto che alleghi, Flux per arte fotorealistica nitida che sta accanto a fotografia reale, e Stable Diffusion per un look diverso dallo stesso prompt. Poiché la qualità del modello varia molto in base al soggetto, il modo più rapido per decidere è eseguire lo stesso prompt su due di essi nella stessa chat e confrontare i risultati.
Perché il testo nella mia immagine viene sbagliato?
Il testo renderizzato resta il punto debole di ogni modello di immagini, e nessun prompt lo risolve in modo affidabile. Parole singole brevi a volte funzionano; titoli, loghi ed etichette di solito no. Genera l'immagine senza testo e aggiungi la tipografia nel tuo strumento di design, che ti dà anche il font corretto e un controllo adeguato sul posizionamento.
Mi serve un abbonamento per immagini separato oltre a Whizi?
Per la maggior parte del lavoro di campagna, contenuti e concept, no. La generazione di immagini è inclusa nel piano Pro (100 al mese) e Powerhouse (500), il che copre lo stesso terreno di un abbonamento autonomo per il tipico output di marketing e social. Uno strumento dedicato ha ancora senso per team con requisiti stilistici molto specifici o una libreria di prompt esistente e approfondita che non vogliono ricostruire.