A resposta rápida
Abra o seletor de modelo, mude a chave no topo de Texto para Imagem e Vídeo, escolha um modelo de imagem e descreva a imagem. A dica do campo de composição muda para "Descreva a imagem que você quer gerar...", e o resultado chega na mesma conversa.
| Modelo | Para que serve |
|---|---|
| Whizi Image | Criar qualquer imagem; a primeira opção no seletor criativo |
| Nano Banana | Editar uma foto que você anexa |
| Flux | Arte fotorrealista nítida |
| Stable Diffusion | O modelo de imagem da Stability AI |
A geração de imagens está incluída no Pro, com 100 imagens por período mensal, e no Powerhouse, com 500. Contas Free e Starter têm um limite de imagens igual a zero. Um prompt de imagem pode ter de 1 a 4.000 caracteres, e as imagens geradas ficam guardadas por 30 dias, com um controle de download em cada uma. Se uma geração der erro em vez de renderizar, o texto indica a causa; veja falha na geração de imagem.
Por que gerar dentro do chat é diferente
O fluxo de trabalho comum de imagens é um produto separado, uma assinatura separada e uma caixa em branco separada que não sabe nada sobre o que você está fazendo. Gerar dentro da conversa muda duas coisas na prática.
Primeiro, o modelo já tem o contexto. Se você acabou de passar vinte mensagens desenvolvendo o conceito de uma campanha, "gere a imagem principal para isso" carrega tudo isso junto. Você não precisa reexplicar o briefing para uma ferramenta diferente.
Segundo, você pode usar um modelo de texto para escrever o prompt de imagem. Esse é o truque que a maioria das pessoas não percebe: peça ao Claude ou ao GPT para transformar sua ideia bruta em um prompt de imagem bem estruturado e depois execute. Modelos de linguagem são consideravelmente melhores em escrever prompts de imagem do que a maioria das pessoas, porque o formato é conhecido e eles já viram muitos exemplos dele.
Prompt: deixe o modelo de texto escrever o prompt de imagem
Escreva um prompt de geração de imagem para: [ideia bruta]. Ele será usado para [finalidade e local de uso]. Estruture assim: sujeito, ação ou estado, cenário, iluminação, composição e enquadramento, meio ou lente, tratamento de cor, atmosfera. Adicione uma lista negativa do que não deve aparecer. Me dê três variações que difiram na composição, não nos adjetivos.
A estrutura de prompt que funciona
Quase todo bom prompt de imagem tem as mesmas sete partes, mais ou menos nessa ordem. As partes que faltam são preenchidas pelo modelo com seus padrões, e esses padrões são o motivo pelo qual prompts genéricos produzem imagens de banco de imagens genéricas. Se essa é sua primeira vez escrevendo um, como criar imagens com IA cobre o mesmo terreno desde o início.
| Parte | O que dizer | Efeito se você omitir |
|---|---|---|
| Sujeito | A coisa específica, com o detalhe que importa | Você recebe a versão mais genérica do substantivo |
| Ação ou estado | O que está fazendo, ou como está posicionado | Estático, posado, sem vida |
| Cenário | Onde, e quanto disso fica visível | Um fundo padrão vazio ou bagunçado |
| Iluminação | Direção, qualidade, hora do dia | Plano, iluminado de forma uniforme, sem caráter |
| Composição | Ângulo, distância, onde o sujeito fica no quadro | Plano médio centralizado sempre |
| Meio ou lente | Fotografia e distância focal, ou estilo de ilustração | Tende a uma arte digital brilhante |
| Cor e atmosfera | Paleta e sensação | Supersaturado, alto contraste |
Um exemplo prático. Fraco: uma pessoa trabalhando em um escritório. Forte: Uma mulher na casa dos cinquenta anos revisando desenhos impressos em uma mesa em pé, luz do fim da tarde vinda de uma janela à sua esquerda, filmado ligeiramente por trás do ombro dela na altura dos olhos, 50mm, verdes suaves e neutros quentes, calmo e sem pressa. Negativo: sorriso de foto de banco de imagens para a câmera, mesa bagunçada, logotipos de marca visíveis, texto.
A lista negativa importa mais do que as pessoas esperam. A maior parte do que faz as imagens geradas parecerem geradas é um pequeno conjunto de artefatos recorrentes, e nomeá-los os remove: sorriso de foto de banco de imagens, supersaturado, texto, marca d'água, dedos extras, composição corporativa simétrica.
Escolhendo o modelo
- Whizi Image para criar qualquer imagem. É o gerador da casa e a primeira opção no seletor criativo.
- Nano Banana para editar uma foto que você já tem. Anexe a imagem e descreva a mudança; o campo de composição muda a dica de gerar para editar assim que uma imagem é anexada.
- Flux para arte fotorrealista nítida e qualquer coisa que precise ficar ao lado de fotografia real.
- Stable Diffusion, modelo da Stability AI, como a segunda opinião: recompensa prompts específicos e produz um visual diferente a partir das mesmas palavras.
Você pode alternar entre eles dentro do mesmo chat, que é a forma mais rápida de responder à única pergunta que importa: rode o mesmo prompt em dois modelos e compare lado a lado. A qualidade do modelo varia enormemente por assunto, e quem ganha em retratos muitas vezes não é quem ganha em interiores ou em ilustração plana.
Iterando sem ficar em círculos
A falha comum é gerar o mesmo prompt de novo e de novo esperando um resultado melhor. Parte disso é inevitável, mas a maioria das tentativas desperdiçadas vem de mudar várias coisas ao mesmo tempo e perder o controle do que ajudou.
- Mude uma variável por tentativa. Iluminação, ou enquadramento, ou paleta. Não as três juntas.
- Registre em palavras o que funcionou. Quando uma imagem fica próxima do ideal, descreva o que está certo nela no próximo prompt em vez de supor que o modelo se lembra.
- Corrija a composição antes do detalhe. Acertar o enquadramento e a luz primeiro é muito mais eficiente do que aperfeiçoar um sujeito que está na parte errada do quadro.
- Gere já na proporção final. Cortar um quadrado para virar um banner largo descarta a composição que você pediu. Peça a proporção que você realmente precisa desde o início.
- Guarde os prompts que funcionaram. Oito prompts confiáveis de estilo da casa que você pode colar de novo valem mais do que qualquer imagem única, e reutilizá-los é o que faz um conjunto de materiais parecer um conjunto.
Para editar uma imagem que você já tem, envie e descreva a mudança. Isso funciona bem para ajustes de fundo, iluminação e paleta, e funciona menos bem para edições estruturais precisas, que ainda são mais rápidas em um editor de imagem de verdade.
O que os modelos de imagem ainda erram
Texto. Palavras renderizadas continuam sendo o ponto mais fraco em todos os modelos. Palavras curtas às vezes saem certas; um título, um logotipo ou um rótulo geralmente não. Gere a imagem limpa e adicione o texto na sua ferramenta de design.
Mãos, contagens e pequenos detalhes repetidos. Dedos, dentes, pernas de cadeira e janelas de um prédio são todos lugares onde os modelos perdem a conta. Dê zoom antes de usar qualquer coisa.
Instruções espaciais precisas. "Exatamente três objetos, o vermelho à esquerda" é pouco confiável. Componha no seu editor se o arranjo realmente importa.
Consistência entre imagens. Fazer o mesmo personagem ou produto aparecer de forma idêntica em uma série é difícil. Descrições detalhadas e repetidas ajudam; resultados idênticos não são garantidos.
Sobre uso: verifique seus direitos antes de qualquer coisa gerada entrar em uma peça paga, e tenha cuidado especial com qualquer coisa que se pareça com uma pessoa real, um local reconhecível ou um estilo distinto associado a um artista vivo. Os termos de cada fornecedor diferem, e a exposição comercial recai sobre quem publica a imagem.
- Peça a um modelo de texto para escrever o prompt de imagem a partir da sua ideia bruta
- Inclua as sete partes: sujeito, ação, cenário, iluminação, composição, meio, atmosfera
- Adicione uma lista negativa nomeando os artefatos que você nunca quer
- Gere na proporção que você realmente vai usar
- Mude uma variável por iteração
- Rode o mesmo prompt em dois modelos e compare
- Adicione texto na sua ferramenta de design, não no modelo de imagem
- Guarde os prompts que funcionaram como modelos reutilizáveis
Perguntas frequentes
Quantas imagens posso gerar por mês?
O Pro inclui 100 gerações de imagem por período mensal e o Powerhouse inclui 500. Contas Free e Starter têm um limite de imagens igual a zero, então o Pro é o plano mais básico com geração de imagens. Em um ciclo de cobrança semanal, o limite é o valor mensal dividido por quatro, arredondado para cima. Como a iteração é onde as gerações são gastas, escrever um prompt estruturado primeiro (idealmente com um modelo de texto) reduz bastante quantas tentativas uma imagem utilizável leva.
Posso editar uma imagem existente?
Sim. No modo Imagem e Vídeo, anexe a foto e descreva a mudança; o campo de composição muda a dica de gerar para editar assim que uma imagem é anexada, e o Nano Banana é o modelo feito para edições de foto. Isso funciona bem para ajustes de fundo, iluminação, paleta e estilo. Funciona menos bem para edições estruturais precisas, como mover um objeto uma distância específica ou mudar texto, que ainda são mais rápidas em um editor de imagem comum.
Qual modelo de imagem devo usar?
Whizi Image para criar qualquer imagem, Nano Banana para editar uma foto que você anexa, Flux para arte fotorrealista nítida que fica ao lado de fotografia real, e Stable Diffusion para um visual diferente a partir do mesmo prompt. Como a qualidade do modelo varia muito por assunto, a forma mais rápida de decidir é rodar o mesmo prompt em dois deles no mesmo chat e comparar os resultados.
Por que o texto na minha imagem sai errado?
O texto renderizado ainda é o ponto mais fraco em todos os modelos de imagem, e nenhum prompt resolve isso de forma confiável. Palavras curtas às vezes funcionam; títulos, logotipos e rótulos geralmente não. Gere a imagem sem texto e adicione a tipografia na sua ferramenta de design, o que também garante a fonte correta e controle adequado sobre o posicionamento.
Preciso de uma assinatura de imagem separada além do Whizi?
Para a maioria dos trabalhos de campanha, conteúdo e conceito, não. A geração de imagens está incluída no Pro (100 por mês) e no Powerhouse (500), o que cobre o mesmo terreno que uma assinatura separada cobriria para o marketing e as redes sociais típicos. Uma ferramenta dedicada ainda faz sentido para equipes com requisitos estilísticos muito específicos ou uma biblioteca de prompts extensa que não querem reconstruir.