La respuesta corta
Abre el selector de modelo, cambia el interruptor de arriba de Texto a Imagen y Video, elige un modelo de imagen y describe la imagen. La pista del compositor cambia a "Describe la imagen que quieres generar...", y el resultado llega a la misma conversación.
| Modelo | Para qué sirve |
|---|---|
| Whizi Image | Generar cualquier imagen; la primera fila del selector creativo |
| Nano Banana | Editar una foto que adjuntas |
| Flux | Arte fotorrealista nítido |
| Stable Diffusion | El modelo de imagen de Stability AI |
La generación de imágenes está incluida en Pro, con 100 imágenes por periodo mensual, y en Powerhouse, con 500. Las cuentas Free y Starter tienen una asignación de imágenes de cero. Un prompt de imagen puede tener de 1 a 4.000 caracteres, y las imágenes generadas se conservan 30 días, con un control de descarga en cada una. Si una generación da error en vez de renderizar, el texto indica la causa; consulta error al generar la imagen.
Por qué generar en el chat es diferente
El flujo habitual de generación de imágenes es un producto aparte, una suscripción aparte y una caja en blanco aparte que no sabe nada de lo que estás haciendo. Generar dentro de la conversación cambia dos cosas prácticas.
Primero, el modelo ya tiene el contexto. Si acabas de pasar veinte mensajes desarrollando un concepto de campaña, "genera la imagen principal para esto" lo lleva todo consigo. No tienes que volver a describir el brief a otra herramienta.
Segundo, puedes usar un modelo de texto para escribir el prompt de imagen. Este es el truco que casi todos pasan por alto: pídele a Claude o a GPT que convierta tu idea general en un prompt de imagen bien estructurado, y luego ejecútalo. Los modelos de lenguaje son considerablemente mejores escribiendo prompts de imagen que la mayoría de las personas, porque el formato es conocido y han visto muchísimos ejemplos.
Prompt: deja que el modelo de texto escriba el prompt de imagen
Escribe un prompt de generación de imagen para: [idea general]. Se usará para [propósito y ubicación]. Estructúralo así: sujeto, acción o estado, escenario, iluminación, composición y encuadre, medio o lente, tratamiento del color, atmósfera. Añade una lista negativa de lo que no debe aparecer. Dame tres variaciones que difieran en composición, no en adjetivos.
La estructura de prompt que funciona
Casi todo buen prompt de imagen tiene las mismas siete partes, más o menos en este orden. Las partes que faltan las rellena el modelo con sus valores por defecto, y esos valores por defecto son la razón por la que los prompts genéricos producen imágenes de banco de imágenes genéricas. Si es tu primera vez escribiendo uno, cómo crear imágenes con IA cubre lo mismo desde cero.
| Parte | Qué decir | Efecto si la omites |
|---|---|---|
| Sujeto | La cosa concreta, con el detalle que importa | Obtienes la versión más genérica del sustantivo |
| Acción o estado | Qué está haciendo, o cómo está colocado | Estático, posado, sin vida |
| Escenario | Dónde, y cuánto se ve de ello | Un fondo por defecto vacío o abarrotado |
| Iluminación | Dirección, calidad, hora del día | Plana, uniforme, sin carácter |
| Composición | Ángulo, distancia, dónde se sitúa el sujeto en el encuadre | Plano medio centrado siempre |
| Medio o lente | Fotografía y distancia focal, o estilo de ilustración | Tiende al arte digital brillante |
| Color y atmósfera | Paleta y sensación | Sobresaturado, alto contraste |
Un ejemplo trabajado. Débil: una persona trabajando en una oficina. Fuerte: Una mujer de unos cincuenta años revisando planos impresos en un escritorio de pie, luz de última hora de la tarde entrando por una ventana a su izquierda, tomada ligeramente desde detrás de su hombro a la altura de los ojos, 50mm, verdes apagados y neutros cálidos, tranquila y sin prisa. Negativo: sonrisa de foto de banco de imágenes mirando a cámara, escritorio desordenado, logotipos de marca visibles, texto.
La lista negativa importa más de lo que la gente espera. Buena parte de lo que hace que una imagen generada se note como tal es un pequeño conjunto de artefactos recurrentes, y nombrarlos los elimina: sonrisa de foto de banco de imágenes, sobresaturado, texto, marca de agua, dedos de más, composición corporativa simétrica.
Elegir el modelo
- Whizi Image para generar cualquier imagen. Es el generador propio de la casa y la primera fila del selector creativo.
- Nano Banana para editar una foto que ya tienes. Adjunta la imagen y describe el cambio; la pista del compositor cambia de generar a editar en cuanto se adjunta una imagen.
- Flux para arte fotorrealista nítido y cualquier cosa que tenga que convivir con fotografía real.
- Stable Diffusion, el modelo de Stability AI, como segunda opinión: premia el prompting específico y produce un aspecto distinto con las mismas palabras.
Puedes alternar entre ellos dentro del mismo chat, que es la forma más rápida de responder a la única pregunta que importa: ejecuta el mismo prompt en dos modelos y compáralos uno junto al otro. La calidad del modelo varía enormemente según el sujeto, y el ganador en retratos no suele ser el ganador en interiores o en ilustración plana.
Iterar sin dar vueltas en círculo
El fallo habitual es regenerar el mismo prompt una y otra vez esperando una tirada mejor. Parte de eso es inevitable, pero la mayoría de los intentos desperdiciados vienen de cambiar varias cosas a la vez y perder de vista qué ayudó.
- Cambia una sola variable por intento. Iluminación, o encuadre, o paleta. No las tres a la vez.
- Guarda en palabras lo que funcionó. Cuando una imagen se acerca, describe en tu siguiente prompt qué está bien en ella en vez de asumir que el modelo lo recuerda.
- Corrige la composición antes que el detalle. Acertar primero con el encuadre y la luz es mucho más eficiente que perfeccionar un sujeto que está en la parte equivocada del encuadre.
- Genera con la relación de aspecto final. Recortar un cuadrado para hacer un banner ancho tira a la basura la composición que pediste. Pide de entrada la relación que realmente necesitas.
- Guarda los prompts que funcionaron. Ocho prompts fiables de estilo propio que puedas volver a pegar valen más que cualquier imagen suelta, y reutilizarlos es lo que hace que un conjunto de recursos parezca un conjunto.
Para editar una imagen que ya tienes, súbela y describe el cambio. Esto funciona bien para ajustes de fondo, iluminación y paleta, y peor para ediciones estructurales precisas, que siguen siendo más rápidas en un editor de imágenes real.
Lo que los modelos de imagen todavía hacen mal
Texto. Las palabras renderizadas siguen siendo el punto más débil en todos los modelos. Palabras cortas a veces salen bien; un titular, un logotipo o una etiqueta normalmente no. Genera la imagen limpia y añade el texto en tu herramienta de diseño.
Manos, cantidades y pequeños detalles repetidos. Dedos, dientes, patas de silla y ventanas de un edificio son lugares donde los modelos pierden la cuenta. Haz zoom antes de usar cualquier cosa.
Instrucciones espaciales precisas. "Exactamente tres objetos, el rojo a la izquierda" es poco fiable. Compón en tu editor si la disposición realmente importa.
Consistencia entre imágenes. Conseguir que el mismo personaje o producto salga idéntico en una serie es difícil. Descripciones detalladas y repetidas ayudan; los resultados idénticos no están garantizados.
Sobre el uso: revisa tus derechos antes de que algo generado entre en una colocación de pago, y ten especial cuidado con cualquier cosa que se parezca a una persona real, un lugar reconocible o un estilo distintivo asociado a un artista vivo. Los términos de cada proveedor difieren, y la exposición comercial recae en quien publica la imagen.
- Pide a un modelo de texto que escriba el prompt de imagen a partir de tu idea general
- Incluye las siete partes: sujeto, acción, escenario, iluminación, composición, medio, atmósfera
- Añade una lista negativa nombrando los artefactos que nunca quieres
- Genera con la relación de aspecto que realmente vas a usar
- Cambia una sola variable por iteración
- Ejecuta el mismo prompt en dos modelos y compara
- Añade el texto en tu herramienta de diseño, no en el modelo de imagen
- Guarda los prompts que funcionaron como plantillas reutilizables
Preguntas frecuentes
¿Cuántas imágenes puedo generar al mes?
Pro incluye 100 generaciones de imagen por periodo mensual y Powerhouse incluye 500. Las cuentas Free y Starter tienen una asignación de imágenes de cero, así que Pro es el plan más bajo con generación de imágenes. En un ciclo de facturación semanal, la asignación es la cifra mensual dividida entre cuatro, redondeada hacia arriba. Como la iteración es donde se gastan las generaciones, escribir primero un prompt estructurado (idealmente con un modelo de texto) reduce notablemente cuántos intentos necesita una imagen utilizable.
¿Puedo editar una imagen existente?
Sí. En el modo Imagen y Video, adjunta la foto y describe el cambio; la pista del compositor cambia de generar a editar en cuanto se adjunta una imagen, y Nano Banana es el modelo pensado para editar fotos. Esto funciona bien para ajustes de fondo, iluminación, paleta y estilo. Funciona peor para ediciones estructurales precisas, como mover un objeto una distancia concreta o cambiar texto, que siguen siendo más rápidas en un editor de imágenes normal.
¿Qué modelo de imagen debería usar?
Whizi Image para generar cualquier imagen, Nano Banana para editar una foto que adjuntas, Flux para arte fotorrealista nítido que convive con fotografía real, y Stable Diffusion para un aspecto distinto con el mismo prompt. Como la calidad del modelo varía mucho según el sujeto, la forma más rápida de decidir es ejecutar el mismo prompt en dos de ellos en el mismo chat y comparar los resultados.
¿Por qué el texto de mi imagen sale mal?
El texto renderizado sigue siendo el punto más débil en todos los modelos de imagen, y ningún prompt lo arregla de forma fiable. Palabras cortas sueltas a veces funcionan; titulares, logotipos y etiquetas normalmente no. Genera la imagen sin texto y añade la tipografía en tu herramienta de diseño, que además te da la fuente correcta y control real sobre la colocación.
¿Necesito una suscripción de imagen aparte además de Whizi?
Para la mayoría del trabajo de campañas, contenido y conceptos, no. La generación de imágenes está incluida en Pro (100 al mes) y Powerhouse (500), lo que cubre lo mismo que cubriría una suscripción independiente para producción típica de marketing y redes sociales. Una herramienta dedicada sigue teniendo sentido para equipos con requisitos estilísticos muy específicos o una biblioteca de prompts ya existente que no quieren rehacer.