Contenido del curso
Producto y Mockups
Personas y personajes
Estética y edición
Campaña y contenido digital
Prompts por etiquetas para generar imágenes con IA
Resumen
Los prompts por etiquetas son la forma más clara de generar imágenes con inteligencia artificial cuando quieres que el resultado coincida con lo que imaginas. Aprenderás a estructurar tus instrucciones en secciones para que el modelo no tenga que adivinar. Es ideal para diseñadores, creadores de contenido y cualquier persona que trabaje con generadores de imágenes.
Hay algo que la inteligencia artificial comparte con un buen diseñador: si no le dices exactamente lo que quieres, va a deducir. Y su interpretación de tus órdenes no siempre coincide con tu visión. Por eso conviene ser específico desde el inicio.
¿Qué es un prompt por etiquetas y por qué funciona mejor?
Un prompt por etiquetas es justo lo que su nombre indica: en lugar de escribir una descripción larga y desordenada, organizas tu instrucción en secciones. Cada sección tiene un objetivo concreto e indica al modelo a qué aspectos debe prestar atención [00:39].
¿Qué es un prompt por etiquetas? Es una forma de escribir instrucciones para IA dividiendo la descripción en secciones con un propósito específico cada una, como personaje, ambiente o iluminación. Así el modelo interpreta mejor lo que quieres.
La gran ventaja es la edición: puedes cambiar un solo elemento sin reescribir todo. Esa flexibilidad es lo que hace tan poderoso este método.
¿Cuáles son las seis etiquetas para construir un prompt?
Estas son las seis etiquetas que estructuran cualquier imagen [00:59]:
- Character: describe a tu personaje o sujeto principal. Edad, género, características físicas, ropa y expresión facial. Si no hay persona, se refiere al objeto protagonista.
- Environment: es el mundo alrededor, el escenario. Una ciudad, un estudio, un mercado, con sus texturas y elementos de fondo.
- Aesthetic: el estilo y el ambiente. Fotorrealista, ilustración, cine de los años 70 o anime. Es lo que más define el carácter de la imagen.
- Action: describe qué está pasando en la escena, cómo se relaciona el personaje con el ambiente. No es una pose estática, es un instante específico.
- Lighting: la iluminación. Día o noche, sombras marcadas o difusas, tonos cálidos o fríos. Es una de las etiquetas más poderosas.
- Camera: el encuadre. Plano abierto o cerrado, tipo de ángulo, lente, profundidad de campo y si hay movimiento.
La etiqueta lighting cambia por completo el ambiente de una imagen, y la etiqueta camera determina cómo el espectador ve la escena [02:38].
¿Cómo construir un prompt completo paso a paso?
Vamos a construirlo etiqueta por etiqueta. La imagen objetivo es una mujer corriendo libremente por una colina con un enorme ramo de rosas rojas en la mano [02:57].
El siguiente paso es describir cada elemento con mayor detalle. Para lograrlo, hazte preguntas sobre cada uno. ¿Tu personaje tiene el cabello corto o largo? ¿Qué ropa usa? ¿Cuál es su complexión, el tono de piel, el color de cabello? Aquí puedes ser lo más detallado posible.
Haz lo mismo con el ambiente: una colina de hierba corta, cielo despejado y un horizonte ligeramente inclinado. Repite este proceso para cada etiqueta.
¿Cómo describir emociones de forma visual en un prompt?
Piensa siempre de forma visual. En vez de decir "mi personaje está triste", describe la escena concreta [03:57].
¿Cómo se describe una emoción en un prompt de imagen? No nombres la emoción, muestra la postura. En lugar de "está triste", escribe "sentada con las manos en la cabeza, expresión seria, encorvada, reflejando una profunda tristeza".
Después de describir todos los elementos, tendrás un prompt completo con toda la información que el modelo necesita.
¿Qué modelos de IA puedes usar para generar la imagen?
Con el prompt listo, puedes usar el generador que prefieras o al que tengas acceso. En la clase se usaron dos [04:26]:
- GPT Images: se genera pegando el prompt tras hacer clic en "Crear una imagen".
- Nano Banana Pro: se usó el mismo prompt y el mismo flujo.
Las dos imágenes quedaron muy parecidas usando exactamente el mismo prompt [05:12]. Esto ocurre precisamente porque el prompt contenía toda la información completa y necesaria para llegar a ese resultado.
¿Por qué la primera imagen casi nunca es la definitiva?
La primera generación rara vez es la imagen final, y eso es parte del proceso [05:47]. Acostúmbrate a iterar y modificar elementos de tu prompt original.
Aquí está lo interesante del método por etiquetas: si no te gusta la iluminación, vas a lighting y la cambias. Si el lugar no es el que imaginabas, editas environment. En la clase se cambió la descripción del personaje, el color del vestido y de las flores, y el resultado se acercó mucho más a la visión inicial [06:07].
Este método no se limita a retratos ni a personas. Puedes generar ilustraciones, arquitectura, moda o contenido de marca. Lo único que cambia es lo que escribes dentro de cada etiqueta, pero la estructura siempre es la misma [06:32].
Ahora es tu turno: abre un editor de texto y crea tu propio prompt con este método. Cuando lo tengas listo, comparte en los comentarios el prompt que escribiste y la imagen que obtuviste. ¿Cuál generador crees que dio mejor resultado?