Un prompt de tres palabras y un prompt de trescientas palabras usan el mismo modelo. La diferencia en el resultado no es la herramienta. Es cuánta dirección le das.
Esa es la lección que casi nadie interioriza. Pedimos “una imagen bonita” y luego culpamos a la IA cuando sale algo plano. Pero la IA no adivina tu intención: rellena los huecos que tú dejas en blanco. Y los rellena con lo más probable, que casi siempre es lo más aburrido.
Hoy vamos a diseccionar un prompt enorme —uno de verdad, de más de 500 palabras, para generar el retrato de una supermodelo al estilo campaña italiana de los 90— y a sacar de él una fórmula que puedes reutilizar para cualquier imagen: un producto, una portada, una infografía o el avatar de tu marca.
🎯 Densidad de dirección
Empecemos por un dato incómodo para quien busca la “palabra mágica”.
Cuando escribes un prompt corto en ChatGPT, el sistema no manda tus palabras tal cual al modelo. Las reescribe y las expande en una descripción mucho más larga y detallada antes de generar la imagen. Lo cuenta la propia documentación de OpenAI: DALL·E 3 “reescribe automáticamente el prompt” por razones de seguridad y de detalle (OpenAI Cookbook).
Traducido: la IA ya sabe que los prompts detallados funcionan mejor. Por eso los rellena por ti… a su gusto.
La pregunta es simple. ¿Prefieres que ese detalle lo decidas tú, o que lo decida un relleno automático que no conoce tu marca ni tu intención?
Un prompt largo no es presumir. Es recuperar el control de las decisiones.
🧠 Las 12 capas escondidas en un prompt profesional
Coge el prompt de la modelo de los 90 y léelo despacio. Parece un párrafo caótico. No lo es. Es una checklist disfrazada de texto. Estas son las capas que contiene, en orden:
Sujeto e identidad: “modelo de alta costura, estilo campaña de lujo italiana de mediados de los 90”. Quién aparece y con qué “época” o carácter.
Tipo de imagen y medio: “retrato de estudio ultrarrealista, cámara profesional full-frame”. ¿Foto? ¿Ilustración? ¿Render 3D?
Encuadre y composición: “plano de tres cuartos, desde medio muslo hacia arriba”. Dónde corta la imagen.
Pose y expresión: “cuerpo ligeramente girado, una mano en la cadera, mentón levantado, mirada segura”.
Detalle físico: pelo, maquillaje y —clave— “piel con poros y textura natural, no filtro de belleza”.
Vestuario y materiales: “seda pesada, satén, cuero pulido, con arrugas y tensiones realistas en la tela”.
Accesorios: “joyas escultóricas de oro con reflejos metálicos creíbles”.
Fondo: “fondo de estudio liso, tono joya, sin objetos que distraigan”.
Iluminación: “luz principal a 35–45 grados, relleno cálido suave, luz de contorno para separar del fondo”.
Color y revelado: “tonos joya saturados, negros profundos, grano de película, sin el típico teal-naranja digital moderno”.
Óptica y cámara: “look de objetivo 85 mm, f/2.8, enfoque nítido en los ojos y desenfoque progresivo hacia abajo”.
Negativos: “evitar: piel de plástico, manos deformes, dedos de más, logotipos, texto, marca de agua…”.
Doce decisiones. Ninguna es opcional si quieres un resultado de campaña. Y aquí está el truco: no necesitas memorizar estas doce capas para la moda. Necesitas entender que cualquier imagen buena responde a la misma estructura. Cambia el contenido, no el esqueleto.
🧪 Las dos capas que casi nadie usa (y más se notan)
Si tuviéramos que quedarnos con dos capas de esa lista, serían las que la mayoría se salta: la óptica y los negativos.
La óptica es lo que separa una foto de “parece IA” de una foto de “parece una cámara real”. Frases como “objetivo 85 mm, f/2.8, profundidad de campo poco profunda, reflejos y brillos especulares realistas” le dicen al modelo que imite la física de una lente concreta. No entiende de fotografía, pero sí ha visto millones de fotos etiquetadas con esos términos.
Los negativos son la otra mitad. Le dices a la IA qué no quieres. En el prompt de la modelo, esta línea hace un trabajo enorme:
Evita: dibujo, ilustración, render 3D, piel de plástico o cerosa, suavizado excesivo, anatomía distorsionada, dedos de más, manos deformes, joyas duplicadas, logotipos, texto, marca de agua, fondo de pasarela.
Cada palabra de ahí es un error típico que estás bloqueando por adelantado.
🔗 La fórmula que puedes copiar hoy (para lo que sea)
Aquí está lo útil: la misma estructura de las 12 capas, convertida en una plantilla rellenable. Copia esto y sustituye los corchetes por lo tuyo.
[TIPO DE IMAGEN: foto realista / ilustración / render 3D] de [SUJETO PRINCIPAL], en estilo [ESTÉTICA O ÉPOCA]. Composición: [ENCUADRE], [POSE O DISPOSICIÓN]. Detalle: [TEXTURAS Y MATERIALES con acabado realista]. Entorno: [FONDO], [ambiente]. Luz: [DIRECCIÓN Y TIPO DE LUZ], sombras y reflejos creíbles. Cámara: [ÓPTICA: 50 mm / 85 mm], [apertura], enfoque nítido en [ZONA CLAVE]. Color: [PALETA Y REVELADO]. Evita: [LISTA DE ERRORES QUE NO QUIERES].
Y así se ve aplicada a algo que sí necesitas un lunes cualquiera —una foto de producto para tu tienda o tu newsletter—:
Foto de producto realista de un tarro de miel artesanal sobre una mesa de madera clara, estilo editorial gastronómico limpio. Composición: plano cenital ligeramente inclinado, el tarro descentrado a la izquierda. Detalle: cristal con reflejos reales, etiqueta de papel con textura, miel densa y translúcida. Entorno: fondo neutro cálido, con un panal desenfocado detrás. Luz: luz lateral natural de ventana a la izquierda, sombras suaves. Cámara: look de objetivo 50 mm, f/4, enfoque nítido en la etiqueta. Color: tonos cálidos y dorados, contraste suave, aspecto de fotografía profesional. Evita: texto inventado en la etiqueta, reflejos artificiales, plástico brillante, marca de agua.
Mismo esqueleto. Otro mundo. Y funciona igual en ChatGPT, Gemini, Midjourney o el generador que uses, porque no depende de “palabras secretas” de una herramienta, sino de darle a cualquier modelo las decisiones que necesita tomar.
🚀 Cómo replicarlo hoy
Elige tu sujeto en una frase clara. Qué es y para qué lo quieres.
Define el tipo de imagen desde el principio: foto, ilustración o 3D. No lo dejes en blanco.
Añade encuadre y pose: cómo se recorta y cómo se coloca el sujeto.
Describe materiales y texturas con la palabra “realista”: tela, cristal, metal, piel.
Dirige la luz y la cámara: dirección de la luz + una óptica concreta (50 mm o 85 mm). Ahí está el 80% del “parece profesional”.
Cierra con negativos: lista los errores típicos que no quieres ver.
Itera una vez: genera, mira qué falla y corrige solo esa capa. No reescribas todo.
No necesitas ser director de fotografía de Vogue. Necesitas rellenar las decisiones que la IA, si no, rellenará por ti.
Preguntas frecuentes
¿Un prompt más largo siempre da mejor resultado?
No siempre. Más largo no es mejor; más específico sí. Si añades relleno vacío, estorbas. Si añades decisiones (luz, óptica, negativos), mejoras.
¿Sustituye esto a saber de fotografía o diseño?
No. Cambia la forma en que trabajas: no necesitas la cámara, pero sí saber qué pedir. Cuanto más entiendes de encuadre y luz, mejores prompts escribes.
¿Funciona para mi caso si vendo servicios, no productos físicos?
Sí. La misma plantilla sirve para una portada de post, una imagen conceptual para LinkedIn o un banner. Cambia el sujeto y el fondo; el esqueleto no se toca.
¿Qué herramientas hacen algo parecido?
ChatGPT con DALL·E 3, Google Gemini, Midjourney, Adobe Firefly o Leonardo. La fórmula por capas funciona en todas; cada una tiene sus matices, pero el principio es idéntico. Ojo, que no todas admiten prompts tan largos.
¿Y los negativos funcionan en cualquier herramienta?
En la mayoría, aunque unas los respetan mejor que otras. Aunque tu herramienta no tenga un campo específico, escribirlos dentro del prompt (”evita…”) ya ayuda.
Antes de que te vayas
Aquí va la pregunta para los comentarios: ¿cuál es el error que más te sale al generar imágenes con IA —manos raras, texto inventado, aspecto “de plástico”—? Cuéntanoslo y te devolvemos la línea de negativos exacta para eliminarlo.
Aprender a dirigir imágenes es exactamente el tipo de habilidad práctica que trabajamos en la formación de Paratodosia: no trucos sueltos, sino un método que funciona con la herramienta que ya usas. Si quieres profundizar, es de lo que hablamos cada semana.
Y si este post te ha sido útil, compártelo con alguien que lo necesite. Alguien que siga escribiendo “una imagen bonita, por favor” y no entienda por qué le sale regular.
Encuesta rápida — ¿Qué te gustaría que cubramos la próxima semana?
🎨 Prompts de imagen avanzados (marca coherente, mismo personaje en varias escenas)
📊 Convertir datos en gráficos e infografías con IA
🎬 Dar el salto al vídeo con IA




Mejorar Infografías