Prompts para Imágenes IA: La Fórmula que Funciona a la Mesa
Resumen
La clave para prompts para imágenes IA efectivos no es escribir como notas de trasfondo, sino traducir la lore en anclas visuales memorables. Usa la fórmula de cinco bloques (rol, anclajes visuales, equipo, expresión, formato) para generar retratos que tus jugadores reconozcan sesiones después. La consistencia visual en campaña larga requiere un Códice de prompts y un registro estilístico único.
Los prompts para imagenes IA bien estructurados son la diferencia entre un personaje memorable y uno que tus jugadores olvidan en la siguiente sesión. Tres sesiones adentro de un nuevo arco, esperaba revelar el líder de la facción visualmente. El retrato tras cuarenta minutos de generación lucía como cualquier villano encapuchado genérico: impreciso, olvidable, nada del personaje que había construido. La solución no era una herramienta mejor, sino aprender a estructurar los prompts correctamente. Aquí está la fórmula que funciona: produce retratos, ubicaciones e imágenes que mantienen identidad visual a lo largo de cincuenta sesiones.
Qué la Mayoría de los Prompts Hacen Mal a la Mesa
El instinto por defecto, para un MJ que ha pasado años escribiendo trasfondo, es escribir prompts como entradas de lore. Escribes el historial del personaje, motivaciones, la herida secreta de la infancia, la posición filosófica. Nada de eso aparece en la imagen. Lo que aparece es lo que un pintor vería desde el otro lado de la sala: la cicatriz en la mejilla izquierda, la postura estrecha, los tres cuchillos visibles en el cinturón.
El enfoque de "lista de compras" tiene el mismo problema desde la otra dirección. Prompt tras prompt en foros de campañas se ve así: "elf rogue dark hood dagger 8k ultra detailed masterpiece." La herramienta genera algo. Rara vez genera un personaje que reconocerías tres sesiones después. Cadenas de calidad como "masterpiece" y "ultra detailed" queman fichas que podrían describir algo que un jugador realmente recordaría.
El problema fundamental es que la mayoría de los constructores de mundos escriben lo que saben de un personaje, y los generadores de imágenes IA renderizan lo que es visible. Cuanto antes aprendas a traducir lore en anclajes visuales, más rápido obtendrá identidad visual coherente la campaña.
Una Fórmula de Cinco Bloques para Retratos de Personajes que Aguanten a la Mesa
Después de probar esto durante seis meses de preparación de campaña, incluyendo una campaña casera de Pathfinder 2e con más de treinta PNJs que necesitaban ser distinguibles a la mesa, los resultados más consistentes vienen de cinco bloques ordenados. El orden importa porque los pesos de atención del modelo enfatizan información al principio más pesadamente.
Bloque 1: Rol y ascendencia. Un sustantivo compuesto. "Cartógrafo mediano," "ingeniero de asedio enano," "erudita cortesana tiefling." No un nombre, no un trasfondo, solo el arquetipo y la ascendencia.
Bloque 2: Anclajes visuales permanentes. Dos o tres detalles específicos y visibles que sobrevivirían a una descripción de personaje escrita de memoria después de que termine la sesión. "Colmillo delantero roto," "arete plateado de luna creciente," "cicatriz de quemadura en el antebrazo derecho." Estos son los detalles que hacen que el personaje sea reconocible en múltiples generaciones del mismo prompt. Si un detalle no es visible en la imagen, sácalo del prompt.
Bloque 3: Equipo y silueta. Qué están usando o llevando, descrito con la precisión suficiente para leer en un retrato. "Delantal de cuero pesado sobre cota de malla" se lee diferente de "delantal de cuero." "Dos dagas estrechas sostenidas bajas" es una silueta diferente de "con dagas." La especificidad aquí no es decoración; es la única forma en que el modelo distingue un conjunto de equipo de otro.
Bloque 4: Expresión y postura. Una palabra para la expresión, una para la postura. "Cauteloso, peso desplazado atrás." "Divertido, barbilla inclinada." Evita estados emocionales abstractos; usa la expresión física de la emoción. El modelo no puede renderizar "conflictivo" pero puede renderizar "mandíbula tensa, ojos ligeramente desfocados."
Bloque 5: Luz y formato. Aquí es donde le dices a la herramienta qué tipo de salida realmente necesitas. "Retrato, pared de piedra iluminada por velas detrás, estilo pintura al óleo, paleta apagada." Para tokens de VTT: "retrato, fondo blanco, ilustración digital." Para una revelación de villano: "dramáticamente subiluminado, fondo oscuro, concept art." El bloque de formato también establece el registro visual para toda tu campaña si lo mantienes idéntico en todos los prompts de personajes.
La longitud total del prompt debe rondar entre cuarenta y ochenta palabras. Más allá de ochenta, comienzas a perder señal. Menos de treinta, obtienes un resultado genérico.

Prompts de Ubicación: El Detalle Que Hace Que una Escena Sea Específica
Los retratos de personajes tienen una fórmula. Los prompts de ubicación tienen una trampa diferente: genericidad. "Torre en ruinas antigua de noche" produce exactamente el tipo de imagen que has visto mil veces. Es atmosféricamente correcto y emocionalmente inerte.
La solución es especificidad de un elemento. "Torre en ruinas antigua de noche" es genérica. "Ciudadela de acantilado marino con torre este colapsada y luz de antorcha naranja sangrando de estrechas troneras" es una ubicación. La especificidad no tiene que estar en todas partes del prompt. Un detalle arquitectónico preciso, una condición atmosférica inusual, una pieza de evidencia de inhabitación previa es suficiente para empujar la escena más allá del resultado genérico.
Para MJs que dirigen campañas largas, los prompts de ubicación se benefician de un anclaje secundario: evidencia de qué sucedió allí. "Salón de baile colapsado, piano de cola semienterrado bajo escombros" ubica una ruina en una civilización. "Campo de batalla tres días después de la lucha, cuervos en la línea de árboles, máquina de asedio abandonada en el lodo" pone historia en un paisaje. Estos detalles rara vez dañan la imagen y frecuentemente la hacen sentir habitada en lugar de renderizada.
Mantén los prompts de ubicación entre cuarenta y sesenta palabras y evita listar demasiados elementos arquitectónicos. Una estructura clara, condiciones atmosféricas, un detalle narrativo.

Manteniendo la Canon Visual Consistente en una Campaña Larga
El verdadero problema en una campaña que se ejecuta sesenta u ochenta sesiones no es generar buenas imágenes. Es generar imágenes consistentes. El líder de facción que apareció en la sesión cuatro necesita lucir reconociblemente como ella en la sesión cuarenta y siete, después de que sus circunstancias han cambiado y necesitas un nuevo retrato.
La respuesta práctica es un Códice de prompts: un documento separado donde almacenas los prompts exactos que produjeron cada imagen canónica, junto con la URL de salida y qué herramienta usaste. Cuando necesites una nueva imagen del mismo personaje, tiras del bloque 2 de anclajes verbatim y actualizas solo los bloques 3 al 5. "Colmillo delantero roto, arete plateado de luna creciente" permanece igual. El equipo, la expresión y el formato cambian.
La consistencia de estilo en toda una campaña es más difícil que la consistencia de personaje. El enfoque más simple es elegir una cadena de estilo y nunca desviarse de ella. "Estilo pintura al óleo, paleta apagada, fondo ligeramente enfocado" como sufijo fijo en cada retrato de personaje crea coherencia visual más rápido que intentar igualar estilos por personaje. Un registro visual para la campaña, de la manera que una novela tiene un registro de prosa único.
Algunas herramientas manejan esto mejor que otras. La característica de referencia de personaje de Leonardo AI te permite bloquear una imagen de referencia y regenerar con nuevas poses o iluminación, lo que elimina la necesidad de repetición de prompt verbatim una vez que tienes un retrato aprobado. Para MJs con elencos grandes, este es un costo de flujo de trabajo que vale la pena.
Cuál Generador de Imágenes Maneja Realmente Qué
La respuesta honesta es que ninguna herramienta única hace todo lo que una biblioteca visual de campaña necesita.
Midjourney produce los mejores resultados para calidad de retrato terminado. Renderiza caras, tela y atmósfera a un nivel que las otras herramientas no cumplen consistentemente. La compensación es un ecosistema cerrado: trabajas dentro de su interfaz web, no puedes ejecutarlo localmente, y la consistencia de estilo en un elenco grande requiere documentación cuidadosa de prompts.
Stable Diffusion es la herramienta para MJs que quieren control sobre el proceso en lugar de conveniencia. Ejecutado localmente, maneja lotes grandes sin costo por imagen y permite ajuste fino en estilos de arte específicos o referencias de personajes. La sintaxis del prompt es diferente (los prompts negativos van en un campo separado, los pesos del modelo importan), y el costo de configuración es real. La recompensa es un pipeline visual que pertenece a la campaña en lugar de a un servicio de terceros.
Leonardo AI se sienta en el medio en calidad y flexibilidad. Su sistema de referencia de personaje es el más amigable con MJ de los tres para mantener consistencia visual en una campaña que se ejecuta largo tiempo. La calidad de imagen para escenas complejas cae por debajo de Midjourney pero por encima del promedio de salida de Stable Diffusion sin ajuste fino.
Ideogram vale la pena conocer para símbolos de facción, diseño de escudos heráldicos e ilustración cartográfica. Maneja gráficos planos estilizados más limpiamente que los modelos orientados a fotorrealismo, y la legibilidad de formas geométricas es notablemente mejor. No es un reemplazo para una herramienta de retrato, pero es un complemento útil para una.

Qué la Fragua Genera vs. Qué Aún Tienes que Escribir Tú Mismo
Hay un patrón en la preparación de campaña donde los MJs comienzan a usar prompts para imágenes IA, obtienen resultados lo suficientemente buenos, y luego comienzan a usar la generación visual como sustituto del trabajo de diseño subyacente. El retrato existe, entonces el personaje existe. El concept art de ubicación está ahí, entonces la ubicación está construida.
El problema surge a la mesa. Un jugador pregunta sobre la cicatriz en la cara del líder de facción. Sabes que está ahí; la describiste en el prompt. Pero no sabes qué significa dentro de la lore. La Fragua genera la superficie visible. El historial detrás de ella aún necesita un paso humano.
La generación de imágenes asistida por IA es más rápida y útil cuando el diseño subyacente ya es sólido. Un personaje con motivaciones claras, un rol definido en la estructura de facción, y al menos una relación con otro personaje produce un prompt más útil porque sabes cuáles tres anclajes visuales realmente importan. Un personaje en blanco que existe solo para llenar un rol en la sesión cuatro produce un retrato genérico porque aún no sabes qué los hace específicos.
Esto no es una crítica de las herramientas. Es una descripción de cómo sacar el máximo provecho de ellas. La lore gana credibilidad o no. Genera la imagen después de saber quién es el personaje. No para descubrir quién son.
Así es Como Aguanta a la Mesa
La fórmula de cinco bloques produce retratos de personajes que aguantan a lo largo de sesiones cuando los anclajes visuales se eligen deliberadamente: marcadores físicos, no rasgos de personalidad. Los prompts de ubicación con un detalle arquitectónico o narrativo específico empujan más allá del resultado genérico de stock. La consistencia de estilo a lo largo de una campaña viene de elegir un registro visual y mantener el sufijo fijo idéntico en todos los prompts de personajes.
Las imágenes que las herramientas generan son mejores que lo que la mayoría de los MJs tendrían acceso de otra manera, y son más rápidas que comisionar piezas individuales para cada PNJ con un rol hablado. La brecha que no cierran es el trabajo de diseño que hace que un personaje valga la pena generar en primer lugar. Ese sigue siendo el trabajo del MJ, y las herramientas asistidas por IA funcionan mejor una vez que está hecho.