Cómo hacer fotos con IA: guía para crear mejores prompts

Crear fotos con inteligencia artificial es sencillo, pero conseguir imágenes realistas requiere saber describir el sujeto, el escenario, la iluminación y el encuadre. Esta guía explica cómo escribir prompts claros, evitar errores frecuentes y mejorar cada resultado.

Cómo hacer fotos con IA: guía para crear mejores prompts
FOTO: ilustrativa generada con IA a modo informativo.
20/07/2026 NEVIRAX INTELIGENCIA ARTIFICIAL

¿Cómo hacer fotos con inteligencia artificial?

Crear fotos con IA consiste en describir mediante texto la imagen que queremos obtener. La herramienta interpreta esas instrucciones y genera una escena nueva con personas, animales, productos, paisajes o situaciones imaginarias.

No es necesario saber dibujar ni utilizar programas profesionales. Sin embargo, escribir solamente una frase como “un perro en una playa” deja demasiadas decisiones en manos de la inteligencia artificial.

La herramienta tendrá que decidir por su cuenta cómo es el perro, en qué momento del día ocurre la escena, qué tipo de playa aparece, desde dónde se toma la fotografía y qué estilo visual debe utilizar.

Para tener mayor control sobre el resultado es necesario aprender a escribir buenos prompts.

¿Qué es un prompt?

Los prompts son las instrucciones escritas que recibe una herramienta de inteligencia artificial para crear una imagen.

Un prompt puede ser muy sencillo:

Cómo hacer fotos con IA: guía para crear mejores prompts
FOTO: ilustrativa generada con IA a modo informativo.

“Una computadora sobre un escritorio”.

Pero también puede incluir información mucho más precisa:

“Computadora moderna sobre un escritorio de madera dentro de una oficina, luz natural entrando por una ventana, fotografía editorial realista, cámara a la altura del escritorio, fondo ligeramente desenfocado y formato horizontal 16:9”.

En el segundo ejemplo, la herramienta sabe cuál es el objeto principal, dónde se encuentra, cómo debe estar iluminado y qué tipo de imagen tiene que producir.

Un prompt detallado no garantiza que la primera generación sea perfecta, pero reduce las posibilidades de obtener una escena completamente diferente de la imaginada.

La estructura básica de un buen prompt

Una forma sencilla de ordenar un prompt es utilizar esta estructura:

Sujeto principal + acción + escenario + detalles + iluminación + encuadre + estilo visual + formato.

Por ejemplo:

“Gato negro sentado frente a una ventana durante una tarde lluviosa, gotas sobre el vidrio, luz cálida dentro de la habitación, fotografía realista, plano medio, fondo desenfocado y formato horizontal”.

No es obligatorio incluir todos los elementos en cada generación. Una imagen sencilla puede funcionar con una descripción corta, mientras que una escena compleja necesitará instrucciones adicionales.

Lo importante es que la información no sea contradictoria y que la herramienta pueda identificar con facilidad cuál es el elemento principal.

Definir claramente el sujeto principal

El sujeto es la persona, animal, producto u objeto más importante de la imagen.

En lugar de escribir:

“Un automóvil”.

Se puede especificar:

“Automóvil deportivo azul oscuro, carrocería moderna, estacionado sobre una calle mojada durante la noche”.

Cuando aparece una persona, también pueden describirse características generales como la edad aproximada, la ropa, la expresión y la posición.

Por ejemplo:

“Mujer adulta con chaqueta negra, expresión concentrada, mirando la pantalla de un smartphone”.

No es necesario agregar detalles que no afectan la imagen. La descripción debe concentrarse en las características que realmente queremos controlar.

Indicar qué está haciendo el sujeto

La acción ayuda a que la escena tenga sentido.

Una persona puede estar caminando, trabajando, cocinando, hablando, conduciendo o utilizando un dispositivo. Un animal puede estar corriendo, durmiendo, jugando o mirando hacia la cámara.

En lugar de escribir:

“Una persona en una oficina”.

Se puede utilizar:

“Una persona analizando gráficos en una computadora dentro de una oficina moderna”.

Las acciones deben ser claras. Pedir que una misma persona realice demasiadas cosas simultáneamente puede generar posiciones extrañas, brazos adicionales u objetos mezclados.

Describir el escenario

El escenario indica dónde ocurre la imagen. Puede ser una vivienda, una ciudad, una playa, un bosque, una oficina, un taller, un centro de datos o un lugar completamente imaginario.

También pueden incorporarse elementos ambientales:

- Lluvia.
- Niebla.
- Nieve.
- Humo.
- Vegetación.
- Pantallas.
- Vehículos.
- Reflejos.
- Personas en segundo plano.
- Objetos sobre una mesa.

Por ejemplo:

“Robot humanoide caminando por una ciudad futurista durante la noche, edificios altos, calles mojadas, neblina suave y luces reflejadas sobre el pavimento”.

Un buen escenario ayuda a que las imágenes con IA cuenten una historia y no parezcan objetos colocados sobre fondos genéricos.

Elegir correctamente la iluminación

La iluminación puede cambiar por completo la apariencia de una imagen. Una misma escena puede parecer tranquila, dramática, misteriosa o tecnológica dependiendo del tipo de luz.

Algunas indicaciones útiles son:

- Luz natural.
- Luz cálida.
- Luz fría.
- Iluminación suave.
- Iluminación cinematográfica.
- Amanecer.
- Atardecer.
- Contraluz.
- Día nublado.
- Luces de neón.
- Iluminación de estudio.
- Sombras dramáticas.

En lugar de pedir solamente “buena iluminación”, conviene explicar de dónde proviene la luz y qué apariencia debería tener.

Por ejemplo:

“Retrato fotográfico con luz natural suave proveniente de una ventana, sombras realistas y fondo neutro”.

La iluminación también debe coincidir con el escenario. Pedir una noche completamente oscura y, al mismo tiempo, una habitación iluminada por el sol puede confundir a la herramienta.

Seleccionar el encuadre

El encuadre determina cuánto se muestra del sujeto y del escenario.

Los más utilizados son:

- Primer plano: destaca el rostro o un detalle.
- Plano medio: muestra aproximadamente desde la cintura.
- Plano general: incluye al sujeto y gran parte del ambiente.
- Vista aérea: observa la escena desde arriba.
- Ángulo bajo: coloca la cámara por debajo del sujeto.
- Cámara a la altura de los ojos: produce un resultado natural.
- Composición centrada: ubica el sujeto en el centro.
- Regla de los tercios: coloca el sujeto hacia uno de los lados.

Este elemento es especialmente importante cuando la imagen será utilizada como portada de una noticia.

Por ejemplo:

“Smartphone ubicado en el lado derecho, fondo tecnológico desenfocado y espacio libre en el lado izquierdo para colocar un título”.

Dejar espacio libre permite agregar posteriormente texto, títulos o botones sin cubrir el elemento principal.

Cómo pedir una fotografía realista

Para obtener una apariencia cercana a una fotografía pueden utilizarse términos como:

- Fotografía realista.
- Texturas naturales.
- Proporciones humanas correctas.
- Iluminación coherente.
- Colores naturales.
- Sombras suaves.
- Reflejos realistas.
- Detalle fotográfico.
- Profundidad de campo.
- Fondo ligeramente desenfocado.

Un ejemplo sería:

“Hombre reparando un smartphone bajo un microscopio en un taller de electrónica, pequeñas herramientas sobre la mesa, iluminación de trabajo realista, texturas naturales, plano cercano y fondo ligeramente desenfocado”.

Escribir “ultrarrealista” o “máxima calidad” puede ayudar, pero estas palabras no reemplazan una descripción clara del contenido.

La IA generativa suele responder mejor cuando recibe información concreta sobre el sujeto, la iluminación y la composición.

¿Sirve indicar una cámara o un lente?

Agregar referencias fotográficas puede ayudar a definir la apariencia de la imagen, aunque no es obligatorio.

Algunos términos habituales son:

- Lente de 35 mm para escenas amplias.
- Lente de 50 mm para una perspectiva natural.
- Lente de 85 mm para retratos.
- Lente macro para objetos pequeños.
- Profundidad de campo para desenfocar el fondo.
- Fotografía de producto para objetos comerciales.
- Fotografía editorial para noticias y publicaciones.

Por ejemplo:

“Computadora gamer sobre un escritorio moderno, fotografía editorial, lente de 35 mm, perspectiva natural, profundidad de campo suave e iluminación ambiental”.

No conviene agregar una lista extensa de cámaras, lentes y configuraciones sin conocer su función. Demasiadas indicaciones técnicas pueden producir instrucciones contradictorias.

Elegir un estilo visual

Las herramientas de inteligencia artificial pueden crear muchos tipos de imágenes además de fotografías.

Algunos estilos posibles son:

- Fotografía editorial.
- Fotografía documental.
- Ilustración digital.
- Anime.
- Cómic.
- Pintura al óleo.
- Acuarela.
- Pixel art.
- Arte conceptual.
- Ciencia ficción.
- Diseño minimalista.
- Renderizado tridimensional.

Lo recomendable es elegir un estilo principal y mantenerlo durante toda la descripción.

Mezclar fotografía realista, anime, acuarela y pixel art en el mismo prompt puede generar una imagen desordenada o difícil de interpretar.

También es preferible describir las características visuales buscadas en lugar de depender únicamente del nombre de un artista, una película o una franquicia.

Indicar el formato antes de generar

El formato depende del lugar donde será publicada la imagen.

Los más utilizados son:

- Horizontal 16:9 para noticias, videos y presentaciones.
- Cuadrado 1:1 para publicaciones de redes sociales.
- Vertical 4:5 para ocupar más espacio en el feed.
- Vertical 9:16 para historias y videos cortos.

Para la portada de una noticia normalmente conviene utilizar una imagen horizontal 16:9.

Indicar la proporción desde el comienzo evita que posteriormente sea necesario recortar una parte importante del sujeto o del escenario.

Explicar lo que no debe aparecer

También es posible indicar elementos que deben evitarse.

Por ejemplo:

“Sin logos, sin marcas comerciales, sin texto legible, sin marcas de agua y sin objetos duplicados”.

Estas indicaciones son útiles para crear portadas editoriales, fotografías de productos genéricos o imágenes destinadas a publicaciones comerciales.

Sin embargo, escribir una lista demasiado larga de prohibiciones puede complicar el prompt. Conviene incluir solamente las restricciones necesarias.

Cómo mejorar una imagen que salió mal

Cuando el primer resultado no es correcto, no hace falta cambiar todo el prompt. Lo mejor es observar el problema y modificar únicamente esa parte.

Si el rostro parece artificial:

“Rostro natural, expresión sutil, textura de piel realista y proporciones humanas correctas”.

Si el fondo está demasiado cargado:

“Fondo simple, pocos elementos y composición limpia”.

Si la imagen es demasiado oscura:

“Escena correctamente iluminada, detalles visibles y sombras suaves”.

Si el sujeto aparece muy lejos:

“Plano medio, sujeto ocupando gran parte de la imagen”.

Si aparecen objetos innecesarios:

“Escena ordenada, sin elementos adicionales y fondo despejado”.

Este proceso de generar, revisar y corregir permite aprender cómo interpreta las instrucciones cada herramienta.

Los errores más comunes al escribir prompts

Uno de los errores más frecuentes es escribir una descripción demasiado corta y esperar un resultado muy específico.

Otro problema es solicitar demasiados elementos al mismo tiempo. Varias personas, animales, vehículos, edificios, carteles y acciones pueden aumentar las deformaciones.

También es común repetir palabras como “profesional”, “increíble”, “perfecto” y “alta calidad” sin describir realmente la escena.

Los adjetivos generales aportan menos información que una indicación concreta sobre la iluminación, el escenario o el encuadre.

Otro error consiste en pedir textos largos dentro de la imagen. Aunque las herramientas mejoraron, todavía pueden escribir palabras incorrectas, mezclar letras o inventar símbolos.

Para publicaciones importantes, suele ser más seguro generar la imagen sin palabras y agregar el texto posteriormente mediante un editor.

Qué revisar antes de publicar

Antes de utilizar una imagen generada es importante observarla ampliada y controlar:

- Manos y cantidad de dedos.
- Ojos y expresiones.
- Dientes y orejas.
- Brazos y piernas.
- Objetos duplicados.
- Sombras y reflejos.
- Texto deformado.
- Logos inventados.
- Bordes cortados.
- Elementos mezclados.
- Calidad del fondo.
- Relación entre el sujeto y el escenario.

Las herramientas actuales producen resultados cada vez mejores, pero todavía pueden crear detalles imposibles o poco naturales.

Una imagen puede parecer correcta a primera vista y contener errores visibles cuando se observa con atención.

Ejemplo de prompt para una portada tecnológica

“Smartphone moderno sobre un escritorio dentro de una oficina, sistema de inteligencia artificial representado mediante paneles visuales abstractos alrededor del dispositivo, iluminación natural combinada con luz azul suave, fotografía editorial tecnológica, composición limpia, cámara a la altura del teléfono, fondo desenfocado, sin logos, sin marcas, sin texto legible y formato horizontal 16:9”.

Este prompt define el sujeto, el ambiente, la iluminación, el estilo, el encuadre, las restricciones y la proporción final.

Ejemplo de prompt para una fotografía de producto

“Auriculares inalámbricos sobre una superficie oscura, fotografía de producto profesional, iluminación de estudio suave, reflejos controlados, composición minimalista, fondo limpio, detalles nítidos, colores naturales, sin logos, sin texto y formato cuadrado”.

En las fotografías de productos conviene utilizar fondos simples y evitar objetos que puedan distraer la atención.

Ejemplo de prompt para una escena cotidiana

“Familia preparando una comida en una cocina moderna durante la tarde, gestos naturales, luz cálida entrando por una ventana, objetos cotidianos sobre la mesa, fotografía documental realista, plano general, colores naturales y formato horizontal”.

Esta descripción se concentra en la acción, el ambiente, la luz y la composición sin agregar indicaciones innecesarias.

Plantilla para crear cualquier prompt

Esta plantilla puede utilizarse como punto de partida:

“[Sujeto principal] realizando [acción] en [escenario], con [detalles importantes], iluminación [tipo de luz], estilo [tipo de fotografía o ilustración], encuadre [tipo de plano], fondo [descripción], colores [apariencia], sin [elementos que deben evitarse] y formato [proporción]”.

Un ejemplo completo sería:

“Periodista trabajando en una computadora dentro de una redacción moderna, varias pantallas con gráficos abstractos, iluminación natural y ambiente profesional, fotografía editorial realista, plano medio, fondo ligeramente desenfocado, colores naturales, sin logos, sin marcas, sin texto legible y formato horizontal 16:9”.

¿Es mejor escribir el prompt en español o en inglés?

Las herramientas modernas suelen comprender correctamente ambos idiomas. En muchos casos se pueden obtener buenos resultados escribiendo en español.

Algunas plataformas fueron entrenadas con grandes cantidades de descripciones en inglés y pueden interpretar mejor determinados términos fotográficos en ese idioma. Sin embargo, esto depende del generador utilizado.

La mejor opción es comenzar en el idioma que permita explicar mejor la idea. Si una palabra o un estilo no se interpreta correctamente, se puede probar solamente esa parte en inglés sin traducir todo el prompt.

¿Cuánto debe medir un buen prompt?

Un prompt largo no siempre produce una imagen mejor.

Una escena sencilla puede explicarse en una o dos oraciones. Una portada editorial compleja puede necesitar una descripción más extensa.

Lo importante es que el texto sea ordenado, concreto y coherente.

La mejor práctica consiste en comenzar con el sujeto, la acción y el escenario. Después se pueden agregar la iluminación, el encuadre, el estilo y las restricciones.

De esta manera resulta más fácil descubrir qué instrucción está mejorando o empeorando el resultado.

La inteligencia artificial no reemplaza la decisión humana

Crear imágenes con IA no consiste solamente en escribir una frase y aceptar el primer resultado.

El usuario todavía debe pensar la idea, organizar la descripción, elegir la mejor generación, detectar errores y adaptar la imagen al lugar donde será publicada.

La inteligencia artificial acelera el trabajo creativo y permite producir escenas que antes requerían cámaras, modelos, ilustradores o programas profesionales.

Sin embargo, la calidad final sigue dependiendo de la capacidad humana para describir, observar, seleccionar y corregir.

Aprender a escribir prompts claros permite aprovechar mejor estas herramientas y obtener fotografías más realistas, ordenadas y útiles para noticias, redes sociales, proyectos personales o trabajos comerciales.

Sumate a la conversación e iniciá sesión para comentar.

Cargando comentarios...