Generar imágenes a partir de unas pocas palabras ya es posible, pero obtener un buen resultado exige algo más que pedir una idea general. En ChatGPT y Gemini, la clave está en describir con precisión qué se quiere ver, cómo debe verse y qué debe quedar fuera.

La diferencia entre una imagen útil y una frustrante suele estar en la forma de redactar el prompt. No hace falta escribir un texto larguísimo, pero sí dar instrucciones claras, estructuradas y con el nivel de detalle justo para que la IA no improvise de más.

Cómo afinar un prompt en ChatGPT

Para crear una imagen en ChatGPT, basta con ir a Añadir archivos y más y luego a Crear una imagen. Con una descripción breve puede ser suficiente, aunque el resultado mejora cuando se define el objetivo, el sujeto principal, el contexto, el estilo, la iluminación, el punto de vista, el fondo, la composición, lo que no se quiere ver y la relación de aspecto.

Entre los consejos que mejor funcionan están especificar si se busca fotografía, dibujo, acuarela, anime, pixelado o estilo vectorial; indicar si la imagen debe ser vertical u horizontal; y dejar claro si no deben aparecer textos, logotipos, marcas de agua, personas u objetos.

Siete claves para mejorar imágenes con ChatGPT y Gemini

Qué recomienda Gemini para generar mejores imágenes

En Gemini, la ruta para crear una imagen pasa por el símbolo + junto a Pregunta a Gemini y luego por Crear imagen. El modelo resume su enfoque en cinco elementos: sujeto, acción, entorno, luz y cámara, y estilo visual.

Además, sugiere describir en positivo, poner los textos entre comillas, usar lenguaje fotográfico para explicar la composición, generar una base cuando el objetivo sea complejo y apoyarse en imágenes de referencia para reducir la cantidad de detalles que hay que escribir.

Corregir, repetir y ajustar hasta lograr el resultado

Una de las ventajas de estas herramientas es que permiten editar una imagen ya generada. Si el sujeto quedó mal colocado, el fondo no encaja o la proporción no sirve, se puede rehacer la imagen con cambios concretos.

Siete claves para mejorar imágenes con ChatGPT y Gemini

La práctica también pesa. Rara vez una imagen sale bien a la primera, sobre todo cuando el resultado está muy claro en la mente de quien la pide. Por eso conviene probar, ajustar y volver a pedir la imagen hasta acercarse al resultado esperado.

Dos ejemplos de prompts detallados

La nota propone dos modelos de prompt como base. El primero pide una fotografía hiperrealista de un ordenador portátil plateado sobre un escritorio de madera clara en una oficina moderna, con luz natural lateral, fondo desenfocado, vista ligeramente elevada, estilo editorial de tecnología, colores neutros, sin logotipos visibles y relación de aspecto 16:9.

El segundo plantea un primer plano cinematográfico de una mujer detective de unos 40 años, con gabardina de sarga y expresión concentrada, bajo la lluvia nocturna de una calle de neón de Tokio, con iluminación dramática y lateral, reflejos azules y rojos sobre el asfalto mojado, y acabado fotorrealista con grano de película de 35 mm.

Más consejos de Gemini para crear imágenes con ChatGPT y Gemini están recogidos en la guía de Gemini sobre prompts.