Saltar al contenido principal
EN VIVO
BTC: $64,364.67ETH: $1,875.49SOL: $74.65USD/BCV: 742.23 BsEUR/BCV: 844.22 BsBTC: $64,364.67ETH: $1,875.49SOL: $74.65USD/BCV: 742.23 BsEUR/BCV: 844.22 BsBTC: $64,364.67ETH: $1,875.49SOL: $74.65USD/BCV: 742.23 BsEUR/BCV: 844.22 BsBTC: $64,364.67ETH: $1,875.49SOL: $74.65USD/BCV: 742.23 BsEUR/BCV: 844.22 Bs
Inteligencia Artificial

15 consejos para crear imágenes con ChatGPT y Gemini que transforman tus resultados (sin ser experto)

15 consejos para crear imágenes con ChatGPT y Gemini que transforman tus resultados (sin ser experto)

La inteligencia artificial generativa ha dado un paso más allá de la simple ejecución de órdenes: ahora las propias herramientas explican cómo sacarles el mejor partido. Tanto ChatGPT como Gemini han compartido sus consejos internos para crear imágenes con ChatGPT y Gemini de alta calidad sin desperdiciar tiempo en pruebas fallidas. En Arepa Tecnológica reunimos las recomendaciones que los modelos de OpenAI y Google consideran imprescindibles para escribir prompts efectivos y obtener ilustraciones o fotografías hiperrealistas.

El truco, según ambas plataformas, no está en escribir párrafos interminables sino en estructurar la petición con los elementos justos. Mientras ChatGPT detalla una decena de prácticas, Gemini prefiere concentrarse en cinco pilares. A continuación, te contamos cómo aplicarlos.

Lo que ChatGPT te pide en un prompt para imagen

Al preguntarle directamente a ChatGPT cómo crear mejores imágenes, el modelo listó diez aspectos que mejoran el resultado. La clave está en ser preciso sin abrumar a la IA.

  • Objetivo claro: explica para qué necesitas la imagen y qué debe transmitir.
  • Sujeto principal: describe al protagonista o el objeto central con detalle.
  • Contexto: ubícalo en un entorno concreto: oficina, naturaleza, calle…
  • Estilo visual: ¿fotografía realista, dibujo animado, acuarela, vectorial?
  • Iluminación: natural, dramática, cenital, contraluz… Define la fuente y la atmósfera.
  • Punto de vista: ángulo de cámara y distancia (primer plano, picado, tres cuartos).
  • Fondo: especifica si lo quieres desenfocado, minimalista, con objetos o vacío.
  • Lo que no quieres: prohíbe logos, marcas de agua, personas extra, textos, marcas registradas.
  • Composición: deja espacio para texto o indica dónde debe ir el sujeto.
  • Relación de aspecto: 16:9 horizontal, 4:3, cuadrado 1:1 según el uso que le darás.

La fórmula de Gemini en cinco pasos

Por su parte, Gemini reduce la receta a cinco elementos que todo buen prompt debe incluir. La simplicidad no resta potencia: si los defines, la imagen gana coherencia.

  • Sujeto: quién o qué protagoniza la escena y cómo es.
  • Acción: qué está haciendo en ese momento.
  • Entorno: fondo, lugar y objetos secundarios que crean ambiente.
  • Luz y cámara: iluminación, ángulo, profundidad de campo y tipo de lente.
  • Estilo visual: realista, boceto, pixel art, anime… Define el acabado gráfico.

Además, la documentación oficial de Google Cloud añade recomendaciones prácticas que mejoran la interpretación del prompt:

  • Describe en positivo siempre que puedas, aunque a veces necesites prohibir elementos.
  • Coloca los textos que deban aparecer entre comillas para que no se distorsionen.
  • Emplea terminología fotográfica (gran angular, bokeh, claroscuro) para guiar el ojo de la IA.
  • Genera una base y luego edita la imagen paso a paso, añadiendo o quitando elementos.
  • Usa imágenes de referencia para ahorrar descripciones y copiar estilos.

Mientras Google ajusta los tiempos de su modelo con Gemini 3.5 Pro, estos lineamientos ya están disponibles para cualquier usuario que quiera mejorar sus generaciones.

El arte de iterar: prueba, corrige y vuelve a generar

Rara vez la primera imagen encaja a la perfección. Tanto ChatGPT como Gemini permiten editar sobre el resultado con instrucciones adicionales: mover al sujeto, cambiar el fondo, oscurecer la iluminación o modificar el estilo. Así puedes pulir la imagen hasta que se parezca a lo que tenías en mente.

En Arepa Tecnológica también hemos seguido de cerca la evolución de estas herramientas. Por ejemplo, OpenAI lanzó recientemente el modo de voz de ChatGPT en escritorio, mientras la competencia afina sus motores para tareas más complejas.

Dos ejemplos que condensan todo lo aprendido

Para ilustrar cómo aplicar estos consejos, aquí tienes dos prompts detallados que combinan las recomendaciones de ChatGPT y Gemini:

Ejemplo con ChatGPT:
«Genera una fotografía hiperrealista de un ordenador portátil plateado abierto sobre un escritorio de madera clara en una oficina moderna. Luz natural entrando por una ventana lateral. Fondo desenfocado con plantas y estanterías. Vista ligeramente elevada en tres cuartos. Estilo editorial de tecnología. Colores neutros. Sin logotipos visibles. Composición centrada, dejando espacio libre en la parte superior para añadir un titular. Relación de aspecto 16:9.»

Ejemplo con Gemini:
«Primer plano cinematográfico de una mujer detective de unos 40 años, con gabardina de sarga y expresión concentrada, bajo la lluvia nocturna de una calle de neón de Tokio. Iluminación dramática y lateral (claroscuro), reflejando las luces azules y rojas de la ciudad en el asfalto mojado. Fotografía fotorrealista con grano de película de 35 mm.»

Las posibilidades se multiplican cuando entiendes que la calidad de la imagen depende menos de la herramienta y más de cómo le hablas. Probar con estructuras como las anteriores puede ahorrarte horas de frustración.

Comentarios

Relacionados

Ver más