¿Qué es esto?
La generación de imágenes con IA crea y edita imágenes a partir de descripciones de texto. Fue el primer avance viral de la IA generativa, y la frontera pasó de '¿sabe dibujar?' a la edición precisa: cambiar un objeto, mantener todo lo demás, renderizar texto legible, ser consistente en una serie.
Herramientas y actores clave
- Midjourney — el referente estético
- FLUX (Black Forest Labs) — la familia de pesos abiertos más fuerte, impulsa muchas apps (incluida la nuestra)
- Los modelos de imagen de Google — edición conversacional que se hizo viral como 'Nano Banana'
- DALL·E / GPT image (OpenAI) — generación de imágenes dentro de ChatGPT
- Stable Diffusion — el proyecto de código abierto que lo democratizó todo
- Adobe Firefly — generación comercialmente segura dentro de Photoshop
Hitos
- 2021 — DALL·E demuestra que texto-a-imagen es posible
- 2022 — Stable Diffusion lo libera; Midjourney lo vuelve bello; una imagen de IA gana una feria de arte
- 2023 — Llega el fotorrealismo; el problema de las 'manos de la IA' se desvanece
- 2024 — FLUX eleva el listón de los pesos abiertos; el texto dentro de la imagen se vuelve legible
- 2025 — La edición conversacional se hace viral; se extienden las etiquetas de procedencia (C2PA)
- 2026 — Maduran las series con personajes idénticos y el control exacto de composición
- Ago 2026 — La procedencia se vuelve ley: la UE y California exigen etiquetas de IA legibles por máquina (C2PA) la misma semana
- Ago 2026 — Google hace opcional el distintivo visible de IA, salvo en la UE y Corea del Sur, donde la ley lo exige; SynthID y C2PA invisibles se mantienen
Mini glosario
- Difusión: generar una imagen quitando ruido progresivamente a píxeles aleatorios
- Inpainting: regenerar solo una parte seleccionada de una imagen
- LoRA: un pequeño complemento que enseña al modelo un estilo o rostro específico