Was ist das?
KI-Bildgenerierung erstellt und bearbeitet Bilder aus Textbeschreibungen. Sie war der erste virale Durchbruch der generativen KI, und die Front hat sich von 'Kann sie zeichnen?' zu präzisem Bearbeiten verschoben: ein Objekt ändern, alles andere behalten, lesbaren Text rendern, über eine Serie konsistent bleiben.
Wichtige Werkzeuge und Akteure
- Midjourney — der ästhetische Maßstab
- FLUX (Black Forest Labs) — stärkste Open-Weight-Familie, treibt viele Apps an (auch unsere)
- Googles Bildmodelle — dialogisches Bearbeiten, viral geworden als 'Nano Banana'
- DALL·E / GPT image (OpenAI) — Bildgenerierung direkt in ChatGPT
- Stable Diffusion — das Open-Source-Projekt, das alles demokratisierte
- Adobe Firefly — kommerziell unbedenkliche Generierung in Photoshop
Meilensteine
- 2021 — DALL·E zeigt, dass Text-zu-Bild möglich ist
- 2022 — Stable Diffusion macht es quelloffen; Midjourney macht es schön; ein KI-Bild gewinnt eine Kunstmesse
- 2023 — Fotorealismus kommt; das 'KI-Hände'-Problem verblasst
- 2024 — FLUX hebt die Open-Weight-Messlatte; Text im Bild wird lesbar
- 2025 — Dialogisches Bearbeiten geht viral; Herkunftslabels (C2PA) verbreiten sich
- 2026 — Serien mit identischen Figuren und exakte Layoutkontrolle reifen
- Aug 2026 — Herkunftsnachweis wird Gesetz: EU und Kalifornien verlangen in derselben Woche maschinenlesbare KI-Kennzeichnung (C2PA)
- Aug 2026 — Google macht das sichtbare KI-Abzeichen optional, außer in der EU und Südkorea, wo es gesetzlich vorgeschrieben ist; unsichtbares SynthID und C2PA bleiben
Mini-Glossar
- Diffusion: Bilderzeugung durch schrittweises Entrauschen zufälliger Pixel
- Inpainting: nur einen ausgewählten Bildbereich neu generieren
- LoRA: ein kleines Zusatzmodul, das dem Modell einen bestimmten Stil oder ein Gesicht beibringt