Что это?
ИИ-генерация изображений создаёт и редактирует картинки по текстовому описанию. Это был первый вирусный прорыв генеративного ИИ, и передний край сместился от 'умеет ли он рисовать?' к точному редактированию: изменить один объект, сохранив всё остальное, отрисовать читаемый текст, удержать единый образ в серии.
Ключевые инструменты и игроки
- Midjourney — эстетический эталон
- FLUX (Black Forest Labs) — сильнейшее семейство открытых весов, движок многих приложений (включая наше)
- Модели изображений Google — диалоговое редактирование, ставшее вирусным под именем 'Nano Banana'
- DALL·E / GPT image (OpenAI) — генерация изображений внутри ChatGPT
- Stable Diffusion — open-source проект, который всё демократизировал
- Adobe Firefly — коммерчески безопасная генерация внутри Photoshop
Вехи
- 2021 — DALL·E показывает, что текст-в-изображение возможен
- 2022 — Stable Diffusion открывает исходники; Midjourney делает красиво; ИИ-картина побеждает на арт-ярмарке
- 2023 — приходит фотореализм; проблема 'ИИ-рук' сходит на нет
- 2024 — FLUX поднимает планку открытых весов; текст внутри изображения становится читаемым
- 2025 — диалоговое редактирование становится вирусным; распространяются метки происхождения (C2PA)
- 2026 — серии с одинаковыми персонажами и точный контроль композиции взрослеют
- Авг 2026 — Происхождение контента становится законом: ЕС и Калифорния в одну неделю ввели обязательную машиночитаемую маркировку ИИ (C2PA)
- Авг 2026 — Google делает видимый значок ИИ необязательным, кроме ЕС и Южной Кореи, где он требуется по закону; невидимые SynthID и C2PA остаются
Мини-словарь
- Диффузия: генерация изображения путём постепенной очистки случайных пикселей от шума
- Inpainting: перегенерация только выделенной части изображения
- LoRA: небольшая надстройка, обучающая модель конкретному стилю или лицу