Что это?
ИИ-генерация изображений создаёт и редактирует картинки по текстовому описанию. Это был первый вирусный прорыв генеративного ИИ. Передний край сместился от 'умеет ли он рисовать?' к точному редактированию: изменить один объект, сохранив всё остальное. Читаемый текст и единый образ в серии — сегодняшняя проверка.
Ключевые инструменты и игроки
- Midjourney — эстетический эталон
- FLUX (Black Forest Labs) — сильнейшее семейство открытых весов, движок многих приложений (включая наше)
- Модели изображений Google — диалоговое редактирование, ставшее вирусным под именем 'Nano Banana'
- DALL·E / GPT image (OpenAI) — генерация изображений внутри ChatGPT
- Stable Diffusion — open-source проект, который всё демократизировал
- Adobe Firefly — коммерчески безопасная генерация внутри Photoshop
Вехи
- 2021 — DALL·E показывает, что текст-в-изображение возможен
- 2022 — Stable Diffusion открывает исходники; Midjourney делает красиво; ИИ-картина побеждает на арт-ярмарке
- 2023 — приходит фотореализм; проблема 'ИИ-рук' сходит на нет
- 2024 — FLUX поднимает планку открытых весов; текст внутри изображения становится читаемым
- 2025 — диалоговое редактирование становится вирусным; распространяются метки происхождения (C2PA)
- 2026 — серии с одинаковыми персонажами и точный контроль композиции взрослеют
- Авг 2026 — Происхождение контента становится законом в ЕС и Калифорнии, а Google делает видимый значок необязательным вне их
- Сен 2026 — iPhone от Apple подписывает снимок на сенсоре и добавляет проверяемый оригинал (наш материал)
- Сен 2026 — Qwen-Image от Alibaba уходит с Apache 2.0 на исследовательскую лицензию, разделяя открытые веса и открытое использование (наш материал)
- Окт 2026 — FLUX 3 Image ставит объекты по координатам и правит один, не трогая остальное (наш материал)
Мини-словарь
- Диффузия: генерация изображения путём постепенной очистки случайных пикселей от шума
- Inpainting: перегенерация только выделенной части изображения
- LoRA: небольшая надстройка, обучающая модель конкретному стилю или лицу