这是什么?
AI图像生成根据文字描述创作和编辑图片。它是生成式AI第一个病毒式突破,前沿也早已从'能不能画'转向精准编辑:只改一个物体、其余保持不变、渲染可读文字、系列图片保持一致。
关键工具与玩家
- Midjourney — 审美标杆
- FLUX (Black Forest Labs) — 最强开源权重家族,驱动众多应用(包括我们)
- 谷歌图像模型 — 以'Nano Banana'爆红的对话式编辑
- DALL·E / GPT image (OpenAI) — ChatGPT内置的图像生成
- Stable Diffusion — 让一切平民化的开源项目
- Adobe Firefly — Photoshop内的商用安全生成
里程碑
- 2021 — DALL·E证明文生图可行
- 2022 — Stable Diffusion将其开源;Midjourney让它变美;AI图像赢得艺术博览会大奖
- 2023 — 照片级真实感到来;'AI手'问题消退
- 2024 — FLUX抬高开源权重标杆;图中文字变得可读
- 2025 — 对话式编辑爆红;溯源标签(C2PA)普及
- 2026 — 同一角色系列与精确版面控制走向成熟
- 2026年8月 — 内容溯源成为法律:欧盟与加州在同一周强制要求机器可读的AI标识(C2PA)
- 2026年8月 — 谷歌将可见的AI角标改为可选,法律强制要求的欧盟与韩国除外;隐形的 SynthID 与 C2PA 保留
小词典
- 扩散(Diffusion):对随机像素逐步去噪以生成图像
- 局部重绘(Inpainting):只重新生成图像中选定的部分
- LoRA:教会模型特定风格或面孔的小型附加模块