これは何?
AI画像生成は、テキストの説明から絵を作り、編集する。生成AI最初のバイラルな躍進だった。最前線は「描けるか?」から精密な編集へ移った:一つの物だけ変え、他はそのまま。読める文字とシリーズでの一貫性が今の試験だ。
主要ツールとプレイヤー
- Midjourney — 美的ベンチマーク
- FLUX (Black Forest Labs) — 最強のオープンウェイト系列、多くのアプリを支える(当アプリも)
- Googleの画像モデル — 「Nano Banana」としてバズった対話型編集
- DALL·E / GPT image (OpenAI) — ChatGPT内の画像生成
- Stable Diffusion — すべてを民主化したオープンソースプロジェクト
- Adobe Firefly — Photoshop内の商用安全な生成
節目
- 2021 — DALL·Eがテキストから画像の可能性を示す
- 2022 — Stable Diffusionがオープンソース化;Midjourneyが美しくする;AI画像がアートフェアで優勝
- 2023 — フォトリアリズム到来;「AIの手」問題が薄れる
- 2024 — FLUXがオープンウェイトの水準を引き上げ;画像内の文字が読めるように
- 2025 — 対話型編集がバズる;来歴ラベル(C2PA)が普及
- 2026 — 同一キャラクターのシリーズと正確なレイアウト制御が成熟
- 2026年8月 — 来歴表示がEUとカリフォルニア州で法制化され、グーグルは他地域の可視バッジを任意にした
- 2026年9月 — アップルのiPhoneがセンサー側で写真に署名し、検証可能な原本を残す(当サイトの記事)
- 2026年9月 — アリババのQwen-ImageがApache 2.0を離れ研究用途限定の条件に移り、重みの公開と用途の自由が分かれた(当誌報道)
- 2026年10月 — FLUX 3 Imageが座標で物を置き、他を崩さず一つだけ直す(当誌報道)
ミニ用語集
- 拡散(ディフュージョン):ランダムなピクセルを段階的にノイズ除去して画像を生成
- インペインティング:画像の選択部分だけを再生成
- LoRA:特定のスタイルや顔をモデルに教える小さな追加モジュール