総復習 - 画像生成AIの技術

拡散モデルやGANなど、画像生成AIの技術を振り返ります。

編集・検証: AIパスポートスタディ編集部 公式情報: GUGA 生成AIパスポート公式ページ 制作・検証方針
香月 リサ 先生(笑顔) 香月 リサ 先生

今日は画像生成AIの技術を復習するわよ。
近年大きな話題になっている分野、社会的インパクトも大きいわね。

雪村 ましろ(笑い) 雪村 ましろ

わぁ、Stable DiffusionとかDALL-Eとか、すごいよねぇ〜! わたし、絵を描いてもらうの大好き〜!

戸倉 ジャスミン(笑い) 戸倉 ジャスミン

ましろ、めっちゃ目キラキラじゃん(笑) そんなに好きなんだ? こないだSNSで生成絵見せてくれたよね。

深見 つむぎ(普段) 深見 つむぎ

画像生成は技術系統が複数あるから、整理しておきましょう。
GAN、VAE、拡散モデル…それぞれアプローチが根本的に違うのよ。

香月 リサ 先生(笑顔) 香月 リサ 先生

系統を整理すると、歴史の流れが見えてくるわ。
試験でも頻出ね。
各技術の世代交代も知識として押さえましょう。

雪村 ましろ(笑顔) 雪村 ましろ

えへへ、いっぱいあるんだねぇ!

戸倉 ジャスミン(普段) 戸倉 ジャスミン

拡散モデルってどういう仕組みだっけ? ノイズから…?

香月 リサ 先生(普段) 香月 リサ 先生

拡散モデルは2段階で学習するの。

まず正方向拡散で、きれいな画像に少しずつノイズを加えて、最終的にほぼランダムなノイズにする。

次に逆方向拡散で、ノイズから元の画像に戻す過程を学習するわ。
生成時には、ランダムノイズから少しずつ整えて画像を作り出すの。

雪村 ましろ(笑顔) 雪村 ましろ

砂嵐テレビから絵が浮かび上がる感じなのぉ?

香月 リサ 先生(笑顔) 香月 リサ 先生

素敵な比喩ね、ましろちゃん! まさにそんなイメージよ。
砂嵐→モヤモヤ→シルエット→絵、という流れね。

深見 つむぎ(びっくり) 深見 つむぎ

ましろちゃんの感性、本当にすごい…。
わたしも見習いたいわ。
直感的な理解は数式理解より深いところに届くわね。

戸倉 ジャスミン(笑顔) 戸倉 ジャスミン

あたしもバドミントンの戦術みたいな比喩しか出てこないから、ましろすご〜い! 別ジャンルで力発揮じゃん!

深見 つむぎ(普段) 深見 つむぎ

画像生成AIは技術と著作権の両面を問われるのですね。
片方だけじゃダメ、と。
試験対策としては欲張りですが…。

香月 リサ 先生(笑顔) 香月 リサ 先生

はい、著作権は後の復習回で詳しく見ていくから、今日は技術面を押さえましょう。
両方揃って合格ラインよ。

戸倉 ジャスミン(普段) 戸倉 ジャスミン

妹の誕生日プレゼント、あたしもAIで絵作ってみようかな…肖像権とか大丈夫かな?

深見 つむぎ(笑顔) 深見 つむぎ

家族の肖像権は本人の同意を取ればOKね。
作る前に妹さんに聞いてみては?

雪村 ましろ(笑顔) 雪村 ましろ

妹さん、きっと喜ぶよぉ! お姉ちゃんからの手作りAIプレゼント、すてき〜!

香月 リサ 先生(笑顔) 香月 リサ 先生

ジャスミンちゃん、素敵な発想ね。
家族への気持ちをAIで形にするのは、技術の良い使い方だわ。

確認クイズ

現在主流の画像生成AI技術はどれか?

  1. ルールベース生成 (if-thenルールで画像を組み立てる)
  2. GAN (敵対的生成ネットワーク)
  3. 拡散モデル (Diffusion Model)
  4. テンプレート合成 (既存画像の組合せ)
こたえを見る

正解: 3. 拡散モデル (Diffusion Model)

現在の画像生成AIでは拡散モデル (Diffusion Model) が主流です。Stable Diffusion・DALL-E・Midjourneyはいずれも拡散モデルベースで、GANは2010年代主流でしたが現在は拡散モデルに置き換わっています。

🔖 この記事の関連書籍

Amazonアソシエイトリンクを含みます。他分野は おすすめ書籍ページ へ。