今日は画像生成AIの技術を復習するわよ。
近年大きな話題になっている分野、社会的インパクトも大きいわね。
わぁ、Stable DiffusionとかDALL-Eとか、すごいよねぇ〜! わたし、絵を描いてもらうの大好き〜!
ましろ、めっちゃ目キラキラじゃん(笑) そんなに好きなんだ? こないだSNSで生成絵見せてくれたよね。
画像生成は技術系統が複数あるから、整理しておきましょう。
GAN、VAE、拡散モデル…それぞれアプローチが根本的に違うのよ。
系統を整理すると、歴史の流れが見えてくるわ。
試験でも頻出ね。
各技術の世代交代も知識として押さえましょう。
えへへ、いっぱいあるんだねぇ!
拡散モデルってどういう仕組みだっけ? ノイズから…?
拡散モデルは2段階で学習するの。
まず正方向拡散で、きれいな画像に少しずつノイズを加えて、最終的にほぼランダムなノイズにする。
次に逆方向拡散で、ノイズから元の画像に戻す過程を学習するわ。
生成時には、ランダムノイズから少しずつ整えて画像を作り出すの。
砂嵐テレビから絵が浮かび上がる感じなのぉ?
素敵な比喩ね、ましろちゃん! まさにそんなイメージよ。
砂嵐→モヤモヤ→シルエット→絵、という流れね。
ましろちゃんの感性、本当にすごい…。
わたしも見習いたいわ。
直感的な理解は数式理解より深いところに届くわね。
あたしもバドミントンの戦術みたいな比喩しか出てこないから、ましろすご〜い! 別ジャンルで力発揮じゃん!
画像生成AIは技術と著作権の両面を問われるのですね。
片方だけじゃダメ、と。
試験対策としては欲張りですが…。
はい、著作権は後の復習回で詳しく見ていくから、今日は技術面を押さえましょう。
両方揃って合格ラインよ。
妹の誕生日プレゼント、あたしもAIで絵作ってみようかな…肖像権とか大丈夫かな?
家族の肖像権は本人の同意を取ればOKね。
作る前に妹さんに聞いてみては?
妹さん、きっと喜ぶよぉ! お姉ちゃんからの手作りAIプレゼント、すてき〜!
ジャスミンちゃん、素敵な発想ね。
家族への気持ちをAIで形にするのは、技術の良い使い方だわ。
確認クイズ
現在主流の画像生成AI技術はどれか?
- ルールベース生成 (if-thenルールで画像を組み立てる)
- GAN (敵対的生成ネットワーク)
- 拡散モデル (Diffusion Model)
- テンプレート合成 (既存画像の組合せ)
こたえを見る
正解: 3. 拡散モデル (Diffusion Model)
現在の画像生成AIでは拡散モデル (Diffusion Model) が主流です。Stable Diffusion・DALL-E・Midjourneyはいずれも拡散モデルベースで、GANは2010年代主流でしたが現在は拡散モデルに置き換わっています。