音楽生成AI - AIが作曲する時代

テキストやメロディから音楽を自動生成するAI技術。代表的なモデルとその仕組みを紹介します。

編集・検証: AIパスポートスタディ編集部 公式情報: GUGA 生成AIパスポート公式ページ 制作・検証方針
香月 リサ 先生(普段) 香月 リサ 先生

今日のテーマは音楽生成AIよ。
著作権・産業構造・クリエイター保護など、社会影響が大きいテーマなので、みんなで真剣に考えてみましょう。

戸倉 ジャスミン(普段) 戸倉 ジャスミン

今までも真剣に考えてきたけど、今日は特にってこと?

香月 リサ 先生(普段) 香月 リサ 先生

音楽は文化そのもの。
そして AI の影響でプロの仕事が変容している領域でもあるの。
だからこそ技術と倫理を並行して見ていきましょう。

深見 つむぎ(普段) 深見 つむぎ

まず技術面から整理すると、代表的な音楽生成 AI は Google のMusicLM、Meta のMusicGen、そして Suno、Udio などのサービスがあります。
「ローファイヒップホップ、夜の雨音」「明るいポップス、アップテンポ」のようなテキスト指示で、数秒〜数分の楽曲を生成できます。

戸倉 ジャスミン(しょんぼり) 戸倉 ジャスミン

うそっ!?
それってもうプロの作曲家と競合しちゃうじゃん…

香月 リサ 先生(普段) 香月 リサ 先生

技術的にはいくつかアプローチがあって、①音声を音声トークン化して言語モデルのように生成する方式、②拡散モデルでスペクトログラム(時間×周波数の画像)を生成する方式、など。
MusicGen は音声トークン+Transformer 型ね。

雪村 ましろ(びっくり) 雪村 ましろ

音を画像みたいに扱うなんて、なんだか不思議…。

深見 つむぎ(普段) 深見 つむぎ

スペクトログラムは音の波を時間軸と周波数軸で2次元の画像として表した表現形式で、そこから拡散モデルで画像を生成するように音楽を作る、という発想です。

香月 リサ 先生(普段) 香月 リサ 先生

そしてここから倫理の話ね。
音楽生成 AI の学習データには、既存の楽曲が含まれている可能性があるわ。
これが著作権の議論に直結するの。
2024年には米国の大手レコード会社が Suno と Udio を著作権侵害で提訴する動きも出ていて、世界中で法的整理が進んでいる最中よ。

戸倉 ジャスミン(普段) 戸倉 ジャスミン

つまり、AIが有名な曲を学習して、そっくりの曲を作っちゃう可能性があるってこと?

深見 つむぎ(普段) 深見 つむぎ

そうです。
クリエイター保護の観点では、AI による自動生成楽曲を明示する義務、学習データの開示、対価還元の仕組みなどが議論されています。

雪村 ましろ(しょんぼり) 雪村 ましろ

便利さとクリエイターさんの生活、バランスとるのって難しそう…

香月 リサ 先生(笑顔) 香月 リサ 先生

ふふ、ましろちゃんの感性、大事よ。
音楽家が AI を「作業効率化ツール」として使う事例(アイデア出し、BGM 量産)も増えていて、必ずしも対立構造ではない、という見方もあるの。
「使い方のマナー」も大事で、YouTube 公開やスポンサー付き動画で使う場合は、サービス利用規約と生成物の商用可否を必ず確認してね。

深見 つむぎ(普段) 深見 つむぎ

補足: 日本音楽著作権協会(JASRAC)や各国著作権団体も、AI 生成楽曲の扱いに関するガイドラインを整備中ですね。
Phase 7 の法務編で続きを扱います。

香月 リサ 先生(普段) 香月 リサ 先生

試験的には「音楽生成AI=テキストから楽曲生成」「代表はMusicLM、MusicGen、Suno」「著作権問題は進行中」の3点を押さえればOKよ。
技術と倫理、両方を意識する章だったわね。

確認クイズ

音楽生成AI に関する説明として最も適切なものはどれか。

  1. 著作権の問題は完全に解決されている
  2. テキストの説明から楽曲を生成できるモデルがある
  3. 音楽生成には画像生成と同じモデルをそのまま使う
  4. 現在のAIではメロディの生成は不可能
こたえを見る

正解: 2. テキストの説明から楽曲を生成できるモデルがある

MusicLM・MusicGen・Suno など、テキストの説明から楽曲を生成できる音楽生成AIが実在します。著作権問題は未解決、画像モデル流用ではなく音楽特有の仕組み、メロディ生成は既に可能です。

🔖 この記事の関連書籍

Amazonアソシエイトリンクを含みます。他分野は おすすめ書籍ページ へ。