これは日本語版です。韓国語版と 英語版もご覧いただけます。

AI音楽制作2.0:短いBGMから完成曲へ

2026-09-28 · AI · 日本 · Zoogom編集部

#AI音楽#Suno v6#Lyria 3#音楽生成#クリエイター#作曲

文章、写真、動画、ボイスメモが歌声、ドラム、ベース、メロディーのある完成曲になる個人音楽スタジオ

AI音楽の最初のブームは、一文から短くて意外な曲を作る体験だった。聞いて共有するには十分に楽しかったが、サビだけを直したい、録音した鼻歌を残したい、動画の長さに合わせたいという段階になると、曲全体を作り直すことが多かった。

2026年のAI音楽は、単発の生成機から個人の制作環境へ変わり始めている。Suno v6は一つの区間だけを自然言語で変更し、複数の素材から歌声やドラムを組み合わせ、文章・音声・画像・動画を出発点にできる。Google Lyria 3はGeminiで日常の写真や動画を30秒の曲に変え、Lyria 3 Proは最大3分の構成を持つ音楽へ範囲を広げる。

本記事がAI音楽制作2.0と呼ぶのは、このように最初の出力を聞くだけではなく、人が選び、構成し、部分的に直せるようになった変化である。公式の技術標準を示す名称ではない。

Suno v6は目的の異なる三つのモデル

Sunoは2026年9月9日にv6ファミリーを発表した。

Sunoの説明では、v6とv6-wildは有料利用者向けで、v6-miniは全プランで利用できる。三つのモデルはいずれも1回で最大8分の生成に対応する。プランの内容は変更される可能性があるため、公開や商用利用の前には利用中のアカウントで最新条件を確認したい。Suno v6公式ヘルプ

より重要なのは編集方法である。「サビだけを合唱に変更して、ほかは残す」「45秒付近のギターを分離して新しいビートに使う」「このボイスメモと写真と日記を一つの曲にする」「歌詞の一行だけを変える」といった操作が案内されている。Suno v6公式発表

Lyria 3は日常の場面を音楽にする

GoogleのLyria 3は、Geminiアプリで文章、写真、動画を入力して30秒の曲を作る。歌詞の生成、スタイル、歌声、テンポの指定に対応し、日本語を含む複数の言語で18歳以上の利用者へ提供されている。写真に写った旅行やペット、友人との思い出から、その場面に合う短いサウンドトラックを作る方向が特徴である。Google JapanのLyria 3発表

Lyria 3 Proでは最大3分まで伸び、イントロ、Aメロ、サビ、ブリッジなど曲の構成を指示できる。動画、ポッドキャスト、解説コンテンツなど、始まりから終わりまで流れが必要な用途に使いやすい。GoogleはAI StudioとGemini APIを通じた開発者向けの展開も案内している。GoogleのLyria 3 Pro発表

SunoとLyriaは同じ目的の製品ではない。Suno v6は長い曲の制作と詳細な編集を強く意識し、GeminiのLyria 3は写真や動画から気軽に音楽を作る入口を広げている。一つの順位にするより、作る作品と編集方法に合うかを見る方が実用的である。

文章、音声、写真と動画、区間編集、複数素材、実際の作品への活用というAI音楽の六機能

なぜ日本のクリエイターに広がるのか

Adobeが日本のSNSクリエイターを対象に実施した2026年の調査では、64%がクリエイティブAIを利用していると回答した。利用者の84%は1年前より利用が増え、81%はビジネスやフォロワーの成長を速めたと答えた。この調査は音楽だけでなく画像、動画、デザインなどを含むため、AI音楽単独の普及率ではない。それでも、生成AIが試用段階から日常の制作工程へ入っていることを示している。Adobe Japanの調査

気に入った部分を残して直せる

以前は歌声がよくてもドラムが合わなければ、全体を再生成する必要があった。区間編集があれば、サビ、歌詞、楽器の一部だけを変えられる。利用者は結果を選ぶだけの人から、編集する人へ移る。

音楽用語を知らなくても構成を伝えられる

「最初は静かに始め、二回目のサビで広がり、最後は歌声だけにする」と場面や感情で説明できる。さらに精密にしたい場合は、BPM、楽器、調、構成を追加できる。

身近な素材から始められる

スマートフォンのボイスメモ、旅行写真、短い動画、日記を一つの作品に使える。完成したメロディーがなくても、自分の経験を出発点にできるため、一般の利用者にも取り組みやすい。

日本のコンテンツ形式と相性がよい

動画配信、VTuberの配信開始・終了曲、ゲーム試作、ポッドキャスト、店舗や地域イベントの映像、家族の思い出動画など、短い音楽と構成された曲の両方に需要がある。作品の長さと展開を先に決めれば、映像編集と音楽制作を並行しやすい。

完成曲へ進める五つの段階

1. ジャンルより利用場面を決める

15秒の配信ジングル、3分の動画、繰り返すゲームBGM、個人の記念曲では必要な構成が異なる。使用場所、長さ、会話やナレーションの有無を最初に決める。

2. 自分が使える素材を集める

自作の歌詞、自分で録音した声やメロディー、自分で撮影した写真と動画を使うと、個性と権利関係が明確になる。インターネットで見つけた音源や映像を、出典や許可を確認せずにアップロードしてはいけない。

3. 曲の流れを説明する

次の情報を組み合わせるとよい。

4. 候補を比較して一つずつ直す

最初から一曲に決めず、少数の候補からよい部分を選ぶ。サビ、歌詞、楽器、長さを一度にすべて変えるのではなく、一項目ずつ修正すると指示と結果の関係を理解しやすい。

5. 書き出す前に利用条件を確認する

AIで作ったからといって、すべての用途に自由に使えるわけではない。無料・有料プラン、制作時点の規約、商用利用、収益化、所有権の説明を確認する。制作日、サービス、モデル、プラン、プロンプト、入力素材、人が行った編集を内部記録として残すと、後から確認しやすい。

目的、素材、構成、部分修正、利用条件の確認で進める人間主導のAI音楽制作

日本向けの実用例

VTuber・配信の開始曲

20秒の配信開始用インストゥルメンタルを作る。明るい電子音と短いドラムフィルを使い、最初の3秒でタイトルを表示できる余白を作る。歌声と既存曲に似たメロディーは使わず、最後は本編へ自然につながる音で終える。

旅行動画のBGM

秋の京都を歩く90秒の映像に合うインストゥルメンタルを作る。温かいエレクトリックピアノと控えめな打楽器を中心にし、ナレーションを邪魔しない密度にする。60秒から少し明るくし、最後の5秒で自然に終える。

ゲーム試作のループ

パズルゲームの集中場面で繰り返す45秒の曲を作る。木の打楽器と短いシンセサイザーを使い、歌声と大きな低音は入れない。最後から最初へ切れ目なく戻る構成にする。

特定の歌手や既存曲を指定するのではなく、用途、構成、感情、楽器で説明することが重要である。

人の役割は判断へ移る

多数の候補を短時間で作れるほど、何を残し、何を捨てるかという判断が重要になる。Adobe Japanの調査では、クリエイティブAI利用者の86%が最終的な創作判断は人に残るべきだと回答した。

Googleは、GeminiアプリでLyriaを使って生成した音楽にAI生成物を識別するSynthIDを埋め込むとしている。また、Lyria 3は既存アーティストの直接的な模倣ではなく、独自表現を目的に設計し、既存コンテンツとの照合フィルターも用意したと説明する。ただし、技術的な対策だけで権利問題が完全になくなるわけではない。作る人が入力素材と最終結果を確認し、正当な申立てに対応する必要がある。

まとめ

AI音楽制作2.0の変化は音質だけではない。文章から一度曲を生成して終わるのではなく、写真、動画、ボイスメモを材料にし、曲の構成を決め、気に入らないサビや歌詞だけを修正できるようになった。

Suno v6は最大8分の生成、区間編集、複数素材を使った制作を前面に出す。Lyria 3はGeminiで日常の場面を30秒の音楽に変え、Lyria 3 Proは最大3分の構造化された曲と開発者向け連携を提供する。AIが最初のスタジオを身近にしても、目的、選択、権利、完成の判断は人に残る。

商標・権利・画像について

Suno、Google、Gemini、Lyria、SynthIDおよび関連する商標は各権利者に帰属する。本記事は各社の提供・承認を受けた広告ではない。特定の歌手の声や既存楽曲の模倣を勧めるものではなく、サービスの商用利用条件は、利用者がアップロードする素材の権利まで取得してくれるものではない。記事内の画像は本記事のために新たに制作し、製品画面、企業ロゴ、アルバム画像、第三者の写真を複製していない。

出典

出典: Suno · 独自の画像・図版を含みます