はじめに
GoogleのGeminiアプリが2026年2月18日、テキストや写真からオリジナル楽曲を生成できる音楽生成機能をベータ版として公開しました。この機能の中核を担うのは、Google DeepMindが開発した最新の音楽生成モデル「Lyria 3」です。本稿では、Googleの公式ブログをもとに、Lyria 3の機能と使い方、著作権への配慮について解説します。
参考記事
- タイトル: A new way to express yourself: Gemini can now create music
- 著者: Joël Yawili(Senior Product Manager, Gemini app)、Myriam Hamed Torres(Senior Product Manager, Google DeepMind)
- 発行元: Google Blog
- 発行日: 2026年2月18日
- URL: https://blog.google/innovation-and-ai/products/gemini-app/lyria-3/
要点
- GeminiアプリにGoogle DeepMind製の音楽生成モデル「Lyria 3」がベータ版として搭載され、テキストや写真・動画から30秒のオリジナル楽曲を生成できる
- Lyria 3では歌詞の自動生成、スタイル・ボーカル・テンポなどの細かな制御、より高い音楽的品質の3点が従来モデルから改善されている
- 生成されたすべてのトラックにはSynthIDによる透かしが埋め込まれており、Geminiアプリ上でAI生成コンテンツかどうかを音声・画像・動画の形式を問わず確認できる
- 特定のアーティスト名をプロンプトに含めた場合、そのアーティストの楽曲をそのまま生成するのではなく、スタイルやムードを参考にしたオリジナル楽曲として出力される設計になっている
- 18歳以上のユーザーを対象に英語・ドイツ語・スペイン語・フランス語・ヒンディー語・日本語・韓国語・ポルトガル語の8言語で利用可能で、Google AI Plus・Pro・Ultraの有料プランでは利用上限が高くなる
詳細解説
Lyria 3とは——前モデルからの3つの改善点
Googleによれば、Lyria 3はGoogle DeepMindが開発した最新の音楽生成モデルで、2023年に初代Lyriaが公開されて以来、音楽コミュニティとの協力を経て継続的に改善が重ねられてきたモデルです。
従来モデルからの改善点は大きく3つ挙げられています。1つ目は歌詞の自動生成です。ユーザーが歌詞を用意しなくても、プロンプトの内容をもとに歌詞が自動的に生成されます。2つ目はクリエイティブなコントロールの向上で、スタイル・ボーカル・テンポといった要素をより細かく指定できるようになりました。3つ目は楽曲の完成度の向上で、より自然でリアルな音楽的表現が可能になったとされています。
生成AIの音楽分野では、これまでインストゥルメンタル(器楽曲)の生成が先行していた経緯があります。歌詞付きのボーカルトラックを自然な形で生成できるようになったことは、音楽生成技術の成熟を示す一歩と言えます。
使い方——テキストと写真・動画の2つのアプローチ
Googleの発表によれば、Geminiアプリでの音楽生成には主に2つの方法があります。

1つ目はテキストからトラックを生成する方法です。ジャンル、ムード、個人的な思い出などを自由に記述すると、歌詞付きまたはインストゥルメンタルのトラックが生成されます。発表では「懐かしい気分。子どもの頃の記憶と母の手料理について、アフロビートで曲を作って」といった具体的なプロンプト例が紹介されています。
2つ目は写真・動画からトラックを生成する方法です。アップロードしたメディアの内容をGeminiが解析し、その雰囲気に合った歌詞付きの楽曲を作成します。たとえば愛犬のハイキング写真をもとに、その場面を表現したトラックを生成するといった使い方が可能です。
生成されるトラックは30秒間で、Nano Bananaが生成するカスタムカバーアートも自動的に付与されます。ダウンロードや共有リンクでかんたんにシェアできる設計になっており、日常的なコミュニケーションツールとしての活用を想定していると考えられます。
YouTubeクリエイターへの展開——Dream Trackとの連携
Lyria 3はGeminiアプリだけでなく、YouTubeのDream Track機能にも展開されています。Googleによれば、これまでアメリカ国内のクリエイター向けに提供されていたDream Trackが、Lyria 3の採用を機に他国のYouTubeクリエイターへも順次展開される予定です。
YouTubeショートのサウンドトラック生成品質が向上することで、個人クリエイターが動画コンテンツの音楽的な完成度を高めやすくなると思います。動画と音楽の生成が同一のエコシステム内で完結する方向性は、Googleが動画プラットフォームと生成AIを連携させていく戦略の一環とも言えます。
著作権への配慮とSynthIDによる透かし
Googleの発表では、著作権への配慮として2点が明記されています。
1点目は特定アーティストの模倣を避ける設計です。プロンプトにアーティスト名が含まれていた場合でも、そのアーティストの楽曲を直接再現するのではなく、スタイルやムードを参考にしたオリジナル楽曲として出力されます。また、生成されたコンテンツが既存コンテンツに類似していないかを確認するフィルターも実装されているとのことです。
2点目はSynthIDによる透かし(ウォーターマーク)の埋め込みです。SynthIDはGoogle DeepMindが開発した、人間の耳には聞こえない形でAI生成コンテンツを識別するための技術です。Geminiアプリではこの機能が音声にも対応し、音声・画像・動画のいずれについてもAI生成かどうかをユーザーが確認できるようになりました。
Googleは2023年の初代Lyria公開以来、音楽業界との協力のもとで技術開発を進めてきたと説明しています。生成AIと著作権の問題は現在も各国で議論が続いている領域であり、フィルターや透かし技術がどこまで実効性を持つかは、今後の運用を見守る必要があると思います。
対応言語とプラン
Googleによれば、Lyria 3による音楽生成機能は18歳以上のユーザーを対象に、英語・ドイツ語・スペイン語・フランス語・ヒンディー語・日本語・韓国語・ポルトガル語の8言語で利用可能です。日本語が初期対応言語に含まれている点は、日本のユーザーにとって使いやすい条件と言えます。
提供開始はデスクトップ版から始まり、モバイルアプリへは数日以内に順次展開される予定です。利用上限については、Google AI Plus・Pro・Ultraの有料プランで高い上限が設定されています。無料ユーザーでもベータ版として試すことができますが、詳細な上限については現時点では公開されていません。
まとめ
GeminiアプリへのLyria 3搭載により、テキストや写真・動画から30秒のオリジナル楽曲を手軽に生成できる機能がベータ版として利用可能になりました。著作権への配慮やSynthIDによる透かしといった安全設計も含め、日常的な自己表現ツールとしての活用が期待できます。音楽生成AIがどのように普及し、音楽コミュニティとの関係がどう発展していくかが注目されます。
