[開発者向け]Google「Lyria 3 Pro」公開——最長3分の楽曲生成と画像入力が開発者APIで利用可能に

目次

はじめに

 Google DeepMindが2026年3月25日、音楽生成モデル「Lyria 3 Pro」を発表しました。最長約3分の楽曲生成やマルチモーダル入力など、開発者向けAPIとしてGemini APIおよびVertex AI経由での公開と同時に、Google VidsやGeminiアプリなど複数のGoogleサービスへの統合も進んでいます。

参考記事

要点

  • Lyria 3 Proは最長約3分の楽曲を生成でき、イントロ・バース・コーラス・ブリッジなど楽曲構造をプロンプトで指定できる
  • 開発者向けに2つのモデルバリアントが提供される:スタジオ品質のLyria 3 Proと、30秒クリップ向けの高速処理Lyria 3 Clipである
  • テキストに加え画像からの音楽生成(マルチモーダル入力)、テンポ指定、歌詞のタイミング制御など精密なコントロールが可能だ
  • Vertex AI、Gemini API、Google AI Studio、Google Vids、GeminiアプリなどのGoogleプロダクトで順次利用可能となった
  • 全出力にSynthID電子透かしが埋め込まれており、アーティスト模倣の禁止など責任ある設計が採用されている

詳細解説

Lyria 3 ProとLyria 3 Clipの2バリアント構成

 Google DeepMindは2026年3月25日、音楽生成モデル「Lyria 3 Pro」を正式発表しました。先月公開された「Lyria 3」をベースに、さらなる長尺生成と楽曲構造への対応を強化したモデルです。

 開発者向けには、用途に応じた2つのモデルバリアントが提供されています。Lyria 3 Pro(モデル名:lyria-3-pro-preview)は、最長約3分のフルレングス楽曲を生成できるプレミアムモデルです。プロスタジオ品質の構造的認識を持ち、イントロからバース・コーラス・ブリッジまで、楽曲の各セクションを指定して生成できます。複雑なトランジションを含む楽曲制作や、スタイルの異なるセクションを組み合わせた実験に適しています。

 一方、Lyria 3 Clip(lyria-3-clip-preview)は、30秒クリップの高速・大量生成に最適化されたバリアントです。ラピッドプロトタイピング、バックグラウンドループ、SNS向けアセットの生成に向いており、レイテンシを重視するアプリケーションに適したモデルと言えます。AIによる音楽生成では、こうした「品質重視」と「速度重視」のモデルを使い分けられる設計が実用的な観点から重要と考えられます。

精密なコントロールとマルチモーダル入力

 Lyria 3では、テキストプロンプトによる自然言語指定に加え、いくつかの精密なコントロール機能が導入されています。

 テンポ指定(Tempo conditioning)では、楽曲のテンポを「Fast」「Slow」などの指示で高精度に制御できます。時間軸に沿った歌詞制御(Time-aligned lyrics)では、曲中のどのタイミングで歌詞を開始・終了するかをプロンプトで指定できます。そして画像→音楽変換(Multimodal image-to-music input)では、画像を入力することで、その雰囲気やスタイルに合った音楽を生成できます。

 また、ボーカル生成においては、英語以外の言語にも対応しており、ポップ・ファンク・モータウンなど多様なジャンルの楽曲制作が可能です。リアルな表現力を持つボーカルと、クリアなサウンドが特徴とされています。

Google AI Studioでの体験環境

 Google AI Studioでは、Lyria 3を試すための専用の音楽生成ワークスペースが新たに公開されました(https://aistudio.google.com/new_music)。有料APIキーを使用することで、2つの作成モードが利用できます。

 テキストモードでは、テンポやキーなどのパラメータを含む自然言語でプロンプトを記述するシンプルな操作感で音楽を生成できます。コンポーザーモードでは、イントロ・バース・ブリッジなどのセクションごとに、タイミング・強弱・内容の記述を個別に設定しながら楽曲を構築できます。より細かな制御を求める制作者に向いたモードです。

 さらに、Google AI Studioではデモアプリも複数公開されています。動画をアップロードすると内容を分析してサウンドトラックを自動生成する「Background music for Videos」や、天気・スケジュール情報を歌詞に織り込んで毎朝新しい曲で目覚めさせる「Alarm Clock」などが例として挙げられています。

各Googleサービスへの統合

 Lyria 3 ProはGoogleの複数のサービスに統合され、開発者・ビジネス・クリエイター向けにそれぞれ異なる形で提供されています。

 Vertex AIでは、大規模な商用利用を想定したLyria 3 Proがパブリックプレビューで利用可能になっています。ゲーム向けサウンドトラックの大量生成や、クリエイティブツールへの統合などのユースケースが想定されています。Gemini APIとGoogle AI Studioでは開発者向けに公開されており、前述のコンポーザーモードやLyria RealTimeも利用できます。

 Google Vids(GoogleワークスペースのAI動画作成アプリ)では、マーケティング動画やクリエイティブプロジェクト向けのカスタム音楽生成機能として、今週からGoogle WorkspaceユーザーおよびGoogle AI Pro・Ultraサブスクライバーへ順次展開されています。Geminiアプリでも、有料サブスクライバー向けにLyria 3 Proによる長尺生成が利用可能になりました。また、ミュージシャン向けの共同作業ツールProducerAIでは、無料・有料サブスクライバーを問わずグローバルに利用可能とされています。

責任ある設計とクリエイターとの連携

 Google DeepMindは、Lyria 3の開発にあたって音楽業界との協働を重視してきたと説明しています。Music AI Sandboxを通じてミュージシャン・プロデューサー・ソングライターに実験的ツールを提供し、その知見をLyria 3の開発に反映してきたとのことです。

 グラミー賞受賞プロデューサーのYung SpielbergがGoogle DeepMindの短編映画「Dear Upstairs Neighbors」のスコア制作にLyriaを活用した事例や、DJのFrançois KがLyria 3を使って制作した新曲のリリースが予定されていることも紹介されています。

 責任ある設計の観点では、SynthIDと呼ばれるGoogle AIの電子透かし技術がすべての出力に埋め込まれています。この透かしは知覚されにくい形で埋め込まれており、音声が修正された後でも識別・検証が可能です。また、アーティスト名を指定するプロンプトに対しては、そのアーティストの模倣は行わず、あくまで広い意味でのインスピレーションとして扱う設計がとられています。学習データについては、YouTubeおよびGoogleが利用権を持つ素材が使用されているとのことです。

まとめ

 Google DeepMindは2026年3月25日、音楽生成モデル「Lyria 3 Pro」を発表し、Gemini APIやVertex AIでのパブリックプレビューを開始しました。最長3分の楽曲生成、画像入力、テンポ・歌詞のタイミング制御など、開発者が実用アプリを構築するための機能が揃いつつあります。音楽生成AIの実装可能性について、ぜひご自身の開発や業務の文脈で試してみる価値があると思います。

この記事が気に入ったら
フォローしてね!

  • URLをコピーしました!
  • URLをコピーしました!
目次