Google Lyria 3.5発表|音楽生成AIの企業活用とAPI料金

Google Lyria 3.5発表|音楽生成AIの企業活用

公式ドキュメント・公式発表などの一次情報を確認したうえで、株式会社Nexaが執筆・更新しています。AIツールの仕様や料金は変わることがあるため、導入判断の前に各公式サイトの最新情報もご確認ください。運営会社について

Lyria 3.5は、最長3分の楽曲生成と歌詞・ボーカル・テンポ制御を強化したGoogleの音楽生成AIです。

  • 要点1: 2026年7月29日にGoogle Flow Musicで発表、2026年9月4日からGeminiアプリ・Gemini APIにも拡大
  • 要点2: 音楽性、歌詞、ボーカル、長さとテンポの制御を改善
  • 要点3: 生成物にはSynthIDを適用し、安全対策も実施

対象: 広告、動画、商品企画で音楽生成AIを検討する企業担当者

今日やること: 既存案件から30秒の仮音源を試す用途を1つ選ぶ

この記事の著者
株式会社Nexa 代表取締役川島 陸

一橋大学経済学部卒業後、フォーティエンスコンサルティング株式会社(旧 株式会社クニエ)にて法人向けAI導入支援等を経験。独立後、AI系メディア運営やDify/n8nの導入支援を経て、株式会社Nexaを創業。法人向けAI研修・AI導入支援・AI関連メディア運営を手掛ける。

Googleは2026年7月29日、音楽生成AIの新モデル「Lyria 3.5」を発表しました。Google Flow Musicで順次提供し、音楽性、歌詞、ボーカル、テンポと長さの制御を改善しています。

注目点は、単に音質が上がったことではありません。最長3分の楽曲を作り、用途に合わせて尺やテンポを指定できるため、企業の動画や広告で使う「仮音源」の制作工程に組み込みやすくなりました。

ただし、SynthIDの透かしが付くことと、商用利用に必要な権利確認は別の問題です。本記事では、Googleの公式発表とモデルカードを基に、機能と企業での扱い方を整理します。

Lyria 3.5はGoogle Flow MusicとGeminiで提供される音楽生成AI

Lyria 3.5は、テキストの指示から音楽音声と歌詞を生成するGoogle DeepMindのモデルです。Googleは同日から、音楽制作サービス「Google Flow Music」で順次提供すると発表しました。

Google DeepMindのモデルページでは、最長3分の楽曲を生成できると案内しています。60秒の短いクリップから3分の曲まで、必要な長さをプロンプトで指定できます。

Flow Musicには、画像をアップロードし、その雰囲気に合う楽曲を作る機能もあります。商品写真や映像のキービジュアルを起点に、企画初期のBGM案を短時間で比較する使い方が考えられます。

Googleは2026年9月4日、Lyria 3.5をGeminiアプリ(ウェブ・モバイル)とGemini API、Google AI Studio、Google Vidsにも拡大すると発表しました。Flow Music限定だった提供範囲が、通常のGemini利用者にも広がっています。

項目 公式情報で確認できた内容
発表日 2026年7月29日
提供先 Google Flow Music(2026年7月29日〜)、Geminiアプリ・Gemini API・Google AI Studio・Google Vids(2026年9月4日〜)
入力 テキスト。Flow Musicでは画像を使った制作機能も案内
出力 音楽音声、歌詞テキスト
最長時間 3分
主な改善 音楽性、歌詞、ボーカル、テンポと長さの制御

GoogleのAIモデル全体を把握したい場合は、Gemini 3のモデルと料金を整理した記事も参考になります。

Lyria 3.5で改善された4つの機能

Googleが挙げた改善点は4つです。いずれも、試作した曲を実案件に近づける際の修正回数を減らす方向に働きます。

複雑なメロディーを自然に構成する

音楽性の改善により、複雑なメロディー構造でも、より自然で豊かな楽曲を作れるとGoogleは説明しています。

企業利用では、ブランド動画の構成に合わせて、静かな導入から盛り上がる終盤までを一曲で設計したい場面があります。単調なループだけでなく、展開を持つ仮音源を早い段階で確認できる点が実務上の利点です。

歌詞の指示追従と構成理解を高める

Lyria 3.5は、歌詞の品質、プロンプトへの忠実度、曲の構成に対する理解を改善しました。

たとえば、商品名を連呼するのではなく、Aメロでは課題、サビでは価値を伝えるといった構成を指示しやすくなります。ただし、生成された文言の商標、誤認表示、表現上の問題は人が確認する必要があります。

ボーカルの感情表現と発音を改善する

ボーカルは、自然さ、感情の細かさ、発音が改善されています。歌声を含むデモ曲を使えば、ナレーションだけでは伝わりにくいキャンペーンの温度感を、関係者間で共有しやすくなります。

一方、特定の実在歌手を想起させる声や表現は、肖像、パブリシティ、契約上のリスクにつながります。社内ルールでは「特定人物の模倣を指示しない」と明記するのが安全です。

テンポと出力時間を制御する

テンポと長さを指定しやすくなった点は、企業の制作工程に直結します。15秒広告、30秒の商品紹介、60秒の採用動画では、必要な音源の尺が異なるためです。

映像に合わせて後から曲を切り貼りするのではなく、企画段階から指定尺に近い音源を作れば、編集工数を抑えられる可能性があります。

Lyria 2との違いとモデルカードの技術情報

Google DeepMindのモデルカードによると、Lyria 3.5は時間方向の音声潜在表現に「latent diffusion」を適用しています。これは、音声を扱いやすい内部表現に変換し、ノイズから段階的に音楽を構成する方式です。

評価では、音質と美しさ、ボーカル品質、音声忠実度、プロンプトへの追従性を対象に、人手評価と自動評価を実施しました。Lyria 2との比較では、音声忠実度と歌詞の指示追従が改善したと報告されています。

ただし、公開されたモデルカードには改善率の数値がありません。「何倍高品質」といった表現は避け、自社の用途で比較試験を行うべきです。

比較軸 Lyria 3.5で公表された改善
音声 明瞭さと技術的な品質を改善
歌詞 単純な指示と複雑な指示の両方で追従性を改善
ボーカル 感情表現、自然さ、発音を改善
制御 テンポと生成時間を指定しやすくした

企業で想定できる3つの活用場面

Lyria 3.5は、完成品を無人で量産する道具よりも、制作初期の選択肢を増やす道具として導入しやすいモデルです。

広告とSNS動画の仮BGM

マーケティング担当者は、動画編集を始める前に複数の曲調を作り、ブランドとの相性を比較できます。15秒、30秒、60秒と尺を変えた案を準備すれば、媒体ごとの検証にも使えます。

商品デモとプレゼンテーション

新商品の発表会、展示会、営業デモでは、映像の完成前に音楽を含む体験を共有できます。画像から楽曲を作るFlow Musicの機能は、キービジュアルと音の方向性を同時に検討する場面に向きます。

動画生成AIと組み合わせた試作

動画生成AIで映像案を作り、Lyria 3.5で仮音源を付ければ、外部制作に発注する前の絵コンテを動画に近い形で確認できます。Seedance 2.0を使った動画生成の動向と合わせると、生成AIが制作工程のどこを短縮できるか見えやすくなります。

ただし、音源と映像を同時に大量生成すると、承認対象も増えます。案を3つまでに絞るなど、生成後の選定工程を先に決めておく必要があります。

導入前に確認すべき権利と安全性

Lyria 3.5には、AI生成物を識別するGoogleの電子透かし「SynthID」が適用されます。モデルカードには、データセットのフィルタリング、人手によるレッドチーミング、製品側の安全フィルタも記載されています。

SynthIDは生成経路を識別する仕組みであり、企業の権利処理を代行するものではありません。公開前には、少なくとも次の項目を確認します。

  • Flow Musicと利用プランの最新規約で商用利用条件を確認する
  • 既存楽曲、歌手、ブランドを過度に模倣する指示を避ける
  • 歌詞に商標、誤認表示、差別表現、機密情報がないか確認する
  • 生成日時、プロンプト、担当者、承認者、利用媒体を記録する
  • 外部配布前に法務または権利担当者が確認する

Googleの禁止用途には、他者の権利侵害、誤情報やなりすまし、危険または違法な活動などが含まれます。技術的に生成できても、企業が公開してよいとは限りません。

企業が今取るべき3ステップ

全社導入より先に、権利リスクが低い社内試作で評価する方法が現実的です。

1. 用途を一つに限定する

最初の検証は、社内プレゼン用の30秒BGMなど、外部公開しない用途に絞ります。評価対象を音質、指示への追従、修正時間の3項目に限定すると、導入効果を判断しやすくなります。

2. 同じ条件で複数案を比較する

テンポ、長さ、楽器、感情、ボーカルの有無を固定し、表現だけを変えた3案を作ります。従来の素材サイトや外部制作と比べ、作業時間と品質を記録します。

3. 公開前の承認手順を決める

生成担当者だけで公開を判断せず、ブランド、法務、制作責任者の承認を通します。AI生成であることの表示方針も、媒体ごとに決めておきます。

\ AI活用の「次の一手」を一緒に考えませんか /

AI顧問の無料相談はこちら

Gemini APIでの提供開始とAPI料金(2026年9月4日更新)

モデルカードは、下流事業者にAPI経由でモデルを提供すると記載していました。Googleは2026年9月4日、Lyria 3.5をGemini API(モデルID: lyria-3.5)で一般提供(GA)すると発表し、同時にGeminiアプリ(ウェブ・モバイル)、Google AI Studio、Google Vidsにも展開しました。

Gemini APIの料金ページによると、Lyria 3.5は1曲あたり0.08ドルの従量課金で、無料枠はありません。出力は44.1kHzのステレオ音声で、テキストと画像の両方をプロンプトに使えます。

企業が本番ワークフローへ組み込むには、1曲あたりの料金だけでなく、生成履歴、権限管理、監査ログ、データ保持条件の確認が必要です。SLAや企業向け管理機能の詳細は、Gemini APIおよびGoogle Cloudの契約条件を個別に確認してください。

よくある質問

Q. Lyria 3.5はどこで使えますか?

Googleは2026年7月29日にGoogle Flow Musicで発表し、2026年9月4日からはGeminiアプリ(ウェブ・モバイル)、Gemini API、Google AI Studio、Google Vidsでも利用できるようになりました。利用可否は地域やアカウントで異なる可能性があるため、各サービスの画面で確認してください。

Q. 何分までの曲を生成できますか?

Google DeepMindの公式ページでは最長3分と案内されています。60秒など、プロジェクトに合わせた長さも指定できます。

Q. Lyria 3.5で作った曲は商用利用できますか?

用途、地域、契約プランにより条件が変わり得ます。公開時点のGoogle Flow Music利用規約を確認し、第三者の権利を侵害しないか社内でも審査してください。

Q. SynthIDがあれば著作権確認は不要ですか?

不要にはなりません。SynthIDはAI生成物を識別する透かしであり、歌詞、声の類似、商標、既存作品との関係を審査する仕組みではありません。

Q. Gemini APIの料金はいくらですか?

Gemini APIの料金ページでは、Lyria 3.5は1曲あたり0.08ドルで、無料枠は無いと案内されています(2026年9月時点)。最新の料金・提供条件は公式ページで確認してください。

まとめ

Lyria 3.5は、最長3分の楽曲生成に対応し、音楽性、歌詞、ボーカル、テンポと長さの制御を改善しました。2026年9月4日からはGeminiアプリとGemini API(1曲0.08ドル)でも利用できるようになり、企業では、広告や商品デモの完成音源を無人で作るより、企画初期の仮音源を比較する用途から始めると評価しやすくなります。

導入時は、生成速度だけでなく、権利確認と承認にかかる時間も測定してください。30秒の社内向け仮BGMを一つ作り、従来工程との比較を残すことが最初の一歩です。

参考情報


AI導入に関するお困りごとをサポートします

株式会社NexaのAI顧問は、ツール選定から業務への適用、社内定着までを月額制でサポートします。特定のツールに限らず、「AIをどう使えばいいか分からない」という段階からご相談いただけます。

AI顧問の詳細・無料相談はこちら →





この記事で参照した外部情報

  1. Google公式ブログ: Introducing Lyria 3.5 in Google Flow Musicblog.google
  2. Google DeepMind: Lyria 3.5deepmind.google
  3. Google DeepMind: Lyria 3.5 Model Carddeepmind.google
  4. Google公式ブログ: Create your best tracks yet with Lyria 3.5 in Geminiblog.google
  5. Gemini API 料金ページ(Lyria 3.5)ai.google.dev

本文中でリンクしている外部ページの一覧です(自動生成)。最終確認日は本記事の最終更新日 2026-09-30 で、リンク先の内容はその後変わることがあります。

AI導入を検討中の方へ

AIの力で、ビジネスを次のステージへ

まずはお気軽にご相談ください。貴社に最適なAI活用プランをご提案します。