None
JA
Google「Lyria 3.5」はAI音楽市場を変えるか―歌声・歌詞の進化と著作権訴訟で揺れるSuno・Udioとの競争を分析
[]
財経新聞:最新ニュースフィード
Google DeepMindは、Google Flow Music向けAI音楽生成モデルの最新版「Lyria 3.5」をリリースした。歌声の表現力や歌詞の一貫性を高め、テンポと曲の長さをより正確に制御できるようにした。競合するSunoとUdioが著作権訴訟を抱えるなか、Googleはライセンスに基づく学習データと電子透かし技術「SynthID」を構造的な強みとして打ち出している。アップデートはすべてのGoogle Flow Musicユーザーに追加料金なしで提供されている。■Lyria 3.5の変更点Googleの公式発表によると、今回のアップデートは4つの領域に及ぶ。2026年2月以来、Lyriaにとって3度目となる重要なアップデートであり、GoogleがAI音楽を単なる研究実験ではなく、優先度の高い製品分野として扱っていることを示す開発ペースだ。音楽性:より豊かで複雑なメロディー構造を生成し、トラック全体を通して、より自然に聞こえるようになった。これは、最初の30秒を過ぎるとメロディーのループが機械的、あるいは反復的に感じられるという、従来のLyriaに対する根強い批判に直接応えるものだ。歌詞:Googleが「プロンプトへの忠実性と構造認識の向上」と説明する、より高品質な歌詞を生成する。実際には、文法的には正しくてもテーマ性に乏しい歌詞ではなく、ユーザーが指定した雰囲気、物語、ジャンルに沿った歌詞を生成できる可能性が高まったことを意味する。ボーカル:より現実感があり、感情のニュアンスに富んだ歌唱と、発音の改善を実現した。これは、英語以外の歌詞、ジャンル固有のボーカルスタイル、あるいは単に正しい音程で歌うことよりも表現力が重視されるコンテンツを制作するクリエイターにとって、特に重要な改善だ。クリエイティブコントロール:ユーザーはテンポと曲の長さを、これまでより正確に設定できるようになった。従来のLyriaによる出力を楽曲のアイデアや下書きとしては有用と感じながらも、構成のある楽曲に使用するには予測しにくいと考えていたプロデューサーにとって、実用的なアップグレードとなる。■AI音楽生成の仕組みとLyriaの違いLyriaが競合モデルとどのように異なるのかを理解するには、その基盤となる技術を見る必要がある。Lyria 3.5は、前身のLyria 3およびLyria 3 Proと同様に、48kHz、16ビットPCMのステレオ音声を出力する。プロ向けの音楽制作にも用いられる品質だ。基盤となるシステムは、単一のモデルだけで構成されているわけではない。Lyriaが音声生成を担い、Geminiがクリエイティブプロンプトを解釈するための自然言語理解を提供し、VeoがFlowの広範なエコシステムにおける映像要素を処理する。Googleが2026年2月に買収したスタートアップのProducerAIは、これとは異なるアーキテクチャを採用していた。もともとのRiffusionモデルは、スペクトログラムを対象にStable Diffusionをファインチューニングし、音楽生成を画像生成の問題として扱うものだった。Googleは買収時に、このアーキテクチャを全面的にLyria 3へ置き換えた。Lyria 3 Proで導入され、Lyria 3.5がさらに発展させた構成上の一貫性は、曲のどの位置を生成しているかを認識せず、音声をトークン単位で連続生成するのではなく、イントロ、ヴァース、サビ、ブリッジなどを備えた構造的な作品として楽曲を理解するよう、モデルを学習させたことによる。Lyria 3.5のボーカル改善が何に由来するのかは、技術論文がないため特定しにくい。一方、独立した比較では、Lyria 3 Proの総合的な音質は「Suno v4.5に匹敵する」と評価されていた。Suno v5の水準にはまだ達していないものの、その差は縮まりつつある。Lyria 3.5は、Udioが従来から強みを持ってきたボーカル領域を明確に狙ったリリースだ。■SynthIDが電子透かし以上の意味を持つ理由Lyriaが生成したすべてのトラックにはSynthIDの電子透かしが付与される。しかし、SynthIDはすでに単一製品の一機能を超えた存在になりつつある。Googleの音声向け電子透かしは、心理音響マスキングを利用する。人間が知覚しにくい周波数帯域や、大きな音によって小さな音が聞こえにくくなるマスキング効果を利用し、生成時に知覚できない暗号学的信号を音声波形へ直接埋め込む仕組みだ。その結果、削除可能なメタデータタグではなく、音そのものの一部となるデジタル署名が作られる。この透かしは、128kbpsのような強いMP3圧縮、再生速度やピッチの変更、さらにはスピーカーを通した再録音にも耐えるとされる。2026年5月には、OpenAIがChatGPTで生成した画像にSynthIDによる電子透かしを採用し、NVIDIAもCosmosワールドモデルにSynthIDを統合した。SynthIDは、業界横断的なAIコンテンツの来歴証明における標準になりつつある。このためLyriaで生成された音楽は、ストリーミングプラットフォーム、権利管理団体、規制当局が自動検出やポリシー適用に利用できる、検証可能な管理・流通履歴の中に位置づけられる。DeezerのAI検出システム、SpotifyのAI Credits開示フレームワーク、TIDALが7月15日に導入したAIラベル付けポリシーは、いずれもAI生成音声を識別できることを前提としている。SynthIDは、Googleが生成した音声を確実に識別可能にするための仕組みだ。SunoとUdioはSynthIDを使用していない。■Lyriaの開発ペース今回のリリースは、5カ月間で3度目となるLyriaの重要なアップデートだ。Android Centralの報道によると、Lyria 3は2026年2月18日に公開された。18歳以上のユーザーを対象に、Geminiアプリを通じ、テキストまたは画像プロンプトから、歌詞、ボーカル、カスタムカバーアートを含む48kHzの高音質トラックを30秒間生成できるモデルだった。Lyria 3 Proは2026年3月25日に続いて公開され、トラックの最大時間を3分に延長した。さらに、本格的なフルレングス楽曲と単に引き延ばされたループを分ける、楽曲構成の認識機能を導入した。Googleは、Geminiアプリ、Google Vids、ProducerAI(現在のFlow Music)、Vertex AI、Gemini API、AI Studioという6つのプラットフォームで、Lyria 3 Proを同時に展開した。Lyria 3.5はLyria 3 Proの基盤を発展させ、曲の長さや提供範囲の拡大ではなく、表現の品質向上に重点を置いている。■Google Flow Music:プラットフォームの現状Lyria 3.5が提供されるGoogle Flow Musicは、ProducerAIを改称し、再構築したプラットフォームだ。ProducerAIは以前Riffusionとして知られ、Googleは2026年2月に同サービスをGoogle Labsの傘下に加えた。Google Flow Musicでは、テキスト、画像、オーディオ、音声プロンプトから曲を生成できるほか、既存トラックのリミックス、セクション単位での楽曲編集、歌詞の直接的な書き換え、作品の公開、共有可能なワークスペースを通じた共同作業が可能だ。2026年5月、GoogleはTuneCoreを傘下に持つグローバルなアーティスト支援企業Believeと提携し、Believeに所属するアーティストやソングライターへFlow Musicを直接提供した。この提携は、GoogleがFlow Musicを単なる一般消費者向けの実験的サービスではなく、プロおよびセミプロの音楽制作を支える基盤として位置づけようとしていることを示す。Flow MusicはGoogle Vids、Google AI Studio、Vertex AI、Geminiアプリとも連携する。この提供範囲の広さは、SunoやUdioにはないGoogleの強みだ。■ライセンスされた学習データが構造的優位性となる理由Googleが最も明確な差別化要因として強調しているのが、学習データの来歴だ。Lyria 3 Proと、それを基盤とするLyria 3.5は、YouTubeとGoogleが利用規約、パートナー契約、適用される法律に基づいて利用する権利を持つ素材を用い、ライセンスに基づくデータで学習している。Googleによると、モデルは特定のアーティストの声や楽曲カタログを複製するものではない。この違いは2026年の市場環境において極めて重要だ。AI Vortexの訴訟状況トラッカーによると、全米レコード協会(RIAA)は2024年6月、Sony Music、Universal Music Group、Warner Music Groupを代表し、SunoとUdioの両社を相手取って著作権訴訟を起こした。Universal Music Groupは2025年10月にUdioと和解し、Warner Music Groupは2025年11月にSunoと和解した。しかし、Sony Music Entertainmentはいずれとも和解しておらず、両社を相手取った訴訟は現在も続いている。TechTimesの報道によると、SonyとUniversalが、具体的に特定した6万1,026件の録音物を対象に訴えを拡張する動きを見せたことで、Sunoが負う可能性のある法定損害賠償額は最大で数十億ドル規模に達し得る。またTechTimesによると、2026年7月に流出したSunoのソースコードから、同社がプロキシツールを使い、YouTube Music、Deezerなどのストリーミングプラットフォームから音声をストリームリッピングして学習に利用していたことが確認されたという。同社はこの行為自体を否定しておらず、法務チームは、この方法はDMCA(デジタルミレニアム著作権法)で禁止されていないと主張している。商用コンテンツを制作するクリエイター、ブランド、映像作品などへの楽曲利用を扱うシンクライセンス事業者、エンタープライズ用途にとって、こうした訴訟は現実的なリスクとなる。Googleは、ライセンスに基づく学習データの採用によって、自社モデルをこのリスクから切り離そうとしている。■Lyria 3.5の競争環境における位置づけMusic Business Worldwideによると、Sunoは定量的な指標で市場をリードしている。2026年2月時点で有料会員は200万人、年間経常収益は3億ドル(約492億円、1ドル=164円換算)に達し、サービス開始以来の利用者は1億人を超える。Sacraによると、2026年6月時点におけるSunoのシリーズDでの評価額は54億ドル(約8,856億円、1ドル=164円換算)だった。独立系コミュニティーのベンチマークでは、2026年初頭のSuno v5のEloスコアは1,293で、音質、楽曲構成、ボーカルの現実感において競合を上回ったとされている。元Google DeepMind研究者らが設立したUdioは、引き締まった低音表現、楽器を認識した生成、楽器やボーカルを個別の音源へ分離するステム分離機能によって、エレクトロニックミュージックのプロデューサーから支持を集めてきた。2026年初頭のコミュニティー比較では、ボーカルのタイミングと音作りの明瞭さが重要になるエレクトロニック、ヒップホップ、ポップの各ジャンルで、UdioがSunoより品質面で優位にあると評価された。Lyria 3.5以前のGoogleの優位性は、音質面での市場リーダーシップではなく、提供先の広さにあった。今回のボーカルと歌詞の改善は、Udioが強みを