Google、音楽生成モデル「Lyria 3.5」を発表 – メロディ構造と歌詞の質を強化

近日、Googleは新世代の音楽生成モデルLyria 3.5を正式に発表し、当日からGoogle Flow Musicでの提供を開始しました。今回のアップグレードは、メロディ構造、歌詞の質、人声の表現、創作コントロールの4つの側面を主にカバーしています。

Lyria 3.5は音楽生成の質とユーザーコントロール能力を向上させる

音楽性の面では、Lyria 3.5はより豊かで複雑なメロディ構造を生成できるようになり、異なる段落間のつながりを改善し、生成結果がより自然に聞こえるようになりました。明確なジャンル、感情、アレンジの要求を含むプロンプトに対しても、新しいモデルはユーザーの意図をより正確に理解できるようになっています。

歌詞は今回のアップグレードのもう一つの重点です。Googleによれば、Lyria 3.5はより強力なプロンプト遵守と曲構造の理解能力を持ち、質の高い歌詞を生成できるとのことです。単にキーワードをつなげるだけではなく、新しいモデルは歌詞と曲の段落、メロディの流れとの関係をさらに処理します。

人声の面では、Lyria 3.5が生成する歌声はよりリアルで、より細やかな感情の変化を表現でき、特定の単語や文の発音も改善されています。ユーザーは曲のリズムや持続時間をより簡単にコントロールできるため、生成結果が速度、構造、長さにおいて期待から逸脱することを減らすことができます。

情報によれば、今年の2月にGoogleはLyria 3を発表し、3月末にはLyria 3 Proにアップグレードし、曲の生成時間を約30秒から3分に延長し、ユーザーが前奏、主歌、副歌などの完全な構造をカスタマイズできるようにしました。これにより、AI生成コンテンツがプロフェッショナルな制作プロセスにより近づくことが可能になりました。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle