Google AI 音樂新突破:Lyria 3 Pro 賦能 3 分鐘創作,細緻掌控旋律結構

Google DeepMind 於 25 日推出全新音樂生成模型 Lyria 3 Pro,將 AI 音樂創作推向新里程碑。相較前代 Lyria 3 僅支援 30 秒,Lyria 3 Pro 大幅提升至最長 3 分鐘的音軌生成能力,並提供前所未有的細緻結構控制,讓創作者能精準指定前奏、主歌、副歌等元素,開啟 AI 音樂創作的更多可能性。

劃時代的 AI 音樂創作能力

Lyria 3 Pro 的發表,標誌著人工智慧在音樂生成領域的顯著進步。此模型不僅延長了 AI 音樂的生成長度,從 Lyria 3 的 30 秒躍升至最長 3 分鐘,更在創作控制與客製化方面提供強大支援。使用者現在可以透過提示詞(prompt)精確指定音樂的不同組成部分,例如前奏、主歌、副歌,甚至是連接主歌與副歌的橋段(bridge)。這項功能得以實現,主因是 Lyria 3 Pro 對於音樂結構的理解遠優於其前身。

這項技術的突破,讓音樂創作者能夠更深入地參與到 AI 生成的過程中,不再僅限於簡單的風格或情緒指令。透過對曲式結構的細部掌控,AI 音樂作品的複雜性與藝術性將有望大幅提升,為專業音樂人與業餘愛好者帶來更豐富的創作工具。

權威數據與創作倫理的堅守

Google 強調,Lyria 3 Pro 的訓練數據來源嚴謹且合法合規,主要來自合作夥伴提供的資料,以及經授權的 YouTube 與 Google 平台內容。此舉旨在確保模型的運作符合著作權規範,並保障創作者的權益。值得注意的是,該模型不會模仿特定歌手的風格,但若使用者在提示詞中指定某位歌手,系統將會從該歌手的作品中汲取靈感來生成新的音樂。

Google DeepMind 團隊表示:「我們致力於發展負責任的 AI 技術,Lyria 3 Pro 的訓練數據皆來自合法管道,並融入了不模仿特定歌手的設計理念,以維護音樂創作的公平性與原創性。所有透過 Lyria 3 及 Lyria 3 Pro 創作的音樂,皆會自動嵌入 SynthID 數位浮水印,明確標示其為 AI 生成內容,確保透明度。」

數位浮水印 SynthID 的應用,是 Google 在 AI 生成內容透明化方面的重要措施。這項技術能夠在 AI 生成的音樂作品中嵌入無法被感知但可被偵測的數位標記,有效區分人類創作與 AI 輔助生成內容,進一步建立負責任的 AI 生態系統。

Gemini 應用整合與未來展望

Lyria 3 Pro 的音樂生成能力,已進一步導入 Google 的 Gemini 應用程式中。這意味著 Gemini 的使用者現在可以利用 Lyria 3 Pro 的強大功能,直接在應用程式內創作更長、結構更複雜的 AI 音樂。這項整合不僅提升了 Gemini 的多媒體創作能力,也讓 AI 音樂的觸及範圍更加廣泛。

此次升級為音樂產業帶來以下潛在影響:

  • 提升創作效率:音樂人可快速生成概念、編曲片段,節省大量前期製作時間。
  • 拓展創作邊界:提供非專業人士探索音樂創作的機會,降低技術門檻。
  • 倫理與版權挑戰:AI 生成音樂的版權歸屬及潛在濫用問題,仍是業界持續關注的焦點。
  • 透明度標準化:SynthID 數位浮水印有助於建立 AI 內容的識別標準,維護市場秩序。

隨著 Lyria 3 Pro 等先進模型的問世,AI 在音樂領域的角色正從單純的輔助工具,轉變為能夠共同參與創作過程的「智慧夥伴」。這不僅將重塑音樂製作流程,也可能催生出全新的音樂風格與商業模式,值得業界持續觀察與探索。