
谷歌推出 Lyria 3.5 音樂生成模型:在 Gemini 應用與 API 中提供更具表現力的聲音
Google 於本週正式在 Gemini 手機應用與公開 API 中上線全新 Lyria 3.5 音樂生成模型。相較於前代版本,Lyria 3.5 能夠產出更具情感的歌聲與更豐富的編曲,使用者只要在 Gemini 介面選擇想要的音樂類型與風格,即可快速生成短片段或完整曲目,亦支援純人聲或純樂器兩種模式。
背景與技術說明
Lyria 系列是 Google 內部開發的生成式 AI,專注於音樂創作。Gemini 為 Google 最新的多模態 AI 平台,將文字、影像與音訊模型整合於同一介面。此次 Lyria 3.5 透過 Google Flow Music、Google AI Studio(供開發者調用)以及 Google Vids(影片編輯工具)同步提供,讓從普通使用者到專業開發者皆能即時使用。
值得注意的是,Google 表示 Lyria 3.5 的訓練資料僅來自已取得授權的音樂內容,與競爭對手 Suno 以公開資料為基礎的做法形成對照。雖然 Google 未透露具體的資料來源或模型參數,但已明確指出模型在聲音表現力與編曲層次上有明顯提升。
可能的產業影響
-
內容創作者:透過內建的「背景音樂」與「生日歌」範本,即使沒有音樂基礎的使用者也能在數分鐘內完成配樂,降低製作門檻。
-
廣告與行銷:即時生成符合品牌調性的音樂,可加速廣告素材的產出與 A/B 測試。
-
開發者生態:API 的開放讓第三方應用程式能將 AI 音樂直接嵌入,如遊戲、教育平台或社交媒體,擴大了 AI 音樂的商業應用範圍。
未來展望與讀者啟示
Lyria 3.5 的上線標誌著生成式音樂技術從「實驗室原型」逐步走向「即服務」階段。未來若 Google 持續擴充授權資料庫與模型容量,預計會出現更長篇幅、跨語言、甚至可自訂歌詞的高階功能。對於音樂產業的從業者而言,掌握 AI 生成工具的操作與版權管理將成為新必備技能;而對一般使用者,則可期待在日常生活中更頻繁地遇見「AI 作曲」的創意驚喜。
結語:Lyria 3.5 讓聲音的創作不再受限於傳統錄音室與編曲師的時間成本,Google 以授權資料為基礎的訓練策略也為 AI 音樂的合法性樹立了新標桿。隨著 API 生態的成熟,未來音樂創作將更加民主化,也將為各行各業帶來前所未有的音訊創新可能。