首頁 / 資訊 / Google 將 Lyria 3.5 音樂 AI 推廣至 Gemini、API 與 Vids
Google Lyria

Google 將 Lyria 3.5 音樂 AI 推廣至 Gemini、API 與 Vids

2026年9月6日5 分鐘閱讀
Google 將 Lyria 3.5 音樂 AI 推廣至 Gemini、API 與 Vids

新聞摘要

Google 已開始向 Gemini 應用程式與 Gemini API 推出其最新的 AI 音樂生成模型 Lyria 3.5,這是該公司音訊生成技術迄今最廣泛的一次發布。這項於 2026 年 9 月 4 日(太平洋時間)宣布的推廣計畫,延續了 2026 年 7 月 29 日首度在 Google Flow Music 亮相的模型,如今將其帶給全球更廣大的日常使用者、藝術家與開發者。

Lyria 3.5 帶來哪些新功能

Google 將 Lyria 3.5 形容為其迄今音效最佳的音樂生成模型。該公司表示,相較於早期版本,新模型能呈現更具表現力的人聲演唱、更豐富的樂器編曲,以及更高的整體音訊保真度。輸出內容以 44.1 kHz 立體聲音訊生成,品質水準可比擬標準商業音樂發行;而該模型的設計目標是產出結構完整的歌曲,可包含多段主歌、副歌與橋段,而非短暫重複的循環片段。

音軌長度可調整,依據提示詞的不同,生成內容約從一分鐘到三分鐘不等,讓使用者能針對不同應用情境靈活運用,無論是短促的廣告配樂或更完整的歌曲皆可勝任。

適用平台

此次擴展同時涵蓋多項 Google 產品:

  • Gemini 應用程式 — 網頁版與行動版皆可使用,向 Gemini 的全球用戶群開放此功能
  • Gemini API — 開發者可透過 Google AI Studio 使用,將模型整合至第三方應用程式與工作流程中
  • Google Flow Music — 專為藝術家與音樂人打造的創作工具,Lyria 於七月即在此首次推出
  • Google Vids — Workspace 中的影片製作工具,讓使用者能直接將 AI 生成的配樂加入影片專案

Google 表示,此功能正逐步向全球所有 Gemini 使用者推出,而非僅限於特定地區或訂閱方案。

創作控制與應用情境

Lyria 3.5 提供多種方式讓使用者塑造所生成的音樂。使用者可以選擇或描述音樂類型,並決定要生成人聲或純樂器版本。該模型也支援圖片生成音樂功能,讓使用者上傳圖片後,由系統根據其氛圍或內容創作音軌。

在歌詞方面,使用者可自行撰寫,或要求模型圍繞特定主題產生歌詞。Google 也內建了針對常見情境的範本快捷選項,例如背景音樂、生日歌曲、自訂廣告配樂與鈴聲,旨在讓沒有音樂背景的使用者也能輕鬆上手。

在開發者方面,Gemini API 文件列出了一個名為 Lyria 3 Clip 的配套選項,可生成固定的 30 秒片段,與主要用於生成較長、更可自訂音軌的 Lyria 3.5 模型並存。請求可以文字提示的形式發送,或以結合文字與最多十張圖片的多模態輸入形式發送,生成的檔案則可回傳 MP3 或 WAV 格式。

安全性與內容溯源

如同 Google 的其他生成式媒體模型,Lyria 3.5 生成的每一段音軌都直接在音訊中嵌入了聽不見的 SynthID 浮水印。這使得日後能夠驗證片段的來源,協助聽眾、平台與權利持有者區分 AI 生成的音樂與人類錄製的音軌,同時不影響音訊的聽感。

Google 也會對提交給模型的所有提示詞套用安全過濾機制。根據 Gemini API 文件,試圖模仿特定歌手聲音或重現受版權保護內容的請求,會在生成前遭到阻擋。該 API 設計為單輪生成,意即使用者透過單一提示詞生成完整音軌,而非在多輪對話中反覆修改片段;Google 也指出,即使兩次使用相同的提示詞,各次呼叫的結果仍可能有所不同。

產業背景

此次發布反映了整個 AI 產業的普遍趨勢:將生成式音訊工具從實驗性或僅限邀請的預覽階段,推向主流的全面上市產品。透過同時在消費級聊天應用程式、專屬創作工作室、生產力工具與開發者 API 中提供 Lyria 3.5,Google 正將音樂生成定位為一項橫跨個人休閒使用、專業內容創作與第三方軟體整合的功能,而非單純的新奇獨立產品。

相關報導指出,從七月在 Flow Music 的預覽到九月的擴展,展現了相當快速的迭代節奏;Google 表示,在兩次發布相隔一個多月的時間內,人聲表現力與編曲複雜度皆有顯著提升。

Google LyriaAI 音樂生成