Google Flow Music 推出 Spaces,用文字製作音樂外掛

Google Flow Music 的 Spaces 讓製作人描述想要的樂器或效果,再匯出 VST3、AU 外掛到音樂工作站使用。本文說明它與直接生成歌曲的差別。

Share
Google Flow Music 公告中的音樂製作人照片
Google Flow Music 公告中的音樂製作人照片。 圖片來源:https://blog.google/innovation-and-ai/models-and-research/google-labs/create-music-production-plugins-google-flow/

Google 在 10 月 6 日介紹 Flow Music 的 Spaces,讓音樂創作者用自然語言描述需要的樂器與效果,建立可放進既有製作流程的音樂外掛。

例如,一段旋律已經錄好,但製作人希望增加某種質感或做出特殊音色,就能把需求寫成描述。這項工具的焦點落在製作環節中的小工具,讓 AI 參與聲音調整,而非只交付一首完整歌曲。

Spaces 把聲音需求變成可操作工具

官方將 Spaces 描述為建立自訂樂器與效果的環境。創作者可用文字表達想要的聲音,再調整產生的工具,讓它符合自己的音樂想法。

這類使用方式適合有明確製作需求的人。描述不只需要說「好聽」或「有氣氛」,還可以指出希望改變的音色、節奏感或處理方式。需求越具體,越容易判斷結果是否符合目的。

外掛可回到既有音樂工作站

Spaces 支援匯出 VST3 與 AU 外掛。這兩種格式是音樂軟體常用的外掛介面,讓樂器或音效處理工具可以被載入數位音樂工作站,也就是錄音、編曲與混音的主要軟體。

對製作人,這個出口讓新工具能與既有曲目一起使用。實際能否載入,仍要看工作站、作業系統與外掛格式的支援情況,不能只看到格式名稱就推論所有軟體都相容。

Google Flow Music 官方影片,展示製作人如何建立自訂音樂外掛。 影片來源:Google Flow Music。

官方示範聚焦製作人的創作過程

Google 的介紹邀請製作人 Khris Riddick-Tynes 展示如何使用這套工具,並以「No Chaser」相關創作為例,呈現自訂音樂工具在製作中的角色。

這種示範的價值是讓人看到工具如何進入工作流程,而不是替所有音樂風格做出品質保證。創作者仍要自行聆聽、修改並決定要保留哪些聲音,AI 產生的效果不會自動符合一首作品的混音需求。

音樂 AI 開始從作品走向製作工具

我的判斷是,Spaces 比較吸引已經在做音樂、卻常找不到合適外掛的人。它降低了嘗試自訂工具的門檻,也讓聲音想法有機會直接變成可操作的控制介面。

能否長期使用,接下來要看外掛的穩定性、調整空間與匯出後的表現。這些因素會決定工具能否留在正式製作流程,並非一段成功示範就能回答。

先說清楚要改變哪一種聲音

用文字建立音樂工具時,需求可以從已有素材出發。想讓鼓聲更有空間感、讓某段旋律呈現不同質地,或建立一個可調整的樂器,都是不同方向。先知道要改什麼,比只說「更好聽」容易判斷。

可以先播放目前作品,找出最需要處理的一段,再用語言描述缺少的效果。描述中包含輸入是什麼、希望發生什麼變化,以及哪些特點要保留,會讓試作更集中。

這不表示文字能夠完全替代聽覺。聲音是否適合,仍要在實際作品中聆聽。文字提供目標,耳朵與製作判斷負責確認結果,兩者適合一起工作。

我會先選一個小範圍聲音問題,讓 Spaces 產出工具並嘗試調整。若目標太大,例如一次改變整首作品的全部風格,就很難知道哪一個修改真的帶來幫助。

樂器與效果外掛,處理聲音的位置不同

樂器外掛主要用來產生聲音,效果外掛則處理已經存在的聲音。兩種工具都可能進入音樂工作站,但在製作中的角色不同,使用者應先知道需要的是新的音色,還是對錄好的內容做變化。

例如已有一段人聲,希望改變空間或質感,就比較接近效果處理。若想用新的聲音演奏旋律,則需要樂器方向。這裡是幫助理解的情境,並非官方替所有型別提供完整功能保證。

需求明確之後,工具控制也比較容易設計。使用者可以要求少量關鍵參數,讓每個調整都與目標有關。太多旋鈕可能讓畫面看起來專業,卻增加找到適合聲音的難度。

我認為自訂工具的價值,在於讓控制方式符合個人想法。它不一定需要比現有外掛複雜,只要能穩定解決一項製作問題,就可能值得保留。

自然語言也可以說明控制介面

製作外掛不只關乎聲音,還包括創作者如何操作。參數名稱、調整範圍與預設狀態,都會影響工具能否在創作中快速使用。若每次都要猜某個旋鈕代表什麼,便利就會下降。

可以用文字要求控制數量與用途,例如希望一個主要旋鈕改變效果強度,其他參數處理細節。這是設計建議,實際支援方式仍要依 Spaces 的當前功能與輸出確認。

也應考慮初始狀態。剛載入工具時,如果聲音變化太強,可能不容易比較原始素材。讓使用者能從清楚起點逐步調整,通常更適合反覆試用。

我會把聲音結果與介面可理解性一起檢查。一個效果很有趣,但無法穩定重現,可能只適合單次實驗。控制清楚,則更有機會成為日常製作工具。

匯出 VST3 與 AU 後,回到自己的工作站測試

官方說明支援常見外掛格式,讓創作者把工具帶回已有環境。這個出口很有意義,因為許多人已經在固定工作站錄音和混音,不希望為了新工具重新搬動整首專案。

不過,支援格式名稱只是相容性的第一步。工作站、系統與外掛版本是否符合條件,仍需要實際載入確認。本文沒有列出所有可用軟體,也沒有將格式支援寫成全面相容保證。

第一次可以在測試專案裡載入,先確認聲音輸出,再儲存、關閉並重新開啟。工具能在當次工作,和專案下次開啟時仍保持相同狀態,是不同檢查點。

我會把穩定往返作為正式採用條件。若作品已經需要交付,就應先確認外掛與檔案能被可靠儲存,而不是只依生成頁面裡的一次預覽決定。

比較效果時,儘量保留相同素材與條件

聽覺很容易受到音量與上下文影響。比較新工具前後,可以使用同一段素材,交替聽原始與處理後的版本,觀察變化是否符合目標,而不只是因為更響就覺得更有力量。

也應在整首作品中聽。單獨播放某個音色很漂亮,放進歌曲後卻可能與其他聲部重疊。工具要服務實際作品,因此比較應包含它在整體編曲中的位置。

如果需要反覆調整,可以記錄有用參數與版本。這樣下次回到作品時,知道哪一組設定符合需求,不必從頭尋找。這裡提供的是一般製作方法,沒有替任何生成結果評定音質。

我認為 AI 的優勢可能在快速試作,讓過去需要更多工程時間的想法能更早被聽見。但決定是否留下,仍需要在實際素材與作品目標中判斷。

官方製作人示範,可以看方法而非照搬聲音

Google 的示範讓創作者看到一位製作人怎樣把工具放進工作。觀看時,可以注意他如何描述需求、選擇調整方向與判斷結果,而不只記住最後聽起來是什麼風格。

如果自己的作品型別不同,就應重新選擇目標。某個效果適合一段節奏或音色,不代表放進所有音樂都合適。示範提供的是工作可能性,實際作品仍需要自己的判斷。

也不必為了重現展示而複製全部元素。較實用的學習方式,是理解工具如何連線到工作站,以及每次調整對應哪個問題,再用自己的素材練習。

我會把官方影片當成流程資料。它幫助理解產品方向,但不會代替長期穩定性、具體相容條件或某個創作者自己的試聽結果。

自訂外掛也需要清楚的專案管理

當一個專案使用多個自訂工具,名稱與版本會變得重要。可以讓工具名稱說明用途,並保留生成時的需求描述,之後發現問題時才能知道它原本要解決什麼。

若修改了工具,也應區分新舊版本。舊專案可能依賴舊設定,直接替換會改變聲音。是否支援相應版本管理,應依工具實際功能確認,使用者也可以在自己的資料整理中保留必要記錄。

合作時還要確認其他成員能否取得相同工具與條件。自己電腦能播放,不等於交給別人後也會得到同樣結果。可交付檔案、依賴與輸出方式都應事先整理。

我認為這是自訂工具走向正式製作的一道關卡。產生工具變得容易之後,儲存、重現與協作仍是專業工作的重要部分,不能因為使用 AI 就省略。

從實驗到正式作品,先找可重複的價值

Spaces 很適合用來探索聲音想法,但每個實驗不必都進入作品。可以先保留少量真正有用的工具,觀察它們是否在不同素材上仍容易調整,而不是每次都重新生成一套。

衡量效益時,可以記錄從想法到可試聽工具花多少時間,以及最後是否減少尋找和試用現有外掛的工作。若生成之後需要大量修正,也應把這部分計入。

對創作者,我會從一項具體聲音需求開始。完成後檢查載入、試聽與儲存,再決定是否擴大用途,這樣比較容易知道 AI 幫助的是試作、控制設計還是實際製作。

Flow Music 的這次更新把音樂 AI 延伸到工具層。它最有意義的前景,是讓創作者把自己的聲音需求變成可操作、可儲存的工作方法,接上原本已經熟悉的製作環境。

把一個有用效果整理成可再次使用的聲音筆記

當某個工具符合目標,可以儲存簡短筆記:它處理什麼素材、哪些參數最有用,以及放進作品後的限制。這樣下次使用時,不必重新回憶當初為什麼產生這個外掛。

也可以保留原始與處理後的對照,幫助合作成員理解變化。對照應使用相同素材,說明當前設定,而不是只給一段離開上下文的漂亮聲音,讓別人難以判斷是否適用。

如果之後修改工具,筆記也應更新。版本改變可能影響聲音,尤其舊作品需要重新開啟時,更要知道用的是哪一份。本文沒有將自訂工具視為自動儲存所有創作背景的系統。

我認為這類小型記錄會讓 AI 試作更容易累積。不是每次從零產生新效果,而是把真正有效的方法留成可重用資源,讓新的生成能力進入長期製作習慣。

Flow Music Spaces 常見問題

它主要是用來直接生成整首歌嗎?

這次公告介紹的是自訂樂器與效果外掛。它可參與歌曲製作,但重點在可被調整與重複使用的工具,而不是只輸入一句話就交付完整歌曲。

匯出後一定能在我的音樂軟體使用嗎?

要先確認軟體與系統支援 VST3 或 AU,以及外掛的其他相容條件。正式專案使用前,應在自己的工作站試載入並確認聲音輸出。

結語:讓聲音想法接上製作流程

Spaces 提供的方向,是把文字描述變成音樂製作中的樂器與效果。對創作者,最值得觀察的是它能否可靠地支援反覆調整,讓新音色真正成為作品的一部分。

延伸閱讀:想了解讓程式呼叫音樂模型的 API 介面,可讀 Google AI Studio 正式上線 Lyria 3.5 音樂生成模型:支援 3 分鐘完整曲式結構、Gemini App 與 API 同步開放

資料來源