雜文

Suno.AI 與初次嘗試寫詞

約 4 分鐘讀完
人工智慧與創作 工作與創作 語言與信念

連續兩個假日我都把時間花在Suno.AI上。也整理出這個AI對我來說有什麼用處。覺得可以分享一下。

因為要玩這個AI,我算是第一次動手寫詞。光是來來回回跟它輸入輸出,我的詞就改了好多好多遍,有趣的是因為它會馬上回我一段音樂,所以過程中我覺得自己有慢慢在進步,第一次寫出來的東西跟這個第八版本比起來差了蠻多。在文字部分,我這次只考慮了押韻問題,但前幾天洗澡時我突然想到中文其實有平仄聲問題,而且歌詞敘事性其實要更強一點會比較有趣。這些都可以作為以後努力的方向先筆記起來。

Suno要說它做出一段音樂,我覺得不太適當。它可能更像樂器,因為它輸出的音樂並不像傳統上我們用MIDI數位編曲輸出的音樂,聲部有很明顯的差異。它更像是一次思考一整段音樂,它可能沒有和弦、Bass、節奏、人聲這種基本的分佈概念,它只知道怎樣全部一起出。所以它出出來的人聲很薄,被淹沒在整個音場裡面不太明顯,和弦跟低音部分也很單調,如果是慢歌節奏通常就一三拍放個重音就結束了。

大概在第四版本的時候,我突然想也許我可以用工具把人聲抽出來強化再塞回去。所以我就把Suno的產出物拿去給 Lala.AI 請它幫我把人聲跟背景音分離。抽取出來的音訊檔我再拿去 Ableton Live 裡面去疊音,做出左右音場跟補上中音頻率。這樣操作人聲是有明顯強化,但廉價的聽感還是沒辦法消除。

後來我想,既然我可以分離人聲,我應該也可以重新幫整首歌編曲。所以我就把Suno丟出來的歌,放到 scaler2 裡面去做和弦分析。想說用簡單和弦進行,幫背景音樂重新編曲好了。

我本來的算盤是用Ableton Live 裡面的Magenta Studio AI工具隨便搞點和弦節奏襯底就好,只要能把音場弄好一點就好。結果!AI就是AI,把背景音拆出來以後,我發現它思考音律的方式跟人類不太一樣,它根本沒有在管十二平均律,有很多段音樂根本不在調上,要幫他找一個合理的調式已經超過我這個半吊子的樂理知識了。但我想AI音樂搞不好未來會讓十二平均律不再統治所有音樂?畢竟 Ableton Live 最新的12 也更新了很多支援非傳統音律的支援功能,搞不好因為AI未來音樂會有很大變化?

後來我想,那我是不是可以從被分離的人聲下手重新編曲?我把人聲丟到 ACE studio 這個虛擬AI 歌手工具中,想說既然Suno會跑掉,我就先把人聲MIDI化以後,再把跑掉的音都拉回某個調式中,之後再用AI歌手輸出音樂,再根據那個調式去生出後面的整組編曲,搞不好可行?

所以我就去用了ACE studio 好幾天。在調整過程中我發現ACE的歌手不愧是專門做人聲歌唱的歌手AI,它需要換氣!而Suno的歌聲是不考慮換氣的,所以ACE的歌手會唱出快要斷氣或者長到人一聽就不合理的長度,有種恐怖谷的不舒服。

後來我嘗試在ACE中重新建立每一句歌詞的長短跟人聲換氣節奏。整體聽起來順暢很多。但有趣的是,我把所有音都拉回某個調裡面,聽起來就很平還不如Suno一開始自己做得好。我覺得問題是我陷在它一開始給我的框架裡面,而且Suno是用整體輸出來考慮音樂的,硬要把它套回人類格式以我的能力應該是還做不到。所以我決定放棄繼續搞這三分鐘的小專案,就讓它到這邊就好。

雖然已放棄收場,但其實蠻好玩的。小時候我只會彈 Bass,有很長一段時間我的夢想是可以去學編曲。但舊家裡窮,起碼在我那個時候去學編曲根本是不可能的事。那時候我是自己在網路上找資料自學,用的軟體是要打五線譜的那種。後來好不容易存了錢有去上一個月的課,然後我馬上就發現這件事我真的做不起。所以後面就沒多想,就是偶爾繼續彈彈琴。再後來誤入創業歧途,就連琴都不彈了。

Suno讓我體驗到,AI可以讓一件事的啟動成本變得很低很低。更棒的是市場上不是只有一家Suno AI,我前面描述的所有工具都是AI化的,都是好學好玩,而且可預期的未來會更好學。它不只帶動我在工具上的嘗試,也因為要玩它第一次寫詞,一度我還想說這Bass乾脆自己錄可能比較快,差點把琴拿去保養(搞不好之後會)。

下一個小專案我應該會改變作業流程,詞寫好以後就丟Suno看各種曲風跟這個詞的適性。但不會再執著要使用Suno的素材,會直接先去根據Suno得到的心得去編相應的曲風,然後到ACE裡面直接做旋律創作後再把整首歌打包。我猜應該會比這次的工作流程好很多。

音樂製作門檻變低應該是好事吧,搞不好以後每個人都能填填詞抒發個人情感,音樂回到古早的價值狀態。如果這些東西二十年前就有該有多好,想想真是羨慕現在的小朋友們。