還以為 AI 歌曲只能抽盲盒?
以前跟 Suno 說「男聲抒情」,常常唱得像解放軍唱軍歌,慷慨激昂、字正腔圓。換成女聲,又很容易往 Celine Dion、Mariah Carey 那種大開大闔走,不然就是滿滿哭腔。
這其實是模型訓練偏差。模型從一開始,就會受到訓練資料的影響,偏向某些特定的唱法;更麻煩的是,訓練者對歌曲結構的誤解,也會寫進模型裡。
之前看到一位 AI 音樂專家談副歌。他說副歌就是要和主歌作區隔,通常就是拉高音階,這樣整首歌才有層次、比較好聽。這是嚴重的認知偏差。
副歌當然要和主歌作區隔,但區隔的方法很多。可以用文字密度、節奏、旋律、和聲、配器、力度、情緒來做,不一定要拉高音。古風、敘事歌尤其如此。主歌把話說清楚,副歌把話說進心裡,音域可以幾乎不動。模型如果認定「副歌=往上衝」,抒情就會變成喊,層次也會變成音高表演。
後來我換方法:先自己把基本旋律唱出來,再餵給 Suno 建自訂模型。操作介面有寫,最低 6 首,建議 24 首以上效果比較好。我就準備了 24 首。
其實只是同一份複製 24 份,讓它以為人類就是這樣唱歌。😄
之後生成時直接用這個模型。很幸運,大約九成能跟著我原本唱的旋律走。所以《三問朱泥》不能說 100% 獨立作曲,因為 Suno 還是會修正、補充一些旋律,但這一版,大約 90% 以上的旋律走向,是我先唱出來的。
到了 V6,路就更直了。人類作曲,AI 協助編曲、演唱。您可以自己把旋律哼出來,或在 Suno Studio 寫出主旋律、產生 MIDI,再叫它依這條旋律生成,編曲也能在 Studio 裡改。
最近做的《千里共嬋娟》就是 V6 生成。原本鼓太強,我把前半段鼓壓低,人聲拉到前景,整個聽起來才像在錄音空間裡唱,而不是在鼓裡喊。
詞曲可以是人的,Suno 負責把歌唱完、編成能聽的樣子。
可以聽聽看《三問朱泥》和《千里共嬋娟》,和您認知的那種大吼大叫的 AI 音樂有何不同。
不喜歡古風?沒問題,那就聽聽這首《聲聲慢》。
簡單地說,
您當然可以一鍵生成 AI 歌曲,但不是每個人都是這樣寫歌。
也不要看到別人寫「作詞作曲,AI 編曲」,就認定別人在說謊。




























































































