先講答案:趕件的話,掛一個低通濾波器把 10 到 12kHz 以上砍掉,疊一層乾淨的 shaker 或 hi-hat 補回高頻,人耳自己會忽略底下的瑕疵,這是最快的解法。時間夠、想做得乾淨,就得用工具把噪音那一層真的挖掉,往下看。
先確認:這是不是「毛毛的」那種雜訊
Suno 生出來的歌,高頻常有一層毛毛的、沙沙的東西,跟麥克風收到的環境噪音或電流聲不是同一種。它的學名叫擴散模型的頻譜殘渣(spectral artifacts),是模型在高頻隨機填音訊、假裝很亮留下的碎渣。它麻煩在會跟人聲一起呼吸,所以不能當一般白噪音處理,硬砍高頻只會讓整首歌變悶。分清楚是哪一種,才知道該用哪個工具。
最快:高頻置換術
趕件時我會用這招。伴奏掛一個 LPF(低通濾波器,把某個頻率以上切掉)砍在 10 到 12kHz,聲音會變悶但瞬間乾淨,然後疊一層乾淨的 shaker 或 hi-hat 把高頻補回來。人耳對高頻的解析度本來就低,大腦會自動忽略底下那些瑕疵,這招快,但騙得過耳朵騙不過細聽。
好一點:SpectraLayers 拆出噪音層
我最常用的是 SpectraLayers 的 Unmix Components(把聲音拆成三種成分,不是拆樂器)。它會分成 Tonal(旋律類)、Transient(打擊瞬態)、Noise(噪音)三層,我只動 Noise 那層,把它音量拉低約 −10dB,或對它的高頻做 EQ 衰減,鼓和樂器那兩層原封不動。這樣清得乾淨,又不會傷到主體,是我用得最多的方法。
最徹底:iZotope RX 精修
要更細就上 iZotope RX 的 Spectral De-noise(頻譜降噪),模式切 Adaptive(自動適應,不用 Learn 抓樣本)。Threshold(觸發門檻)抓 −10 到 −20dB,Reduction(衰減量)6 到 8dB 就好。下手太重會出現「水底音」,那種咕嚕咕嚕的假象比雜訊還難聽,寧可留一點也別過頭。混音階段的插件順序我怎麼排,另一篇有講(Suno 生成後怎麼混音)。
清完之後別忘了補一步
清完噪音,人聲高頻常會跟著「死」掉,聽起來悶悶的。這時掛一點 saturation(飽和,加好聽的泛音),輕推 presence 那段,用漂亮的諧波把質感填回去,人聲就活過來了。這個悶悶的問題其實不只 Suno 會有,AI 生成的人聲整體處理,我在另一篇也整理過(Suno 生出來的歌聲很數位、很毛)。
常見問答
這雜訊跟一般收音的底噪是同一種嗎?
不是。收音底噪是穩定的環境噪音,Suno 這種是模型在高頻隨機填出來的頻譜殘渣,會跟著人聲的呼吸起伏,不能用同一套降噪邏輯處理。
用高頻置換術會不會被聽出來偷懶?
一般聽眾用手機或耳機聽,幾乎聽不出來,因為人耳對高頻的解析度本來就低。但如果是要上串流、給挑剔的耳朵聽,建議還是用 SpectraLayers 或 iZotope RX 處理得更乾淨。
降噪之後人聲變悶,是哪裡沒做對?
八成是降噪拉得太重,把高頻的細節一起清掉了。先把 Reduction 調輕一點,寧可留一點雜訊;再補一點 saturation 把泛音填回去,人聲就會活過來。
---
我是陳則皞,音樂製作人,平常在做編曲、混音、客製化歌曲,也教寫歌。Suno 生出來的歌聽起來毛毛的、悶悶的,帶著檔案來聊最快,從 45 分鐘諮詢 開始;想從頭把一首歌做完整,看 完整製作流程。