先講答案:人聲齒音,就是 s、ㄘ、ㄙ 那些「嘶嘶」的高頻音,太重會很刺耳,它主要住在 5 到 8kHz 這一帶(更尖的可以到 10kHz 以上)。我最常用的做法,是在人聲軌開一顆動態 EQ,在那個頻段開一個「只在齒音出現時才作用」的凹槽,一顆 plugin 就解掉,不用整條掛 de-esser,也不用把音軌 bounce 出去。
這篇先講怎麼抓出齒音的位置、我實際怎麼設定這顆動態 EQ,再補一個很多人會漏掉的雷:AI 生成人聲的齒音處理。如果你要處理的是別種刺耳感,先看人聲的嘶聲好刺耳怎麼辦那篇的手剪做法,兩篇可以互相對照。
先確認齒音住在哪
頻段先抓出來:5 到 8kHz。想聽清楚齒音到底在哪、有多重,可以用 de-esser(專門壓齒音的工具)的「只聽 sibilance」監聽模式,FabFilter Pro-DS、iZotope RX 都有這個功能。它會把齒音單獨抓出來讓你聽,你就知道該處理多少,不用用猜的。
動態 EQ 一顆解掉
我的主力做法:在人聲軌開一個動態 EQ(會隨音量自動增減作用力的 EQ)的 bell(鐘形凹槽),定位在 7 到 8kHz,設成只在齒音超標的那個瞬間往下壓。
它比傳統 de-esser 好用的地方在於:即時、可以邊聽邊調、不破壞原本的聲音、不用把音軌先渲染成新檔。比起 RX 那種要出檔再處理、還容易誤殺其他內容的做法,對「一首歌裡持續會出現幾次的齒音」這種常態狀況,動態 EQ 精準太多。RX 的頻譜筆刷,我會留給「單一一個明顯的異音」那種一次性狀況,不是拿來當日常做法用。
偶爾會有的口哨聲,也是同一招
有時候齒音會帶一點口哨般的尖叫聲,一樣落在 7 到 8kHz。同一顆動態 EQ 的 bell 就能處理,只在它出現時 attenuate(壓低),不會傷到旁邊的內容。不用因為它聽起來不太一樣就另外開一顆掛。
AI 人聲要注意的雷:齒音會消失
如果你的人聲是用 voice clone(把一段人聲換成另一個音色)做的,常會發現齒音「消失」了、咬字變怪。原因是齒音本來就是高頻的噪音類聲音,轉檔的模型對它重建得很差,容易在過程中直接丟掉。這跟前面講的「太多」是相反的問題,解法有兩條:把餵進去轉檔的原始人聲,事先把齒音加大;或者生成完之後,在 5 到 8kHz 手動補一點回來。兩條路都行,看你手上有沒有原始素材。這類 AI 人聲的其他毛邊,我在Suno 生出來的歌聲很數位很毛那篇有整理更多後製做法。
常見問答
動態 EQ 跟 de-esser 到底差在哪,一定要用動態 EQ 嗎?
de-esser 也是一種壓齒音的工具,概念類似,但多半是單一頻段的固定壓縮,調整彈性沒有動態 EQ 高。如果你手上的軌只有 de-esser 沒有動態 EQ,一樣可以用,先用「只聽 sibilance」模式抓出頻段,再慢慢調門檻,不是非動態 EQ 不可。
齒音壓太多會怎樣?
會咬字變糊、變悶,聽起來像感冒。齒音是子音清晰度的一部分,不是全部拿掉就叫乾淨,壓到「不刺耳」就該停,邊聽邊調,不要看數值調到底。
沒有 de-esser 這種工具,可以用手剪嗎?
可以,把齒音出現的那幾個瞬間框起來,單獨用 EQ 或音量自動化壓低,就是最原始的手剪做法。麻煩一點,但一首歌齒音次數不多的話完全可行,人聲的嘶聲好刺耳怎麼辦那篇有更完整的手剪步驟。
---
我是陳則皞,音樂製作人,平常在做編曲、混音、客製化歌曲,也教寫歌。人聲齒音處理不好整首歌都會被拖累,從 45 分鐘諮詢 開始,帶著你的軌來聊最快;想從頭把一首歌做完整,看 完整製作流程,也可以直接找我做配唱製作。