Sonusi 聲敘 logoSonusi 聲敘

教學指南

想做 Voice Clone,卻卡在樣本品質?

Voice Clone(建立專屬聲線)效果不自然、不像本人?問題通常不在模型,而在樣本品質。若不確定這段音檔能不能做 Voice Clone,可先免費檢測,再依建議優化音檔。

這些素材都能先處理,再送去 Voice Clone

  • 帶 BGM 的影片與音檔
  • 自己參與的訪談、多人對話
  • 手機錄影環境音雜亂
  • 有效發言太短

兩步流程

兩步音檔優化,為什麼能拉高 Voice Clone 成功率

帶 BGM 或多人講話的樣本直接送去 Voice Clone,模型容易學到多餘的聲音,導致成品效果不佳。若不確定素材能不能做 Voice Clone,可先免費檢測,再依建議選做以下兩步。 檢測樣本適配

多人對話建議先做講者分離;若有需要,再對個別音軌做去除背景音。

  1. 1

    選出目標講者

    從多人對話中分辨並保留你的發言,避免其他講者的聲音混進樣本。

    什麼時候需要

    • 在 Podcast、對談或訪談中參與錄製,需從整段音檔保留自己的發言
    • 多人對話混有其他講者,需先分出個人發言,再送去建立專屬聲線

    立即使用 →

  2. 2

    去除背景音

    削弱襯底音樂或伴奏,讓模型較能專注在人聲,而非 BGM。

    什麼時候需要

    • 單人錄製的 Podcast、訪談或影片,人聲被 BGM 或環境噪音蓋過
    • 講者分離後,個別音軌仍夾帶明顯背景音,需再個別處理

    立即使用 →

環境雜音為主或多人同時說話的錄音,建議換段乾淨、單人素材再試。

常見問題

訪談或多人對話的錄音,可以做 Voice Clone 嗎?

可以嘗試,但樣本須為本人或已獲授權之聲音。若你在訪談或多人對話的錄音中與他人輪流發言,請先用原始錄音做選出目標講者,分出自己的發言;若分離後的個別音軌仍夾帶明顯 BGM 或環境噪音,再個別做去除背景音。

帶 BGM 的影片或 Podcast,可以做 Voice Clone 嗎?

可以,但建議先處理樣本品質,且樣本須為本人或已獲授權之聲音。若已是單人錄音且帶 BGM 或環境噪音,可先去除背景音讓人聲更清楚;若是多人對話,請先用原始錄音選出你自己的發言,必要時再對分離出的個別音軌做去除背景音。可先用短段試聽效果,確認人聲夠清楚再進一步評估。

Voice Clone 需要準備多長的錄音?

有效發言越完整、連續越好。若你自己的發言只有極短幾句,即使做完前處理,仍難支撐穩定的專屬聲線;宜準備較完整、輪流發言清楚的單人片段。