Skip to content

建立 2026-09-15 更新 2026-09-15

聲音克隆

克隆(Voice Cloning)是用你的錄音,讓模型之後用「你的聲音」唸任何稿。只克隆你有明確同意與權利的聲音。專業克隆通常只能克隆自己的聲音。

兩種路徑

類型 素材 速度 適合
Instant Voice Cloning(即時克隆) 約 1–2 分鐘乾淨單人聲 幾分鐘內可用 試水溫、短影音、內部測試
Professional Voice Cloning(專業克隆) 約 30 分鐘到 3 小時,建議錄音室級 訓練常要數小時 品牌聲音、長系列課程、要高度像本人

即時克隆是用既有模型「猜」你的聲音;專業克隆會為你訓練專用模型,口音與獨特音色較準。即時效果不夠,再升級專業克隆。

素材怎麼錄

乾淨、一致的輸入,才有乾淨、一致的輸出。

  • 單人、無背景音樂、無回音。筆電風扇與街道噪音都會被學進去。
  • 音量穩定,不要時近時遠。
  • 內容盡量自然口語,不要只唸同一句。
  • 上傳前可用 Voice Isolator 去掉噪音,但源頭乾淨仍最重要。

同意與法律

畫面上必須勾選你有權克隆該聲音。未授權克隆他人聲音,在許多司法管轄區已違法。接案時把使用範圍與期限寫進合約;公開內容建議揭露使用 AI 語音。

不要拿名人或同事的聲音來試

免費額度不夠當藉口。用聲庫或 Voice Design 做角色聲,用自己的錄音做克隆。

克隆之後

到 My Voices 選該聲音,回到 Text to Speech 貼訓練時沒唸過的新稿來測。若長句問句容易出戲,檢查素材長度與專業克隆是否更適合。