聲音克隆
克隆(Voice Cloning)是用你的錄音,讓模型之後用「你的聲音」唸任何稿。只克隆你有明確同意與權利的聲音。專業克隆通常只能克隆自己的聲音。
兩種路徑
| 類型 | 素材 | 速度 | 適合 |
|---|---|---|---|
| Instant Voice Cloning(即時克隆) | 約 1–2 分鐘乾淨單人聲 | 幾分鐘內可用 | 試水溫、短影音、內部測試 |
| Professional Voice Cloning(專業克隆) | 約 30 分鐘到 3 小時,建議錄音室級 | 訓練常要數小時 | 品牌聲音、長系列課程、要高度像本人 |
即時克隆是用既有模型「猜」你的聲音;專業克隆會為你訓練專用模型,口音與獨特音色較準。即時效果不夠,再升級專業克隆。
素材怎麼錄
乾淨、一致的輸入,才有乾淨、一致的輸出。
- 單人、無背景音樂、無回音。筆電風扇與街道噪音都會被學進去。
- 音量穩定,不要時近時遠。
- 內容盡量自然口語,不要只唸同一句。
- 上傳前可用 Voice Isolator 去掉噪音,但源頭乾淨仍最重要。
同意與法律
畫面上必須勾選你有權克隆該聲音。未授權克隆他人聲音,在許多司法管轄區已違法。接案時把使用範圍與期限寫進合約;公開內容建議揭露使用 AI 語音。
不要拿名人或同事的聲音來試
免費額度不夠當藉口。用聲庫或 Voice Design 做角色聲,用自己的錄音做克隆。
克隆之後
到 My Voices 選該聲音,回到 Text to Speech 貼訓練時沒唸過的新稿來測。若長句問句容易出戲,檢查素材長度與專業克隆是否更適合。