AI Avatar
AI Avatar 是 Dreamina 把一張靜態人像照片變成會說話、有表情動作的影片的功能,也就是常說的「對嘴」(Lip Sync)。背後由 Omnihuman 系列模型驅動:模型會分析照片裡的臉部特徵,預測合理的嘴型、表情與動作,再依你提供的文字或聲音生成對應的說話影片。
對嘴三步驟
- 上傳人像照片:進入 AI Avatar(或「Lip Sync」)分頁,上傳一張五官清楚、正面或接近正面的人像照片;也可以直接用你先前在 AI 圖片 生成過、存在「我的資產」裡的圖。
- 提供聲音來源:介面通常有兩個分頁可選:
- 文字轉語音(Text to Speech):直接打字,再挑一個 AI 語音;適合沒有現成錄音的情況。
- 上傳音檔:使用你自己錄好或品牌指定的聲音,口型與語氣會更貼近真人。
- 生成:確認模型等級(例如標準與較高品質等級)後按下生成,等待數分鐘產出說話影片。
讓成果更自然的小技巧
- 照片品質決定上限:光線均勻、五官清晰、沒有遮擋的照片,對嘴效果通常明顯優於模糊或側臉照片。
- 文字轉語音先試短句:先用一兩句話確認聲音語氣與口型是否理想,滿意後再貼完整逐字稿,避免一次生成長內容卻要整段重來。
- 上傳音檔要乾淨:背景雜音或多人交談會影響嘴型對準的準確度,建議用單一人聲、少雜音的錄音。
- 想要動作與表情:部分等級的模型支援額外的動作或情緒提示詞,可以描述「微笑」「輕輕點頭」等,讓影片不只是嘴巴在動。
使用界線
AI Avatar 用來生成「你有權使用其肖像」的照片(例如自己、你的虛擬角色,或已取得授權的素材)。用他人肖像生成說話影片前,務必確認取得當事人同意,並遵守 Dreamina 服務條款與所在地區法規;不要用來假冒他人發表其未曾說過的言論。
實際操作畫面與更多案例見 影音教學。