文生影片
文生影片(Text-to-Video)只丟提示詞,模型自己決定構圖。適合找感覺、測鏡頭語言,或你手上還沒有可用的首幀。畫面要很像某一張圖時,改走 圖生影片。
最短操作
- 工作台選 Video Generation,模型選 VIDEO 3.0。
- 不要上傳圖片(或不要指定首幀)。
- 在提示詞寫清:主體、動作、場景、鏡頭、光影;需要聲音再寫對白/環境音。
- 選比例:橫式 16:9、直式 9:16、方形 1:1。
- 時長先 5–6 秒;解析度先 1080p。
- 畫面還沒對時,先關 Native Audio 與 Multi-Shot。
- 按生成,預覽後再迭代提示詞,不要一次改十個變數。
官方流程見 How to Create AI Videos。
提示詞先寫這五件事
完整公式在 提示詞。文生最少要有:
- 主體:誰/什麼,外觀兩、三個特徵即可
- 動作:正在做什麼,最好有順序(走向窗邊 → 轉身)
- 場景:時間、地點、天氣
- 鏡頭:景別(特寫/中景)與運鏡(固定、緩推、跟隨)
- 光影:例如「黃昏側光、體積霧」
第一次不要堆十種風格形容詞。一句具體的動作,比十個「電影感、8K、超寫實」有用。
常見失敗
- 什麼都寫、什麼都不強調:模型會平均分配,主體變小、動作變糊。把最重要的主體放第一句。
- 動作違反畫面物理:人突然飛起來、液體不跟著杯子。先寫「合理會發生的動作」。
- 一開始就開多鏡頭:單鏡頭還不穩,切鏡只會更亂。單鏡頭過關再看 多鏡頭。