Skip to content

建立 2026-09-15 更新 2026-09-15

文生影片

文生影片(Text-to-Video)只丟提示詞,模型自己決定構圖。適合找感覺、測鏡頭語言,或你手上還沒有可用的首幀。畫面要很像某一張圖時,改走 圖生影片

最短操作

  1. 工作台選 Video Generation,模型選 VIDEO 3.0
  2. 不要上傳圖片(或不要指定首幀)。
  3. 在提示詞寫清:主體、動作、場景、鏡頭、光影;需要聲音再寫對白/環境音。
  4. 選比例:橫式 16:9、直式 9:16、方形 1:1。
  5. 時長先 5–6 秒;解析度先 1080p。
  6. 畫面還沒對時,先關 Native AudioMulti-Shot
  7. 按生成,預覽後再迭代提示詞,不要一次改十個變數。

官方流程見 How to Create AI Videos

提示詞先寫這五件事

完整公式在 提示詞。文生最少要有:

  • 主體:誰/什麼,外觀兩、三個特徵即可
  • 動作:正在做什麼,最好有順序(走向窗邊 → 轉身)
  • 場景:時間、地點、天氣
  • 鏡頭:景別(特寫/中景)與運鏡(固定、緩推、跟隨)
  • 光影:例如「黃昏側光、體積霧」

第一次不要堆十種風格形容詞。一句具體的動作,比十個「電影感、8K、超寫實」有用。

常見失敗

  • 什麼都寫、什麼都不強調:模型會平均分配,主體變小、動作變糊。把最重要的主體放第一句。
  • 動作違反畫面物理:人突然飛起來、液體不跟著杯子。先寫「合理會發生的動作」。
  • 一開始就開多鏡頭:單鏡頭還不穩,切鏡只會更亂。單鏡頭過關再看 多鏡頭

相關資料