「畫面從左邊到右邊」到底是哪一個指令?AI 影片運鏡命令完全指南

你想描述的畫面,其實都有對應的專業運鏡指令。這篇把攝影機能做的每一個動作拆開、去掉重複的別名,並附上白話對照表——因為模型看得懂術語,看不懂含糊。

教學
發布
更新

你腦中有一個畫面:鏡頭從左邊移到右邊。

你把它打進提示詞:「畫面從左往右移動」。

模型給你的東西可能是這三種其中一種——攝影機整台往右滑、攝影機原地往右轉、或者攝影機根本沒動、只是主角自己往右走。這三種在畫面上完全不同,而你那句話三種都成立。

所以它不是在亂搞,它是在猜。而你剛剛把決定權交出去了。

同樣是「畫面從左往右」,其實是兩個不同指令:Truck 機身橫移會產生視差,Pan 定點搖鏡不會

這篇要做的事很單純:把攝影機能做的動作全部列出來、去掉重複的別名,再給你一張「你想講的話 → 該用哪個指令」的對照表。

先講為什麼值得學這幾個詞

這不是要你變成攝影師。純粹是因為模型對術語的反應比對形容詞好——而且這句話有官方背書。

MiniMax 的 API 文件在講運鏡指令時,白紙黑字寫了一句:

Free-form descriptions also work, but explicit commands yield more accurate results.

(自由描述也可以,但明確的指令會得到更準確的結果。)

字節跳動的 Seedance 2.0 指南也說得很直接——它要你「直接使用標準的運鏡術語」,並且把好的提示詞定義成「工程式指令,不是文案式描述」。

兩家講的是同一件事:術語就是講好的暗號。 你寫「鏡頭慢慢靠近」,模型還得猜你要的是機身往前走、還是鏡頭拉近;你寫 [Push in],它不用猜。

而且這些詞你其實早就會用了,只是沒對上名字。下面全部都會對上。

攝影機只有三種「動」

先把地基打好。不管你聽過多少術語,攝影機能做的事只有三類:

攝影機只有三種動:平移(機身位移)、旋轉(定點轉方向)、變焦(機身完全不動)

  1. 平移——機身整個換位置(前後、左右、上下)
  2. 旋轉——機身位置不動,只轉方向
  3. 變焦——機身一步都沒動,只有鏡頭改變視角

只要先問「機身有沒有換位置」,一半的混淆就消失了。 這也是後面所有對照的判斷起點。

這不是我們自己編的分法。快手可靈(Kling)在 API 裡開了六個運鏡欄位,每一個都直接用來定義,剛好就是這三類:

可靈的參數 官方定義 屬於
horizontal camera translation along x-axis 平移
vertical camera translation along y-axis 平移
pan camera rotation around y-axis 旋轉
tilt camera rotation around x-axis 旋轉
roll camera rotation around z-axis 旋轉
zoom controls camera focal length change 變焦

兩個平移、三個旋轉、一個變焦。 名字各家可以各叫各的,軸不會變。

平移:機身換位置的三個方向

動作 白話 指令
左右橫移 攝影機平行往左/右滑 [Truck left] / [Truck right]
上下升降 整台升高/降低,鏡頭仍水平 [Pedestal up] / [Pedestal down]
前後推拉 沿著視線走近/走遠 [Push in] / [Pull out]

平移都會產生視差:你真的換了位置,所以近的東西跑得比遠的東西快。這就是為什麼平移看起來有空間感,而原地轉頭沒有。

旋轉:三個軸,第三個最少人用

旋轉的三個軸:Pan 左右轉、Tilt 上下轉、Roll 沿視線翻滾

動作 白話 指令
左右搖鏡 像站著原地左右轉頭 [Pan left] / [Pan right]
上下俯仰 像原地點頭或抬頭 [Tilt up] / [Tilt down]
沿視線翻滾 像把頭歪向肩膀,地平線跟著歪 提示詞層多半沒有,寫白話

Roll 值得單獨提一句:三個旋轉軸裡,它最少被做成提示詞指令。

它不是做不到,只是躲在 API 裡。可靈就有一個 roll 參數,可以指定往逆時針還是順時針轉、轉多大。所以模型會轉,只是多數平台沒把這個旋鈕開到提示詞這一層。

要在提示詞裡用,就直接寫效果——「地平線向右傾斜約 15 度」,比寫 roll right 保險。

三組最容易寫錯的對照

這三組是實務上真正會害你重抽的地方。

一、Truck 還是 Pan?——你要不要視差

回到開頭那張圖。同樣是「畫面往右走」:

  • Truck(機身橫移):攝影機真的移動了。近處的東西移動得比遠處多,畫面出現視差,空間感很強。適合跟著人走、沿著櫥窗滑過去。
  • Pan(定點搖鏡):攝影機站在原地轉頭。前景和背景一起平移,沒有視差。適合掃過一整片風景、交代環境有多大。

判斷方式:你想讓觀眾感覺「我跟著鏡頭走進去了」,用 Truck;你想讓觀眾感覺「我站在這裡看過去」,用 Pan。

二、Push in 還是 Zoom in?——背景會出賣你

推近和變焦不一樣:Push in 主體放大很多而背景只放大一點,Zoom in 則是整個畫面等比例放大

這兩個在畫面上都是「主體變大」,但成因完全不同:

  • Push in:機身往前走。視點改變,所以主體長大得比背景快,空間被拉開,像走進場景裡。
  • Zoom in:機身一步沒動,只是視角變窄。整個畫面等比例放大,包括背景,空間感完全不變,就只是裁得更緊。

日常講話兩者都叫「拉近一點」,但寫進提示詞就是兩種畫面。想要「靠近他」的情緒,用 Push in;只是想讓主體佔畫面大一點,用 Zoom in。

三、Pedestal 還是 Tilt?——垂直線會出賣你

升高機身還是抬起鏡頭:Pedestal 垂直線保持垂直,Tilt 則會讓垂直線向上收斂

想拍到更高的地方,你有兩個選擇:

  • Pedestal up:整台升高,鏡頭仍然水平。視線與地面平行,所以建築物的垂直線保持垂直
  • Tilt up:高度不變,只把鏡頭抬起來。視線變成斜的,垂直線會向上收斂,產生透視變形。

這一組在拍商品和建築時特別要命。你想要一張方正、專業、沒有變形的產品照,該用的是 Pedestal 不是 Tilt;反過來,想強調建築的壓迫感,Tilt up 的變形正是你要的。

環繞:唯一能讓觀眾看到另一面的運鏡

環繞:機身繞著主體走、鏡頭始終對準它,背景整片換掉而主體幾乎不動

Orbit(也叫 Arc)是平移和旋轉同時發生:機身沿著圓弧走,鏡頭一直對準主體。

結果是主體留在畫面中間幾乎不動,背景整片換掉。所有運鏡裡只有它能讓觀眾看到主體的另一面,所以商品展示和角色登場特別愛用。

它最常被誤寫成 Pan。差別是致命的:Pan 是機身不動只轉方向,主體會直接滑出畫面。 白話說「鏡頭繞著他轉」= Orbit,白話說「鏡頭掃過去」= Pan。

兩個複合運鏡:它們是疊出來的

Crane 是升降加俯仰的複合,Dolly Zoom 是推近加反向變焦、兩者互相抵消

知道它們是複合的,你就知道怎麼寫:

  • Crane / Jib[Pedestal up][Tilt down]。機身升高的同時鏡頭往下壓,主體留在畫面裡,視角從平視變成俯視。常見於開場或收尾。
  • Dolly ZoomPush inZoom out(或反過來)。兩者互相抵消,所以主體大小不變、背景卻在膨脹。這就是俗稱的暈眩效果,希區考克在《迷魂記》用過,後來變成表達「世界突然不對勁」的固定語彙。

複合運鏡通常沒有單一指令,寫法就是把兩個基本動作寫在一起,並說明它們同時發生。

也有廠商直接把常用的複合動作包成現成選項。 可靈就準備了四個,每一個的官方說明本身就是兩個動作疊起來:

現成選項 官方說明
down_back 攝影機下降並後退
forward_up 攝影機前進並上仰
right_turn_forward 先右轉再前進
left_turn_forward 先左轉再前進

看得出來就是前面那些基本動作兩兩疊起來。知道怎麼拆,你在沒有現成選項的平台上也寫得出同樣的效果。

順帶一提,可靈給 down_back 附的英文註解是「Pan down and zoom out」——照這篇的標準看,這兩個詞都用得不精確:下降是 Pedestal 不是 Pan,後退是機身在走、不是 Zoom。連官方文件都會混著叫,所以認動作,不要認名字。

最後三個:它們描述的是狀態,不是方向

Static 完全不動、Shake 手持晃動、Tracking 跟著主體移動

動作 白話 指令
固定 腳架鎖死,一格都不動 [Static shot]
晃動 手持的細微抖動 [Shake]
跟拍 跟著主體走,相對位置不變 [Tracking shot]

[Static shot] 看起來像廢話,其實是最有用的一個。排錯的時候先把運鏡拿掉:固定鏡頭如果人物和動作都對,那問題就在運鏡;固定鏡頭本身就錯,那再炫的運鏡也救不回來。

白話 → 指令 對照表

這張表是這篇的重點。左邊是你腦中會冒出來的說法,右邊是該寫進提示詞的東西。

你想講的 其實是什麼動作 該寫的指令
跟著他往右走 機身橫移 [Truck right]
鏡頭掃過整個房間 定點搖鏡 [Pan right]
慢慢靠近他的臉 機身前進 [Push in]
把畫面拉近一點 只變焦,機身不動 [Zoom in]
往後退,露出整個場景 機身後退 [Pull out]
從腳往上帶到臉 鏡頭上仰 [Tilt up]
從上往下俯視他 鏡頭下壓 [Tilt down]
整台升高但畫面不變形 機身升降 [Pedestal up]
從高處慢慢降下來看到他 升降+俯仰複合 [Pedestal down][Tilt up]
繞著他轉一圈 環繞 寫「鏡頭沿圓弧繞行主體,始終對準他」
一路跟著他 跟拍 [Tracking shot]
鏡頭不要動 固定 [Static shot]
要有手持的臨場感 晃動 [Shake]
天旋地轉、失去平衡 沿視線翻滾 寫「地平線向右傾斜」
越靠近越覺得不對勁 推近+反向變焦 寫「機身前進的同時鏡頭向外變焦」

為什麼同一個動作有那麼多名字

你在不同地方會看到 Truck leftDolly leftTrack leftMove leftSlide left——它們指的是同一件事:機身往左平移。

原因是這批詞來自實體器材的年代:Dolly 是攝影機推車,Truck 是推車橫向走,Pedestal 是可升降的機座,Crane 是搖臂。器材不同,動作卻重疊,於是同一個動作留下了好幾個名字。

各家 AI 影片平台各自挑了一組,就變成現在這樣。

所以判斷的依據永遠是「攝影機到底做了什麼」,不是名字。 遇到沒看過的詞,問三個問題就能歸位:

  1. 機身有沒有換位置?(有=平移,沒有=旋轉或變焦)
  2. 換位置的話,往哪個軸?(左右/上下/前後)
  3. 沒換位置的話,是轉方向還是改視角?(轉=旋轉,改視角=變焦)

一鏡到底放幾個指令?

三家的答案都不一樣,而且不只是寬鬆程度的差別:

  • MiniMax 讓你組合,同一個方括號裡放多個會同時發生(例如 [Pan left,Pedestal up]),建議最多 3 個;也可以排順序,寫成 "...[Push in], then...[Push out]"
  • Seedance 2.0 反過來,建議一鏡只給一種,還明說「不要同時要求推、拉、搖、移,那會讓畫面更不穩」。(這是 2.0 的說法;1.0 的指南態度不同,說多個運鏡指令可以組合出有創意的長鏡頭。同一家換個版本就改口,引用時記得看版本。)
  • 可靈乾脆寫進 API 規則:六個欄位只能有一個不是零

最後一條和前兩條不是同一種東西:前兩家在給建議(寫多了畫面會爛),可靈是規則(寫多了請求直接被擋下來)。

沒有誰對誰錯,就是各家模型脾氣不同。實務上最安全的做法:第一次先給一個運鏡就好,確認主體和動作都對了,再考慮加第二個。

一個很簡單的自我檢查:把運鏡術語全部刪掉,你還說得出觀眾先看到什麼、後看到什麼嗎?說不出來的話,那些術語只是裝飾,還沒變成畫面設計。

先說清楚:這篇整理的是各家官方文件寫了什麼,加上影視業界通用的術語。至於哪個指令在哪個模型上真的會生效、哪個會被無視,各家都沒有公開保證,而且會隨版本變。所以把它當成起手式——真正的答案還是要自己抽幾次看。

接下來

運鏡只是提示詞裡的一欄。同一句話該怎麼交代主體、動作、場景與光線,兩家的寫法差很多——MiniMax 的結構在 API 裡,Seedance 的結構在提示詞文字裡,兩者的取捨見〈同一句話餵兩個模型〉。

如果你的問題是「每一段都好看,剪在一起卻跳掉」,那是接鏡,不是運鏡。

官方資料來源

方括號指令的詞彙、組合與序列規則、以及「明確指令更準確」一句,依 MiniMax 官方 API reference(該表適用於 Hailuo/Director 線的模型,官方未在 H3 端點重列,本文不宣稱 H3 支援全部 15 個)。運鏡術語的開放式用法依 BytePlus 的 Seedance 提示詞指南;「一鏡只給一種運鏡」出自 Seedance 2.0 指南,1.0 指南的措辭不同(1.0 說多個運鏡指令可以組合),本文已分別標注版本。

平移/旋轉/變焦的三分類與各軸定義,另依可靈(Kling)camera_control 的官方參數說明佐證——該協定以 x/y/z 軸明確定義六個欄位。

Dolly、Truck、Pedestal、Crane、Orbit、Roll 等詞的定義屬影視業界通用術語,非任一廠商的專有指令;本文在對照表中已標明哪些有具名指令、哪些需要寫成白話描述。

最後對照日期:2026-08-01。

推薦閱讀 RECOMMENDED
教學Seedance 2.5 Prompt Skill 到底管什麼?參考圖、故事板與首幀一次拆開教學Blender 3D 白模實測:AI 影片開拍前,我們先養了一隻方塊貓