「畫面從左邊到右邊」到底是哪一個指令?AI 影片運鏡命令完全指南
你想描述的畫面,其實都有對應的專業運鏡指令。這篇把攝影機能做的每一個動作拆開、去掉重複的別名,並附上白話對照表——因為模型看得懂術語,看不懂含糊。
你腦中有一個畫面:鏡頭從左邊移到右邊。
你把它打進提示詞:「畫面從左往右移動」。
模型給你的東西可能是這三種其中一種——攝影機整台往右滑、攝影機原地往右轉、或者攝影機根本沒動、只是主角自己往右走。這三種在畫面上完全不同,而你那句話三種都成立。
所以它不是在亂搞,它是在猜。而你剛剛把決定權交出去了。

這篇要做的事很單純:把攝影機能做的動作全部列出來、去掉重複的別名,再給你一張「你想講的話 → 該用哪個指令」的對照表。
先講為什麼值得學這幾個詞
這不是要你變成攝影師。純粹是因為模型對術語的反應比對形容詞好——而且這句話有官方背書。
MiniMax 的 API 文件在講運鏡指令時,白紙黑字寫了一句:
Free-form descriptions also work, but explicit commands yield more accurate results.
(自由描述也可以,但明確的指令會得到更準確的結果。)
字節跳動的 Seedance 2.0 指南也說得很直接——它要你「直接使用標準的運鏡術語」,並且把好的提示詞定義成「工程式指令,不是文案式描述」。
兩家講的是同一件事:術語就是講好的暗號。 你寫「鏡頭慢慢靠近」,模型還得猜你要的是機身往前走、還是鏡頭拉近;你寫 [Push in],它不用猜。
而且這些詞你其實早就會用了,只是沒對上名字。下面全部都會對上。
攝影機只有三種「動」
先把地基打好。不管你聽過多少術語,攝影機能做的事只有三類:

- 平移——機身整個換位置(前後、左右、上下)
- 旋轉——機身位置不動,只轉方向
- 變焦——機身一步都沒動,只有鏡頭改變視角
只要先問「機身有沒有換位置」,一半的混淆就消失了。 這也是後面所有對照的判斷起點。
這不是我們自己編的分法。快手可靈(Kling)在 API 裡開了六個運鏡欄位,每一個都直接用軸來定義,剛好就是這三類:
| 可靈的參數 | 官方定義 | 屬於 |
|---|---|---|
horizontal |
camera translation along x-axis | 平移 |
vertical |
camera translation along y-axis | 平移 |
pan |
camera rotation around y-axis | 旋轉 |
tilt |
camera rotation around x-axis | 旋轉 |
roll |
camera rotation around z-axis | 旋轉 |
zoom |
controls camera focal length change | 變焦 |
兩個平移、三個旋轉、一個變焦。 名字各家可以各叫各的,軸不會變。
平移:機身換位置的三個方向
| 動作 | 白話 | 指令 |
|---|---|---|
| 左右橫移 | 攝影機平行往左/右滑 | [Truck left] / [Truck right] |
| 上下升降 | 整台升高/降低,鏡頭仍水平 | [Pedestal up] / [Pedestal down] |
| 前後推拉 | 沿著視線走近/走遠 | [Push in] / [Pull out] |
平移都會產生視差:你真的換了位置,所以近的東西跑得比遠的東西快。這就是為什麼平移看起來有空間感,而原地轉頭沒有。
旋轉:三個軸,第三個最少人用

| 動作 | 白話 | 指令 |
|---|---|---|
| 左右搖鏡 | 像站著原地左右轉頭 | [Pan left] / [Pan right] |
| 上下俯仰 | 像原地點頭或抬頭 | [Tilt up] / [Tilt down] |
| 沿視線翻滾 | 像把頭歪向肩膀,地平線跟著歪 | 提示詞層多半沒有,寫白話 |
Roll 值得單獨提一句:三個旋轉軸裡,它最少被做成提示詞指令。
但它不是做不到,只是躲在 API 裡。可靈就有一個 roll 參數,可以指定往逆時針還是順時針轉、轉多大。所以模型會轉,只是多數平台沒把這個旋鈕開到提示詞這一層。
要在提示詞裡用,就直接寫效果——「地平線向右傾斜約 15 度」,比寫 roll right 保險。
三組最容易寫錯的對照
這三組是實務上真正會害你重抽的地方。
一、Truck 還是 Pan?——你要不要視差
回到開頭那張圖。同樣是「畫面往右走」:
- Truck(機身橫移):攝影機真的移動了。近處的東西移動得比遠處多,畫面出現視差,空間感很強。適合跟著人走、沿著櫥窗滑過去。
- Pan(定點搖鏡):攝影機站在原地轉頭。前景和背景一起平移,沒有視差。適合掃過一整片風景、交代環境有多大。
判斷方式:你想讓觀眾感覺「我跟著鏡頭走進去了」,用 Truck;你想讓觀眾感覺「我站在這裡看過去」,用 Pan。
二、Push in 還是 Zoom in?——背景會出賣你

這兩個在畫面上都是「主體變大」,但成因完全不同:
- Push in:機身往前走。視點改變,所以主體長大得比背景快,空間被拉開,像走進場景裡。
- Zoom in:機身一步沒動,只是視角變窄。整個畫面等比例放大,包括背景,空間感完全不變,就只是裁得更緊。
日常講話兩者都叫「拉近一點」,但寫進提示詞就是兩種畫面。想要「靠近他」的情緒,用 Push in;只是想讓主體佔畫面大一點,用 Zoom in。
三、Pedestal 還是 Tilt?——垂直線會出賣你

想拍到更高的地方,你有兩個選擇:
- Pedestal up:整台升高,鏡頭仍然水平。視線與地面平行,所以建築物的垂直線保持垂直。
- Tilt up:高度不變,只把鏡頭抬起來。視線變成斜的,垂直線會向上收斂,產生透視變形。
這一組在拍商品和建築時特別要命。你想要一張方正、專業、沒有變形的產品照,該用的是 Pedestal 不是 Tilt;反過來,想強調建築的壓迫感,Tilt up 的變形正是你要的。
環繞:唯一能讓觀眾看到另一面的運鏡

Orbit(也叫 Arc)是平移和旋轉同時發生:機身沿著圓弧走,鏡頭一直對準主體。
結果是主體留在畫面中間幾乎不動,背景整片換掉。所有運鏡裡只有它能讓觀眾看到主體的另一面,所以商品展示和角色登場特別愛用。
它最常被誤寫成 Pan。差別是致命的:Pan 是機身不動只轉方向,主體會直接滑出畫面。 白話說「鏡頭繞著他轉」= Orbit,白話說「鏡頭掃過去」= Pan。
兩個複合運鏡:它們是疊出來的

知道它們是複合的,你就知道怎麼寫:
- Crane / Jib=
[Pedestal up]+[Tilt down]。機身升高的同時鏡頭往下壓,主體留在畫面裡,視角從平視變成俯視。常見於開場或收尾。 - Dolly Zoom=
Push in+Zoom out(或反過來)。兩者互相抵消,所以主體大小不變、背景卻在膨脹。這就是俗稱的暈眩效果,希區考克在《迷魂記》用過,後來變成表達「世界突然不對勁」的固定語彙。
複合運鏡通常沒有單一指令,寫法就是把兩個基本動作寫在一起,並說明它們同時發生。
也有廠商直接把常用的複合動作包成現成選項。 可靈就準備了四個,每一個的官方說明本身就是兩個動作疊起來:
| 現成選項 | 官方說明 |
|---|---|
down_back |
攝影機下降並後退 |
forward_up |
攝影機前進並上仰 |
right_turn_forward |
先右轉再前進 |
left_turn_forward |
先左轉再前進 |
看得出來就是前面那些基本動作兩兩疊起來。知道怎麼拆,你在沒有現成選項的平台上也寫得出同樣的效果。
順帶一提,可靈給 down_back 附的英文註解是「Pan down and zoom out」——照這篇的標準看,這兩個詞都用得不精確:下降是 Pedestal 不是 Pan,後退是機身在走、不是 Zoom。連官方文件都會混著叫,所以認動作,不要認名字。
最後三個:它們描述的是狀態,不是方向

| 動作 | 白話 | 指令 |
|---|---|---|
| 固定 | 腳架鎖死,一格都不動 | [Static shot] |
| 晃動 | 手持的細微抖動 | [Shake] |
| 跟拍 | 跟著主體走,相對位置不變 | [Tracking shot] |
[Static shot] 看起來像廢話,其實是最有用的一個。排錯的時候先把運鏡拿掉:固定鏡頭如果人物和動作都對,那問題就在運鏡;固定鏡頭本身就錯,那再炫的運鏡也救不回來。
白話 → 指令 對照表
這張表是這篇的重點。左邊是你腦中會冒出來的說法,右邊是該寫進提示詞的東西。
| 你想講的 | 其實是什麼動作 | 該寫的指令 |
|---|---|---|
| 跟著他往右走 | 機身橫移 | [Truck right] |
| 鏡頭掃過整個房間 | 定點搖鏡 | [Pan right] |
| 慢慢靠近他的臉 | 機身前進 | [Push in] |
| 把畫面拉近一點 | 只變焦,機身不動 | [Zoom in] |
| 往後退,露出整個場景 | 機身後退 | [Pull out] |
| 從腳往上帶到臉 | 鏡頭上仰 | [Tilt up] |
| 從上往下俯視他 | 鏡頭下壓 | [Tilt down] |
| 整台升高但畫面不變形 | 機身升降 | [Pedestal up] |
| 從高處慢慢降下來看到他 | 升降+俯仰複合 | [Pedestal down] + [Tilt up] |
| 繞著他轉一圈 | 環繞 | 寫「鏡頭沿圓弧繞行主體,始終對準他」 |
| 一路跟著他 | 跟拍 | [Tracking shot] |
| 鏡頭不要動 | 固定 | [Static shot] |
| 要有手持的臨場感 | 晃動 | [Shake] |
| 天旋地轉、失去平衡 | 沿視線翻滾 | 寫「地平線向右傾斜」 |
| 越靠近越覺得不對勁 | 推近+反向變焦 | 寫「機身前進的同時鏡頭向外變焦」 |
為什麼同一個動作有那麼多名字
你在不同地方會看到 Truck left、Dolly left、Track left、Move left、Slide left——它們指的是同一件事:機身往左平移。
原因是這批詞來自實體器材的年代:Dolly 是攝影機推車,Truck 是推車橫向走,Pedestal 是可升降的機座,Crane 是搖臂。器材不同,動作卻重疊,於是同一個動作留下了好幾個名字。
各家 AI 影片平台各自挑了一組,就變成現在這樣。
所以判斷的依據永遠是「攝影機到底做了什麼」,不是名字。 遇到沒看過的詞,問三個問題就能歸位:
- 機身有沒有換位置?(有=平移,沒有=旋轉或變焦)
- 換位置的話,往哪個軸?(左右/上下/前後)
- 沒換位置的話,是轉方向還是改視角?(轉=旋轉,改視角=變焦)
一鏡到底放幾個指令?
三家的答案都不一樣,而且不只是寬鬆程度的差別:
- MiniMax 讓你組合,同一個方括號裡放多個會同時發生(例如
[Pan left,Pedestal up]),建議最多 3 個;也可以排順序,寫成"...[Push in], then...[Push out]"。 - Seedance 2.0 反過來,建議一鏡只給一種,還明說「不要同時要求推、拉、搖、移,那會讓畫面更不穩」。(這是 2.0 的說法;1.0 的指南態度不同,說多個運鏡指令可以組合出有創意的長鏡頭。同一家換個版本就改口,引用時記得看版本。)
- 可靈乾脆寫進 API 規則:六個欄位只能有一個不是零。
最後一條和前兩條不是同一種東西:前兩家在給建議(寫多了畫面會爛),可靈是規則(寫多了請求直接被擋下來)。
沒有誰對誰錯,就是各家模型脾氣不同。實務上最安全的做法:第一次先給一個運鏡就好,確認主體和動作都對了,再考慮加第二個。
一個很簡單的自我檢查:把運鏡術語全部刪掉,你還說得出觀眾先看到什麼、後看到什麼嗎?說不出來的話,那些術語只是裝飾,還沒變成畫面設計。
先說清楚:這篇整理的是各家官方文件寫了什麼,加上影視業界通用的術語。至於哪個指令在哪個模型上真的會生效、哪個會被無視,各家都沒有公開保證,而且會隨版本變。所以把它當成起手式——真正的答案還是要自己抽幾次看。
接下來
運鏡只是提示詞裡的一欄。同一句話該怎麼交代主體、動作、場景與光線,兩家的寫法差很多——MiniMax 的結構在 API 裡,Seedance 的結構在提示詞文字裡,兩者的取捨見〈同一句話餵兩個模型〉。
如果你的問題是「每一段都好看,剪在一起卻跳掉」,那是接鏡,不是運鏡。
官方資料來源
方括號指令的詞彙、組合與序列規則、以及「明確指令更準確」一句,依 MiniMax 官方 API reference(該表適用於 Hailuo/Director 線的模型,官方未在 H3 端點重列,本文不宣稱 H3 支援全部 15 個)。運鏡術語的開放式用法依 BytePlus 的 Seedance 提示詞指南;「一鏡只給一種運鏡」出自 Seedance 2.0 指南,1.0 指南的措辭不同(1.0 說多個運鏡指令可以組合),本文已分別標注版本。
平移/旋轉/變焦的三分類與各軸定義,另依可靈(Kling)camera_control 的官方參數說明佐證——該協定以 x/y/z 軸明確定義六個欄位。
Dolly、Truck、Pedestal、Crane、Orbit、Roll 等詞的定義屬影視業界通用術語,非任一廠商的專有指令;本文在對照表中已標明哪些有具名指令、哪些需要寫成白話描述。
最後對照日期:2026-08-01。
