Seedance 2.5 Prompt 實戰:我們第一版寫得很滿,鏡頭卻被講亂了 的文章封面

Seedance 2.5 Prompt 實戰:我們第一版寫得很滿,鏡頭卻被講亂了

第一版 Prompt 有故事、有角色代號、有八格分鏡,連紙船最後怎麼飛走都先寫好了。看起來火力全開,實際上好幾套鏡頭語法正在互撞。這是我們從原始稿一路修到六次實際提交版的紀錄。

教學
發布
更新

Seedance 2.5 很像一個不會駁回通告單的執行導演。你塞進幾套互相打架的鏡頭指令,它不會先召開劇本會議,只會在生成時自己取捨。而這正是我們初版 Prompt 的問題。

初版 Prompt 由大語言模型生成。我們給的指示很簡單:「必填且自包含:誰、在哪、做什麼、表演與情緒、構圖與運鏡;凡出場角色、場景或道具,都把其外觀錨點融入文字。」這個要求表面完整,實際把「故事怎麼讀」和「鏡頭怎麼拍」攪在一起。情緒被寫成結論,運鏡又在不同段落重複下令。

故事當然重要。但提示詞對影片生成模型而言,是工作任務。Seedance 2.5 更在乎:貓抬頭多少、重心往哪裡移、鏡頭跟著誰走、最後停在哪裡。Prompt Engineering 就在這一段見真章。

Claude Code 這類大語言模型閱讀故事、故事板圖片與參考圖,協助我們整理 Prompt;Seedance 接收最後的 Prompt 和素材生成影片。sd25-pe 管的是前一端的翻譯紀律,Seedance 不會偷偷讀到另一套 Skill 密碼本。

本文拆兩件事:我們第一版寫錯了什麼;故事板圖片和參考圖又怎麼把問題照得一清二楚。P01–P08 最後有沒有進入成片,留給另一篇〈Seedance 2.5 故事板分鏡實測〉逐格對帳。

一支片拆成 3 個 Act,再送出 6 次 Seedance 2.5 生成

我們整理了 3 份 Act Prompt。Desktop 與 Mobile 各使用一次,合計六次提交。除了生成好的角色、場景與道具資產,我們也把故事板圖片一起交給 Seedance 2.5。

16:9 八格故事板,依序呈現貓蜷縮在紙箱旁、紙船靠近、貓伸掌試水、紙船發光、鼻尖靠近、紙船浮起,以及貓跟著紙船走進雨街。

實際交給 Desktop 版本的 16:9 八格故事板;P01–P08 由左至右、由上而下閱讀。

Act 使用的故事板分鏡 這次提交只負責什麼
Act 1 P01–P03 貓蜷縮、抬頭、探掌,紙船停在面前
Act 2 P04–P06 紙船回應、貓踏水、鼻尖靠近但不接觸
Act 3 P07–P08 紙船浮起、環繞,帶貓走入雨街

第一版 Prompt 很完整,也很會互相打架

原始 Prompt 確實引用了八格故事板(Storyboard 圖片)作為指導。後續生成結果也真沒愧對價格,P01–P08 全部能在成片裡找到;逐格證據見〈AI 生成影片真的會看故事板?Seedance 2.5 把 8 格分鏡全用上了〉。

下面節錄原始 Storyboard 段落與 P01–P03。為了閱讀而換行,素材名稱、明顯錯字與其他文字均照原稿保留。

Image 1 是 Storyboard 頁面,包含 P01-P08。依每格框線外正上方的 P## 標題辨識;這個 Act 只准使用 P01、P02、P03 作為視覺參考,其餘所有格一律完全忽略。只把這些指定格當作一張有序的關鍵姿勢調度圖:在一個不間斷的連續鏡頭中依序走完,不要停留在任何一格;動作內容以文字描述與下方各段為準。

ACTION + CAMERA: P01 MCU·固定;P02 MCU·跟拍;P03 MS·跟隨。

MOTION PHRASES:

P01: 蜷縮 / 箱旁: 橘貓蜷縮在落地玻璃前的濕紙箱旁,身體縮成球狀,頭部低埋於前肢之間,尾巴環繞軀幹。——雨夜,@橘貓 · 半身圖蜷縮在@落地玻璃前 · 主圖 落地玻璃前被雨水打濕的破紙箱旁。

P02: 抬首 / 望船: 橘貓頭部抬起,面部朝向積水處飄來的傳單紙船,前肢貼地,重心微微前移。——@傳單紙船 · 主圖 傳單紙船從的積水處飄蕩到@橘貓 · 半身圖面前。橘貓從蜷縮中抬頭,眼神充滿好奇。構圖為中近景,鏡頭跟隨橘貓的視線。

P03: 探掌 / 觸水: 橘貓側身面向積水,右前腳掌懸空向前探出,左前肢與後肢支撐身體,重心壓低。——@橘貓 · 半身圖試探性的伸出腳掌,@傳單紙船 · 主圖 些微後退了一點點然後輕微的晃動了一兩下。

看著是不是還行?幸好我們沒有直接提交給 Seedance 2.5。把前後兩版攤開,問題就沒地方躲了:

首次 Prompt 實際提交版 為什麼改
「一個不間斷的連續鏡頭」 「由三個鏡頭剪接而成」 三鏡設計已經成立,樣板句退場
Act 1 已寫到 P04–P08 的發光、開門、飛起與離場 Act 1 只保留 P01–P03 後段事件不來搶戲
ACTION + CAMERA、錨點、MOTION PHRASES 多次重述 每個 P 段一次寫完景別、動作、運鏡與結束狀態 每顆鏡頭只收一份調度指令
「眼神充滿好奇」 抬頭、頭部前伸、睜眼、圓形瞳孔、重心前移 把情緒拆成可拍表演
場景和紙船也套用「最終形象與服裝」 每張圖只定義一個角色、道具或場景屬性 資產不用集體換衣服
騎樓、傳單紙船 店門前人行道、白紙船、船尾立架與細長船槳 文字承認參考圖真正畫了什麼

雨夜、濕貓、破紙箱、紙船靠近、貓抬頭、前掌試水、船後退和晃動,全部留下。離場的是重複版本、拍不出來的解釋,以及 Act 1 還沒輪到的劇情。

「眼神充滿好奇」很有戲,Seedance 2.5 卻拿不到鏡頭指令

再讀一次 P02 的提示詞:

傳單紙船從積水處飄蕩到橘貓面前。橘貓從蜷縮中抬頭,眼神充滿好奇。構圖為中近景,鏡頭跟隨橘貓的視線。

只寫「好奇」,模型有太多交卷方式:抬頭、歪頭、身體後縮,甚至站著不動。我們把它拆成轉臉、頭部前伸、睜眼與重心前移,等於把導演權拿回來。

實際提交的 Act 1 · P02 寫成:

P02,3–7秒:中近景、跟拍。紙船從積水遠端緩緩飄到貓面前;貓抬起頭,面部轉向紙船,頭部前伸,雙眼睜大、瞳孔放大成圓形,前肢貼地,重心微微前移;鏡頭順著貓的視線帶到紙船。結束時紙船停在貓面前的積水上。

「好奇」被拆成抬頭、轉臉、前伸、睜眼、前移五個表演狀態。攝影機也拿到路線:從貓的視線出發,帶到紙船。最後一句替下一鏡留下可接續的物理狀態。

故事留在導演腦中,動作送進 Prompt

這個故事背後有一句導演筆記:貓已經去世,紙船是來接牠的。

還有一句更私人的話:「至於為什麼那艘船會跟貓玩?因為,我就是那艘船。」

兩句都沒有進入實際提交版。模型一收到「貓已經去世」,很可能直接端出屍體、半透明或發光輪廓。暗示系統第一秒就被劇透,導演再怎麼淚崩都救不回來。

Act 2 · P04 收到的是行為:

貓在畫面邊緣圍繞紙船試探,來回兩次:貓靠近紙船就微微後退,貓停下紙船又些微飄近。船底暖黃光在此段從無到有浮現,如呼吸般明滅,紙面開始映上水中霓虹的色彩。結束時紙船在積水中央發著微光。

紙船退開、等待、再靠近。那句「我就是紙船」決定了這三個動作。Prompt 把動作交代乾淨,觀眾再從破紙箱、雨夜、無人注意的門和一起離場讀出自己的答案。故事沒有消失,它躲進了鏡頭選擇裡。

Act 1 別急著偷看 P08

首次 Prompt 的「連續性錨點」一次爆雷整支片:紙船在第四鏡發光、第五鏡被漣漪擾動、第六鏡靠近鼻尖、第七鏡飛起,自動門跟著打開,第八鏡再帶貓離開。

總分鏡需要這份全局資訊。只負責 P01–P03 的生成提交用不到。實際版把範圍收回眼前:

【保持一致】三個鏡頭之間,貓的外觀與濕透毛髮、紙箱與紙船各只有一個、落地玻璃在貓身後與積水在貓前方的方位、積水深度與玻璃反射角度、霓虹光色與亮度、雨勢、船槳會隨著船頭的方向變化,全程一致。

數量、空間、外觀、方向留下。P04 以後的事件回到各自的 Act。每個 P 段再寫明結尾,例如 P03 收在四掌著地、腳掌沒有碰船、紙船仍浮在水上。比起一句「保持故事一致」,這些條件真的能拿成片來驗收。

故事板圖片成了 Prompt 的除錯畫面

BytePlus 官方把這種用法稱為 Multi-panel storyboard reference。我們使用的是多宮格故事板:把 P01–P08 排在同一張圖片裡,再把它交給 Seedance 與協助寫 Prompt 的 LLM。文字裡藏得住的矛盾,放到故事板旁邊通常藏不住。

16:9 橫式八格分鏡,依左至右、由上而下呈現貓蜷縮在破紙箱旁、抬頭看紙船、伸掌試水、紙船微光、貓靠近紙船、鼻尖貼近、紙船浮起,以及貓跟著紙船走入雨街。

實際用於 Desktop 生成的 16:9 故事板圖片。

9:16 直式八格分鏡,依左至右、由上而下呈現同一組 P01–P08。

實際用於 Mobile 生成的 9:16 故事板圖片。

只看「P01 固定、P02 跟拍、P03 跟隨」,三個術語排得很整齊。圖文並讀後,景別、主體位置和姿勢都能對回每一格。三個問題也隨之浮上來:這裡規劃了三顆鏡頭;Act 1 必須有明確終點;構圖已經提供的資訊不必再散落到三套欄位裡重播。

最終 Prompt 給故事板一個清楚的職位:提供閱讀順序與大致構圖。線稿風格、灰階、格線、文字標註和占位角色造型一律不跟。動作、運鏡、結束狀態交給 P01–P03 的文字段落。

本篇處理故事板圖片如何協助 LLM 寫 Prompt。Seedance 最後用了幾格、落在哪些影格,請看左右對照的〈P01–P08 成片實測〉。那一篇直接上證據,不靠印象派。

參考圖一出來,Prompt 就得改口

第一版替三張素材套用同一句「只用於最終形象與服裝」。貓有外觀,便利商店和紙船被分配到「服裝」,現場氣氛開始有點微妙。

四張參考圖完成後,我們把圖交回 LLM,逐項找出圖和字的硬衝突。

貓:小金寶 1 號

橘色摺耳貓的正面全身參考圖。

紙船:小方舟

白紙摺成、帶船尾立架與細長船槳的紙船參考圖。

紙箱:瓦楞紙

翻蓋敞開、邊角破損並局部塌陷的瓦楞紙箱參考圖。

場景:便利商店轉角

雨夜轉角便利商店、落地玻璃、霓虹燈與門前積水的場景參考圖。

圖片把改稿拉回具體決定:

圖裡真正看得到什麼 Prompt 跟著怎麼改
店面沒有騎樓,是開放人行道 「騎樓角落」改成「店門前人行道」
貓是摺耳,而且參考圖是乾毛 取摺耳、虎斑、五官和體型;淋濕狀態由事件腳本另寫
船是白紙、尖船頭、船尾立架與細長船槳 「傳單紙船」改成具體結構,並排除參考圖的深色背景
紙箱相對完整、偏乾 保留結構,再於事件裡要求更濕爛、塌陷

先寫 Prompt,再生成參考圖,不代表文字從此封印。圖一旦存在,它就是下一輪改稿的事實。圖和字互相拉扯時,結果可能選任何一邊。

紙船參考圖本身帶著底光,Act 1 實際提交版又沒有保留「本段全程不發光」。直式 P02、P03 因而提早出現暖光。這個案例只能支持一件事:本次輸出採用了參考圖裡可見的光源。它無法替「負面限制永遠可以省略」背書,先別把三次生成寫成宇宙定律。

影片製作不再是回合制了

我們實際走過的循環很簡單:

  1. 寫故事和導演意圖。
  2. 生成多宮格,以及角色、場景、道具參考圖。
  3. 把圖片交回 LLM,檢查構圖、外觀和 Prompt 的衝突。
  4. 一次整理一個 Act,先送 480p 預覽。
  5. 看過畫面,再選接點與下一段首幀;確認能用後才提升到 2K 與 60fps。

我們團隊也沒什麼江湖地位創造 buzz word,但我們內部管這個叫互動式( 明明就在抽卡 )創作。要我們造詞也可以,例如:創意顯化工作流、生成式創意。

跑題了。

前置作業仍然有硬功夫。主體數量、空間位置、鏡頭順序、Act 起訖、每張參考圖負責的屬性、下一段從哪一幀接,這些決定一改就會牽動整支片,值得早點鎖定。門在某秒開幾度、雨絲長什麼樣、動作快慢半秒,看到預覽再判斷也來得及。

最終我們的每一個Act 都是一次過( 我們水準低 )。那張故事板圖片與字節跳動的 skill ( 僅適用於他家的模型 ),實實在在的把創意、把最初的一句話、把概念呈現在創作者的眼前。

這次 Prompt 最後留下了什麼

我們清掉了:

  • 「眼神充滿好奇」這類單獨無法驗收的情緒標籤;
  • 場景和紙船也被套上「服裝」的資產樣板;
  • 同一動作散落在不同欄位裡的重複版本;
  • 與三鏡剪接互撞的一鏡到底句子;
  • Act 1 暫時用不到的 P04–P08 事件。

我們留下並寫得更細:

  • 一隻貓、一個紙箱、一艘紙船,以及全程不接觸的關係;
  • 紙船靠近、貓抬頭、前掌試水、紙船後退的因果順序;
  • 玻璃在貓身後、積水在前方的空間方向;
  • 濕毛、霓虹倒影、雨聲和紙船晃動等可見、可聽狀態;
  • 每一鏡和每個 Act 都能拿成片核對的結束狀態。

故事回答「我們為什麼要拍」。多宮格先排出大致畫面,參考圖鎖定外觀和空間,Prompt 再把所有選擇整理成一組能被執行的鏡頭。第一版把四件事寫成一鍋;實際提交版終於讓每一層各自上工。

完整成片、Blender 白模與製作順序,見〈用 AI 做影片:一艘紙船來接一隻貓〉。通用的 Seedance 2.5 素材角色、首幀與多宮格規則,另見〈Seedance 2.5 Prompt Skill 到底管什麼?〉。

16:9 與 9:16 完整成片

以下兩支成片各由 3 個 Act 生成:Desktop 為 16:9,Mobile 為 9:16。我們先用 480p 確認內容,再透過 BytePlus 的原生功能升至 2K、補幀到 60fps。

16:9 Desktop

完整成片 45 秒;來源影片為 3184×1792、60fps。嵌入版以黑底保留完整橫式構圖。

9:16 Mobile

完整成片 46.5 秒;來源影片為 1792×3184、60fps。嵌入版以黑底保留完整直式構圖。

系列文章 SERIES用 AI 做影片4
  1. 01用 AI 做影片:提示詞就是你的影片
  2. 02用 AI 做影片:先決定從文字、圖片還是腳本開始
  3. 03用 AI 做影片:讓每個鏡頭接得上的簡單 Storyboard
  4. 04用 AI 做影片:一艘紙船來接一隻貓,我們真的把它拍出來了
推薦閱讀 RECOMMENDED
教學Seedance 2.5 Prompt Skill 到底管什麼?參考圖、故事板與首幀一次拆開教學用 AI 做一支短片:從腳本到成片的完整工作流,以及它真正的成本