跳到主要內容
Frank Chiu

徐享/享哥

AI應用規劃師

具有 10 年經驗在數位行銷與電商廣告領域,專精生成式AI應用與個人資料保護,致力於以獨特商業洞察與實戰案例研討,助力品牌突破成長瓶頸。

文章目錄

  1. 1. 一、先看懂這 40 秒:我們要練習的是兩輪製作、四段影片
  2. 2. 二、先改變提示詞的寫法:不要列特效,要寫事件
  3. 3. 三、豆包新手怎麼開始?先分清楚兩個工作
    1. 3.1. 先讓豆包幫你規劃,而不是立即生成
  4. 4. 四、先準備一張適合跳舞的起始圖
    1. 4.1. 生圖提示詞
  5. 5. 五、四段共用設定:每次都要帶上,不要假設模型記得
    1. 5.1. 共用設定
    2. 5.2. 為什麼這次把 125 BPM 改成 120 BPM?
  6. 6. 六、第一段 A1:先讓動作「啟動畫框」
    1. 6.1. 這段在學什麼?
    2. 6.2. A1 中文提示詞
    3. 6.3. 看什麼才算有做到?
  7. 7. 七、第二段 A2:讓人物真的「推開畫框」
    1. 7.1. 這段在學什麼?
    2. 7.2. A2 中文提示詞
    3. 7.3. 為什麼要安排半身鏡頭?
  8. 8. 八、第三段 B1:不要增加舞步,先升級「立體空間」
    1. 8.1. 這段在學什麼?
    2. 8.2. B1 中文提示詞
    3. 8.3. 這段怎麼比較?
  9. 9. 九、第四段 B2:升級接觸細節,讓高潮「有原因、有結果」
    1. 9.1. 這段在學什麼?
    2. 9.2. B2 中文提示詞
    3. 9.3. 這段最重要的取捨
  10. 10. 十、生成前與生成後,分別要驗證什麼?
    1. 10.1. 生成前:檢查矛盾
    2. 10.2. 生成後:用可見現象驗收
  11. 11. 十一、四段怎麼接?畫面與音樂要分開處理
    1. 11.1. 畫面:A1 接 A2,B1 接 B2
    2. 11.2. 音樂:同樣 BPM,不等於同一首歌
  12. 12. 十二、要做成單一連續 40 秒,改這三個地方
  13. 13. 最後:先學會控制一個效果,再追求整支影片都很精彩
  14. 14. 常見問答 (FAQ)
    1. 14.1. Q1:四段提示詞可以一次貼上,直接生成連續 40 秒嗎?
    2. 14.2. Q2:A1、A2、B1、B2 每段都要貼共用設定嗎?
    3. 14.3. Q3:120 BPM 是參考影片量測出的速度嗎?
    4. 14.4. Q4:手掌穿過畫框時,應該先改哪裡?
    5. 14.5. Q5:這些提示詞是參考作品原作者使用的版本嗎?

豆包街舞 × MG 四段提示詞教學:讓舞者推開畫框,做出 40 秒雙版本合輯

- A1/A2/B1/B2 四段各 10 秒實作|動作觸發、推框互動與立體空間 -

看過一支好看的 AI 跳舞影片,最值得研究的不是「對方用了多少特效」,而是:

人物做了什麼,畫面為什麼跟著變化?

手臂向外揮,畫框隨之展開;雙掌往兩側推,黑色框邊真的被推開;最後一個重拍,立體文字碎裂,留下清楚的人物與主標。

這種「動作與圖像有因果關係」的設計,就是這次要練習的重點。

參考作品:〈YUNA|MOVE THE FRAME〉40 秒雙版本合輯

本文的畫面分析依據,是提供的 0–19 秒與 20–39 秒逐秒截圖;本次未取得可播放影片或音軌,Facebook 頁面也未能直接讀取。截圖可用來觀察構圖與元素變化,不能據此確認動作流暢、精準接觸或音畫同步。以下提示詞是根據參考畫面重新設計的教學版本,不是取得原作者的提示詞,也不能據此判定對方使用的模型或後製工具。

如果還沒做過單段練習,可以先看豆包 AI 跳舞影片與 MG 入門教學。本篇進一步拆解四段實作,重點是觸發時機、立體空間與手掌接觸。本文及下載包均為教學試作提示詞,尚未執行影片生成與成片驗收。


一、先看懂這 40 秒:我們要練習的是兩輪製作、四段影片

逐秒截圖涵蓋 0–39 秒,約 20 秒處再次出現主標與相近的舞台元素。本教學將這組畫面解讀為前後兩輪練習的參考;這是教學編排,不代表已確認原作者的生成段數或剪輯方式。因此,這次採用的安排是:先做一個 20 秒版本,再做一個加強後的 20 秒版本。

段落 對照參考片的時間 原片值得注意的內容 本次實作目標
A1:啟動畫框 0–10 秒 畫框、腳步、大型 MOVE、逐漸增加的空間層次 學會讓舞步觸發圖像
A2:推框收尾 10–20 秒 框架傾斜、BEAT、雙手推框、片名揭示 學會接觸互動與收尾
B1:空間升級 20–30 秒 更突出的文字厚度、透視與框架變化 在 A1 基礎上加強立體感
B2:互動升級 30–40 秒 框架開合、近距離推框、碎裂與最後主標 在 A2 基礎上加強因果關係

這些分段是方便教學的近似範圍,畫面依據可對照下方兩組逐秒截圖。MG 是 Motion Graphics 的縮寫,指文字、線條、框架與幾何元素等動態圖像。

參考作品 0–19 秒逐秒截圖:黑色畫框、MOVE、BEAT、推框姿勢與主標

前半段參考截圖:可觀察框架層次、景別與手掌位置;實際動作先後仍需回到影片驗證。

參考作品 20–39 秒逐秒截圖:立體文字、透視框架、手部互動與碎塊收尾

後半段參考截圖:本教學據此設計立體空間與接觸互動的加強版本。截圖來源為使用者提供的參考作品畫面,原作品連結見上方。

最後的組合是:

  • A1+A2=20 秒 A 版
  • B1+B2=20 秒 B 版
  • A 版+B 版=40 秒比較合輯

這樣除了完成作品,還能看出「改了哪個條件,帶來什麼差異」。文末也會說明如何改成一支不重新開場的連續 40 秒影片。


二、先改變提示詞的寫法:不要列特效,要寫事件

原本的英文提示詞已經有很好的方向,例如角色一致、腳步清楚、特效跟著動作,以及逐漸增強的節奏。

這次要做的是,把抽象要求改成可以看見、可以檢查的事件。

原本比較抽象的寫法 改成具體事件 想得到的效果
加入炫酷的動態圖像 手臂向外揮時,後方畫框沿同方向展開 觀眾看懂動作與圖像的關係
大型動態文字 MOVE 有厚實側面、透視與地面投影 文字像舞台裝置,而不是字幕
畫框跟著舞者互動 雙掌先碰到框邊,再向外施力,框邊才移動 看起來真的在推框
最後所有效果一起爆發 只爆發一次,接著清空中央,留下人物與主標 高潮之後有清楚收尾
全程禁止切鏡 固定同一攝影棚,允許少量有目的的景別切換 可以看舞步,也可以看清手部互動

這次最重要的提示詞公式是:

人物動作 → 圖像回應 → 結束狀態。

例如:

舞者雙掌貼住左右框邊,接著向外推開。框邊隨手掌移動,中央空間逐漸變寬;動作完成後,框架停在兩側,中央保持乾淨。

這一句同時交代了開始、過程和結果,比「加入推框特效」更容易拿來驗收。


三、豆包新手怎麼開始?先分清楚兩個工作

你會用到兩種操作,不要混在一起:

一般對話:請豆包協助分析、寫提示詞、檢查矛盾。
影片生成:上傳素材、設定規格,再把完成的提示詞送進影片模型。

Seedance 2.0 官方曾列出的豆包入口是「豆包 App 對話框 → Seedance 2.0 → 選擇模型」。實際按鈕、可選模型與素材模式,仍應以你的帳號介面為準,不必為了跟教學畫面完全相同而更換版本。字節跳動 Seed

本次建議操作順序:

步驟 你要做什麼
先規劃 在一般對話貼上下面的「導演提示詞」
準備人物 選好角色圖片,再建立白色棚景的全身起始圖
生成 A1 上傳人物素材,只貼 A1,不要一次貼四段
接著做 A2 使用 A1 合格的結束畫面協助接續
製作 B1、B2 保留角色與主要設定,測試加強版本
驗收與合併 比較兩版,再組成 40 秒合輯

Seedance 2.0 的技術報告列有 4–15 秒的直接生成範圍,因此 10 秒是合理的練習單位;這不代表所有 Seedance 版本都只能生成這個長度,也不代表每個平台開放完全相同的設定。arXiv

先讓豆包幫你規劃,而不是立即生成

把以下文字貼進一般對話,並提供人物圖、參考影片或本文的分段描述。

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
你是一位舞蹈MV導演與MG動態圖像設計師。
請先規劃並撰寫提示詞,不要直接生成影片。

我想參考一支40秒雙版本舞蹈影片,製作四支各10秒的練習片:

A1:動作啟動畫框。
A2:雙手推開畫框,完成第一次收尾。
B1:保留A1的主要舞步,加強文字與框架的立體空間。
B2:保留A2的概念,加強手掌接觸、推框因果與乾淨收尾。

A1+A2構成20秒A版。
B1+B2構成20秒B版。

使用我上傳的成年街舞女孩圖片,固定人物與服裝,
不要改成參考影片中的人物。

場景固定白色攝影棚。
主要元素為黑色立體矩形框、電光青色邊緣、
少量螢光黃,以及MOVE、BEAT設計文字。

請先列出每段的:
主要舞步、鏡頭、MG事件、起始狀態、結束狀態、
預期效果與驗收方法。

接著輸出四份中文影片提示詞。
每份都使用局部0–10秒時間,不要混用整片時間。

每段只安排少量主要事件,
用「人物動作→圖像回應→結束狀態」描述,
不要只是羅列特效名稱。

最後檢查動作是否過多、接觸是否合理、
首尾是否能銜接、指令是否矛盾。

看不到影片或無法分析音訊的地方請明說,
不要宣稱已實測成功。

這段是在教 AI「如何幫我們寫」,不是要直接送進影片生成框。


四、先準備一張適合跳舞的起始圖

若手上的人物圖採用低角度、蹲姿或鞋子靠近鏡頭的構圖,可以留作造型參考;這次的目標是看清楚全身舞步,應另外準備一張正面全身起始圖。本文不附角色身分參考圖,請自行準備符合下列服裝設定的成年角色圖片,再開始生成。

角色參考圖負責「長什麼樣子」;起始圖負責「從什麼構圖與姿勢開始」。

Seedance 官方說明支援圖片、影片與音訊等參考,可以分別提供人物、構圖、動作與聲音資訊;實際能否同時指定不同素材角色,仍要看使用入口。字節跳動 Seed

生圖提示詞

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
以上傳圖片中的成年街舞女孩為人物與服裝參考,
建立一張16:9橫式、單人全身的舞蹈影片起始圖。

保留五官、高馬尾、黑色帽子、銀色耳環、
黑色短版上衣、黑白寬鬆外套、黑色工裝褲、
褲鏈與白色球鞋。

不要改成參考MV中的另一位人物或另一套服裝。

將場景改為明亮乾淨的白色攝影棚,地面柔和反光。
人物站在中央,雙腳錯開、膝蓋微彎,
手臂處於即將向外揮動的舞蹈起勢。

使用正面自然視角,頭頂與鞋底完整入鏡,
左右保留跨步空間。
不要蹲姿、極端低角度或巨大近景鞋子的構圖。

人物後方只有一個厚實的黑色矩形框,
框邊帶細青色亮線。

只畫一位人物,不要多角度拼版,不放文字。
先確保手指、雙腳與服裝結構自然。

起始圖確認之後再生影片。不要帶著已經變形的手指、裁掉的鞋子,期待後面生成時一定會自行修好。


五、四段共用設定:每次都要帶上,不要假設模型記得

下面的四段提示詞,使用方式是:

共用設定+當次段落提示詞。

不要把四段一次貼進同一個 10 秒生成任務,也不要直接接在舊英文提示詞後面,否則可能同時出現「禁止切鏡」與「切到半身」等矛盾。

共用設定

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
生成一支10秒、16:9橫式的單人街舞MV。

以本次上傳的角色圖片為人物與服裝依據,
固定成年女性角色的五官、髮型、服裝、配件與身材比例。

場景固定為明亮白色攝影棚,地面柔和反光。
主要圖像為黑色立體矩形畫框、電光青色邊緣、
少量螢光黃,以及本段指定的MOVE或BEAT文字。
文字是舞台設計,不是字幕。

人物、舞步與接觸關係的清楚程度,優先於特效數量。
重心轉移自然,雙腳落地穩定。
腳步組合使用全身鏡頭,手部互動可以使用半身鏡頭。

每段最多三次有目的的切鏡,但不更換攝影棚。
不要混亂旋轉、頻繁閃光或長時間遮住臉與雙腳。

有上傳節奏音訊時,以該段音訊為節奏參考。
沒有音訊參考時,生成原創4/4拍、
目標120 BPM的電子嘻哈練習器樂,無演唱、無對白。
人物自然閉口或呼吸,不做演唱口型。

下面的秒數都是這次10秒生成任務的局部時間。
依順序呈現事件,主要發力與圖像變化盡量對應重拍。

為什麼這次把 125 BPM 改成 120 BPM?

這是為了方便練習,不是參考片的實測速度,也不是 120 BPM 比較好看。

假設使用 4/4 拍、以四分音符計拍,120 BPM 就是每拍 0.5 秒、每小節 2 秒。音樂從小節起點開始時,10 秒正好是五小節,方便對照 0、2、4、6、8 秒的分段。

但這只是時間計算。提示詞寫了 120 BPM,不代表生成音樂一定精確符合,仍要聽、看節拍或量測確認。


六、第一段 A1:先讓動作「啟動畫框」

這段在學什麼?

參考片前段有黑框、腳部特寫、大型 MOVE,以及逐步增加的框架層次。我們先取其中最容易辨認的關係:手臂展開,框架也展開;腳步落下,文字出現。

這一輪先不追求滿場碎片、複雜旋轉和大量特寫。

預期效果:舞者仍是主角,但觀眾能明確感覺她的動作正在啟動畫面。

A1 中文提示詞

請接在「共用設定」後使用。

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
【A1:動作啟動畫框】

核心:先建立「我一動,畫框就回應」的關係。
本段只練習畫框展開、MOVE出現和短追蹤線。

0–2秒:
中全身鏡頭。
舞者由起勢直接接肩膀重擊與手臂向外揮動,
不要額外站著等待。
身後一個黑色矩形畫框隨手臂展開,
青色邊緣短暫亮起。

2–4秒:
切到正面全身。
左腳側跨、右腳跟進,再做一次清楚的腳跟腳尖切換。
落腳重拍時,厚實的黑色MOVE文字從後方浮現,
位於人物背後,鞋子保持可見。

4–6秒:
交叉步接向外手臂重擊。
一條短青色線沿著揮臂方向延伸,完成後消失,
不留下滿場光線。

6–8秒:
舞者向側邊跨步,
背景單一畫框沿深度方向展開成三層。
人物保持在最前方,不被框架穿過。

8–10秒:
完成簡單換腳,回到中央全身構圖。
MOVE退場,保留身後三層矩形畫框。
最後以重心穩定、雙手落在腰側的過渡姿勢收尾,
不做片尾字卡,為下一段接續預留構圖。

看什麼才算有做到?

先看手臂揮出與畫框展開是否有關係,再看 MOVE 出現時有沒有遮住人物。只要這兩件事還不清楚,就先不要增加其他效果。

常見失敗:人物跳得很正常,但框架自己轉個不停。

把相關段落改成:

1
2
3
4
畫框只在手臂向外展開的那一次重拍擴張,
方向跟手臂一致。
其餘時間保持穩定,
取消額外旋轉和持續閃爍。

這不是把效果變少而已,而是把「什麼時候才能動」寫得更清楚。


七、第二段 A2:讓人物真的「推開畫框」

這段在學什麼?

參考片約 16–17 秒的重點,是雙手貼近左右框邊,再向外展開。相比「伸手時出現一道光」,這種構圖更容易被理解為人物在操作圖像;手掌是否持續貼住框邊,仍需播放影片才能確認。

我們要練習三件事:

碰到 → 推動 → 打開。

預期效果:不是背景自動開門,而是舞者用雙手把空間推開。

A2 中文提示詞

本段在合輯中是 10–20 秒,但送進生成工具時,時間仍由 0 秒開始。

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
【A2:推框與第一次結尾】

核心:框架旋轉、雙手推框、乾淨收尾。

有上傳A1接續圖片時,
從其人物姿勢、位置、鏡頭尺度和三層畫框接著表演。
沒有接續圖片時,從正面中央全身構圖開始。

0–2秒:
全身鏡頭。
舞者交叉步接一次受控的四分之一轉身,
身後多層畫框順時針緩慢傾斜。
人物保持直立、地板水平,攝影機不翻滾。

2–4秒:
舞者回正,胸口做一次清楚的向前、收回動作。
框架也輕微向內縮,再恢復原狀。
短暫出現立體BEAT文字後退場。

4–7秒:
切到半身鏡頭。
兩側框邊已在雙手可接觸的距離。
舞者雙掌先抵住框邊,再伸展手臂向外推開。
框邊跟著手掌移動,中央開口逐漸變寬。
接觸處有短暫青色亮線,不要手掌穿模。

7–9秒:
回到全身。
舞者向外跨步、打開雙臂,
背景出現一次向外擴散的震波。
其餘圖像退到兩側,不淹沒人物。

9–10秒:
舞者強力定格,背景留下單一MOVE主標。
保留乾淨白色空間,
結尾不再新增粒子、框架或其他文字。

為什麼要安排半身鏡頭?

因為本段最重要的不是腳步速度,而是手掌有沒有接觸框邊。

這是有目的的景別切換:看舞步時用全身,看接觸時拉近。

常見失敗:框架一旋轉,人物和地板也跟著歪掉。

修改成:

1
2
3
只有身後畫框旋轉。
地板保持水平,舞者保持直立,攝影機不翻滾。
取消舞者轉身,只保留側向跨步。

這一輪先分清楚「誰在動」,不要讓人物、背景、攝影機同時搶著旋轉。


八、第三段 B1:不要增加舞步,先升級「立體空間」

這段在學什麼?

參考片後半段的 MOVE 更突出文字厚度與透視,框架也逐漸形成向後延伸的通道。

這次保留 A1 的主要舞步,只加強圖像的空間關係。

這裡幾個名詞,可以直接用白話寫進提示詞:

想描述的特徵 中文可以怎麼寫
厚度 看得到文字側面,不是一張薄片
倒角 字體邊緣有斜面,能接住反光
透視 遠處的框架較小,向後形成通道
前後遮擋 人物在前、文字在後,不要穿過身體
光影一致 文字與人物像處於同一個攝影棚

預期效果:文字與框架不像貼在影片上的裝飾,而像舞者身後的大型舞台裝置。

B1 中文提示詞

這是 B 版的開場,請使用與 A1 相同的角色起始圖,而不是接 A2 的片尾定格。

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
【B1:A1的空間深度升級版】

這是另一個20秒版本的開場,不接續A2片尾姿勢。
使用與A1相同的角色起始圖片、舞步安排、配色及音樂片段。
主要升級只有圖像的空間深度,不增加舞步數量。

0–2秒:
中全身鏡頭。
肩膀重擊接手臂向外揮動,啟動身後黑色畫框。
框邊具有清楚厚度、側面與斜面反光,
不像貼在畫面上的黑色線條。

2–4秒:
切到正面全身。
左腳側跨、右腳跟進,再做腳跟腳尖切換。
落腳重拍時,巨大MOVE出現在人物背後,
帶有厚實側面、倒角、透視和地面投影。
文字傾斜少量角度以看見厚度,
保持完整可讀,不翻到背面。

4–6秒:
交叉步接手臂重擊,短追蹤線只出現一次。
MOVE輕微側向轉動,保持字形不變。
人物在前、文字在後,遮擋關係明確。

6–8秒:
舞者向側邊跨步,
畫框沿深度方向展開成四層,
由近到遠逐漸縮小,形成透視通道。
青色邊緣光依序由前向後亮起。

8–10秒:
舞者回到中央全身構圖。
MOVE退場,保留四層框架。
最後採用與A1相近的穩定過渡姿勢,
不要突然換場景或放入結尾字卡。

這段怎麼比較?

把 A1 和 B1 放在一起,先不問哪支「比較炫」,而是問:

文字的厚度有沒有更清楚?框架有沒有更明確的遠近?人物是否仍然好看、好辨認?

這不是嚴格控制所有條件的模型實驗,重新生成的舞步仍可能不同;但把主要修改集中在空間深度,至少比較容易理解修改方向。

常見失敗:字體一轉動,就變成其他字母。

修改成:

1
2
3
4
5
MOVE全程保留正面可讀字形,
只做小角度側轉,不翻背面、不拆字、不融化。

仍不穩定時,取消轉動,
只保留文字厚度與側面光影。

官方也指出文字還原精度仍有改善空間,所以不要把「提示詞寫了正確拼字」當成生成結果一定正確。品牌名稱需要逐次檢查;重要字樣也可以留到後製處理。字節跳動 Seed


九、第四段 B2:升級接觸細節,讓高潮「有原因、有結果」

這段在學什麼?

參考片最後一段包含框架開合、雙手互動、碎塊與主標揭示。我們不把所有效果原封不動塞進去,而是選一個主要事件:雙手推開框架,才觸發最後的爆發。

B2 的升級,不一定是更多效果。

更重要的是留出時間,讓觀眾看見:

手靠近 → 手碰到 → 手開始推 → 框架打開 → 效果退場。

預期效果:畫面像一段完整的小表演,而不是舞蹈旁邊剛好有特效。

B2 中文提示詞

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
【B2:A2的接觸與收尾升級版】

核心:先接觸,再受力,再展開,最後清空。
寧可減少舞步,也要讓手掌與框邊互動清楚。

有上傳B1接續圖片時,
從該姿勢、鏡頭尺度與四層框架接著表演。
沒有時,從中央全身、身後四層框架開始。

0–2秒:
正面全身。
舞者做簡短交叉步和肩膀重擊,
畫框收回正面。
兩側框邊向舞者靠近,但不接觸軀幹。

2–4秒:
切到半身。
舞者雙手移向左右框邊,手掌貼住內側邊緣,
接觸處出現細小青色亮線。
此時框架停止移動,
明確呈現「手已碰到,尚未推開」。

4–7秒:
雙掌向外施力,手肘逐漸伸直。
兩側框邊跟隨手掌向左右移動。
手掌始終貼在框邊,不穿透、不離開接觸面。
隨開口變寬,後方青色光線逐漸露出。
不要在雙手開始施力前,就讓框架自行打開。

7–9秒:
切回全身,舞者跨步打開雙臂。
框架完全展開後,
後方BEAT短暫出現並只碎裂一次。
少量大塊碎片向兩側與後方離開,
中央維持清楚。
接著一次圓形震波向後方擴散。

9–10秒:
碎片與框架完全退場,
舞者定格,留下單一MOVE主標。
此時不要再增加效果。

無法同時完成碎裂與震波時,
保留震波、取消碎裂,
優先保住人物與結尾可讀性。

這段最重要的取捨

推框時,手臂不能一邊高速甩動、一邊始終貼住同一個接觸面。因此,我刻意讓中段互動較慢、較清楚,前後再用舞步維持節奏。

不是整支影片每一秒都要最快,才會有力量。

常見失敗:手掌穿過框架,或框架比手先移動。

先把這一輪縮減成:

1
2
3
4
5
6
7
8
本輪只做雙掌貼住框邊後向外推開,
使用穩定半身鏡頭。

取消碎裂、文字和鏡頭移動。
手掌持續貼住內側邊緣,
框架跟隨手掌向外移動。

接觸動作自然,優先於其他視覺效果。

等推框成功,再逐項加回震波、文字或碎裂。不要一次把所有問題綁在一起重試。


十、生成前與生成後,分別要驗證什麼?

生成前檢查的是指令;生成後檢查的才是影片。

讓 AI 給提示詞 95 分,不能證明手掌真的碰得到框架,也不能證明音樂已經精準同步。

生成前:檢查矛盾

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
請審查以下10秒影片提示詞,先不要生成。

檢查:
人物與服裝是否衝突;
10秒內是否塞入太多動作;
是否禁止切鏡卻安排特寫;
舞者與鏡頭是否同時快速旋轉;
手掌與框邊的距離是否合理;
是否有特效遮住腳步;
局部時間是否超過10秒;
是否引用了實際未上傳的素材;
開頭和結尾是否能與相鄰片段接續。

用「問題→原句→替換句」輸出。
只修改有問題的地方,
不要因為要優化就增加更多效果。

不要用主觀總分代替檢查。

生成後:用可見現象驗收

驗收項目 具體看什麼
人物一致 帽子、髮型、臉部、外套與鞋子有沒有改變
舞步自然 換腳是否合理,支撐腳有沒有不自然滑動
圖像因果 是手先動、框才動,還是兩者各做各的
接觸成立 手掌有沒有穿框、懸空或突然離開
空間成立 人物、文字、框架的前後位置有沒有跳來跳去
文字正確 MOVE、BEAT 是否拼對,旋轉後是否變字
結尾乾淨 最後是否真的留下人物與單一主標
音畫節奏 主要動作、圖像與鼓點是否對得上

建議先正常播放看整體,再靜音看動作,最後專門檢查音樂與圖像的重拍。

交給豆包分析時,可以補上這段:

1
2
3
4
5
6
7
8
9
10
11
請分析我上傳的生成影片,不是只評價提示詞。

依時間列出:
秒數、可見問題、是否能確認、
一個最值得優先修改的提示詞句子。

本輪只選三個主要問題,不重新設計整支影片。

沒有音訊分析能力時,不要判定BPM或逐拍同步。
只有截圖時,不要宣稱動作流暢。
無法確認的項目請標示「無法驗證」。

十一、四段怎麼接?畫面與音樂要分開處理

畫面:A1 接 A2,B1 接 B2

若使用入口支援首幀或接續模式,可以從 A1 的結尾選一張人物清楚、手腳正常、構圖合適的畫面,作為 A2 起點;B1 接 B2 也是相同做法。

但一張結束圖片只能提供某一刻的畫面,沒有完整的前後運動資訊,因此不要把「尾幀接首幀」當成保證無縫的功能。

接不上時,先檢查人物位置、鏡頭遠近與手臂姿勢。必要時在重拍上安排明確切鏡,比硬做一個看得出破綻的假連續鏡頭更適合這次練習。

Seedance 官方另有說明影片延長能力;不過,只有在你的使用入口實際提供該功能時,才把它當成可用的接續方法。字節跳動 Seed

音樂:同樣 BPM,不等於同一首歌

四次都要求「120 BPM 電子嘻哈」,仍可能得到四段不同旋律、不同鼓組與不同音色。

這次製作比較合輯,我建議:

先準備同一段 20 秒配樂,A 版使用一次,B 版再使用一次。

支援音訊參考時,可以把前後兩個 10 秒片段分別提供給對應的生成任務;不支援時,就把生成音訊當成練習參考,最後在剪輯時間軸統一使用選定的配樂,再調整可用剪點。不要直接把四段生成音樂接起來,卻期待它自然成為同一首歌。

對拍仍不理想時,優先調整片段起點、剪點與特效落點,不要大幅改變播放速度,把原本自然的舞步拉壞。


十二、要做成單一連續 40 秒,改這三個地方

前面的設計是兩個 20 秒版本。要改成從頭到尾持續推進的一支影片,不是直接把四段接起來就好。

要修改的位置 修改內容
A2 最後一秒 取消片尾主標與長定格,保留人物、框架與過渡動作
B1 開頭 取消「第二版本重新開場」,改成承接 A2 的結束狀態
全片音樂 使用單一 40 秒音軌,只有 B2 最後一秒是真正結尾

可以把這段交給豆包,請它調整現有四份稿:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
請將A1、A2、B1、B2改編成一支連續40秒影片,
仍分成四次、每次10秒生成。

不要重新設計人物與場景。

A2最後一秒不做片尾,
改成中央全身、雙臂回收、
身後保留三層畫框的過渡構圖。

B1不重新開場,
從A2合格結束畫面的姿勢、鏡頭尺度與框架狀態接續,
先延續動作,再逐步增加文字厚度與空間深度。

只有B2最後一秒做真正的片尾。
四段都使用同一首配樂的對應時間片段。

請逐段列出起始狀態與結束狀態,
檢查是否發生人物瞬間換位置、
框架突然增加、姿勢重設或音樂重新開始。

這樣,四段的敘事才會變成:

啟動畫框 → 打開空間 → 加強立體舞台 → 最後爆發與收尾。


最後:先學會控制一個效果,再追求整支影片都很精彩

這次四段練習,其實是在學四種不同的控制:

A1 控制觸發時機;A2 控制人物與圖像互動;B1 控制空間層次;B2 控制接觸順序與收尾。

提示詞不必每次越寫越長。當你已經知道問題在哪,最有效的修改往往只有一句:

「框架要等手掌開始施力才打開。」

或是:

「最後一秒不要再新增效果。」

第一次實作先做 A1。人物穩定、腳步看得清楚、MOVE 與框架的出現有理由,再進到 A2。

四段已包含共用設定、可分別複製使用的完整中文提示詞,連同生圖、審查、局部修正與使用者提供的英文提示詞範例,已整理為實作包。英文範例僅供對照,不是原作者已證實使用的提示詞;不要與新版中文稿混貼。

下載四段完整中文提示詞實作包(TXT)

內文示範「共用設定+單段腳本」的組合方式;下載包的 A1、A2、B1、B2 已各自包含共用設定,每次只需複製其中一段。角色圖需自行準備並實際上傳,本文參考截圖用於畫面分析,不是提示詞中黑帽、高馬尾、工裝褲角色的身分參考。

常見問答 (FAQ)

Q1:四段提示詞可以一次貼上,直接生成連續 40 秒嗎?

本篇設計為四次各 10 秒生成,A1 接 A2 組成 20 秒 A 版,B1 接 B2 組成 20 秒 B 版,再做比較合輯。要改成連續 40 秒,須修改 A2 結尾、B1 開頭並使用單一 40 秒音軌;實際可選長度以模型與介面為準。

Q2:A1、A2、B1、B2 每段都要貼共用設定嗎?

使用內文分段稿時,要先貼共用設定再貼當次腳本。下載包的四份獨立提示詞已包含共用設定,每次複製一份即可,不要一次貼四份,也不要接在規則不同的舊英文稿後面。

Q3:120 BPM 是參考影片量測出的速度嗎?

不是。120 BPM 是方便分段的練習目標:4/4 拍以四分音符計拍時,每拍 0.5 秒、每小節 2 秒。生成音訊仍需量測或核對;四次要求同樣 BPM,也不會自動得到同一首歌。

Q4:手掌穿過畫框時,應該先改哪裡?

先取消文字、碎裂與鏡頭移動,只保留穩定半身鏡頭中的貼框、施力與推開。明確要求手掌持續貼住框邊,框架在施力後才移動,接觸自然後再逐項加回效果。

Q5:這些提示詞是參考作品原作者使用的版本嗎?

不是。這是依提供的逐秒截圖重新設計的教學改編,無法據此確認原作者使用的模型、參考素材、後製方法或音樂流程。本文也未取得可播放影片或音軌,因此沒有宣稱動作流暢或逐拍同步已驗證。

相關文章

AI 角色一致性實用教學:男生、女生設定與社群、電商、短影音中文提示詞
AI 角色一致性實用教學:男生、女生設定與社群、電商、短影音中文提示詞
AI工具 內容行銷 影音行銷

2026/10/11

用 Codex 製作風格一致的 AI 簡報:YAML Image Deck 實作教學
用 Codex 製作風格一致的 AI 簡報:YAML Image Deck 實作教學
AI自動化 AI工具 Codex

2026/10/11

豆包 AI 跳舞影片完整教學:從角色生圖、中文提示詞到 10 秒 K-pop 街舞+MG 動態特效
豆包 AI 跳舞影片完整教學:從角色生圖、中文提示詞到 10 秒 K-pop 街舞+MG 動態特效
AI工具 影音行銷 Seedance

2026/10/10

零基礎 AI 跳舞影片教學:用豆包寫專業舞蹈提示詞,10 秒也能跳出節奏感
零基礎 AI 跳舞影片教學:用豆包寫專業舞蹈提示詞,10 秒也能跳出節奏感
AI工具 影音行銷

2026/10/09

不會剪片也能做 MG 動畫:用 Codex、Claude、Canvas 與 FFmpeg 從零入門
不會剪片也能做 MG 動畫:用 Codex、Claude、Canvas 與 FFmpeg 從零入門
AI工具 Codex 影音行銷

2026/10/09

【Adobe 全家桶替代品來了?7 套開源創作工具開始為 AI Agent 設計】
【Adobe 全家桶替代品來了?7 套開源創作工具開始為 AI Agent 設計】
AI自動化 AI工具 AI Agent

2026/10/08

AI 不會讓你的工作更輕鬆,只會讓你有能力接下更大的工作
AI 不會讓你的工作更輕鬆,只會讓你有能力接下更大的工作
AI自動化 AI工具 AI Agent

2026/10/04

【別再一鏡一鏡抽卡:我整理出一套真正能拍完整故事的 AI 短片製片 SOP】
【別再一鏡一鏡抽卡:我整理出一套真正能拍完整故事的 AI 短片製片 SOP】
AI工具 AI Agent 影音行銷

2026/10/04

AI Coding 成本最佳化:多模型分工取代單一高價方案
AI Coding 成本最佳化:多模型分工取代單一高價方案
AI工具 AI Agent AI Coding

2026/10/03