MINEH4O

01 · 03

人一定是

在作品之前

CLICK TO SKIP

AI · SEEDANCE 2.02026-0710 min

我在家拍了四個動作,做出一支地下犯罪電影

從 Raw Footage、Target Frame、Sequence Storyboard 到 Seedance 2.0 的完整工作流

ByOscar Lai影像工作者Taichung · TW

8 秒精華循環 — 完整成片在第 11 章

這支片的所有「動作」, 都是我在自己家裡拍的:走路、停下、開箱、吃東西 — 四個動作

剩下的九龍城寨、賭場、霓虹和槍手, 都是 AI 生的 — 我給它的只有角色設定、參考畫面和分鏡, 最後在 DaVinci 調光收尾

這篇筆記的核心觀點:
影片告訴 AI 我要怎麼演, 圖片告訴 AI 電影長什麼樣

30 秒看懂整條流程

Workflow · 01

構想與腳本 — 步驟 0101

Concept

構想與腳本

在家拍動作 — 步驟 0202

Act

在家拍動作

挑關鍵幀 — 步驟 0303

Keyframe

挑關鍵幀

生成目標畫面 — 步驟 0404

Design

生成目標畫面

生成影片 — 步驟 0505

Seedance

生成影片

剪輯與調光 — 步驟 0606

Grade

剪輯與調光

↑ 這就是整篇的流程 — 點卡片直接跳到那一章

先看一組完整的過程 — 同一顆鏡頭,從我家走廊到賭場走廊:

SHOT 02 · 從我家走廊到賭場走廊

01 · RAW

在家拍的 5 秒直線位移 — 沒有佈景、沒有燈光,只有動作

每種素材只負責一件事

Asset Roles · 02

分工越清楚, 生成越穩:

Raw Footage — 動作、節奏、表演
關鍵幀 Keyframe — 姿勢、機位、構圖起點
Target Frame 目標畫面 — 場景、美術、燈光、最終長相
Element(@OSCAR-1) — 身份、臉、髮型、服裝一致性
道具參考圖 — 款式與顏色鎖定
Prompt — 優先級、鏡頭語言、限制條件
後期 — 節奏、色彩、聲音、統一感

黑西裝版角色設定圖
角色 — 黑西裝 OSCAR
黑色公事包道具圖(閉合與裝滿現金的開啟狀態)
道具 — 黑色公事包(開關箱是同一只)
Element 的正確用法:
三視圖建成 @OSCAR-1 之後就別再上傳一次 — 模型會把白底和排版當成畫面,還會長出多個角色, Element 管身份,不管畫面

五顆鏡頭,逐顆拆解

Shot Breakdown · 03

每顆卡片都能切換看: 原影片 → 關鍵幀 → 目標畫面 → 生成結果,哪裡成功、哪裡失敗、怎麼修,都寫在卡片裡

SHOT 00

城市建立鏡頭

IMAGE 驅動

開場 — 九龍城寨式的天際線,先交代這是什麼世界

生成 5sExtreme wide establishing・slow push-in
目標畫面 — TARGET FRAME01 · TARGET FRAME

Image-to-Image 生成的最終示意 — 控制場景、燈光、美術與構圖

PROMPT 摘要高密度香港式城市、頂樓違建與空橋、紅藍洋紅霓虹、潮濕反光地面;鏡頭緩慢推進,人物在空橋上小比例走動

成功點

城市密度與霓虹氛圍一次到位

沒有 Raw 也能穩定建立世界觀

問題

背景飛行物偶爾出現不合理路徑

修正

在 Prompt 限制空中載具數量與方向,保持遠景層次

輸入素材:城市 Target Frame・Sequence Storyboard

SHOT 01

地下賭場入口

RAW 驅動

主角提著公事包走過霓虹招牌,第一次亮相

Raw 5.7s生成 5sLateral tracking・招牌前景遮擋
01 · RAW

在家拍的動作參考 — 控制動作、節奏、姿勢與表演

PROMPT 摘要門口橫向走位、在「地下賭場」霓虹下停頓看向門;場景鎖定、只允許人物與霓虹動

成功點

走位節奏跟 Raw 高度一致

公事包全程保持黑色

問題

第一版 12.6 秒原片壓 5 秒 — 模型直接跳過走位,從門口開始(見失敗章)

修正

裁切 Raw 到約 5 秒,並給 Start/End 圖

輸入素材:Raw Footage・Target Frame・@OSCAR-1・黑色公事包

SHOT 02

狹窄走廊前進

RAW 驅動

提著箱子朝鏡頭走來

Raw 5s生成 5sBackward tracking・前後景層次
01 · RAW

在家拍的動作參考 — 控制動作、節奏、姿勢與表演

PROMPT 摘要家中走廊的直線位移對映到賭場走廊;鏡頭後退、人物直行、兩側霓虹與蒸氣持續

成功點

位移方向與速度都跟著 Raw 走

走廊透視穩定沒有變形

問題

早期版本曾把走廊逐漸變形成賭場入口(場景 morph)

修正

Start/End 圖固定同一條走廊,場景轉換交給剪接,不交給模型

輸入素材:Raw Footage・Target Frame・@OSCAR-1・黑色公事包

SHOT 03

交貨開箱

RAW 驅動

打開公事包、抽出文件

Raw 8.6s生成 9sOver-the-shoulder・手部特寫接力
01 · RAW

在家拍的動作參考 — 控制動作、節奏、姿勢與表演

PROMPT 摘要沙發開箱動作對映到賭場桌面交易;開箱、抽紙兩個階段都要完整呈現

成功點

8.6 秒的動作用 9 秒生成 — 開箱到抽紙都完整

開箱前後是同一只箱子

問題

手部細節在快速動作處偶爾融化

修正

Raw 拍攝時放慢手部動作、保留起止停頓

輸入素材:Raw Footage・Target Frame・@OSCAR-1・黑色公事包

SHOT 04

牛排包圍

RAW 驅動

結尾 — 槍手環繞,主角繼續吃牛排

Raw 7.5s生成 8sSlow push-in・背景群眾錯峰反應
01 · RAW

在家拍的動作參考 — 控制動作、節奏、姿勢與表演

PROMPT 摘要餐桌用餐動作對映到賭場宴席;背景人物各做各的事、反應時間錯開,禁止同步動作

成功點

刀叉節奏與「不在意」的表演都保留

背景人群沒有出現同步反應

問題

個別背景人物視線偶爾飄向鏡頭

修正

在 Prompt 明確分配每群背景人物的行為與注意力方向

輸入素材:Raw Footage・Target Frame・@OSCAR-1

關於秒數的觀察(本次實測建議,非官方規定):
Raw 幾秒,生成就設幾秒 — 5.7→5.0、8.6→9.0、7.5→8.0 都順利; 12.6 秒壓成 5 秒, 模型就直接跳過走路(見第 05 章)

兩種工作流:掌控 vs 驚喜

Raw Driven vs Storyboard Driven · 04

上面五顆是一顆一顆生的, 我另外做了個實驗: 不給 Raw, 只給 12 格分鏡、開場圖、結尾圖和角色道具, 讓 Seedance 一次生 15 秒

12 格 Sequence Storyboard 分鏡表

Sequence Storyboard — 12 格,從城市遠景到牛排包圍的完整敘事

▶ Storyboard 驅動版 — 15 秒 sequence,模型自己補了運鏡和過場

Raw Footage 驅動

一顆一顆生成

高掌控・較克制・適合動作展示

Storyboard 驅動

整段一次生成

高自由・可能有驚喜・更容易漂移

動作準確度高 — 貼著 Raw 的表演走低 — 模型自行詮釋
角色一致性高(Element+單顆控制)中 — 可能漂移
運鏡自由度低 — 你說了算高 — 模型會自己補特寫、反應鏡頭與過場
場景穩定性中低 — 可能 morph 或變拼貼
生成長度跟著每顆 Raw(本片 5–9 秒)一次 15 秒 sequence
適合用途關鍵敘事鏡頭、動作戲探索剪法、B-roll、意外之喜
最大風險鏡頭語言保守把 Storyboard 當幻燈片、剪接不可控

我的結論:重要的鏡頭用 Raw 驅動,實驗性的段落交給 Storyboard 驅動 — Raw 保表演, Storyboard 偶爾給驚喜, 但也可能把分鏡表當成幻燈片

這次踩過的十個雷

Don't Repeat · 05

先看最貴的一課 —秒數不對齊,模型就自己當導演

▶ 失敗版 Shot 01 — 12.6 秒走位壓成 5 秒:模型跳過走路,人直接出現在門口

ChatGPT 對失敗原因的分析:秒數壓縮導致模型跳過走位
當時的失敗分析(原始對話)
ChatGPT 分析:畫面動態元素與運鏡需要時常緊盯
動態元素要時常緊盯
第一版酒紅色公事包道具圖 — 與電影設定不符的反面教材

反面教材 — 第一版公事包是酒紅色的 Motel 主題,電影要的是黑色:道具圖要一開始就鎖定

關鍵幀怎麼挑

Keyframe Checklist · 06

最好看的幀,不一定是最好生成的幀
快速動作的最高點常有動態模糊, 反而不如動作前後那一格穩定 — 挑的是最容易被 AI 理解的畫面,不是最戲劇化的
關鍵幀挑選 CHECKLIST(可複製收藏)
□ 姿勢最清楚
□ 手部與道具可辨識
□ 臉部沒有嚴重模糊
□ 身體輪廓完整、沒被裁切
□ 遮擋少
□ 與最終構圖最接近
□ 動作處於可讀的中間或結尾狀態
□ 有明確位移的鏡頭:Start 幀與 End 幀都要準備,不要只給終點

在家拍 Raw Footage 的規矩

Shooting Checklist · 07

拍攝時不需要真正的電影場景 — 我家的走廊、沙發和餐桌就夠了, 重要的是動作本身的品質:

RAW FOOTAGE 拍攝 CHECKLIST(可複製收藏)
□ 動作完整,起點與終點清楚
□ 身體沒有被畫面裁切
□ 鏡頭不要晃動過度
□ 動作不要太快
□ 手部不要長時間被遮擋
□ 道具尺寸與最終想像接近
□ 開始和結束各保留短暫停頓
□ 一顆鏡頭只拍一個主要動作

Prompt 是導演的工作分配單

Prompt Design · 08

Prompt 不能只寫畫面裡有什麼, 還要寫攝影機怎麼動、觀眾先看到什麼

我的 Prompt 固定拆成七個部分,按優先級排:

1. 素材角色分工(誰管動作、誰管畫面)
2. 人物主要動作(最高優先,不可犧牲)
3. 攝影機運動(slow push-in、pull-back reveal、rack focus…)
4. 場景固定條件(同一鏡內建築不得改變)
5. 背景人物行為(各做各的事,反應時間錯開)
6. 不允許發生的錯誤(morph、同步反應、換裝)
7. 生成設定(秒數、解析度、音訊開關)

背景動態的鐵則:背景人物不能同步反應
有人打牌、有人抽煙、有人晚一點才轉頭, 荷官繼續發牌、風扇繼續轉、煙霧繼續飄 — 同步抬槍、同步轉頭、同步後退,一眼就是 AI

完整逐字 Prompt(含失敗版) 整理好後會補進這一章

調光:讓素材屬於同一部電影

Color Grading · 09

AI 生的每顆鏡頭顏色都不一樣, 降 AI 感靠的不是套一顆 LUT,是讓所有鏡頭的曝光、色溫、黑位一致

我在 DaVinci 的七個步驟,每一步都有截圖:

DAVINCI 調光七步驟

生成原色 — SOURCE00 · SOURCE

Seedance 直出 — 顏色過鮮、各鏡頭黑位不一

成本

Credits · 10

成本資料整理中,將於核對方案與生成紀錄後補上

原則很簡單: 解析度和音訊都吃 credits, 先用 720p+關音訊測試, 確認滿意再出高規格版

最終成片

Final Film · 11

▶ 調光後完整版 — 29.6 秒,有聲音,點擊播放

結論

Wrap · 12

這不是按一個按鈕就有電影 — 是把分工重排: 人負責表演, AI 負責場景和美術, 導演負責取捨

生成會失敗、角色會漂、場景會變形, 後期仍然重要 — 你的工作是決定留什麼、丟什麼

現在的大場面,可能只需要你家的一面牆

留言會變成這一頁的漂浮泡泡

Oscar's Notes

整個專案最花時間的不是生成, 是想清楚「每個素材該負責什麼」— 想清楚之後,AI 才開始聽話

下一步我想挑戰對話戲和多角色 — 有想看的題材,留言告訴我