如何建立價值 200 萬美元的影片製作流程

@EXM7777
英語2026年8月16日
286K
644
49
23
1.8K

TL;DR

本指南揭示了使用 Higgsfield 和 Seedance 2.5 的專業 11 階段 AI 影片製作工作流程,重點在於角色一致性與自動化流程。

我給你 7 個免費技能,以及導演們在 higgsfield 上製作數百萬美元預算 AI 電影所使用的精確流程... 整個系統逐步揭曉,每個階段運行的技能今天即可安裝

Seedance 2.5 的 1080p 版本(僅限 higgsfield)現在意味著你可以一鏡到底生成完整的 30 秒廣告/創意內容/預告片,無需任何放大... 這太棒了

Machina - inline image

以下是內容:

  • 整個工作流程運行的單一平台及其原因
  • 每部 AI 電影都會失敗的一個問題
  • 11 個階段以及將它們結合在一起的兩個關卡
  • 每個階段的分解,可自動化的階段以運行它的技能作結
  • 哪些部分保留人工處理及其原因
  • 完整的劇本區塊

要獲取所有技能,請在此加入:https://t.me/tgmachina 我很快就會發布它們

如果你想更深入探討如何將 AI 影片轉化為實際收入,培訓和每週系統位於 real time AI ops 社群,網址為 weeklyaiops.com

引擎:Seedance 2.5 的 1080p 版本與 CLI

本文中的所有內容都通過一個平台運行:higgsfield

有兩個原因,而且都是結構性的:整個表面是為 Agent 使用而構建的,因此你的 Agent 可以端到端驅動每個生成,而 Seedance 2.5 的 1080p 版本僅在 higgsfield 上運行

整個工作流程刻意地在一個影片模型上運行

一個模型意味著一種提示語法、一套特性、一種需要學習的一致性行為... 影像模型僅構建餵養它的參考表

今天的影片模型是 Seedance 2.5

它可以一鏡到底生成一個 30 秒的片段,並在相同過程中同步對話唇形並生成音效,而且它攜帶的參考預算足夠大,可以在一次生成中容納你的演員、地點、關鍵道具、攝影機運動、聲音和環境氛圍

流程的迭代規則允許一個失敗的鏡頭嘗試 10 到 15 次,之後你才能責怪措辭

CLI 是 Agent 的大門:

  • npm install -g @higgsfield/cli
  • higgsfield auth login
  • npx skills add higgsfield-ai/skills

三個指令,每個模型都可以從 Claude Code 或你運行的任何工具中呼叫,這意味著一個 Agent 可以掌握整個流程... 生成什麼、以什麼順序、使用哪個模型,而你負責導演

如果 2.5 在下個季度被取代,下面的內容都不會改變... 將模型表視為一個快照,因為階段和關卡才是你要保留的部分

以下是你使用此流程可以製作的快速範例:

Machina - inline image

演員不記得他昨天長什麼樣子

那句話是整個流程存在的唯一原因

一個影片模型在生成之間沒有記憶,所以如果角色的外觀沒有在每個提示中詳盡描述,相鄰的鏡頭會給他不同的臉、不同的夾克、不同的年齡

在 10 秒的片段中沒有人會注意到... 但在 90 分鐘裡它會毀了這部電影,因為觀眾讀取連續性中斷的速度比任何其他缺陷都快

模型沒有記憶,所以流程就是記憶

你即將看到的一半階段的存在,只是為了代表模型記住事情... 英雄穿什麼、門離窗戶多遠、哪個色調主導場景

而記憶運行在你永遠不能打破的四條規則上:

  • 在每個資產鎖定之前,不要為電影生成任何東西
  • 一個資產獲得一個批准的護照,逐字複製到使用它的每個提示中
  • 編輯是外科手術式的:更改一行,保持其他所有內容一字不差
  • 所有內容都進行版本控制和記錄,因為未記錄的好鏡頭是你無法重現的鏡頭

打破第一條規則,一旦外觀偏移,你就要重做一半的素材

這篇文章的其餘部分就是這四條規則擴展成一個運作中的工作室

11 個階段

傳統的前期製作是選角、勘景和道具店

在這裡它反過來運作:你改為固定數位參考,而你越早關閉早期階段,之後的每次生成就越便宜

Machina - inline image
  • 分解:劇本變成場景和鏡頭卡
  • 參考:收集影像作為規格,每個資產和每個風格
  • 視覺聖經鎖定:每個專案都獲得書面決定
  • 資產表:角色、地點和道具獲得護照
  • 資料庫:護照經過壓力測試,然後鎖定到註冊表中
  • 生成:從鏡頭卡和護照製作鏡頭
  • 剪輯:組裝與生成並行運行
  • 清理:逐個鏡頭修復瑕疵
  • 調色:外包的調色師統一色調然後進行調色
  • 音效:外包的後期團隊清理和混音
  • 母版:電影節和平台交付物以及存檔

這些階段在場景層級按順序運行,只有一個例外:當場景 N 生成時,剪輯師已經在組裝場景 N-1,而導演團隊正在為 N+1 製作鏡頭表

這種重疊之所以存在,是因為這裡重拍只需幾分鐘,而不是一個拍攝日

剪輯師觀看組裝,訂購一個缺失的插入鏡頭,並在同一個下午拿到它... 這意味著剪輯不再是後期製作,而是開始積極塑造要製作的內容

但在關卡允許之前,什麼都不會開始

一個階段通過書面檢查清單退出,而最難的關卡位於生成之前:場景中的每個角色、變體、地點和道具都需要一個標記為已鎖定的註冊表行,然後才能渲染任何電影幀

流程中最昂貴的規則,也是回報最高的規則

現在是階段本身

下面的每個階段都以我為運行它而構建的技能作結,所有 7 個技能都在 Telegram 中等待

階段 1:分解

在任何人撰寫提示之前,劇本會變成鏡頭卡

每個鏡頭獲得一張包含三個軌道中 22 個欄位的卡片:

  • 身份:場景和鏡頭 ID、地點、時間、角色及其資產標籤和狀態變體、道具、描述、對話逐字稿、運行時間、複雜度
  • 方向:鏡頭的目標、作為動詞的任務、戲劇性、走位、表演、風格手法
  • 攝影機和剪輯:景別、運動、鏡頭、角度、剪輯類型、節奏、轉場

22 個欄位聽起來像官僚作風,直到你看到它帶來了什麼:之後的提示幾乎是機械式地自行撰寫,因為欄位組一對一地映射到提示區塊

Machina - inline image

有兩條規則伴隨

每個片段承載一個動作,絕不是一系列動作

任何必須出現在畫面內的文字... 標誌、手機螢幕、標題... 完全離開生成,並放到它自己的任務清單上,因為影片模型寫文字寫得很差,而標題屬於剪輯

技能:/film-breakdown 接收一個劇本、一個處理方案或一個段落的想法,並逐步引導它逐個場景,一次一個問題,在進行時撰寫場景表和每個場景的一個鏡頭卡檔案

每個鏡頭離開時都填滿了所有 22 個欄位,任何畫面內文字在你提示之前就已經被拉到它自己的任務清單上

Machina - inline image

但一張完美的卡片仍然描述了一個沒有兩個模型會以相同方式繪製的人... 那個問題有它自己的兩個階段

階段 2 和 3:參考與鎖定

這裡的參考是一個規格

「一個穿著破舊夾克的疲憊父親」在每個模型和每個人的腦海中產生一個不同的人

他的實際影像解決了這個問題,這就是為什麼規則只朝一個方向運行:先找到現有影像,然後描述它... 絕不要想像一個描述然後尋找證據

工作數量:主角 10 到 20 張影像,每個關鍵地點 8 到 15 張,每個道具 3 到 5 張,加上光線、色彩、光學、攝影機運動、紋理、剪輯節奏和音效的獨立專案

這些範圍是從實際製作中計算出來的,而不是猜測的,這就是為什麼我沒有四捨五入

每張影像都有一個說明文字,命名從中確切提取的內容

你只是喜歡但沒有說明的影像,一周後就是垃圾

而標記為「像這樣... 不允許」的影像成為禁止清單,它比參考更能為你節省生成次數

填充風格專案最快的方法是從真實電影中提取,而不是想像:將已經承載你感覺的電影劇照餵給視覺模型,讓它命名鏡頭、光線方向、色調、顆粒感,並將輸出鎖定為一個段落,貼到專案的每個提示中

然後是鎖定,而鎖定是書面的

每個專案以一個固定的決定結束... 批准、修改或拒絕... 記錄在專案本身上

一個口頭批准的風格意味著導演和提示工程師持有兩部不同的電影,他們會在一個月後發現

技能:/reference-board 一次一個專案地運行訪談... 你提供參考,它強制對每張影像進行說明,將每個反參考歸檔到禁止清單,並以書面決定(批准、修改或拒絕)關閉每個專案

沒有那個決定在專案上,什麼都不能被稱為鎖定

Machina - inline image

階段 4:護照

這就是製造一致性的地方

看看一個角色會發生什麼:他獲得一個詳盡的文字描述,以及一張在中性灰色背景上生成的參考影像表... 正面、四分之三側面、側面、背面、特寫肖像

那對組合,描述加上參考,逐字逐句、逐個檔案地進入他出現的每個提示

那是他的護照,一個製作中每個角色、地點和道具都持有一份

濕衣服是一個不同的護照

血也是... @cal@cal_wet@cal_blood 是三個帶有三個不同標籤的獨立資產,因為內聯描述的變體是模型會忘記的變體

兩個細節讓護照站得住腳:

  • 描述絕不縮短,因為「為簡潔而修剪」正是一致性消亡的地方
  • 一個地點的護照攜帶場景的色調和光線特性在裡面,所以該地點的每個鏡頭到達時都已預先調色

而參考影像本身首先在影像模型中手工構建,在任何影片提示存在之前

鎖定它們,絕不重新生成它們... 如果之後動作看起來不對,你修復動作提示,因為一個新影像會撤銷堆疊在舊影像上的每一項一致性工作

每個護照作為一行落在一個活躍的註冊表中:標籤、類型、版本、種子檔案、場景、狀態

此時的護照仍然是草稿,因為建立在一個幸運影像上的護照是虛假的勝利

技能:/asset-passport 一次構建一個資產... 它訪談你直到描述沒有漏洞,為你的影像模型撰寫灰色背景參考表提示,將每個狀態變體拆分為其自己的標記資產,並將註冊表行歸檔為草稿

Machina - inline image

階段 5:壓力測試

在任何資產被信任之前,它在戰鬥條件下生成:不同的角度和景別、其實際場景的光線,以及與它將共享畫面的每個資產並列... 因為一個單獨站得住的角色,一旦與他人共享畫面,往往會崩潰

測試是便宜的靜態影像,在單個昂貴的影片生成之前運行

角色必須達到 10 分之 10 的重複性

這是正確的

低於此的任何內容都將註冊表行保留為草稿,而它阻塞的場景要么等待,要么有意識地移動到下一個製作區塊

當場景觸及的每一行都標記為已鎖定時,場景的生成才開始,而不是更早

技能:/stress-test 讀取你的註冊表和分解,構建戰鬥矩陣... 角度、景別、真實場景光線、與每個聯合主演的雙人鏡頭... 將測試提示交給你,並且僅在完全通過時才將行翻轉為已鎖定

沒有完全通過,就沒有鎖定,場景保持關閉

Machina - inline image

隨著註冊表變綠,製作終於開始渲染... 而它的每個鏡頭都來自相同的 15 個區塊

階段 6:提示

每個鏡頭提示都是相同固定順序的 15 個區塊

任何地方都沒有負面提示... 每個禁止事項都被重寫為畫面中「有什麼」

這就是生成階段運行的基礎,因為一旦區塊被鎖定,渲染本身是機械式的

Machina - inline image

值得單獨偷走的區塊:

  • 開場白聲明「精確 N 個角色 - 無重複」,因為模型在你讓計數開放時就會添加人物
  • 位置地圖以公尺為單位給出距離,並命名攝影機永遠不會越過的線
  • 每個鏡頭一個鏡頭,視野僅在硬切時改變
  • 動作落在 0.3 到 0.8 秒的定時節拍中
  • 物理持續存在:傷害在場景中永遠不會癒合,碎片留在它掉落的地方
  • 光線永遠不是平坦和正面的,它來自地點自身的來源
  • 風格區塊以 60:30:10 的色彩線作結:主色調、次要色調以及強調色在畫面中的佔比

對於 30 秒的一鏡到底,提示分為四個定時節拍... 0-6 設定場景,6-14 構建,14-24 轉折,24-30 解決... 每個節拍都寫有完整的細節集,包括時間戳

參考獲得同樣的紀律:每個附加的影像、片段或音訊檔案都說明它控制什麼以及它不得觸碰什麼

@video 1 定義運動和節奏」是角色的一半... 另一半是「不要從中獲取身份、服裝或場景」,而第二行正是阻止一個參考洩漏到它從未被設計來塑造的鏡頭中的東西

運動有自己的語法:每個提示命名攝影機運動,並將其與片段期間發生的事件配對

然後它直接說沒有凍結的人物

一個移動鏡頭經過一個站立的人物是一個漂移的靜止影像

同一個移動鏡頭在帆撕裂時則是電影

然後是迭代規則

一次編輯更改一行,並保持其他所有內容一字不差,每次嘗試都記錄更改了什麼和結果,而一個在嘗試 15 次後仍未落地的鏡頭不需要更好的詞語... 它需要一個更簡單的鏡頭:將其分成兩個、放棄一個動作、改變角度

一個完成的鏡頭通過檢查清單被接受... 匹配參考、無瑕疵、攝影機如訂購、唇形同步保持、與相鄰鏡頭匹配... 只有被接受的鏡頭在 selects 資料夾中獲得最終名稱

那個接受是鏡頭永遠需要的最後一個「是」,因為剪輯師從不觸碰原始生成

技能:/shot-prompt 接收一個鏡頭卡加上畫面中所有內容的已鎖定護照,並且在這些資產中的任何一個仍然是草稿時,它拒絕撰寫一個準備生成的提示

然後它撰寫 15 個區塊,每個描述逐字貼上,並與你一起保存生成日誌... 每次嘗試更改一行,在 15 次時簡化鏡頭

Machina - inline image

工作室是一個檔案樹

這個流程中沒有製作辦公室

有一個目錄

  • assets 保存護照:角色、地點、道具
  • prompts 保存鏡頭卡和每個提示版本
  • generations 保存原始嘗試,除了提示工程師之外沒有人進入
  • selects 僅保存被接受的鏡頭,它是剪輯被允許看到的唯一資料夾
  • edit、color、sound 和 master 保存後期製作鏈
  • docs 保存分解、聖經、註冊表和生成日誌

還有一條法則:參考檔案永遠不會被重新命名

一個新版本是一個新檔案,因為重新命名會破壞指向舊檔案的每個提示

技能:/studio-init 問一個問題,專案名稱,然後搭建整個樹,將分解、聖經、註冊表和生成日誌作為準備好的模板植入,並將三個資料夾法則寫入專案,以便觸及它的每個 Agent 都繼承它們

Machina - inline image

而第七個技能是前門:/setup 詢問你使用什麼影像和影片模型,你如何存取每個模型,並且從不假設一個技術棧... 它將共享配置寫入你的專案,以便每個其他技能讀取相同的設定,然後按順序將鏈條交給你:setup、studio-init、film-breakdown、reference-board、asset-passport、stress-test、shot-prompt

Machina - inline image

所有 7 個都在 Telegram 中:https://t.me/tgmachina

階段 7 到 11:保留人工處理的部分

剪輯、清理、調色、音效和母版是沒有技能運行的五個階段

流程生成畫面和草稿音訊,並且它刻意停在那裡

後期製作是人工工作

剪輯修剪幾乎每個生成的第一和最後半秒,因為片段在邊緣處漂移

而且它比感覺自然的剪得更狠,因為生成的鏡頭傾向於緩慢進入... 常規指示是比你認為應該的更積極地剪輯

生成的音效是支架:唇形同步的台詞設定時機,然後音效後期團隊清理同一個聲音而不是重新錄製它,重建效果,並混音到平台響度

調色交給調色師,其首要工作是統一相鄰的鏡頭,因為每個地點的護照已經提供了一個內建的色調來完善

而母版像任何工作室一樣交付:一個 DCP(標準電影交付包)用於電影節,一個 ProRes 檔案(高品質存檔格式)用於存檔,加上平台編碼和字幕

存檔保存的不僅僅是完成的電影

它保存了生產工具... 每個最終提示、生成日誌、註冊表、已鎖定的護照... 因為續集從上一次製作學到的一切開始

劇本區塊

整個流程,壓縮成值得保存的區塊:

  1. 在為電影生成任何東西之前,以書面形式鎖定視覺聖經
  2. 一個資產,一個護照:詳盡的描述加上灰色背景參考,永遠逐字複製
  3. 在場景開放之前,在場景光線和雙人鏡頭中將每個護照壓力測試到 10/10
  4. 將每個提示寫成相同的 15 個區塊,30 秒鏡頭分為四個定時節拍
  5. 每次嘗試更改一行,記錄每次生成,在嘗試 15 次時簡化鏡頭
  6. 通過檢查清單將鏡頭接受放入 selects:剪輯看不到其他任何東西
  7. 修剪邊緣,積極剪輯,鎖定畫面,將調色和音效交給人工

跳過鎖定,你一半的素材會被製作兩次

模型會從這個系統下被替換... 方法本身預期其模型表在幾個月內老化

序列和關卡是不會變化的部分

感謝 higgsfield 贊助這篇文章

7 個技能很快就會在我的 Telegram 中發布:https://t.me/tgmachina

二次創作

使用 YouMind 創作爆款文章

收集素材、拆解爆點、生成視覺資產、撰寫內容,並在一個 AI 工作空間裡完成分發。

了解 YouMind
寫給創作者

把你的 Markdown 變成乾淨的 𝕏 文章

圖片上傳、表格、程式碼區塊,往 𝕏 上手動重排太痛苦。YouMind 把整篇 Markdown 一鍵轉成乾淨、可直接發佈的 𝕏 文章草稿。

試試 Markdown 轉 𝕏

更多可拆解樣本

近期爆款文章

探索更多爆款文章