지금부터 7가지 무료 스킬과, higgsfield 에서 수백만 달러 예산의 AI 영화를 제작하는 디렉터들이 사용하는 정확한 파이프라인을 공개합니다... 전체 시스템을 단계별로, 각 단계를 실행하는 스킬까지 오늘 바로 설치할 수 있도록 준비했습니다
Seedance 2.5 의 1080p (higgsfield 전용) 기능으로 이제 업스케일링 없이 30초짜리 광고/크리에이티브/트레일러를 한 번에 제작할 수 있습니다... 정말 대단하죠

내용은 다음과 같습니다:
- 전체 워크플로우가 실행되는 단일 플랫폼과 그 이유
- 모든 AI 영화가 실패하는 단 하나의 문제
- 11개 단계와 이를 하나로 묶는 두 개의 게이트
- 각 단계 분석, 자동화 가능한 단계와 이를 실행하는 스킬
- 인간이 담당해야 하는 부분과 그 이유
- 전체 플레이북 블록
모든 스킬에 접근하려면 여기서 가입하세요: https://t.me/tgmachina 곧 게시하겠습니다
AI 비디오를 실제 수익으로 전환하는 방법에 대해 더 깊이 알고 싶다면, 교육 및 주간 시스템은 weeklyaiops.com 의 실시간 AI 운영 커뮤니티에서 제공됩니다: weeklyaiops.com
엔진: Seedance 2.5 의 1080p 및 CLI
이 글의 모든 내용은 하나의 플랫폼에서 실행됩니다: higgsfield
두 가지 이유가 있으며, 둘 다 구조적입니다: 전체 표면이 에이전트 사용을 위해 구축되어 에이전트가 처음부터 끝까지 모든 생성을 주도할 수 있고, Seedance 2.5 의 1080p가 higgsfield 에서만 실행됩니다
전체 워크플로우는 의도적으로 하나의 비디오 모델에서 실행됩니다
하나의 모델은 하나의 프롬프트 문법, 하나의 특성 세트, 하나의 일관성 동작을 학습한다는 것을 의미합니다... 이미지 모델은 이를 공급하는 레퍼런스 시트만 구축합니다
오늘날 그 비디오 모델은 Seedance 2.5 입니다
30초 클립을 한 번에 생성하며, 대화 립싱크와 사운드 효과를 동시에 생성하고, 캐스트, 로케이션, 주요 소품, 카메라 움직임, 음성, 분위기를 하나의 생성 내에 담을 수 있을 만큼 큰 레퍼런스 예산을 제공합니다
파이프라인의 반복 규칙은 실패한 샷에 대해 단어 문제를 탓하기 전에 10~15번의 시도를 허용합니다
CLI는 에이전트 진입점입니다:
- npm install -g @higgsfield/cli
- higgsfield auth login
- npx skills add higgsfield-ai/skills
세 가지 명령어로 모든 모델을 Claude Code 또는 사용하는 모든 하네스에서 호출할 수 있게 되어, 에이전트가 전체 파이프라인을 관리할 수 있습니다... 무엇을, 어떤 순서로, 어떤 모델로 생성할지, 당신이 지시하는 동안
그리고 2.5가 다음 분기에 교체되더라도 아래 내용은 변경되지 않습니다... 모델 테이블을 스냅샷으로 취급하세요. 단계와 게이트는 유지해야 할 부분이기 때문입니다
다음은 이 파이프라인으로 제작할 수 있는 간단한 예시입니다:

배우는 어제 자신의 모습을 기억하지 못한다
이 문장이 바로 이 파이프라인이 존재하는 이유입니다
비디오 모델은 생성 간에 메모리가 없으므로, 캐릭터의 외모가 모든 단일 프롬프트에 철저히 설명되지 않으면 인접한 샷에서 다른 얼굴, 다른 재킷, 다른 나이를 갖게 됩니다
10초 클립에서는 아무도 눈치채지 못합니다... 90분 동안은 영화를 망칩니다. 관객은 다른 어떤 결함보다 연속성 파괴를 더 빨리 읽어내기 때문입니다
모델에는 메모리가 없으므로, 파이프라인이 메모리 역할을 합니다
지금부터 보게 될 단계의 절반은 모델을 대신해 사물을 기억하기 위해서만 존재합니다... 주인공이 무엇을 입는지, 문이 창문에서 얼마나 떨어져 있는지, 어떤 팔레트가 장면을 지배하는지
그리고 메모리는 절대 깨지지 않는 네 가지 규칙에 따라 실행됩니다:
- 모든 에셋이 잠길 때까지 영화를 위해 아무것도 생성하지 마십시오
- 하나의 에셋은 하나의 승인된 패스포트를 가지며, 이를 사용하는 모든 프롬프트에 그대로 복사됩니다
- 편집은 외과적입니다: 한 줄을 변경하고 다른 모든 것은 그대로 유지하십시오
- 모든 것은 버전 관리되고 기록됩니다. 기록되지 않은 좋은 샷은 재현할 수 없는 샷이기 때문입니다
첫 번째 규칙을 어기면 룩이 변경된 후에 재료의 절반을 다시 만들어야 합니다
이 글의 나머지 부분은 이 네 가지 규칙을 실제 스튜디오로 확장한 것입니다
11단계
클래식한 프리프로덕션은 캐스팅, 로케이션 스카우팅, 소품 작업실입니다
여기서는 반대로 진행됩니다: 대신 디지털 레퍼런스를 고정하고, 초기 단계를 더 빡빡하게 마무리할수록 이후의 모든 생성 비용이 저렴해집니다

- 브레이크다운: 대본이 장면 및 샷 카드가 됩니다
- 레퍼런스: 에셋 및 스타일별로 사양으로 수집된 이미지
- 비주얼 바이블 잠금: 모든 보드에 서면 결정이 내려집니다
- 에셋 시트: 캐릭터, 로케이션, 소품이 패스포트를 얻습니다
- 라이브러리: 패스포트가 스트레스 테스트를 거친 후 레지스트리에 잠깁니다
- 생성: 카드와 패스포트로 샷이 제작됩니다
- 편집: 생성과 병렬로 어셈블리가 실행됩니다
- 클린업: 아티팩트가 샷별로 수정됩니다
- 컬러: 아웃소싱된 컬러리스트가 통일한 후 그레이딩합니다
- 사운드: 아웃소싱된 포스트 팀이 정리하고 믹싱합니다
- 마스터: 페스티벌 및 플랫폼 딜리버러블과 아카이브
단계는 장면 수준에서 순차적으로 실행되며, 한 가지 예외가 있습니다: 장면 N이 생성되는 동안 편집자는 이미 장면 N-1을 어셈블하고 있고, 디렉터 팀은 N+1의 샷리스트를 작성하고 있습니다
이러한 중첩은 리슛 비용이 촬영일이 아닌 몇 분이기 때문에 가능합니다
편집자는 어셈블리를 보고 누락된 컷어웨이를 주문하면 같은 오후에 받을 수 있습니다... 즉, 편집이 포스트 프로덕션이 아니라 무엇이 만들어질지 적극적으로 형성하기 시작합니다
하지만 게이트가 허락할 때까지 아무것도 시작되지 않습니다
단계는 서면 체크리스트를 통해 종료되며, 가장 어려운 게이트는 생성 앞에 있습니다: 장면의 모든 캐릭터, 변형, 로케이션, 소품은 단일 영화 프레임이 렌더링되기 전에 레지스트리 행이 '잠김'으로 표시되어야 합니다
파이프라인에서 가장 비싼 규칙이자 가장 보람 있는 규칙입니다
이제 단계 자체를 살펴보겠습니다
아래 각 단계는 이를 실행하기 위해 제가 구축한 스킬로 마무리되며, 7개 모두 텔레그램에서 기다리고 있습니다
1단계: 브레이크다운
누구도 프롬프트를 작성하기 전에, 대본이 샷 카드가 됩니다
각 샷은 세 가지 영역에 걸쳐 22개 필드의 카드를 얻습니다:
- 아이덴티티: 장면 및 샷 ID, 로케이션, 시간대, 에셋 태그 및 상태 변형이 있는 캐릭터, 소품, 설명, 대화 그대로, 러닝 타임, 복잡성
- 디렉션: 샷의 목표, 동사로서의 작업, 드라마투르기, 블로킹, 연기, 스타일 장치
- 카메라 및 편집: 사이즈, 움직임, 렌즈, 앵글, 컷 유형, 페이스, 트랜지션
22개 필드는 관료적으로 들리지만, 그 대가를 보면 그렇지 않습니다: 프롬프트는 나중에 거의 기계적으로 작성됩니다. 열 그룹이 프롬프트 블록에 일대일로 매핑되기 때문입니다

두 가지 규칙이 함께 적용됩니다
모든 클립은 하나의 액션을 전달하며, 절대 연속된 액션이 아닙니다
그리고 프레임 내에 나타나야 하는 모든 텍스트... 간판, 휴대폰 화면, 제목...은 생성을 완전히 떠나 자체 작업 목록으로 이동합니다. 비디오 모델은 텍스트를 잘못 작성하고 제목은 편집에 속하기 때문입니다
스킬: /film-breakdown 은 대본, 트리트먼트 또는 한 문단짜리 아이디어를 받아 장면별로, 한 번에 하나의 질문씩 안내하며, 진행하면서 장면 테이블과 장면당 하나의 샷 카드 파일을 작성합니다
모든 샷은 22개 필드가 모두 채워진 상태로 나오며, 프레임 내 텍스트는 프롬프트를 입력하기 전에 이미 자체 작업 목록으로 분리됩니다

하지만 완벽한 카드라도 두 모델이 동일하게 그리지 않을 사람을 설명합니다... 그 문제에는 자체 두 단계가 있습니다
2단계 및 3단계: 레퍼런스 및 잠금
여기서 레퍼런스는 사양입니다
"낡은 재킷을 입은 지친 아버지"는 모델과 사람마다 다른 사람을 생성합니다
그의 실제 이미지는 문제를 해결합니다. 이것이 규칙이 한 방향으로만 실행되는 이유입니다: 먼저 기존 이미지를 찾은 다음 설명하십시오... 설명을 상상하고 증거를 찾지 마십시오
작업 카운트: 주연 캐릭터당 10~20개 이미지, 주요 로케이션당 8~15개, 소품당 3~5개, 조명, 색상, 광학, 카메라 움직임, 텍스처, 컷팅 템포, 사운드에 대한 별도 보드
이 범위는 추측이 아닌 실제 제작에서 계산된 것이므로 반올림하지 않습니다
모든 이미지는 정확히 무엇을 가져왔는지 명명하는 캡션을 얻습니다
캡션이 없는, 단순히 마음에 드는 이미지는 일주일 후에는 쓰레기입니다
그리고 "이런 느낌... 허용 안 됨"으로 표시된 이미지는 금지 목록이 되어 레퍼런스보다 더 많은 생성을 절약합니다
스타일 보드를 채우는 가장 빠른 방법은 상상하는 대신 실제 영화에서 추출하는 것입니다: 이미지가 담고 있는 느낌을 가진 영화의 스틸을 비전 모델에 공급하고, 렌즈, 조명 방향, 팔레트, 그레인을 명명하게 한 다음 출력을 프로젝트의 모든 프롬프트에 붙여넣을 하나의 단락으로 잠급니다
그런 다음 잠금이 오고, 잠금은 서면으로 이루어집니다
모든 보드는 고정된 결정... 승인, 수정, 또는 거부...으로 끝나며, 보드 자체에 기록됩니다
구두로 승인된 스타일은 디렉터와 프롬프트 엔지니어가 서로 다른 두 영화를 보고 있다는 것을 의미하며, 한 달 후에 알게 됩니다
스킬: /reference-board 는 한 번에 하나의 보드씩 인터뷰를 실행합니다... 레퍼런스를 제공하면 모든 이미지에 캡션을 강제하고, 모든 안티 레퍼런스를 금지 목록에 파일링하고, 각 보드를 승인, 수정, 거부의 서면 결정으로 마무리합니다
보드에 그 결정 없이는 잠김으로 간주되지 않습니다

4단계: 패스포트
여기서 일관성이 만들어집니다
한 캐릭터에 어떤 일이 일어나는지 지켜보십시오: 그는 철저한 텍스트 설명자와 중립 회색 배경에서 생성된 레퍼런스 이미지 시트(정면, 3/4, 프로필, 후면, 클로즈 포트레이트)를 얻습니다
그 쌍(설명자 + 레퍼런스)은 그가 등장하는 모든 프롬프트에 단어 그대로, 파일 그대로 전달됩니다
그것이 그의 패스포트이며, 프로덕션은 캐릭터, 로케이션, 소품당 하나씩 보유합니다
젖은 옷은 다른 패스포트입니다
피도 마찬가지입니다... @cal, @cal_wet, @cal_blood 는 세 개의 별도 에셋이며 세 개의 별도 태그를 가집니다. 인라인으로 설명된 변형은 모델이 잊어버릴 변형이기 때문입니다
패스포트를 유지하는 두 가지 세부 사항:
- 설명자는 절대 축약되지 않습니다. "간결함을 위해 축약"은 정확히 일관성이 죽는 지점이기 때문입니다
- 로케이션의 패스포트는 장면의 팔레트와 조명 특성을 내부에 전달하므로, 해당 로케이션의 모든 샷은 사전 그레이딩된 상태로 도착합니다
그리고 레퍼런스 이미지 자체는 비디오 프롬프트가 존재하기 전에 이미지 모델에서 먼저 수동으로 구축됩니다
잠그고 절대 재생성하지 마십시오... 나중에 모션이 잘못 보이면 모션 프롬프트를 수정하십시오. 새 이미지는 이전 이미지에 쌓인 모든 일관성 작업을 취소하기 때문입니다
모든 패스포트는 하나의 살아있는 레지스트리에 행으로 기록됩니다: 태그, 유형, 버전, 시드 파일, 장면, 상태
이 시점의 패스포트는 여전히 초안입니다. 하나의 운 좋은 이미지로 구축된 패스포트는 거짓 승리이기 때문입니다
스킬: /asset-passport 는 한 번에 하나의 에셋을 구축합니다... 설명자에 공백이 없을 때까지 인터뷰하고, 이미지 모델에 대한 회색 배경 레퍼런스 시트 프롬프트를 작성하고, 모든 상태 변형을 자체 태그가 있는 에셋으로 분할하고, 레지스트리 행을 초안으로 파일링합니다

5단계: 스트레스 테스트
에셋이 신뢰되기 전에, 전투 조건에서 생성됩니다: 다른 각도와 샷 크기, 실제 장면의 조명, 그리고 프레임을 공유할 모든 에셋 옆에 서 있습니다... 혼자서는 잘 버티던 캐릭터가 프레임을 공유하는 순간 무너지는 경우가 많기 때문입니다
테스트는 값비싼 비디오 생성 전에 실행되는 저렴한 정적 이미지입니다
캐릭터는 10/10 반복성을 달성해야 합니다
정확합니다
그 이하는 레지스트리 행을 초안으로 유지하며, 차단된 장면은 기다리거나 의식적으로 다음 프로덕션 블록으로 이동합니다
장면의 생성은 그것이 접촉하는 모든 행이 '잠김'이라고 말할 때 시작되며, 그보다 한 시간 일찍 시작되지 않습니다
스킬: /stress-test 는 레지스트리와 브레이크다운을 읽고, 전투 매트릭스(각도, 샷 크기, 실제 장면 조명, 모든 공연자 옆의 투샷)를 구축하고, 테스트 프롬프트를 제공하고, 전체 패스에서만 행을 '잠김'으로 전환합니다
전체 패스가 없으면 잠금이 없으며, 장면은 닫힌 상태로 유지됩니다

레지스트리가 녹색이 되면, 프로덕션이 마침내 렌더링을 시작합니다... 그리고 모든 샷은 동일한 15개 블록에서 비롯됩니다
6단계: 프롬프트
모든 샷 프롬프트는 동일한 15개 블록을 동일한 고정 순서로 사용합니다
어디에도 네거티브 프롬프트는 없습니다... 모든 금지는 프레임에 있는 것으로 다시 작성됩니다
이것이 생성 단계가 실행되는 기반입니다. 블록이 잠기면 렌더링 자체는 기계적이기 때문입니다

그 자체로 가져올 가치가 있는 블록:
- 오프너는 "정확히 N명의 캐릭터 - 중복 없음"을 명시합니다. 모델은 카운트를 열어두면 사람을 추가하기 때문입니다
- 로케이션 맵은 거리를 미터 단위로 제공하고 카메라가 절대 넘지 않는 선을 명명합니다
- 샷당 하나의 렌즈, 시야는 하드 컷에서만 변경됩니다
- 액션은 0.3~0.8초의 시간 비트로 배치됩니다
- 물리학은 지속됩니다: 손상은 장면 중간에 치유되지 않으며, 잔해는 떨어진 곳에 남아 있습니다
- 조명은 평평하고 정면이 아니며, 로케이션 자체 소스에서 형성됩니다
- 스타일 블록은 60:30:10 컬러 라인(지배적인 색조, 보조 색조, 악센트가 프레임에서 차지하는 비율)으로 마무리됩니다
30초 원샷의 경우 프롬프트는 네 개의 시간 비트로 분할됩니다... 0-6초는 장면 설정, 6-14초는 구축, 14-24초는 전환, 24-30초는 해결... 비트당 전체 세부 정보 세트가 타임스탬프와 함께 작성됩니다
레퍼런스는 동일한 규율을 얻습니다: 첨부된 모든 이미지, 클립 또는 오디오 파일은 제어하는 것과 건드리지 말아야 할 것을 명시합니다
"@video 1은 모션과 페이싱을 정의합니다"는 역할의 절반입니다... 나머지 절반은 "아이덴티티, 의복 또는 장면을 가져오지 마십시오"이며, 이 두 번째 줄이 하나의 레퍼런스가 결코 형성하도록 의도되지 않은 샷으로 새는 것을 막습니다
모션은 자체 문법을 얻습니다: 모든 프롬프트는 카메라 움직임을 명명하고 클립 중에 발생하는 이벤트와 짝을 이룹니다
그런 다음 얼어붙은 인물은 절대 안 된다고 명시합니다
서 있는 인물을 지나는 돌리는 것은 표류하는 정지 이미지입니다
돛이 찢어지는 동안 같은 돌리는 것은 영화입니다
그런 다음 반복 규칙
편집은 한 줄을 변경하고 다른 모든 것은 그대로 유지하며, 모든 시도는 변경된 내용과 판정과 함께 기록되며, 15번째 시도까지 착륙하지 않은 샷은 더 나은 단어가 필요하지 않습니다... 더 간단한 샷이 필요합니다: 둘로 나누고, 액션을 떨어뜨리고, 각도를 변경하십시오
완성된 테이크는 체크리스트로 승인됩니다... 레퍼런스와 일치하고, 아티팩트가 없고, 카메라가 주문대로이고, 립싱크가 유지되고, 이웃과 컷이 맞습니다... 그리고 승인된 테이크만 셀렉트 폴더에 최종 이름을 얻습니다
그 승인은 샷이 필요한 마지막 '예'입니다. 편집자는 원시 생성물을 건드리지 않기 때문입니다
스킬: /shot-prompt 는 하나의 샷 카드와 프레임 내 모든 것의 잠긴 패스포트를 가져오며, 해당 에셋 중 하나라도 초안인 동안 생성 준비 프롬프트 작성을 거부합니다
그런 다음 모든 설명자를 그대로 붙여넣은 15개 블록을 작성하고 생성 로그를 사용자와 함께 유지합니다... 시도당 한 줄 변경, 15번째에 샷 단순화

스튜디오는 파일 트리입니다
이 파이프라인에는 프로덕션 오피스가 없습니다
디렉토리가 있습니다
- assets: 패스포트(캐릭터, 로케이션, 소품) 보관
- prompts: 샷 카드 및 모든 프롬프트 버전 보관
- generations: 원시 시도 보관, 프롬프트 엔지니어만 접근 가능
- selects: 승인된 테이크만 보관, 편집이 볼 수 있는 유일한 폴더
- edit, color, sound, master: 마무리 체인 보관
- docs: 브레이크다운, 바이블, 레지스트리, 생성 로그 보관
또 하나의 법칙: 레퍼런스 파일의 이름은 절대 변경되지 않습니다
새 버전은 새 파일입니다. 이름 변경은 이전 파일을 가리키는 모든 프롬프트를 깨뜨리기 때문입니다
스킬: /studio-init 은 프로젝트 이름이라는 한 가지 질문을 한 다음 전체 트리를 스캐폴딩하고, 브레이크다운, 바이블, 레지스트리, 생성 로그를 준비된 템플릿으로 시드하고, 세 가지 폴더 법칙을 프로젝트에 작성하여 이를 접촉하는 모든 에이전트가 상속하도록 합니다

그리고 일곱 번째 스킬은 정문입니다: /setup 은 사용하는 이미지 및 비디오 모델, 각각에 액세스하는 방법을 묻고 스택을 가정하지 않습니다... 공유 구성을 프로젝트에 작성하여 다른 모든 스킬이 동일한 설정을 읽도록 한 다음 순서대로 체인을 제공합니다: setup, studio-init, film-breakdown, reference-board, asset-passport, stress-test, shot-prompt

7개 모두 텔레그램에 있습니다: https://t.me/tgmachina
7~11단계: 인간이 담당하는 부분
편집, 클린업, 컬러, 사운드, 마스터는 스킬이 실행하지 않는 다섯 단계입니다
파이프라인은 영상과 스크래치 오디오를 생성하며, 의도적으로 거기서 멈춥니다
마무리는 인간의 작업입니다
편집은 거의 모든 생성물의 처음과 마지막 0.5초를 다듬습니다. 클립이 가장자리에서 표류하기 때문입니다
그리고 자연스럽게 느껴지는 것보다 더 세게 컷합니다. 생성된 샷은 느린 진입에 치우치기 때문입니다... 표준 지침은 생각보다 더 공격적으로 컷하라는 것입니다
생성된 사운드는 스캐폴딩입니다: 립싱크된 라인이 타이밍을 설정한 다음, 사운드 포스트 팀이 동일한 음성을 재녹음하는 대신 정리하고, 효과를 재구축하고, 플랫폼 음량으로 믹싱합니다
컬러는 컬러리스트에게 전달되며, 그의 첫 번째 작업은 인접한 샷을 통일하는 것입니다. 모든 로케이션의 패스포트가 이미 정제할 내장 그레이드를 제공했기 때문입니다
그리고 마스터는 다른 스튜디오와 마찬가지로 배송됩니다: 페스티벌용 DCP(표준 시네마 배송 패키지), 보관용 ProRes 파일(고품질 아카이브 형식), 플랫폼 인코딩 및 자막
아카이브는 완성된 영화 이상을 보관합니다
생산 수단을 보관합니다... 모든 최종 프롬프트, 생성 로그, 레지스트리, 잠긴 패스포트... 속편은 마지막 프로덕션이 배운 모든 것에서 시작되기 때문입니다
플레이북 블록
전체 파이프라인을 저장할 가치가 있는 블록으로 압축:
- 영화를 위해 아무것도 생성하기 전에 비주얼 바이블을 서면으로 잠급니다
- 하나의 에셋, 하나의 패스포트: 철저한 설명자와 회색 배경 레퍼런스, 영원히 그대로 복사
- 장면이 열리기 전에 모든 패스포트를 장면 조명 및 투샷에서 10/10으로 스트레스 테스트합니다
- 모든 프롬프트를 동일한 15개 블록, 30초 샷의 경우 4개의 시간 비트로 작성합니다
- 시도당 한 줄 변경, 모든 생성 기록, 15번째 시도에서 샷 단순화
- 체크리스트로 테이크를 셀렉트에 승인: 편집은 다른 것을 보지 않습니다
- 가장자리 다듬기, 공격적으로 컷, 픽처 잠금, 컬러와 사운드를 인간에게 전달
잠금을 건너뛰면 재료의 절반이 두 번 만들어집니다
모델은 이 시스템 아래에서 교체될 것입니다... 방법 자체는 모델 테이블이 몇 달 안에 노후화될 것으로 예상합니다
변하지 않는 부분은 순서와 게이트입니다
이 기사를 후원해 주신 higgsfield 에 감사드립니다
7개의 스킬은 곧 제 텔레그램에 게시됩니다: https://t.me/tgmachina





