$2M का वीडियो प्रोडक्शन पाइपलाइन कैसे बनाएं

@EXM7777
अंग्रेज़ी16 अग॰ 2026
286K
644
49
23
1.8K

TL;DR

यह गाइड Higgsfield और Seedance 2.5 का उपयोग करके एक पेशेवर 11-चरणीय AI वीडियो प्रोडक्शन वर्कफ़्लो का खुलासा करती है, जो कैरेक्टर कंसिस्टेंसी और स्वचालित पाइपलाइनों पर केंद्रित है।

मैं आपको 7 मुफ्त कौशल और वह सटीक पाइपलाइन दे रहा हूं जिसका उपयोग निर्देशक हिग्सफील्ड में लाखों डॉलर के बजट वाली AI फिल्में बनाने के लिए कर रहे हैं... पूरी प्रणाली चरण-दर-चरण उजागर की गई है, जिसमें प्रत्येक चरण को चलाने वाला कौशल आज ही इंस्टॉल करने के लिए तैयार है

Seedance 2.5 1080p पर (केवल हिग्सफील्ड पर) अब इसका मतलब है कि आप बिना किसी अपस्केलिंग के 30 सेकंड के पूरे विज्ञापन/क्रिएटिव/ट्रेलर एक ही बार में शूट कर सकते हैं... यह शानदार है

Machina - inline image

यहाँ बताया गया है कि अंदर क्या है:

  • वह एकमात्र प्लेटफ़ॉर्म जिस पर पूरा वर्कफ़्लो चलता है और क्यों
  • वह एक समस्या जिस पर हर AI फिल्म अटक जाती है
  • 11 चरण और दो गेट जो उन्हें एक साथ बांधे रखते हैं
  • प्रत्येक चरण को तोड़ा गया, स्वचालित किए जा सकने वाले चरण उस कौशल के साथ समाप्त होते हैं जो इसे चलाता है
  • क्या मानवीय रहता है और क्यों
  • पूरा प्लेबुक ब्लॉक

सभी कौशलों तक पहुँच पाने के लिए, यहाँ जुड़ें: https://t.me/tgmachina मैं उन्हें जल्द ही पोस्ट करूंगा

और यदि आप AI वीडियो को वास्तविक राजस्व में बदलने के बारे में गहराई से जानना चाहते हैं, तो प्रशिक्षण और साप्ताहिक सिस्टम weeklyaiops.com पर रियल टाइम AI ऑप्स समुदाय में उपलब्ध हैं

इंजन: 1080p पर Seedance 2.5 और CLI

इस लेख में सब कुछ एक ही प्लेटफ़ॉर्म पर चलता है: हिग्सफील्ड

दो कारण, और दोनों संरचनात्मक हैं: पूरी सतह एजेंटिक उपयोग के लिए बनाई गई है, ताकि आपका एजेंट हर जनरेशन को शुरू से अंत तक चला सके, और 1080p पर Seedance 2.5 केवल हिग्सफील्ड पर चलता है

पूरा वर्कफ़्लो जानबूझकर एक ही वीडियो मॉडल पर चलता है

एक मॉडल का मतलब है एक प्रॉम्प्ट व्याकरण, विचित्रताओं का एक सेट, सीखने के लिए एक स्थिरता व्यवहार... इमेज मॉडल केवल संदर्भ शीट बनाते हैं जो इसे फीड करती हैं

आज वह वीडियो मॉडल Seedance 2.5 है

यह एक ही पास में लिप-सिंक किए गए डायलॉग और जेनरेट किए गए साउंड इफेक्ट्स के साथ 30 सेकंड का क्लिप शूट करता है, और इसमें एक रेफरेंस बजट होता है जो आपके कलाकारों, आपके स्थान, एक मुख्य प्रॉप, एक कैमरा मूव, एक आवाज़ और एक जनरेशन के अंदर के माहौल को रखने के लिए पर्याप्त होता है

पाइपलाइन का पुनरावृत्ति नियम एक असफल शॉट को 10 से 15 प्रयास देता है, इससे पहले कि आपको शब्दों को दोष देने की अनुमति दी जाए

CLI एजेंटिक दरवाजा है:

  • npm install -g @higgsfield/cli
  • higgsfield auth login
  • npx skills add higgsfield-ai/skills

तीन कमांड और हर मॉडल Claude Code या आपके द्वारा चलाए जाने वाले किसी भी हार्नेस से कॉल करने योग्य हो जाता है, जिसका अर्थ है कि एक एजेंट पूरी पाइपलाइन को संभाल सकता है... क्या उत्पन्न करता है, किस क्रम में, किस मॉडल के साथ, जबकि आप निर्देशित करते हैं

और यदि अगली तिमाही में 2.5 को बदल दिया जाता है, तो नीचे कुछ भी नहीं बदलता... मॉडल तालिका को एक स्नैपशॉट के रूप में मानें, क्योंकि चरण और गेट वह हिस्सा हैं जिसे आप रखते हैं

यहाँ एक त्वरित उदाहरण है कि आप इस पाइपलाइन के साथ क्या उत्पादन कर सकते हैं:

Machina - inline image

अभिनेता को याद नहीं रहता कि वह कल कैसा दिखता था

वह वाक्य इस पूरी पाइपलाइन के अस्तित्व का एकमात्र कारण है

एक वीडियो मॉडल के पास जनरेशन के बीच कोई मेमोरी नहीं होती है, इसलिए यदि किसी चरित्र की उपस्थिति का हर एक प्रॉम्प्ट में पूरी तरह से वर्णन नहीं किया गया है, तो आसन्न शॉट उसे एक अलग चेहरा, एक अलग जैकेट, एक अलग उम्र देते हैं

10 सेकंड के क्लिप पर कोई नोटिस नहीं करता... 90 मिनट में यह फिल्म को मार देता है, क्योंकि दर्शक किसी भी अन्य दोष की तुलना में निरंतरता में विराम को तेजी से पढ़ते हैं

मॉडल के पास कोई मेमोरी नहीं है, इसलिए पाइपलाइन ही मेमोरी है

आप जिन आधे चरणों को देखने वाले हैं, वे केवल मॉडल की ओर से चीजों को याद रखने के लिए मौजूद हैं... नायक क्या पहनता है, दरवाजा खिड़की से कितनी दूर है, कौन सा पैलेट दृश्य का मालिक है

और मेमोरी चार नियमों पर चलती है जिन्हें आप कभी नहीं तोड़ते:

  • फिल्म के लिए तब तक कुछ भी उत्पन्न न करें जब तक कि हर संपत्ति लॉक न हो जाए
  • एक संपत्ति को एक स्वीकृत पासपोर्ट मिलता है, जिसे हर प्रॉम्प्ट में शब्दशः कॉपी किया जाता है जो इसका उपयोग करता है
  • संपादन सर्जिकल होते हैं: एक पंक्ति बदलें, बाकी सब कुछ शब्द दर शब्द रखें
  • सब कुछ संस्करणबद्ध और लॉग किया जाता है, क्योंकि एक अनलॉग्ड अच्छा शॉट एक ऐसा शॉट है जिसे आप दोबारा नहीं बना सकते

पहला नियम तोड़ें और एक बार लुक बहने के बाद आप अपनी आधी सामग्री को फिर से बनाते हैं

इस लेख का शेष भाग वे चार नियम हैं जो एक कार्यशील स्टूडियो में फैले हुए हैं

11 चरण

क्लासिक प्री-प्रोडक्शन कास्टिंग, लोकेशन स्काउटिंग और एक प्रॉप शॉप है

यहाँ यह उल्टा चलता है: आप इसके बजाय डिजिटल संदर्भ तय करते हैं, और आप शुरुआती चरणों को जितना कसकर बंद करेंगे, उनके बाद प्रत्येक जनरेशन उतनी ही सस्ती होगी

Machina - inline image
  • ब्रेकडाउन: स्क्रिप्ट दृश्यों और शॉट कार्ड में बदल जाती है
  • संदर्भ: प्रति संपत्ति और प्रति शैली, विनिर्देश के रूप में एकत्रित चित्र
  • विज़ुअल बाइबल लॉक: प्रत्येक बोर्ड को एक लिखित निर्णय मिलता है
  • एसेट शीट: पात्रों, स्थानों और प्रॉप्स को पासपोर्ट मिलते हैं
  • लाइब्रेरी: पासपोर्ट का तनाव-परीक्षण किया जाता है, फिर एक रजिस्ट्री में लॉक किया जाता है
  • जनरेशन: कार्ड और पासपोर्ट से शॉट तैयार किए जाते हैं
  • एडिट: जनरेशन के समानांतर असेंबली चलती है
  • क्लीनअप: शॉट दर शॉट आर्टिफैक्ट ठीक किए जाते हैं
  • कलर: एक आउटसोर्स कलरिस्ट एकीकृत करता है फिर ग्रेड करता है
  • साउंड: एक आउटसोर्स पोस्ट टीम साफ और मिक्स करती है
  • मास्टर: फेस्टिवल और प्लेटफ़ॉर्म डिलीवरेबल्स प्लस आर्काइव

चरण दृश्य स्तर पर अनुक्रम में चलते हैं, एक अपवाद के साथ: जबकि दृश्य N उत्पन्न होता है, संपादक पहले से ही दृश्य N-1 को असेंबल कर रहा है और निर्देशक टीम N+1 की शॉटलिस्टिंग कर रही है

वह ओवरलैप मौजूद है क्योंकि यहाँ एक रीशूट में मिनट लगते हैं, एक शूटिंग दिन नहीं

संपादक एक असेंबली देखता है, एक लापता कटअवे का ऑर्डर देता है, और उसे उसी दोपहर प्राप्त करता है... जिसका अर्थ है कि संपादन पोस्ट-प्रोडक्शन नहीं रह जाता है और सक्रिय रूप से आकार देना शुरू कर देता है कि क्या बनाया जाता है

लेकिन यह सब तब तक शुरू नहीं होता जब तक गेट ऐसा न कहें

एक चरण एक लिखित चेकलिस्ट के माध्यम से बाहर निकलता है, और सबसे कठिन गेट जनरेशन के सामने बैठता है: एक दृश्य में प्रत्येक चरित्र, संस्करण, स्थान और प्रॉप को एक रजिस्ट्री पंक्ति की आवश्यकता होती है जिसे एक फिल्म फ्रेम रेंडर करने से पहले लॉक के रूप में चिह्नित किया जाता है

पाइपलाइन में सबसे महंगा नियम, और सबसे फायदेमंद

अब चरण स्वयं

नीचे दिए गए प्रत्येक चरण उस कौशल के साथ समाप्त होता है जिसे मैंने इसे चलाने के लिए बनाया है, और सभी 7 टेलीग्राम में प्रतीक्षा कर रहे हैं

चरण 1: ब्रेकडाउन

इससे पहले कि कोई प्रॉम्प्ट लिखे, स्क्रिप्ट शॉट कार्ड में बदल जाती है

प्रत्येक शॉट को तीन लेन में 22 फ़ील्ड का एक कार्ड मिलता है:

  • पहचान: दृश्य और शॉट आईडी, स्थान, दिन का समय, उनके एसेट टैग और स्टेट वेरिएंट वाले पात्र, प्रॉप्स, विवरण, डायलॉग शब्दशः, चलने का समय, जटिलता
  • दिशा: शॉट का लक्ष्य, एक क्रिया के रूप में कार्य, नाटकशास्त्र, ब्लॉकिंग, अभिनय, शैली उपकरण
  • कैमरा और एडिट: आकार, गति, लेंस, कोण, कट प्रकार, गति, संक्रमण

22 फ़ील्ड नौकरशाही की तरह लगते हैं जब तक आप यह नहीं देखते कि यह क्या खरीदता है: प्रॉम्प्ट बाद में लगभग यांत्रिक रूप से खुद को लिखता है, क्योंकि कॉलम समूह प्रॉम्प्ट ब्लॉक पर एक-से-एक मैप करते हैं

Machina - inline image

दो नियम साथ चलते हैं

प्रत्येक क्लिप एक क्रिया करता है, कभी उनका एक क्रम नहीं

और कोई भी टेक्स्ट जो फ्रेम के अंदर दिखाई देना चाहिए... एक संकेत, एक फ़ोन स्क्रीन, एक शीर्षक... जनरेशन को पूरी तरह से छोड़ देता है और अपनी स्वयं की कार्य सूची में चला जाता है, क्योंकि वीडियो मॉडल टेक्स्ट को बुरी तरह से लिखते हैं और शीर्षक एडिट से संबंधित होते हैं

कौशल: /film-breakdown एक स्क्रिप्ट, एक ट्रीटमेंट, या एक-पैराग्राफ विचार लेता है और इसे दृश्य दर दृश्य, एक बार में एक प्रश्न, दृश्य तालिका और प्रति दृश्य एक शॉट-कार्ड फ़ाइल लिखता है जैसे-जैसे यह आगे बढ़ता है

प्रत्येक शॉट सभी 22 फ़ील्ड भरे हुए छोड़ता है, और कोई भी इन-फ्रेम टेक्स्ट पहले से ही अपनी स्वयं की कार्य सूची में खींच लिया जाता है, इससे पहले कि आप कभी प्रॉम्प्ट करें

Machina - inline image

लेकिन एक आदर्श कार्ड अभी भी एक ऐसे व्यक्ति का वर्णन करता है जिसे कोई भी दो मॉडल एक ही तरह से नहीं खींचेंगे... उस समस्या के अपने दो चरण हैं

चरण 2 और 3: संदर्भ और लॉक

यहाँ एक संदर्भ एक विनिर्देश है

"एक थका हुआ पिता घिसी हुई जैकेट में" हर मॉडल और हर दिमाग में एक अलग आदमी पैदा करता है

उसकी एक वास्तविक छवि प्रश्न का समाधान करती है, यही कारण है कि नियम केवल एक दिशा में चलता है: पहले मौजूदा छवि खोजें, फिर उसका वर्णन करें... कभी भी एक विवरण की कल्पना न करें और सबूत की तलाश न करें

काम करने की संख्या: एक मुख्य चरित्र के लिए 10 से 20 चित्र, प्रति प्रमुख स्थान 8 से 15, प्रति प्रॉप 3 से 5, साथ ही प्रकाश, रंग, प्रकाशिकी, कैमरा मूवमेंट, बनावट, कटिंग टेम्पो और ध्वनि के लिए अलग बोर्ड

वे श्रेणियां काम करने वाले प्रोडक्शन से गिनी जाती हैं, अनुमानित नहीं, यही कारण है कि मैं उन्हें गोल नहीं कर रहा हूं

प्रत्येक छवि को एक कैप्शन मिलता है जो ठीक से नाम देता है कि इससे क्या लिया गया है

एक छवि जो आपको पसंद है, बिना कैप्शन के, एक सप्ताह बाद कबाड़ है

और "इस तरह... अनुमति नहीं" के रूप में चिह्नित चित्र प्रतिबंध सूची बन जाते हैं, जो आपको संदर्भों की तुलना में अधिक जनरेशन बचाता है

स्टाइल बोर्ड भरने का सबसे तेज़ तरीका कल्पना करने के बजाय वास्तविक सिनेमा से निकालना है: एक विज़न मॉडल को उन फिल्मों के स्टिल्स फीड करें जो पहले से ही आपकी भावना रखती हैं, इसे लेंस, प्रकाश दिशा, पैलेट, अनाज का नाम दें, और आउटपुट को एक पैराग्राफ के रूप में लॉक करें जो परियोजना के हर प्रॉम्प्ट में पेस्ट किया जाता है

फिर लॉक आता है, और लॉक लिखित होता है

प्रत्येक बोर्ड एक निश्चित निर्णय में समाप्त होता है... स्वीकृत, संशोधित, या अस्वीकृत... बोर्ड पर ही दर्ज किया जाता है

एक शैली जिसे मौखिक रूप से स्वीकृत किया गया था, इसका मतलब है कि निर्देशक और प्रॉम्प्ट इंजीनियर दो अलग-अलग फिल्में पकड़ रहे हैं, और उन्हें एक महीने बाद पता चलता है

कौशल: /reference-board एक बार में एक बोर्ड का साक्षात्कार चलाता है... आप संदर्भ प्रदान करते हैं, यह प्रत्येक छवि पर एक कैप्शन को मजबूर करता है, प्रत्येक एंटी-रेफरेंस को प्रतिबंध सूची में दर्ज करता है, और प्रत्येक बोर्ड को लिखित निर्णय, स्वीकृत, संशोधित, या अस्वीकृत के साथ बंद करता है

बोर्ड पर उस निर्णय के बिना कुछ भी लॉक नहीं कहा जाता है

Machina - inline image

चरण 4: पासपोर्ट

यहाँ वह जगह है जहाँ स्थिरता निर्मित होती है

देखें कि एक चरित्र के साथ क्या होता है: उसे एक विस्तृत टेक्स्ट डिस्क्रिप्टर और एक तटस्थ ग्रे पृष्ठभूमि पर उत्पन्न संदर्भ छवियों की एक शीट मिलती है... सामने, तीन-चौथाई, प्रोफ़ाइल, पीछे, क्लोज़ पोर्ट्रेट

वह जोड़ी, डिस्क्रिप्टर प्लस संदर्भ, हर प्रॉम्प्ट में यात्रा करती है जिसमें वह दिखाई देता है, शब्द दर शब्द, फ़ाइल दर फ़ाइल

यह उसका पासपोर्ट है, और एक प्रोडक्शन में प्रति चरित्र, स्थान और प्रॉप एक होता है

गीले कपड़े एक अलग पासपोर्ट हैं

खून भी है... @cal, @cal_wet, और @cal_blood तीन अलग-अलग संपत्तियां हैं जिनमें तीन अलग-अलग टैग हैं, क्योंकि इनलाइन वर्णित एक संस्करण एक ऐसा संस्करण है जिसे मॉडल भूल जाएगा

दो विवरण पासपोर्ट को धारण करते हैं:

  • डिस्क्रिप्टर को कभी छोटा नहीं किया जाता है, क्योंकि "संक्षिप्तता के लिए छंटनी" ठीक वही है जहाँ स्थिरता मर जाती है
  • एक स्थान का पासपोर्ट अपने अंदर दृश्य के पैलेट और प्रकाश चरित्र को वहन करता है, ताकि उस स्थान का प्रत्येक शॉट पूर्व-ग्रेडेड आए

और संदर्भ छवियां स्वयं पहले हाथ से बनाई जाती हैं, एक इमेज मॉडल में, किसी भी वीडियो प्रॉम्प्ट के अस्तित्व में आने से पहले

उन्हें लॉक करें और कभी पुन: उत्पन्न न करें... यदि गति बाद में गलत लगती है तो आप मोशन प्रॉम्प्ट को ठीक करते हैं, क्योंकि एक नई छवि पुराने पर ढेर किए गए स्थिरता कार्य के हर टुकड़े को पूर्ववत कर देती है

प्रत्येक पासपोर्ट एक जीवित रजिस्ट्री में एक पंक्ति के रूप में उतरता है: टैग, प्रकार, संस्करण, सीड फ़ाइल, दृश्य, स्थिति

इस बिंदु पर एक पासपोर्ट अभी भी एक ड्राफ्ट है, क्योंकि एक भाग्यशाली छवि पर बनाया गया पासपोर्ट एक झूठी जीत है

कौशल: /asset-passport एक बार में एक संपत्ति बनाता है... यह आपका साक्षात्कार तब तक करता है जब तक डिस्क्रिप्टर में कोई अंतराल न हो, आपके इमेज मॉडल के लिए ग्रे-बैकग्राउंड रेफरेंस-शीट प्रॉम्प्ट लिखता है, प्रत्येक राज्य संस्करण को अपनी स्वयं की टैग की गई संपत्ति में विभाजित करता है, और ड्राफ्ट पर रजिस्ट्री पंक्ति दर्ज करता है

Machina - inline image

चरण 5: तनाव परीक्षण

किसी भी संपत्ति पर भरोसा करने से पहले, यह युद्ध की स्थितियों में उत्पन्न होता है: विभिन्न कोण और शॉट आकार, इसके वास्तविक दृश्यों की रोशनी, और हर संपत्ति के बगल में खड़ा होना जिसके साथ यह एक फ्रेम साझा करेगा... क्योंकि एक चरित्र जो अकेला रहता है, वह अक्सर उस समय टूट जाता है जब वह एक फ्रेम साझा करता है

परीक्षण सस्ते स्थिर चित्र हैं, जो एक महंगी वीडियो जनरेशन से पहले चलाए जाते हैं

पात्रों को 10 में से 10 दोहराव पर हिट करना होता है

जो सही है

इससे नीचे कुछ भी रजिस्ट्री पंक्ति को ड्राफ्ट में रखता है, और जिस दृश्य को यह अवरुद्ध करता है वह या तो प्रतीक्षा करता है या जानबूझकर अगले प्रोडक्शन ब्लॉक में चला जाता है

एक दृश्य के लिए जनरेशन तब शुरू होती है जब वह जिस भी पंक्ति को छूता है वह लॉक कहती है, और एक घंटे पहले नहीं

कौशल: /stress-test आपकी रजिस्ट्री और ब्रेकडाउन पढ़ता है, कॉम्बैट मैट्रिक्स बनाता है... कोण, शॉट आकार, वास्तविक दृश्य प्रकाश, प्रत्येक सह-कलाकार के बगल में एक टू-शॉट... आपको परीक्षण प्रॉम्प्ट देता है, और पंक्ति को केवल पूर्ण पास पर लॉक में बदल देता है

कोई पूर्ण पास नहीं, कोई लॉक नहीं, और दृश्य बंद रहता है

Machina - inline image

रजिस्ट्री के हरे होने के साथ, प्रोडक्शन अंततः रेंडर करना शुरू करता है... और इसका हर शॉट उन्हीं पंद्रह ब्लॉकों से आता है

चरण 6: प्रॉम्प्ट

प्रत्येक शॉट प्रॉम्प्ट एक ही निश्चित क्रम में एक ही 15 ब्लॉक है

कहीं भी कोई नकारात्मक प्रॉम्प्ट नहीं... हर निषेध को फिर से लिखा जाता है कि फ्रेम में क्या है

जनरेशन चरण इसी पर चलता है, क्योंकि एक बार ब्लॉक लॉक हो जाने के बाद रेंडर स्वयं यांत्रिक होता है

Machina - inline image

अपने आप में चुराने लायक ब्लॉक:

  • ओपनर "EXACT N CHARACTERS - NO DUPLICATES" बताता है क्योंकि मॉडल उस समय लोगों को जोड़ता है जब आप गिनती को खुला छोड़ देते हैं
  • स्थान का नक्शा मीटर में दूरी देता है और उस रेखा का नाम देता है जिसे कैमरा कभी पार नहीं करता
  • प्रति शॉट एक लेंस, और दृश्य का क्षेत्र केवल एक हार्ड कट पर बदलता है
  • कार्रवाई 0.3 से 0.8 सेकंड के समयबद्ध बीट्स में उतरती है
  • भौतिकी बनी रहती है: क्षति कभी भी मध्य-दृश्य में ठीक नहीं होती, मलबा वहीं रहता है जहाँ वह गिरा
  • प्रकाश कभी सपाट और सामने का नहीं होता, यह स्थान के अपने स्रोतों से आकार में आता है
  • स्टाइल ब्लॉक 60:30:10 रंग रेखा के साथ बंद होता है: प्रमुख रंग, द्वितीयक, और फ्रेम में एक्सेंट का हिस्सा

30 सेकंड के वन-शॉट के लिए प्रॉम्प्ट चार समयबद्ध बीट्स में विभाजित होता है... 0-6 दृश्य सेट करता है, 6-14 निर्माण करता है, 14-24 मोड़ता है, 24-30 हल करता है... प्रति बीट पूर्ण विवरण सेट लिखा जाता है, टाइमस्टैम्प शामिल हैं

संदर्भों को समान अनुशासन मिलता है: प्रत्येक संलग्न छवि, क्लिप, या ऑडियो फ़ाइल बताती है कि यह क्या नियंत्रित करता है और इसे क्या स्पर्श नहीं करना चाहिए

"@video 1 गति और गति को परिभाषित करता है" आधी भूमिका है... दूसरी छमाही है "इससे पहचान, कपड़े या दृश्य न लें", और वह दूसरी पंक्ति वह है जो एक संदर्भ को एक शॉट में लीक होने से रोकती है जिसे आकार देने का इरादा कभी नहीं था

गति को अपना स्वयं का व्याकरण मिलता है: प्रत्येक प्रॉम्प्ट कैमरा मूव का नाम देता है और इसे एक घटना के साथ जोड़ता है जो क्लिप के दौरान होती है

फिर यह कहता है कि कोई जमी हुई आकृतियाँ नहीं, सीधे तौर पर

एक खड़ी आकृति के पास से एक डॉली एक स्थिर छवि है जो बहती है

वही डॉली जबकि पाल फट जाता है एक फिल्म है

फिर पुनरावृत्ति नियम

एक संपादन एक पंक्ति बदलता है और बाकी सब कुछ शब्दशः रखता है, प्रत्येक प्रयास लॉग किया जाता है कि क्या बदला और फैसला, और एक शॉट जो प्रयास 15 तक नहीं उतरा है उसे बेहतर शब्दों की आवश्यकता नहीं है... इसे एक सरल शॉट की आवश्यकता है: इसे दो में विभाजित करें, एक क्रिया छोड़ें, कोण बदलें

एक समाप्त टेक चेकलिस्ट द्वारा स्वीकार किया जाता है... संदर्भों से मेल खाता है, कोई आर्टिफैक्ट नहीं, कैमरा ऑर्डर के अनुसार, लिप-सिंक रहता है, अपने पड़ोसियों के साथ कटता है... और केवल स्वीकृत टेक को सेलेक्ट्स फ़ोल्डर में अंतिम नाम मिलते हैं

वह स्वीकृति एक शॉट को कभी भी आवश्यक अंतिम हाँ है, क्योंकि संपादक कभी भी कच्ची जनरेशन को नहीं छूता

कौशल: /shot-prompt एक शॉट कार्ड और फ्रेम में सब कुछ के लॉक किए गए पासपोर्ट लेता है, और यह एक जनरेशन-रेडी प्रॉम्प्ट लिखने से इनकार करता है जबकि उनमें से कोई भी संपत्ति अभी भी ड्राफ्ट है

फिर यह हर डिस्क्रिप्टर के साथ 15 ब्लॉक शब्दशः पेस्ट करता है और आपके साथ जनरेशन लॉग रखता है... प्रति प्रयास एक पंक्ति बदली गई, 15 पर शॉट को सरल बनाएं

Machina - inline image

स्टूडियो एक फ़ाइल ट्री है

इस पाइपलाइन में कोई प्रोडक्शन ऑफिस नहीं है

एक निर्देशिका है

  • assets पासपोर्ट रखता है: पात्र, स्थान, प्रॉप्स
  • prompts शॉट कार्ड और प्रत्येक प्रॉम्प्ट संस्करण रखता है
  • generations कच्चे प्रयास रखता है, और प्रॉम्प्ट इंजीनियर के अलावा कोई नहीं जाता
  • selects केवल स्वीकृत टेक रखता है, और यह एकमात्र फ़ोल्डर है जिसे एडिट को देखने की अनुमति है
  • edit, color, sound, और master फिनिशिंग चेन रखते हैं
  • docs ब्रेकडाउन, बाइबल, रजिस्ट्री और जनरेशन लॉग रखता है

एक और कानून: एक संदर्भ फ़ाइल का नाम कभी नहीं बदला जाता

एक नया संस्करण एक नई फ़ाइल है, क्योंकि नाम बदलने से हर प्रॉम्प्ट टूट जाता है जो पुराने की ओर इशारा करता है

कौशल: /studio-init एक प्रश्न पूछता है, परियोजना का नाम, फिर पूरे ट्री को स्कैफोल्ड करता है, ब्रेकडाउन, बाइबल, रजिस्ट्री और जनरेशन लॉग को तैयार टेम्पलेट के रूप में सीड करता है, और तीन फ़ोल्डर कानूनों को परियोजना में लिखता है ताकि इसे छूने वाला हर एजेंट उन्हें प्राप्त करे

Machina - inline image

और सातवां कौशल सामने का दरवाजा है: /setup पूछता है कि आप किस इमेज और वीडियो मॉडल के साथ काम करते हैं, आप प्रत्येक तक कैसे पहुँचते हैं, और कभी भी एक स्टैक नहीं मानता... यह आपकी परियोजना में साझा कॉन्फ़िगरेशन लिखता है ताकि हर दूसरा कौशल एक ही सेटअप पढ़े, फिर आपको क्रम में श्रृंखला देता है: setup, studio-init, film-breakdown, reference-board, asset-passport, stress-test, shot-prompt

Machina - inline image

सभी 7 टेलीग्राम में हैं: https://t.me/tgmachina

चरण 7 से 11: क्या मानवीय रहता है

एडिट, क्लीनअप, कलर, साउंड और मास्टर पाँच चरण हैं जिन्हें कोई कौशल नहीं चलाता

पाइपलाइन चित्र और स्क्रैच ऑडियो उत्पन्न करती है, और यह जानबूझकर वहीं रुक जाती है

फिनिशिंग मानवीय काम है

एडिट लगभग हर जनरेशन के पहले और आखिरी आधे सेकंड को ट्रिम करता है, क्योंकि क्लिप अपने किनारों पर बहते हैं

और यह स्वाभाविक लगने से अधिक कठोरता से काटता है, क्योंकि उत्पन्न शॉट धीमी प्रविष्टियों की ओर झुकते हैं... खड़ा निर्देश आपके विचार से अधिक आक्रामक रूप से काटना है

उत्पन्न ध्वनि मचान है: लिप-सिंक की गई पंक्तियाँ समय निर्धारित करती हैं, फिर एक ध्वनि पोस्ट टीम उसी आवाज़ को फिर से रिकॉर्ड करने के बजाय साफ करती है, प्रभावों का पुनर्निर्माण करती है, और प्लेटफ़ॉर्म लाउडनेस में मिक्स करती है

रंग एक कलरिस्ट के पास जाता है जिसका पहला काम आसन्न शॉट्स को एकीकृत करना है, क्योंकि प्रत्येक स्थान के पासपोर्ट ने पहले से ही परिष्कृत करने के लिए एक अंतर्निहित ग्रेड दिया है

और मास्टर किसी भी स्टूडियो की तरह शिप करते हैं: एक DCP, मानक सिनेमा वितरण पैकेज, त्योहारों के लिए, एक ProRes फ़ाइल, उच्च गुणवत्ता वाला संग्रह प्रारूप, तिजोरी के लिए, प्लस प्लेटफ़ॉर्म एन्कोड और सबटाइटल

आर्काइव समाप्त फिल्म से अधिक रखता है

यह उत्पादन के साधन रखता है... हर अंतिम प्रॉम्प्ट, जनरेशन लॉग, रजिस्ट्री, लॉक किए गए पासपोर्ट... क्योंकि सीक्वल उस सब से शुरू होता है जो पिछले प्रोडक्शन ने सीखा

प्लेबुक ब्लॉक

पूरी पाइपलाइन, बचाने लायक ब्लॉक में संपीड़ित:

  1. फिल्म के लिए कुछ भी उत्पन्न करने से पहले विज़ुअल बाइबल को लिखित रूप में लॉक करें
  2. एक संपत्ति, एक पासपोर्ट: विस्तृत डिस्क्रिप्टर प्लस ग्रे-बैकग्राउंड संदर्भ, हमेशा के लिए शब्दशः कॉपी किया गया
  3. इसके दृश्य खुलने से पहले प्रत्येक पासपोर्ट का दृश्य प्रकाश और टू-शॉट में 10/10 तक तनाव-परीक्षण करें
  4. प्रत्येक प्रॉम्प्ट को एक ही 15 ब्लॉक के रूप में लिखें, 30 सेकंड के शॉट के लिए चार समयबद्ध बीट्स
  5. प्रति प्रयास एक पंक्ति बदलें, प्रत्येक जनरेशन लॉग करें, प्रयास 15 पर शॉट को सरल बनाएं
  6. चेकलिस्ट द्वारा सेलेक्ट्स में टेक स्वीकार करें: एडिट और कुछ नहीं देखता
  7. किनारों को ट्रिम करें, आक्रामक रूप से काटें, चित्र लॉक करें, रंग और ध्वनि मनुष्यों को सौंपें

लॉक छोड़ें और आपकी आधी सामग्री दो बार बनाई जाती है

मॉडल इस सिस्टम के नीचे से स्वैप हो जाएंगे... विधि स्वयं अपनी मॉडल तालिका को महीनों में पुरानी होने की उम्मीद करती है

अनुक्रम और गेट वह हिस्सा हैं जो नहीं बदलता

इस लेख को प्रायोजित करने के लिए हिग्सफील्ड का धन्यवाद

7 कौशल जल्द ही मेरे टेलीग्राम में आएंगे: https://t.me/tgmachina

YouMind में रीमिक्स करें

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
क्रिएटर्स के लिए

अपने Markdown को एक साफ़-सुथरे 𝕏 आर्टिकल में बदलें

जब आप अपना लंबा कंटेंट पब्लिश करते हैं, तो इमेज, टेबल और कोड ब्लॉक को 𝕏 के लिए फ़ॉर्मेट करना मुश्किल होता है। YouMind पूरे Markdown ड्राफ़्ट को एक साफ़-सुथरे, पोस्ट के लिए तैयार 𝕏 आर्टिकल में बदल देता है।

Markdown से 𝕏 आज़माएँ

समझने के लिए और पैटर्न

हाल के वायरल लेख

और वायरल लेख देखें