Anthropic ने अब तक का अपना सबसे मजबूत मॉडल जारी किया है, और बेंचमार्क में हुई छलांग लगभग सबसे कम दिलचस्प हिस्सा है।
Claude Fable 5.1 एक बेहतर चैटबॉट से कम और एक नए तरह के ऑपरेटर की तरह लगता है। यह घंटों एक समस्या पर बैठ सकता है, जब कोई योजना टूटती है तो उसे संभाल सकता है, अन्य एजेंटों को समन्वित कर सकता है, अपने स्वयं के आउटपुट का निरीक्षण कर सकता है, और हर दस मिनट में किसी के द्वारा इसे बचाए जाने की आवश्यकता के बिना आगे बढ़ता रह सकता है।
आंकड़े इसका समर्थन करते हैं। Anthropic के प्रकाशित मूल्यांकनों पर, Fable 5.1 ने एजेंटिक वैज्ञानिक अनुसंधान में Fable 5 से दोगुना से अधिक अंक प्राप्त किए, व्यवसाय ऑटोमेशन में 17.1% से बढ़कर 31.4% तक पहुंच गया, और CursorBench पर 73.4% तक पहुंच गया। इसने Anthropic द्वारा रिपोर्ट किए गए अधिकांश कोडिंग, ऑटोमेशन, कंप्यूटर-उपयोग और ज्ञान-कार्य परीक्षणों में Fable 5, Opus 5 और GPT-5.6 Sol को भी पीछे छोड़ दिया।
https://x.com/claudeai/status/2094848581425377479
बॉक्स से बाहर, यह कठिन कोडिंग, लंबी अवधि के काम, अनुसंधान, योजना, कंप्यूटर उपयोग और पूर्ण डिलिवरेबल्स तैयार करने में असाधारण है। लेकिन बड़ा अवसर तब आता है जब आप इसे हर कार्य करने वाले व्यक्ति के रूप में उपयोग करना बंद कर देते हैं और इसे काम करने वाली प्रणाली का प्रभारी बना देते हैं।
यही वह चीज़ है जो यह कोर्स कवर करता है: Fable 5.1 वास्तव में कहाँ अलग है, इसे लीडर की सीट पर कैसे बिठाया जाए, इसके नीचे वर्कर्स कैसे बनाएं, इसे बिना दबाए कैसे प्रॉम्प्ट करें, लक्ष्यों और लूप्स का उपयोग कैसे करें, और वे पाँच वर्कफ़्लो जहाँ अंतर वास्तविक पैसे में बदल सकता है।
यदि आप टर्मिनलों, एजेंट फ़ाइलों और ऑर्केस्ट्रेशन की परवाह नहीं करते हैं और बस एक विचार को एक काम करने वाले ऐप में बदलना चाहते हैं, तो इसके लिए हमने Shipper बनाया है।
यह मॉडल वास्तव में किसमें असाधारण है
विधियों से पहले, मशीन से मिलिए। ये पाँच क्षमताएँ हैं जो Fable 5.1 को इससे पहले के मॉडलों से अलग महसूस कराती हैं।
यह बेतुके लंबे रनों के लिए सुसंगत रहता है
इसे एक ऐसा काम दें जिसमें घंटों लगते हैं और इसके बीच में ही भटक जाने की संभावना बहुत कम होती है।
एक प्रारंभिक परीक्षक ने 38 घंटे के एक अप्राप्य मशीन-लर्निंग रन की सूचना दी जिसमें Fable ने एक खराब पिछले परिणाम का निदान किया, उसे ठीक किया, समानांतर में छह प्रयोग शुरू किए, और निष्कर्षों और अगले चरणों के साथ वापस आया। एक अन्य ने कहा कि इसने अपने स्वयं के रिकॉर्ड रखे, जब स्थितियाँ बदलीं तो पुनः प्राथमिकता दी, और जहाँ से छोड़ा था वहीं से फिर से शुरू किया।
1-मिलियन-टोकन संदर्भ विंडो मदद करती है, लेकिन संदर्भ आकार वास्तविक अपग्रेड नहीं है। अपग्रेड यह है कि मॉडल उस संदर्भ के अंदर उपयोगी निर्णय लेना जारी रख सकता है, न कि केवल यह याद रखना कि जानकारी मौजूद है।
यह सबसे तेज़ पैच के बजाय मूल कारण की तलाश करता है
पिछले एजेंट अक्सर पहला फिक्स ढूंढ लेते थे जिससे कोई त्रुटि गायब हो जाती थी। Fable 5.1 तब तक खुदाई जारी रखने को अधिक इच्छुक है जब तक वह यह नहीं समझ लेता कि त्रुटि क्यों मौजूद थी।
Anthropic के लॉन्च परीक्षण में, Millennium ने इसे एक क्रैश दिया जो लगभग दस लाख रनों में एक बार होता था और चार से पाँच वर्षों तक अस्पष्टीकृत रहा था। Fable 5.1 ने एक बाहरी लाइब्रेरी को अलग किया, इसे कोर डंप से जोड़ा, और क्रैश को वास्तविक बग तक ट्रेस किया। उन्होंने जितने भी अन्य मॉडल आज़माए थे, जिसमें Fable 5 भी शामिल है, वे इसे मिस कर गए।
यह डिबगिंग से कहीं आगे मायने रखता है। वही प्रवृत्ति अनुसंधान, रणनीति, वित्तीय विश्लेषण और संचालन में दिखाई देती है: जब अंतर्निहित प्रणाली गलत हो तो लक्षण को अनुकूलित न करें।
यह देख सकता है, कार्य कर सकता है और सत्यापित कर सकता है
Fable 5.1 स्क्रीनशॉट, चार्ट, PDF, इंटरफ़ेस और दस्तावेज़ों का निरीक्षण कर सकता है, फिर जो देखता है उसका उपयोग अगली कार्रवाई का मार्गदर्शन करने के लिए कर सकता है।
इसका मतलब है कि यह संदर्भों से एक इंटरफ़ेस का पुनर्निर्माण कर सकता है, एक वित्तीय दस्तावेज़ के अंदर दबे आंकड़ों को पढ़ सकता है, एक ब्राउज़र संचालित कर सकता है, अपने कार्यान्वयन की मूल डिज़ाइन से तुलना कर सकता है, और काम को पूर्ण घोषित करने से पहले दृश्य समस्याओं को पकड़ सकता है।
Anthropic के परीक्षण में इसका OSWorld कंप्यूटर-उपयोग स्कोर Fable 5 और Opus 5 दोनों से ऊपर चला गया। इससे भी महत्वपूर्ण बात यह है कि मॉडल तेजी से दृष्टि को एक सत्यापन लूप के हिस्से के रूप में उपयोग करने में सक्षम हो रहा है, न कि केवल आपके द्वारा दी गई छवि का वर्णन करने के लिए।
यह काम लौटाता है, काम पर एक व्याख्यान नहीं
इसे दस्तावेज़ों का एक फ़ोल्डर दें और एक निवेश मेमो, एक डेक, एक काम करने वाला प्रोटोटाइप, या एक विश्लेषण माँगें, और इसके कलाकृति को स्वयं लौटाने की संभावना बहुत अधिक होती है।
प्रारंभिक परीक्षकों ने आज तक के Anthropic के सर्वश्रेष्ठ PowerPoint परिणाम, वित्तीय दस्तावेज़ों पर मजबूत उद्धरण स्मरण, अधिक संक्षिप्त अनुबंध रेडलाइन और जटिल बहु-भागीय अनुरोधों की बेहतर पूर्णता की सूचना दी। एक MongoDB इंजीनियर ने तीन दिवसीय प्रोटोटाइप रन का वर्णन किया जहाँ मॉडल ने मौजूदा सेवाओं पर शोध किया, सिस्टम को डिज़ाइन किया, इसे अप्राप्य चरणों में लागू किया, और इस बात के सबूत के साथ दृश्य वॉकथ्रू लौटाए कि प्रत्येक चरण ने काम किया।
व्यावहारिक अंतर सरल है: आप एक उत्तर को उपयोगी कार्य में बदलने में कम समय बिताते हैं।
इसे नेतृत्व करने के लिए बनाया गया था
Fable 5.1 सबसे मूल्यवान तब होता है जब यह तय कर रहा होता है कि आगे क्या होना चाहिए।
Claude Code पहले से ही इसे सबएजेंट, बैकग्राउंड सेशन, एजेंट टीम, डायनेमिक वर्कफ़्लो, लक्ष्य, लूप, ब्राउज़र, टर्मिनल और प्रोजेक्ट फ़ाइलें दे सकता है। Fable के पास उन टुकड़ों को एक फिनिश लाइन की ओर इंगित रखने के लिए पर्याप्त योजना गहराई और संदर्भ है, जो पिछले मॉडल कर सकते थे उससे कहीं अधिक समय तक।
यही कारण है कि नीचे दिया गया सेटअप काम करता है, और कोर्स Fable को वर्कर सीट से बाहर निकालकर क्यों शुरू होता है।
कॉकपिट: हर एक नियंत्रण जिसकी आपको वास्तव में आवश्यकता है
कुछ और करने से पहले Claude Code को अपडेट करें। वर्तमान मॉडल कॉन्फ़िगरेशन दस्तावेज़ के अनुसार, संस्करण 2.1.255 या बाद का fable उपनाम को Fable 5.1 पर हल करता है, और हाल के रिलीज़ में नीचे उपयोग किए गए गोल, लूप, बैकग्राउंड-एजेंट और एफर्ट नियंत्रण शामिल हैं।
फिर मॉडल और प्रयास स्तर चुनें:
/model fable
/effort high
High महत्वपूर्ण कार्य के लिए समझदार डिफ़ॉल्ट है। सस्ते, तेज़ पास के लिए medium पर जाएँ। xhigh या max पर तभी जाएँ जब समस्या अधिक सोच को सही ठहराने के लिए पर्याप्त कठिन हो। Fable की अनुकूली सोच हमेशा चालू रहती है, इसलिए प्रयास ही वह नियंत्रण है जो मायने रखता है।
शेष नियंत्रण सरल हैं:
/plan या Shift+Tab: फ़ाइलों को बदलने से पहले इसे निरीक्षण और योजना बनाने दें
/goal: एक परीक्षण योग्य शर्त पूरी होने तक बारी-बारी से काम करते रहें
/loop: सत्र सक्रिय रहने पर एक शेड्यूल पर एक प्रॉम्प्ट को फिर से चलाएँ
/tasks: देखें कि बैकग्राउंड वर्कर क्या कर रहे हैं
/context: देखें कि संदर्भ विंडो में क्या खपत हो रही है
यह कॉकपिट है।
बाकी कोर्स यह जानना है कि किस नियंत्रण तक कब पहुँचना है।
मुख्य कार्यक्रम: Fable को नेता बनाएँ, कार्यकर्ता नहीं
सबसे बड़ा एकल अपग्रेड एक भूमिका परिवर्तन है।
Fable को हर कीबोर्ड कार्य देना बंद करें। इसे काम को परिभाषित करने, इसे साफ-सुथरी लेन में विभाजित करने, उन लेन को सस्ते एजेंटों को भेजने और जो वापस आता है उसका न्याय करने दें।
सेटअप इस तरह दिखता है:
Fable योजना को आकार देता है:
इसे प्लान मोड में रखें और बदलावों का प्रस्ताव देने से पहले प्रोजेक्ट का निरीक्षण करने दें। यदि अनुरोध अभी भी अस्पष्ट है, तो Matt Pocock के
skills collection का उपयोग करके विचार से पूछताछ करें, बातचीत को एक स्पेक में बदलें, और स्पेक को टिकटों में विभाजित करें।
Fable पृथक कार्य सौंपता है:
कार्यान्वयन Opus या Sonnet सबएजेंटों को जाता है, प्रत्येक कार्यकर्ता के पास एक सीमांकित लेन होती है। यदि आप पहले से इसका उपयोग करते हैं तो Codex एक और कार्यकर्ता हो सकता है, लेकिन इसे समान फ़ाइल सीमाओं और साक्ष्य नियमों का पालन करना चाहिए।
एक अलग एजेंट सत्यापित करता है:
कार्यकर्ता अपना स्वयं का होमवर्क ग्रेड नहीं करता है। एक नया सत्यापनकर्ता योजना को पढ़ता है, डिफ का निरीक्षण करता है, जाँच चलाता है, और या तो चरण पास करता है या इसे एक ठोस विफलता के साथ वापस करता है।
आप चेकपॉइंट पर स्टीयर करते हैं:
योजना को स्वीकृत करें, सार्थक ट्रेडऑफ़ की समीक्षा करें, और अंत में साक्ष्य का निरीक्षण करें। आपको हर कमांड देखने की आवश्यकता नहीं है।
यह क्यों काम करता है: महंगा मॉडल अपने टोकन आर्किटेक्चर, प्राथमिकता, रिकवरी और निर्णय पर खर्च करता है। सस्ते मॉडल अपने टोकन सीमांकित निष्पादन पर खर्च करते हैं।
अर्थशास्त्र तभी काम करता है जब लेन वास्तव में स्वतंत्र हों। Anthropic की वर्तमान API मूल्य निर्धारण के तहत, Fable 5.1 की लागत $10 प्रति मिलियन इनपुट टोकन और $50 प्रति मिलियन आउटपुट टोकन है, जबकि Opus 5 उसका आधा है और Sonnet 5 पाँचवाँ हिस्सा है। Fable 5.1 ने कैश रीड को भी घटाकर $0.25 प्रति मिलियन टोकन कर दिया, जो एक स्थिर प्रोजेक्ट संदर्भ के साथ लंबे सत्रों को अधिक व्यावहारिक बनाता है।
दिखावे के लिए समानांतरीकरण न करें। पाँच एजेंट एक ही फ़ाइलों को संपादित करने से पाँच बिल और एक मर्ज समस्या पैदा होगी। अनुसंधान, पृथक मॉड्यूल, परीक्षण, दस्तावेज़ीकरण और अन्य लेन को समानांतर करें जो एक-दूसरे की प्रतीक्षा किए बिना समाप्त हो सकते हैं।
अपने कार्यकर्ताओं का निर्माण करें
नेता को एक छोटी टीम की आवश्यकता होती है, और एक कस्टम वर्कर .claude/agents/ के अंदर केवल एक Markdown फ़ाइल है।
एक कार्यान्वयन कार्यकर्ता से शुरू करें:
name: implementation-worker
description: एक स्वीकृत योजना से एक पृथक चरण लागू करता है। केवल तभी उपयोग करें जब चरण में अलग-अलग फ़ाइलें हों।
model: opus
tools: Read, Grep, Glob, Edit, Write, Bash
maxTurns: 25
आप केवल अपने को सौंपे गए चरण के मालिक हैं।
संपादित करने से पहले, अपनी लेन में सटीक फ़ाइलों और स्वीकृति मानदंडों की पहचान करें।
किसी अन्य कार्यकर्ता के स्वामित्व वाली फ़ाइलों को न बदलें।
सबसे छोटा पूर्ण समाधान लागू करें, फिर प्रासंगिक परीक्षण चलाएँ।
लौटाएँ:
- बदली गई फ़ाइलें
- चलाई गई जाँच और उनका वास्तविक आउटपुट
- कुछ भी जो अभी भी अनिश्चित है
इस रन से साक्ष्य के बिना सफलता की घोषणा न करें।
फिर वह कार्यकर्ता बनाएँ जो सबसे अधिक मायने रखता है, सत्यापनकर्ता:
name: verifier
description: एक पूर्ण चरण को उसकी योजना और स्वीकृति मानदंडों के विरुद्ध स्वतंत्र रूप से सत्यापित करता है। प्रत्येक कार्यान्वयन चरण के बाद उपयोग करें।
model: opus
tools: Read, Grep, Glob, Bash
maxTurns: 15
कार्यान्वयन सारांश को एक अविश्वसनीय दावे के रूप में मानें।
योजना पढ़ें और वास्तविक डिफ का निरीक्षण करें। प्रासंगिक परीक्षण स्वयं चलाएँ।
शुद्धता, प्रतिगमन, दायरा और प्रत्येक स्वीकृति मानदंड की जाँच करें।
PASS या FAIL लौटाएँ।
प्रत्येक विफलता के लिए, साक्ष्य और आवश्यक न्यूनतम सुधार शामिल करें।
जिस कार्यान्वयन का आप मूल्यांकन कर रहे हैं, उसे कभी संशोधित न करें।
नई आँखें वह पकड़ती हैं जिसे लेखक सामान्य कर देता है। तुरंत जाँचा गया चरण उस दोष की तुलना में बहुत सस्ता है जो चार और चरणों के उस पर निर्भर होने के बाद खोजा जाता है।
चार नियम टीम को तेज़ रखते हैं:
एक कार्यकर्ता, एक लेन, स्पष्ट फ़ाइल स्वामित्व के साथ
समानांतर कार्य केवल तभी जब लेन एक-दूसरे पर निर्भर न हों
Fable नेता की सीट पर रहता है जबकि Opus या Sonnet श्रम संभालता है
पूर्णता के प्रत्येक दावे की फ़ाइलों, परीक्षणों या लाइव परिणाम के विरुद्ध जाँच की जाती है
रहस्य 1: मार्ग निर्धारित न करें
अधिकांश प्रॉम्प्टिंग सलाह कमजोर मॉडलों को भटकने से रोकने के लिए लिखी गई थी।
लंबी प्रक्रियाएँ, कठोर चरण सूचियाँ और विशाल नियम ब्लॉक तब मदद करते थे जब मॉडल योजना नहीं बना सकता था। Fable 5.1 के साथ, वही मचान इसे उस रास्ते से भी बदतर रास्ते पर जाने के लिए मजबूर कर सकता है जो वह स्वयं ढूंढ लेता।
ट्रिक गंतव्य के बारे में सख्त और मार्ग के बारे में ढीला होना है।
इसे चार चीज़ें दें:
परिणाम:
जब काम पूरा हो जाए तो क्या मौजूद होना चाहिए
बाधाएँ:
यह क्या तोड़, खर्च, उजागर या बदल नहीं सकता है
कारण:
यह किसके लिए है और परिणाम को किस निर्णय या कार्य का समर्थन करना चाहिए
प्रमाण:
कौन सा देखने योग्य साक्ष्य पूर्ण माना जाएगा
वह अंतिम भाग सब कुछ बदल देता है। "चेकआउट को काम करने दें" एक प्रशंसनीय दावे को आमंत्रित करता है। "सैंडबॉक्स में एक परीक्षण खरीदारी पूरी करें और परिणामी ऑर्डर पंक्ति दिखाएं" मॉडल को एक फिनिश लाइन देता है जिसके चारों ओर वह बात करके नहीं निकल सकता।
छिपी हुई विचार-श्रृंखला के प्रदर्शन के लिए न पूछें। योजना, महत्वपूर्ण निर्णय, साक्ष्य और शेष अनिश्चितता के लिए पूछें। Fable की सोच पहले से ही हमेशा चालू है। आपके लिए जो मायने रखता है वह यह है कि क्या परिणाम निरीक्षण में टिकता है।
और इसे यह याद दिलाते न रहें कि बजट गायब हो रहा है। इसके बजाय सीमा को सिस्टम में रखें: वर्कर टर्न को कैप करें, अनुमत खर्च को परिभाषित करें, और इसे बताएं कि जब सीमा तक पहुँच जाए तो क्या करना है।
रहस्य 2: CLAUDE.md को हल्का रखें
CLAUDE.md प्रत्येक Claude Code सत्र की शुरुआत में लोड किया जाता है। यह इसे उपयोगी बनाता है, लेकिन इसका यह भी अर्थ है कि प्रत्येक अप्रासंगिक पंक्ति प्रत्येक भविष्य के कार्य पर कर लगाती है।
Anthropic अब अनुशंसा करता है कि प्रत्येक फ़ाइल को 200 पंक्तियों से कम रखा जाए। व्यवहार में, आपकी फ़ाइल आमतौर पर बहुत छोटी हो सकती है।
तीन खंड अधिकांश परियोजनाओं को कवर करते हैं:
यह परियोजना क्या है:
उत्पाद, आर्किटेक्चर और महत्वपूर्ण सीमाएँ
कार्य को कैसे सत्यापित करें:
बिल्ड, टेस्ट, लिंट और स्थानीय पूर्वावलोकन के लिए कमांड
यह बार-बार क्या गलत करता है:
परियोजना-विशिष्ट परंपराएँ और आवर्ती गलतियाँ
प्रक्रियाएँ जो केवल कभी-कभी मायने रखती हैं, वे skills से संबंधित हैं। नियम जो केवल कुछ फ़ाइलों पर लागू होते हैं, वे पथ-स्कोप्ड नियमों से संबंधित हैं। ऐतिहासिक नोट्स दस्तावेज़ीकरण से संबंधित हैं, न कि प्रत्येक सत्र के प्रॉम्प्ट में।
आज रात अपना CLAUDE.md खोलें और प्रत्येक पंक्ति को चुनौती दें: यदि इसे हटाने से कोई वास्तविक गलती नहीं होगी, तो इसे हटा दें।
हल्की फ़ाइल आमतौर पर अधिक मजबूत होती है।
रहस्य 3: लक्ष्यों और लूप्स का दुरुपयोग करें
यह वह जगह है जहाँ Fable एक बातचीत नहीं रह जाता है और एक ऐसी प्रक्रिया बन जाता है जो आपके कुछ और करते समय आगे बढ़ती रह सकती है।
लक्ष्य: /goal सत्र को एक परीक्षण योग्य पूर्णता की स्थिति देता है। प्रत्येक बारी के बाद, एक अलग छोटा मॉडल जाँचता है कि क्या स्थिति संतुष्ट है। यदि नहीं, तो Fable आपको नियंत्रण वापस सौंपने के बजाय एक और बारी शुरू करता है। लक्ष्य तब समाप्त होता है जब वह पास हो जाता है, असंभव हो जाता है, एक अपरिवर्तनीय त्रुटि से टकराता है, या आप इसे साफ़ करते हैं।
शिल्प एक ऐसी फिनिश लाइन लिखना है जिसे यह नकली नहीं बना सकता:
देखने योग्य प्रमाण की माँग करें: "सभी auth परीक्षण पास होते हैं और आउटपुट संलग्न है" "auth ठीक करें" से अधिक मजबूत है
विफलता पथ को परिभाषित करें: यदि कोई वास्तविक अवरोधक लक्ष्य को असंभव बना देता है, तो प्रगति का आविष्कार करने के बजाय अवरोधक और साक्ष्य की रिपोर्ट करें
जोखिम भरे भागों को कैप करें: वर्कर्स के लिए maxTurns, भुगतान सेवाओं के लिए खर्च सीमाएँ, और डिप्लॉयमेंट या उत्पादन डेटा के आसपास स्पष्ट सीमाएँ का उपयोग करें
प्रत्येक संक्षिप्त विवरण में एक ईमानदारी नियम रखें: प्रत्येक प्रगति दावे को इस रन के दौरान उत्पादित या निरीक्षण किए गए परिणाम की ओर इशारा करना चाहिए
लक्ष्यों को ऑटो मोड में केवल उन सीमाओं के भीतर चलाएँ जिन्हें आप अप्राप्य छोड़ने में सहज हैं। एक अधिक बुद्धिमान एजेंट का विस्फोट दायरा बड़ा होता है जब संक्षिप्त विवरण गलत होता है।
लूप: /loop एक अंतराल पर एक प्रॉम्प्ट को फिर से चलाता है। एक निश्चित कैडेंस के लिए /loop 15m check the deployment and investigate any failure का उपयोग करें, या अंतराल को छोड़ दें और Claude को यह चुनने दें कि कब फिर से जाँच करनी है।
Claude Code के अंदर लूप सत्र-स्कोप्ड होते हैं और अंततः समाप्त हो जाते हैं। बिल्ड, पुल रिक्वेस्ट, माइग्रेशन और अस्थायी निगरानी के लिए उनका उपयोग करें। ऐसे काम के लिए जिसे सत्र या मशीन बंद होने के बाद भी जीवित रहने की आवश्यकता है, एक सतत दिनचर्या या डेस्कटॉप शेड्यूल किए गए कार्य का उपयोग करें।
लक्ष्यों और लूप्स के बीच, आप Fable को तब तक काम करते रख सकते हैं जब तक कि काम को वास्तव में आवश्यकता हो, अंत में एक और आत्मविश्वासपूर्ण पैराग्राफ के बजाय साक्ष्य प्रतीक्षा कर रहा हो।
एक वास्तविक प्रोजेक्ट को एक-शॉट कैसे करें
अब पूरे सिस्टम को एक बिल्ड के आसपास इकट्ठा करें।
उदाहरण एक काम करने वाली प्रतीक्षा सूची के साथ एक लैंडिंग पेज है। प्रोजेक्ट को बदलें और वही अनुक्रम लागू होता है।
चरण 1, संक्षिप्त विवरण लिखें
एक संदेश भेजें:
मैं [दर्शकों] के लिए [उत्पाद] लॉन्च कर रहा हूँ। उन्हें एक लैंडिंग पेज चाहिए जो एक स्पष्ट वादा करे और [ईमेल] कैप्चर करे। एक उत्तरदायी पृष्ठ बनाएँ जिसमें एक काम करने वाला फ़ॉर्म हो जो साइनअप संग्रहीत करता है। बाधाएँ: कोई फ्रेमवर्क नहीं जिसे मुझे संभालना है, कोई भुगतान निर्भरता नहीं, मोबाइल पर तेज़, और जब तक मैं स्वीकृत न करूँ तब तक कोई डिप्लॉयमेंट नहीं। पूर्ण का अर्थ है कि पृष्ठ स्थानीय रूप से चलता है, एक परीक्षण ईमेल स्टोरेज में दिखाई देता है, मोबाइल लेआउट 390px पर सत्यापित होता है, और परिणाम परीक्षण आउटपुट और स्क्रीनशॉट के साथ दिखाया जाता है। पहले प्रोजेक्ट का निरीक्षण करें और योजना बनाएँ। केवल स्वतंत्र चरणों को सौंपें। प्रत्येक पूर्ण चरण को सत्यापित करें।
संक्षिप्त विवरण इसे अपनी ओर से कार्यान्वयन को डिज़ाइन किए बिना एक गंतव्य देता है।
चरण 2, योजना को स्वीकृत करें
कुछ भी बदलने से पहले /plan या Shift+Tab के साथ प्लान मोड में प्रवेश करें।
यदि विचार अपर्याप्त रूप से निर्दिष्ट है, तो /plugin install mattpocock-skills के साथ Matt Pocock का संग्रह स्थापित करें, एक बार /setup-matt-pocock-skills चलाएँ, और परिणाम को एक स्पेक में बदलने से पहले /grill-with-docs का उपयोग करें।
योजना पढ़ें। उन सुविधाओं को काटें जिनकी आपको आवश्यकता नहीं है। सुनिश्चित करें कि प्रत्येक चरण में एक देखने योग्य पास की स्थिति है। फिर इसे स्वीकृत करें।
चरण 3, टीम को काम करने दें
Fable पहले पृथक चरण को कार्यान्वयन कार्यकर्ता को सौंपता है। सत्यापनकर्ता वास्तविक डिफ और परीक्षण आउटपुट की जाँच करता है। एक आश्रित चरण तभी शुरू होता है जब पिछला चरण पास हो जाता है।
आप टर्मिनल छोड़ सकते हैं। /tasks का उपयोग करें जब आप देखना चाहते हैं कि अभी भी क्या चल रहा है।
चरण 4, फिनिश लाइन सेट करें
एक ऐसे लक्ष्य का उपयोग करें जो स्थिति और प्रमाण का नाम दे:
/goal the page runs locally, the form stores a test signup, and the layout works at 390px, proven by the real test output, the stored record, and a current screenshot. If a genuine blocker makes this impossible, stop and report the evidence instead of claiming success.
वह शर्त केवल शब्दों से संतुष्ट होना बहुत कठिन है।
चरण 5, परिणाम की समीक्षा करें
डिफ, परीक्षण आउटपुट, संग्रहीत साइनअप और स्क्रीनशॉट पर वापस आएँ।
उत्पाद की समीक्षा एक उपयोगकर्ता की तरह करें, न कि मॉडल के प्रबंधक की तरह। उन परिवर्तनों के लिए पूछें जिन्हें आप वास्तव में देख सकते हैं, एक अंतिम स्वतंत्र सत्यापन पास चलाएँ, और जब साक्ष्य संक्षिप्त विवरण से मेल खाता हो तो शिप करें।
पहला रन विस्तृत लगेगा।
दूसरी बार, आप देखेंगे कि वही अनुक्रम लगभग हर उस प्रोजेक्ट के लिए काम करता है जिसे आप टाल रहे थे।
पाँच वर्कफ़्लो जहाँ यह वास्तविक पैसा बनाता है
अब सेटअप को उस काम पर इंगित करें जो मॉडल को सही ठहराने के लिए पर्याप्त मूल्यवान है।
ये पाँच वर्कफ़्लो हैं जहाँ Fable 5.1 एक मापने योग्य अंतर पैदा कर सकता है।
वह कोडबेस जॉब जो कोई नहीं चाहता: तीन सप्ताह का अनुमानित माइग्रेशन, दुर्लभ उत्पादन विफलता, आठ सेवाओं में फैली प्रदर्शन समस्या। Fable सिस्टम का मानचित्रण करता है, वर्कर पृथक स्लाइस लेते हैं, सत्यापनकर्ता प्रत्येक चरण की जाँच करता है, और प्रगति आशावाद के बजाय परीक्षणों से बंधी होती है।
निर्णय-ग्रेड अनुसंधान: एक प्रश्न अंदर जाता है, अनुसंधान वर्कर समानांतर में प्राथमिक स्रोतों से एकत्र करते हैं, एक संशयवादी समीक्षक प्रत्येक महत्वपूर्ण दावे पर हमला करता है, और नेता जो बचता है उसे एक मेमो में बदल देता है। यह एक अधिग्रहण, एक लॉन्च, एक बाजार निर्णय या एक निवेश थीसिस को खिला सकता है।
व्यावसायिक संचालन: इसे सही उपकरणों तक पहुँच दें और इसे डेटा को समेटने, विसंगतियों की जाँच करने, रिपोर्ट तैयार करने, एक प्रक्रिया की निगरानी करने या एक परिचालन बैकलॉग के माध्यम से काम करने दें। Fable 5.1 ने Anthropic के AutomationBench पर Fable 5 के स्कोर को लगभग दोगुना कर दिया, जो रिलीज़ में सबसे स्पष्ट व्यावहारिक छलांगों में से एक है।
संदर्भ-संचालित उत्पाद कार्य: इसे उस अनुभव के स्क्रीनशॉट दें जो आप चाहते हैं, वास्तविक संपत्तियाँ, और चल रहे ऐप तक पहुँच। यह संदर्भ के विरुद्ध कार्यान्वित कर सकता है, परिणाम खोल सकता है, दोनों की तुलना कर सकता है, और तब तक जारी रख सकता है जब तक दृश्य अंतर बंद नहीं हो जाता। आप स्वाद प्रदान करते हैं। यह आँखें, हाथ और धैर्य प्रदान करता है।
एक चक्रवृद्धि ज्ञान प्रणाली: इसे अपनी कंपनी में संरक्षित करने लायक हर चीज़ पर इंगित करें और इसे बिखरे हुए दस्तावेज़ों को एक बनाए रखा, जुड़ा हुआ सत्य का स्रोत बनाने दें। एक कॉपीराइटर इसे बेहतरीन सेल्स पेजों से बना सकता है, एक एजेंसी अपने केस स्टडीज से, और एक SaaS कंपनी ग्राहक कॉल, निर्णय, प्रयोग और सहायता इतिहास से। प्रत्येक भविष्य का एजेंट अधिक स्मार्ट शुरू होता है क्योंकि उपयोगी संदर्भ पहले से मौजूद है।
इनमें से प्रत्येक एक कभी-कभी का प्रोजेक्ट हुआ करता था।
Fable 5.1 उनमें से कई को इस-सप्ताह के प्रोजेक्ट बनाता है, बशर्ते आप सिस्टम को एक वास्तविक फिनिश लाइन और यह साबित करने का एक तरीका दें कि उसने इसे पार कर लिया है।
एक ब्लॉक में पूरा सेटअप
Fable 5.1 को नेता के रूप में चलाएँ: यह योजना बनाता है, सौंपता है, समीक्षा करता है और निर्णय लेता है
सीमांकित श्रम के लिए Opus या Sonnet का उपयोग करें, प्रति स्वतंत्र लेन एक कार्यकर्ता के साथ
इसे परिणाम, बाधाएँ, कारण और प्रमाण दें, फिर इसे मार्ग चुनने दें
CLAUDE.md को छोटा रखें और सामयिक प्रक्रियाओं को skills में ले जाएँ
सत्यापन योग्य पूर्णता के लिए लक्ष्यों और शेड्यूल किए गए चेक के लिए लूप्स का उपयोग करें
प्रयास स्तरों, सस्ते वर्कर्स, कैश किए गए संदर्भ और कठोर सीमाओं के साथ लागत को नियंत्रित करें
सिस्टम को कोडबेस, अनुसंधान, संचालन, उत्पाद कार्य और ज्ञान पर इंगित करें जो चक्रवृद्धि करता है
मॉडल सेटअप का सबसे दृश्यमान हिस्सा है, लेकिन यह पूरा लाभ नहीं है।
लाभ इस सक्षम मॉडल को एक स्पष्ट गंतव्य, एक सक्षम टीम, वास्तविकता तक पहुँच और एक आश्वस्त उत्तर को पूर्ण कार्य के साथ भ्रमित करने का कोई तरीका नहीं देना है।





