एक मुफ्त चीनी मॉडल ने 4 मिनट और 11 सेकंड में माइक्रोन का पूरा मूल्यांकन तैयार किया, स्टॉक की कीमत $854 प्रति शेयर रखी, और फिर अपने ही अंकगणित को सही ठहराया जब छह संख्याएँ गलत थीं।
फिर मैंने इसे अपने ही काम पर हमला करने को कहा। 27 सेकंड बाद इसने सात खामियाँ ढूँढ लीं, अपने एक निष्कर्ष को वापस ले लिया, और एक पंक्ति लिखी जिस पर मैं बार-बार लौटता हूँ।
मैन ग्रुप उस दूसरे भाग को करने के लिए लोगों की एक टीम को भुगतान करता है। एंट ग्रुप ने इसे अभी मुफ्त दे दिया: Ling-3.0-flash-Fin, 124 बिलियन पैरामीटर जिसमें 5.1 बिलियन सक्रिय हैं, OpenRouter पर मुफ्त, इस सप्ताह ओपन वेट।
इसलिए मैंने इसे वित्त में सबसे कठिन निर्देश दिया। शोध लिखना नहीं, बल्कि उसे नष्ट करना।

पहले इसे हमला किए जाने का अधिकार अर्जित करना था
मैंने इसे माइक्रोन पर एक सत्यापित तथ्य पैक दिया: Q3 राजस्व $41.456bn, सकल मार्जिन 84.9%, Q4 मार्गदर्शन, TrendForce उद्योग डेटा, और 31 अगस्त का बंद भाव $958.73। कोई वेब एक्सेस नहीं, सुधार की कोई गुंजाइश नहीं।
चार चरण। व्यवसाय पर शोध करें, छह-तिमाही का मॉडल बनाएं, DCF चलाएं, मेमो लिखें।
इसमें 4 मिनट और 11 सेकंड का मशीन समय लगा और कुछ भी खर्च नहीं हुआ।
मॉडल एक पूर्ण परिचालन निर्माण के साथ वापस आया: राजस्व $50.0bn से बढ़कर $57.0bn हो गया, सकल मार्जिन 86% से घटकर 78% हो गया, FY27 EPS $127.03, अनलिवर्ड फ्री कैश फ्लो $107.08bn। फिर 9% WACC और 3% टर्मिनल ग्रोथ के साथ एक DCF: एंटरप्राइज वैल्यू $957.88bn, इक्विटी $982.28bn, $854.16 प्रति शेयर, फॉरवर्ड P/E के साथ क्रॉस-चेक किया गया और $935.20 पर मिश्रित किया गया, जबकि बाजार मूल्य $958.73 था।

मैंने इसकी हर पंक्ति को Python में फिर से बनाया। छह-तिमाही तालिका सटीक है। डिस्काउंट फैक्टर सटीक हैं। टर्मिनल वैल्यू, नेट कैश ब्रिज, प्रति-शेयर गणित, संवेदनशीलता ग्रिड के दोनों कोने। यह सब सही है।
इसने जो मेमो तैयार किया वह 611 शब्दों का है, कंपनी के तथ्यों को उद्योग के सबूतों और अपने अनुमान से अलग करता है, और सभी छह स्रोत URL को सही ढंग से पुन: प्रस्तुत करता है। मैंने हर लिंक खोला। वे काम करते हैं।
$0 के लिए, यह एक जूनियर विश्लेषक का एक सप्ताह है।
फिर इसने अपना होमवर्क खुद ग्रेड किया
मॉडल के निचले भाग में इसने एक पंक्ति मुद्रित की जिसे इसे मुद्रित करने के लिए कहा गया था:
> पंक्ति-गणना जाँच: 6; अंकगणित जाँच: पास।
यह पास नहीं था।
परिदृश्य ब्लॉक में छह संख्याएँ गलत थीं। बेस केस एक ही उत्तर में दो अलग-अलग मानों के साथ दो बार दिखाई दिया। और बियर केस फ्री कैश फ्लो $1.08 बिलियन से कम था।

इसलिए मैंने इसे ब्लॉक की पुनर्गणना करने के लिए कहा। मैंने यह नहीं बताया कि त्रुटि कहाँ थी। मैंने यह नहीं बताया कि कोई त्रुटि थी।
इसने सभी छह ढूँढ लिए। प्रत्येक को दूसरे दशमलव तक नामित किया। इसके सुधारे गए नंबर मेरे Python से लाइन दर लाइन मेल खाते थे, और इसने लिखा:
पिछले उत्तर के वार्षिक योग उसकी अपनी तिमाही तालिका से मेल नहीं खाते थे, और संवेदनशीलता योग अंकगणितीय रूप से गलत थे।
यह हर समय खुद की जाँच कर सकता था। इसने बस कभी शुरू नहीं किया।
वास्तविक परीक्षण
फिर मैंने इसे पलट दिया। नया निर्देश: आप जोखिम अधिकारी हैं जिसका एकमात्र काम इस मेमो को निवेश समिति तक पहुँचने से रोकना है। हर वह जगह ढूँढें जहाँ विश्लेषक ने बिना सबूत के खुद पर विश्वास किया।
27 सेकंड। 1,008 शब्द। सात खामियाँ।

इसने अपने दूसरे थीसिस दावे को पूरी तरह वापस ले लिया, और कहा कि उसका अपना आत्मविश्वास रेटिंग एक ऐसे दावे के लिए उदार था जिसका सार यह था कि कोई नहीं जानता। इसने आंतरिक असंगति के लिए पहले दावे को डाउनग्रेड किया, यह बताते हुए कि विश्लेषक ने प्रतितर्क देखा और फिर भी इसे उच्च दर्जा दिया।
फिर यह उन चीजों पर गया जिन्हें मैंने चिह्नित नहीं किया था।
इसने FY31 तक मार्जिन को घटाकर 42% कर दिया और इसे एक गर्त कहा, जबकि ऐतिहासिक स्मृति गर्त 30 से 35 प्रतिशत तक चलती है। जो कि वही चरम-स्थायित्व त्रुटि है जिससे मेमो ने बचने का दावा किया था।
6x, 8x और 10x गुणकों को बिना किसी पीयर सेट और उनके पीछे कोई चक्र इतिहास के बिना प्रस्तुत किया गया था।
DCF और P/E के बीच 50/50 भारांक का कोई औचित्य नहीं था, इसलिए मिश्रित संख्या ने दोनों की कमजोरियों को विरासत में ले लिया।
$24.4bn का नेट कैश स्थिर रखा गया जबकि CapEx $45bn से ऊपर चला गया।
$100bn के ग्राहक समझौते प्रतिबद्ध मात्रा पर न्यूनतम मूल्य हैं, राजस्व नहीं, और एक उत्प्रेरक के रूप में जीवित नहीं रहते।
और वह पंक्ति जिस पर मैं बार-बार लौटता हूँ:
यह विश्लेषण नहीं है; यह एक विस्तृत आत्मविश्वास अंतराल है जिसमें एक आत्मविश्वासपूर्ण लगने वाली शीर्षक है।
मैंने पूछा कि यह किस संस्करण के पीछे खड़ा है
छह सेकंड:
> मेमो अपने वर्तमान स्वरूप में निवेश समिति से नहीं बचेगा। मैं जिसके पीछे खड़ा हूँ वह समीक्षा है, क्योंकि यह इस बारे में ईमानदार थी कि मेमो में क्या गलत था।
कोई बचाव नहीं। मूल की ओर वापस कोई हेजिंग नहीं। इसने अपने निष्कर्ष को उचित-मूल्य कॉल से एक स्वीकारोक्ति तक सीमित कर दिया कि कोई राय रखने के लिए सीमा बहुत विस्तृत थी।
इसका वास्तव में क्या मतलब है
पढ़ना और मॉडलिंग करना हो गया है। नौकरी का वह आधा हिस्सा अब कुछ भी खर्च नहीं करता, मिनटों में चलता है, और स्रोत सहित और पुन: प्रस्तुत करने योग्य वापस आता है।
निर्णय नहीं हुआ है। यह मॉडल आपको एक आत्मविश्वासपूर्ण मेमो देगा और बिना देखे इसे अनुमोदित कर देगा। हर वह संख्या जो इसने गलत की, इसे पकड़ने में सक्षम था, और किसी के पूछने पर इसने उन सभी को पकड़ लिया।
यही पूरा सबक है। जाँच को मॉडल के बाहर बैठना होगा और हर बार चलना होगा, न कि जब कुछ गड़बड़ लगे। यह ऑडिट किए जाने का विरोध नहीं करता। यह बस कभी स्वेच्छा से नहीं करता।
जो उस हर विश्लेषक के बारे में भी सच है जिसने कभी कोई नोट लिखा।
यदि आप इसे चलाना चाहते हैं
मॉडल अभी OpenRouter पर मुफ्त है और इस सप्ताह वेट ओपन हो जाएंगे। 262k कॉन्टेक्स्ट बिना विभाजित किए एक पूर्ण तिमाही फाइलिंग लेता है।
दो चीजें जो कोई नहीं बताता। यह एक अलग चैनल में सोचता है जो आपके टोकन बजट को खा जाता है, और एक-वाक्य का उत्तर वहाँ पहुँचने में 481 टोकन जला सकता है, इसलिए अपनी सीमा ऊँची रखें अन्यथा आपका आउटपुट खाली आता है। और OpenRouter आपके लिए टूल नहीं चलाएगा, इसलिए यदि आप लाइव रिट्रीवल चाहते हैं, तो आप स्वयं कॉल निष्पादित करें और परिणाम वापस दें।
उस लूप के बंद होने के साथ इसने 6 चरणों में 13 टूल कॉल चलाए, चार प्रथम-पक्ष प्रकटीकरण खींचे, जो तुलनीय नहीं थे उन्हें बाहर फेंक दिया, और उनके बीच के दिनों की गणना सही की।
शोध दीजिए। फैसला अपने पास रखिए।





