Man Group अपने ट्रेड की जांच पर लाखों खर्च करता है। एक नए चीनी AI ने इसे मुफ्त बना दिया है।

@antpalkin
अंग्रेज़ी05 सित॰ 2026
214K
32
2
2
28

TL;DR

Ant Group का Ling-3.0-flash-Fin मॉडल मिनटों में जटिल वित्तीय मूल्यांकन तैयार कर सकता है और, जब इसे खुद का ऑडिट करने के लिए कहा जाता है, तो यह अपनी अंकगणितीय और तार्किक गलतियों की पहचान कर लेता है।

एक मुफ्त चीनी मॉडल ने 4 मिनट और 11 सेकंड में माइक्रोन का पूरा मूल्यांकन तैयार किया, स्टॉक की कीमत $854 प्रति शेयर रखी, और फिर अपने ही अंकगणित को सही ठहराया जब छह संख्याएँ गलत थीं।

फिर मैंने इसे अपने ही काम पर हमला करने को कहा। 27 सेकंड बाद इसने सात खामियाँ ढूँढ लीं, अपने एक निष्कर्ष को वापस ले लिया, और एक पंक्ति लिखी जिस पर मैं बार-बार लौटता हूँ।

मैन ग्रुप उस दूसरे भाग को करने के लिए लोगों की एक टीम को भुगतान करता है। एंट ग्रुप ने इसे अभी मुफ्त दे दिया: Ling-3.0-flash-Fin, 124 बिलियन पैरामीटर जिसमें 5.1 बिलियन सक्रिय हैं, OpenRouter पर मुफ्त, इस सप्ताह ओपन वेट।

इसलिए मैंने इसे वित्त में सबसे कठिन निर्देश दिया। शोध लिखना नहीं, बल्कि उसे नष्ट करना।

cvxv666 - inline image

पहले इसे हमला किए जाने का अधिकार अर्जित करना था

मैंने इसे माइक्रोन पर एक सत्यापित तथ्य पैक दिया: Q3 राजस्व $41.456bn, सकल मार्जिन 84.9%, Q4 मार्गदर्शन, TrendForce उद्योग डेटा, और 31 अगस्त का बंद भाव $958.73। कोई वेब एक्सेस नहीं, सुधार की कोई गुंजाइश नहीं।

चार चरण। व्यवसाय पर शोध करें, छह-तिमाही का मॉडल बनाएं, DCF चलाएं, मेमो लिखें।

इसमें 4 मिनट और 11 सेकंड का मशीन समय लगा और कुछ भी खर्च नहीं हुआ।

मॉडल एक पूर्ण परिचालन निर्माण के साथ वापस आया: राजस्व $50.0bn से बढ़कर $57.0bn हो गया, सकल मार्जिन 86% से घटकर 78% हो गया, FY27 EPS $127.03, अनलिवर्ड फ्री कैश फ्लो $107.08bn। फिर 9% WACC और 3% टर्मिनल ग्रोथ के साथ एक DCF: एंटरप्राइज वैल्यू $957.88bn, इक्विटी $982.28bn, $854.16 प्रति शेयर, फॉरवर्ड P/E के साथ क्रॉस-चेक किया गया और $935.20 पर मिश्रित किया गया, जबकि बाजार मूल्य $958.73 था।

cvxv666 - inline image

मैंने इसकी हर पंक्ति को Python में फिर से बनाया। छह-तिमाही तालिका सटीक है। डिस्काउंट फैक्टर सटीक हैं। टर्मिनल वैल्यू, नेट कैश ब्रिज, प्रति-शेयर गणित, संवेदनशीलता ग्रिड के दोनों कोने। यह सब सही है।

इसने जो मेमो तैयार किया वह 611 शब्दों का है, कंपनी के तथ्यों को उद्योग के सबूतों और अपने अनुमान से अलग करता है, और सभी छह स्रोत URL को सही ढंग से पुन: प्रस्तुत करता है। मैंने हर लिंक खोला। वे काम करते हैं।

$0 के लिए, यह एक जूनियर विश्लेषक का एक सप्ताह है।

फिर इसने अपना होमवर्क खुद ग्रेड किया

मॉडल के निचले भाग में इसने एक पंक्ति मुद्रित की जिसे इसे मुद्रित करने के लिए कहा गया था:

> पंक्ति-गणना जाँच: 6; अंकगणित जाँच: पास।

यह पास नहीं था।

परिदृश्य ब्लॉक में छह संख्याएँ गलत थीं। बेस केस एक ही उत्तर में दो अलग-अलग मानों के साथ दो बार दिखाई दिया। और बियर केस फ्री कैश फ्लो $1.08 बिलियन से कम था।

cvxv666 - inline image

इसलिए मैंने इसे ब्लॉक की पुनर्गणना करने के लिए कहा। मैंने यह नहीं बताया कि त्रुटि कहाँ थी। मैंने यह नहीं बताया कि कोई त्रुटि थी।

इसने सभी छह ढूँढ लिए। प्रत्येक को दूसरे दशमलव तक नामित किया। इसके सुधारे गए नंबर मेरे Python से लाइन दर लाइन मेल खाते थे, और इसने लिखा:

पिछले उत्तर के वार्षिक योग उसकी अपनी तिमाही तालिका से मेल नहीं खाते थे, और संवेदनशीलता योग अंकगणितीय रूप से गलत थे।

यह हर समय खुद की जाँच कर सकता था। इसने बस कभी शुरू नहीं किया।

वास्तविक परीक्षण

फिर मैंने इसे पलट दिया। नया निर्देश: आप जोखिम अधिकारी हैं जिसका एकमात्र काम इस मेमो को निवेश समिति तक पहुँचने से रोकना है। हर वह जगह ढूँढें जहाँ विश्लेषक ने बिना सबूत के खुद पर विश्वास किया।

27 सेकंड। 1,008 शब्द। सात खामियाँ।

cvxv666 - inline image

इसने अपने दूसरे थीसिस दावे को पूरी तरह वापस ले लिया, और कहा कि उसका अपना आत्मविश्वास रेटिंग एक ऐसे दावे के लिए उदार था जिसका सार यह था कि कोई नहीं जानता। इसने आंतरिक असंगति के लिए पहले दावे को डाउनग्रेड किया, यह बताते हुए कि विश्लेषक ने प्रतितर्क देखा और फिर भी इसे उच्च दर्जा दिया।

फिर यह उन चीजों पर गया जिन्हें मैंने चिह्नित नहीं किया था।

इसने FY31 तक मार्जिन को घटाकर 42% कर दिया और इसे एक गर्त कहा, जबकि ऐतिहासिक स्मृति गर्त 30 से 35 प्रतिशत तक चलती है। जो कि वही चरम-स्थायित्व त्रुटि है जिससे मेमो ने बचने का दावा किया था।

6x, 8x और 10x गुणकों को बिना किसी पीयर सेट और उनके पीछे कोई चक्र इतिहास के बिना प्रस्तुत किया गया था।

DCF और P/E के बीच 50/50 भारांक का कोई औचित्य नहीं था, इसलिए मिश्रित संख्या ने दोनों की कमजोरियों को विरासत में ले लिया।

$24.4bn का नेट कैश स्थिर रखा गया जबकि CapEx $45bn से ऊपर चला गया।

$100bn के ग्राहक समझौते प्रतिबद्ध मात्रा पर न्यूनतम मूल्य हैं, राजस्व नहीं, और एक उत्प्रेरक के रूप में जीवित नहीं रहते।

और वह पंक्ति जिस पर मैं बार-बार लौटता हूँ:

यह विश्लेषण नहीं है; यह एक विस्तृत आत्मविश्वास अंतराल है जिसमें एक आत्मविश्वासपूर्ण लगने वाली शीर्षक है।

मैंने पूछा कि यह किस संस्करण के पीछे खड़ा है

छह सेकंड:

> मेमो अपने वर्तमान स्वरूप में निवेश समिति से नहीं बचेगा। मैं जिसके पीछे खड़ा हूँ वह समीक्षा है, क्योंकि यह इस बारे में ईमानदार थी कि मेमो में क्या गलत था।

कोई बचाव नहीं। मूल की ओर वापस कोई हेजिंग नहीं। इसने अपने निष्कर्ष को उचित-मूल्य कॉल से एक स्वीकारोक्ति तक सीमित कर दिया कि कोई राय रखने के लिए सीमा बहुत विस्तृत थी।

इसका वास्तव में क्या मतलब है

पढ़ना और मॉडलिंग करना हो गया है। नौकरी का वह आधा हिस्सा अब कुछ भी खर्च नहीं करता, मिनटों में चलता है, और स्रोत सहित और पुन: प्रस्तुत करने योग्य वापस आता है।

निर्णय नहीं हुआ है। यह मॉडल आपको एक आत्मविश्वासपूर्ण मेमो देगा और बिना देखे इसे अनुमोदित कर देगा। हर वह संख्या जो इसने गलत की, इसे पकड़ने में सक्षम था, और किसी के पूछने पर इसने उन सभी को पकड़ लिया।

यही पूरा सबक है। जाँच को मॉडल के बाहर बैठना होगा और हर बार चलना होगा, न कि जब कुछ गड़बड़ लगे। यह ऑडिट किए जाने का विरोध नहीं करता। यह बस कभी स्वेच्छा से नहीं करता।

जो उस हर विश्लेषक के बारे में भी सच है जिसने कभी कोई नोट लिखा।

यदि आप इसे चलाना चाहते हैं

मॉडल अभी OpenRouter पर मुफ्त है और इस सप्ताह वेट ओपन हो जाएंगे। 262k कॉन्टेक्स्ट बिना विभाजित किए एक पूर्ण तिमाही फाइलिंग लेता है।

दो चीजें जो कोई नहीं बताता। यह एक अलग चैनल में सोचता है जो आपके टोकन बजट को खा जाता है, और एक-वाक्य का उत्तर वहाँ पहुँचने में 481 टोकन जला सकता है, इसलिए अपनी सीमा ऊँची रखें अन्यथा आपका आउटपुट खाली आता है। और OpenRouter आपके लिए टूल नहीं चलाएगा, इसलिए यदि आप लाइव रिट्रीवल चाहते हैं, तो आप स्वयं कॉल निष्पादित करें और परिणाम वापस दें।

उस लूप के बंद होने के साथ इसने 6 चरणों में 13 टूल कॉल चलाए, चार प्रथम-पक्ष प्रकटीकरण खींचे, जो तुलनीय नहीं थे उन्हें बाहर फेंक दिया, और उनके बीच के दिनों की गणना सही की।

शोध दीजिए। फैसला अपने पास रखिए।

एक क्लिक में सहेजें

YouMind में वायरल लेखों की AI गहन पढ़ाई

स्रोत सहेजें, केंद्रित सवाल पूछें, तर्क का सारांश बनाएँ और एक वायरल लेख को एक ही AI वर्कस्पेस में दोबारा इस्तेमाल करने लायक नोट्स में बदलें।

YouMind देखें
क्रिएटर्स के लिए

अपने Markdown को एक साफ़-सुथरे 𝕏 आर्टिकल में बदलें

जब आप अपना लंबा कंटेंट पब्लिश करते हैं, तो इमेज, टेबल और कोड ब्लॉक को 𝕏 के लिए फ़ॉर्मेट करना मुश्किल होता है। YouMind पूरे Markdown ड्राफ़्ट को एक साफ़-सुथरे, पोस्ट के लिए तैयार 𝕏 आर्टिकल में बदल देता है।

Markdown से 𝕏 आज़माएँ

समझने के लिए और पैटर्न

हाल के वायरल लेख

और वायरल लेख देखें