You found us. Union Alpha — OpenRouter, OpenCode, और Cloudflare पर मौजूद stealth model — असल में Pareto 26.9 है, जिसे @TheUnbiasedCo ने लॉन्च किया था। इंटरनेट को इसका पता लगाने में सिर्फ एक दिन लगा। हमें @aitrackerbot जैसे प्रतिद्वंद्वियों को कम आंकना नहीं चाहिए।
हमने इन प्लेटफॉर्म के साथ साझेदारी करके एक stealth launch इसलिए किया क्योंकि हम जानना चाहते थे कि वास्तविक उपयोगकर्ता इसके बारे में क्या सोचते हैं, स्केलिंग के दौरान कौन सी चुनौतियां सामने आती हैं, और उस जानकारी को अगले महीने होने वाले अपने नियोजित public launch (26.10) में शामिल करना चाहते थे। हम आपके prompts या outputs को स्टोर नहीं करते हैं, और हमारा मानना है कि अधिक से अधिक models के लिए zero data retention को default होना चाहिए।
कुछ लोगों को लगा कि वे एक नए model का परीक्षण कर रहे हैं, लेकिन जब दूसरों ने कहा कि यह कई models हैं, तो उन्हें हैरानी हुई। यह पूरी तरह हमारी गलती थी। यह @OpenRouter, @OpenCode, या @Cloudflare की गलती नहीं थी। उन्होंने हमारे साथ मिलकर एक stealth listing को वैसे ही चलाया जैसा कि stealth listings हमेशा चलाई जाती हैं।
Pareto कोई single set of weights नहीं है। यह एक system है: कई models, open और frontier दोनों, एक ही task पर काम करते हैं, और एक harness होता है जो काम की जांच करता है और जब task को बेहतर शक्ति की जरूरत होती है, तो वह एक stronger model को बुलाता है। यहाँ कोई training run नहीं हुआ था। Pareto के पिछले संस्करणों ने हमें सिखाया कि benchmarks भ्रामक हो सकते हैं। हमारे private beta ने हमें सिखाया कि किस model में किस task के लिए असाधारण क्षमता है। हमारा मानना है कि भविष्य के routers आज के models जैसे ही दिखेंगे और महसूस होंगे। जब task को अधिकतम intelligence की जरूरत हो तो वह देगा, और जब आप बस यह पूछ रहे हों कि अंडा कैसे फेंटें, तो वह सस्ती intelligence देगा।
बुधवार को कुछ ही घंटों में, मांग billions of tokens per minute तक पहुंच गई और model इतना धीमा हो गया कि उसे इस्तेमाल करना मुश्किल हो गया। हम एक छोटी company हैं, और हमने उस मांग को पूरा करने के लिए पर्याप्त compute के साथ launch नहीं किया था। यदि आपने कल निराशा में इसे छोड़ दिया था, तो हम समझ सकते हैं। AWS ने रातों-रात हमारी capacity तीन गुना बढ़ा दी! हालाँकि, पता चला कि यह भी इस रुचि को संभालने के लिए पर्याप्त नहीं था।
हम gateways के साथ तालमेल बिठा रहे हैं ताकि 26.9 के लिए paid access उपलब्ध कराया जा सके। Pricing है: input के लिए $2.50, cache के लिए $0.25, और output के लिए $7.50 per million tokens – जो Astra की list price का एक चौथाई से भी कम है।
हमारा मानना है कि इस तरह के systems कम लागत में अधिक intelligence हासिल करने का रास्ता हैं। यह एक नया research field है: कई models एक साथ काम कर रहे हैं। अब से, हम इसे खुले तौर पर pursue करेंगे: https://unbiased.ai/model-card/।
26.9 का उपयोग करें। हमें बताएं कि यह कहाँ fail होता है। हम आपको दिखाएंगे कि आगे क्या आ रहा है, इसके लिए हम उत्साहित हैं।





