Ihr habt uns gefunden. Union Alpha – das Stealth-Modell auf OpenRouter, OpenCode und Cloudflare – ist Pareto 26.9 von @TheUnbiasedCo. Das Internet brauchte einen Tag, um die Maske abzunehmen. Wir sollten Gegner wie @aitrackerbot nicht unterschätzen.
Wir haben mit diesen Plattformen zusammengearbeitet, um einen Stealth-Launch durchzuführen, weil wir sehen wollten, was echte Nutzer davon halten, lernen wollten, wo es bei der Skalierung hakt, und diese Erkenntnisse in unseren geplanten öffentlichen Launch von 26.10 im nächsten Monat einfließen lassen wollten. Wir speichern weder eure Prompts noch die Ausgaben, und wir sind der Meinung, dass Zero Data Retention (keine Datenspeicherung) für mehr Modelle der Standard sein sollte.
Einige von euch dachten, sie testen ein neues Modell, und waren überrascht, als andere sagten, es seien mehrere. Das liegt an uns. Es liegt nicht an @OpenRouter, @OpenCode oder @Cloudflare. Sie haben mit uns zusammengearbeitet, um eine Stealth-Listung so zu betreiben, wie Stealth-Listungen immer betrieben werden.
Pareto ist kein einzelner Satz von Gewichten. Es ist ein System: mehrere Modelle, offene und Frontier-Modelle, die an derselben Aufgabe arbeiten, mit einem Harness, der die Arbeit überprüft und ein stärkeres Modell hinzuzieht, wenn die Aufgabe dies erfordert. Es gab keinen Trainingslauf. Frühere Versionen von Pareto haben uns gezeigt, dass Benchmarks irreführend sein können. Unsere private Beta hat uns gelehrt, zu messen, welche Modelle bei welchen Aufgaben außergewöhnlich gut sind. Wir glauben, dass die Router der Zukunft aussehen und sich anfühlen werden wie die Modelle von heute. Maximale Intelligenz, wenn die Aufgabe sie braucht, günstigere Intelligenz, wenn du fragst, wie man Rührei macht.
Innerhalb weniger Stunden am Mittwoch erreichte die Nachfrage Milliarden von Tokens pro Minute und das Modell war unbrauchbar langsam. Wir sind ein kleines Unternehmen und haben nicht mit genug Rechenleistung gestartet, um dem Moment gerecht zu werden. Wenn ihr gestern aus Frustration aufgegeben habt, verstehen wir das. AWS hat uns geholfen, die Kapazität über Nacht zu verdreifachen! Es stellte sich heraus, dass das immer noch nicht ausreichte, um das Interesse zu decken.
Wir koordinieren uns mit den Gateways, um bezahlten Zugang für 26.9 zu ermöglichen. Die Preise liegen bei $2,50 für Input, $0,25 Cache und $7,50/Output pro Million Tokens – weniger als ein Viertel des Listenpreises von Astra.
Wir glauben, dass Systeme wie dieser Weg zu mehr Intelligenz für weniger Kosten sind. Es ist ein neues Forschungsfeld: viele Modelle, die als eines arbeiten. Von hier an verfolgen wir dies offen: https://unbiased.ai/model-card/.
Nutzt 26.9. Sagt uns, wo es versagt. Wir freuen uns darauf, euch zu zeigen, was als Nächstes kommt.





