Vous nous avez trouvés. Union Alpha — le modèle furtif sur OpenRouter, OpenCode et Cloudflare — est Pareto 26.9 de @TheUnbiasedCo. Il a fallu une journée à Internet pour lever le masque. Nous ne devons pas sous-estimer des adversaires comme @aitrackerbot.
Nous avons collaboré avec ces plateformes pour effectuer un lancement furtif car nous voulions voir ce que les utilisateurs réels en pensaient, apprendre ce qui posait problème à grande échelle, et intégrer ces retours dans notre lancement public prévu pour la version 26.10 le mois prochain. Nous ne conservons ni vos prompts ni vos sorties, et nous pensons que la rétention zéro de données devrait être la norme par défaut pour davantage de modèles.
Certains d'entre vous pensaient tester un seul nouveau modèle et ont été surpris lorsque d'autres ont indiqué qu'il s'agissait de plusieurs. C'est de notre faute. Ce n'est pas la faute de @OpenRouter, @OpenCode ou @Cloudflare. Ils ont travaillé avec nous pour exécuter une mise en liste furtive exactement comme les mises en liste furtives sont toujours gérées.
Pareto n'est pas un ensemble unique de poids. C'est un système : plusieurs modèles, ouverts et de pointe, travaillant sur la même tâche, avec un cadre qui vérifie le travail et fait appel à un modèle plus puissant lorsque la tâche l'exige. Il n'y a eu aucune session d'entraînement. Les versions précédentes de Pareto nous ont appris que les benchmarks peuvent être trompeurs. Notre bêta privée nous a appris à mesurer quels modèles sont exceptionnellement bons pour quelles tâches. Nous pensons que les routeurs du futur ressembleront et fonctionneront comme les modèles d'aujourd'hui. Une intelligence maximale quand la tâche l'exige, une intelligence moins coûteuse quand vous demandez comment brouiller des œufs.
En quelques heures mercredi, la demande a atteint des milliards de tokens par minute et le modèle était inutilisablement lent. Nous sommes une petite entreprise et nous n'avons pas lancé avec assez de puissance de calcul pour répondre à la demande. Si vous avez abandonné hier par frustration, nous comprenons. AWS nous a aidés à tripler la capacité pendant la nuit ! Il s'est avéré que cela ne suffisait toujours pas à soutenir l'intérêt.
Nous coordonnons avec les passerelles pour activer l'accès payant pour 26.9. Le prix est de 2,50 $ pour l'entrée, 0,25 $ pour le cache et 7,50 $ pour la sortie par million de tokens – soit moins d'un quart du prix catalogue d'Astra.
Nous croyons que des systèmes comme celui-ci sont la voie vers plus d'intelligence pour moins cher. C'est un nouveau domaine de recherche : de nombreux modèles travaillant comme un seul. À partir de maintenant, nous poursuivons cette approche en toute transparence : https://unbiased.ai/model-card/.
Utilisez 26.9. Dites-nous où il échoue. Nous sommes enthousiastes à l'idée de vous montrer ce qui vient ensuite.





