Ci avete trovato. Union Alpha — il modello stealth su OpenRouter, OpenCode e Cloudflare — è Pareto 26.9 di @TheUnbiasedCo. Internet ha impiegato un giorno per smascherarlo. Non dovremmo sottovalutare avversari come @aitrackerbot.
Abbiamo collaborato con queste piattaforme per un lancio stealth perché volevamo vedere cosa ne pensassero gli utenti reali, capire quali fossero le difficoltà legate alla scalabilità e integrare questi apprendimenti nel nostro prossimo lancio pubblico della versione 26.10 previsto per il mese prossimo. Non conserviamo i tuoi prompt né le tue output, e riteniamo che la zero data retention dovrebbe essere l'impostazione predefinita per più modelli.
Alcuni di voi pensavano di testare un nuovo modello e sono rimasti sorpresi quando altri hanno detto che erano più di uno. La colpa è nostra. Non è colpa di @OpenRouter, @OpenCode o @Cloudflare. Hanno lavorato con noi per gestire una lista stealth esattamente come vengono gestite tutte le liste stealth.
Pareto non è un singolo set di pesi. È un sistema: diversi modelli, aperti e frontier, che lavorano sullo stesso compito, supportati da un framework che verifica il lavoro e coinvolge un modello più potente quando il task lo richiede. Non c'è stata alcuna fase di addestramento (training run). Le versioni precedenti di Pareto ci hanno insegnato che i benchmark possono trarre in inganno. La nostra beta privata ci ha insegnato a misurare quali modelli siano eccezionalmente bravi in quali compiti. Pensiamo che i router del futuro assomiglieranno e funzioneranno come i modelli attuali. Massima intelligenza quando il task lo richiede, intelligenza più economica quando chiedi come fare delle uova strapazzate.
Entro poche ore da mercoledì, la domanda ha raggiunto miliardi di token al minuto e il modello è diventato inutilizzabile per lentezza. Siamo una piccola azienda e non abbiamo lanciato con abbastanza capacità di calcolo per soddisfare la richiesta. Se ieri hai desistito per frustrazione, ti capiamo. AWS ci ha aiutato a triplicare la capacità durante la notte! Si è scoperto che comunque non bastava per sostenere l'interesse.
Stiamo coordinandoci con i gateway per abilitare l'accesso a pagamento per la 26.9. Il prezzo è di $2,50 per input, $0,25 per cache e $7,50 per output ogni milione di token – meno di un quarto del prezzo di listino di Astra.
Crediamo che sistemi come questo siano la strada verso più intelligenza a costi inferiori. È un nuovo campo di ricerca: molti modelli che lavorano come uno solo. Da qui in avanti, lo perseguiremo apertamente: https://unbiased.ai/model-card/.
Usa la 26.9. Dicci dove fallisce. Siamo entusiasti di mostrarti cosa verrà dopo.





