Você nos encontrou. A Union Alpha — o modelo furtivo no OpenRouter, OpenCode e Cloudflare — é a Pareto 26.9 da @TheUnbiasedCo. A internet levou apenas um dia para desmascarar. Não devemos subestimar adversários como @aitrackerbot.
Fizemos uma parceria com essas plataformas para realizar um lançamento furtivo porque queríamos ver o que os usuários reais pensavam sobre ele, aprender o que se tornava complicado na escala e incorporar esse aprendizado ao nosso planejado lançamento público da versão 26.10 no próximo mês. Não guardamos seus prompts ou saídas, e acreditamos que a retenção zero de dados deveria ser o padrão para mais modelos.
Alguns de vocês acharam que estavam testando um novo modelo único e ficaram surpresos quando outros disseram que eram vários. A culpa foi nossa. Não é do @OpenRouter, do @OpenCode ou da @Cloudflare. Eles trabalharam conosco para executar uma listagem furtiva da maneira como as listagens furtivas são sempre executadas.
A Pareto não é um conjunto único de pesos. É um sistema: vários modelos, abertos e de fronteira, trabalhando na mesma tarefa, com uma estrutura que verifica o trabalho e chama um modelo mais forte quando a tarefa exige. Não houve treinamento. Versões anteriores da Pareto nos ensinaram que benchmarks podem enganar. Nossa beta privada nos ensinou a medir quais modelos são excepcionalmente bons em quais tarefas. Achamos que os roteadores do futuro parecerão e funcionarão como os modelos parecem hoje. Máxima inteligência quando a tarefa exigir, inteligência mais barata quando você estiver perguntando como fazer ovos mexidos.
Em poucas horas na quarta-feira, a demanda atingiu bilhões de tokens por minuto e o modelo ficou inutilizavelmente lento. Somos uma empresa pequena e não lançamos com capacidade computacional suficiente para atender ao momento. Se você desistiu ontem por frustração, entendemos. A AWS nos ajudou a triplicar a capacidade durante a noite! Acontece que ainda não foi suficiente para suportar o interesse.
Estamos coordenando com os gateways para habilitar acesso pago para a 26.9. O preço é $2,50 por entrada, $0,25 por cache e $7,50 por saída por milhão de tokens – menos de um quarto do preço de tabela da Astra.
Acreditamos que sistemas como este são o caminho para mais inteligência por menos. É um novo campo de pesquisa: muitos modelos trabalhando como um só. Daqui para frente, perseguiremos isso abertamente: https://unbiased.ai/model-card/.
Use a 26.9. Conte-nos onde ela falha. Estamos animados para mostrar o que vem a seguir.





