YouMind
Entrar

Anunciando nossa parceria com a OpenAI

@baseten
INGLÊS29 de set. de 2026
299K
465
44
16
233

TL;DR

A Baseten anuncia uma parceria com a OpenAI para servir modelos de pesos abertos via OpenAI B2B Marketplace e integração nativa com o Codex, permitindo que empresas aproveitem compromissos existentes para fluxos de trabalho de codificação agêntica multi-modelo.

Estamos animados em fazer uma parceria com a OpenAI como um dos primeiros provedores de inferência de modelos abertos no OpenAI B2B Marketplace, incluindo uma integração nativa dentro do Codex. Os clientes corporativos da OpenAI agora podem usar seus compromissos existentes com a OpenAI para acessar modelos abertos fornecidos pela Baseten dentro do Codex ou por meio da Responses API. Para as empresas, isso significa entregar ainda mais inteligência por dólar investido usando o compromisso que você já tem com a OpenAI.

Já escrevemos sobre o futuro multimodelo, e este anúncio mostra a velocidade com que esse futuro está se tornando o presente. A programação agêntica é hoje o caso de uso de IA mais adotado, e os modelos Codex e GPT da OpenAI estão entre as opções mais populares para escalar fluxos de trabalho de geração de código. Com os modelos abertos impulsionados pela Baseten agora disponíveis para os clientes da OpenAI, as organizações podem otimizar fluxos de trabalho agênticos entre modelos abertos e fechados, direcionando cada tarefa para o modelo mais adequado.

A programação agêntica é o primeiro fluxo de trabalho multimodelo em escala global

Hoje, as empresas líderes em IA estão migrando para o uso de uma combinação de modelos nas fronteiras de Pareto, equilibrando inteligência, custo, latência e capacidade.

As melhores equipes de engenharia estão direcionando ativamente as tarefas, por meio de roteadores estáticos ou adaptativos, para o modelo que oferece a melhor combinação de custo, qualidade e desempenho para cada trabalho. E com o ciclo entre novos modelos abertos e fechados reduzido a semanas, nenhum modelo continua sendo a melhor ferramenta para todas as tarefas por muito tempo.

Para sair na frente, as empresas precisam de acesso instantâneo aos modelos mais recentes, com uma inferência rápida e confiável que se integre perfeitamente às suas estruturas, gateways e outras ferramentas. A Baseten foi projetada exatamente para isso, oferecendo primitivos de infraestrutura de alto desempenho e ferramentas de desenvolvedor que se integram nativamente ao ambiente exclusivo de cada organização.

Novas capacidades para escalar a inteligência multimodelo na geração de código

A melhor relação entre inteligência e custo em produção só funciona em escala quando os modelos entregam consistentemente o resultado esperado. Você precisa de desempenho, confiabilidade e flexibilidade para tornar um sistema multimodelo tecnicamente funcional. Para escalar dentro de uma empresa, é preciso somar a isso uma experiência de desenvolvimento simplificada, recursos globais de governança e suporte de engenharia de linha de frente.

  • Otimização de desempenho full-stack: As cargas de trabalho de geração de código são especialmente desafiadoras na camada de inferência. Múltiplas interações, prompts longos em repositórios grandes e janelas de contexto enormes sobrecarregam todas as partes da pilha, por isso nosso trabalho de desempenho abrange tudo, desde as ferramentas até o nível do motor.
  • Capacidade e confiabilidade multicloud. A geração de código acontece em picos por toda a organização de engenharia, e a capacidade é a primeira restrição a apertar. A Baseten opera em mais de 90 clusters distribuídos por mais de 20 nuvens, com implantações em modo ativo-ativo. Assim, se um provedor ou região cair, o tráfego é redirecionado em vez de o trabalho parar. Nossos relacionamentos com mais de 200 provedores de computação fazem de nós a primeira opção quando uma nova capacidade entra no ar, garantindo que a oferta cresça antes da demanda.
  • Acesso a modelos no dia zero: Quando um novo modelo aberto lidera os benchmarks de programação, não dá para esperar um trimestre inteiro para avaliá-lo. Lançamos os principais modelos abertos nas Model APIs no mesmo dia em que são disponibilizados. Avaliar o modelo de fronteira mais recente no dia do lançamento é tão simples quanto atualizar uma única linha de código.
  • Experiência do desenvolvedor (e do agente): Apenas a inferência não basta para fluxos de trabalho de programação. Os agentes precisam de um lugar para executar o código que escrevem, e é por isso que os sandboxes Blaxel, agora parte da Baseten, oferecem um sandbox próprio para cada agente.
  • Governança corporativa: Código é sensível por natureza, e a inferência da Baseten roda em infraestrutura nos EUA com retenção zero de dados (ZDR) para todos os prompts. Para exigências de conformidade ainda maiores, você pode fixar implantações em regiões específicas, implementar AuthN e AuthZ granulares e visualizar o uso por modelo, usuário ou chave.
  • Pesquisa aplicada e suporte de engenharia incorporado: Engenheiros alocados no cliente ajustam as implantações para atingir suas metas de latência, e pesquisadores aplicados conduzem o pós-treinamento junto com você. Foi assim que a LangChain treinou modelos personalizados para o LangSmith Engine com o Baseten Loops.

Nossa parceria com a OpenAI é mais um passo rumo à melhor experiência de programação agêntica multimodelo. Com acesso a modelos abertos de fronteira no dia zero, inferência rápida e confiável e capacidade garantida na nossa nuvem ou na sua, continuaremos construindo o que você precisa para acelerar a adoção de IA e aumentar o valor da inteligência por dólar investido.

Para acessar modelos abertos nativamente no Codex usando seu compromisso com a OpenAI, entre na lista. Para todo o resto, fale com um engenheiro.

Salvar com um clique

Faça leitura profunda de artigos virais com IA no YouMind

Salve a fonte, faça perguntas específicas, resuma o argumento e transforme um artigo viral em notas reutilizáveis em um único espaço de trabalho com IA.

Explorar o YouMind
Para criadores

Transforme seu Markdown em um artigo 𝕏 impecável

Quando você publica seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown em um artigo 𝕏 impecável e pronto para publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais