YouMind
Iniciar sessão

Anunciando nossa parceria com a OpenAI

@baseten
INGLÊS29/09/2026
299K
465
44
16
233

TL;DR

A Baseten anuncia uma parceria com a OpenAI para servir modelos open-weight via o Marketplace B2B da OpenAI e integração nativa com o Codex, permitindo que as empresas aproveitem seus compromissos existentes para fluxos de trabalho de codificação agêntica multi-modelo.

Estamos muito animados com a parceria com a OpenAI como um dos primeiros provedores de inferência de modelos abertos no OpenAI B2B Marketplace, incluindo uma integração nativa dentro do Codex. Os clientes corporativos da OpenAI agora podem usar seus compromissos existentes com a OpenAI para acessar modelos abertos servidos pela Baseten dentro do Codex ou por meio da Responses API. Para as empresas, isso significa entregar ainda mais inteligência por dólar investido, aproveitando o compromisso que você já tem com a OpenAI.

Já falamos aqui sobre o futuro multimodelo, e este anúncio mostra a velocidade com que esse futuro está se tornando o presente. A programação agêntica é hoje o caso de uso de IA mais adotado, e os modelos Codex e GPT da OpenAI estão entre as escolhas mais populares para escalar fluxos de trabalho de geração de código. Com os modelos abertos rodando na Baseten agora disponíveis para os clientes da OpenAI, as organizações podem otimizar fluxos de trabalho agênticos entre modelos abertos e fechados, direcionando cada tarefa para o modelo mais adequado.

A programação agêntica é o primeiro fluxo de trabalho multimodelo em escala global

Hoje, as empresas que lideram em IA estão migrando para o uso de uma combinação de modelos nas fronteiras de Pareto, equilibrando inteligência, custo, latência e capacidade.

As melhores equipes de engenharia estão direcionando ativamente as tarefas — por meio de roteadores estáticos ou adaptativos — para o modelo que oferece a melhor combinação de custo, qualidade e desempenho para cada trabalho. E com o ciclo de lançamento de novos modelos abertos e fechados caindo para semanas, nenhum modelo permanece como a melhor ferramenta para tudo por muito tempo.

Para sair na frente, as empresas precisam de acesso instantâneo aos modelos mais recentes, com uma inferência rápida e confiável que se integre perfeitamente às suas estruturas, gateways e outras ferramentas. A Baseten foi projetada exatamente para isso, oferecendo primitivos de infraestrutura de alto desempenho e ferramentas para desenvolvedores que se integram nativamente ao ambiente exclusivo de cada organização.

Novas capacidades para escalar a inteligência multimodelo na geração de código

O melhor custo-benefício em inteligência na produção só funciona em escala quando os modelos entregam consistentemente o que prometem. Você precisa de desempenho, confiabilidade e flexibilidade para fazer um sistema multimodelo funcionar tecnicamente. Mas, para escalar dentro de uma empresa, é preciso somar a isso uma experiência de desenvolvimento fluida, recursos de governança global e suporte de engenharia de linha de frente.

  • Otimização de desempenho full-stack: As cargas de trabalho de geração de código são especialmente desafiadoras na camada de inferência. Múltiplas interações, prompts longos sobre repositórios extensos e janelas de contexto gigantescas sobrecarregam todas as partes da pilha. Por isso, nosso trabalho de performance abrange tudo, desde as ferramentas até o nível do motor.
  • Capacidade e confiabilidade multicloud. A geração de código acontece em picos por toda a organização de engenharia, e a capacidade é o gargalo que aperta primeiro. A Baseten roda em mais de 90 clusters distribuídos por mais de 20 nuvens, com implantações em formato ativo-ativo. Assim, se um provedor ou região cair, o tráfego é redirecionado em vez de o trabalho parar. Nossos relacionamentos com mais de 200 provedores de computação fazem de nós a primeira opção quando novas capacidades entram no ar, garantindo que a oferta cresça antes da demanda.
  • Acesso a modelos no dia zero: Quando um novo modelo aberto lidera os benchmarks de programação, esperar um trimestre para avaliá-lo simplesmente não é aceitável. Lançamos os principais modelos abertos nas Model APIs no mesmo dia em que chegam ao mercado. Avaliar o modelo de fronteira mais recente no dia do lançamento é tão simples quanto atualizar uma única linha de código.
  • Experiência para desenvolvedores (e agentes): Só a inferência não basta para fluxos de trabalho de programação. Os agentes precisam de um lugar para executar o código que escrevem. É por isso que os sandboxes Blaxel, agora parte da Baseten, oferecem um sandbox próprio para cada agente.
  • Governança corporativa: Código é sensível por natureza. Por isso, a inferência da Baseten roda em infraestrutura nos EUA com retenção zero de dados (ZDR) para todos os prompts. Para exigências de conformidade ainda mais rigorosas, você pode fixar implantações em regiões específicas, implementar AuthN e AuthZ granulares e monitorar o uso por modelo, usuário ou chave.
  • Pesquisa aplicada e suporte de engenharia incorporado: Nossos engenheiros alocados no cliente ajustam as implantações para atingir suas metas de latência, e nossos pesquisadores aplicados conduzem o pós-treinamento junto com você. Foi assim que a LangChain treinou modelos personalizados para o LangSmith Engine com o Baseten Loops.

Nossa parceria com a OpenAI é mais um passo rumo à melhor experiência multimodelo para programação agêntica. Com acesso a modelos abertos de fronteira no dia zero, inferência rápida e confiável, e capacidade garantida na nossa nuvem ou na sua, vamos continuar construindo o que você precisa para acelerar a adoção de IA e extrair mais valor em inteligência por cada dólar investido.

Para acessar modelos abertos nativamente no Codex usando seu compromisso com a OpenAI, entre na lista. Para todo o resto, fale com um engenheiro.

Guardar com um clique

Faça leitura aprofundada de artigos virais com IA no YouMind

Guarde a fonte, faça perguntas específicas, resuma o argumento e transforme um artigo viral em notas reutilizáveis num único espaço de trabalho com IA.

Explorar o YouMind
Para criadores

Transforme o seu Markdown num artigo 𝕏 impecável

Quando publica os seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown num artigo 𝕏 impecável e pronto a publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais