YouMind
Se connecter

Annonce de notre partenariat avec OpenAI

@baseten
ANGLAIS29 sept. 2026
299K
465
44
16
233

TL;DR

Baseten annonce un partenariat avec OpenAI pour proposer des modèles open-weight via la marketplace B2B d'OpenAI et une intégration native à Codex, permettant aux entreprises de tirer parti de leurs engagements existants pour des workflows de codage agentique multi-modèles.

Nous sommes ravis de nous associer à OpenAI en tant que l'un des premiers fournisseurs d'inférence de modèles ouverts sur l'OpenAI B2B Marketplace, avec notamment une intégration native au sein de Codex. Les clients entreprise d'OpenAI peuvent désormais utiliser leurs engagements OpenAI existants pour les modèles ouverts servis par Baseten dans Codex ou via l'API Responses. Pour les entreprises, cela signifie encore plus d'intelligence par dollar investi grâce à votre engagement OpenAI actuel.

Nous avons déjà évoqué l'avenir multi-modèles, et cette annonce montre à quelle vitesse cet avenir devient notre présent. Le codage agentique est aujourd'hui le cas d'usage de l'IA le plus largement adopté, et les modèles Codex et GPT d'OpenAI figurent parmi les choix les plus prisés pour faire monter en puissance les workflows de génération de code. Avec les modèles ouverts propulsés par Baseten désormais accessibles aux clients d'OpenAI, les organisations peuvent optimiser leurs workflows agentiques entre modèles ouverts et fermés, et router chaque tâche vers le modèle le plus adapté.

Le codage agentique, premier workflow multi-modèles à l'échelle mondiale

Aujourd'hui, les entreprises leaders en IA passent à une combinaison de modèles situés sur les frontières de Pareto, afin d'optimiser l'intelligence, le coût, la latence et la capacité.

Les meilleures équipes d'ingénierie orientent activement leurs tâches, via des routeurs statiques ou adaptatifs, vers le modèle offrant le meilleur compromis entre coût, qualité et performance pour chaque mission. Et alors que le cycle de renouvellement des modèles ouverts et fermés se compte désormais en semaines, aucun modèle ne reste longtemps l'outil idéal pour toutes les tâches.

Pour garder une longueur d'avance, les entreprises ont besoin d'un accès instantané aux derniers modèles, avec une inférence rapide et fiable qui s'intègre parfaitement à leurs harnais de test, passerelles et autres outils. Baseten a été conçu précisément pour cela : fournir des primitives d'infrastructure hautes performances et des outils de développement qui s'intègrent nativement à l'environnement technique propre à chaque organisation.

De nouvelles capacités pour faire monter en puissance l'intelligence multi-modèles dans la génération de code

En production, le meilleur rapport intelligence/dollar ne fonctionne à grande échelle que si les modèles offrent des performances constantes et conformes aux attentes. Performance, fiabilité et flexibilité sont indispensables pour qu'un système multi-modèles soit techniquement viable. Mais pour le déployer à l'échelle d'une entreprise, il faut y ajouter une expérience développeur fluide, des capacités de gouvernance mondiales et un support d'ingénierie de première ligne.

  • Optimisation des performances full-stack : les charges de travail liées à la génération de code sont particulièrement exigeantes au niveau de la couche d'inférence. Les échanges multi-tours, les prompts longs sur de vastes dépôts et les immenses fenêtres de contexte sollicitent chaque maillon de la chaîne. Notre travail d'optimisation couvre donc tout l'écosystème, des outils jusqu'au moteur d'inférence.
  • Capacité et fiabilité multi-cloud. La génération de code fonctionne par pics à l'échelle de toute l'organisation d'ingénierie, et la capacité est la première contrainte à se faire sentir. Baseten s'exécute sur plus de 90 clusters répartis sur plus de 20 clouds, avec des déploiements en actif-actif : la perte d'un fournisseur ou d'une région entraîne un reroutage du trafic plutôt qu'un arrêt des travaux. Nos relations avec plus de 200 fournisseurs de calcul font de nous les premiers informés lorsque de nouvelles capacités sont mises en ligne, ce qui permet à l'offre de devancer la demande.
  • Accès aux modèles dès le jour zéro : lorsqu'un nouveau modèle ouvert domine les benchmarks de code, attendre un trimestre pour l'évaluer n'est tout simplement pas envisageable. Nous lançons les principaux modèles ouverts sur Model APIs le jour même de leur sortie. Évaluer le dernier modèle frontier dès sa publication est aussi simple que de modifier une seule ligne de code.
  • Expérience développeur (et agent) : l'inférence seule ne suffit pas pour les workflows de codage. Les agents ont besoin d'un endroit où exécuter le code qu'ils écrivent. C'est pourquoi les sandboxes Blaxel, qui font désormais partie de Baseten, offrent à chaque agent son propre environnement isolé.
  • Gouvernance d'entreprise : le code est sensible par nature. L'inférence de Baseten s'exécute sur une infrastructure basée aux États-Unis, avec une rétention des données nulle (ZDR) pour tous les prompts. Pour des exigences de conformité encore plus strictes, vous pouvez ancrer vos déploiements dans des régions spécifiques, mettre en place une authentification (AuthN) et une autorisation (AuthZ) granulaires, et suivre l'utilisation par modèle, utilisateur ou clé.
  • Recherche appliquée et support d'ingénierie embarqué : nos ingénieurs déployés chez les clients ajustent les déploiements selon vos objectifs de latence, et nos chercheurs appliqués réalisent le post-training à vos côtés. C'est ainsi que LangChain entraîne des modèles personnalisés pour LangSmith Engine avec Baseten Loops.

Notre partenariat avec OpenAI constitue une nouvelle étape vers la meilleure expérience de codage agentique multi-modèles. Grâce à l'accès aux modèles ouverts frontier dès le jour zéro, à une inférence rapide et fiable, et à une capacité garantie sur notre cloud ou le vôtre, nous continuerons à développer tout ce dont vous avez besoin pour accélérer l'adoption de l'IA et maximiser la valeur de chaque dollar investi dans l'intelligence artificielle.

Pour accéder nativement aux modèles ouverts dans Codex via votre engagement OpenAI, inscrivez-vous sur la liste d'attente. Pour toute autre demande, discutez avec un ingénieur.

Enregistrer en un clic

Lire les articles viraux en profondeur avec l’IA de YouMind

Enregistrez la source, posez des questions ciblées, résumez l’argument et transformez un article viral en notes réutilisables dans un seul espace de travail IA.

Découvrir YouMind
Pour les créateurs

Transformez votre Markdown en un article 𝕏 impeccable

Quand vous publiez vos propres textes longs, la mise en forme 𝕏 des images, tableaux et blocs de code est pénible. YouMind transforme un brouillon Markdown complet en un article 𝕏 impeccable, prêt à publier.

Essayer Markdown vers 𝕏

D'autres patterns à décoder

Articles viraux récents

Explorer plus d'articles viraux