OpenAI B2B Marketplace において、Codex 内のネイティブ統合を含め、最初のオープンモデル推論プロバイダーの 1 つとして OpenAI と提携できることを大変嬉しく思います。OpenAI のエンタープライズ顧客は、既存の OpenAI コミットメントを活用して、Codex 内または Responses API を通じて Baseten が提供するオープンモデルを利用できるようになりました。企業にとってこれは、既存の OpenAI コミットメントを通じて、1 ドルあたりのインテリジェンスをさらに最大化できることを意味します。
私たちはこれまでマルチモデルの未来について発信してきましたが、今回の発表は、その未来がいかに早く現実のものとなっているかを示しています。現在、エージェント型コーディングは最も広く採用されている AI ユースケースであり、OpenAI の Codex や GPT モデルは、コード生成ワークフローをスケールさせるための最も人気のある選択肢の 2 つです。Baseten が支えるオープンモデルが OpenAI の顧客に提供されることで、組織はオープンモデルとクローズドモデルを横断してエージェント型ワークフローを最適化し、各タスクを最適なモデルにルーティングできるようになります。
エージェント型コーディングは、グローバル規模で実現する初のマルチモデルワークフロー
今日、AI をリードする企業は、インテリジェンス、コスト、レイテンシ、キャパシティにおけるパレートフロンティア上で、複数のモデルを組み合わせて使用する方向へと移行しています。
トップクラスのエンジニアリングチームは、静的または適応型のルーターを通じて、コスト、品質、パフォーマンスの最適なバランスを提供するモデルへタスクを積極的に振り分けています。そして、新しいオープンモデルやクローズドモデルが登場するサイクルが数週間単位まで短縮された今、あらゆるタスクにおいて常に最高のツールであり続けるモデルは存在しません。
競争優位を保つためには、自社のハーネスやゲートウェイ、その他のツール群にシームレスに統合できる、高速かつ信頼性の高い推論環境で、最新モデルに即座にアクセスできる体制が必要です。Baseten はまさにこの目的のために設計されており、各組織固有の環境にネイティブに統合される、高性能なインフラストラクチャプリミティブと開発者ツールを提供します。
コード生成におけるマルチモデルインテリジェンスをスケールさせる新機能
本番環境で 1 ドルあたりのインテリジェンスを最大化するには、モデルが常に期待通りに動作するスケールでの運用が不可欠です。マルチモデルシステムを技術的に機能させるには、パフォーマンス、信頼性、柔軟性が求められます。さらにエンタープライズ規模で展開するには、洗練された開発者体験、グローバルなガバナンス機能、そして最前線のエンジニアリングサポートが必要になります。
- フルスタックのパフォーマンス最適化: コード生成ワークロードは、推論レイヤーにおいて特に難易度が高くなります。複数ターンにわたるやり取り、大規模リポジトリに対する長いプロンプト、巨大なコンテキストウィンドウがスタック全体に負荷をかけるため、私たちのパフォーマンス最適化はツールからエンジンレベルに至るまで多岐にわたります。
- マルチクラウドのキャパシティと信頼性。 コード生成はエンジニアリング組織全体でバースト的に実行されるため、最初にボトルネックとなるのはキャパシティです。Baseten は 20 以上のクラウドにまたがる 90 以上のクラスターで稼働し、デプロイメントはアクティブ/アクティブ構成で動作するため、特定のプロバイダーやリージョンに障害が発生しても、処理が停止するのではなくトラフィックが再ルーティングされます。200 以上のコンピュートプロバイダーとの関係により、新しいキャパシティが利用可能になった際に真っ先に連絡が入るため、需要を先回りして供給を拡大できます。
- 初日からのモデルアクセス: 新しいオープンモデルがコーディングベンチマークで首位を獲得したとき、評価までに四半期も待つことは許されません。私たちは主要なオープンモデルを、リリース当日に Model APIs で提供開始します。最新のフロンティアモデルをリリース日に評価することは、たった 1 行のコードを更新するだけで完了します。
- 開発者(およびエージェント)体験: コーディングワークフローにおいて、推論だけでは不十分です。エージェントには自身が書いたコードを実行する場所が必要なため、Baseten の一部となった Blaxel サンドボックスでは、すべてのエージェントに専用のサンドボックスを提供しています。
- エンタープライズガバナンス: コードは基本的に機密性の高いものです。Baseten の推論は米国拠点のインフラストラクチャ上で実行され、すべてのプロンプトに対してデータ保持ゼロ(ZDR)を実現しています。より厳格なコンプライアンス要件にも対応できるよう、デプロイメントを特定のリージョンに固定したり、きめ細かい AuthN および AuthZ を実装したり、任意のモデル、ユーザー、キーごとの利用状況を確認したりすることが可能です。
- 応用研究と組み込み型エンジニアリングサポート: フォワードデプロイドエンジニアがお客様のレイテンシ目標に合わせてデプロイメントをチューニングし、応用研究者がお客様と共にポストトレーニングを実施します。LangChain が Baseten Loops を使用して LangSmith Engine 向けのカスタムモデルをトレーニングしているのは、まさにこの仕組みによるものです。
OpenAI との提携は、最高のマルチモデル・エージェント型コーディング体験を提供するための新たな一歩です。初日からオープンフロンティアモデルにアクセスでき、高速かつ信頼性の高い推論と、自社クラウドまたはお客様のクラウドでのキャパシティ保証を備え、AI 導入の加速と 1 ドルあたりのインテリジェンス価値の向上に必要なものを、これからも構築し続けます。
OpenAI コミットメントを通じて Codex 内でオープンモデルをネイティブに利用するには、リストに登録してください。その他のお問い合わせについては、ぜひエンジニアにご相談ください。





