我們很高興能與 OpenAI 合作,成為 OpenAI B2B Marketplace 中首批開放模型推論服務供應商之一,並在 Codex 內提供原生整合。OpenAI 的企業客戶現在可以使用既有的 OpenAI 承諾用量,在 Codex 中或透過 Responses API 呼叫由 Baseten 提供的開放模型。對企業而言,這代表你能透過現有的 OpenAI 承諾用量,讓每一分錢換來更強大的智慧能力。
我們曾撰文探討過多模型的未來,而這次發布正說明了這個未來有多快變成了現在。Agentic coding(代理式程式開發)是目前普及度最高的 AI 應用場景,而 OpenAI 的 Codex 與 GPT 模型則是擴展程式碼生成工作流程時最受歡迎的兩大選擇。隨著由 Baseten 驅動的開放模型正式向 OpenAI 客戶開放,企業可以在開放與封閉模型之間最佳化 Agent 工作流程,並將每項任務路由到最適合的模型。
Agentic coding 是全球首個大規模落地的多模型工作流程
如今,在 AI 領域領先的公司正轉向混合使用多種模型,在智慧程度、成本、延遲與容量之間取得 帕雷托最前緣 的最佳平衡。
頂尖的工程團隊正積極透過靜態或自適應路由器,將任務導向能在成本、品質與效能上提供最佳組合的模型。而當新開放模型與封閉模型的迭代週期縮短到以「週」計算時,沒有任何模型能長期稱霸所有任務。
要保持領先,企業需要能即時存取最新模型,並搭配快速、穩定的推論服務,且能無縫整合至現有的測試框架、閘道器與其他工具。Baseten 正是為此而生,提供高效能的基礎架構元件與開發者工具,原生整合進每家企業獨有的技術環境中。
全新能力,為程式碼生成擴展多模型智慧
在生產環境中,只有當模型表現始終符合預期時,「每一分錢換來最多智慧」才能真正大規模實現。要讓多模型系統在技術上跑得動,你需要效能、穩定性與彈性;而要在企業內部大規模推行,你還需要流暢的開發者體驗、全球治理能力以及第一線工程支援。
- 全端效能最佳化: 程式碼生成工作負載在推論層特別具挑戰性。多輪對話、橫跨大型程式庫的長提示詞,以及龐大的上下文窗口,會考驗堆疊中的每一個環節,因此我們的效能優化涵蓋了從工具到引擎層的所有面向。
- 多雲容量與穩定性。 程式碼生成會在整個工程組織中以突發方式執行,而容量往往是最先卡住的瓶頸。Baseten 運行於橫跨 20 多個雲端平台的 90 多個叢集上,部署採用雙主動(active-active)架構,因此即使某個供應商或區域出問題,流量也會自動重新路由,而不是讓工作中斷。我們與 200 多家運算供應商的合作關係,讓我們在新容量上線時總是第一個被通知,確保供給永遠走在需求前面。
- Day zero 模型存取: 當新的開放模型登上程式碼基準測試榜首時,等上一季才來評估是無法接受的。重大開放模型發布當天,我們就會在 Model APIs 上同步推出。要評估最新的前沿模型,只需更新一行程式碼這麼簡單。
- 開發者(與 Agent)體驗: 對程式開發工作流程來說,光有推論是不夠的。Agent 需要地方來執行自己寫出的程式碼,這也是為什麼 Blaxel 沙盒(現已成為 Baseten 的一部分) 會為每個 Agent 提供專屬沙盒。
- 企業治理:程式碼天生就是敏感資料,而 Baseten 的推論服務運行於美國境內的基礎架構上,對所有提示詞皆採零資料保留(ZDR)。若有更高的合規要求,你可以將部署鎖定在特定區域、實作細粒度的 AuthN 與 AuthZ,並查看任何模型、使用者或金鑰的使用狀況。
- 應用研究與嵌入式工程支援: 駐點工程師會根據你的延遲目標調校部署,應用研究員則會與你一起進行後訓練。LangChain 正是透過 Baseten Loops 為 LangSmith Engine 訓練自訂模型。
與 OpenAI 的合作,是我們打造最佳多模型 Agent 程式開發體驗的又一步。透過 Day zero 即可存取開放前沿模型、快速穩定的推論,以及在我們或你的雲端中保證的容量,我們將持續建構你所需的一切,加速 AI 落地,並提升每一分錢所能買到的智慧價值。
若想透過 OpenAI 承諾用量在 Codex 中原生使用開放模型,請 加入等候名單。其他需求,歡迎 直接與工程師聊聊。





