YouMind
Anmelden

Ankündigung unserer Partnerschaft mit OpenAI

@baseten
ENGLISCH29. Sept. 2026
299K
465
44
16
233

TL;DR

Baseten gibt eine Partnerschaft mit OpenAI bekannt, um Open-Weight-Modelle über den OpenAI B2B Marketplace und die native Codex-Integration bereitzustellen. Dies ermöglicht es Unternehmen, bestehende Verpflichtungen für Multi-Model-Agentic-Coding-Workflows zu nutzen.

Wir freuen uns über unsere Partnerschaft mit OpenAI als einer der ersten Inference-Anbieter für offene Modelle im OpenAI B2B Marketplace – inklusive einer nativen Integration in Codex. Unternehmenskunden von OpenAI können nun bestehende OpenAI-Verpflichtungen für offene Modelle nutzen, die von Baseten innerhalb von Codex oder über die Responses API bereitgestellt werden. Für Unternehmen bedeutet das: noch mehr Intelligence pro Dollar aus deiner bestehenden OpenAI-Verpflichtung herausholen.

Wir haben bereits über die Multi-Model-Zukunft geschrieben, und diese Ankündigung zeigt, wie schnell diese Zukunft zur Gegenwart wird. Agentic Coding ist aktuell der am weitesten verbreitete KI-Anwendungsfall, und Codex sowie die GPT-Modelle von OpenAI gehören zu den beliebtesten Optionen, um Workflows zur Codegenerierung zu skalieren. Da OpenAI-Kunden jetzt auch auf offene Modelle zugreifen können, die von Baseten betrieben werden, lassen sich agentische Workflows organisationsübergreifend über offene und geschlossene Modelle hinweg optimieren – jede Aufgabe wird automatisch an das passendste Modell geroutet.

Agentic Coding ist der erste Multi-Model-Workflow im globalen Maßstab

Unternehmen, die heute bei KI führend sind, setzen zunehmend auf einen Mix aus Modellen an den Pareto-Grenzen für Intelligence, Kosten, Latenz und Kapazität.

Top-Engineering-Teams leiten Aufgaben bereits aktiv – über statische oder adaptive Router – an genau das Modell weiter, das für den jeweiligen Job die beste Kombination aus Kosten, Qualität und Performance liefert. Und da der Zyklus zwischen neuen offenen und geschlossenen Modellen mittlerweile nur noch wenige Wochen dauert, bleibt kein Modell lange das beste Werkzeug für alle Aufgaben.

Um vorne zu bleiben, brauchen Unternehmen sofortigen Zugriff auf die neuesten Modelle mit schnellem, zuverlässigem Inference, das sich nahtlos in ihre Harnesses, Gateways und andere Tools integrieren lässt. Genau dafür wurde Baseten entwickelt: Wir bieten hochperformante Infrastruktur-Primitives und Developer-Tools, die sich nativ in die individuelle Systemlandschaft jeder Organisation einfügen.

Neue Funktionen, um Multi-Model-Intelligence für die Codegenerierung zu skalieren

Die beste Intelligence pro Dollar im Produktivbetrieb skaliert nur dann, wenn Modelle durchgehend so performen wie erwartet. Performance, Zuverlässigkeit und Flexibilität sind die Grundvoraussetzungen, damit ein Multi-Model-System technisch funktioniert. Um es unternehmensweit zu skalieren, brauchst du zusätzlich eine reibungslose Developer Experience, globale Governance-Funktionen und Engineering-Support an vorderster Front.

  • Full-Stack-Performance-Optimierung: Workloads zur Codegenerierung sind auf der Inference-Ebene besonders anspruchsvoll. Mehrere Turns, lange Prompts über große Repos hinweg und riesige Kontextfenster belasten jeden Teil des Stacks. Deshalb reicht unsere Performance-Arbeit von den Tools bis hinunter auf Engine-Ebene.
  • Multi-Cloud-Kapazität und Zuverlässigkeit. Codegenerierung läuft in ganzen Engineering-Organisationen in Bursts ab – und Kapazität ist der Engpass, der zuerst zuschlägt. Baseten läuft auf über 90 Clustern in mehr als 20 Clouds, und Deployments arbeiten im Active-Active-Betrieb. Fällt ein Provider oder eine Region aus, wird der Traffic einfach umgeleitet, statt dass die Arbeit stoppt. Unsere Beziehungen zu über 200 Compute-Anbietern sorgen dafür, dass wir als Erste informiert werden, wenn neue Kapazitäten verfügbar sind – das Angebot wächst also schneller als die Nachfrage.
  • Modellzugriff ab Tag null: Wenn ein neues offenes Modell die Coding-Benchmarks anführt, ist es keine Option, ein Quartal mit der Evaluierung zu warten. Wir launchen wichtige offene Modelle an dem Tag auf Model APIs, an dem sie veröffentlicht werden. Das neueste Frontier-Modell direkt am Release-Tag zu evaluieren, ist so einfach wie das Aktualisieren einer einzigen Codezeile.
  • Developer (und Agent) Experience: Inference allein reicht für Coding-Workflows nicht aus. Agents brauchen eine Umgebung, in der sie den von ihnen geschriebenen Code ausführen können. Deshalb geben Blaxel-Sandboxes, jetzt Teil von Baseten, jedem Agent seine eigene Sandbox.
  • Enterprise Governance: Code ist standardmäßig sensibel. Deshalb läuft das Inference von Baseten auf US-basierter Infrastruktur mit Zero Data Retention (ZDR) für alle Prompts. Für noch höhere Compliance-Anforderungen kannst du Deployments an bestimmte Regionen pinnen, feingranulare AuthN und AuthZ implementieren und die Nutzung über jedes Modell, jeden User oder jeden Key hinweg einsehen.
  • Applied Research und eingebetteter Engineering-Support: Forward-deployed Engineers stimmen Deployments exakt auf deine Latenzziele ab, und Applied Researchers führen gemeinsam mit dir das Post-Training durch. So trainiert beispielsweise LangChain mit Baseten Loops eigene Modelle für die LangSmith Engine.

Unsere Partnerschaft mit OpenAI ist ein weiterer Schritt hin zur besten Multi-Model-Agentic-Coding-Experience. Mit Zugriff auf offene Frontier-Modelle ab Tag null, schnellem und zuverlässigem Inference sowie garantierter Kapazität in unserer oder deiner Cloud bauen wir kontinuierlich genau das, was du brauchst, um die KI-Einführung zu beschleunigen und den Wert von Intelligence pro Dollar zu steigern.

Um über deine OpenAI-Verpflichtung nativ in Codex auf offene Modelle zuzugreifen, lass dich auf die Liste setzen. Für alles andere sprich direkt mit einem Engineer.

Mit einem Klick speichern

Virale Artikel mit YouMind per KI tief lesen

Speichere die Quelle, stelle gezielte Fragen, fasse die Argumentation zusammen und verwandle einen viralen Artikel in wiederverwendbare Notizen in einem einzigen KI-Arbeitsbereich.

YouMind entdecken
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken