YouMind
Iniciar sesión

Anunciamos nuestra asociación con OpenAI

@baseten
INGLÉS29 sept 2026
299K
465
44
16
233

TL;DR

Baseten anuncia una asociación con OpenAI para servir modelos de pesos abiertos a través del OpenAI B2B Marketplace y la integración nativa con Codex, permitiendo a las empresas aprovechar sus compromisos existentes para flujos de trabajo de programación agéntica multi-modelo.

Nos entusiasma asociarnos con OpenAI como uno de los primeros proveedores de inferencia de modelos abiertos en el OpenAI B2B Marketplace, lo que incluye una integración nativa dentro de Codex. Ahora, los clientes empresariales de OpenAI pueden utilizar sus compromisos existentes con OpenAI para acceder a modelos abiertos servidos por Baseten dentro de Codex o a través de la Responses API. Para las empresas, esto significa obtener aún más inteligencia por cada dólar invertido mediante su compromiso actual con OpenAI.

Ya hemos escrito sobre el futuro multimodelo, y este anuncio demuestra lo rápido que ese futuro se está convirtiendo en el presente. La programación agéntica es hoy el caso de uso de IA con mayor adopción, y los modelos Codex y GPT de OpenAI son dos de las opciones más populares para escalar flujos de trabajo de generación de código. Con los modelos abiertos impulsados por Baseten ahora disponibles para los clientes de OpenAI, las organizaciones pueden optimizar sus flujos de trabajo agénticos combinando modelos abiertos y cerrados, y dirigir cada tarea al modelo que mejor se adapte.

La programación agéntica es el primer flujo de trabajo multimodelo a escala global

Hoy en día, las empresas líderes en IA están adoptando una combinación de modelos situados en las fronteras de Pareto en términos de inteligencia, costo, latencia y capacidad.

Los mejores equipos de ingeniería canalizan activamente las tareas, mediante enrutadores estáticos o adaptativos, hacia el modelo que ofrece la mejor combinación de costo, calidad y rendimiento para cada trabajo. Y con ciclos de lanzamiento de nuevos modelos abiertos y cerrados que se han reducido a semanas, ningún modelo sigue siendo la mejor herramienta para todo durante mucho tiempo.

Para mantenerse a la vanguardia, las empresas necesitan acceso instantáneo a los modelos más recientes, con una inferencia rápida y confiable que se integre sin problemas en sus entornos de ejecución, puertas de enlace y demás herramientas. Baseten fue diseñado exactamente para eso: proporciona primitivos de infraestructura de alto rendimiento y herramientas para desarrolladores que se integran de forma nativa en el entorno tecnológico particular de cada organización.

Nuevas capacidades para escalar la inteligencia multimodelo en la generación de código

Lograr la mejor relación inteligencia-costo en producción funciona a escala cuando los modelos rinden de manera consistente según lo esperado. Necesitas rendimiento, confiabilidad y flexibilidad para que un sistema multimodelo funcione técnicamente. Pero para escalarlo dentro de una empresa, también debes sumar una experiencia de desarrollo fluida, capacidades de gobernanza global y soporte de ingeniería de primera línea.

  • Optimización de rendimiento full-stack: Las cargas de trabajo de generación de código son especialmente exigentes en la capa de inferencia. Los intercambios múltiples, los prompts extensos sobre repositorios grandes y las ventanas de contexto enormes someten a presión cada parte del stack, por lo que nuestro trabajo de optimización abarca desde las herramientas hasta el nivel del motor.
  • Capacidad y confiabilidad multicloud. La generación de código se ejecuta en ráfagas en toda la organización de ingeniería, y la capacidad es la primera limitante que aparece. Baseten opera en más de 90 clústeres distribuidos en más de 20 nubes, y los despliegues funcionan en modo activo-activo, de modo que si se pierde un proveedor o una región, el tráfico se redirige en lugar de detener el trabajo. Nuestras relaciones con más de 200 proveedores de cómputo nos convierten en la primera opción cuando se habilita nueva capacidad, por lo que la oferta crece antes que la demanda.
  • Acceso a modelos desde el día cero: Cuando un nuevo modelo abierto lidera los benchmarks de programación, no es aceptable esperar un trimestre para evaluarlo. Lanzamos los principales modelos abiertos en Model APIs el mismo día en que se publican. Evaluar el modelo frontier más reciente el día de su lanzamiento es tan sencillo como actualizar una sola línea de código.
  • Experiencia para desarrolladores (y agentes): La inferencia por sí sola no basta para los flujos de trabajo de programación. Los agentes necesitan un lugar donde ejecutar el código que escriben; por eso, los sandboxes de Blaxel, que ahora forman parte de Baseten, le asignan a cada agente su propio entorno aislado.
  • Gobernanza empresarial: El código es sensible por naturaleza, y la inferencia de Baseten se ejecuta en infraestructura ubicada en Estados Unidos con retención de datos cero (ZDR) para todos los prompts. Si tus requisitos de cumplimiento son aún más estrictos, puedes anclar los despliegues a regiones específicas, implementar AuthN y AuthZ de grano fino y consultar el uso por modelo, usuario o clave.
  • Investigación aplicada y soporte de ingeniería integrado: Nuestros ingenieros desplegados en campo ajustan los despliegues a tus objetivos de latencia, y nuestros investigadores aplicados ejecutan el post-entrenamiento junto a ti. Así es como LangChain entrena modelos personalizados para LangSmith Engine con Baseten Loops.

Nuestra asociación con OpenAI es un paso más hacia la mejor experiencia de programación agéntica multimodelo. Con acceso a modelos abiertos frontier desde el día cero, inferencia rápida y confiable, y capacidad garantizada en nuestra nube o en la tuya, seguiremos construyendo lo que necesitas para acelerar la adopción de la IA y aumentar el valor de la inteligencia por cada dólar invertido.

Para acceder a modelos abiertos de forma nativa en Codex a través de tu compromiso con OpenAI, regístrate en la lista. Para cualquier otra consulta, habla con un ingeniero.

Guardar con un clic

Lee artículos virales en profundidad con IA en YouMind

Guarda la fuente, haz preguntas concretas, resume el argumento y convierte un artículo viral en notas reutilizables en un único espacio de trabajo con IA.

Explora YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales