YouMind
ลงชื่อเข้าใช้

ประกาศความร่วมมือกับ OpenAI

@baseten
อังกฤษ29 ก.ย. 2569
299K
465
44
16
233

TL;DR

Baseten ประกาศความร่วมมือกับ OpenAI ในการให้บริการโมเดลแบบเปิดน้ำหนักผ่าน OpenAI B2B Marketplace และการผสานรวมเข้ากับ Codex โดยตรง ทำให้องค์กรสามารถใช้ประโยชน์จากข้อผูกพันที่มีอยู่สำหรับเวิร์กโฟลว์การเขียนโค้ดด้วยเอเจนต์หลายโมเดล

เรารู้สึกตื่นเต้นที่ได้ร่วมมือกับ OpenAI ในฐานะหนึ่งในผู้ให้บริการ inference แบบ open-model รายแรก ๆ ใน OpenAI B2B Marketplace ซึ่งรวมถึงการผสานการทำงานแบบ native ภายใน Codex ด้วย ลูกค้าระดับองค์กรของ OpenAI สามารถใช้ commitment ที่มีอยู่กับ OpenAI เพื่อเข้าถึง open models ที่ให้บริการโดย Baseten ภายใน Codex หรือผ่าน Responses API ได้แล้ว สำหรับองค์กร นี่หมายถึงการสร้างความฉลาด (intelligence) ต่อทุกดอลลาร์ที่จ่ายได้มากยิ่งขึ้น ผ่าน commitment ของ OpenAI ที่คุณมีอยู่แล้ว

เราเคยเขียนถึงอนาคตแบบ multi-model ไว้แล้ว และการประกาศครั้งนี้แสดงให้เห็นว่าอนาคตนั้นกำลังกลายเป็นปัจจุบันอย่างรวดเร็วเพียงใด Agentic coding คือ use case ของ AI ที่ได้รับการนำไปใช้อย่างแพร่หลายที่สุดในขณะนี้ และโมเดล Codex กับ GPT ของ OpenAI ก็เป็นสองตัวเลือกยอดนิยมสำหรับการขยาย scale ของ workflow การสร้างโค้ด เมื่อ open models ที่ขับเคลื่อนโดย Baseten พร้อมให้ลูกค้าของ OpenAI ใช้งานแล้ว องค์กรต่าง ๆ จึงสามารถปรับแต่ง agentic workflows ให้ทำงานข้ามทั้ง open และ closed models ได้อย่างเหมาะสมที่สุด พร้อมทั้งส่งแต่ละ task ไปยังโมเดลที่ตอบโจทย์งานนั้นได้ดีที่สุด

Agentic coding คือ multi-model workflow แรกในระดับโลก

ทุกวันนี้ บริษัทที่เป็นผู้นำด้าน AI กำลังเปลี่ยนมาใช้โมเดลผสมผสานกันที่ Pareto frontiers โดยพิจารณาจากความฉลาด ต้นทุน latency และ capacity ร่วมกัน

ทีมวิศวกรรมชั้นนำกำลังส่งต่อ task ต่าง ๆ อย่างจริงจัง ทั้งผ่าน static หรือ adaptive router ไปยังโมเดลที่มอบส่วนผสมที่ดีที่สุดระหว่างต้นทุน คุณภาพ และประสิทธิภาพสำหรับงานนั้น ๆ และเมื่อวงจรการเปิดตัว open และ closed models ใหม่ ๆ ลดลงเหลือเพียงหลักสัปดาห์ ก็ไม่มีโมเดลใดที่จะครองตำแหน่งเครื่องมือที่ดีที่สุดสำหรับทุกงานได้นานอีกต่อไป

เพื่อรักษาความเป็นผู้นำ บริษัทต่าง ๆ จำเป็นต้องเข้าถึงโมเดลล่าสุดได้ทันที พร้อม inference ที่รวดเร็วและเสถียร ซึ่งผสานเข้ากับ harness, gateway และเครื่องมืออื่น ๆ ของพวกเขาได้อย่างไร้รอยต่อ Baseten ถูกออกแบบมาเพื่อสิ่งนี้โดยเฉพาะ ด้วยการมอบ infrastructure primitives และ developer tools ประสิทธิภาพสูงที่ผสานการทำงานแบบ native เข้ากับระบบเฉพาะตัวของแต่ละองค์กรได้อย่างลงตัว

ความสามารถใหม่ในการขยาย scale ความฉลาดแบบ multi-model สำหรับการสร้างโค้ด

ความฉลาดต่อทุกดอลลาร์ที่ดีที่สุดใน production จะทำงานได้ในระดับ scale ก็ต่อเมื่อโมเดลแสดงผลได้ตามที่คาดหวังอย่างสม่ำเสมอ คุณต้องการทั้งประสิทธิภาพ ความเสถียร และความยืดหยุ่น เพื่อให้ระบบ multi-model ทำงานได้ในทางเทคนิค แต่หากต้องการขยาย scale ภายในองค์กร คุณต้องเพิ่มประสบการณ์นักพัฒนาที่ลื่นไหล ความสามารถในการกำกับดูแลระดับโลก และการสนับสนุนจากทีมวิศวกรแนวหน้าเข้าไปด้วย

  • การปรับแต่งประสิทธิภาพแบบ full-stack: workload การสร้างโค้ดถือเป็นความท้าทายอย่างยิ่งในชั้น inference การทำงานหลายรอบ (multiple turns), prompt ยาว ๆ บน repo ขนาดใหญ่ และ context window มหึมา ล้วนดึงทรัพยากรจากทุกส่วนของ stack ดังนั้นงานด้านการปรับปรุงประสิทธิภาพของเราจึงครอบคลุมตั้งแต่ระดับเครื่องมือไปจนถึงระดับ engine
  • Capacity และความเสถียรแบบ multi-cloud: การสร้างโค้ดมักเกิดขึ้นเป็นระลอกทั่วทั้งองค์กรวิศวกรรม และ capacity คือข้อจำกัดแรกที่สร้างปัญหา Baseten ทำงานบนคลัสเตอร์กว่า 90 แห่ง ครอบคลุมมากกว่า 20 คลาวด์ และการ deploy ทำงานแบบ active-active ดังนั้นหากสูญเสียผู้ให้บริการหรือ region ใดไป ระบบจะ route traffic ใหม่แทนที่จะหยุดการทำงาน ความสัมพันธ์อันดีกับผู้ให้บริการ compute กว่า 200 ราย ทำให้เราเป็นรายแรก ๆ ที่ได้รับการติดต่อเมื่อมี capacity ใหม่พร้อมใช้งาน supply จึงเติบโตนำหน้า demand เสมอ
  • การเข้าถึงโมเดลตั้งแต่วันแรก (Day zero): เมื่อ open model ใหม่ขึ้นแท่นอันดับหนึ่งบน benchmark ด้านการเขียนโค้ด การรอถึงหนึ่งไตรมาสเพื่อทดสอบมันย่อมไม่ใช่เรื่องที่ยอมรับได้ เราเปิดตัว open models รุ่นสำคัญบน Model APIs ตั้งแต่วันที่ปล่อยออกมา การทดสอบ frontier model ใหม่ล่าสุดในวันที่เปิดตัวจึงง่ายเหมือนการแก้ไขโค้ดเพียงบรรทัดเดียว
  • ประสบการณ์สำหรับนักพัฒนา (และ agent): inference เพียงอย่างเดียวไม่เพียงพอสำหรับ workflow การเขียนโค้ด agent ต้องการพื้นที่สำหรับรันโค้ดที่พวกมันเขียนขึ้นมา นี่คือเหตุผลที่ Blaxel sandboxes ซึ่งตอนนี้เป็นส่วนหนึ่งของ Baseten แล้ว มอบ sandbox ส่วนตัวให้กับทุก agent
  • การกำกับดูแลระดับองค์กร: โค้ดคือข้อมูลที่ละเอียดอ่อนโดยธรรมชาติ และ inference ของ Baseten ทำงานบน infrastructure ในสหรัฐอเมริกา พร้อมนโยบาย zero data retention (ZDR) สำหรับทุก prompt หากองค์กรของคุณมีข้อกำหนดด้านการปฏิบัติตามกฎระเบียบที่สูงกว่านั้น คุณสามารถตรึงการ deploy ไว้กับ region เฉพาะได้ ใช้ระบบ AuthN และ AuthZ แบบละเอียด และดูข้อมูลการใช้งานข้ามโมเดล ผู้ใช้ หรือ key ใดก็ได้
  • การวิจัยเชิงประยุกต์และการสนับสนุนด้านวิศวกรรมแบบฝังตัว: วิศวกรที่ประจำการหน้างาน (forward-deployed engineers) จะช่วยปรับแต่งการ deploy ให้ตรงกับเป้าหมายด้าน latency ของคุณ และนักวิจัยเชิงประยุกต์จะร่วมทำ post-training ไปพร้อมกับคุณ นี่คือวิธีที่ LangChain ใช้ฝึก custom models สำหรับ LangSmith Engine ด้วย Baseten Loops

ความร่วมมือของเรากับ OpenAI เป็นอีกหนึ่งก้าวสู่การมอบประสบการณ์ agentic coding แบบ multi-model ที่ดีที่สุด ด้วยการเข้าถึง frontier models แบบเปิดตั้งแต่วันแรก, inference ที่รวดเร็วและเสถียร รวมถึง capacity ที่รับประกันได้ไม่ว่าจะบนคลาวด์ของเราหรือของคุณ เราจะเดินหน้าสร้างสิ่งที่คุณต้องการต่อไป เพื่อเร่งการนำ AI ไปใช้จริงและเพิ่มมูลค่าความฉลาดต่อทุกดอลลาร์ที่คุณจ่าย

หากต้องการเข้าถึง open models แบบ native ใน Codex ผ่าน commitment ของ OpenAI ที่คุณมีอยู่ ลงทะเบียนรับสิทธิ์ได้ที่นี่ และสำหรับเรื่องอื่น ๆ พูดคุยกับวิศวกรของเราได้เลย

บันทึกในคลิกเดียว

อ่านบทความไวรัลเชิงลึกด้วย AI ใน YouMind

บันทึกแหล่งที่มา ถามคำถามที่ตรงประเด็น สรุปข้อโต้แย้ง และเปลี่ยนบทความไวรัลให้เป็นโน้ตที่นำกลับมาใช้ได้ใน AI เวิร์กสเปซเดียว

สำรวจ YouMind
สำหรับครีเอเตอร์

เปลี่ยน Markdown ของคุณให้เป็นบทความ 𝕏 ที่สะอาดตา

เวลาคุณเผยแพร่งานเขียนยาวของตัวเอง การจัดรูปแบบรูปภาพ ตาราง และบล็อกโค้ดให้เข้ากับ 𝕏 นั้นน่าปวดหัว YouMind เปลี่ยนร่าง Markdown ทั้งฉบับให้เป็นบทความ 𝕏 ที่สะอาดตาและพร้อมโพสต์ทันที

ลอง Markdown เป็น 𝕏

แพตเทิร์นให้ถอดรหัสเพิ่มเติม

บทความไวรัลล่าสุด

สำรวจบทความไวรัลเพิ่มเติม