ทุก Agent ที่คุณใช้มาจนถึงตอนนี้ล้วนมาในรูปแบบแพ็กเกจเดียว ทั้งตัวระบบควบคุม (harness) ไม่ว่าจะเป็นคอมพิวเตอร์ การล็อกอิน หน่วยความจำ หรือรูทีน และสมองที่ขับเคลื่อนมัน ล้วนถูกสร้างโดยบริษัทเดียวกันและขายมาด้วยกัน
ในวันที่ 7 ตุลาคม Grok Bot ได้แยกสองสิ่งนี้ออกจากกัน:
https://x.com/elonmusk/status/2107724314451878104
จากนี้ไป SpaceX จะส่งทุกงานไปยังโมเดล back-end ที่ดีที่สุดเสมอ และชื่อแรกในลิสต์นั้นคือ Claude Opus 5.5 โดย SpaceX ยังคงเก็บตัว harness ไว้ ส่วนสมองนั้นกลายเป็นของ Anthropic ไปแล้ว
การผสมผสานนี้คือเวอร์ชันที่แข็งแกร่งที่สุดของผลิตภัณฑ์เท่าที่เคยมีมา: Agent ที่มีคอมพิวเตอร์เป็นของตัวเองและทำงานแทนคุณได้แม้ตอนที่คุณหลับ ขับเคลื่อนด้วยโมเดลที่เป็นผู้นำใน benchmark อิสระสำหรับงาน agentic แบบหลายขั้นตอน
นี่คือคู่มือ 10 ขั้นตอน
ตั้งแต่ทำความเข้าใจว่าอะไรเปลี่ยนไป ไปจนถึงการรันทีมผู้เชี่ยวชาญที่ขับเคลื่อนด้วย Opus ซึ่งส่งต่องานให้กันเอง และดึงคุณเข้ามาเฉพาะเรื่องที่จำเป็นต้องใช้คนจริงๆ เท่านั้น
01. ทำความเข้าใจว่าอะไรเพิ่งเปลี่ยนไป
ทุกอย่างเริ่มจากโพสต์เดียว ในช่วงดึกของวันที่ 6 ตุลาคมตามเวลาสหรัฐฯ Musk โพสต์บน X ว่า SpaceX จะใช้โมเดล back-end ที่ดีที่สุดสำหรับแต่ละงาน โดยเอ่ยชื่อ Claude Opus 5.5, Midjourney และ Suno พร้อมปิดท้ายว่า "อะไรก็ตามที่มีแนวโน้มจะให้ผลลัพธ์ที่ดีที่สุดกับคุณ"
ไม่กี่ชั่วโมงต่อมา Lauren (@poteto) จากทีม Grok Bot ก็ออกมาทำให้เรื่องนี้เป็นรูปธรรมมากขึ้น: บอททั้งหมดจะถูกขับเคลื่อนด้วย Opus 5.5 และสามารถสร้าง cloud agent ที่รันโมเดลของ Cursor ได้ ซึ่ง 9to5Mac รายงานเรื่องนี้แบบเรียลไทม์เมื่อวันที่ 7 ตุลาคม
https://x.com/claudeai/status/2107894039626277339
ทำไมถึงเลือกใช้โมเดลของคู่แข่ง? เพราะเมื่อวัดจากงานที่ Agent ต้องทำจริงๆ แล้ว ช่องว่างระหว่างสองค่ายนั้นกว้างมาก Artificial Analysis ได้ทดสอบแล็บทั้งสองบน harness เดียวกัน:

ข้อควรระวังเล็กน้อย: นั่นคือ Grok 4.6 ไม่ใช่ Grok 4.7 ที่เปิดตัวในเดือนกันยายน และการทดสอบทั้งสองครั้งห่างกันหนึ่งเดือน แต่ตัวเลขจาก Terminal-Bench คือตัวชี้วัดว่าจะมอบ "งาน" ให้โมเดลทำได้หรือไม่ แทนที่จะเป็นแค่ "คำถาม" และในจุดนี้ช่องว่างต่างกันเกือบ 3 เท่า
https://x.com/zhuokaiz/status/2102825912471527738
ชาว X ตอบสนองก่อนสื่อกระแสหลักเสียอีก:
ในวันที่ 7 ตุลาคม Grok Bot ได้แยกสองสิ่งนี้ออกจากกันไปยังโมเดล back-end ที่ดีที่สุด และชื่อแรกในลิสต์นั้นคือ Claude Opus 5.5 โดย SpaceX ยังคงเก็บตัว harness ไว้ ส่วนสมองนั้นกลายเป็นของ Anthropic ไปแล้ว
ใคร
พวกเขาพูดว่าอะไร
Theo - t3.gg (@theo)
"ข่าวร้ายครับทุกคน: Grok Bot มันดีจริงๆ นะ" - ยอดวิว 4.4 ล้านครั้ง โพสต์ก่อนข่าวออกไม่กี่ชั่วโมง วันถัดมา Lauren ตอบกลับว่ามันยิ่งดีขึ้นกว่าเดิมอีก
Lauren (@poteto)
Quote-post ข้อความของ Musk เพื่อประกาศว่า Grok Bot กำลังจะได้อัปเกรด
Iorel (@Iorel_X)
มองเรื่องนี้ในมุมที่ว่า Grok Bot เปิดรับโมเดลภายนอก แทนที่จะผูกติดอยู่กับโมเดลใดโมเดลหนึ่ง
02. ติดตั้งและทำความรู้จักกับ Chief
Grok Bot เป็นแอปพลิเคชัน ไม่ใช่แท็บเบราว์เซอร์ มันรันได้ทั้งบน Mac, iPhone และ iPad คุณเข้าสู่ระบบด้วยบัญชี Grok หรือ Cursor ของคุณได้ โดยไม่ได้ขายแยกเดี่ยวๆ แต่จะมาพร้อมกับแพ็กเกจส่วนใหญ่ของ SuperGrok และแผนใช้งาน Cursor แบบเสียเงิน
หน้าตาที่คุณจะเจอจะคล้ายแอปแชทมากกว่าแชทบอท: รายชื่อบอทอยู่ด้านซ้าย บทสนทนาอยู่ด้านขวา แต่ละบอทจะมีคอมพิวเตอร์บนคลาวด์เป็นของตัวเอง

คุณไม่ต้องไปตั้งค่าอะไรเลยเพื่อใช้ Opus 5.5 เพราะทีม Grok Bot บอกว่ามันเป็นค่าเริ่มต้นของทุกบอทอยู่แล้ว และไม่มีการสมัครสมาชิก Claude แยกต่างหาก
ให้เริ่มจากบอทอเนกประสงค์สักตัว เรียกมันว่า Chief หน้าที่ของมันคือเป็นคนที่ให้คุณทักไปหาเวลาที่ยังไม่แน่ใจว่าควรโยนงานนี้ให้ผู้เชี่ยวชาญคนไหน
ลองสั่งงานจริงที่ให้ผลลัพธ์ตรวจสอบได้ในสามสิบวินาที ทุกขั้นตอนหลังจากนี้จะเกี่ยวกับการไว้ใจให้มันทำงานที่ใหญ่ขึ้น ดังนั้นจงเริ่มจากงานที่คุณพิสูจน์ได้ก่อน
03. เขียน Charter ให้กับสมองที่ฉลาดขึ้น
Prompt คือคำขอ แต่บอทคือบทบาทหน้าที่ มันคงอยู่ สร้างหน่วยความจำ และเป็นเจ้าของโดเมนงาน ดังนั้นจงตั้งชื่อมันตามตำแหน่งงาน เช่น Inbox Manager, Research Lead, Sales Outbound

จากนั้นบรีฟงานมันเหมือนพนักงานใหม่: มันรับผิดชอบอะไร งานที่ดีหน้าตาเป็นอย่างไร และตรงไหนที่มันต้องหยุดแล้วมาถามคุณ
นี่คือสิ่งที่เปลี่ยนไปเมื่อใช้ Opus 5.5 Charter ที่เขียนสำหรับโมเดลเริ่มต้นตัวเดิมมักจะเป็นเชิงป้องกันตัวเอง คือแบ่งงานเป็นขั้นสั้นๆ และคอยเช็กบ่อยๆ เพราะโมเดลมักจะค้างไปดื้อๆ หลังผ่านไปไม่กี่ขั้น แต่ด้วยสมองที่ได้คะแนนงานแบบหลายขั้นตอนสูงกว่าเกือบ 3 เท่า คุณสามารถโยนงานทั้งหมดให้มันได้เลย ไม่ใช่แค่ขั้นตอนแรก
Opus 5.5 ยังรองรับ context window ขนาด 1M token และ output สูงสุด 128K token ผ่าน API ส่วน Grok Bot จะเปิดให้ใช้ได้มากน้อยแค่ไหนนั้นยังไม่มีการเปิดเผย แต่ประเด็นสำคัญคือ ตอนนี้คุณสามารถสั่งงานที่ยาวขึ้นได้แล้ว
1Charter prompt — ออกแบบมาเพื่อ Opus 5.52คุณคือ Research Lead ของฉัน34// สิ่งที่คุณรับผิดชอบ5เมื่อได้รับหัวข้อ ให้ทำงานทั้งหมดตั้งแต่ต้นจนจบ: ค้นหาแหล่งข้อมูลปฐมภูมิ6เปิดทุกหน้าที่คุณอ้างอิง ตรวจสอบตัวเลขข้ามแหล่งข้อมูล7อย่างน้อยสองแหล่ง และร่างสรุปความยาว 1,500 คำ89// งานที่ดีหน้าตาเป็นอย่างไร10ตัวเลขทุกตัวต้องมีลิงก์กำกับ แหล่งข้อมูลที่ขัดแย้งกันต้อง11ถูกไฮไลต์เตือน ไม่ใช่นำมาหาค่าเฉลี่ย ไฟล์ร่างต้องไปอยู่ในโฟลเดอร์ Drive ของฉัน ไม่ใช่ในแชท1213// จุดที่คุณต้องหยุด14ห้ามเผยแพร่เด็ดขาด ห้ามอีเมลหาใครเด็ดขาด ทำแค่ไฟล์ร่างเท่านั้น15หากสองแหล่งข้อมูลขัดแย้งกันและคุณหาข้อสรุปไม่ได้ ให้พักเรื่องนั้นไว้แล้วมาถามฉัน
กฎคือ: สมองที่ฉลาดขึ้นจะได้ "จำนวนขั้นตอน" ที่มากขึ้น ไม่ใช่ "อำนาจ" ที่มากขึ้น บล็อก "จุดที่คุณต้องหยุด" จึงยังต้องเข้มงวดเท่าเดิมทุกประการ
04. เชื่อมต่อเครื่องมือครั้งเดียว และขีดเส้นแบ่งข้อมูลให้ชัด

Grok Bot มาพร้อมแผงปลั๊กอินที่เชื่อมต่อได้เพียงคลิกเดียว: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio และ Context7 รวมถึงการเชื่อมต่อแบบกำหนดเอง
การเชื่อมต่อเหล่านี้เป็นระดับบัญชี เชื่อมต่อ Gmail ครั้งเดียว ทุกบอทที่คุณสร้างก็จะใช้งานได้ทันที บอทตัวที่ห้าของคุณจึงพร้อมทำงานภายในไม่กี่วินาที
ส่วนที่เพิ่มเข้ามาใหม่: ข้อมูลของคุณมีปลายทางที่สองแล้ว เมื่อบอทคิดวิเคราะห์ด้วย Opus 5.5 สิ่งที่มันอ่านจะถูกส่งไปยัง Anthropic สำหรับขั้นตอนนั้น คำถามเรื่องการ opt-out ของ Tom ภายใต้โพสต์ของ Musk ยังไม่มีคำตอบ และ SpaceXAI ก็ยังไม่ได้เผยแพร่เงื่อนไขว่าข้อมูลใดบ้างที่ถูกแชร์ออกไป
คุณเลือกไม่ได้ว่าโมเดลจะรันที่ไหน แต่คุณเลือกได้ว่าบอทจะแตะต้องข้อมูลอะไรบ้าง เพิ่มข้อความนี้ลงในทุก charter:
1// เส้นแบ่งข้อมูล — เพิ่มลงในทุก charter2ห้ามเปิด อ่าน หรือสรุป:3 - อะไรก็ตามในโฟลเดอร์ Drive /Legal หรือ /Finance ของฉัน4 - อีเมลจากทนายความ นักบัญชี หรือธนาคารของฉัน5 - ข้อความใดๆ ที่มีรหัสผ่าน seed phrase หรือรหัส 2FA67หากงานใดต้องใช้ข้อมูลเหล่านี้ ให้หยุดและถามฉันก่อน8เวลาทำงานกับเอกสาร ให้ใช้เฉพาะข้อมูลที่จำเป็นต่องานนั้นเท่านั้น
เชื่อมต่อเฉพาะสิ่งที่จำเป็นจริงๆ และปล่อยที่เหลือไว้ ช่วงเบต้าทุกการเชื่อมต่อจะเข้าถึงได้ทุกบอท และตอนนี้ยังหมายถึงการเข้าถึงได้มากกว่าหนึ่งบริษัทด้วย
05. ส่งมอบแค่เซสชันการล็อกอิน ไม่ใช่รหัสผ่าน
ซอฟต์แวร์ส่วนใหญ่ในบริษัทจริงๆ มักไม่มี API และไม่มี MCP server นี่คือกลไกที่ทำให้ Grok Bot ทำงานกับระบบเหล่านั้นได้อยู่ดี
บอทจะนำทางในเบราว์เซอร์บนคลาวด์ของตัวเองจนกว่าจะชนกำแพงหน้าล็อกอิน จากนั้นมันจะส่งหน้าจอมาให้คุณ คุณแค่ล็อกอิน กดเสร็จสิ้น แล้วบอทจะกลับมาทำงานต่อบนเซสชันเบราว์เซอร์เดิมจากจุดที่ค้างไว้
บอทจะได้ไปแค่ "เซสชัน" ไม่ใช่ "ความลับ" คุณไม่ต้องพิมพ์ข้อมูลรับรองใดๆ ลงในแชท และเมื่อมีโมเดลของบุคคลที่สามเข้ามาเกี่ยวข้อง เรื่องนี้ยิ่งสำคัญกว่าที่เคย รหัสผ่านที่แปะลงในบทสนทนาคือข้อความที่โมเดลอ่านได้ แต่การล็อกอินผ่านหน้าจอที่ส่งมอบให้นั้นไม่ใช่
กฎที่ต้องยึดให้มั่น: หากเครื่องมือใดขอให้คุณแปะรหัสผ่านลงในข้อความ นั่นคือวิธีที่ผิด
06. ทำให้ดูครั้งเดียว แล้วเปลี่ยนให้เป็นรูทีน
คุณสามารถสอน workflow ให้บอทได้ด้วยการลงมือทำให้มันดูครั้งเดียว มันจะบันทึกขั้นตอนเหล่านั้นไว้และรันเองในครั้งถัดไป

งานที่เหมาะจะอัดวิดีโอครั้งแรกควรเป็นงานที่ทำซ้ำ ใช้หลายเครื่องมือ และมีรูปแบบคงที่ เช่น สิ่งที่คุณทำทุกสัปดาห์ ข้ามแอปสองแอปขึ้นไป และขั้นตอนแทบไม่เปลี่ยนแปลง อธิบายด้วยปากเปล่ายาก แต่ทำให้ดูใช้เวลาแค่สี่สิบวินาที
จากนั้นตั้งเงื่อนไขให้รูทีนทำงาน มีสองตัวเลือก ซึ่งทั้งคู่ตั้งค่าด้วยภาษาธรรมดา ไม่ต้องลาก node canvas หรือใช้ workflow builder:
1// ตั้งเวลา — สรุปงานยามเช้า2ทุกวันทำการเวลา 7 โมงเช้า ให้เช็คปฏิทิน กล่องจดหมาย และ3แชนเนล #launches ใน Slack ของฉัน แล้วสรุปสั้นๆ มาให้: วันนี้มีอะไร4ต้องตอบอะไร และอะไรเปลี่ยนไปจากเมื่อคืน56// ทริกเกอร์ — ตัวดักจับอีเมลขาเข้า7เมื่อใดก็ตามที่ได้รับอีเมลจากโดเมนที่ไม่อยู่ในรายชื่อผู้ติดต่อของฉันและ8มีการพูดถึงราคา ให้ร่างอีเมลตอบกลับจากเทมเพลตแล้วพักไว้รอฉันตรวจ910// ทางลัดที่ใช้สร้างรูทีนบ่อยที่สุด11รันคำสั่งนี้ทุกสัปดาห์12 ^ พูดประโยคนี้ทันทีหลังจบงานที่คุณพอใจ
จุดที่ Opus 5.5 คุ้มค่าตัว: รูทีนมักจะพังเวลาเว็บไซต์เปลี่ยนเลย์เอาต์หรือ input ดูต่างไปจากเดิมนิดหน่อย โมเดลที่เก่งงานหลายขั้นตอนกว่ามีโอกาสกู้สถานการณ์จากหน้าที่เปลี่ยนไปได้ดีกว่า แทนที่จะล้มเหลวเงียบๆ
07. จ้างผู้เชี่ยวชาญที่สามารถสร้าง Cursor agents ได้
รันบอทหลายตัวพร้อมกัน โดยให้แต่ละตัวรับผิดชอบหนึ่งโดเมน การแยกบอทหมายถึงการแยกหน่วยความจำ แยก context และมี thread สะอาดๆ ให้ย้อนดูเวลาเกิดปัญหา ทีมของ SpaceXAI เองบอกว่าพวกเขารันบอทสำหรับงานขาย การตลาด งานปฏิบัติการในออฟฟิศ และการแก้บั๊ก
ให้แบ่งตามโดเมนงาน ไม่ใช่ขนาดของงาน Expense Manager ที่โฟกัสแค่เรื่องใบเสร็จอย่างเดียว จะเก่งเรื่องใบเสร็จของคุณโดยเฉพาะ
เลเยอร์ใหม่คือครึ่งหนึ่งที่เงียบกว่าในการประกาศของทีม Grok Bot: บอทสามารถสร้าง cloud agent ที่รันโมเดลใดๆ ของ Cursor ได้ ซึ่งสอดคล้องกับแผนที่ความเป็นเจ้าของ เพราะ SpaceX ซื้อ Cursor ไปเมื่อเดือนสิงหาคมด้วยดีลมูลค่า 6 หมื่นล้านดอลลาร์
ดังนั้นบอทสายโค้ดดิ้งจึงกลายเป็นผู้จัดการ บอทที่ขับเคลื่อนด้วย Opus จะวางแผนงานและถือ context ไว้ ส่วน Cursor agents จะเป็นคนลงแรงทำงานหนักขนานกันไป แล้วบอทจะมารีวิวผลงานที่ส่งกลับมา
1// Repo Maintainer — บอทที่จัดการ agents2คุณคือ Repo Maintainer ของฉัน34เมื่อ issue บน GitHub ถูกติดป้าย "bug":51. จำลองปัญหานั้นบนคอมพิวเตอร์ของคุณและเขียน test ที่ fail62. สร้าง Cursor cloud agent เพื่อแก้ไขบน branch ใหม่73. รัน test suite ทั้งหมดกับผลลัพธ์ที่ได้84. เปิด draft PR พร้อม test, โค้ดที่แก้ และสรุป 3 บรรทัด910ห้าม merge เด็ดขาด ห้าม push เข้า main เด็ดขาด11หากการแก้ไขกระทบ auth, billing หรือ migration ให้พักไว้รอฉัน
ผู้ใช้บน X ทำอะไรแบบนี้มาก่อนแล้วตั้งแต่ยังไม่มีการประกาศ โดยโพสต์ในช่วงปลายเดือนกันยายนเกี่ยวกับการสร้าง Cursor cloud agents จาก Grok Bot
https://x.com/mikepat711/status/2103551603102126149
08. จับพวกมันเข้ากรุ๊ปแชท
บอทสามารถส่งข้อความหากันและแชร์ context ใน thread ได้ ลองจับหลายตัวไว้ในกรุ๊ปแชทเดียว พวกมันจะประสานงานกันเอง ทั้งส่งต่องาน มอบหมายหน้าที่ และดึงคุณเข้ามาเฉพาะตอนที่จำเป็นต้องตัดสินใจ
ตัวอย่างจาก SpaceXAI เอง: บอทฝ่ายวิศวกรรมจำลองบั๊กขึ้นมา เปิด ticket แล้วส่งต่อให้บอทตัวที่สองไป debug การที่บอทตัวหนึ่งตัดสินใจว่าอีกตัวเหมาะกับงานกว่าและส่งมอบหน้าที่ให้ คือสิ่งที่เครื่องมือแชทแบบตัวต่อตัวไม่มีวันทำได้
ตั้งแต่ปลายเดือนกันยายน ทีมงานยังสามารถเผยแพร่ shared bot ที่เพื่อนร่วมงานนำไปใช้ในแอปหรือใน Slack ได้อีกด้วย
เคล็ดลับคือการมอบ "เป้าหมาย" ให้กลุ่ม ไม่ใช่ "รายการงาน" เพราะถ้าเป็นรายการงาน แปลว่าคุณแยกย่อยงานให้มันเรียบร้อยแล้ว แต่เป้าหมายจะทำให้พวกมันแบ่งงานกันเอง และการแยกย่อยงานก็คือการใช้เหตุผลแบบหลายขั้นตอนซึ่งเป็นจุดแข็งที่สุดของ Opus 5.5 พอดี
1// เป้าหมาย ไม่ใช่รายการงาน2เป้าหมาย: เปิดตัวจดหมายข่าวเดือนตุลาคมภายในวันศุกร์ 17.00 น.34Research Lead รับผิดชอบข้อเท็จจริงและแหล่งข้อมูล5Inbox Manager รับผิดชอบการตอบกลับจากผู้ติดตาม6Chief รับผิดชอบไทม์ไลน์และแจ้งฉันว่ามีอะไรติดขัดบ้าง78แบ่งงานกันเอง อะไรที่ต้องเผยแพร่ให้สาธารณะให้พักไว้รอฉัน
09. ขีดเส้นแบ่งการอนุมัติ
แนวคิดหลักของ Grok Bot คือบอทจะทำงานจนจบกระบวนการและกลับมาหาคุณเฉพาะเมื่อมีบางอย่างที่ต้องขออนุมัติเท่านั้น ซึ่งภาระจะตกอยู่ที่ตัวคุณในการนิยามคำว่า "ต้องขออนุมัติ" เพราะค่าเริ่มต้นของบอทอาจไม่ตรงกับของคุณ

เส้นแบ่งที่ใช้ได้ผลไม่ได้ขึ้นอยู่กับขนาดของงาน แต่ขึ้นอยู่กับ "ความสามารถในการย้อนกลับ" อะไรที่บอท undo ได้ ให้มันทำจบเอง แต่อะไรที่โลกภายนอกมองเห็น เกี่ยวข้องกับการโอนเงิน หรือไม่สามารถเรียกคืนได้ ให้พักไว้รอคุณ
เรื่องนี้สำคัญกว่าเดิม ไม่ใช่ลดลง สมองที่ฉลาดขึ้นจะลุยงานไปได้ไกลกว่าเดิมก่อนจะชนเส้นที่คุณขีดไว้ เส้นแบ่งนั้นจึงต้องชัดเจนอย่างยิ่ง
1// ทำสิ่งเหล่านี้ให้จบเองเสมอ2ร่าง · จัดเก็บ · แท็ก · สรุป · ค้นคว้า · เตรียมการ · ตรวจทาน3 ทุกอย่างย้อนกลับได้หมด ไม่ต้องถาม ทำเลยแล้วบันทึกไว้45// พักสิ่งเหล่านี้ไว้รอฉันเสมอ6ส่งอะไรก็ตามให้บุคคลภายนอกบริษัท7ใช้จ่าย โอนเงิน หรือตกลงราคา8เผยแพร่สิ่งใดก็ตามสู่สาธารณะ9ลบอะไรก็ตามที่ไม่ใช่ขยะชัดเจน10ยอมรับเงื่อนไขใดๆ หรือสมัครบริการใดๆ1112// เมื่อไม่แน่ใจ13ถ้าย้อนกลับไม่ได้ภายในไม่ถึงนาที ให้พักไว้แล้วมาถาม
ภาพที่ควรตั้งเป้าไว้สำหรับทุกบอท: ร่างรอคิว 36 ฉบับ ส่งออกไป 0 ฉบับ ทุกขั้นตอนที่ย้อนกลับได้ถูกทำเสร็จ และหยุดชะงักทันทีเมื่อเจอขั้นตอนแรกที่กลับไม่ได้
10. จับตาดูต้นทุน และรีวิวทุกสัปดาห์
Opus 5.5 ไม่ใช่สมองราคาถูก บน API มันมีราคาสูงกว่า Grok มาก:

ในงานเล็กๆ ที่ใช้ input 30K token และ output 8K token ราคาจะอยู่ที่ราว 28 เซนต์ เทียบกับ 11 เซนต์ แต่ถ้า context ยาวมากๆ ลำดับราคาจะกลับกัน เพราะเรทของ Grok จะเพิ่มเป็นสองเท่าเมื่อเกิน 200K token ในขณะที่ Opus คงที่
คุณไม่ได้จ่ายตามจำนวน token ใน Grok Bot เพราะมันรวมอยู่ในแพ็กเกจของคุณแล้ว คำถามที่ยังเปิดอยู่ ซึ่งเป็นสิ่งที่ Adam Hincu ถามบน X คืองานที่ขับเคลื่อนด้วย Opus จะกินโควตาของแพ็กเกจเร็วกว่าปกติหรือไม่ ซึ่ง SpaceXAI ยังไม่ได้ตอบ ดังนั้นให้จับตาดูการใช้งานในสัปดาห์แรกก่อนจะเพิ่มรูทีนใหม่ๆ

และไม่ใช่ทุกสิ่งที่ประกาศไปแล้วจะพร้อมใช้งาน Midjourney และ Suno ยังไม่มีกำหนดการ และบอทของผู้ใช้อย่างน้อยหนึ่งรายก็บอกว่า Suno ยังใช้งานไม่ได้ในวันแรก ให้สร้างงานบน Opus 5.5 ไปก่อน เพราะยืนยันแล้ว ส่วนที่เหลือให้รอไปก่อน
จากนั้นจองเวลา 15 นาทีทุกสัปดาห์ในปฏิทิน แล้วปล่อยให้บอทมารายงานผลการทำงานของตัวเอง:
1ลิสต์ทุกรูทีนที่คุณรันในสัปดาห์นี้ สำหรับแต่ละรูทีน:23 - มันถูกเรียกใช้งานกี่ครั้ง4 - มันสร้างผลลัพธ์อะไรออกมา5 - มีอะไรที่มันข้ามไป ล้มเหลว หรือต้องเดาเอาเอง6 - มีอะไรที่คุณพักไว้รอฉันแต่ฉันไม่เคยตอบกลับ78แล้วบอกฉันว่าอันไหนมีประโยชน์น้อยที่สุด และเพราะอะไร9ถ้าบอกไม่ได้ว่าขั้นตอนไหนใช้โมเดลอะไร ให้บอกมาตรงๆ
สุ่มตรวจผลลัพธ์ของ each รูทีนด้วยตัวเองสักหนึ่งชิ้น บอทที่ให้คะแนนงานตัวเองก็มีจุดบอดเดียวกับคุณนั่นแหละ
บทสรุป: harness คือผลิตภัณฑ์
ตลอดสามปีที่ผ่านมา คำถามมีอยู่ว่าโมเดลไหนดีที่สุด แต่สัปดาห์นี้ ผู้สร้างโมเดลที่ดุดันที่สุดในตลาดกลับตอบคำถามอีกข้อ: harness ไหนดีที่สุด แล้วจับสมองของคู่แข่งยัดเข้าไปข้างใน
นั่นคือการเปลี่ยนแปลงที่เกิดขึ้น harness เป็นเจ้าของคอมพิวเตอร์ การล็อกอิน หน่วยความจำ และรูทีน ส่วนสมองนั้นถอดเปลี่ยนได้จากระดับล่าง และตอนนี้สมองที่ดีที่สุดสำหรับงาน agent ก็คือ Opus 5.5
หน้าที่ของคุณไม่ได้เปลี่ยนไป คุณยังคงเป็นคนตัดสินใจว่าจะมอบหมายอะไร อำนาจของบอทสิ้นสุดตรงไหน และข้อมูลใดที่มันแตะต้องได้ เขียนทั้งสามอย่างนี้ลงไปใน charter แล้วปล่อยให้สมองที่แข็งแกร่งที่สุดในตลาดเป็นคนคลิกทำงานแทนคุณ





