การค้นหาถูกสร้างขึ้นเพื่อมนุษย์ คุณพิมพ์คำค้นหาหนึ่งคำ สแกนผลลัพธ์ ปรับแต่ง แล้วลองอีกครั้ง
โครงสร้างพื้นฐานที่สร้างขึ้นมากว่าสามสิบปีถูกออกแบบมาเพื่อวนซ้ำดังกล่าว
AI Agent ไม่ได้ทำงานแบบนั้น Agent ต้องการถามคำถามจากหลายมุมพร้อมกัน และรับทุกอย่างกลับมาพร้อมกัน
แต่ API การค้นหาที่ป้อนข้อมูลให้กับ Agent ในปัจจุบันนั้นเป็นวงจรของมนุษย์แบบเดิมที่ถูกห่อหุ้มด้วย endpoint
หนึ่งคำค้นหาเข้า หนึ่งคำตอบออก แต่ละครั้งใช้เวลาหลายร้อยมิลลิวินาที
เราทุ่มเทเวลาตลอดปีที่ผ่านมาเพื่อสร้างเครื่องมือค้นหาขึ้นใหม่สำหรับสิ่งที่เป็นผู้ค้นหาจริงๆ เราไม่ได้โพสต์เกี่ยวกับมันมากนัก
พูดตามตรง เรายังไม่พร้อม ช่วงต้นปีนี้ฉันรู้สึกว่าเราอาจจะอยู่ที่ประมาณ 70% ของความคาดหวังของเราเอง และฉันไม่อยากสร้างกระแสเกี่ยวกับตัวเลข 70%
ตอนนี้เราพร้อมแล้ว
ตัวเลข
API การค้นหาเว็บของ Octen ส่งคืนผลลัพธ์ใน 62ms (P50) โดยมี P90 ที่ 68ms ซึ่งวัดจากชุดทดสอบ SealQA Hard
ซึ่งเร็วกว่า Exa, Parallel และบริการที่คล้ายกันหลายเท่า
ทางเลือกที่เร็วที่สุดวัดได้ประมาณ 244ms ส่วนที่ช้าที่สุดสูงกว่า 2.6 วินาที

รายละเอียดหนึ่งในแผนภูมินี้สำคัญกว่าพาดหัวข่าว นั่นคือช่องว่างระหว่าง P50 และ P90 ของเราคือ 6ms สำหรับบางบริการอาจมากกว่าหนึ่งวินาที
หาก Agent ของคุณไม่สามารถคาดการณ์ได้ว่าการค้นหาจะใช้เวลานานเท่าใด มันก็ไม่สามารถวางแผนรอบการทำงานนั้นได้
ราคาอยู่ที่ $1 ต่อ 1,000 ครั้ง บริการส่วนใหญ่ในหมวดนี้คิดราคาระหว่าง $4 ถึง $9
ในด้านคุณภาพ: Octen Embedding อยู่อันดับ #1 บน RTEB และโมเดล VL embedding ของเราอยู่อันดับ #1 บน MMEB-v2
เราปล่อยโอเพนซอร์สโมเดล text embedding และพวกมันถูกดาวน์โหลดมากกว่า 500,000 ครั้งในห้าเดือน
บน DeepResearch Bench เราทำคะแนนสูงกว่า OpenAI Deep Research, Gemini และ Grok อยู่ 10 ถึง 17 คะแนน
บน FreshQA Strict และ SimpleQA เรานำหน้าทุกผู้จำหน่ายที่เราทดสอบด้วย

หมายเหตุ: เกณฑ์มาตรฐานทั้งหมดได้รับการเผยแพร่และสามารถทำซ้ำได้ ลิงก์อยู่ท้ายบทความ
เหตุผลที่ฉันเริ่มต้นสิ่งนี้
ฉันชื่อ Kuan Zou ก่อนหน้า Octen ฉันเป็นหัวหน้าฝ่ายผลิตภัณฑ์ด้าน AI Search ที่ Alibaba Cloud เป็นเวลาห้าปี โดยดูแลระบบที่ให้บริการผู้ใช้หลายร้อยล้านคน
ก่อนหน้านั้น ฉันสร้างแพลตฟอร์มการค้นหาระดับองค์กรของ Baidu ขึ้นจากศูนย์
ทุกปีที่ Alibaba หน้าที่ของฉันคือการเอาตัวรอดจาก Black Friday คำค้นหาหลายพันล้านครั้งในหนึ่งวัน และไม่มีความผิดพลาดใดๆ ได้รับการยอมรับ
ดังนั้นเมื่อฉันมองดู API การค้นหาที่มอบให้กับ AI Agent ฉันรู้สึกประหลาดใจจริงๆ ส่วนใหญ่เริ่มทำงานผิดพลาดเมื่อจำนวนคำค้นหาต่อวินาทีถึงหลักสิบ
Agent ที่ทำงานจริงจะทริกเกอร์การค้นหา 20, 50, 100 ครั้งพร้อมกัน โครงสร้างพื้นฐานที่ Agent พึ่งพามากที่สุดคือส่วนที่ล้มเหลวก่อน
เราระดมทุน $10M Seed นำโดย Square Peg รวบรวมทีมงานจาก Alibaba, Baidu, Meta, Google, TikTok, DeepSeek และ Xiaohongshu และเริ่มทำงาน
จากเชิงเส้นไปสู่การทำงานพร้อมกัน
ให้ Octen ตั้งคำถามหนึ่งข้อ มันจะแยกย่อยเป็นคำถามย่อยหลายสิบข้อ ยิงพวกมันทั้งหมดพร้อมกัน และรวบรวมทุกสิ่งที่ส่งกลับมาเป็นคำตอบเดียว
ไม่ใช่ครั้งละหนึ่งคำถาม แต่ทั้งหมดในคราวเดียว



นี่คือสิ่งที่มันทำกับการวิจัยเชิงลึก: รายงานที่มาพร้อมแหล่งอ้างอิงที่สมบูรณ์ภายในเวลาไม่ถึง 3 นาที ระบบที่ใช้เวลามากกว่าหนึ่งชั่วโมงกับงานเดียวกันนั้นทำคะแนนต่ำกว่าเราบน DeepResearch Bench

ที่ความเร็ว 62ms การค้นหาจะหยุดทำตัวเหมือนเครื่องมือภายนอกและเริ่มทำตัวเหมือนหน่วยความจำ
Agent ของคุณใช้เหตุผลบนเว็บสดด้วยความเร็วใกล้เคียงกับความเร็วที่มันใช้เหตุผลบนบริบทของตัวเอง
สิ่งนี้เปิดโอกาสให้กับแอปพลิเคชันที่ไม่สามารถทำได้ในทางปฏิบัติมาก่อน Agent การซื้อขายแบบเรียลไทม์ ข้อมูลกีฬาสดและตลาด Agent เสียงที่ตอบกลับโดยไม่มีการหยุดชะงักที่น่าอึดอัดใจ

สร้างมาเพื่อความน่าเชื่อถือ
บัญชี Octen เดียวรองรับคำค้นหามากกว่า 1,000,000 ครั้งต่อวินาที เนื้อหาใหม่จะถูกจัดทำดัชนีภายใน 5 นาทีหลังจากเผยแพร่
เรายังเสนอ QPS ที่รับประกันพร้อม SLA
เท่าที่ฉันรู้ เราเป็นรายเดียวในหมวดนี้ที่สามารถสัญญาเรื่องนี้ได้ เพราะมันเป็นไปได้ก็ต่อเมื่อคุณเป็นเจ้าของดัชนีแบบ end-to-end เราทำได้

นอกเหนือจากข้อความ เรายังมีการค้นหารูปภาพและค้นหาวิดีโอ และเรายึดโยงการสร้างรูปภาพและวิดีโอกับข้อมูลอ้างอิงจริงจากเว็บสด
เลเยอร์นี้อยู่ในช่วง Early Access ในขณะนี้

ทำไมถึงถูกกว่าถึง 5 เท่า
ไม่มีเคล็ดลับอะไร
ผลิตภัณฑ์ "การค้นหาสำหรับ AI" ส่วนใหญ่สร้างขึ้นบนชุดเครื่องมือค้นหาโอเพนซอร์สที่ออกแบบมาสำหรับมนุษย์ พวกเขาเอาเครื่องยนต์ที่อยู่เบื้องหลังช่องค้นหาแล้วย้ายไปไว้เบื้องหลัง API
เทคโนโลยีไม่ได้เปลี่ยนแปลง มีเพียงอินเทอร์เฟซเท่านั้นที่เปลี่ยนไป การเรียกสิ่งนั้นว่า "การค้นหาสำหรับ AI" ไม่สมเหตุสมผลเลย
เราสร้างทุกอย่างขึ้นมาใหม่ เครื่องมือค้นหา การจัดอันดับ เลเยอร์การให้บริการ ทั้งหมดเขียนขึ้นจากศูนย์เพื่อการบริโภคของเครื่องจักร ไม่มีอะไรในสแต็คของเราที่ออกแบบมาสำหรับคนที่เลื่อนดูผลลัพธ์
นั่นคือเหตุผลที่ทำให้ราคานี้เป็นไปได้ เครื่องยนต์ที่เน้น AI อย่างแท้จริงไม่ได้รับภาระค่าใช้จ่ายจากการค้นหาของมนุษย์ที่สะสมมาสามสิบปี ธุรกิจนี้มีสุขภาพดีที่ $1 ต่อ 1,000 ครั้ง นี่ไม่ใช่เงินอุดหนุนที่กำลังจะหมดอายุ
ราคาคือหลักฐานที่ซื่อสัตย์ที่สุดของสถาปัตยกรรม ใครๆ ก็อ้างได้ว่าการค้นหาของพวกเขาสร้างขึ้นสำหรับ AI โครงสร้างต้นทุนแสดงให้เห็นว่ามันเป็นความจริงหรือไม่
บางบริษัทในหมวดนี้รัน API ของเรากับ API ของพวกเขาทุกวัน
ฉันถือว่ามันเป็นคำชม
ทำไมฉันถึงแบ่งปันทุกอย่าง
การรู้ว่าเราทำอะไรและสามารถสร้างมันขึ้นมาได้นั้นเป็นคนละปัญหากัน
คูเมืองของเราคือทีมที่ใช้เวลาหนึ่งทศวรรษในการจัดการกับการเข้าชมการค้นหาที่ยากที่สุดในโลก
ผู้บุกเบิกกลุ่มแรกได้ให้ความรู้แก่ตลาด และฉันรู้สึกขอบคุณสำหรับสิ่งนั้น
แต่นักพัฒนามักจะตรวจสอบตัวเลข และพวกเขาเลือกเส้นทางที่ทำงานได้ดีที่สุดและมีต้นทุนต่ำที่สุด
ฉันคิดว่านั่นคือตลาดที่ซื่อสัตย์ที่สุดในโลก
ผู้เล่นรายเดิมใช้เวลาสองปีที่ผ่านมากับการตลาด เราทุ่มเทเวลานั้นให้กับวิศวกรรม
ตอนนี้วิศวกรรมก็เปิดเผยต่อสาธารณะแล้ว
ยุคแห่งกายภาพ
AI รุ่นต่อไปไม่ได้อยู่บนหน้าจอ
แว่นตา หุ่นยนต์ โมเดลโลก ในโลกนั้น การค้นหากลายเป็นดวงตา: การรับรู้แบบเรียลไทม์ของเว็บสด
หุ่นยนต์ไม่สามารถรอคำตอบ 3 วินาทีได้
เมื่อการค้นหาส่งคืนผลลัพธ์ในหลักสิบมิลลิวินาที ปฏิสัมพันธ์แบบเรียลไทม์สำหรับ AI ทางกายภาพก็สามารถทะลุผ่านคอขวดที่คอยฉุดรั้งมันไว้ได้ในที่สุด
ในยุคสมัยนั้น ฉันไม่เชื่อว่าสิ่งใดก็ตามที่มีความหน่วงเกิน 100ms จะอยู่รอดได้ วันนี้เราเป็นรายเดียวที่อยู่ต่ำกว่าเกณฑ์นั้น
สแต็ค Agent กำลังตกผลึกเป็นสามส่วน: โมเดลพื้นฐาน, GPU และการค้นหาสด
สองอย่างแรกเป็นปัญหาที่แก้ไขแล้วและมีผู้ชนะที่ชัดเจน ส่วนที่สามยังคงถูกตัดสินอยู่ นั่นคือการแข่งขันที่เราตั้งใจจะชนะ
ลองด้วยตัวเอง
เกณฑ์มาตรฐานเป็นแบบสาธารณะและ API เปิดให้ใช้งาน
$1 ต่อ 1,000 ครั้ง พร้อมเครดิตฟรี $5 ใช้งานได้ในรูปแบบ API, Skills, ผ่าน MCP และจาก CLI มันทำงานได้ใน Claude Code, Cursor, VS Code และ MCP client ใดๆ
รันเรากับสิ่งที่คุณใช้อยู่ในปัจจุบัน
คำค้นหาเดียวกัน เปรียบเทียบเคียงข้างกัน โพสต์สิ่งที่คุณพบ
บริษัทในหมวดนี้ทดสอบมาตรฐานเราทุกวันอยู่แล้ว และคุณก็ควรทำเช่นกัน
เอกสาร: docs.octen.ai
หมายเหตุ: ตัวเลขความหน่วงและความแม่นยำวัดบน SealQA Hard, FreshQA Strict และ SimpleQA วันที่และภูมิภาคที่ทดสอบถูกประทับไว้บนแผนภูมิแต่ละอัน ทำซ้ำเกณฑ์มาตรฐาน: https://github.com/Octen-Team/search-eval





