เราซุ่มพัฒนาและสร้างระบบค้นหาที่ เร็วที่สุด ในโลก

@KZouAPT
อังกฤษ7 ชั่วโมงที่ผ่านมา · 21 ก.ค. 2569
399K
351
82
146
138

TL;DR

Octen แนะนำ AI-native search API ที่ออกแบบมาเพื่อรองรับ high-concurrency agents โดยเฉพาะ ด้วยความหน่วงระดับ 62ms และราคาที่คุ้มค่าเพียง 1 ดอลลาร์ ต่อ 1,000 การเรียกใช้งาน พัฒนาโดยผู้เชี่ยวชาญด้านระบบค้นหา เพื่อเข้ามาแทนที่ stack การค้นหาแบบเดิมที่เน้นมนุษย์เป็นศูนย์กลาง

การค้นหาถูกสร้างขึ้นเพื่อมนุษย์ คุณพิมพ์คำค้นหาหนึ่งคำ สแกนผลลัพธ์ ปรับแต่ง แล้วลองอีกครั้ง

โครงสร้างพื้นฐานที่สร้างขึ้นมากว่าสามสิบปีถูกออกแบบมาเพื่อวนซ้ำดังกล่าว

AI Agent ไม่ได้ทำงานแบบนั้น Agent ต้องการถามคำถามจากหลายมุมพร้อมกัน และรับทุกอย่างกลับมาพร้อมกัน

แต่ API การค้นหาที่ป้อนข้อมูลให้กับ Agent ในปัจจุบันนั้นเป็นวงจรของมนุษย์แบบเดิมที่ถูกห่อหุ้มด้วย endpoint

หนึ่งคำค้นหาเข้า หนึ่งคำตอบออก แต่ละครั้งใช้เวลาหลายร้อยมิลลิวินาที

เราทุ่มเทเวลาตลอดปีที่ผ่านมาเพื่อสร้างเครื่องมือค้นหาขึ้นใหม่สำหรับสิ่งที่เป็นผู้ค้นหาจริงๆ เราไม่ได้โพสต์เกี่ยวกับมันมากนัก

พูดตามตรง เรายังไม่พร้อม ช่วงต้นปีนี้ฉันรู้สึกว่าเราอาจจะอยู่ที่ประมาณ 70% ของความคาดหวังของเราเอง และฉันไม่อยากสร้างกระแสเกี่ยวกับตัวเลข 70%

ตอนนี้เราพร้อมแล้ว

ตัวเลข

API การค้นหาเว็บของ Octen ส่งคืนผลลัพธ์ใน 62ms (P50) โดยมี P90 ที่ 68ms ซึ่งวัดจากชุดทดสอบ SealQA Hard

ซึ่งเร็วกว่า Exa, Parallel และบริการที่คล้ายกันหลายเท่า

ทางเลือกที่เร็วที่สุดวัดได้ประมาณ 244ms ส่วนที่ช้าที่สุดสูงกว่า 2.6 วินาที

Kuan Zou - inline image

รายละเอียดหนึ่งในแผนภูมินี้สำคัญกว่าพาดหัวข่าว นั่นคือช่องว่างระหว่าง P50 และ P90 ของเราคือ 6ms สำหรับบางบริการอาจมากกว่าหนึ่งวินาที

หาก Agent ของคุณไม่สามารถคาดการณ์ได้ว่าการค้นหาจะใช้เวลานานเท่าใด มันก็ไม่สามารถวางแผนรอบการทำงานนั้นได้

ราคาอยู่ที่ $1 ต่อ 1,000 ครั้ง บริการส่วนใหญ่ในหมวดนี้คิดราคาระหว่าง $4 ถึง $9

ในด้านคุณภาพ: Octen Embedding อยู่อันดับ #1 บน RTEB และโมเดล VL embedding ของเราอยู่อันดับ #1 บน MMEB-v2

เราปล่อยโอเพนซอร์สโมเดล text embedding และพวกมันถูกดาวน์โหลดมากกว่า 500,000 ครั้งในห้าเดือน

บน DeepResearch Bench เราทำคะแนนสูงกว่า OpenAI Deep Research, Gemini และ Grok อยู่ 10 ถึง 17 คะแนน

บน FreshQA Strict และ SimpleQA เรานำหน้าทุกผู้จำหน่ายที่เราทดสอบด้วย

Kuan Zou - inline image

หมายเหตุ: เกณฑ์มาตรฐานทั้งหมดได้รับการเผยแพร่และสามารถทำซ้ำได้ ลิงก์อยู่ท้ายบทความ

เหตุผลที่ฉันเริ่มต้นสิ่งนี้

ฉันชื่อ Kuan Zou ก่อนหน้า Octen ฉันเป็นหัวหน้าฝ่ายผลิตภัณฑ์ด้าน AI Search ที่ Alibaba Cloud เป็นเวลาห้าปี โดยดูแลระบบที่ให้บริการผู้ใช้หลายร้อยล้านคน

ก่อนหน้านั้น ฉันสร้างแพลตฟอร์มการค้นหาระดับองค์กรของ Baidu ขึ้นจากศูนย์

ทุกปีที่ Alibaba หน้าที่ของฉันคือการเอาตัวรอดจาก Black Friday คำค้นหาหลายพันล้านครั้งในหนึ่งวัน และไม่มีความผิดพลาดใดๆ ได้รับการยอมรับ

ดังนั้นเมื่อฉันมองดู API การค้นหาที่มอบให้กับ AI Agent ฉันรู้สึกประหลาดใจจริงๆ ส่วนใหญ่เริ่มทำงานผิดพลาดเมื่อจำนวนคำค้นหาต่อวินาทีถึงหลักสิบ

Agent ที่ทำงานจริงจะทริกเกอร์การค้นหา 20, 50, 100 ครั้งพร้อมกัน โครงสร้างพื้นฐานที่ Agent พึ่งพามากที่สุดคือส่วนที่ล้มเหลวก่อน

เราระดมทุน $10M Seed นำโดย Square Peg รวบรวมทีมงานจาก Alibaba, Baidu, Meta, Google, TikTok, DeepSeek และ Xiaohongshu และเริ่มทำงาน

จากเชิงเส้นไปสู่การทำงานพร้อมกัน

ให้ Octen ตั้งคำถามหนึ่งข้อ มันจะแยกย่อยเป็นคำถามย่อยหลายสิบข้อ ยิงพวกมันทั้งหมดพร้อมกัน และรวบรวมทุกสิ่งที่ส่งกลับมาเป็นคำตอบเดียว

ไม่ใช่ครั้งละหนึ่งคำถาม แต่ทั้งหมดในคราวเดียว

Kuan Zou - inline image
Kuan Zou - inline image
Kuan Zou - inline image

นี่คือสิ่งที่มันทำกับการวิจัยเชิงลึก: รายงานที่มาพร้อมแหล่งอ้างอิงที่สมบูรณ์ภายในเวลาไม่ถึง 3 นาที ระบบที่ใช้เวลามากกว่าหนึ่งชั่วโมงกับงานเดียวกันนั้นทำคะแนนต่ำกว่าเราบน DeepResearch Bench

Kuan Zou - inline image

ที่ความเร็ว 62ms การค้นหาจะหยุดทำตัวเหมือนเครื่องมือภายนอกและเริ่มทำตัวเหมือนหน่วยความจำ

Agent ของคุณใช้เหตุผลบนเว็บสดด้วยความเร็วใกล้เคียงกับความเร็วที่มันใช้เหตุผลบนบริบทของตัวเอง

สิ่งนี้เปิดโอกาสให้กับแอปพลิเคชันที่ไม่สามารถทำได้ในทางปฏิบัติมาก่อน Agent การซื้อขายแบบเรียลไทม์ ข้อมูลกีฬาสดและตลาด Agent เสียงที่ตอบกลับโดยไม่มีการหยุดชะงักที่น่าอึดอัดใจ

Kuan Zou - inline image

สร้างมาเพื่อความน่าเชื่อถือ

บัญชี Octen เดียวรองรับคำค้นหามากกว่า 1,000,000 ครั้งต่อวินาที เนื้อหาใหม่จะถูกจัดทำดัชนีภายใน 5 นาทีหลังจากเผยแพร่

เรายังเสนอ QPS ที่รับประกันพร้อม SLA

เท่าที่ฉันรู้ เราเป็นรายเดียวในหมวดนี้ที่สามารถสัญญาเรื่องนี้ได้ เพราะมันเป็นไปได้ก็ต่อเมื่อคุณเป็นเจ้าของดัชนีแบบ end-to-end เราทำได้

Kuan Zou - inline image

นอกเหนือจากข้อความ เรายังมีการค้นหารูปภาพและค้นหาวิดีโอ และเรายึดโยงการสร้างรูปภาพและวิดีโอกับข้อมูลอ้างอิงจริงจากเว็บสด

เลเยอร์นี้อยู่ในช่วง Early Access ในขณะนี้

Kuan Zou - inline image

ทำไมถึงถูกกว่าถึง 5 เท่า

ไม่มีเคล็ดลับอะไร

ผลิตภัณฑ์ "การค้นหาสำหรับ AI" ส่วนใหญ่สร้างขึ้นบนชุดเครื่องมือค้นหาโอเพนซอร์สที่ออกแบบมาสำหรับมนุษย์ พวกเขาเอาเครื่องยนต์ที่อยู่เบื้องหลังช่องค้นหาแล้วย้ายไปไว้เบื้องหลัง API

เทคโนโลยีไม่ได้เปลี่ยนแปลง มีเพียงอินเทอร์เฟซเท่านั้นที่เปลี่ยนไป การเรียกสิ่งนั้นว่า "การค้นหาสำหรับ AI" ไม่สมเหตุสมผลเลย

เราสร้างทุกอย่างขึ้นมาใหม่ เครื่องมือค้นหา การจัดอันดับ เลเยอร์การให้บริการ ทั้งหมดเขียนขึ้นจากศูนย์เพื่อการบริโภคของเครื่องจักร ไม่มีอะไรในสแต็คของเราที่ออกแบบมาสำหรับคนที่เลื่อนดูผลลัพธ์

นั่นคือเหตุผลที่ทำให้ราคานี้เป็นไปได้ เครื่องยนต์ที่เน้น AI อย่างแท้จริงไม่ได้รับภาระค่าใช้จ่ายจากการค้นหาของมนุษย์ที่สะสมมาสามสิบปี ธุรกิจนี้มีสุขภาพดีที่ $1 ต่อ 1,000 ครั้ง นี่ไม่ใช่เงินอุดหนุนที่กำลังจะหมดอายุ

ราคาคือหลักฐานที่ซื่อสัตย์ที่สุดของสถาปัตยกรรม ใครๆ ก็อ้างได้ว่าการค้นหาของพวกเขาสร้างขึ้นสำหรับ AI โครงสร้างต้นทุนแสดงให้เห็นว่ามันเป็นความจริงหรือไม่

บางบริษัทในหมวดนี้รัน API ของเรากับ API ของพวกเขาทุกวัน

ฉันถือว่ามันเป็นคำชม

ทำไมฉันถึงแบ่งปันทุกอย่าง

การรู้ว่าเราทำอะไรและสามารถสร้างมันขึ้นมาได้นั้นเป็นคนละปัญหากัน

คูเมืองของเราคือทีมที่ใช้เวลาหนึ่งทศวรรษในการจัดการกับการเข้าชมการค้นหาที่ยากที่สุดในโลก

ผู้บุกเบิกกลุ่มแรกได้ให้ความรู้แก่ตลาด และฉันรู้สึกขอบคุณสำหรับสิ่งนั้น

แต่นักพัฒนามักจะตรวจสอบตัวเลข และพวกเขาเลือกเส้นทางที่ทำงานได้ดีที่สุดและมีต้นทุนต่ำที่สุด

ฉันคิดว่านั่นคือตลาดที่ซื่อสัตย์ที่สุดในโลก

ผู้เล่นรายเดิมใช้เวลาสองปีที่ผ่านมากับการตลาด เราทุ่มเทเวลานั้นให้กับวิศวกรรม

ตอนนี้วิศวกรรมก็เปิดเผยต่อสาธารณะแล้ว

ยุคแห่งกายภาพ

AI รุ่นต่อไปไม่ได้อยู่บนหน้าจอ

แว่นตา หุ่นยนต์ โมเดลโลก ในโลกนั้น การค้นหากลายเป็นดวงตา: การรับรู้แบบเรียลไทม์ของเว็บสด

หุ่นยนต์ไม่สามารถรอคำตอบ 3 วินาทีได้

เมื่อการค้นหาส่งคืนผลลัพธ์ในหลักสิบมิลลิวินาที ปฏิสัมพันธ์แบบเรียลไทม์สำหรับ AI ทางกายภาพก็สามารถทะลุผ่านคอขวดที่คอยฉุดรั้งมันไว้ได้ในที่สุด

ในยุคสมัยนั้น ฉันไม่เชื่อว่าสิ่งใดก็ตามที่มีความหน่วงเกิน 100ms จะอยู่รอดได้ วันนี้เราเป็นรายเดียวที่อยู่ต่ำกว่าเกณฑ์นั้น

สแต็ค Agent กำลังตกผลึกเป็นสามส่วน: โมเดลพื้นฐาน, GPU และการค้นหาสด

สองอย่างแรกเป็นปัญหาที่แก้ไขแล้วและมีผู้ชนะที่ชัดเจน ส่วนที่สามยังคงถูกตัดสินอยู่ นั่นคือการแข่งขันที่เราตั้งใจจะชนะ

ลองด้วยตัวเอง

เกณฑ์มาตรฐานเป็นแบบสาธารณะและ API เปิดให้ใช้งาน

$1 ต่อ 1,000 ครั้ง พร้อมเครดิตฟรี $5 ใช้งานได้ในรูปแบบ API, Skills, ผ่าน MCP และจาก CLI มันทำงานได้ใน Claude Code, Cursor, VS Code และ MCP client ใดๆ

รันเรากับสิ่งที่คุณใช้อยู่ในปัจจุบัน

คำค้นหาเดียวกัน เปรียบเทียบเคียงข้างกัน โพสต์สิ่งที่คุณพบ

บริษัทในหมวดนี้ทดสอบมาตรฐานเราทุกวันอยู่แล้ว และคุณก็ควรทำเช่นกัน

เอกสาร: docs.octen.ai

หมายเหตุ: ตัวเลขความหน่วงและความแม่นยำวัดบน SealQA Hard, FreshQA Strict และ SimpleQA วันที่และภูมิภาคที่ทดสอบถูกประทับไว้บนแผนภูมิแต่ละอัน ทำซ้ำเกณฑ์มาตรฐาน: https://github.com/Octen-Team/search-eval

สร้างต่อใน YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
สำหรับครีเอเตอร์

เปลี่ยน Markdown ของคุณให้เป็นบทความ 𝕏 ที่สะอาดตา

เวลาคุณเผยแพร่งานเขียนยาวของตัวเอง การจัดรูปแบบรูปภาพ ตาราง และบล็อกโค้ดให้เข้ากับ 𝕏 นั้นน่าปวดหัว YouMind เปลี่ยนร่าง Markdown ทั้งฉบับให้เป็นบทความ 𝕏 ที่สะอาดตาและพร้อมโพสต์ทันที

ลอง Markdown เป็น 𝕏

แพตเทิร์นให้ถอดรหัสเพิ่มเติม

บทความไวรัลล่าสุด

สำรวจบทความไวรัลเพิ่มเติม