YouMind
ลงชื่อเข้าใช้

วิธีที่เราทำให้ Partyline เป็น AI Assistant ที่เร็วที่สุดในโลก

@textpartyline
อังกฤษ06 ต.ค. 2569
1.6M
0
0
2
5

TL;DR

Partyline เล่าเรื่องราวการเดินทางด้านวิศวกรรมเพื่อกลายเป็น AI Assistant ที่เร็วที่สุดใน iMessage โดยลดความล่าช้าในการค้นหาจาก 46 วินาที เหลือน้อยกว่า 3 วินาที ผ่านการทำ pre-indexing สำหรับกิจกรรมท้องถิ่น และการนำ Jev classifiers ที่มีประสิทธิภาพมาใช้งาน

ผู้ช่วย AI จะอยู่รอดหรือดับสูญขึ้นอยู่กับความเร็ว ผู้ช่วยต้องจัดการเรื่องต่าง ๆ ให้คุณได้ แต่บน iMessage มีวิธีบอกให้คุณรู้แค่นิดเดียวว่ากำลังทำงานตามคำขอของคุณอยู่ เช่น tapback, ฟองพิมพ์ข้อความ หรือการตอบกลับสั้น ๆ

Partyline คือผู้ช่วย AI รูปแบบพิเศษใน iMessage ของคุณ เราไม่ได้มุ่งเน้นเรื่องการคัดกรองอีเมล เพราะเราเชื่อว่าในฐานะมนุษย์ คุณไม่ควรต้องไปยุ่งกับอีเมลตั้งแต่แรก เป้าหมายของเราคือการพาคุณออกไปข้างนอก ไปอยู่กับคนอื่น ๆ และมีความสุขให้เต็มที่ ตัวชี้วัดความสำเร็จของผลิตภัณฑ์เราคือปริมาณช่วงเวลาในชีวิตของผู้ใช้ที่คุ้มค่าแก่การใช้ชีวิต

แต่สำหรับผู้ช่วยแล้ว นั่นหมายถึงการแข่งขันในโลกที่วุ่นวายสุดขีด ซึ่งพยายามทำทุกอย่างเพื่อให้ผู้ใช้ของเราเหนื่อยล้า ทำให้พวกเขาซึมเศร้าและไม่มีความสุข แต่เหนือสิ่งอื่นใด คือการแย่งชิงความสนใจของพวกเขา

เพราะคนมักส่งข้อความจากสภาพแวดล้อมที่วุ่นวาย เราจึงต้องเร็ว เรามีเวลาเพียงชั่วครู่กับผู้ใช้ก่อนที่พวกเขาจะเก็บมือถือ (ซึ่งก็ควรทำแบบนั้น!) และเราไม่อยากให้พวกเขามองหน้าจอนานเกินความจำเป็นแม้แต่วินาทีเดียว

ตอนที่เราสร้าง Partyline ขึ้นมา การตอบกลับของเราช้าเกินไป การค้นหาสถานที่หรือกิจกรรมใช้เวลา 29 ถึง 46 วินาที ซึ่งนานมากเมื่อคุณออกไปเที่ยวกับเพื่อน ถ้าคุณเป็นคนหยิบมือถือขึ้นมาหาที่เที่ยวต่อ คุณกำลังเอาเครดิตทางสังคมของตัวเองเป็นเดิมพัน เพราะคุณคือคนที่รู้ว่ากำลังมีอะไรเจ๋ง ๆ เกิดขึ้น แต่พอผ่านไป 46 วินาที คนอื่นก็เสนอที่ไปแล้วและแย่งบทสนทนาไปได้เรียบร้อย

ดังนั้นผู้ช่วยบน iMessage จึงต้องเร็วสุด ๆ แอปทั่วไปจะให้หน้าจอที่คุณควบคุมได้ขณะใช้งาน แต่ iMessage ไม่ใช่แบบนั้น ผู้คนใช้มันในช่วงเวลาที่วุ่นวายและซับซ้อน และผู้ช่วยก็ต้องแข่งกับทุกสิ่งรอบตัวพวกเขา

เราเทียบกับเจ้าอื่นอย่างไร

เราเปรียบเทียบ Partyline กับผู้ช่วยส่วนตัวอีกสองรายบน iMessage คือ Tomo และ Instinct โดย Instinct ช้าที่สุด การค้นหาคำตอบใช้เวลา 42 ถึง 82 วินาที ซึ่งช้าเกินกว่าจะใช้ตอนออกไปเที่ยวกับเพื่อน ส่วน Tomo เก่งเรื่องการสนทนามาก ข้อความแชทตอบกลับภายในไม่กี่วินาที และการค้นหาคำตอบใช้เวลา 28 ถึง 37 วินาที พร้อม tapback ที่ราว 2 วินาที และข้อความแรกที่ประมาณ 5 วินาที

Partyline - inline image

จาก 46 วินาที สู่ 3 วินาที

Tomo ตั้งคำถามพื้นฐานให้เราว่า Partyline จะตอบได้เร็วเท่า Tomo ในการสนทนาได้อย่างไร แต่สำหรับงานที่ใหญ่กว่าอย่างการค้นหาสถานที่และกิจกรรม เราเริ่มต้นที่ 29 ถึง 46 วินาที แต่วันนี้การค้นหาใช้เวลาเพียง 2 ถึง 3 วินาที นับตั้งแต่กดส่งจนถึงได้รับคำตอบ

Partyline - inline image

การเปลี่ยนแปลงสองอย่างสร้างความแตกต่างมากที่สุด

อย่างแรก เราจัดทำดัชนีกิจกรรมล่วงหน้าสำหรับสถานที่ที่ผู้คนถามถึงบ่อยที่สุด ในช่วง Tech Week ของ a16z ที่ซานฟรานซิสโก คลังข้อมูลของเราเก็บกิจกรรมไว้ราว 1,700 รายการต่อสัปดาห์ และการค้นหาจะคัดให้เหลือรายการสั้น ๆ ในเวลาไม่ถึงหนึ่งในสิบวินาที ส่วนพื้นที่ที่ยังไม่ได้จัดทำดัชนี ระบบจะค้นหาผ่านเว็บควบคู่กันไปและให้คำตอบในอีกไม่กี่วินาทีต่อมา

อย่างที่สอง เราใส่ Jev classifiers ไว้หลายจุดใน message pipeline ของเรา Jev คือโมเดล classifier ของ TypeSafe ในการเรียกใช้ครั้งเดียวที่ใช้เวลาประมาณ 0.2 วินาที มันสามารถตอบคำถามเกี่ยวกับข้อความได้มากมาย เช่น เป็นคำขอประเภทไหน เป็นการค้นหาต่อเนื่องจากครั้งก่อนหรือไม่ หรือเป็นเรื่องละเอียดอ่อนหรือเปล่า Jev ยังจัดอันดับกิจกรรมและสถานที่ที่เป็นตัวเลือก และตรวจสอบข้อความตอบกลับแต่ละบรรทัดเทียบกับข้อมูลที่อธิบายไว้อีกด้วย ตอนที่เราใช้โมเดลขนาดใหญ่ตัดสินใจเรื่องเหล่านี้ แต่ละครั้งใช้เวลาประมาณ 4 วินาที

Partyline - inline image

ก้าวต่อไปคืออะไร

ตอนนี้ Partyline ค้นหาคำตอบเสร็จก่อนที่ Tomo จะส่งข้อความแรกเสียอีก และสามารถคุยเล่นกันได้หลายรอบก่อนที่ Instinct จะตอบกลับมาแม้แต่ครั้งเดียว ข้อเสียคือคำตอบบางอย่างอ่านดูไม่ค่อยเหมือนการสนทนา แต่เหมือนการตอบกลับด่วนมากกว่า เรากำลังแก้ไขเรื่องนี้ งานต่อไปของเราคือการปรับระบบให้อยู่ตรงกลาง ที่ยังรู้สึกเร็วทันใจแต่อ่านแล้วเหมือนกำลังคุยกันจริง ๆ

เรายังกำลังสร้างเครื่องมือเพื่อควบคุมต้นทุน inference ให้จับต้องได้เมื่อเราเติบโตขึ้น เพื่อจะได้ไม่ต้องแลกความเร็วหรือคุณภาพกับต้นทุน

วันนี้ Partyline คือผู้ช่วย AI บน iMessage ที่เร็วที่สุดในโลก โดยเฉพาะสำหรับการค้นหากิจกรรม ถ้าคุณอยู่ที่ Tech Week ของ a16z ในซานฟรานซิสโกสัปดาห์นี้ ลองทักไปหา Partyline ดู แล้วจะได้สัมผัสการค้นหากิจกรรมที่เร็วที่สุดเท่าที่เคยเจอ

ลองใช้ได้ที่ Partyline!

บันทึกในคลิกเดียว

อ่านบทความไวรัลเชิงลึกด้วย AI ใน YouMind

บันทึกแหล่งที่มา ถามคำถามที่ตรงประเด็น สรุปข้อโต้แย้ง และเปลี่ยนบทความไวรัลให้เป็นโน้ตที่นำกลับมาใช้ได้ใน AI เวิร์กสเปซเดียว

สำรวจ YouMind
สำหรับครีเอเตอร์

เปลี่ยน Markdown ของคุณให้เป็นบทความ 𝕏 ที่สะอาดตา

เวลาคุณเผยแพร่งานเขียนยาวของตัวเอง การจัดรูปแบบรูปภาพ ตาราง และบล็อกโค้ดให้เข้ากับ 𝕏 นั้นน่าปวดหัว YouMind เปลี่ยนร่าง Markdown ทั้งฉบับให้เป็นบทความ 𝕏 ที่สะอาดตาและพร้อมโพสต์ทันที

ลอง Markdown เป็น 𝕏

แพตเทิร์นให้ถอดรหัสเพิ่มเติม

บทความไวรัลล่าสุด

สำรวจบทความไวรัลเพิ่มเติม