ผมจะจัดระเบียบข้อมูลเป็น "สิ่งที่เขียนในโค้ด" "สิ่งที่เขียนเฉพาะใน README" และ "สิ่งที่ไม่ได้เขียนไว้ที่ไหนเลย"
ทำไมผมถึงเขียนบทความนี้
วันที่ 15 พฤษภาคม อีลอน มัสก์ประกาศว่าอัลกอริทึม X ถูกปล่อยบน GitHub หลังจากนั้นไม่นาน โพสต์จำนวนมากเกี่ยวกับ "วิธีเอาชนะอัลกอริทึม X ตัวใหม่" ก็เริ่มแพร่กระจาย สิ่งที่รบกวนจิตใจผมขณะอ่านคือบางโพสต์อ้างกฎเฉพาะเจาะจงที่ไม่ได้อยู่ในโค้ด พร้อมกับอ้างว่า "ได้อ่านโค้ดแล้ว" ผมเลยตัดสินใจตรวจสอบด้วยตัวเอง และให้ (AI) อ่านโค้ดบน GitHub ในบทความนี้ ผมจะจัดระเบียบสิ่งที่ยืนยันได้และยืนยันไม่ได้
โครงสร้างของบทความนี้
ผมจะเขียนข้อมูลเป็นสามชั้น:
- สิ่งที่ยืนยันได้โดยตรงจากโค้ด
- สิ่งที่เขียนใน README แต่ไม่ยืนยันในโค้ด (ในระดับ "ตามเอกสารทางการ")
- สิ่งที่กำลังแพร่กระจายบน X ซึ่งไม่ได้เขียนในโค้ดหรือ README เลย
สิ่งที่ยืนยันได้จากโค้ด
อัปเดตครั้งนี้ใหญ่มาก มีไฟล์มากกว่า 187 ไฟล์และเพิ่มโค้ดมากกว่า 18,000 บรรทัด ในช่วงสี่เดือนนับตั้งแต่ปล่อยครั้งแรกในเดือนมกราคม เนื้อหาเปลี่ยนแปลงไปมาก
Grox ตอนนี้ "เห็น" โพสต์เพื่อตัดสินคุณภาพ
การเปลี่ยนแปลงครั้งใหญ่ที่สุดในครั้งนี้คือการสร้างบริการตรวจสอบเนื้อหาที่ชื่อ Grox ขึ้นมาอย่างสมบูรณ์ มันไม่มีอยู่ในโค้ดที่ปล่อยในเดือนมกราคม (ถึงแม้ผมจะบอกไม่ได้แน่ชัดว่าฟังก์ชันที่คล้ายกันไม่มีอยู่ในสภาพแวดล้อม X จริง) แกนหลักของ Grox คือ VLM (Vision Language Model) VLM คือ AI ที่สามารถเข้าใจไม่เพียงแค่ข้อความ แต่ยังรวมถึงรูปภาพและเฟรมวิดีโอด้วย มันไม่ได้แค่ "อ่านข้อความ" แต่ยัง "ดูรูปภาพและตัดสินใจ" ได้ Grox ทำสามอย่างหลักๆ:
การให้คะแนนคุณภาพโพสต์ (Banger Screen)
"คะแนน Banger" คือคะแนนตั้งแต่ 0 ถึง 1 ที่ AI ให้คะแนนว่าโพสต์นั้นเป็น "เนื้อหาที่มีคุณค่าและมีแนวโน้มจะกลายเป็นไวรัล" โค้ดมีเกณฑ์ "คะแนน >= 0.4" โดยที่ 0.4 หรือสูงกว่าถือว่าผ่าน
การตรวจจับสแปม
VLM ตรวจสอบว่าโพสต์เป็นสแปมหรือไม่ โดยเน้นที่โพสต์จากบัญชีที่มีผู้ติดตามน้อย
การตรวจจับความปลอดภัยและการละเมิดนโยบาย
Grox ตัดสินเจ็ดประเภทดังนี้:
- สื่อรุนแรง
- เนื้อหาสำหรับผู้ใหญ่
- สแปม
- กิจกรรมผิดกฎหมาย/ถูกควบคุม
- ความเกลียดชัง/การคุกคาม
- คำพูดรุนแรง
- การฆ่าตัวตาย/ทำร้ายตัวเอง
ในโค้ดยังมีกลไกในการตรวจสอบเพิ่มเติมสำหรับสื่อรุนแรงและเนื้อหาสำหรับผู้ใหญ่โดยใช้โมเดลอนุมานที่มีความแม่นยำสูงกว่า อย่างไรก็ตาม ไม่สามารถยืนยันจากโค้ดสาธารณะเพียงอย่างเดียวได้ว่าโพสต์ใดบ้างที่ถูกตรวจสอบเพิ่มเติม
กลไกที่มีอยู่ตั้งแต่ปล่อยเดือนมกราคม
จากนี้ไป ไม่ใช่ "ฟีเจอร์ใหม่" แต่เป็นกลไกที่มีอยู่ตั้งแต่ปล่อยครั้งแรกในเดือนมกราคม "คำอธิบายอัลกอริทึมล่าสุด" หลายอันบน X ผสมโค้ดเดือนมกราคมและเดือนพฤษภาคมเข้าด้วยกันโดยไม่แยกแยะ ถ้าคุณแค่ให้ AI สรุป GitHub ฟีเจอร์จากสี่เดือนที่แล้วจะถูกนำเสนอเป็น "การเปลี่ยนแปลงครั้งนี้"
การบล็อก การปิดเสียง และการรายงานลดคะแนน (ตั้งแต่เดือนมกราคม)
จากโครงสร้างของโค้ด ยืนยันได้ว่าการกระทำต่อไปนี้ถูกนำมาเป็นสัญญาณเชิงลบในสูตรการคำนวณ:
- ไม่สนใจ
- บล็อก
- ปิดเสียง
- รายงาน
นอกจากนี้ ตัวให้คะแนนการจัดอันดับ (ranking_scorer.rs) ใน Home Mixer รวมถึงกระบวนการลดอคติเพื่อไม่ให้โพสต์จากบัญชีเดียวกันปรากฏบ่อยเกินไปใน "สำหรับคุณ" นี่เป็นกลไกที่มีอยู่ตั้งแต่เดือนมกราคมเช่นกัน เมื่อมีโพสต์หลายอันจากบัญชีเดียวกันปรากฏในฟีดของคนคนหนึ่ง คะแนนของโพสต์ที่สองและต่อมาจะลดลงแบบทวีคูณ

นี่คือเพื่อให้มีความหลากหลาย—"ไม่ให้ฟีดของคนคนหนึ่งเต็มไปด้วยโพสต์ของคุณ"—และไม่ได้จำกัดจำนวนโพสต์ทั้งหมดต่อวัน
สิ่งที่เขียนใน README แต่ไม่ยืนยันในโค้ด
"การยกเลิกกฎที่เขียนด้วยมือเกือบทั้งหมด" เป็นจริงครึ่งเดียว
README ทางการระบุหลักการออกแบบ: "เราได้ยกเลิกฟีเจอร์และกฎฮิวริสติกที่เขียนด้วยมือเกือบทั้งหมด" นี่ไม่ใช่คำอธิบายที่เพิ่มในเดือนพฤษภาคม เป็นข้ออ้างที่มีอยู่ใน README ตั้งแต่ปล่อยครั้งแรกในเดือนมกราคม
อย่างไรก็ตาม เมื่อดูที่โค้ด เลเยอร์การกรอง (การยกเว้นโพสต์เก่า การยกเว้นคีย์เวิร์ดที่ถูกปิดเสียง ฯลฯ) ยังคงเป็นแบบใช้กฎ
สิ่งที่ "ถูกยกเลิก" คือเกณฑ์สำหรับการจัดอันดับและการให้คะแนน ไม่ใช่การกรอง และโครงสร้างนี้ไม่ได้เปลี่ยนแปลงในการอัปเดตครั้งนี้
การเปลี่ยนแปลงที่ทางการรับรู้ใน README เดือนพฤษภาคม
ส่วนเฉพาะชื่อ "Updates — May 15th, 2026" ถูกสร้างขึ้นใหม่ใน README วันที่ 15 พฤษภาคม และการเปลี่ยนแปลงครั้งนี้ถูกระบุอย่างชัดเจนเป็นเจ็ดข้อ การเพิ่มของ Grox, การรวม Ad, Query hydrators, Candidate hydrators และ Candidate sources ทั้งหมดถูกระบุไว้ที่นี่
กล่าวอีกนัยหนึ่ง README ตอบว่า "ฟีเจอร์ใหม่ครั้งนี้คืออะไร" กลไกที่มีอยู่ตั้งแต่เดือนมกราคมไม่ปรากฏในส่วนนี้
"วิธี" ที่ Banger Score ส่งผลต่อการจัดอันดับไม่เปิดเผย
"การตัดสินว่าผ่านที่คะแนน 0.4 หรือสูงกว่า" ยืนยันได้จากโค้ด อย่างไรก็ตาม โค้ดที่แสดงว่าผลลัพธ์นั้นส่งผลต่อการจัดอันดับอย่างไรไม่ได้รวมอยู่ใน repository ที่ปล่อยครั้งนี้ เราไม่สามารถยืนยัน ณ จุดนี้ได้ว่า "ต่ำกว่า 0.4 จะไม่ถูกแสดง" หรือ "0.4 ขึ้นไปจะได้รับการบูสต์"
ค่าน้ำหนักการมีส่วนร่วมอาจไม่ใช่ค่าที่ใช้งานจริง
ค่าต่อไปนี้เขียนไว้ใน inference pipeline เพื่อสาธิต:
- ไลค์: 1.0
- ตอบกลับ: 0.5
- รีโพสต์: 0.3
- เวลาที่อยู่อ่าน: 0.2
อย่างไรก็ตาม โค้ดฝั่งโปรดักชันจัดการด้วยพารามิเตอร์แบบไดนามิก (รองรับการทดสอบ A/B) และค่าไม่ได้ถูกฮาร์ดโค้ด เราไม่สามารถยืนยันได้ว่าค่าเหล่านี้เป็นค่าจริงในโปรดักชันหรือไม่
สิ่งที่ไม่ได้เขียนในโค้ดหรือ README เลย
ข้อมูลต่อไปนี้ ซึ่งกำลังแพร่กระจายบน X ในฐานะ "วิธีเอาชนะอัลกอริทึมใหม่" ไม่ได้เขียนไว้ที่ไหนในโค้ด:
- การเข้าถึงลดลงถ้าคุณโพสต์มากกว่า 4 ครั้งต่อวัน
- การตอบกลับภายใน 30 นาทีหลังจากโพสต์ทำให้เกิดการระเบิดของห่วงโซ่การสนทนา
- รูปภาพ 3-5 ใบดีที่สุด
- วิดีโอ 30-90 วินาทีมีประสิทธิภาพเป็นพิเศษ
เหตุผลที่ข้อมูลนี้แพร่กระจายเพราะคนผสมข้อเท็จจริงที่ว่า "อัลกอริทึมเปลี่ยนเมื่อวันที่ 15 พฤษภาคม" กับ "กฎที่ได้จากประสบการณ์ของตัวเอง" ในโพสต์เดียวกัน เพราะผู้อ่านได้รับข้อมูลภายใต้ความน่าเชื่อถือของ "ฉันรู้เพราะอ่านโค้ด" ความคิดเห็นส่วนตัวจึงดูเหมือนข้อกำหนดของอัลกอริทึม
สรุป
ถ้าผมจะสรุปอัปเดตวันที่ 15 พฤษภาคมในหนึ่งประโยค มันจะเป็นแบบนี้:
"กลไกการจัดอันดับ" แทบจะไม่เปลี่ยนแปลง "กลไกการอ่านเนื้อหาโพสต์" ถูกเพิ่มเข้ามาทั้งหมด
แกนหลักของว่าจะแสดงโพสต์ของใครในลำดับใด—การทำนายการมีส่วนร่วม สัญญาณเชิงลบ และการรับประกันความหลากหลายของบัญชี—ไม่เปลี่ยนแปลงตั้งแต่เดือนมกราคม
สิ่งที่เพิ่มเข้ามาครั้งนี้คือส่วน "ตา" ที่ตัดสินว่าโพสต์พูดถึงอะไรและมีคุณค่าหรือไม่
ดังนั้น คำตอบของคำถามเช่น "ควรโพสต์วันละกี่ครั้ง" หรือ "ควรตอบกลับภายในกี่นาที" ไม่ได้อยู่ในโค้ดนี้
มีเพียงข้อเท็จจริงที่ว่า "AI มองโพสต์และตัดสินว่าคุ้มค่าที่จะอ่านหรือไม่" แทนที่จะถูกหลอกด้วยข่าวลือเกี่ยวกับอัลกอริทึมและไล่ตามตัวเลข ผมคิดว่าการถามว่า "โพสต์นี้ให้อะไรกับผู้อ่านหรือไม่" เหมาะกับอัลกอริทึมปัจจุบันมากกว่า
คุณเชื่อใน "กลโกงการเติบโตด้วยอัลกอริทึม" มากแค่ไหน? คุณคิดอย่างไรเมื่อเห็นโค้ดจริง ๆ?
ผมเริ่มใช้ X (เดิมคือ Twitter) ในปี 2017 และตอนนี้เข้าสู่ปีที่ 10 แล้ว และผมชอบการมีส่วนร่วมบน X มันทำให้ผมหงุดหงิดมากเวลาที่คนถูกหลอกโดยสิ่งที่คนอื่นพูดไร้สาระ แล้วตัดสินใจ "จำกัดโพสต์ไว้ที่ 4 ครั้งต่อวัน" ซึ่งขัดขวางการมีส่วนร่วม
ตัวเลขสำคัญ แต่คุณไม่คิดว่าการมีส่วนร่วมก็สำคัญเหรอ? ไม่ว่าอัลกอริทึมจะเปลี่ยนไปอย่างไร ผมอยากทำงานต่อไปพร้อมกับเพลิดเพลินกับการมีส่วนร่วมบน X ผมจะดีใจถ้าคุณยังคงสนุกกับการมีส่วนร่วมกับผมบน X ต่อไป





