Tôi sẽ tổ chức thông tin thành "Những gì được viết trong code", "Những gì chỉ có trong README" và "Những gì không được viết ở đâu cả".
Tại sao tôi viết bài này
Ngày 15 tháng 5, Elon Musk thông báo rằng thuật toán X đã được phát hành trên GitHub. Ngay sau đó, một lượng lớn bài viết về "cách đánh bại thuật toán X mới" bắt đầu lan truyền. Điều làm tôi khó chịu khi đọc chúng là một số bài viết khẳng định các quy tắc cụ thể không có trong code, trong khi lại tuyên bố đã "đọc code". Tôi quyết định tự kiểm tra và nhờ (một AI) đọc code GitHub. Trong bài viết này, tôi sẽ tổng hợp những gì tôi có thể và không thể xác nhận.
Cấu trúc của bài viết này
Tôi sẽ trình bày thông tin theo ba lớp:
- Những điều được xác nhận trực tiếp trong code
- Những điều được viết trong README nhưng không được xác nhận trong code (ở mức "theo tài liệu chính thức")
- Những điều đang lan truyền trên X mà không có trong code hay README
Những điều được xác nhận trong code
Bản cập nhật này rất lớn, với hơn 187 tệp và 18.000 dòng code được thêm vào. Trong bốn tháng kể từ lần phát hành đầu tiên vào tháng 1, nội dung đã thay đổi đáng kể.
Grox hiện "xem" bài đăng để đánh giá chất lượng
Thay đổi lớn nhất lần này là việc thiết lập hoàn chỉnh một dịch vụ đánh giá nội dung có tên Grox. Nó không tồn tại trong code được phát hành vào tháng 1 (mặc dù tôi không thể khẳng định chắc chắn rằng một chức năng tương tự không tồn tại trong môi trường X thực tế). Cốt lõi của Grox là một VLM (Mô hình ngôn ngữ thị giác). VLM là một AI có thể hiểu không chỉ văn bản, mà còn cả hình ảnh và khung hình video cùng nhau. Nó không chỉ "đọc văn bản"; nó có thể "nhìn vào hình ảnh và đưa ra nhận định". Grox chủ yếu làm ba việc:
Đánh giá chất lượng bài đăng (Banger Screen)
"Điểm Banger" là điểm từ 0 đến 1, nơi AI đánh giá xem một bài đăng có phải là "nội dung có giá trị có khả năng lan truyền" hay không. Code chứa ngưỡng "điểm >= 0.4", trong đó 0.4 trở lên được đánh giá là tích cực.
Phát hiện spam
VLM xác định xem một bài đăng có phải là spam hay không, tập trung vào các bài đăng từ tài khoản có ít người theo dõi.
Phát hiện vi phạm chính sách và an toàn
Grox đánh giá bảy loại sau:
- Phương tiện bạo lực
- Nội dung người lớn
- Spam
- Hoạt động bất hợp pháp/bị quản lý
- Thù ghét/quấy rối
- Lời nói bạo lực
- Tự tử/tự hại
Trong code, cũng có một cơ chế thực hiện kiểm tra bổ sung đối với phương tiện bạo lực và nội dung người lớn bằng cách sử dụng các mô hình suy luận có độ chính xác cao hơn. Tuy nhiên, bài đăng nào bị áp dụng điều này thì không thể xác nhận chỉ từ code công khai.
Cơ chế đã tồn tại từ tháng 1
Từ đây trở đi, đây không phải là "tính năng mới" mà là những cơ chế đã tồn tại từ lần phát hành đầu tiên vào tháng 1. Nhiều "giải thích về thuật toán mới nhất" trên X trộn lẫn code tháng 1 và tháng 5 mà không phân biệt. Nếu bạn chỉ nhờ AI tóm tắt GitHub, các tính năng từ bốn tháng trước sẽ được giới thiệu như "thay đổi lần này".
Chặn, ẩn và báo cáo làm giảm điểm (Từ tháng 1)
Từ cấu trúc code, đã xác nhận rằng các hành động sau được tích hợp vào công thức tính toán như tín hiệu tiêu cực:
- Không quan tâm
- Chặn
- Ẩn
- Báo cáo
Ngoài ra, bộ xếp hạng (ranking_scorer.rs) trong Home Mixer bao gồm một quy trình để triệt tiêu thiên vị, đảm bảo các bài đăng từ cùng một tài khoản không xuất hiện quá thường xuyên trong "Dành cho bạn". Đây cũng là một cơ chế đã tồn tại từ tháng 1; khi nhiều bài đăng từ cùng một tài khoản xuất hiện trong feed của một người, điểm cho bài đăng thứ hai và các bài tiếp theo giảm theo cấp số nhân.

Điều này là để đảm bảo sự đa dạng—"không lấp đầy dòng thời gian của một người bằng bài đăng của bạn"—và không giới hạn tổng số bài đăng mỗi ngày.
Những điều được viết trong README nhưng không được xác nhận trong code
"Hầu như tất cả quy tắc thủ công đều bị bãi bỏ" chỉ đúng một nửa
README chính thức nêu một nguyên tắc thiết kế: "Chúng tôi đã hầu như loại bỏ hoàn toàn các tính năng và heuristic được xây dựng thủ công." Đây không phải là mô tả được thêm vào tháng 5; đó là một tuyên bố đã tồn tại trong README từ lần phát hành đầu tiên vào tháng 1.
Tuy nhiên, khi nhìn vào code, các lớp lọc (loại trừ bài đăng cũ, loại trừ từ khóa bị ẩn, v.v.) vẫn dựa trên quy tắc.
Những gì đã bị "bãi bỏ" là các tiêu chí xếp hạng và tính điểm, không phải là lọc. Và cấu trúc này không thay đổi trong bản cập nhật này.
Những thay đổi được chính thức công nhận trong README tháng 5
Một phần riêng có tiêu đề "Cập nhật — 15 tháng 5, 2026" đã được thiết lập mới trong README ngày 15 tháng 5, và những thay đổi lần này đã được nêu rõ trong bảy mục. Việc bổ sung Grox, tích hợp Quảng cáo, Bộ hydrat hóa truy vấn, Bộ hydrat hóa ứng viên và Nguồn ứng viên đều được liệt kê ở đây.
Nói cách khác, README trả lời "các tính năng mới lần này là gì." Các cơ chế đã tồn tại từ tháng 1 không xuất hiện trong phần này.
"Cách" mà Banger Score ảnh hưởng đến xếp hạng không được công bố
"Đánh giá tích cực ở mức 0.4 trở lên" đã được xác nhận trong code. Tuy nhiên, code thể hiện cách kết quả đó ảnh hưởng đến xếp hạng không được bao gồm trong kho lưu trữ được phát hành lần này. Chúng ta không thể khẳng định tại thời điểm này rằng "dưới 0.4 sẽ không được hiển thị" hoặc "0.4 trở lên sẽ được ưu tiên."
Giá trị trọng số tương tác có thể không phải là giá trị sản phẩm
Các giá trị sau được viết trong đường ống suy luận cho mục đích demo:
- Thích: 1.0
- Trả lời: 0.5
- Chia sẻ lại: 0.3
- Thời gian xem: 0.2
Tuy nhiên, code phía sản phẩm được quản lý bằng các tham số động (hỗ trợ thử nghiệm A/B), và các giá trị không được mã hóa cứng. Chúng ta không thể xác nhận liệu các giá trị này có phải là giá trị thực tế trong sản phẩm hay không.
Những điều không được viết trong code hay README
Thông tin sau đây, đang lan truyền trên X với tư cách "cách đánh bại thuật toán mới", không được viết ở bất cứ đâu trong code:
- Lượng tiếp cận giảm nếu bạn đăng nhiều hơn 4 lần một ngày
- Trả lời trong vòng 30 phút sau khi đăng gây ra chuỗi hội thoại bùng nổ
- 3-5 hình ảnh là tốt nhất
- Video dài 30-90 giây đặc biệt mạnh mẽ
Lý do thông tin này lan truyền là vì mọi người trộn lẫn sự thật "thuật toán đã thay đổi vào ngày 15 tháng 5" với "quy tắc kinh nghiệm từ hoạt động của chính họ" trong cùng một bài đăng. Bởi vì độc giả tiếp nhận nó dưới quyền uy của "tôi đã phát hiện ra bằng cách đọc code", ý kiến cá nhân trông giống như thông số kỹ thuật của thuật toán.
Tóm tắt
Nếu tôi phải tóm tắt bản cập nhật ngày 15 tháng 5 trong một câu, thì đó là:
"Cơ chế xếp hạng" hầu như không thay đổi. "Cơ chế đọc nội dung bài đăng" đã được thêm vào một cách hoàn chỉnh.
Cốt lõi của việc hiển thị bài đăng của ai theo thứ tự nào—dự đoán tương tác, tín hiệu tiêu cực và đảm bảo sự đa dạng của tài khoản—đã không thay đổi kể từ tháng 1.
Những gì được thêm vào lần này là phần "mắt" đánh giá nội dung bài đăng và liệu nó có giá trị hay không.
Do đó, câu trả lời cho các câu hỏi như "nên đăng bao nhiêu lần một ngày" hoặc "trong vòng bao nhiêu phút nên trả lời" không có trong code này.
Chỉ có một thực tế là "AI nhìn vào bài đăng và đánh giá xem nó có đáng đọc hay không." Thay vì bị lừa bởi những tin đồn thuật toán và chạy theo con số, tôi nghĩ rằng tự hỏi "đây có phải là bài đăng để lại điều gì đó cho người đọc không?" phù hợp hơn với thuật toán hiện tại.
Bạn tin tưởng bao nhiêu vào "các mẹo tăng trưởng thuật toán"? Bạn nghĩ gì khi thực sự nhìn thấy code?
Tôi bắt đầu dùng X (trước đây là Twitter) vào năm 2017 và hiện đã bước sang năm thứ 10, và tôi yêu thích việc tương tác trên X. Tôi vô cùng bực bội khi mọi người bị lừa bởi một người nào đó nói những điều vô lý và quyết định "giới hạn bài đăng 4 lần một ngày", điều này cản trở sự tương tác.
Số liệu rất quan trọng, nhưng bạn có nghĩ tương tác cũng quan trọng không? Dù thuật toán có thay đổi thế nào, tôi muốn tiếp tục làm việc trong khi tận hưởng sự tương tác trên X. Tôi sẽ rất vui nếu bạn tiếp tục tận hưởng việc tương tác với tôi trên X.





