YouMind
Đăng nhập

Phân tích thuật toán mới của X trên GitHub: Các quy tắc '4 bài đăng mỗi ngày' và 'phản hồi trong 30 phút' không tồn tại trong mã nguồn

@yonemura2006
TIẾNG NHẬT17 thg 5, 2026
484K
718
294
4
694

TL;DR

Phân tích bản cập nhật thuật toán mới nhất của X cho thấy việc giới thiệu Grox AI để chấm điểm chất lượng nội dung, đồng thời bác bỏ các tin đồn lan truyền về tần suất đăng bài và thời gian phản hồi.

Tôi sẽ tổ chức thông tin thành "Những gì được viết trong code", "Những gì chỉ có trong README" và "Những gì không được viết ở đâu cả".

Tại sao tôi viết bài này

Ngày 15 tháng 5, Elon Musk thông báo rằng thuật toán X đã được phát hành trên GitHub. Ngay sau đó, một lượng lớn bài viết về "cách đánh bại thuật toán X mới" bắt đầu lan truyền. Điều làm tôi khó chịu khi đọc chúng là một số bài viết khẳng định các quy tắc cụ thể không có trong code, trong khi lại tuyên bố đã "đọc code". Tôi quyết định tự kiểm tra và nhờ (một AI) đọc code GitHub. Trong bài viết này, tôi sẽ tổng hợp những gì tôi có thể và không thể xác nhận.

Cấu trúc của bài viết này

Tôi sẽ trình bày thông tin theo ba lớp:

  • Những điều được xác nhận trực tiếp trong code
  • Những điều được viết trong README nhưng không được xác nhận trong code (ở mức "theo tài liệu chính thức")
  • Những điều đang lan truyền trên X mà không có trong code hay README

Những điều được xác nhận trong code

Bản cập nhật này rất lớn, với hơn 187 tệp và 18.000 dòng code được thêm vào. Trong bốn tháng kể từ lần phát hành đầu tiên vào tháng 1, nội dung đã thay đổi đáng kể.

Grox hiện "xem" bài đăng để đánh giá chất lượng

Thay đổi lớn nhất lần này là việc thiết lập hoàn chỉnh một dịch vụ đánh giá nội dung có tên Grox. Nó không tồn tại trong code được phát hành vào tháng 1 (mặc dù tôi không thể khẳng định chắc chắn rằng một chức năng tương tự không tồn tại trong môi trường X thực tế). Cốt lõi của Grox là một VLM (Mô hình ngôn ngữ thị giác). VLM là một AI có thể hiểu không chỉ văn bản, mà còn cả hình ảnh và khung hình video cùng nhau. Nó không chỉ "đọc văn bản"; nó có thể "nhìn vào hình ảnh và đưa ra nhận định". Grox chủ yếu làm ba việc:

Đánh giá chất lượng bài đăng (Banger Screen)

"Điểm Banger" là điểm từ 0 đến 1, nơi AI đánh giá xem một bài đăng có phải là "nội dung có giá trị có khả năng lan truyền" hay không. Code chứa ngưỡng "điểm >= 0.4", trong đó 0.4 trở lên được đánh giá là tích cực.

Phát hiện spam

VLM xác định xem một bài đăng có phải là spam hay không, tập trung vào các bài đăng từ tài khoản có ít người theo dõi.

Phát hiện vi phạm chính sách và an toàn

Grox đánh giá bảy loại sau:

  • Phương tiện bạo lực
  • Nội dung người lớn
  • Spam
  • Hoạt động bất hợp pháp/bị quản lý
  • Thù ghét/quấy rối
  • Lời nói bạo lực
  • Tự tử/tự hại

Trong code, cũng có một cơ chế thực hiện kiểm tra bổ sung đối với phương tiện bạo lực và nội dung người lớn bằng cách sử dụng các mô hình suy luận có độ chính xác cao hơn. Tuy nhiên, bài đăng nào bị áp dụng điều này thì không thể xác nhận chỉ từ code công khai.

Cơ chế đã tồn tại từ tháng 1

Từ đây trở đi, đây không phải là "tính năng mới" mà là những cơ chế đã tồn tại từ lần phát hành đầu tiên vào tháng 1. Nhiều "giải thích về thuật toán mới nhất" trên X trộn lẫn code tháng 1 và tháng 5 mà không phân biệt. Nếu bạn chỉ nhờ AI tóm tắt GitHub, các tính năng từ bốn tháng trước sẽ được giới thiệu như "thay đổi lần này".

Chặn, ẩn và báo cáo làm giảm điểm (Từ tháng 1)

Từ cấu trúc code, đã xác nhận rằng các hành động sau được tích hợp vào công thức tính toán như tín hiệu tiêu cực:

  • Không quan tâm
  • Chặn
  • Ẩn
  • Báo cáo

Ngoài ra, bộ xếp hạng (ranking_scorer.rs) trong Home Mixer bao gồm một quy trình để triệt tiêu thiên vị, đảm bảo các bài đăng từ cùng một tài khoản không xuất hiện quá thường xuyên trong "Dành cho bạn". Đây cũng là một cơ chế đã tồn tại từ tháng 1; khi nhiều bài đăng từ cùng một tài khoản xuất hiện trong feed của một người, điểm cho bài đăng thứ hai và các bài tiếp theo giảm theo cấp số nhân.

米村歩@日本一残業の少ないIT企業社長 - inline image

Điều này là để đảm bảo sự đa dạng—"không lấp đầy dòng thời gian của một người bằng bài đăng của bạn"—và không giới hạn tổng số bài đăng mỗi ngày.

Những điều được viết trong README nhưng không được xác nhận trong code

"Hầu như tất cả quy tắc thủ công đều bị bãi bỏ" chỉ đúng một nửa

README chính thức nêu một nguyên tắc thiết kế: "Chúng tôi đã hầu như loại bỏ hoàn toàn các tính năng và heuristic được xây dựng thủ công." Đây không phải là mô tả được thêm vào tháng 5; đó là một tuyên bố đã tồn tại trong README từ lần phát hành đầu tiên vào tháng 1.

Tuy nhiên, khi nhìn vào code, các lớp lọc (loại trừ bài đăng cũ, loại trừ từ khóa bị ẩn, v.v.) vẫn dựa trên quy tắc.

Những gì đã bị "bãi bỏ" là các tiêu chí xếp hạng và tính điểm, không phải là lọc. Và cấu trúc này không thay đổi trong bản cập nhật này.

Những thay đổi được chính thức công nhận trong README tháng 5

Một phần riêng có tiêu đề "Cập nhật — 15 tháng 5, 2026" đã được thiết lập mới trong README ngày 15 tháng 5, và những thay đổi lần này đã được nêu rõ trong bảy mục. Việc bổ sung Grox, tích hợp Quảng cáo, Bộ hydrat hóa truy vấn, Bộ hydrat hóa ứng viên và Nguồn ứng viên đều được liệt kê ở đây.

Nói cách khác, README trả lời "các tính năng mới lần này là gì." Các cơ chế đã tồn tại từ tháng 1 không xuất hiện trong phần này.

"Cách" mà Banger Score ảnh hưởng đến xếp hạng không được công bố

"Đánh giá tích cực ở mức 0.4 trở lên" đã được xác nhận trong code. Tuy nhiên, code thể hiện cách kết quả đó ảnh hưởng đến xếp hạng không được bao gồm trong kho lưu trữ được phát hành lần này. Chúng ta không thể khẳng định tại thời điểm này rằng "dưới 0.4 sẽ không được hiển thị" hoặc "0.4 trở lên sẽ được ưu tiên."

Giá trị trọng số tương tác có thể không phải là giá trị sản phẩm

Các giá trị sau được viết trong đường ống suy luận cho mục đích demo:

  • Thích: 1.0
  • Trả lời: 0.5
  • Chia sẻ lại: 0.3
  • Thời gian xem: 0.2

Tuy nhiên, code phía sản phẩm được quản lý bằng các tham số động (hỗ trợ thử nghiệm A/B), và các giá trị không được mã hóa cứng. Chúng ta không thể xác nhận liệu các giá trị này có phải là giá trị thực tế trong sản phẩm hay không.

Những điều không được viết trong code hay README

Thông tin sau đây, đang lan truyền trên X với tư cách "cách đánh bại thuật toán mới", không được viết ở bất cứ đâu trong code:

  • Lượng tiếp cận giảm nếu bạn đăng nhiều hơn 4 lần một ngày
  • Trả lời trong vòng 30 phút sau khi đăng gây ra chuỗi hội thoại bùng nổ
  • 3-5 hình ảnh là tốt nhất
  • Video dài 30-90 giây đặc biệt mạnh mẽ

Lý do thông tin này lan truyền là vì mọi người trộn lẫn sự thật "thuật toán đã thay đổi vào ngày 15 tháng 5" với "quy tắc kinh nghiệm từ hoạt động của chính họ" trong cùng một bài đăng. Bởi vì độc giả tiếp nhận nó dưới quyền uy của "tôi đã phát hiện ra bằng cách đọc code", ý kiến cá nhân trông giống như thông số kỹ thuật của thuật toán.

Tóm tắt

Nếu tôi phải tóm tắt bản cập nhật ngày 15 tháng 5 trong một câu, thì đó là:

"Cơ chế xếp hạng" hầu như không thay đổi. "Cơ chế đọc nội dung bài đăng" đã được thêm vào một cách hoàn chỉnh.

Cốt lõi của việc hiển thị bài đăng của ai theo thứ tự nào—dự đoán tương tác, tín hiệu tiêu cực và đảm bảo sự đa dạng của tài khoản—đã không thay đổi kể từ tháng 1.

Những gì được thêm vào lần này là phần "mắt" đánh giá nội dung bài đăng và liệu nó có giá trị hay không.

Do đó, câu trả lời cho các câu hỏi như "nên đăng bao nhiêu lần một ngày" hoặc "trong vòng bao nhiêu phút nên trả lời" không có trong code này.

Chỉ có một thực tế là "AI nhìn vào bài đăng và đánh giá xem nó có đáng đọc hay không." Thay vì bị lừa bởi những tin đồn thuật toán và chạy theo con số, tôi nghĩ rằng tự hỏi "đây có phải là bài đăng để lại điều gì đó cho người đọc không?" phù hợp hơn với thuật toán hiện tại.

Bạn tin tưởng bao nhiêu vào "các mẹo tăng trưởng thuật toán"? Bạn nghĩ gì khi thực sự nhìn thấy code?

Tôi bắt đầu dùng X (trước đây là Twitter) vào năm 2017 và hiện đã bước sang năm thứ 10, và tôi yêu thích việc tương tác trên X. Tôi vô cùng bực bội khi mọi người bị lừa bởi một người nào đó nói những điều vô lý và quyết định "giới hạn bài đăng 4 lần một ngày", điều này cản trở sự tương tác.

Số liệu rất quan trọng, nhưng bạn có nghĩ tương tác cũng quan trọng không? Dù thuật toán có thay đổi thế nào, tôi muốn tiếp tục làm việc trong khi tận hưởng sự tương tác trên X. Tôi sẽ rất vui nếu bạn tiếp tục tận hưởng việc tương tác với tôi trên X.

Lưu một chạm

Đọc sâu bài viết viral bằng AI trong YouMind

Lưu nguồn, đặt câu hỏi tập trung, tóm tắt lập luận và biến một bài viết viral thành các ghi chú có thể tái sử dụng trong một không gian làm việc AI duy nhất.

Khám phá YouMind
Dành cho nhà sáng tạo

Biến Markdown của bạn thành bài viết 𝕏 gọn gàng

Khi bạn đăng bài viết dài của riêng mình, việc định dạng hình ảnh, bảng và khối mã cho 𝕏 rất mệt mỏi. YouMind biến cả bản nháp Markdown thành một bài viết 𝕏 gọn gàng, sẵn sàng để đăng.

Thử Markdown sang 𝕏

Thêm pattern để giải mã

Bài viết viral gần đây

Khám phá thêm bài viết viral