Union Alpha chính thức là Pareto 26.9

@unionalphaai
TIẾNG ANH17 thg 9, 2026
383K
1.2K
69
139
342

TL;DR

Union Alpha công bố mình là Pareto 26.9, một hệ thống định tuyến kết hợp nhiều mô hình, sau đợt dùng thử miễn phí ngắn hạn vấp phải phản ứng gay gắt về hiệu suất và tính minh bạch.

Bạn đã tìm thấy chúng tôi. Union Alpha — mô hình bí mật trên OpenRouter, OpenCode và Cloudflare — chính là Pareto 26.9 từ @TheUnbiasedCo. Cộng đồng mạng chỉ mất một ngày để bóc trần danh tính thật sự của nó. Chúng ta không nên đánh giá thấp những đối thủ như @aitrackerbot.

Chúng tôi hợp tác với các nền tảng này để thực hiện một đợt ra mắt bí mật vì muốn xem phản hồi thực tế từ người dùng, học hỏi những thách thức khi mở rộng quy mô, và tích hợp bài học đó vào kế hoạch ra mắt công khai phiên bản 26.10 vào tháng tới. Chúng tôi không lưu trữ prompt hay kết quả đầu ra của bạn, và chúng tôi tin rằng việc không lưu giữ dữ liệu (zero data retention) nên là mặc định cho nhiều mô hình hơn nữa.

Một số bạn nghĩ rằng mình đang thử nghiệm một mô hình mới duy nhất, và đã bất ngờ khi biết rằng thực chất có nhiều mô hình khác nhau. Lỗi này thuộc về chúng tôi. Không phải lỗi của @OpenRouter, @OpenCode, hay @Cloudflare. Họ đã phối hợp với chúng tôi để vận hành một danh sách bí mật theo đúng cách mà các danh sách bí mật vẫn luôn được thực hiện.

Pareto không phải là một bộ trọng số đơn lẻ. Nó là một hệ thống: bao gồm nhiều mô hình, cả mã nguồn mở lẫn frontier, cùng xử lý một nhiệm vụ, với một cơ chế kiểm tra kết quả và gọi đến một mô hình mạnh hơn khi nhiệm vụ đòi hỏi. Không có quá trình huấn luyện riêng biệt nào diễn ra. Các phiên bản trước của Pareto đã dạy chúng tôi rằng benchmark có thể gây hiểu lầm. Giai đoạn beta nội bộ giúp chúng tôi đo lường được mô hình nào xuất sắc vượt trội trong từng tác vụ cụ thể. Chúng tôi tin rằng các router trong tương lai sẽ hoạt động và mang lại trải nghiệm giống như các mô hình hiện nay. Cung cấp trí tuệ tối đa khi nhiệm vụ cần thiết, và sử dụng trí tuệ tiết kiệm chi phí hơn khi bạn chỉ hỏi cách làm món trứng bác.

Chỉ trong vài giờ vào thứ Tư, nhu cầu đã tăng vọt lên hàng tỷ token mỗi phút, khiến mô hình trở nên chậm chạp đến mức không thể sử dụng được. Là một công ty nhỏ, chúng tôi đã không chuẩn bị đủ tài nguyên tính toán để đáp ứng thời điểm đó. Nếu bạn đã bỏ cuộc hôm qua vì bực bội, chúng tôi hoàn toàn thấu hiểu. AWS đã giúp chúng tôi tăng gấp ba lần năng lực xử lý chỉ sau một đêm! Hóa ra điều đó vẫn chưa đủ để đáp ứng lượng quan tâm khổng lồ.

Chúng tôi đang phối hợp với các gateway để kích hoạt quyền truy cập trả phí cho phiên bản 26.9. Mức giá là $2.50 cho input, $0.25 cho cache, và $7.50/output cho mỗi triệu token – thấp hơn một phần tư so với giá niêm yết của Astra.

Chúng tôi tin rằng các hệ thống như thế này là con đường dẫn đến nhiều trí tuệ hơn với chi phí thấp hơn. Đây là một lĩnh vực nghiên cứu mới: nhiều mô hình hoạt động như một thể thống nhất. Từ đây, chúng tôi sẽ phát triển nó một cách minh bạch: https://unbiased.ai/model-card/.

Hãy sử dụng 26.9. Hãy cho chúng tôi biết nơi nào nó còn thiếu sót. Chúng tôi rất háo hức muốn giới thiệu với bạn những gì tiếp theo.

@TheUnbiasedCo

Lưu một chạm

Đọc sâu bài viết viral bằng AI trong YouMind

Lưu nguồn, đặt câu hỏi tập trung, tóm tắt lập luận và biến một bài viết viral thành các ghi chú có thể tái sử dụng trong một không gian làm việc AI duy nhất.

Khám phá YouMind
Dành cho nhà sáng tạo

Biến Markdown của bạn thành bài viết 𝕏 gọn gàng

Khi bạn đăng bài viết dài của riêng mình, việc định dạng hình ảnh, bảng và khối mã cho 𝕏 rất mệt mỏi. YouMind biến cả bản nháp Markdown thành một bài viết 𝕏 gọn gàng, sẵn sàng để đăng.

Thử Markdown sang 𝕏

Thêm pattern để giải mã

Bài viết viral gần đây

Khám phá thêm bài viết viral