Hôm nay, chúng tôi chính thức cung cấp MiniMax Code CLI phiên bản v0.4.12 cho các nhà phát triển trên toàn thế giới và mã nguồn mở theo giấy phép MIT.
Trên bộ đánh giá FrontierHarness Eval, MiniMax Code đã đạt tỷ lệ vượt qua bài kiểm tra (pass rate) tốt nhất hiện nay, thời gian hoàn thành tác vụ trung bình nhanh nhất và mức sử dụng token thấp thứ hai.*1

Chúng tôi tin rằng một harness được thiết kế tốt có thể khai phá nhiều hơn nữa khả năng của mô hình, đồng thời giảm thiểu thời gian chờ đợi kết quả của nhà phát triển.
Bằng việc mã nguồn mở MiniMax Code, chúng tôi cho phép các nhà phát triển xem xét cách xử lý các lệnh gọi công cụ (tool calls) và quyền hạn, từ đó xây dựng các ứng dụng doanh nghiệp đáng tin cậy.


Chúng tôi cũng mời gọi cộng đồng cùng xác định các vấn đề và đóng góp bản sửa lỗi. Thông qua việc sử dụng thực tế và sự rà soát của cộng đồng, chúng tôi hướng tới việc liên tục tăng cường các biện pháp bảo vệ của MiniMax Code để nhà phát triển có thể yên tâm sử dụng với độ tin cậy cao hơn.
Bắt đầu ngay:
Khám phá mã nguồn trên GitHub:
github.com/MiniMax-AI/minimax-code
MiniMax Code đang phát triển rất nhanh chóng. Cùng với cộng đồng, chúng tôi muốn xây dựng một harness an toàn, đáng tin cậy và hiệu suất cao, tiếp tục khai phá những tiềm năng mới của các mô hình AI.
Trí tuệ nhân tạo cho tất cả mọi người.
*1 Ghi chú về đánh giá
FrontierHarness Eval: Kho lưu trữ GitHub
- Bài đánh giá của bên thứ ba này đã thử nghiệm MiniMax Code 0.3.2 với Kimi K3 trên 30 tác vụ: 23 tác vụ đạt, 4 tác vụ thất bại và 3 tác vụ quá thời gian mà không nhận được điểm. Tỷ lệ vượt qua được tính dựa trên tổng số 30 tác vụ. Các nhà cung cấp, phương pháp checkpointing và giới hạn thời gian cho một số tác vụ khác biệt so với các baseline đã công bố. Kết quả này chỉ mang tính chất so sánh số liệu và không đại diện cho xếp hạng bảng xếp hạng chính thức.
- Kết quả đánh giá: PR #13
- Dấu vết thực thi (Execution traces): Tải xuống ZIP
- Cấu hình adapter: PR #14





