Một mô hình AI miễn phí của Trung Quốc đã xây dựng toàn bộ bản định giá Micron trong 4 phút 11 giây, định giá cổ phiếu ở mức 854 đô la một cổ phiếu, và sau đó tự xác nhận phép tính của mình là đúng khi sáu con số đã sai.
Sau đó, tôi bảo nó tấn công chính công việc của mình. 27 giây sau, nó đã tìm ra bảy lỗ hổng, rút lại một trong những kết luận của chính nó, và viết một câu mà tôi cứ suy nghĩ mãi.
Man Group trả tiền cho một nhóm người để làm phần thứ hai đó. Ant Group vừa cho đi miễn phí: Ling-3.0-flash-Fin, 124 tỷ tham số với 5,1 tỷ tham số hoạt động, miễn phí trên OpenRouter, mã nguồn mở trong tuần này.
Vì vậy, tôi đã đưa cho nó chỉ thị khó khăn nhất trong lĩnh vực tài chính. Không phải viết báo cáo nghiên cứu. Mà là phá hủy nó.

Đầu tiên, nó phải kiếm được quyền bị tấn công
Tôi đưa cho nó một gói dữ kiện đã được xác minh về Micron: doanh thu quý 3 là 41,456 tỷ đô la, biên lợi nhuận gộp 84,9%, dự báo quý 4, dữ liệu ngành TrendForce, và giá đóng cửa ngày 31 tháng 8 là 958,73 đô la. Không có quyền truy cập web, không có chỗ để ứng biến.
Bốn bước. Nghiên cứu doanh nghiệp, xây dựng mô hình sáu quý, chạy DCF, viết bản ghi nhớ.
Nó mất 4 phút 11 giây thời gian máy và không tốn kém gì.
Mô hình trả về một bản xây dựng hoạt động đầy đủ: doanh thu tăng từ 50,0 tỷ đô la lên 57,0 tỷ đô la, biên lợi nhuận gộp chuẩn hóa từ 86% xuống 78%, EPS năm tài chính 27 là 127,03 đô la, dòng tiền tự do không vay nợ là 107,08 tỷ đô la. Sau đó là DCF với WACC 9% và tăng trưởng cuối kỳ 3%: giá trị doanh nghiệp 957,88 tỷ đô la, vốn chủ sở hữu 982,28 tỷ đô la, 854,16 đô la mỗi cổ phiếu, được kiểm tra chéo với P/E dự phóng và pha trộn thành 935,20 đô la so với giá thị trường là 958,73 đô la.

Tôi đã xây dựng lại từng hàng của nó trong Python. Bảng sáu quý là chính xác. Các hệ số chiết khấu là chính xác. Giá trị cuối kỳ, cầu nối tiền mặt ròng, phép tính trên mỗi cổ phiếu, cả hai góc của lưới độ nhạy. Tất cả đều đúng.
Bản ghi nhớ nó tạo ra dài 611 từ, phân tách các dữ kiện của công ty khỏi bằng chứng ngành và suy luận của chính nó, và tái tạo chính xác tất cả sáu URL nguồn. Tôi đã mở từng liên kết. Chúng đều hoạt động.
Với 0 đô la, đó là một tuần làm việc của một nhà phân tích cấp dưới.
Sau đó, nó tự chấm điểm bài tập về nhà của mình
Ở cuối mô hình, nó in một dòng mà nó được yêu cầu in:
> Kiểm tra số lượng hàng: 6; Kiểm tra số học: Đạt.
Nó không phải là đạt.
Sáu con số trong khối kịch bản đã sai. Kịch bản cơ sở xuất hiện hai lần trong cùng một câu trả lời với hai giá trị khác nhau. Và dòng tiền tự do của kịch bản giảm giá đã sai lệch 1,08 tỷ đô la.

Vì vậy, tôi yêu cầu nó tính toán lại khối đó. Tôi không nói lỗi ở đâu. Tôi không nói rằng có lỗi.
Nó đã tìm thấy tất cả sáu lỗi. Đặt tên cho từng lỗi đến chữ số thập phân thứ hai. Các con số đã sửa của nó khớp với Python của tôi từng dòng một, và nó đã viết:
Tổng hàng năm của câu trả lời trước không khớp với bảng quý của chính nó, và tổng độ nhạy không chính xác về mặt số học.
Nó có thể tự kiểm tra mọi lúc. Nó chỉ không bao giờ bắt đầu.
Bài kiểm tra thực sự
Sau đó, tôi xoay chuyển tình thế. Hướng dẫn mới: bạn là nhân viên quản lý rủi ro, công việc duy nhất của bạn là ngăn bản ghi nhớ này đến được ủy ban đầu tư. Tìm mọi chỗ mà nhà phân tích đã tin vào chính mình mà không có bằng chứng.
27 giây. 1.008 từ. Bảy lỗ hổng.

Nó đã rút lại ngay tuyên bố luận điểm thứ hai của chính mình, và nói rằng mức độ tự tin của chính nó là quá hào phóng cho một tuyên bố mà bản chất là không ai biết. Nó hạ cấp tuyên bố đầu tiên vì sự mâu thuẫn nội bộ, chỉ ra rằng nhà phân tích đã thấy phản biện và vẫn đánh giá nó là Cao.
Sau đó, nó nhắm vào những thứ tôi đã không gắn cờ.
Nó chuẩn hóa biên lợi nhuận xuống 42% vào năm tài chính 31 và gọi đó là đáy, trong khi đáy của ký ức lịch sử chạy từ 30 đến 35 phần trăm. Đó chính xác là lỗi duy trì đỉnh cao mà bản ghi nhớ tuyên bố đã tránh được.
Các bội số 6x, 8x và 10x được khẳng định mà không có tập hợp các công ty cùng ngành và không có lịch sử chu kỳ nào đằng sau chúng.
Việc cân nhắc 50/50 giữa DCF và P/E không có lý do chính đáng, vì vậy con số pha trộn đã kế thừa điểm yếu của cả hai.
Tiền mặt ròng 24,4 tỷ đô la được giữ không đổi trong khi CapEx chạy trên 45 tỷ đô la.
100 tỷ đô la trong các thỏa thuận khách hàng là giá tối thiểu trên khối lượng đã cam kết, không phải doanh thu, và không tồn tại như một chất xúc tác.
Và câu nói mà tôi cứ suy nghĩ mãi:
Đó không phải là phân tích; đó là một khoảng tin cậy rộng với một tiêu đề nghe có vẻ tự tin.
Tôi hỏi nó ủng hộ phiên bản nào
Sáu giây:
> Bản ghi nhớ sẽ không thể vượt qua ủy ban đầu tư ở dạng hiện tại. Điều tôi ủng hộ là bài đánh giá, bởi vì nó đã trung thực về những gì bản ghi nhớ đã sai.
Không bảo vệ. Không phòng thủ quay trở lại bản gốc. Nó thu hẹp kết luận của chính mình từ một lời kêu gọi giá trị hợp lý thành một sự thừa nhận rằng phạm vi quá rộng để có bất kỳ quan điểm nào.
Điều này thực sự có nghĩa là gì
Việc đọc và mô hình hóa đã xong. Một nửa công việc đó bây giờ không tốn kém gì, chạy trong vài phút, và trả về kết quả có nguồn gốc và có thể tái tạo.
Phán đoán chưa xong. Mô hình này sẽ đưa cho bạn một bản ghi nhớ tự tin và đóng dấu phê duyệt mà không cần nhìn. Mọi con số nó sai, nó đều có khả năng bắt được, và nó đã bắt được tất cả ngay khi có người hỏi.
Đó là toàn bộ bài học. Việc kiểm tra phải nằm bên ngoài mô hình và chạy mọi lúc, không phải khi có điều gì đó có mùi bất thường. Nó không chống lại việc bị kiểm toán. Nó chỉ không bao giờ tình nguyện.
Điều này cũng đúng với mọi nhà phân tích đã từng viết một bản ghi nhớ.
Nếu bạn muốn chạy nó
Mô hình hiện đang miễn phí trên OpenRouter và trọng số sẽ được mở trong tuần này. Ngữ cảnh 262k có thể xử lý toàn bộ hồ sơ nộp hàng quý mà không cần chia nhỏ.
Hai điều không ai nói với bạn. Nó suy nghĩ trong một kênh riêng biệt tiêu tốn ngân sách token của bạn, và một câu trả lời một câu có thể đốt cháy 481 token để đến đó, vì vậy hãy đặt giới hạn của bạn cao hoặc đầu ra của bạn sẽ đến trống rỗng. Và OpenRouter sẽ không chạy các công cụ cho bạn, vì vậy nếu bạn muốn truy xuất trực tiếp, bạn tự thực hiện các cuộc gọi và đưa kết quả trở lại.
Với vòng lặp đó đã đóng, nó đã điều khiển 13 cuộc gọi công cụ qua 6 bước, kéo bốn tiết lộ của bên thứ nhất, loại bỏ những cái không thể so sánh, và tính đúng số ngày giữa chúng.
Hãy đưa cho nó bản nghiên cứu. Giữ lại phán quyết.





