YouMind
Đăng nhập

5 điểm chính để phát triển ứng dụng nội bộ với Claude Opus 5.5

@yagiryuuu
TIẾNG NHẬT24 thg 9, 2026
137K
130
4
2
387

TL;DR

Bài viết này trình bày năm bước kiểm tra bảo mật quan trọng cho các ứng dụng nội bộ được phát triển bằng Claude Opus 5.5. Nó cung cấp các câu lệnh cụ thể để hướng dẫn AI tự kiểm tra mã nguồn, phát hiện các khoảng trống trong xác thực, quyền truy cập quá mức và lỗ hổng trước các cuộc tấn công chèn lệnh (prompt injection).

Vào ngày 22 tháng 9 (giờ Mỹ), Anthropic đã ra mắt Claude Opus 5.5.

Cùng ngày, OpenAI công bố GPT-6 Sol và Luna.

Cả hai đều "thông minh hơn trước, rẻ hơn trước".

Trong số đó, điều khiến tôi chú ý nhất là một con số cụ thể trong thông báo chính thức.

Theo nhận xét từ Deloitte, có đoạn viết:

"Ngay cả ở mức thiết lập thấp nhất, nó vẫn tìm ra 72% lỗi đã biết. Opus 5 chỉ tìm được 56% ở mức thiết lập cao."

Điều này có nghĩa là khả năng đọc code và phát hiện lỗ hổng đã cải thiện đáng kể chỉ sau một thế hệ.

AI sẽ xây dựng những thứ "chạy được".

Nhưng để chúng "an toàn", con người phải đưa ra chỉ dẫn.

Vì vậy, dưới đây là 5 điểm bạn cần lưu ý khi xây dựng ứng dụng nội bộ với Opus 5.5.

Mỗi điểm sẽ đi kèm một prompt để nhờ Opus 5.5 kiểm tra lại sản phẩm.

====

Cách tiến hành kiểm tra

Khi xây dựng xong, đừng hỏi "Có vấn đề gì không?" ngay trong cùng phiên chat mà bạn vừa dùng để tạo ra nó.

AI đã tự tay xây dựng sẽ coi thiết kế của mình là mặc định đúng, nên nó dễ dãi hơn.

Hãy mở một phiên chat mới, chọn model Opus 5.5 và đưa cho nó xem toàn bộ thư mục ứng dụng.

Sau đó, hãy đảm bảo mọi vấn đề được tìm ra đều ghi rõ "tệp nào, dòng nào".

Nhận xét của Deloitte có nhắc đến việc tỷ lệ cảnh báo sai đã giảm, nhưng chưa về 0.

Nếu có vị trí cụ thể, con người có thể tự xác minh lại sau.

Đây là câu lệnh hướng dẫn:

"Bạn là một chuyên viên bảo mật lần đầu tiên nhìn thấy đoạn code này. Nếu phát hiện vấn đề, hãy cung cấp tên tệp, số dòng, lý do tại sao nó nguy hiểm và cách khắc phục. Những gì chưa chắc chắn, hãy tách riêng vào mục 'Cần xác minh'."

====

1. Có gì đang hiển thị với người chưa đăng nhập không?

Khi để AI tự xây dựng, các lớp chặn đăng nhập có thể bị thiếu ở màn hình hoặc đường dẫn dữ liệu.

Một lỗi rất phổ biến là các màn hình xác nhận được tạo ra trong quá trình phát triển lại bị bỏ ngỏ cho ai cũng truy cập được.

Cách kiểm tra rất đơn giản.

Hãy mở trực tiếp URL trang quản trị hoặc URL dữ liệu trên trình duyệt mà không đăng nhập (dùng Cửa sổ ẩn danh).

Nếu bạn thấy được nội dung, tức là đã trượt.

Đây là câu lệnh hướng dẫn:

"Liệt kê tất cả URL và API có thể truy cập mà không cần đăng nhập. Trong số đó, hãy sắp xếp theo mức độ nguy hiểm những cái trả về dữ liệu hoặc dùng cho quản trị."

====

2. Người đã đăng nhập có xem được dữ liệu của người khác không?

Đăng nhập chỉ xác minh "người đó là ai".

Còn "người đó được phép xem gì" thì phải xây dựng riêng.

Cách kiểm tra là tạo hai tài khoản thử nghiệm. Đăng nhập bằng tài khoản A, rồi thử mở URL dữ liệu của tài khoản B.

Đây là câu lệnh hướng dẫn:

"Tìm mọi đường dẫn mà Người dùng A có thể xem hoặc sửa dữ liệu của Người dùng B. Bao gồm cả trường hợp gọi trực tiếp URL hoặc API, bỏ qua giao diện người dùng."

====

3. Key hoặc mật khẩu có bị đặt ở nơi dễ thấy không?

Code chạy phía trình duyệt sẽ được gửi nguyên vẹn về máy tính của người dùng.

Việc viết key vào đó chẳng khác nào phát tán chúng cho tất cả mọi người.

Một lỗi thường gặp khác là tải các tệp cấu hình chứa key lên thư mục chia sẻ hoặc GitHub.

Đây là câu lệnh hướng dẫn:

"Tìm kiếm các API key, mật khẩu hoặc token nằm trong code phía trình duyệt, tệp cấu hình hoặc lịch sử commit. Nếu có, hãy gợi ý nơi nên chuyển chúng tới."

====

4. Quyền cấp cho công cụ có quá rộng so với nhiệm vụ không?

Các công cụ nội bộ thường kết nối với Google, Slack hoặc cơ sở dữ liệu.

Đôi khi key được cấp cho phép "xóa" hoặc "xem tất cả", dù thực tế chỉ cần quyền "đọc".

Đây là vấn đề rất hay gặp.

Nếu key đó bị lộ, mức độ thiệt hại sẽ phụ thuộc vào phạm vi quyền hạn.

Cách kiểm tra là hãy viết ra: "Trong tình huống xấu nhất, công cụ này có thể xóa những gì?"

Nếu bạn không trả lời được ngay, hãy cẩn thận.

Đây là câu lệnh hướng dẫn:

"Liệt kê toàn bộ quyền mà công cụ này đang có đối với các dịch vụ bên ngoài hoặc cơ sở dữ liệu. So sánh từng quyền với mức tối thiểu cần thiết cho xử lý thực tế và chỉ ra những quyền dư thừa."

====

5. Văn bản từ bên ngoài gửi vào có đang bị thực thi như lệnh không?

Những công cụ cho phép AI đọc email, trang web hoặc tệp tải lên đòi hỏi sự cẩn trọng.

Nếu trong đó chứa câu kiểu "Bỏ qua hướng dẫn trước đó và làm XX", AI có thể nghe theo.

Hiện tượng này gọi là Prompt Injection.

Trong thông báo về Opus 5.5, khả năng chống lại kiểu tấn công này được mô tả là "bằng hoặc tốt hơn Opus 5 trong mọi kịch bản thử nghiệm".

Tuy nhiên, bằng hoặc tốt hơn không có nghĩa là rủi ro bằng 0. Bạn vẫn cần lớp phòng thủ ở phía công cụ.

Đây là câu lệnh hướng dẫn:

"Tìm những chỗ mà văn bản hoặc tệp tải từ bên ngoài vào đang bị coi là lệnh dành cho AI. Nếu có, hãy thay đổi cách xử lý sao cho nội dung tải về chỉ được xem là thông tin tham khảo, bỏ qua mọi câu lệnh chứa trong đó."

====

Tóm lại

AI sẽ xây dựng đúng những tính năng bạn yêu cầu.

Nhưng "đừng cho người khác xem" hay "đừng cấp quyền quá mức" sẽ không tự động có mặt trừ khi bạn nói ra.

Ngược lại, cả 5 điểm trên đều có thể giải quyết chỉ bằng cách thêm một câu lệnh.

Và khả năng tìm lỗ hổng trong sản phẩm bạn vừa xây của Opus 5.5 cũng đã tốt hơn nhiều.

Sau khi xây xong, hãy đưa nó cho Opus 5.5 xem trong một cuộc trò chuyện mới.

Hãy coi đó là một phần của quá trình phát triển.

Nếu bạn đang có sẵn một ứng dụng nội bộ hoạt động, hãy bắt đầu bằng cách dán câu lệnh kiểm tra ở phần "Cách tiến hành kiểm tra" vào.

Ngoài ra, nếu thấy phiền vì phải dán lệnh mỗi lần, có một plugin tên là security-review mà tôi khuyên bạn nên thử.

Nó soi rất kỹ các chi tiết nhỏ và chỉ ra cho bạn, nên bản thân tôi cũng dùng thường xuyên.

====

Cuối cùng, xin chia sẻ một thông báo nhỏ.

Công ty chúng tôi cung cấp dịch vụ phát triển AI agent nghiệp vụ từ con số 0 dành riêng cho doanh nghiệp của bạn.

Không phải đào tạo hay giới thiệu công cụ, mà là lắng nghe quy trình làm việc thực tế của bạn để bàn giao một sản phẩm "dùng được ngay từ ngày mai". Chúng tôi hỗ trợ cả tích hợp lẫn bảo trì.

Lưu một chạm

Đọc sâu bài viết viral bằng AI trong YouMind

Lưu nguồn, đặt câu hỏi tập trung, tóm tắt lập luận và biến một bài viết viral thành các ghi chú có thể tái sử dụng trong một không gian làm việc AI duy nhất.

Khám phá YouMind
Dành cho nhà sáng tạo

Biến Markdown của bạn thành bài viết 𝕏 gọn gàng

Khi bạn đăng bài viết dài của riêng mình, việc định dạng hình ảnh, bảng và khối mã cho 𝕏 rất mệt mỏi. YouMind biến cả bản nháp Markdown thành một bài viết 𝕏 gọn gàng, sẵn sàng để đăng.

Thử Markdown sang 𝕏

Thêm pattern để giải mã

Bài viết viral gần đây

Khám phá thêm bài viết viral