Tác vụ Opus 5.5 tiếp theo của bạn nên để lại một kết quả có thể mở ra xem, bằng chứng có thể kiểm tra được và đủ tiến độ đã lưu để ngày mai làm tiếp. Hãy đưa những đầu ra đó vào quy trình làm việc trước khi bạn bắt đầu chạy.
Một harness (bộ khung điều phối) sẽ quản lý các chỉ thị, công cụ, quyền hạn, trạng thái và bước kiểm tra xoay quanh mô hình.
Claude Code cung cấp cho bạn những nơi cụ thể để cấu hình các trách nhiệm đó. Hướng dẫn tính năng.

Tác vụ tiếp theo có thể dùng chung quy trình và người đánh giá, với cùng định dạng bằng chứng. Bạn chỉ cần cung cấp tài liệu mới và tiêu chí nghiệm thu.
Bảy lớp này tạo thành một thiết lập thực tế dựa trên các tính năng đã được ghi nhận của Claude Code. Ví dụ dưới đây đi theo luồng xử lý tài liệu: tài liệu tham khảo nằm trong sources/, bản nháp đang làm nằm trong drafts/, và tệp đã duyệt nằm trong published/.
Hãy tạo các thư mục đó trong workspace của bạn và gộp các đoạn mã sau vào cấu hình hiện có.
Thiết lập này dùng bốn tệp cấu hình, một kết nối ngoài tùy chọn và một mục tiêu do bạn đặt cho mỗi tác vụ.
1. Cung cấp cho workspace những thông tin nó cần
Giữ file CLAUDE.md ở thư mục gốc tập trung vào những thông tin hữu ích xuyên suốt nhiều tác vụ. Vị trí xuất file, yêu cầu về nguồn tài liệu và quy ước viết lách nên nằm ở đây.
Một thời hạn tạm thời hay một câu hỏi chưa ngã ngũ về nguồn tài liệu thì nên đi kèm với chính tác vụ đó. Việc phân biệt rõ ràng điều này giúp lần chạy tiếp theo hiểu được thông tin nào vẫn còn hiệu lực.
Dán nội dung này vào CLAUDE.md và điều chỉnh chi tiết dự án cho phù hợp:
1Chỉ thị dự án2Dùng sources/ cho tài liệu tham khảo và drafts/ cho các tệp đang xử lý.3Lưu các tệp đã duyệt vào published/.4Viết bằng tiếng Anh, mỗi đoạn văn gồm một hoặc hai câu.5Sử dụng nguồn sơ cấp chính thức cho các khẳng định mang tính kỹ thuật.6Ghi lại URL nguồn và ngày kiểm tra.7Chỉ sử dụng tài liệu truy xuất được làm bằng chứng cho tác vụ được giao.8Lưu các quyết định đã chốt và hành động tiếp theo vào progress.md.9Trả về đường dẫn tệp đầu ra và kết quả xác minh khi hoàn tất công việc.
Claude Code tải các chỉ thị dự án vào ngữ cảnh. Các tệp .claude/rules/ giới hạn theo đường dẫn có thể cung cấp chỉ thị khi những tệp liên quan được truy cập. Bộ nhớ dự án.

Hãy nghĩ xem agent cần gì để đưa ra quyết định tiếp theo. Với một bài viết, đó có thể là văn phong đã duyệt, chủ đề được yêu cầu và những đoạn trích liên quan từ thông báo phát hành.
Tài liệu tham khảo chi tiết có thể nằm yên trong các tệp mà quy trình sẽ tự lấy ra khi cần.
Hướng dẫn về ngữ cảnh của Anthropic mô tả việc truy xuất có chọn lọc và ghi chú bên ngoài như những cách để quản lý thông tin trong lúc agent làm việc. Kỹ thuật ngữ cảnh.
Việc chia nhỏ một tệp chỉ thị lớn thành các lệnh nhập \[@path](https://x.com/@path)\ vẫn sẽ tải nội dung đó ngay khi bắt đầu phiên.
Hãy dùng các lệnh nhập đó để sắp xếp cho gọn gàng, và thỉnh thoảng đưa các quy trình vào skills. Tải bộ nhớ.
Khi một thông tin đã lưu thay đổi, hãy cập nhật nguồn và ngày kiểm tra của nó.
Một tùy chỉnh phát hiện ra trong lúc làm nháp chỉ trở thành quy tắc cố định sau khi bạn xác nhận rằng nó nên áp dụng cho cả các bản nháp tương lai.
Dùng /memory để xem lại các chỉ thị dự án và duyệt qua các ghi chú auto-memory. Hãy kiểm tra các tùy chỉnh đã lưu trước khi áp dụng chúng cho một tác vụ khác.
2. Lưu lại quy trình bạn cứ phải lặp đi lặp lại
Một tác vụ lặp lại thường có chuỗi bước dễ nhận biết: đọc tài liệu, chuẩn bị đầu ra, rà soát và lưu kết quả.
Một skill sẽ giữ nguyên chuỗi bước đó cho yêu cầu tiếp theo.
Toàn bộ chỉ thị của nó sẽ được tải khi được gọi.
Phần mô tả giúp Claude nhận diện khi nào quy trình này phù hợp với tác vụ. Hành vi của skill.

Dán nội dung này vào .claude/skills/write-draft/SKILL.md:
1---2name: write-draft3description: Viết nháp bài từ tài liệu nguồn và xác minh các khẳng định.4---5Chủ đề được yêu cầu: $ARGUMENTS671. Đọc các tệp liên quan trong sources/ và mở các liên kết nguồn sơ cấp của chúng.82. Lập dàn ý, sau đó lưu bản nháp thành drafts/article.md.93. Yêu cầu evidence-reviewer đối chiếu các khẳng định thực tế với tài liệu nguồn.104. Sửa lỗi và đánh dấu những khẳng định chưa ngã ngũ để rà soát thêm.115. Lưu bảng kiểm tra khẳng định thành drafts/checks.md.126. Cập nhật progress.md với các quyết định, vấn đề còn bỏ ngỏ và hành động tiếp theo.137. Trả về cả đường dẫn tệp đầu ra lẫn kết quả xác minh.
Nhập /write-draft rồi gõ tiếp chủ đề. \$ARGUMENTS\ sẽ truyền đoạn văn bản đó vào quy trình, nhờ vậy luồng công việc có thể xử lý một chủ đề mới mà vẫn cho ra các đầu ra giống nhau.
Hãy gắn cho mỗi bước một kết quả có thể quan sát được.
Bước đọc tạo ra danh sách nguồn đã chọn; bước viết nháp tạo ra một tệp đã lưu; bước rà soát tạo ra các phát hiện để người viết xử lý.
Một bước chung chung như "kiểm tra độ chính xác" sẽ để ngỏ quá nhiều quyết định.
Việc nêu rõ tên người đánh giá, yêu cầu về nguồn và định dạng báo cáo sẽ giúp bước kiểm tra trở nên cụ thể.
Hãy tách riêng việc duyệt xuất bản khỏi khâu chuẩn bị bản nháp.
Skill ở trên chỉ chuẩn bị tệp để bạn kiểm tra; việc xuất bản sẽ cần một hành động và quyền phê duyệt riêng.
Khi bạn cải thiện được quy trình, hãy sửa trực tiếp skill đó.
Ví dụ, nếu ngày phát hành cứ bị nhầm lẫn, hãy thêm một bước kiểm tra để phân biệt ngày công bố với ngày tính năng thực sự khả dụng.
3. Cấp cho tác vụ quyền truy cập tài liệu nguồn
Các kết nối Model Context Protocol (MCP) giúp phơi bày công cụ từ những dịch vụ bên ngoài.
Chúng cho phép Claude lấy tài liệu từ một dịch vụ mà luồng công việc của bạn đang dùng. Hướng dẫn MCP
Hãy thêm kết nối khi nó hỗ trợ một bước cụ thể trong tác vụ.
Các tệp nguồn cục bộ vốn đã hoạt động tốt với ví dụ này, còn một bộ tài liệu lưu trữ từ xa thì có thể dùng connector.
Nếu tài liệu nguồn của bạn nằm trên Notion, hãy chạy lệnh này trong terminal:
1claude mcp add --transport http notion https://mcp.notion.com/mcp
Khi mở Claude Code, dùng /mcp để xác thực và kiểm tra trạng thái kết nối. Hãy thử truy xuất một trang mà bạn đã biết và đối chiếu nội dung trước khi phụ thuộc vào nó cho một tác vụ dài.
Cung cấp cho skill một liên kết trang hoặc mã định danh chính xác. Hãy ghi rõ cần trích xuất thông tin gì và tài liệu lấy về sẽ được dùng ở đâu.
Chẳng hạn, một trang nguồn có thể chứa cả thông số kỹ thuật sản phẩm lẫn kế hoạch nội bộ. Hãy nói cho quy trình biết phần nào dùng để viết bài và những thao tác nào connector được phép thực hiện.
Kết quả trả về từ công cụ cần chứa đủ thông tin cho quyết định tiếp theo.
Hướng dẫn thiết kế công cụ của Anthropic bàn về các đầu ra hữu ích và lỗi có thể hành động, bao gồm những thông tin giúp agent phục hồi sau một lời gọi thất bại. Viết công cụ hiệu quả
Nếu việc truy xuất thất bại, hãy giữ lại mã định danh tài liệu và lý do lỗi. Kiểm tra xác thực hoặc quyền truy cập trước khi lặp lại đúng yêu cầu đó.
Hãy xem xét các hành động khả dụng của connector và cấu hình quyền cho những thao tác làm thay đổi dịch vụ bên ngoài.
Vô hiệu hóa các server không dùng đến qua /mcp khi chúng chẳng đóng vai trò gì trong luồng công việc hiện tại.
4. Đưa các quy tắc hành động vào lớp thực thi
Hãy định nghĩa rõ luồng công việc được phép thay đổi những tệp nào và hành động nào cần xin phê duyệt.
Các quy tắc quyền hạn được áp dụng tại ranh giới công cụ.
Một hook PreToolUse có thể soi xét hành động dự kiến trước khi nó được thực thi.
Hãy dùng hook khi quyết định phụ thuộc vào tham số hoặc trạng thái tác vụ, chẳng hạn như việc đích đến có khớp với đầu ra đã duyệt hay không. Tham chiếu hook
Gộp đoạn này vào .claude/settings.json:
1{2 "permissions": {3 "deny": [4 "Read(.env)",5 "Read(.env.*)",6 "Edit(published/**)"7 ]8 }9}
Các quy tắc `Read` bao trùm những tệp môi trường được nêu tên. Quy tắc `Edit` bảo vệ các tệp trong `published/` thông qua công cụ chỉnh sửa và ghi tích hợp sẵn. Cú pháp quyền hạn.

Mở `/permissions` và kiểm tra các quy tắc đang có hiệu lực.
Cấu hình hiện có và chính sách được quản lý có thể ảnh hưởng đến những gì phiên làm việc cho phép, vì vậy hãy kiểm tra lại kết quả đã tải sau khi lưu.
Để thử cho vui, hãy tạo một tài liệu giả trong `published/` và yêu cầu Claude sửa nó bằng công cụ chỉnh sửa tệp. Hành động này lẽ ra phải bị từ chối.
Các giới hạn của công cụ tệp có phạm vi xác định.
Những tiến trình Python hoặc Node bất kỳ có thể truy cập tệp bằng chính mã của chúng; cơ chế sandbox của hệ điều hành sẽ cung cấp giới hạn xuyên suốt các tiến trình đó khi cần.
Với một thao tác ghi ra ngoài, hãy xác định rõ đích đến và chính xác nội dung đang được phê duyệt. Nếu nội dung thay đổi, hãy rà soát lại hành động đã cập nhật trước khi thực thi.
Một thao tác hết giờ cũng cần một bước phục hồi rõ ràng.
Hãy kiểm tra đích đến trước khi thử ghi lại ra ngoài, vì lần thử đầu tiên có thể đã hoàn tất rồi.
5. Buộc người đánh giá phải trả về bằng chứng
Hãy giao cho việc xác minh một phạm vi giới hạn cùng một báo cáo mà agent chính có thể dùng được.
Một subagent có ngữ cảnh riêng và bộ công cụ có thể cấu hình cho công việc đó. Cấu hình subagent

Người đánh giá cần nhận được đường dẫn bản nháp, vị trí tài liệu nguồn liên quan và những khẳng định cần soi xét.
Hãy quy định rõ cách nó báo cáo những điểm chưa chắc chắn.
Dán nội dung này vào .claude/agents/evidence-reviewer.md:
1---2name: evidence-reviewer3description: Xác minh các khẳng định thực tế trong bản nháp bằng nguồn sơ cấp.4tools: Read, Grep, Glob, WebSearch, WebFetch5effort: high6---7Đọc bản nháp được cung cấp và tài liệu nguồn của nó.8Đối chiếu các khẳng định thực tế với nguồn sơ cấp đã mở.9Trả về một bảng gồm: khẳng định, phán quyết, URL nguồn, nội dung cần sửa.10Dùng các phán quyết: verified, incorrect, unresolved.11Với những khẳng định unresolved, hãy nêu rõ bằng chứng nào đang thiếu.
Worker này được cấp quyền dùng công cụ đọc và tìm kiếm.
Việc sửa bản nháp vẫn do agent chính đảm nhiệm.
Mỗi phát hiện cần gắn được một khẳng định với một nguồn đã mở.
Một phán quyết như "incorrect" cần đi kèm bằng chứng mâu thuẫn và hướng sửa để người viết áp dụng được.
Phán quyết "unresolved" cần chỉ rõ bằng chứng nào đang thiếu.
Agent chính sẽ xem xét các phát hiện, cập nhật bản nháp và kiểm tra lại câu chữ đã sửa. Một báo cáo đầy tự tin từ người đánh giá vẫn cần có bằng chứng khả dụng đằng sau các đề xuất.
Hãy kiểm tra lại những câu liền kề nếu một chỗ sửa làm thay đổi nghĩa của cả đoạn văn.
Hướng dẫn đánh giá của Anthropic tách bạch giữa bản ghi phiên của agent và kết quả để lại trong môi trường.
Nó cũng mô tả các phương pháp kiểm tra khác nhau cho từng loại kết quả. Đánh giá agent

Hãy áp dụng sự phân biệt đó ở đây bằng cách mở bản nháp đã lưu và đối chiếu các khẳng định được trích dẫn.
Bảng rà soát phải mô tả được tài liệu thực sự sẽ được nghiệm thu.
6. Phân bổ mức nỗ lực suy luận cho công việc
Khởi động phiên chính ở mức `medium`; Opus 5.5 dùng mặc định này trừ khi có thiết lập khác ghi đè.
Người đánh giá ở trên yêu cầu mức `high` cho công việc xác minh. Cấu hình effort


Sau khi cài Claude Code và đăng nhập tài khoản, hãy chạy lệnh này từ thư mục gốc của workspace:
1claude --model claude-opus-5-5 --effort medium
Xác nhận lại Opus 5.5 và mức effort đang hoạt động trên thanh tiêu đề của phiên.
Lệnh khởi động này đặt mô hình và mức effort cho riêng phiên đó.
Effort có thể được cấu hình cho một skill hoặc subagent, tùy thuộc vào các mức mà mô hình hỗ trợ và giới hạn áp dụng.
Việc viết thêm chỉ thị về "độ sâu tư duy" không làm thay đổi thiết lập effort đã cấu hình.
Hãy chọn một tác vụ mà bạn có thể kiểm tra kết quả trước khi đổi thiết lập. Ghi lại xem những bước nghiệm thu nào đạt và đầu ra cần sửa những gì.
Điều này biến effort thành một quyết định gắn liền với một công việc cụ thể.
Một lượt rà soát nguồn chứa nhiều khẳng định mơ hồ có thể nhận cấu hình riêng, trong khi luồng viết nháp chính vẫn giữ nguyên mức đã chọn.
Trước lần chạy đầu tiên, hãy dùng `/context` để xem các chỉ thị đã tải, `/agents` để xác nhận người đánh giá, và `/permissions` để kiểm tra quy tắc hành động.
Hãy khắc phục các thành phần còn thiếu trước khi giao toàn bộ tác vụ.
7. Nói cho phiên chạy biết nó phải chứng minh điều gì
Hãy định nghĩa việc hoàn thành dựa trên các sản phẩm đã lưu và kết quả xác minh.
Một bản nháp, bảng kiểm tra của nó và ghi chú tiến độ đã cập nhật sẽ cho phiên chạy những đầu ra cụ thể để tạo ra.
Lệnh `/goal` của Claude Code đánh giá điều kiện hoàn thành dựa trên bằng chứng xuất hiện trong hội thoại giữa các lượt. Bộ đánh giá phụ thuộc vào việc agent có trưng ra được các kết quả liên quan hay không. Tài liệu về goal

Đặt chủ đề, tài liệu tham khảo và liên kết nguồn vào `sources/`. Sau đó dán nội dung này vào Claude Code:
1/goal Dùng write-draft để soạn bài từ sources/. Điều kiện hoàn thành: drafts/article.md và drafts/checks.md phải tồn tại, các khẳng định sai phải được sửa, khẳng định chưa ngã ngũ phải được đánh dấu rõ, đồng thời đường dẫn đầu ra và kết quả xác minh phải xuất hiện trong hội thoại. Dừng sau 12 lượt nếu điều kiện vẫn chưa đạt và báo cáo điểm nghẽn.
Mệnh đề về số lượt do mô hình tự đánh giá. Các giới hạn nghiêm ngặt về thời gian chạy hay chi phí cần đến cơ chế kiểm soát thực thi, và `/goal clear` sẽ xóa một goal đang hoạt động.
Khi phiên chạy kết thúc, hãy mở cả hai tệp và kiểm tra vài cặp đối chiếu khẳng định - nguồn.
Đảm bảo ghi chú tiến độ khớp với công việc đã lưu trong workspace.
Hãy dùng chung định dạng bằng chứng cho tác vụ tiếp theo.
Một báo cáo nhất quán giúp bạn nhận diện các khẳng định chưa ngã ngũ và bước kiểm tra còn thiếu mà không cần dựng lại toàn bộ hội thoại.
Để phục hồi, `/rewind` có thể hoàn tác các chỉnh sửa tệp đang được theo dõi. Thay đổi trong shell và phần lớn chỉnh sửa của subagent cần phục hồi riêng, trong khi version control lưu giữ lịch sử tệp bền vững hơn. Giới hạn checkpoint

Chạy trọn vẹn luồng công việc một lần
Tạo các thư mục nguồn và bốn tệp cấu hình trước khi bắt đầu phiên => Đặt một bản tóm tắt tác vụ ngắn gọn cạnh tài liệu nguồn để kết quả yêu cầu luôn rõ ràng.
Sao chép nội dung này vào sources/task.md và điền chi tiết:
1Chủ đề: [chủ đề cụ thể]2Người đọc: [ai cần lời giải thích này]3Sản phẩm: Một bài viết có các bước thực hành và nguồn chính thức.4Nghiệm thu: Đã phủ đủ chủ đề yêu cầu; khẳng định thực tế đã kiểm tra;5khẳng định chưa ngã ngũ đã đánh dấu; bản nháp và bảng rà soát đã lưu.6Ràng buộc: [độ dài, văn phong, chủ đề cần tránh]
Khởi động Claude Code bằng lệnh ở lớp thứ sáu và kiểm tra thiết lập đã tải => Chạy goal ở lớp thứ bảy, sau đó kiểm tra các đầu ra đã lưu.
Kết quả mong đợi là `drafts/article.md`, `drafts/checks.md` và `progress.md`.
Bảng kiểm tra phải chỉ rõ những gì đã xác minh và những gì vẫn cần bạn để mắt tới.
Nếu thiếu skill, hãy kiểm tra đường dẫn và phần frontmatter của nó.
Nếu thiếu người đánh giá, hãy kiểm tra `name` và `description` của nó, sau đó xác nhận lại qua `/agents`.
Với những khẳng định chưa ngã ngũ, hãy xem lại nguồn được cung cấp và bằng chứng mà người đánh giá yêu cầu.
Hãy lấp lỗ hổng đó hoặc giữ nguyên đánh dấu cho nổi bật trước khi chấp nhận bản nháp.
Kiểm tra xem phiên tiếp theo có thể khôi phục được gì
Hãy cập nhật `progress.md` sau mỗi giai đoạn quan trọng.
Ghi lại các tệp hiện tại, bước kiểm tra đã xong, câu hỏi còn bỏ ngỏ và hành động tiếp theo.
File CLAUDE.md ở thư mục gốc sẽ được đọc lại sau khi compaction.
Các chỉ thị theo phạm vi sẽ tải lại khi tệp liên quan được truy cập. Compaction và bộ nhớ
Dùng cấu trúc súc tích này cho ghi chú tiến độ:
1Tác vụ: [chủ đề hiện tại]2Đầu ra: [đường dẫn bản nháp và bảng rà soát]3Đã xong: [các giai đoạn và bước kiểm tra đã hoàn tất]4Quyết định: [lựa chọn đã chốt và nguồn của chúng]5Vấn đề bỏ ngỏ: [bằng chứng thiếu hoặc điểm nghẽn]6Hành động tiếp: [một bước cụ thể để làm tiếp]
Mở một phiên mới trong cùng workspace và dán:
1Đọc progress.md và kiểm tra bản nháp cùng bảng rà soát được nhắc đến.2Tiếp tục từ hành động tiếp theo đã ghi và cập nhật ghi chú tiến độ.
Phiên làm việc lẽ ra phải nhận diện được phần việc đã lưu và tiếp tục từ điểm chuyển giao. Nếu nó làm lại từ đầu, hãy kiểm tra ghi chú và bổ sung quyết định hoặc đường dẫn tệp còn thiếu.
Hướng dẫn về agent chạy dài của Anthropic sử dụng các bản ghi tiến độ liên tục để hỗ trợ công việc xuyên suốt nhiều phiên.
Hãy cập nhật những bản ghi đó khi tác vụ thay đổi để phiên chạy tiếp nối có được thông tin mới nhất. Harness cho tác vụ dài

Đo lường thiết lập trên công việc đã được nghiệm thu
Dùng `/usage` để xem mức sử dụng được báo cáo và `/context` để biết những gì đang chiếm ngữ cảnh làm việc. Hãy tính cả phần rà soát được ủy quyền và các lần thử lại vào tổng mức của tác vụ. Hướng dẫn usage
Ghi lại thời gian bạn rà soát và những chỗ cần sửa trong kết quả.
Một đầu ra đòi hỏi tu bổ nhiều sẽ làm thay đổi giá trị của cả phiên chạy.
Hãy giữ nguyên tác vụ và tiêu chí nghiệm thu khi thử nghiệm một thay đổi cấu hình.
Điều chỉnh một thành phần, lặp lại tác vụ, rồi kiểm tra cả kết quả đã lưu lẫn bằng chứng của nó.
Mức giảm 60% token được nhắc đến trong báo cáo thử nghiệm sớm của Anthropic chỉ thuộc về thí nghiệm với mô hình đó.
Hãy tự đo lường mức tiết kiệm từ harness của bạn thông qua các tác vụ đã hoàn thành. Thông báo về Opus 5.5
Sau lần chạy đầu tiên được nghiệm thu, hãy tái sử dụng skill đó với một chủ đề và bộ nguồn mới. Giữ nguyên người đánh giá, đường dẫn đầu ra và định dạng hoàn thành, sau đó cập nhật quy trình khi một lỗi lặp đi lặp lại hé lộ ra một bước còn thiếu.
Lưu lại để không bị mất nhé
Theo dõi @beamnxw để đón đọc thêm nhiều alpha :)


![Phân tích giải Japan Dirt Classic [S]](/cdn-cgi/image/width=1920,quality=90,format=auto,metadata=none/https%3A%2F%2Fcms-assets.youmind.com%2Fmedia%2F1791393139056_tgbkmu_HT9OCqSasAAks5y.jpg)


