Hướng dẫn toàn diện về Claude Fable 5.1: Sự tiến hóa, tối ưu hóa token và xây dựng kỹ năng

@MakeAI_CEO
TIẾNG NHẬT01 thg 9, 2026
253K
312
25
3
701

TL;DR

Hướng dẫn này khám phá những thế mạnh của Claude Fable 5.1 trong các tác vụ tác nhân dài hạn, chi tiết hóa tính năng Tư duy thích ứng (Adaptive Thinking), các chiến lược lưu trữ bộ nhớ đệm giúp tiết kiệm chi phí, và cách xây dựng các kỹ năng mạnh mẽ để sản xuất nội dung và mã nguồn phức tạp.

Sự Tiến Hóa, Tiết Kiệm Token, Prompt, Harness và Xây Dựng Kỹ Năng

Vào ngày 1 tháng 9 năm 2026, Anthropic đã phát hành "Claude Fable 5.1." Tính đến ngày 2 tháng 9 năm 2026, khi tôi đang viết bài này, mới chỉ có một ngày kể từ khi phát hành. Do đó, thay vì những đánh giá chủ quan trên mạng xã hội, tôi sẽ tổ chức thông tin này dựa trên tài liệu chính thức của Anthropic, tài liệu API và các thông số kỹ thuật Claude Code mới nhất.

Để đưa ra kết luận trước: Fable 5.1 không chỉ đơn thuần là một "mô hình trả lời các câu hỏi thông thường thông minh hơn một chút."

Bản chất của nó nằm ở khả năng xử lý các tác vụ kéo dài hàng giờ hoặc nhiều ngày mà không đánh mất mục tiêu, đào sâu vào nguyên nhân gốc rễ thay vì các vấn đề bề mặt, và tự xác minh đầu ra của chính nó cho đến phút cuối cùng.

Tuy nhiên, giá thành gấp đôi Opus 5 và gấp năm lần Sonnet 5. Hơn nữa, không thể tắt quá trình suy nghĩ nội bộ. Nếu bạn ném mọi thứ vào Fable 5.1, bạn sẽ cạn kiệt giới hạn sử dụng và ngân sách trước khi có thể thực sự khai thác khả năng của nó.

Chìa khóa để làm chủ Fable 5.1 không chỉ là viết những prompt tuyệt vời.

Mà là thiết kế những tác vụ cụ thể nào sẽ giao cho Fable, thông tin nào cần tải, và quy trình nào cần chuyển sang các mô hình hoặc tập lệnh rẻ hơn.

Phần 1: Giải Thích Toàn Diện Về Claude Fable 5.1

1. Claude Fable 5.1 là gì?

Claude Fable 5.1 được định vị là mô hình có năng lực cao nhất trong số những mô hình mà Anthropic đã phát hành ra công chúng.

Fable 5.1 và Claude Mythos 5.1 (chỉ dành cho khách mời) về cơ bản là cùng một mô hình. Sự khác biệt chủ yếu nằm ở các biện pháp an toàn. Fable công khai bao gồm các bộ phân loại mạnh để phát hiện các lĩnh vực rủi ro cao như an ninh mạng, khoa học sự sống và hóa học. Trong khi đó, Mythos được sử dụng bởi các tổ chức đã được thẩm định cho mục đích nghiên cứu phòng thủ và các mục đích khác. (Anthropic

Các thông số kỹ thuật chính như sau:

Mục

Claude Fable 5.1

Ngày phát hành

1 tháng 9 năm 2026

ID Mô hình API

claude-fable-5-1

Cửa sổ ngữ cảnh

1 Triệu Token

Đầu ra tối đa

128.000 Token

Giá đầu vào tiêu chuẩn

$10 mỗi 1 triệu token

Giá đầu ra tiêu chuẩn

$50 mỗi 1 triệu token

Giá đọc bộ nhớ đệm

$0,25 mỗi 1 triệu token

Phương pháp suy nghĩ

Adaptive Thinking, Luôn Bật

Mức độ nỗ lực tiêu chuẩn

high

Giới hạn kiến thức

Tháng 6 năm 2026

Tốc độ tương đối

Chậm hơn Opus 5

Nền tảng khả dụng chính

Claude API, Bedrock, Google Cloud, Microsoft Foundry, v.v.

Đối với người dùng Claude cá nhân, nó khả dụng cho người dùng Pro, Max, Team và Enterprise. Trên API, nó khả dụng cho khách hàng thông thường mà không cần sàng lọc đặc biệt. (Claude Platform

Một ngữ cảnh 1 triệu token, bằng cách tính toán đơn giản, có thể xử lý cùng lúc vài đến hàng chục cuốn sách, kho mã nguồn khổng lồ hoặc lịch sử hội thoại dài.

Tuy nhiên, "có thể chứa 1 triệu token" khác với "bạn nên đưa vào 1 triệu token."

Bạn càng nhồi nhét nhiều tệp không liên quan, các cuộc trò chuyện cũ và nhật ký dài, thì thông tin quan trọng càng bị chôn vùi. Mặc dù Fable 5.1 có thể xử lý các ngữ cảnh lớn, nhưng nó không tự động vô hiệu hóa ngữ cảnh không liên quan cho bạn.

2. Sự Tiến Hóa Của Fable 5.1 Là "Làm Việc Lâu Hơn"

Sự tiến hóa quan trọng nhất của Fable 5.1 không phải là độ chính xác trong một lần, mà là khả năng duy trì tính nhất quán trong các tác vụ tác nhân kéo dài.

Các tác nhân AI nói chung có xu hướng gây ra các vấn đề sau khi tác vụ kéo dài hơn:

  • Quên mất mục tiêu ban đầu.
  • Chỉ thực hiện các sửa chữa triệu chứng mà không điều tra nguyên nhân.
  • Đọc đi đọc lại cùng một tệp hoặc trang web.
  • Tùy tiện thu hẹp phạm vi công việc giữa chừng.
  • Tuyên bố "Tôi sẽ kiểm tra tiếp theo" và sau đó kết thúc.
  • Thực hiện các thay đổi lớn nhưng không thực hiện kiểm tra hoạt động cuối cùng.

Fable 5.1 tập trung cao độ vào việc cải thiện những sự cố này trong quá trình làm việc dài hạn. Các mô tả chính thức liệt kê việc viết mã, thao tác trình duyệt, nghiên cứu và tạo tài liệu/bảng tính/slide kéo dài từ vài giờ đến nhiều ngày là các trường hợp sử dụng chính. Nó được thiết kế để phục hồi sau các bước thất bại, sắp xếp lại thứ tự ưu tiên và tiếp tục trong khi duy trì nhật ký công việc của chính nó. (Anthropic

Các công ty áp dụng sớm đã báo cáo các trường hợp sau:

Tại MongoDB, nó được cho là đã điều tra mã dịch vụ và tài liệu để tạo ra một thiết kế mới, hoàn thành một nguyên mẫu phức tạp trong khoảng ba ngày thông qua hàng giờ thực thi tự động. Tại Ramp, nó đã hoạt động liên tục trong 38 giờ cho một vấn đề học máy, phát hiện ra các vấn đề ghi nhãn trong các kết quả trong quá khứ và thực thi sáu thí nghiệm song song sau khi sửa chúng. (Anthropic

Hơn nữa, trong một trường hợp từ Millennium, có báo cáo rằng đối với một sự cố chỉ xảy ra một lần trong một triệu lần, mô hình đã tháo rời các thư viện bên ngoài, đối chiếu chúng với các kết xuất lõi và tìm ra nguyên nhân đã không được phát hiện trong nhiều năm. Mặc dù đây là những câu chuyện khách hàng trên trang chính thức chứ không phải kết quả được tái tạo bởi các tổ chức độc lập, nhưng chúng thể hiện rõ ràng hướng đi mà Fable 5.1 đang hướng tới. (Anthropic

Tóm lại, Fable 5.1 ít giống một "AI viết nhiều mã" và giống một:

Trưởng nhóm có trách nhiệm, người cô lập các vấn đề khó khăn, thu thập thông tin cần thiết, thử nhiều phương pháp, xác minh bằng chứng và cuối cùng tổng hợp kết quả.

3. Điều Gì Đã Được Cải Thiện Trong Các Điểm Chuẩn?

Theo các điểm số chính do Anthropic công bố, Fable 5.1 đã có sự tăng trưởng đáng kể trong các tác nhân dài hạn, nghiên cứu khoa học và tự động hóa kinh doanh.

Trong Terminal-Bench-Science 0.1, đo lường các tác vụ đầu cuối khoa học, nó đã tăng từ 24,7% ở Fable 5 lên 52,6%. Trong Terminal-Bench 4.0, đo lường viết mã tác nhân tổng quát, nó đạt 55,8% so với 42,0% của Fable 5. Mythos 5.1, với các giới hạn an toàn khác nhau, đạt 60,9%.

Trong AutomationBench, đo lường tự động hóa kinh doanh, nó đã tăng từ 17,1% ở Fable 5 lên 31,4%. Trong CursorBench 3.2, Fable 5.1 đạt 73,4%, so với 70,5% của Fable 5 và 70,0% của Opus 5.

Ngoài ra, trong Humanity's Last Exam, đo lường khả năng suy luận nâng cao trên nhiều lĩnh vực, nó đạt 60,9% khi không có công cụ và 65,0% khi có công cụ. (Anthropic

Tuy nhiên, cần thận trọng khi đọc những con số này.

Đây là các kết quả đánh giá do Anthropic công bố. Hơn nữa, Fable có bật các bộ phân loại an toàn sản xuất; trong các vấn đề mà bộ phân loại can thiệp, nó có thể đạt điểm 0 hoặc quy trình có thể chuyển sang một mô hình khác. Do đó, sự khác biệt giữa Fable và Mythos có thể bao gồm sự khác biệt về cài đặt an toàn chứ không chỉ là khả năng mô hình thuần túy. (Anthropic

Ngoài ra, ở giai đoạn một ngày sau khi phát hành, điều quan trọng hơn là đứng đầu trong các điểm chuẩn là "tỷ lệ hoàn thành tác vụ" trong công việc thực tế của chính bạn.

Ví dụ, trong sản xuất bài viết, chỉ đánh giá văn bản là không đủ:

  • Nó có thể xác minh sự thật dựa trên các nguồn chính không?
  • Nó có tuân theo số lượng ký tự được chỉ định không?
  • Nó có loại bỏ sự dư thừa và mâu thuẫn không?
  • Nó có phân biệt giữa trích dẫn và tóm tắt không?
  • Nó có nhất quán từ tiêu đề đến kết luận không?

Trừ khi bạn chuẩn bị các đánh giá thực tế như vậy, việc sử dụng Fable đắt tiền có thể chỉ dẫn đến việc nó suy nghĩ trong một thời gian dài mà không có kết quả tốt hơn.

4. Adaptive Thinking Hiện Luôn Bật

Trong Fable 5.1, Adaptive Thinking luôn bật.

Không giống như các mô hình trước đây, không thể tắt hoàn toàn quá trình suy nghĩ. Việc chỉ định thinking: {type: "disabled"} trong API sẽ dẫn đến lỗi. Phương pháp mà con người chỉ định một số lượng token suy nghĩ cố định cũng không khả dụng; bản thân mô hình điều chỉnh lượng suy nghĩ dựa trên vấn đề. (Claude Platform

Điều mà người dùng điều chỉnh là "mức độ nỗ lực" (effort).

Có năm cấp độ khả dụng:

  • low
  • medium
  • high
  • xhigh
  • max

Mặc định là high.

Khuyến nghị chính thức là bắt đầu với high và sau đó giảm hoặc tăng dựa trên kết quả đánh giá thực tế. Đối với xử lý thông thường, sử dụng medium hoặc low; chỉ sử dụng xhigh hoặc max cho các công việc thiết kế, gỡ lỗi, nghiên cứu hoặc tác nhân dài hạn rất khó khăn.

Fable 5.1 được cho là tạo ra hiệu suất gần với Fable 5 cũ ngay cả ở mức medium, và ở mức low, nó có thể có tỷ lệ chi phí-hiệu suất trên mỗi tác vụ cao hơn so với chạy một mô hình nhỏ hơn ở mức high cho một số công việc nhất định. (Claude Platform

Điều quan trọng ở đây là suy nghĩ nội bộ cũng được tính phí như token đầu ra và tiêu thụ max_tokens.

Ví dụ: ngay cả khi bản thảo cuối cùng hiển thị trên màn hình là 10.000 token, nếu nó sử dụng tương đương 10.000 token để suy nghĩ trước đó, tổng cộng 20.000 token sẽ phải chịu phí đầu ra. Vì đơn giá đầu ra của Fable là $50 mỗi 1 triệu token, việc sử dụng max một cách không cần thiết sẽ làm tăng mức tiêu thụ một cách nhanh chóng. (Claude Platform

Fable 5.1 không phải là một mô hình mà "nỗ lực cao hơn luôn mang lại lợi nhuận."

Việc sử dụng max để định dạng văn bản hoặc tóm tắt có thể chỉ làm tăng các trường hợp mô hình viết bản nháp nội bộ và sau đó viết lại nó trong trường phản hồi. Anthropic cũng khuyên bạn nên sử dụng high cho các bản phân phối dài theo nguyên tắc và chỉ nâng cấp lên xhigh trở lên nếu có thể đo lường được sự cải thiện về chất lượng. (Claude Platform

5. Giá Cao, Nhưng Bộ Nhớ Đệm Cực Kỳ Rẻ

Giá tiêu chuẩn cho Fable 5.1 là $10 mỗi 1 triệu token đầu vào và $50 mỗi 1 triệu token đầu ra.

Vì Opus 5 là $5/$25 và Sonnet 5 là $2/$10, Fable đắt gấp đôi Opus và gấp năm lần Sonnet về định giá token đơn giản. (Claude Platform Docs

Mặt khác, một thay đổi lớn trong Fable 5.1 là giá đọc bộ nhớ đệm.

Trong khi nó là $1 mỗi 1 triệu token ở Fable 5, thì ở Fable 5.1 nó đã trở thành $0,25. Đây là 2,5% giá đầu vào thông thường. Anthropic ước tính rằng trong xử lý điển hình, điều này sẽ dẫn đến giảm chi phí khoảng 25% so với Fable cũ và lên tới khoảng 45% đối với xử lý tác nhân đọc bộ nhớ đệm nhiều lần. (Anthropic

Ví dụ: nếu bạn đọc một ngữ cảnh cố định 100.000 token mỗi lần, chi phí sẽ là $0,10 mỗi lần ở mức đầu vào thông thường, nhưng chỉ $0,0025 nếu đó là một lần truy cập bộ nhớ đệm.

Nói cách khác, công việc đọc đi đọc lại cùng một mô tả dự án, định nghĩa công cụ, tiền đề kho mã nguồn và lịch sử hội thoại một cách ổn định sẽ có lợi thế hơn.

Ngược lại, việc sử dụng viết lại prompt hệ thống mỗi lần, sắp xếp lại danh sách công cụ hoặc xóa và xây dựng lại các cuộc trò chuyện cũ sẽ phá vỡ bộ nhớ đệm.

Trong Fable 5.1, một cấu trúc prompt không phá vỡ có liên quan trực tiếp đến chi phí hơn là một prompt thông minh.

6. Fable 5.1 Có Thể Phá Vỡ Các Harness API Hiện Có

Khi chỉ thay đổi tên mô hình từ Fable 5 hoặc Opus, có ba điểm cần đặc biệt cẩn thận:

Không khả dụng tính năng gọi công cụ bắt buộc

Việc ép buộc bất kỳ tên công cụ nào hoặc một tên công cụ cụ thể trong tool_choice sẽ dẫn đến lỗi 400.

Lý do là việc ép buộc gọi công cụ khiến mô hình bỏ qua các quy trình suy nghĩ thông thường và bắt đầu suy nghĩ bên trong các đối số của công cụ, điều này làm giảm chất lượng đối số.

Thay vào đó, hãy sử dụng tool_choice: auto và nêu rõ "Vui lòng sử dụng công cụ XX cho quy trình này" trong prompt. Nếu bạn muốn đảm bảo định dạng JSON, hãy sử dụng strict: true hoặc Structured Outputs. (Claude Platform

Lịch sử hội thoại không được viết lại giữa chừng

Khối suy nghĩ trong Fable 5.1 được gắn với prompt hệ thống, công cụ và các tin nhắn trong quá khứ tại thời điểm khối suy nghĩ đó được tạo ra.

Nếu bạn xóa các tin nhắn cũ, tạo lại prompt hệ thống hoặc viết lại các định nghĩa công cụ trong quá khứ giữa chừng, các khối suy nghĩ tiếp theo sẽ trở nên không hợp lệ. Đối với các tài khoản mới, một cơ chế làm cho vi phạm điều kiện này trở thành lỗi đã được áp dụng. (Claude Platform

Nguyên tắc cơ bản là không chỉnh sửa lịch sử, mà chỉ thêm vào cuối.

Các hướng dẫn tạm thời nên được thêm dưới dạng tin nhắn hệ thống theo lượt và các ngữ cảnh dài nên được tổ chức bằng cách sử dụng tính năng nén phía máy chủ hoặc chỉnh sửa ngữ cảnh.

Suy nghĩ nội bộ không thể được chuyển tiếp khi quay lại các mô hình rẻ hơn

Fable 5.1 có thể đọc các khối suy nghĩ được tạo bởi các mô hình trước đó như Opus 5, Fable 5 hoặc Sonnet.

Tuy nhiên, điều ngược lại là không thể. Nếu bạn chuyển một khối suy nghĩ do Fable 5.1 tạo cho Opus hoặc Sonnet, các mô hình đó không thể đọc được nó. (Claude Platform Docs

Do đó, nếu bạn chuyển đổi mô hình trong cùng một cuộc hội thoại, thứ tự sau đây thường an toàn:

Khám phá với các mô hình rẻ → Chuyển lên Fable

Nếu bạn quay lại một mô hình rẻ hơn từ Fable, bạn phải để lại các quyết định, các vấn đề chưa được giải quyết, các tệp cần thiết và kết quả xác minh dưới dạng một tài liệu bàn giao rõ ràng mà không dựa vào khối suy nghĩ.

7. Các Hạn Chế An Toàn và Lưu Giữ Dữ Liệu

Trong Fable 5.1, một số yêu cầu liên quan đến an ninh mạng hoặc khoa học sự sống bị hạn chế bởi các bộ phân loại an toàn.

Trong ứng dụng Claude tiêu chuẩn, các quy trình tương ứng có thể được tự động định tuyến đến Opus 4.8 hoặc Opus 5. Trong API, bạn cần thiết lập cài đặt dự phòng. Bạn sẽ không bị tính phí Fable cho các quy trình được chuyển sang các mô hình khác. (Anthropic

Ngoài ra, Fable 5.1 thường yêu cầu lưu giữ dữ liệu trong 30 ngày. Trừ khi bạn đã nhận được sự cho phép rõ ràng từ Anthropic, nó không thể được sử dụng trong môi trường Zero Data Retention tiêu chuẩn.

Khi xử lý mã bí mật của công ty, thông tin khách hàng hoặc tài liệu nghiên cứu chưa được công bố, bạn nên giới thiệu nó chỉ sau khi xác nhận hợp đồng và các điều kiện lưu giữ, chứ không chỉ sử dụng nó "vì hiệu suất cao." (Claude Platform

8. Cuối Cùng, Ai Cần Fable 5.1?

Fable 5.1 dành cho những người mà tỷ lệ hoàn thành của toàn bộ công việc, chứ không phải phản hồi của một mô hình đơn lẻ, là giá trị.

  • Điều tra và sửa đổi các kho mã nguồn khổng lồ.
  • Phân tích nguyên nhân gốc rễ của các lỗi khó tái tạo.
  • Nghiên cứu trải dài hàng chục tài liệu.
  • Các tác vụ từ nghiên cứu đến tạo bảng tính, tài liệu và slide.
  • Thao tác trình duyệt kéo dài hoặc xử lý tồn đọng.
  • Nghiên cứu tự động lập kế hoạch và thực thi nhiều thí nghiệm.

Ngược lại, hầu như không cần sử dụng Fable để tạo email, tóm tắt ngắn, tạo mã đơn giản, sắp xếp tài liệu thông thường hoặc viết nháp các bài đăng trên mạng xã hội.

Bản thân Anthropic khuyên bạn nên bắt đầu xử lý chung với Opus 5 và chỉ nâng cấp lên Fable nếu chất lượng không đủ ngay cả khi chạy Opus ở mức high. (Claude Platform Docs

Fable 5.1 không phải là "mô hình tiêu chuẩn để mọi người sử dụng ngay từ đầu," mà là một mô hình cao cấp để vượt qua các điểm khó khăn.

Phần 2: Tiết Kiệm Token, Prompt, Harness và Xây Dựng Kỹ Năng

1. Kỹ Thuật Tiết Kiệm Token Cho Fable 5.1

Mẹo tiết kiệm 1: Đừng bắt Fable làm mọi thứ từ đầu

Phương pháp tiết kiệm hiệu quả nhất không phải là viết những câu ngắn.

Mà là giảm số lần bạn gọi chính Fable.

Hãy để việc lấy danh sách tệp, lọc nhật ký, phân loại tài liệu, tóm tắt đơn giản và chuyển đổi định dạng cho Sonnet, Haiku hoặc các tập lệnh thông thường.

Sử dụng Fable cho các giai đoạn như sau:

  • Quyết định chính sách nghiên cứu
  • Chọn giả thuyết hứa hẹn nhất từ một số giả thuyết
  • Tích hợp thông tin mâu thuẫn
  • Xác định nguyên nhân gốc rễ
  • Kiểm toán các sản phẩm cuối cùng
  • Xem xét lại các vấn đề mà các mô hình khác đã thất bại

Tài liệu chính thức cũng hướng dẫn các cấu hình sử dụng nhiều mô hình, với các mô hình rẻ tiền làm người thực thi và các mô hình cao cấp làm cố vấn hoặc giám sát viên. (Claude Platform Docs

Mẹo tiết kiệm 2: Thay đổi mức độ nỗ lực cho mỗi bước

Bạn không cần đặt toàn bộ phiên làm việc ở mức max.

Tôi khuyên bạn nên phân bổ như sau:

Quy trình

Mức độ nỗ lực

Khám phá tệp / Sắp xếp thông tin

low hoặc medium

Triển khai thông thường / Tạo bản thảo

medium hoặc high

Thiết kế / Phân tích nguyên nhân / Tích hợp

high

Đột phá cuối cùng của các vấn đề khó khăn

xhigh

Xác minh cuối cùng khi chi phí thất bại cực kỳ cao

max (chỉ khi cần thiết)

Fable 5.1 cũng cung cấp một cơ chế để thay đổi mức độ nỗ lực trong một cuộc hội thoại. Thay vì viết lại các cài đặt cấp cao nhất, việc thêm các thay đổi về mức độ nỗ lực dưới dạng tin nhắn hệ thống giữa chừng cho phép bạn duy trì bộ nhớ đệm prompt. (Claude Platform

Cách tiếp cận đúng đắn không phải là "luôn có khả năng tối đa," mà là "khả năng tối đa chỉ cho những bước đi khó khăn."

Mẹo tiết kiệm 3: Giữ lịch sử chỉ thêm vào cuối để bảo vệ bộ nhớ đệm

Trong Fable 5.1, hãy giữ các nội dung sau cố định:

  • Prompt hệ thống
  • Định nghĩa và thứ tự công cụ
  • Quy tắc chung của dự án
  • Các tin nhắn trong quá khứ
  • Các khối suy nghĩ

Thêm tất cả các thay đổi vào cuối.

Nếu bạn đang xây dựng API của riêng mình, sẽ an toàn hơn nếu duy trì cùng một tiền tố byte-for-byte thay vì lắp ráp lại prompt hệ thống mỗi lần.

Trong Claude Code, xử lý bộ nhớ đệm về cơ bản được tự động hóa, nhưng bạn có thể sử dụng cache_control trong API. Đối với các cuộc hội thoại nhiều lượt, hãy sử dụng bộ nhớ đệm tự động; để tách các tài liệu cố định dài, hãy sử dụng các ranh giới bộ nhớ đệm rõ ràng. (Claude

Mẹo tiết kiệm 4: Đừng đưa đầu ra công cụ vào nguyên trạng

Đưa 10.000 dòng nhật ký cho Claude và yêu cầu nó "tìm lỗi" là lãng phí.

Trước tiên hãy lọc chúng bằng các tập lệnh hoặc hook.

Hướng dẫn chi phí chính thức của Claude Code cũng khuyến nghị xử lý trước các nhật ký dài bằng hook và chỉ chuyển vài trăm dòng cần thiết cho mô hình. Nó cũng giải thích rằng việc sử dụng các CLI như gh, aws hoặc gcloud khi có sẵn sẽ dễ dàng hơn cho việc kiểm soát mức tiêu thụ ngữ cảnh từ các định nghĩa công cụ so với việc kết nối một số lượng lớn máy chủ MCP. (Claude

Trước khi để AI đọc nó, hãy cắt bỏ những gì có thể cắt bằng máy.

Mẹo tiết kiệm 5: Nhóm các lệnh gọi công cụ độc lập

Khi đọc năm tệp, nếu bạn chia nó thành năm lượt, mỗi lượt một tệp, lịch sử hội thoại sẽ được gửi mỗi lần.

Việc bao gồm hướng dẫn sau trong Fable 5.1 là hiệu quả:

"Tổ chức thông tin cần thiết nội bộ và thực thi song song các thao tác đọc, tìm kiếm và xác minh không phụ thuộc vào kết quả của nhau trong cùng một lượt."

Anthropic cũng giải thích rằng bằng cách khuyến khích việc nhóm các lệnh gọi công cụ độc lập trong một phản hồi duy nhất, bạn có thể giảm số lượng vòng lặp, token và thời gian chờ. (Claude Platform

Mẹo tiết kiệm 6: Đừng để nó viết lại toàn bộ tệp cho các sửa chữa nhỏ

Fable 5.1 có thể viết lại toàn bộ tệp ngay cả đối với những thay đổi nhỏ.

Hãy bao gồm câu này trong các quy tắc chung của bạn:

"Nếu kết quả cuối cùng không thay đổi, đừng viết lại toàn bộ tệp; chỉ chỉnh sửa những phần cần thiết với các diff tối thiểu."

Điều này đặc biệt hiệu quả đối với Markdown dài, JSON, tệp cấu hình, LP và mã nguồn lớn. Bằng cách ngăn chặn việc tạo lại toàn bộ, bạn có thể kiểm soát các token đầu ra và gánh nặng xác minh diff. (Claude Platform

Mẹo tiết kiệm 7: Đừng tiếp tục công việc không liên quan trong cùng một phiên

Trong Claude Code, hãy sử dụng /clear khi chuyển sang công việc không liên quan.

Trong các cuộc hội thoại dài, ngay cả việc thêm một câu hỏi ngắn cũng có nghĩa là xử lý lại các cuộc trò chuyện trong quá khứ, các tệp đã đọc và kết quả công cụ. Ngay cả khi bộ nhớ đệm hoạt động, nó không miễn phí.

Nếu bạn không muốn làm ô nhiễm lịch sử với các câu hỏi tạm thời, hãy sử dụng /btw; nếu bạn muốn chỉ giữ lại nội dung cần thiết, hãy sử dụng /compact. Chuyển việc khám phá kho mã nguồn cho các tác nhân phụ và chỉ trả lại các bản tóm tắt cho cuộc hội thoại chính. (Claude

2. Prompt Thực Tế Cho Fable 5.1

Đối với Fable 5.1, việc truyền đạt rõ ràng mục tiêu, phạm vi, điều kiện hoàn thành và phương pháp xác minh sẽ hiệu quả hơn là chỉ định hàng chục bước suy nghĩ chi tiết.

Dưới đây là một mẫu cơ bản có thể được điều chỉnh cho việc viết mã, nghiên cứu, sản xuất bài viết và tạo tài liệu.

Vai trò

Bạn là người chịu trách nhiệm thực hiện yêu cầu này đến khi hoàn thành.

Bạn phụ trách không chỉ trả lời, mà còn cả nghiên cứu, công việc, xác minh và sửa chữa cần thiết.

Mục tiêu

[Viết sản phẩm cuối cùng cần tạo hoặc vấn đề cần giải quyết]

Đầu vào

[Viết các tệp, URL, tài liệu và điều kiện tiên quyết]

Phạm vi

Cần thực hiện:

  • [Nhiệm vụ bắt buộc]
  • [Nhiệm vụ bắt buộc]

Không cần thực hiện:

  • [Ngoài phạm vi]
  • [Nội dung bạn không muốn thay đổi tùy tiện]

Điều kiện hoàn thành

Nhiệm vụ được coi là hoàn thành khi tất cả các điều kiện sau được đáp ứng:

  1. [Điều kiện về chức năng/nội dung]
  2. [Điều kiện về định dạng/số lượng ký tự/chất lượng]
  3. [Phương pháp xác minh]
  4. [Bằng chứng cho thấy không có lỗi]

Quy tắc thực thi

  • Đầu tiên, tổ chức thông tin cần thiết và các phụ thuộc.
  • Thực thi song song các thao tác tìm kiếm, đọc và xác minh không phụ thuộc vào kết quả của nhau.
  • Tiến hành công việc có thể đảo ngược trong phạm vi yêu cầu mà không cần xin phép giữa chừng.
  • Xác nhận nguyên nhân trước khi sửa chữa, không chỉ các triệu chứng của vấn đề.
  • Không thực hiện các bổ sung tính năng, tối ưu hóa hoặc sửa chữa ngoại vi không được yêu cầu; tách chúng ra dưới dạng đề xuất ở cuối.
  • Chỉnh sửa tệp với các diff tối thiểu bất cứ khi nào có thể.
  • Sau khi làm việc, xác minh theo các điều kiện hoàn thành ban đầu.
  • Nếu xác minh thất bại, hãy điều tra nguyên nhân, sửa chữa và xác minh lại.
  • Đừng kết thúc bằng cách viết "việc cần làm tiếp theo"; hãy thực thi công việc đó.
  • Chỉ xác nhận trước khi thực thi đối với các thao tác phá hủy hoặc thay đổi thông số kỹ thuật lớn.

Báo cáo cuối cùng

Cuối cùng, hãy báo cáo ngắn gọn theo thứ tự sau:

  1. Những gì đã được hoàn thành
  2. Các thay đổi đã thực hiện
  3. Kết quả xác minh và bằng chứng
  4. Các vấn đề còn lại
  5. Các ứng cử viên cải tiến đã nhận thấy nhưng nằm ngoài phạm vi

Fable 5.1 có thể tiếp tục làm việc trong một thời gian dài, nhưng nếu không rõ ràng điều gì cấu thành sự hoàn thành, nó sẽ tiếp tục khám phá nhiều hơn mức cần thiết.

Do đó, viết các điều kiện hoàn thành và dừng quan trọng hơn là nói "hãy suy nghĩ sâu sắc."

3. Thiết Kế Harness Để Tận Dụng Fable 5.1

Harness là cơ chế làm việc xung quanh mô hình.

Thay vì chỉ dựa vào khả năng của mô hình, bạn quyết định từ bên ngoài những thông tin nào sẽ chuyển, những công cụ nào sẽ sử dụng, theo thứ tự nào, xác minh ở đâu và thử lại bao nhiêu lần khi thất bại.

Tôi khuyên bạn nên sử dụng cấu trúc 6 lớp sau:

Lớp 1: Quy tắc chung

Trong CLAUDE.md, chỉ đặt các sự kiện dự án cần thiết mỗi lần.

Dự án

  • Kho lưu trữ này dành cho dịch vụ XX
  • Môi trường sản xuất là XX
  • Sử dụng pnpm để quản lý gói

Kiểm tra bắt buộc

  • pnpm lint sau khi thay đổi
  • pnpm test sau khi thay đổi
  • Kiểm tra kiểu khi thay đổi API

Ràng buộc

  • Không phá vỡ khả năng tương thích với các API hiện có
  • Không xuất thông tin bí mật ra nhật ký
  • Không tái cấu trúc ngoài yêu cầu

Vì CLAUDE.md được đọc trong mọi phiên làm việc, việc để nó quá dài sẽ tiêu tốn ngữ cảnh mỗi lần. Tài liệu chính thức khuyến nghị giữ một tệp dưới 200 dòng và chuyển các quy trình dài sang Skills. (Claude

Lớp 2: Router (Bộ định tuyến)

Khi nhận được một yêu cầu, hãy phân loại công việc thay vì bắt đầu Fable ngay lập tức.

  • Trích xuất/định dạng đơn giản -> Haiku hoặc script
  • Triển khai/nghiên cứu thông thường -> Sonnet
  • Thiết kế/phân tích phức tạp -> Opus
  • Công việc dài hạn/vấn đề khó -> Fable
  • Chỉ những điểm khó đã thất bại -> Fable xhigh

Khi tạo một bộ định tuyến tự động, hãy đánh giá dựa trên "mức độ thiệt hại nếu sai", "thời gian tự chủ cần thiết" và "độ khó của việc xác minh" thay vì giá cả.

Lớp 3: Trưởng nhóm Khám phá (Exploration Lead)

Tách biệt việc khám phá mã nguồn, thu thập tài liệu và nghiên cứu đối thủ cạnh tranh thành các tác nhân phụ (subagents).

Mỗi tác nhân phụ làm việc trong một ngữ cảnh độc lập và chỉ trả lại kết luận cùng bằng chứng cho tác nhân chính. Điều này ngăn chặn kết quả đọc từ hàng chục tệp tin làm phình to lịch sử chính. (Claude

Lớp 4: Giám sát Fable (Fable Supervisor)

Fable đưa ra phán đoán bằng cách sử dụng các kết quả được trả về từ các trưởng nhóm khám phá.

  • Giả thuyết nào nên được chấp nhận
  • Liệu có cần nghiên cứu thêm không
  • Những thay đổi nào cần thực hiện
  • Có mâu thuẫn nào trong kết quả không
  • Các điều kiện hoàn thành đã được đáp ứng chưa

Thay vì bắt Fable chịu trách nhiệm cho mọi thứ cho đến tận khâu thu thập dữ liệu thô, hãy chuyển cho nó những bằng chứng đã được tổ chức và để nó tập trung vào việc phán đoán.

Lớp 5: Xác minh Xác định (Deterministic Verification)

Đừng chỉ để việc xác minh phụ thuộc vào các prompt.

  • Đối với mã nguồn: Kiểm thử (Tests), Lint, kiểm tra kiểu dữ liệu (type checks).
  • Đối với bài viết: Số ký tự, biểu thức trùng lặp, URL, trích dẫn.
  • Đối với bảng tính: Lỗi công thức, giá trị bị thiếu, tổng số.
  • Đối với Landing Page: Liên kết, lỗi bố cục, so sánh ảnh chụp màn hình.

Sử dụng hooks, bạn có thể chạy các kiểm tra trước và sau khi thực thi công cụ. Thay vì đặt cược vào việc LLM sẽ nhớ để xác minh, hãy thực thi nó một cách tự động trong các điều kiện cố định. (Tài liệu nền tảng Claude

Lớp 6: Vòng lặp Sửa chữa (Repair Loop)

Chỉ quay lại Fable nếu việc xác minh thất bại.

Tạo -> Xác minh Cơ học -> Thành công (Hoàn thành) / Thất bại -> Phân tích Nguyên nhân -> Sửa chữa Tối thiểu -> Xác minh lại

Điều quan trọng là không lặp vô hạn.

Ví dụ, quyết định "tối đa 2 lần cho cùng một lỗi" hoặc "dừng lại với bằng chứng sau tổng cộng 3 lần thất bại." Đối với các mô hình có thể làm việc trong thời gian dài, chi phí và phạm vi công việc sẽ tăng vọt nếu không có điều kiện dừng.

Đối với các quy trình sử dụng hàng chục đến hàng trăm tác nhân phụ, hãy chuyển sang Quy trình làm việc Động (Dynamic Workflow) thay vì để Claude quản lý chúng một cách tuần tự. Trong một Workflow, bạn có thể giữ các kết quả trung gian trong các biến script và chỉ trả về kết quả cuối cùng cho ngữ cảnh chính, làm cho nó phù hợp cho nghiên cứu quy mô lớn hoặc xử lý các tệp tin khổng lồ. (Claude

4. Skills Không Phải Là "Kho Lưu Trữ Prompt Dài"

Skills là một cơ chế để lưu các quy trình công việc được sử dụng lặp đi lặp lại dưới dạng SKILL.md.

Sự khác biệt so với CLAUDE.md là phần nội dung chỉ được đọc khi cần thiết.

  • Thông tin dự án và các quy tắc ngắn luôn phải tuân theo: CLAUDE.md.
  • Quy trình sản xuất bài viết, triển khai, nghiên cứu, đánh giá, v.v.: Skills.
  • Một lượng lớn các ví dụ hoặc thông số kỹ thuật: Các tệp tham chiếu cho Skills.

Sự tách biệt này liên quan trực tiếp đến việc tiết kiệm token. (Tài liệu nền tảng Claude

Tôi khuyên bạn nên sử dụng cấu trúc sau:

text
1.claude/
2├── CLAUDE.md
3├── skills/
4│ └── deep-article/
5│ ├── SKILL.md
6│ ├── research-rules.md
7│ ├── writing-rules.md
8│ ├── examples.md
9│ └── scripts/
10│ ├── count_chars.py
11│ └── check_repetition.py
12├── agents/
13│ ├── researcher.md
14│ └── critic.md
15└── settings.json

Trong SKILL.md, chỉ đặt tổng quan, điều kiện thực thi, quy trình và điều kiện hoàn thành.

Tách biệt các giải thích đồ sộ, thông số kỹ thuật API và câu chuyện thành công vào các tệp khác nhau và để Claude đọc chúng chỉ khi cần thiết. Tài liệu chính thức khuyến nghị giữ SKILL.md dưới 500 dòng và tách các tài liệu chi tiết vào các tệp hỗ trợ. (Tài liệu nền tảng Claude

5. Mẫu SKILL.md Thực Tế

Dưới đây là một ví dụ về Skill để tạo các bài viết nghiên cứu.


name: deep-article

description: Nghiên cứu thông tin chính thống và tạo các bài viết dài có kèm bằng chứng. Sử dụng khi được yêu cầu giải thích kỹ lưỡng về AI, công ty, hệ thống hoặc sản phẩm mới nhất.

argument-hint: "[Chủ đề] [Số ký tự mục tiêu]"

effort: high


Mục tiêu

Tạo một bài viết dài đã được kiểm chứng về $ARGUMENTS.

Quy tắc Cơ bản

  • Luôn tìm kiếm nếu thông tin mới nhất có liên quan
  • Ưu tiên thông tin chính thống
  • Phân biệt giữa sự kiện, thông báo của công ty, đánh giá của bên thứ ba và suy đoán
  • Đính kèm khoảng thời gian mục tiêu và định nghĩa cho các con số
  • Không lặp lại cùng một kết luận hoặc ví dụ
  • Giải thích các thuật ngữ kỹ thuật ngay khi đề cập lần đầu
  • Không kết thúc với ít hơn 90% số ký tự đã chỉ định
  • Cuối cùng, báo cáo số ký tự và các mục chưa được xác minh

Quy trình làm việc

  1. Chia chủ đề thành 3-7 điểm nghiên cứu
  2. Nghiên cứu các điểm độc lập song song
  3. Thu thập thông tin chính thống
  4. Điều tra phản chứng hoặc thông tin bất lợi
  5. Tạo một danh sách sự kiện
  6. Quyết định cấu trúc
  7. Tạo bản nháp đầu tiên
  8. Kiểm tra các bản sao, bước nhảy logic, trích dẫn, ngày tháng và số liệu
  9. Chỉnh sửa
  10. Kiểm tra số ký tự

Điều kiện Hoàn thành

  • Kết luận rõ ràng ngay từ đầu
  • Người đọc có thể quyết định phải làm gì
  • Các sự kiện quan trọng có nguồn gốc
  • Sự kiện và suy đoán không bị trộn lẫn
  • Đáp ứng số ký tự đã chỉ định
  • Không có đoạn văn trùng lặp

Tài liệu chỉ đọc khi cần thiết

Kiểm tra Cuối cùng

Thực hiện các lệnh sau:

  • python ${CLAUDE_SKILL_DIR}/scripts/count_chars.py <tệp-đầu-ra>
  • python ${CLAUDE_SKILL_DIR}/scripts/check_repetition.py <tệp-đầu-ra>

Phần mô tả của một Skill hoạt động như một bộ định tuyến, không chỉ đơn thuần là một lời giải thích.

Thay vì một câu mơ hồ như "Viết các bài báo chất lượng cao", việc viết "Sử dụng cho các yêu cầu dạng dài điều tra thông tin chính thống về AI, công ty và hệ thống mới nhất" sẽ giúp nó dễ dàng được gọi đến trong các tình huống cần thiết.

Vì Claude Code đưa danh sách các mô tả Skill vào ngữ cảnh, việc viết các mô tả quá dài sẽ làm tăng chi phí cố định. Hãy đặt các mục đích sử dụng quan trọng ở đầu và giữ chúng ngắn gọn. (Tài liệu nền tảng Claude

6. Sử Dụng Skills Nâng Cao

Skills không được tự động thực thi

Việc triển khai, gửi, xóa, xuất bản và thanh toán không được phép do Claude tự ý bắt đầu.

Đặt disable-model-invocation: true và chỉ chạy chúng khi người dùng nhập rõ ràng /deploy, v.v.

Skills không nên làm ô nhiễm cuộc trò chuyện

Đối với các Skill thực hiện nghiên cứu hoặc khám phá mã nguồn quy mô lớn, hãy đặt context: fork.

Điều này khiến chúng thực thi trong một ngữ cảnh tác nhân phụ riêng biệt. Nội dung tệp tin khổng lồ và lịch sử tìm kiếm sẽ không đi vào cuộc trò chuyện chính; chỉ có kết quả cuối cùng được trả về. (Tài liệu nền tảng Claude

Skills tự động chèn trạng thái hiện tại

Trong một Skill, bạn có thể chèn trước các kết quả lệnh.

Trạng thái hiện tại

!git status --short

!git diff --stat

Claude nhận được kết quả thực thi, không phải chuỗi lệnh.

Tuy nhiên, việc chèn toàn bộ git diff hoặc log khổng lồ mỗi lần là phản tác dụng. Chỉ đưa vào --stat hoặc các dòng lỗi trước, và để nó đọc chi tiết chỉ khi chúng trở nên cần thiết. (Tài liệu nền tảng Claude

Đặt mức độ nỗ lực (effort) cho Skills

Đặt các Skill đơn giản ở mức medium, đánh giá thiết kế và nghiên cứu chuyên sâu ở mức high, và các kiểm toán cực kỳ khó khăn ở mức xhigh.

Nếu bạn cung cấp cho mỗi Skill mức độ nỗ lực riêng của nó, người dùng không cần phải chuyển đổi mỗi lần.

7. Luôn Đánh Giá Skills Một Cách So Sánh

Chỉ tạo một Skill thôi thì không cho bạn biết liệu chất lượng có được cải thiện hay không.

Tài liệu chính thức hướng dẫn đánh giá hai điều riêng biệt:

  1. Skill có bắt đầu chính xác cho các yêu cầu cần thiết không?
  2. Kết quả đầu ra có thực sự tốt hơn nhờ việc bắt đầu Skill không?

Thực hiện cùng một yêu cầu trong các phiên làm việc mới, cả "có Skill" và "không có Skill."

Đối với một Skill viết bài, hãy so sánh số ký tự, nguồn bị thiếu, trùng lặp, lỗi thực tế và số lần sửa chữa. Đối với một Skill viết mã, hãy so sánh tỷ lệ kiểm thử thành công, số lượng tệp đã thay đổi, các thay đổi không cần thiết và số lần làm lại.

Việc kiểm tra trong phần tiếp theo của cuộc trò chuyện nơi bạn tạo Skill sẽ che giấu các lỗi bằng thông tin bổ sung từ cuộc trò chuyện. Luôn đánh giá trong một phiên làm việc mới. Claude Code cũng cung cấp một plugin tạo skill chính thức để hỗ trợ so sánh này. (Tài liệu nền tảng Claude

Kết Luận Cuối Cùng

Claude Fable 5.1 không phải là một mô hình chỉ đơn giản là tăng tốc dòng sản phẩm Claude.

Giá trị lớn nhất của nó là khả năng tiếp tục công việc khó khăn trong một thời gian dài, phục hồi sau những thất bại giữa chừng, tìm kiếm nguyên nhân gốc rễ và hoàn thành công việc trong khi tự xác minh kết quả của chính nó.

Mặt khác, đơn giá đầu vào và đầu ra gấp đôi so với Opus 5. Không thể tắt suy nghĩ nội bộ, không tương thích với các harness ghi đè lên các cuộc trò chuyện cũ và không có sẵn tính năng gọi công cụ bắt buộc.

Do đó, cách sử dụng mạnh mẽ nhất như sau:

**Thu hẹp thông tin bằng Sonnet hoặc script.

Tách biệt việc khám phá bằng các tác nhân phụ.

Giao cho Fable các phán đoán khó và tích hợp.

Xác minh một cách cơ học bằng hooks và kiểm thử.

Tăng mức độ nỗ lực chỉ cho những điểm khó đã thất bại.

Lưu các quy trình lặp đi lặp lại trong Skills.

Giữ lịch sử trò chuyện ở chế độ chỉ nối thêm (append-only) để bảo vệ bộ nhớ đệm.**

Nếu bạn sử dụng Fable 5.1 như một "cuộc trò chuyện cao cấp trả lời mọi thứ," thì chỉ có giá là cao.

Sự khác biệt thực sự so với các thế hệ trước chỉ xuất hiện khi bạn định vị Fable 5.1 như một người giám sát tập hợp các mô hình giá rẻ, Skills, tác nhân phụ, hooks và vòng lặp xác minh.

Viết lại trong YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Dành cho nhà sáng tạo

Biến Markdown của bạn thành bài viết 𝕏 gọn gàng

Khi bạn đăng bài viết dài của riêng mình, việc định dạng hình ảnh, bảng và khối mã cho 𝕏 rất mệt mỏi. YouMind biến cả bản nháp Markdown thành một bài viết 𝕏 gọn gàng, sẵn sàng để đăng.

Thử Markdown sang 𝕏

Thêm pattern để giải mã

Bài viết viral gần đây

Khám phá thêm bài viết viral