相同價格。大多數人只會換模型,卻錯過其他所有細節。

伴隨 Opus 4.8,Anthropic 推出了三項功能,它們改變你在 Claude Code 中的工作方式,遠比基準數字更重要:努力控制、動態工作流程,以及更便宜的快速模式。那些正確配置這些功能的人,能獲得更好結果並花費更少。以下是詳細分析。
最重要的數字
不是編碼的 69.2%。關鍵是 4.8 讓缺陷在自己的程式碼中遺漏的機率降低了約 4 倍。
舊模型喜歡自信滿滿地說「完成了,錯誤已修復」,但證據薄弱。Anthropic 偏向誠實:4.8 更常放慢速度,並在它不確定的地方標記出來,而不是生成看似合理卻會默默破壞邊界情況的程式碼。在長期會話中,這會不斷累積。一個在第 15 輪承認不確定性的模型,能讓你在第 40 輪省下幾小時的除錯時間。
哪些地方改變了:簡短版
編碼。
SWE-bench Verified:87.6% → 88.6%(接近天花版)。
SWE-bench Pro(更難、污染更少):64.3% → 69.2%,領先 GPT-5.5 超過 10 個百分點。
這是主要的編碼數字。
終端機。
Terminal-Bench 2.1:66.1% → 74.6%(+8.5),但 GPT-5.5 仍領先(78.2%)。七項基準中唯一 4.8 落敗的一項。
知識工作。
GDPval-AA:1890 Elo,對比 GPT-5.5 的 1769。整張表格中差距最大的一項。
電腦使用。
OSWorld-Verified:83.4%(部分進步來自更新後的測試框架,Anthropic 已明確指出)。
科學。
GPQA Diamond:93.6%,基本上持平(兩個模型都超過 93%,這是飽和,不是倒退)。

Anthropic 自己稱這個版本是「溫和但實質的改進」。基準數據是加分項。以下的操作層面改動才是真正的重點。
功能 1. 努力控制(最被低估的一項)
Opus 4.8 預設使用高努力。但現在你可以決定它為一個任務投入多少思考。把它想成推理的手排變速箱。
在 claude.ai 和 Cowork 中,滑桿位於模型選擇器旁邊,有五個等級:低、中、高(預設)、額外、最大,外加一個獨立的思考開關。在 Claude Code 中,等級相同但名稱略有不同,還有自動模式:
注意:「額外」在 claude.ai 中與 xhigh 在 Claude Code 中是同一個等級,只是不同介面上的不同標籤。

重點來了,避免混淆。每個努力等級沒有額外的單獨收費。每個等級的費率相同:每 1M 輸入代幣 5 美元,每 1M 輸出代幣 25 美元。差異不在於每個代幣的價格,而在於模型花費了多少代幣。低努力回答簡短,思考少;最大努力思考時間長,消耗好幾倍的代幣。所以「最大」更貴是因為代幣數量,而不是因為費率。
關於相同任務的相對花費粗略指南(數字僅供直覺參考):
一個金錢範例。假設一個高努力的回答花費約 0.05 美元。相同的請求在低努力下約 0.005 美元,而在最大努力下很容易達到 0.20 至 0.40 美元。如果你 60% 的提示都很小(例如「這個函數回傳什麼?」),把它們從高努力移到低努力,就能將每日花費降低好幾倍,同時在關鍵的地方品質不受影響。
為什麼這對帳單影響最大。大多數人會把所有事情留在高努力(或為了安全起見調到最大),從不碰滑桿。而那些根據任務調整努力程度的人,能以明顯更低的成本獲得相同結果。這是這個版本中最被低估的功能。
功能 2. 快速模式(便宜 3 倍)
快速模式以相同品質、2.5 倍速度執行 Opus,而且現在比以前便宜 3 倍。
在 Claude Code 中用 /fast 切換(啟用中的會顯示 ↯ 圖示)。API 存取目前需要排隊(在 claude.com/fast-mode 加入等待清單)。
快速模式適用於:大型多檔案重構、根據規格生成程式碼、文件撰寫、測試生成。任何速度勝過深度的場景。標準模式適用於:複雜除錯、架構決策、安全審查。任何思考品質勝過速度的場景。
功能 3. 動態工作流程(最重要的功能)
Claude Code 現在會為你的任務撰寫一個 JavaScript 協調腳本,並在背景執行,同時你的會話保持回應。計畫存在於程式碼中,而不是模型的上下文裡,因此只有最終答案會回到你的會話。
根據官方文件,你需要知道的是:
- 最多 16 個子 Agent 同時執行,每次執行的硬上限為 1,000 個。
- 可恢復:如果你的筆電沒電或關閉終端機,執行會從中斷處繼續。
- 需要 Claude Code v2.1.154+。研究預覽版。
- 在 Max、Team、Enterprise 方案上預設開啟。在 Pro 方案上,請在
/config中開啟(並先切換到 Opus 4.8)。 - 子 Agent 以 acceptEdits 模式執行,並繼承你的工具允許清單。
用 /effort ultracode 觸發(一個 Claude Code 設定:xhigh 加上自動工作流程協調),或者直接用文字描述一個大型任務:

適用於:跨 200 多個檔案的遷移、全程式碼庫安全審計、專案範圍的測試生成、大型重構、跨多個儲存庫的研究。不適用於:簡單的錯誤修復、單一檔案編輯、快速問題。大材小用。
關於成本。工作流程消耗的代幣明顯比一般會話多。官方控制花費的方法是先限定任務範圍:先在一個資料夾上執行審計,看看它生成了多少子 Agent,然後再據此調整大型執行。
要完全停用工作流程:
Claude Code 設定範例(入門模板)
環境變數(在 ~/.zshrc 或 ~/.bashrc 中):
然後是實用的部分:一個具有安全權限的 settings.json。它允許模型讀取和編輯程式碼、執行測試和提交,但嚴格封鎖危險操作:讀取 .env 和 SSH 金鑰、rm -rf、sudo,以及 git push。Agent 可以自由工作,但無法破壞任何東西或洩漏任何東西。

可直接貼上的 settings.json 檔案在我的 Telegram 頻道中(格式太長,這裡無法清楚閱讀):t.me/+JmDeelv5UCwwMTcy

每日指令速查表
安裝 Opus 4.8:三種方法
A. 瀏覽器或應用程式。在 claude.ai 上,從模型清單中選取 Claude Opus 4.8,然後設定努力滑桿。無需安裝。
B. API。模型 ID 為 claude-opus-4-8。價格為每 1M 代幣 5 美元 / 25 美元。上下文最多 1M(Microsoft Foundry 上為 200k),輸出最多 128k。不支援固定預算的擴展思考:請使用適應性思考(thinking: {type: "adaptive"})和 effort 參數。
C. Claude Code(終端機)。現在建議使用原生安裝程式(npm 為舊版):
然後執行 claude,透過瀏覽器登入,並用 /model 選取 Opus 4.8。
遷移檢查清單:從 4.7 到 4.8
- 將模型 ID 改為
claude-opus-4-8 - 用相同的提示在 4.7 和 4.8 上執行 10 到 20 個真實任務
- 比較:完成率、步驟數、代幣數、測試通過率
- 檢查針對 4.7 行為調整過的提示
- 依任務類型分配努力等級
- 在需要速度的地方測試快速模式
- 將 Claude Code 更新至 v2.1.154+(以使用工作流程)
- 一週後重新檢查 API 帳單
速查卡:所有資訊一覽
模型:claude-opus-4-8 · 發布日期:2026-05-28
價格:每 1M 代幣 5 美元 / 25 美元 · 快速模式 10 美元 / 50 美元
上下文:最多 1M · 輸出最多 128k
重點:SWE-bench Pro 從 64.3% 提升至 69.2%(領先 GPT-5.5 10 個百分點) · SWE-bench Verified 88.6% · 遺漏錯誤減少 4 倍 · GDPval-AA 1890 Elo
新增功能:努力控制 · 快速模式便宜 3 倍 · 動態工作流程(16 個同時執行 / 每次最多 1,000 個)
感謝閱讀。如果你只能從中帶走一件事,那就是「根據任務分配努力程度」。
我關於 Claude 和 vibe coding 的其他筆記都在這裡:t.me/+JmDeelv5UCwwMTcy。
我們那裡見。
@shmidtqq。





