跳到主要內容

Claude Opus 5.5 努力檔位實戰:Low 到 Max 怎麼選才不浪費額度?

最後更新: ·
Claude Opus 5.5 努力檔位 Low 到 Max 選擇指南

Claude Opus 5.5 努力檔位不是「越高越聰明」的五級會員卡。真正省額度的做法,是先用 Medium 完成一次,再依照可驗證的失敗原因升到 High;XHigh 與 Max 只留給已證明能換到更高成功率的任務。

先記住這條公式:找最低可通過檔位

最佳 effort=能讓任務一次通過檢查的最低檔位;完成成本=總用量 ÷ 通過次數。

這條公式比「Max 最強」實用。Medium 若一次完成,升到 Max 只會多花時間與 token;Medium 若漏改第二個呼叫端,High 能少一次重跑,反而可能更便宜。重點是先寫好「通過」的定義,例如測試全過、引用可開啟、JSON schema 正確,而不是看答案有多長。

截至 2026 年 9 月 23 日,Anthropic 發布的 Opus 5.5在 API 的模型 ID 是 claude-opus-5-5,輸入/輸出定價為每百萬 token 4/20 美元,支援 Low、Medium、High、XHigh、Max 五檔,預設是 Medium。它採 adaptive thinking,而且五個檔位都無法關閉 thinking;effort 是行為訊號,不是硬性的 token 上限。

Claude Opus 5.5 Low 到 Max 努力檔位升檔梯
先從最低可完成的檔位開始;只有驗證沒過才升一格。

Low、Medium、High、XHigh、Max 怎麼選?

Low:錯了也容易發現的機械任務

適合改格式、批次重新命名、把既有規則套到多個檔案、從固定欄位抽資料。前提是你能快速人工覆核,或已有 lint、schema、測試可以抓錯。若任務需要做判斷,不要只因為想省額度就硬壓 Low。

Medium:日常預設與第一輪基準

寫信、整理資料、一般研究、清楚範圍內的 coding,都先從 Medium 開始。它也是最適合做 A/B 基準的檔位:你若不知道自己的任務有多難,先跑 Medium 才有比較點。想進一步理解 Claude 各產品的工作邊界,可搭配Claude、Claude Code 與 Cowork 比較

High:Medium 只做完第一層時

High 適合多步推理、跨檔案依賴、棘手除錯與需要較完整工具呼叫的工作。典型升檔訊號是:它修了 API handler,卻沒追到前端仍使用舊欄位;或研究有結論,卻漏了反例。先確認模型能跑測試或檢查自己的輸出,再升檔,通常比盲目增加思考更有效。

XHigh:長時間 agent/coding 任務

官方把 XHigh 定位為超過 30 分鐘、token 可能進入百萬級的長時程 agent 與 coding 任務。它不是「High 再加一點」,而是留給會探索多條路徑、持續使用工具的工作。若任務十分鐘就能結束,XHigh 通常沒有合理的攤提空間。

Max:只有評測證明值得才用

Max 放開 token 支出的約束,適合極難、正確性關鍵而且有明確驗收條件的任務。把它當一次性的「最後升檔」:跑一次仍不過,就回頭改善提示、補測試、縮小範圍或換模型,不要用同一個失敗方法連續燒額度。

官方數據已告訴你:Max 不保證比較好

Opus 5.5 五種努力檔位的官方 benchmark 分數與成本比較
資料來源:Anthropic Opus 5.5 發布頁;供應商 benchmark 不等於你的實際工作。

在 Terminal-Bench 4.0,XHigh 的分數是 66.4%、單次成本 7.35 美元;Max 成本升到 11.24 美元,分數反而降到 64.8%。在 FrontierCode v1.1(Main),Medium 是 54.6%/0.80 美元,Max 是 54.4%/6.19 美元:分數幾乎一樣,單次成本約 7.7 倍。

這不代表 Max 無用,只代表「更努力」的邊際收益取決於任務。官方也提醒 benchmark 的小幅差距不一定能預測真實工作。社群流傳的「Max 固定燒六倍」同樣不能當通則;Claude 用量說明列出的影響因素還包括對話長度、功能、模型與任務複雜度。

Responsive Mode、努力檔位、模型切換是三件事

Responsive Mode 努力檔位與模型切換的差異
一個改互動節奏、一個改思考與工具量、一個改整體能力與價格。
  • Responsive Mode:首日應用程式發布說明截圖把它描述為每次先用一句話回應,再開始思考或使用工具。這改的是等待時的互動節奏,不代表模型少想,也不是 effort。公開 Help Center 截至本文日期尚未提供獨立的控制指南,因此不要把截圖當成所有帳號都有相同開關的保證。
  • 努力檔位:控制同一模型每次回應傾向投入多少 thinking、文字與工具呼叫。Claude 網頁版可點輸入框旁的模型名稱 → Effort → 選檔;完整步驟見官方設定說明
  • 模型切換:從 Opus 換 Fable 會改變每個 token 的價格、速度與能力。在 Claude Code 切 effort 或模型都可能讓下一輪重新寫入快取,所以應在自然段落切換,而不是每一題都來回換。

Claude Code 可輸入 /effort status 查目前檔位,再用 /effort high 等命令切換;設定從下一個請求生效。結束後輸入 /usage/cost 看 input、output、cache 與估算成本。訂閱用戶看到的美元只是按 API 牌價估算工作量,不是額外帳單。若你常碰到額度不足,也可先看Claude 省 token 的完整方法

Opus 5.5 與 Fable 5.1:不要只比誰比較強

Claude Opus 5.5 與 Fable 5.1 適用工作與 API 價格比較
模型選擇決定整段工作每個 token 的價格;先看工作方式,再看能力上限。

Opus 5.5 的 API 輸入/輸出是 4/20 美元,適合你會持續查看與修正的日常工作;Fable 5.1 是 10/50 美元,官方定位更偏向長時間、少人介入、雄心較大的非同步任務。換句話說,快速問答、一般 coding 與研究先用 Opus 5.5;只有 High 連續卡在同一個跨層問題,或任務真的要長時間自主跑,才考慮 Fable。更完整的模型背景可讀Fable 5.1 與 Mythos 5.1 解析,舊版差異則可參考Claude Opus 5 完整解析

可複製的 10 題努力檔位工作簿

不要用十個玩具問題測模型。從自己的真實待辦抽十題,難度要有梯度,而且每題都能判定通過/不通過:

  1. 把會議紀錄改成固定格式。
  2. 依 schema 抽成 JSON,欄位不准多也不准少。
  3. 套用一條已知規則到多個檔案。
  4. 摘要三份資料並標出彼此衝突。
  5. 修一個單檔 bug,附測試。
  6. 做跨前後端欄位重構,既有測試全過。
  7. 解釋一個陌生技術,引用可開啟的一手來源。
  8. 規劃需要多個工具的研究流程並交付結果。
  9. 處理一個預估超過 30 分鐘的 repo 任務。
  10. 設計正式環境遷移方案,包含驗收與回滾。

每一題都用同一份 prompt、附件、工具權限與乾淨的新對話,依序跑 Low 到 Max;不要把前一檔答案留在上下文。至少記錄 pass、分鐘數、input、cache read、output、重試次數。Claude Code 可直接複製這個 CSV 表頭:

task,effort,pass,minutes,input,cache_read,output,retries,notes

最後不要看「平均回答比較漂亮」,而要算每檔的通過率與完成成本。若用訂閱制,就以 /usage 的 token 與用量條作相對比較;若用 API,才用實際美元。這套方法也適合回頭比較Opus 4.8,避免只憑發布會 benchmark 換模型。

預設值、升檔條件與停損線

  • 預設值:日常 Medium;純機械且可驗證才降 Low。
  • 第一次失敗:先補驗收條件、測試或缺少的上下文。
  • 升到 High:Medium 明顯只處理第一層,或複雜推理漏步驟。
  • 升到 XHigh:任務是長時程 agent/coding,且 High 的 A/B 紀錄顯示值得。
  • 只試一次 Max:必須有明確驗收;同類失敗再次出現就停。
  • 換模型:High 連續兩次卡在相同結構性問題,先 /compact 或開新對話,再考慮 Fable。

我的判斷:對多數個人用戶,Medium → High 是最有價值的主幹;Low 是大量可驗證工作的省額度工具;XHigh 與 Max 是例外處理,不應成為預設。真正浪費額度的往往不是檔位太低,而是沒有驗收條件,讓模型在模糊任務上反覆重試。若你想建立更完整的執行框架,可延伸到AI Agent Harness 入門Agent Harness 實作

Claude Opus 5.5 努力檔位常見問題

Opus 5.5 平常應該用哪個檔位?

先用 Medium。只有機械、可快速驗證的任務才降 Low;Medium 明顯漏做跨層步驟時才升 High。

Max 真的固定消耗六倍額度嗎?

不是固定倍數。實際用量會受任務、對話長度、工具呼叫、輸出與快取影響;官方不同 benchmark 的成本倍數也不相同。

High 和 XHigh 的分界是什麼?

High 適合一般複雜推理與 coding;XHigh 是超過 30 分鐘、工具與分支很多的長時程 agent 工作。

Opus 5.5 可以關閉 thinking 嗎?

不行。Opus 5.5 在 Claude 與 API 的所有 effort 檔位都會使用 thinking;你能調整的是投入程度。

Responsive Mode 會比較省額度嗎?

不能這樣推論。它的公開描述是先回一句再思考或用工具,屬於互動節奏;沒有可靠證據顯示它等同較低 effort。

可以在同一個對話中途改 effort 嗎?

可以,下一個請求生效。但 Claude Code 變更 effort 會清掉對話快取,因此最好在自然段落切換。

API 要怎麼設定努力檔位?

在 Messages API 請求的 output_config.effort 設成 low、medium、high、xhigh 或 max;正式上線前應以自己的 eval 比較。

最難的任務一定要換 Fable 5.1 嗎?

不一定。先讓 Opus 5.5 Medium/High 跑過有驗收的任務;只有長時間非同步工作或同一結構問題持續卡住,才測 Fable。

接著閱讀

左右滑動查看更多推薦

結論:把 Max 當例外,不要當信仰

Claude Opus 5.5 努力檔位最穩定的用法很簡單:Medium 起跑、驗證先行、High 解跨層問題,XHigh/Max 必須用工作簿證明值得。當你開始記錄通過率、重試與用量,問題就不再是「哪一檔最強」,而是「哪一檔用最低完成成本交付正確結果」。

ALPHALAB 社群

有問題?來 Telegram 聊

和 Terry、編輯、其他網友一起討論這篇文章。提問、分享觀點,回覆更即時。

加入 Telegram 討論

📩 訂閱 AlphaLab 電子報

每週最多三封:一封 Weekly 週報與最多兩封關鍵 Alpha Signal。

我們不會 spam,隨時可退訂。