2026 年該用哪個 Claude 模型?Fable 5、Opus 5、Sonnet 5 與更多選項
實用指南:在 Claude Code 中如何選擇 Claude Fable 5、Opus 5、上一代 Opus 4.8、Sonnet 5 與 Haiku 4.5——並涵蓋 fast mode、層級混用與 effort 等級。
多年來,挑選 Claude 模型是一次性的決定:設定一個預設模型,整個 session 的所有任務都用它。到了 2026 年年中,這個心智模型已經過時。Claude Code 現在給你的是一整套模型層級與世代組合——Fable 5、Opus 5、上一代 Opus 4.8、Sonnet 5 與 Haiku 4.5——外加三個可以按任務覆寫模型的地方、支援之 Opus 模型的 /fast 模式(fast mode,快速模式),以及僅適用於支援模型的 /effort(推理強度)旋鈕。
這份指南涵蓋每個層級實際的用途、什麼時候該用哪一個,以及如何混用它們——讓昂貴的 token 花在需要判斷力的地方,讓便宜的 token 去做粗活。
2026 年模型陣容一覽
截至 2026 年年中,目前的 Claude 模型如下:
| 模型 | Model ID | 定位 |
|---|---|---|
| Claude Fable 5 | claude-fable-5 | Mythos 級層級,位於 Opus 之上——最強的公開可用模型 |
| Claude Opus 5 | claude-opus-5 | 當代 Opus 世代 |
| Claude Opus 4.8 | claude-opus-4-8 | 上一代 Opus 世代;可用時支援 fast mode |
| Claude Sonnet 5 | claude-sonnet-5 | 日常寫程式的平衡預設選擇 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | 快速/便宜層級,適合扇出(fan-out)與機械性工作 |
這是 Claude Code 2.1.226 的 model configuration。/model 顯示的模型與 alias 可能因 provider、方案、帳號 entitlement 及 rollout 而異,因此請以目前環境的選擇器作為最終可用性檢查。
有一個值得內化的結構性變化:Fable 5 是 Claude 5 家族的第一個模型,屬於新的 Mythos 級(Mythos-class)層級。Anthropic 的官方 system card將 Fable 5 與 Mythos 5 描述為同一個新大型語言模型的兩種 configuration:Fable 供一般使用並加入額外 safeguards;Mythos 為少數 trusted partners 移除相關 safeguards。這能支持 configuration 與 access 的區別,不能推論 Mythos 是另一個「更大」的模型或一般 entitlement。想了解層級拆分的完整故事,請閱讀我們的 Fable 5 與 Mythos 5 解析。
Anthropic 官方對打造 AI 應用的建議,是預設使用最新、能力最強的 Claude 模型。不過對日常使用 Claude Code 而言,「處處都用最強模型」很少是最有效率的答案。以下是各層級實際的分工。
各層級剖析
Fable 5——判斷力層級
Fable 5 是最強的公開可用層級。把它用在最需要判斷力的工作上:
- 架構決策——做錯的代價高昂,難以回頭
- 對抗式驗證——駁斥看似合理但其實錯誤的發現
- 複雜的多步驟自主任務——需要模型自我修正的長任務
- 最終彙整——把多個 agent 的輸出合併成一個連貫的答案
如果一項任務的成本主要來自做錯而不是 token 用量,那就該用這個層級。
Opus 5——當代 Opus 世代
Opus 5 是 Claude Code model configuration 中當代的 Opus 級選項。需要困難的 Opus 級實作或互動式編程時可從它開始評估,但仍以 provider 與帳號實際提供的模型為準。
Opus 4.8——上一代 Opus 世代
Opus 4.8 仍是上一代 Opus 選項,且在可用時支援 fast mode。Opus 4.x 系列也是 Anthropic 長上下文(long-context)成果的落腳處——我們在 Opus 4.6 推出時報導過它預設的 1M token 上下文——不過我們不在這裡對 4.8 宣稱具體的上下文大小。只有當你明確需要這條仍受支援的上一代路徑,且帳號有提供時才選它;不要再把它當成最新 Opus 世代。
Sonnet 5——日常預設
Sonnet 5 是平衡的選擇:以中階成本與延遲提供強大能力。它是 Sonnet 4.x 系列的後繼者——Sonnet 4.x 長期以來都是 Claude Code 的預設——對大多數功能開發、重構和除錯來說,它仍是合理的 session 模型;日常寫程式,用它就夠了。
Haiku 4.5——扇出引擎
Haiku 4.5 是快速/便宜層級,它的甜蜜點在於量:探索型子代理(subagent)、機械性的扇出階段(讀檔、搜尋、格式化),以及高吞吐量的 workflow 階段。你幾乎不會想拿 Haiku 當主 session 模型——你要的是讓子代理跑在 Haiku 上,主 session 則維持在更重的模型。
Fast Mode:更快的 Opus,不是縮小版模型
這是整個陣容中最常被誤解的功能,所以我們講清楚:
/fast在 Claude Code 中切換 fast mode。- Fast mode 使用的是輸出更快的 Claude Opus。
- 它不會把你降級到較小的模型。
- 文件記載它適用於 Opus 4.8 與 4.7,但仍受帳號可見模型與 entitlement 限制。
心智模型是這樣的:fast mode 在「你面對的是哪個模型」這件事上沒有任何取捨——就是同一個 Opus,只是輸出更快。在延遲很重要的互動式 session 中使用它:結對開發(pair programming)的往返、快速「改了就看」的迭代循環,任何你等模型的時間多過在回合之間思考的場合。
決策框架
四種常見的工作模式,以及各層級的定位:
1. 互動式寫程式。 你全程在迴圈中,審查每個變更。日常工作用 Sonnet 5,困難的 Opus 級工作用 Opus 5。如果環境仍提供 Opus 4.8 與 fast mode,這條上一代路徑在延遲敏感時仍有用途。Session 中途用 /model 切換——你的選擇可以存成新 session 的預設。
2. 探索。 摸索不熟悉的程式碼庫、找檔案、追蹤用法。這是子代理的地盤,也是 Haiku 4.5 的地盤:派出便宜的探索者,只把結論(而不是整批檔案內容)留在主上下文裡。委派模式請見 Session 4:子代理與上下文隔離。
3. 驗證。 檢查發現是否屬實、評判互相競爭的輸出、駁斥自己的結論。這是省錢會反噬的地方——一個什麼都蓋章放行的驗證者,比沒有驗證者更糟。用最高層級搭配高 effort。
4. 自主執行。 長時間執行、多步驟、沒有人盯著每一步的任務。模型必須能發現自己的錯誤,所以複雜的多步驟自主任務是 Fable 5 的主場。
選型表
| 任務類型 | 模型 | 原因 |
|---|---|---|
| 日常功能開發、除錯 | Sonnet 5 | 中階成本/延遲下的強大能力 |
| 困難的互動式問題 | Opus 5 | 當代 Opus 世代;以帳號實際可用性為準 |
| 上一代支援路徑上的延遲敏感工作 | Opus 4.8 + /fast | 輸出更快的上一代 Opus——同一個模型 |
| 程式碼庫探索(子代理) | Haiku 4.5 | 快速/便宜;為搜尋加讀取的扇出而生 |
| 機械性階段:格式化、檔案掃描 | Haiku 4.5 | 量大、不需判斷力——別多花錢 |
| 架構決策、最終彙整 | Fable 5 | 最強公開層級;答錯的代價高過 token |
| 對抗式驗證、評審團 | Fable 5(高 effort) | 駁斥品質就是重點所在 |
| 複雜多步驟自主任務 | Fable 5 | 把公開可用最高層級留給代價高昂的判斷 |
| 不確定時的子代理 | (不覆寫) | 繼承 session 模型——安全的預設 |
混用層級:三個覆寫點
2026 年模型陣容真正的技巧在這裡:你挑的不是一個模型,而是按角色挑模型。Claude Code 恰好在三個地方提供 per-agent 的模型覆寫。
1. Agent 定義(.claude/agents/*.md)
registry 裡的每一種 agent 類型都能在 frontmatter 中固定自己的模型、推理 effort 和工具。經典招式——一個常駐的便宜探索者:
---
name: explorer
description: Read-only codebase exploration. Finds files, maps structure, reports back.
tools: Read, Grep, Glob
model: haiku
---
Explore broadly, then return a short summary of conclusions.
Never modify files.
現在每次派出 explorer 都會跑在 Haiku 4.5 上,無論你的 session 用的是什麼模型。
2. Agent 工具的 model 參數
臨時派出一次性子代理時,Agent 工具接受 model 參數:sonnet | opus | haiku | fable。這是同一個概念的即席版本——不需要 registry 條目。
3. Workflow 的 agent() 選項
在 Workflow(Claude Code 的腳本化多代理編排工具)的編排腳本裡,每個 agent() 呼叫都接受 model 與 effort 選項。層級混用在這裡變得系統化——便宜的扇出餵給昂貴的判斷:
// Cheap mechanical stage: scan every module on Haiku without an effort override
const summaries = await parallel(modules.map(m => () =>
agent(`Summarize the public API of ${m}: exports and signatures.`, {
label: `scan ${m}`,
model: 'haiku',
})
));
// Expensive judgment stage: one Fable 5 synthesis at xhigh effort
const review = await agent(
`Here are API summaries for every module:\n` +
summaries.filter(Boolean).join('\n') +
`\nIdentify inconsistencies and propose a unified naming scheme.`,
{ label: 'synthesize', model: 'fable', effort: 'xhigh' }
);
完整的編排模型請見 Session 27:Workflow 工具。
有一條規則貫穿這三個覆寫點:預設不覆寫。 沒有設定 model 的 agent 會繼承 session 模型;除非你有把握某個層級更合適,否則這就是正確的選擇。到處固定模型是過早最佳化——把明顯划算的釘下來(探索用 Haiku、判斷用最高層級),其餘的別動。
Effort:第二個旋鈕
模型選擇只是控制面的一半。對列為支援 effort 的模型,/effort 有五個標準值:low / medium / high / xhigh / max,workflow 腳本也能為子代理設定其支援的值。Claude Code 2.1.226 中,Fable 5、Opus 5、Sonnet 5 與 Opus 4.8 都支援這五個等級;Haiku 4.5 未列為支援 effort 的模型,因此使用時不要附加 --effort 或 effort 選項。Ultracode 不是第六個 effort 層級:它是 session-only 的 xhigh 加 workflow 編排模式,並會在 session 結束時重設。
這值得一整篇專文——請見 Ultracode 與 Effort 等級:把 Claude Code 開到 11。
成本策略,一句話講完
便宜的扇出,昂貴的判斷。
這份指南裡的每個模式都是這句話的變奏。Haiku 4.5 的 agent 不覆寫 effort 就能讀一百個檔案;Fable 5 決定這些發現代表什麼。Sonnet 5 撐起日常中段,Opus 5 是困難工作的當代 Opus 選項,而上一代 Opus 4.8 在可用時仍能走 fast-mode 路徑。多數配置的浪費不在於用了昂貴的模型——而在於把它們用在根本不需要判斷力的工作上。(更完整的 token 預算全貌,Session 21:成本最佳化依然適用。)
重點整理
- 依角色與世代路由:Fable 5 管最難判斷、Opus 5 是當代 Opus、上一代 Opus 4.8 只在路徑適合時使用、Sonnet 5 管日常寫程式、Haiku 4.5 管扇出。
- Fast mode 是更快的 Opus,不是縮小的 Opus——文件記載
/fast適用於 Opus 4.8/4.7,仍以實際可用性為準。 - 三個覆寫點:agent frontmatter、Agent 工具的
model參數、workflow 的agent()選項。 - 預設繼承——只有在確定層級合適時才固定模型。
- Effort 取決於模型——支援的模型有五個標準等級;Haiku 4.5 沒有,ultracode 則是獨立的 session 模式。
模型選擇從「每個 session 選一次」變成了「每個任務選一次」。一旦內化這一點,/model、/effort 和 /fast 就不再只是設定,而是你工作方式的一部分。
想要動手實作的版本?請跟著我們教學系列的 Session 25:Claude 5 家族與模型策略一步步練習。