跳至主要內容

2026 年該用哪個 Claude 模型?Fable 5、Opus 5、Sonnet 5 與更多選項

實用指南:在 Claude Code 中如何選擇 Claude Fable 5、Opus 5、上一代 Opus 4.8、Sonnet 5 與 Haiku 4.5——並涵蓋 fast mode、層級混用與 effort 等級。

多年來,挑選 Claude 模型是一次性的決定:設定一個預設模型,整個 session 的所有任務都用它。到了 2026 年年中,這個心智模型已經過時。Claude Code 現在給你的是一整套模型層級與世代組合——Fable 5、Opus 5、上一代 Opus 4.8、Sonnet 5 與 Haiku 4.5——外加三個可以按任務覆寫模型的地方、支援之 Opus 模型的 /fast 模式(fast mode,快速模式),以及僅適用於支援模型的 /effort(推理強度)旋鈕。

這份指南涵蓋每個層級實際的用途、什麼時候該用哪一個,以及如何混用它們——讓昂貴的 token 花在需要判斷力的地方,讓便宜的 token 去做粗活。


2026 年模型陣容一覽

截至 2026 年年中,目前的 Claude 模型如下:

模型Model ID定位
Claude Fable 5claude-fable-5Mythos 級層級,位於 Opus 之上——最強的公開可用模型
Claude Opus 5claude-opus-5當代 Opus 世代
Claude Opus 4.8claude-opus-4-8上一代 Opus 世代;可用時支援 fast mode
Claude Sonnet 5claude-sonnet-5日常寫程式的平衡預設選擇
Claude Haiku 4.5claude-haiku-4-5-20251001快速/便宜層級,適合扇出(fan-out)與機械性工作

這是 Claude Code 2.1.226 的 model configuration。/model 顯示的模型與 alias 可能因 provider、方案、帳號 entitlement 及 rollout 而異,因此請以目前環境的選擇器作為最終可用性檢查。

有一個值得內化的結構性變化:Fable 5 是 Claude 5 家族的第一個模型,屬於新的 Mythos 級(Mythos-class)層級。Anthropic 的官方 system card將 Fable 5 與 Mythos 5 描述為同一個新大型語言模型的兩種 configuration:Fable 供一般使用並加入額外 safeguards;Mythos 為少數 trusted partners 移除相關 safeguards。這能支持 configuration 與 access 的區別,不能推論 Mythos 是另一個「更大」的模型或一般 entitlement。想了解層級拆分的完整故事,請閱讀我們的 Fable 5 與 Mythos 5 解析

Anthropic 官方對打造 AI 應用的建議,是預設使用最新、能力最強的 Claude 模型。不過對日常使用 Claude Code 而言,「處處都用最強模型」很少是最有效率的答案。以下是各層級實際的分工。


各層級剖析

Fable 5——判斷力層級

Fable 5 是最強的公開可用層級。把它用在最需要判斷力的工作上:

  • 架構決策——做錯的代價高昂,難以回頭
  • 對抗式驗證——駁斥看似合理但其實錯誤的發現
  • 複雜的多步驟自主任務——需要模型自我修正的長任務
  • 最終彙整——把多個 agent 的輸出合併成一個連貫的答案

如果一項任務的成本主要來自做錯而不是 token 用量,那就該用這個層級。

Opus 5——當代 Opus 世代

Opus 5 是 Claude Code model configuration 中當代的 Opus 級選項。需要困難的 Opus 級實作或互動式編程時可從它開始評估,但仍以 provider 與帳號實際提供的模型為準。

Opus 4.8——上一代 Opus 世代

Opus 4.8 仍是上一代 Opus 選項,且在可用時支援 fast mode。Opus 4.x 系列也是 Anthropic 長上下文(long-context)成果的落腳處——我們在 Opus 4.6 推出時報導過它預設的 1M token 上下文——不過我們不在這裡對 4.8 宣稱具體的上下文大小。只有當你明確需要這條仍受支援的上一代路徑,且帳號有提供時才選它;不要再把它當成最新 Opus 世代。

Sonnet 5——日常預設

Sonnet 5 是平衡的選擇:以中階成本與延遲提供強大能力。它是 Sonnet 4.x 系列的後繼者——Sonnet 4.x 長期以來都是 Claude Code 的預設——對大多數功能開發、重構和除錯來說,它仍是合理的 session 模型;日常寫程式,用它就夠了。

Haiku 4.5——扇出引擎

Haiku 4.5 是快速/便宜層級,它的甜蜜點在於:探索型子代理(subagent)、機械性的扇出階段(讀檔、搜尋、格式化),以及高吞吐量的 workflow 階段。你幾乎不會想拿 Haiku 當主 session 模型——你要的是讓子代理跑在 Haiku 上,主 session 則維持在更重的模型。


Fast Mode:更快的 Opus,不是縮小版模型

這是整個陣容中最常被誤解的功能,所以我們講清楚:

  • /fast 在 Claude Code 中切換 fast mode。
  • Fast mode 使用的是輸出更快的 Claude Opus
  • 不會把你降級到較小的模型。
  • 文件記載它適用於 Opus 4.8 與 4.7,但仍受帳號可見模型與 entitlement 限制。

心智模型是這樣的:fast mode 在「你面對的是哪個模型」這件事上沒有任何取捨——就是同一個 Opus,只是輸出更快。在延遲很重要的互動式 session 中使用它:結對開發(pair programming)的往返、快速「改了就看」的迭代循環,任何你等模型的時間多過在回合之間思考的場合。


決策框架

四種常見的工作模式,以及各層級的定位:

1. 互動式寫程式。 你全程在迴圈中,審查每個變更。日常工作用 Sonnet 5,困難的 Opus 級工作用 Opus 5。如果環境仍提供 Opus 4.8 與 fast mode,這條上一代路徑在延遲敏感時仍有用途。Session 中途用 /model 切換——你的選擇可以存成新 session 的預設。

2. 探索。 摸索不熟悉的程式碼庫、找檔案、追蹤用法。這是子代理的地盤,也是 Haiku 4.5 的地盤:派出便宜的探索者,只把結論(而不是整批檔案內容)留在主上下文裡。委派模式請見 Session 4:子代理與上下文隔離

3. 驗證。 檢查發現是否屬實、評判互相競爭的輸出、駁斥自己的結論。這是省錢會反噬的地方——一個什麼都蓋章放行的驗證者,比沒有驗證者更糟。用最高層級搭配高 effort。

4. 自主執行。 長時間執行、多步驟、沒有人盯著每一步的任務。模型必須能發現自己的錯誤,所以複雜的多步驟自主任務是 Fable 5 的主場。

選型表

任務類型模型原因
日常功能開發、除錯Sonnet 5中階成本/延遲下的強大能力
困難的互動式問題Opus 5當代 Opus 世代;以帳號實際可用性為準
上一代支援路徑上的延遲敏感工作Opus 4.8 + /fast輸出更快的上一代 Opus——同一個模型
程式碼庫探索(子代理)Haiku 4.5快速/便宜;為搜尋加讀取的扇出而生
機械性階段:格式化、檔案掃描Haiku 4.5量大、不需判斷力——別多花錢
架構決策、最終彙整Fable 5最強公開層級;答錯的代價高過 token
對抗式驗證、評審團Fable 5(高 effort)駁斥品質就是重點所在
複雜多步驟自主任務Fable 5把公開可用最高層級留給代價高昂的判斷
不確定時的子代理(不覆寫)繼承 session 模型——安全的預設

混用層級:三個覆寫點

2026 年模型陣容真正的技巧在這裡:你挑的不是一個模型,而是按角色挑模型。Claude Code 恰好在三個地方提供 per-agent 的模型覆寫。

1. Agent 定義(.claude/agents/*.md

registry 裡的每一種 agent 類型都能在 frontmatter 中固定自己的模型、推理 effort 和工具。經典招式——一個常駐的便宜探索者:

---
name: explorer
description: Read-only codebase exploration. Finds files, maps structure, reports back.
tools: Read, Grep, Glob
model: haiku
---

Explore broadly, then return a short summary of conclusions.
Never modify files.

現在每次派出 explorer 都會跑在 Haiku 4.5 上,無論你的 session 用的是什麼模型。

2. Agent 工具的 model 參數

臨時派出一次性子代理時,Agent 工具接受 model 參數:sonnet | opus | haiku | fable。這是同一個概念的即席版本——不需要 registry 條目。

3. Workflow 的 agent() 選項

在 Workflow(Claude Code 的腳本化多代理編排工具)的編排腳本裡,每個 agent() 呼叫都接受 modeleffort 選項。層級混用在這裡變得系統化——便宜的扇出餵給昂貴的判斷:

// Cheap mechanical stage: scan every module on Haiku without an effort override
const summaries = await parallel(modules.map(m => () =>
  agent(`Summarize the public API of ${m}: exports and signatures.`, {
    label: `scan ${m}`,
    model: 'haiku',
  })
));

// Expensive judgment stage: one Fable 5 synthesis at xhigh effort
const review = await agent(
  `Here are API summaries for every module:\n` +
  summaries.filter(Boolean).join('\n') +
  `\nIdentify inconsistencies and propose a unified naming scheme.`,
  { label: 'synthesize', model: 'fable', effort: 'xhigh' }
);

完整的編排模型請見 Session 27:Workflow 工具

有一條規則貫穿這三個覆寫點:預設不覆寫。 沒有設定 model 的 agent 會繼承 session 模型;除非你有把握某個層級更合適,否則這就是正確的選擇。到處固定模型是過早最佳化——把明顯划算的釘下來(探索用 Haiku、判斷用最高層級),其餘的別動。


Effort:第二個旋鈕

模型選擇只是控制面的一半。對列為支援 effort 的模型,/effort 有五個標準值:low / medium / high / xhigh / max,workflow 腳本也能為子代理設定其支援的值。Claude Code 2.1.226 中,Fable 5、Opus 5、Sonnet 5 與 Opus 4.8 都支援這五個等級;Haiku 4.5 未列為支援 effort 的模型,因此使用時不要附加 --efforteffort 選項。Ultracode 不是第六個 effort 層級:它是 session-only 的 xhigh 加 workflow 編排模式,並會在 session 結束時重設。

這值得一整篇專文——請見 Ultracode 與 Effort 等級:把 Claude Code 開到 11


成本策略,一句話講完

便宜的扇出,昂貴的判斷。

這份指南裡的每個模式都是這句話的變奏。Haiku 4.5 的 agent 不覆寫 effort 就能讀一百個檔案;Fable 5 決定這些發現代表什麼。Sonnet 5 撐起日常中段,Opus 5 是困難工作的當代 Opus 選項,而上一代 Opus 4.8 在可用時仍能走 fast-mode 路徑。多數配置的浪費不在於用了昂貴的模型——而在於把它們用在根本不需要判斷力的工作上。(更完整的 token 預算全貌,Session 21:成本最佳化依然適用。)


重點整理

  1. 依角色與世代路由:Fable 5 管最難判斷、Opus 5 是當代 Opus、上一代 Opus 4.8 只在路徑適合時使用、Sonnet 5 管日常寫程式、Haiku 4.5 管扇出。
  2. Fast mode 是更快的 Opus,不是縮小的 Opus——文件記載 /fast 適用於 Opus 4.8/4.7,仍以實際可用性為準。
  3. 三個覆寫點:agent frontmatter、Agent 工具的 model 參數、workflow 的 agent() 選項。
  4. 預設繼承——只有在確定層級合適時才固定模型。
  5. Effort 取決於模型——支援的模型有五個標準等級;Haiku 4.5 沒有,ultracode 則是獨立的 session 模式。

模型選擇從「每個 session 選一次」變成了「每個任務選一次」。一旦內化這一點,/model/effort/fast 就不再只是設定,而是你工作方式的一部分。


想要動手實作的版本?請跟著我們教學系列的 Session 25:Claude 5 家族與模型策略一步步練習。