跳至主要內容

AGENT 工具差異地圖 · 當前快照

三條路線,走向
同一台 Agent Computer。

Claude Code、Codex 與 Grok Build 正從不同方向吸收舊電腦堆疊。這張圖比較官方能力覆蓋、目前著重、推論中的方向,以及三者都尚未補齊的層級。

證據邊界

OFFICIAL實心狀態只代表目前第一方資料已有文件。Limited 表示仍是 Preview、Experimental、限定介面或能力不完整。

INFERENCE虛線方向是 ClaudeWorld 分析,不是廠商 Roadmap、承諾、Benchmark 或產品分數。

同一套電腦模型 · 三條演進軌跡

用同一組 11 個系統層級看三個產品

選擇產品可隔離它的方向;比較全部會保留所有標記,但不虛構誰是贏家。

目前軌跡

Claude Code

正從互動式 Coding Tool 走向 Agent OS 與協作控制面,以 Sessions、Skills、Hooks、Teams、Goals 與人類監督包住整個工作。

納入比較的介面
CLI · Desktop · Web · IDE · SDK
SCOPE NOTE
比較 Claude Code 的 CLI、Desktop/Web/IDE 與 Agent SDK,不含一般 Claude Chat 產品。
目前著重
生命週期控制可重用能力Agent 協調人類監督操作
方向向量

Agent 協作控制面 ClaudeWorld 推論 · 強訊號

Agent View、Teams、Workflows、Scheduled Work 與 Goals,把介面從一段對話推向多 Worker 營運。

Skills 成為 Agent Programs ClaudeWorld 推論 · 強訊號

Skills、Plugins、Hooks 與 MCP 正把工作封裝成可重複能力,而非一次性 Prompt。
此產品仍未解決 · ClaudeWorld 推論
  • 跨所有 Sessions 與 Surfaces 的單一資源排程器
  • 跨裝置的交易式共享狀態
  • 超越 Edit Checkpoint 的副作用安全復原
目前軌跡

Codex

正在建立 Local-to-Cloud Execution Fabric:平行長任務、隔離 Worktrees、Skills、Automations、Review 與遠端監督。

納入比較的介面
CLI · App · IDE · Cloud · SDK
SCOPE NOTE
比較 Codex CLI、IDE、Desktop App、Cloud 與 SDK;不同 Surface 的能力可用性並不相同。
目前著重
平行長任務Local ↔ Cloud 連續性Review 與核准Skills 與 Plugins
方向向量

Agent Command Center ClaudeWorld 推論 · 強訊號

官方已明確把開發從單一 Agent Pairing,改寫為監督多個協調團隊與長任務。

電腦成為執行主機 ClaudeWorld 推論 · 強訊號

Goals、Skills、Plugins、Schedules、Cloud Environments 與 Remote Control,把使用者模型拉到檔案與 Terminal 之上。
此產品仍未解決 · ClaudeWorld 推論
  • Local 與 Cloud 間的一致語意狀態
  • Shell、MCP、Browser 與 Computer Use 的統一授權
  • 真實世界副作用的交易式回滾
目前軌跡

Grok Build

一個相容性優先、可攜的本機 Agent Runtime,吸收 Claude、AGENTS.md、MCP、ACP、Plugins、Hooks 與自訂模型慣例。

納入比較的介面
CLI · TUI · Headless · ACP
SCOPE NOTE
比較 Coding Agent Runtime「Grok Build」,不把一般 Grok Chat 或 Hosted Research Multi-Agent 合併進來。
目前著重
互通性本機操作控制可擴充 Runtime企業端點政策
方向向量

可攜式 Agent Shell ClaudeWorld 推論 · 強訊號

ACP、自訂模型、MCP 與相容層,讓 Harness 成為可替換、能承接多個生態的 Runtime。

受治理的本機控制面 ClaudeWorld 推論 · 強訊號

Sessions、Dashboard、Permissions、Sandbox、Monitoring 與 Enterprise Policy 正匯聚成端點執行環境。
此產品仍未解決 · ClaudeWorld 推論
  • Host 掉線後仍存活的 Always-on Supervisor
  • 跨 Host 的排程與資源 Placement
  • 簽章套件與副作用安全的交易式復原
已有官方文件 已有文件 · 能力受限 尚未找到官方證據 尚未評估

「尚未找到官方證據」只表示截至 2026-07-19 的審查來源沒有證據,不等於功能確定不存在。

編輯判斷的著重 · CW 「著重」Badge 是 ClaudeWorld 推論,不是官方成熟度標籤或產品分數。

納入比較的介面 「有文件」表示至少一個納入比較的 Surface 有第一方證據,不代表所有 Surface 功能一致。

三者共同的空白區 · ClaudeWorld 推論

尚未被整合成單一系統的能力

三者仍透過檔案、Shell、Processes、Git、OS Sandbox、Browser 與 SaaS API 執行。只有以下缺層變成原生能力,工具才真正離開 PC 架構。

STATE / 01 · CW

一致的語意狀態

跨 Agent、裝置與外部系統的版本化、可處理衝突狀態,而不只是 Transcript 與檔案。

KERNEL / 02 · CW

全域資源核心

以同一層管理優先序、預算、配額、Placement、取消、重試與背壓。

AUTH / 03 · CW

統一能力授權

依任務授予身分與權限,橫跨 Shell、檔案、Browser、MCP、GUI、Secrets 與 Hosted Tools。

TRACE / 04 · CW

因果副作用帳本

把決策、Tool Calls、State Diff、成本、核准與真實世界結果串成一條可追溯記錄。

TXN / 05 · CW

交易式復原

對外部副作用提供冪等、去重、補償動作與受控回滾。

FABRIC / 06 · CW

位置透明的執行層

目標能安全移動到本機、雲端、Browser、Edge 與裝置,不再繼承單一電腦的限制。

官方證據帳本 每個能力標記都連到此日期快照審查過的第一方文件、公告或 Repository。

Claude Code

Codex

Grok Build

TOOL → COMPUTER → EXECUTION FABRIC

終點不是更好的 Terminal。

而是一個 Goal Runtime:能放置工作、控制權限、保存狀態、證明結果,並跨機器復原,不再把舊電腦當成工作的最小單位。

查看演化地圖 選擇平行模式 檢查開源系統