前言¶
2026 年 7 月下旬,Anthropic 連續推送 Claude Code 多個版本更新。截至 7 月 24 日,最新穩定版爲 2.1.220,其中 2.1.219 引入了本輪最核心的兩項變化:默認模型切換爲 Claude Opus 5,嵌套 Subagent 默認深度從 1 層放寬至 3 層;2.1.218 則將 /code-review 改爲後臺 Subagent 運行。8 月初,多家評測機構將 Claude Code + Opus 5 與 OpenAI 的 GPT-5.6-Sol + Codex 放在 Terminal-Bench 等基準上對比,AI 編程 Agent 的模型與編排層「軍備競賽」進一步升溫。
Claude Code 是 Anthropic 面向終端場景的 AI 編程 Agent,支持在本地 shell 中讀寫代碼、調用工具、派發 Subagent 完成子任務。與前代相比,這一輪更新的重點不在「換一個更強的模型」這麼簡單,而是把 模型能力、Agent 編排、工作流隔離 三件事打包推進。本文基於官方 CHANGELOG 與公開評測資料,梳理 2.1.220 及相關版本的關鍵變更,並給出可操作的配置說明。
版本脈絡:2.1.218 → 2.1.220¶
根據 Claude Code 官方 CHANGELOG,7 月下旬的連續發佈可以這樣理解:
| 版本 | 發佈時間 | 核心變化 |
|---|---|---|
| 2.1.218 | 7 月下旬 | /code-review 改爲後臺 Subagent 運行 |
| 2.1.219 | 2026-07-24 | 默認模型切換 Opus 5;嵌套 Subagent 深度擴至 3 |
| 2.1.220 | 緊隨 2.1.219 | Bug 修復與穩定性改進 |
2.1.220 本身以修復爲主,但對外討論通常以「2.1.220 默認 Opus 5 + 三層 Subagent」作爲整體標籤,因爲 2.1.219 的功能變更纔是實質升級點。下文按功能維度展開,不刻意區分補丁號。
Claude Opus 5 成爲默認模型¶
2.1.219 引入 claude-opus-5,並將其設爲 Opus 系列的默認模型。官方說明要點如下:
- 上下文窗口:1M tokens
- Fast 模式定價:輸入 $10 / 輸出 $50(每百萬 token)
- 遷移路徑:
claude-apiskill 默認指向 Opus 5,從 Opus 4.8 遷移有官方指引 - Fast 模式調整:Opus 4.7 不再支持 fast mode;
/fast現適用於 Opus 5 與 Opus 4.8
對日常使用者而言,升級後無需手動改配置,新會話即默認走 Opus 5。若項目對成本或延遲敏感,仍可在 /model 選擇其他 Opus 變體,或在 API 調用中顯式指定模型 ID。
與 GPT-5.6-Sol 的橫向對比¶
8 月初 NeuralCoreTech 的評測文章 彙總了當時主流 AI 編程 Agent 的基準數據。需要特別注意:以下 Terminal-Bench 分數來自第三方機構 Artificial Analysis 的「純模型」測試,並非 Claude Code 或 Codex 產品級官方榜單,且截至發文時尚未進入 tbench.ai 公開 Agent 排行榜。
| 維度 | Claude Opus 5 | GPT-5.6-Sol |
|---|---|---|
| 發佈 / 默認接入 | 2026-07-24,Claude Code 默認 | 2026-07-09 GA,Codex 默認 |
| Terminal-Bench 2.1(第三方模型測試) | 89.1%(max effort) | 89.5%(xhigh effort) |
| 標價(每百萬 token) | $5 入 / $25 出 | $5 入 / $30 出 |
| 上下文 | 1M tokens | 1.5M tokens(Ultra 模式) |
兩者在 Terminal-Bench 上差距不足 0.5 個百分點,選型更多取決於工作流習慣、訂閱成本結構,以及 Agent 編排層(Subagent、MCP 集成等)而非單一分數。
嵌套 Subagent 深度擴至 3 層¶
Subagent 是 Claude Code 將複雜任務拆分爲並行或串行子任務的核心機制。主 Agent 通過 Agent 工具派發 Subagent,每個 Subagent 在獨立上下文中執行,完成後將結果回傳。
深度變化與歷史背景¶
官方 CHANGELOG 記載,2.1.219 將默認嵌套深度從 1 調整爲 3:
Subagents can now spawn nested subagents up to depth 3 by default (was 1)
這意味着:
- 深度 0:主對話 Agent
- 深度 1:主 Agent 派發的 Subagent
- 深度 2:Subagent 再派發的子 Subagent
- 深度 3:第三層嵌套(新的默認上限)
在此之前,Claude Code 對嵌套策略有過多次調整:早期版本曾允許更深嵌套,2.1.213 一度將默認深度收緊至 1 並加入併發上限,2.1.219 在可控前提下重新開放至 3 層。Anthropic 的意圖很明確——給 Code Review、多文件重構等場景留出「主 Agent → 審查 Agent → 逐條驗證 Agent」的三級流水線,同時避免無節制遞歸。
配套限制機制¶
僅有「深度 3」還不夠,官方同時提供了多層剎車:
- 併發 Subagent 上限:默認最多 20 個同時運行,可通過環境變量
CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS覆蓋 - 單會話派發上限:默認 200 次,可通過
CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION調整;/clear可重置預算 - 動態工作流規模指引:2.1.219 引入
workflowSizeGuideline設置,默認 medium(建議少於 15 個 Agent)
如何關閉或限制嵌套¶
若團隊希望保持扁平結構、避免 Subagent 鏈路過長,可在 settings.json 中寫:
{
"env": {
"CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH": "1"
}
}
將 CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH 設爲 1 即恢復「Subagent 不可再派發子 Agent」的行爲,與 2.1.213 收緊後的策略一致。
對於需要在 CI 或 headless 環境觀測 Subagent 輸出的場景,2.1.219 還支持 --forward-subagent-text 標誌及 CLAUDE_CODE_FORWARD_SUBAGENT_TEXT 環境變量,使 depth-2 及以上的 Subagent 文本出現在 stream-json 輸出中。
/code-review 改爲後臺 Subagent¶
2.1.218 的一項工作流改動,在實際使用中感知度很高:/code-review 改爲後臺 Subagent 執行。
變更前,Code Review 的輸出會直接寫入主對話,長 diff 分析容易擠佔上下文,打斷正在進行的編碼任務。變更後,Review 在後臺 Subagent 中運行,主對話保持乾淨;若你使用了 stacked slash commands(連續斜槓命令),Review 仍會以正確的目標爲審查對象。
官方還修復了 /code-review ultra 在非交互會話中靜默降級爲本地 Review 的問題——現在會正確啓動雲端 Review。對 PR 審查場景,可通過 /code-review <pr#> 指定 Pull Request,配合 --comment 將發現 inline 到 GitHub。
這一改動與 Subagent 深度擴展形成互補:Review 本身後臺化,Review Agent 又可在內部再派發驗證 Subagent,形成「不污染主對話 + 深度審查」的組合。
開發者實踐建議¶
結合官方文檔與社區反饋,升級至 2.1.220 系列後,可按以下步驟驗證環境:
1. 確認版本
claude --version
應顯示 2.1.220 或更高。
2. 檢查默認模型
在 Claude Code 會話中執行 /model,Opus 行應顯示 Opus (1M context),對應 claude-opus-5。
3. 評估 Subagent 策略
- 大型 Monorepo 重構:可保留默認 depth 3,利用多級分工
- 成本敏感或簡單腳本修改:建議設
CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH=1,減少 token 消耗 - 高併發場景:關注
CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS,避免單條消息觸發過多後臺 Agent
4. 對比評測時保持清醒
Terminal-Bench、SWE-bench 等基準各有測試 harness 差異。NeuralCoreTech 文章明確指出,GPT-5.6-Sol 與 Claude Opus 5 的 89%+ 分數是第三方「純模型」測試,Claude Code + Fable 5 在公開 Agent 榜單上的 Terminal-Bench 爲 83.1%。選工具時應區分「模型智商」與「Agent 產品完成度」,兩者並不等價。
小結¶
Claude Code 2.1.220 系列更新,標誌着 Anthropic 在 AI 編程 Agent 賽道上同時推進三條線:更強的默認模型(Opus 5)、更靈活的 Subagent 編排(嵌套深度 3 + 併發/會話上限)、更乾淨的主對話體驗(後臺 Code Review)。與 OpenAI Codex + GPT-5.6-Sol 在 Terminal-Bench 上的膠着差距,說明 2026 年下半年 AI 編程 Agent 的競爭焦點,正從「誰的模型分數高」轉向「誰的 Agent harness 更穩、工作流更順」。
對普通開發者,升級後默認即享 Opus 5,無需額外操作;若 Subagent 派發過多或 Review 輸出干擾主流程,可通過上述環境變量與 settings 精細調控。建議關注 官方 CHANGELOG 持續跟蹤後續版本——Claude Code 在 7 月 alone 就發佈了數十個小版本,迭代節奏極快。