模型不是勝負手:2026 年中 CLI 編碼 Agent 的 Harness 之爭
2026 年中,CLI 編碼 Agent 社區的關注點從基座模型轉向 Harness——系統提示、重試邏輯、上下文壓縮與 Subagent 編排。Terminal-Bench 2.1 上 Claude Code 與 Codex CLI 以 83% 左右準確率膠着,同一模型在不同 Harness 下分數可差數個百分點。本文梳理 Harness 概念,對照 Claude Code、Codex CLI、OpenCode、Copilot CLI 四條路線,並說明上下文壓縮爲何成爲隱形戰場,幫助開發者按場景選型。
閱讀全文