前言¶
2026 年 7 月 24 日,Anthropic 正式发布 Claude Opus 5(API 标识 claude-opus-5)。这是 Opus 系列的一次明显升级:原生 100 万 Token 上下文、默认开启 adaptive thinking,定价仍维持 $5 / $25 每百万 Token(输入 / 输出),与上一代 Opus 4.8 相同。
对 Claude Code 用户来说,这次发布不只是换了一个模型名。Max、Team Premium、Enterprise 按量付费以及 API 账户的 Default 模型已解析为 Opus 5;Pro、Team Standard 等席位则仍以 Sonnet 5 为默认。与此同时,Claude Code 在 7 月持续迭代 Subagent 后台运行、嵌套委派、/code-review 后台审查和 /doctor 自检修复等能力,开发者工具链的讨论也因此格外活跃。
本文依据 Anthropic 官方发布说明、Claude Platform 发布日志 与 Claude Code 变更记录 整理,梳理 Opus 5 的核心规格,以及它与 Claude Code 7 月更新的衔接关系。
Claude Opus 5 核心规格¶
根据 Anthropic 官方文档,Opus 5 的主要参数如下:
| 项目 | 说明 |
|---|---|
| 上下文窗口 | 100 万 Token(默认即上限,无需 beta header) |
| 最大输出 | Messages API 128k Token;Batch API 可通过 beta header 扩展至 300k |
| 定价 | \(5 / 输入百万 Token,\)25 / 输出百万 Token |
| Thinking | 默认开启 adaptive thinking |
| Effort 档位 | low、medium、high、xhigh、max,默认 high |
| Fast Mode | 约 2.5 倍输出速度,价格为标准模式的 2 倍 |
与 Opus 4.8 相比,Opus 5 在 Frontier-Bench、CursorBench 等编码与知识工作评测上均有提升。官方将其定位为「接近 Fable 5 前沿能力、但价格仅为一半」的日常主力模型,也是 Claude Max 的默认模型。
有一点行为变化值得迁移时留意:在 xhigh 或 max effort 下,无法关闭 thinking;若 API 请求携带 thinking: {"type": "disabled"},将返回 400 错误。在 high 及以下档位仍可禁用。
100 万上下文意味着什么¶
Opus 5 的 100 万 Token 窗口既是默认值,也是上限,且 不按长上下文额外加价——官方说明 90 万 Token 的请求与 9 千 Token 的请求按相同单价计费。
对 Claude Code 场景,这意味着:
- 系统提示、工具定义、对话历史、上一轮 thinking 块 都计入上下文,且 thinking 块默认保留并在后续轮次作为输入计费。
- 大型 monorepo 的全量索引、跨文件重构、长会话 debug,不再依赖单独的 1M beta header。
- Sonnet 5 同样具备原生 1M 上下文(促销价 $2 / $10 每百万 Token,至 2026 年 8 月 31 日),Pro 档默认用户日常已能用到长上下文;Opus 5 则是在 推理深度与 agent 稳定性 上进一步抬升上限。
在 Claude Code 中,可通过模型别名显式指定 1M 窗口,例如:
> /model opus[1m]
或直接选用完整模型名:
> /model claude-opus-5
Claude Code 里的模型分工¶
Claude Code 的 Default 模型因账户类型而异,这是 7 月讨论里最容易混淆的一点。根据 Claude Code 模型配置文档:
| 账户类型 | Default 解析为 |
|---|---|
| Max、Team Premium、Enterprise 按量付费、Anthropic API | Opus 5 |
| Pro、Team Standard、Enterprise 订阅席位 | Sonnet 5 |
| Microsoft Foundry | Sonnet 4.5(opus 别名仍指向 Opus 4.6,需显式指定 claude-opus-5) |
因此,「100 万上下文成为 Claude Code 默认旗舰模型」应理解为:在 Max / API 等高档位,Default 已切换为带 1M 上下文的 Opus 5;Pro 档默认仍是 Sonnet 5,但可随时 /model 切换到 Opus 5。
版本要求:
- Opus 5:Claude Code v2.1.219 或更高
- Sonnet 5:v2.1.197 或更高
低于 v2.1.219 时,opus 别名会继续解析到 Opus 4.8,界面里也可能看不到 Opus 5。升级命令:
claude update
Fast Mode 方面,Claude Code 变更记录注明 Opus 4.7 已移出 fast mode 支持;/fast 现适用于 Opus 5 与 Opus 4.8,Opus 5 的 fast mode 定价为 $10 / $50 每百万 Token。
7 月 Claude Code 工具链迭代¶
Opus 5 发布前后,Claude Code 在 agent 工作流上有一串连贯更新。以下均来自官方 changelog 与 2026 年第 27 周摘要。
Subagent 默认后台运行¶
自 v2.1.198 起,Subagent 默认在后台执行:主会话不必阻塞等待,子任务完成后 Claude 会收到通知再继续。若子任务结果必须在下一步之前返回,Claude 仍会将该 Subagent 跑在前台。
可在 agent frontmatter 里用 background 字段固定行为。后台 Subagent 的权限提示会 汇总到主会话,按 Esc 可单独拒绝某次工具调用。
嵌套 Subagent(Nested Subagent)¶
7 月中下旬的更新进一步放宽嵌套深度:Subagent 默认最多可再 spawn 三层子 agent(总深度 3,此前默认为 1)。可通过环境变量收紧:
export CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH=1
headless / stream-json 场景下,设置 --forward-subagent-text 或 CLAUDE_CODE_FORWARD_SUBAGENT_TEXT=1,可将 depth-2 及更深层的 Subagent 输出转发到主流,便于 CI 或 IDE 插件观测。
并发也有上限:默认最多 20 个 同时运行的 Subagent,可用 CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS 覆盖;单会话 spawn 总数默认上限 200,/clear 可重置预算。
/code-review 后台 Code Review¶
较新的 changelog 条目写明:/code-review 改为以后台 Subagent 运行。代码审查不再占满主对话上下文,且能保留 stacked slash command 指定的审查目标。例如:
> /code-review medium
非交互模式下,/code-review ultra 会启动云端审查而非静默降级为本地单 pass。若只需快速单轮审查,仍可使用 /review。
/doctor 自检与修复¶
/doctor(别名 /checkup)已演进为 完整环境体检:可诊断安装渠道、启动脚本、MCP 连接、settings 冲突、CLAUDE.md 体积等问题,并在部分场景下 直接 propose 修复(如 auto mode 默认值、npm 全局安装无法自更新等)。
遇到 Subagent 嵌套导致 TUI 异常、Remote Control 会话状态不同步、或 Windows 路径 \u 段被误解析时,官方 changelog 也建议先跑一遍:
> /doctor
其他 7 月要点¶
- Claude in Chrome GA(v2.1.198):Chrome 集成退出 preview,Claude Code 可驱动浏览器做端到端测试。
- Claude Sonnet 5 成为 Pro 等席位默认(v2.1.197+):1M 上下文 + 促销定价,与 Opus 5 形成「默认 Sonnet、旗舰 Opus」的分层。
- 组织默认模型:管理员可在 org console 设置 Default,个人未选模型时在
/model中显示为「Org default」。
开发者如何上手 Opus 5¶
1. 确认 Claude Code 版本¶
claude --version
若低于 2.1.219,执行 claude update。升级后重启终端,避免别名缓存仍指向 Opus 4.8。
2. 选择模型与 Effort¶
Max / API 用户通常无需改动,Default 已是 Opus 5。Pro 用户可手动切换:
> /model claude-opus-5
> /effort high
长周期 agent 任务可尝试 xhigh 或 max;注意高档位下 thinking 不可关闭,Token 消耗也会显著上升。
3. 按需开启 Fast Mode¶
对 latency 敏感、又愿意付 2 倍 Token 价的场景:
> /fast on
切换模型后 fast mode 状态会自动跟随模型能力调整(changelog 已修复「切回支持 fast 的模型后 fast 仍关闭」的问题)。
4. 用 Subagent 组织复杂任务¶
大型重构可拆给 Explore、code-reviewer 等内置 agent,或自定义 .claude/agents/ 下的 markdown 定义。嵌套深度与后台运行让「主会话规划 + 子 agent 并行执行」成为 Claude Code 7 月的默认工作方式;/code-review 后台化则把审查从主对话里剥离出去。
5. API 侧迁移¶
若项目直接调用 Claude API,模型 ID 从无日期的 claude-opus-5 开始即可。Fast mode 在 API 上通过 speed: "fast" 与对应 beta header 启用;Opus 4.7 的 fast mode 已移除,需迁移到 Opus 5 或 Opus 4.8。
小结¶
Claude Opus 5 把 100 万上下文、默认 thinking 与 Opus 档定价 绑在一起,并在 Max / API 等账户上成为 Claude Code 的 Default 旗舰选择;Pro 档仍以 Sonnet 5 为默认,但两条产品线都已原生支持 1M 窗口。
配合 7 月 Claude Code 在 Subagent 后台化、三层嵌套、/code-review 后台审查、/doctor 自检 上的迭代,开发者工具链正从「单会话问答」转向「主 agent 编排 + 多 Subagent 并行 + 长上下文推理」的形态。若你已在用 Claude Code,优先检查版本是否 ≥ 2.1.219,再确认 /model 解析是否符合自己的订阅档位——这比追逐模型别名更能避免「以为在用 Opus 5,实际还在 Opus 4.8」的隐性落差。