Claude Opus 5 发布:100 万上下文成为 Claude Code 默认旗舰模型

前言

2026 年 7 月 24 日,Anthropic 正式发布 Claude Opus 5(API 标识 claude-opus-5)。这是 Opus 系列的一次明显升级:原生 100 万 Token 上下文、默认开启 adaptive thinking,定价仍维持 $5 / $25 每百万 Token(输入 / 输出),与上一代 Opus 4.8 相同。

对 Claude Code 用户来说,这次发布不只是换了一个模型名。Max、Team Premium、Enterprise 按量付费以及 API 账户的 Default 模型已解析为 Opus 5;Pro、Team Standard 等席位则仍以 Sonnet 5 为默认。与此同时,Claude Code 在 7 月持续迭代 Subagent 后台运行、嵌套委派、/code-review 后台审查和 /doctor 自检修复等能力,开发者工具链的讨论也因此格外活跃。

本文依据 Anthropic 官方发布说明Claude Platform 发布日志Claude Code 变更记录 整理,梳理 Opus 5 的核心规格,以及它与 Claude Code 7 月更新的衔接关系。

Claude Opus 5 核心规格

根据 Anthropic 官方文档,Opus 5 的主要参数如下:

项目 说明
上下文窗口 100 万 Token(默认即上限,无需 beta header)
最大输出 Messages API 128k Token;Batch API 可通过 beta header 扩展至 300k
定价 \(5 / 输入百万 Token,\)25 / 输出百万 Token
Thinking 默认开启 adaptive thinking
Effort 档位 lowmediumhighxhighmax,默认 high
Fast Mode 约 2.5 倍输出速度,价格为标准模式的 2 倍

与 Opus 4.8 相比,Opus 5 在 Frontier-Bench、CursorBench 等编码与知识工作评测上均有提升。官方将其定位为「接近 Fable 5 前沿能力、但价格仅为一半」的日常主力模型,也是 Claude Max 的默认模型。

有一点行为变化值得迁移时留意:在 xhighmax effort 下,无法关闭 thinking;若 API 请求携带 thinking: {"type": "disabled"},将返回 400 错误。在 high 及以下档位仍可禁用。

100 万上下文意味着什么

Opus 5 的 100 万 Token 窗口既是默认值,也是上限,且 不按长上下文额外加价——官方说明 90 万 Token 的请求与 9 千 Token 的请求按相同单价计费。

对 Claude Code 场景,这意味着:

  1. 系统提示、工具定义、对话历史、上一轮 thinking 块 都计入上下文,且 thinking 块默认保留并在后续轮次作为输入计费。
  2. 大型 monorepo 的全量索引、跨文件重构、长会话 debug,不再依赖单独的 1M beta header。
  3. Sonnet 5 同样具备原生 1M 上下文(促销价 $2 / $10 每百万 Token,至 2026 年 8 月 31 日),Pro 档默认用户日常已能用到长上下文;Opus 5 则是在 推理深度与 agent 稳定性 上进一步抬升上限。

在 Claude Code 中,可通过模型别名显式指定 1M 窗口,例如:

> /model opus[1m]

或直接选用完整模型名:

> /model claude-opus-5

Claude Code 里的模型分工

Claude Code 的 Default 模型因账户类型而异,这是 7 月讨论里最容易混淆的一点。根据 Claude Code 模型配置文档

账户类型 Default 解析为
Max、Team Premium、Enterprise 按量付费、Anthropic API Opus 5
Pro、Team Standard、Enterprise 订阅席位 Sonnet 5
Microsoft Foundry Sonnet 4.5(opus 别名仍指向 Opus 4.6,需显式指定 claude-opus-5

因此,「100 万上下文成为 Claude Code 默认旗舰模型」应理解为:在 Max / API 等高档位,Default 已切换为带 1M 上下文的 Opus 5;Pro 档默认仍是 Sonnet 5,但可随时 /model 切换到 Opus 5。

版本要求:

  • Opus 5:Claude Code v2.1.219 或更高
  • Sonnet 5:v2.1.197 或更高

低于 v2.1.219 时,opus 别名会继续解析到 Opus 4.8,界面里也可能看不到 Opus 5。升级命令:

claude update

Fast Mode 方面,Claude Code 变更记录注明 Opus 4.7 已移出 fast mode 支持;/fast 现适用于 Opus 5 与 Opus 4.8,Opus 5 的 fast mode 定价为 $10 / $50 每百万 Token

7 月 Claude Code 工具链迭代

Opus 5 发布前后,Claude Code 在 agent 工作流上有一串连贯更新。以下均来自官方 changelog 与 2026 年第 27 周摘要

Subagent 默认后台运行

自 v2.1.198 起,Subagent 默认在后台执行:主会话不必阻塞等待,子任务完成后 Claude 会收到通知再继续。若子任务结果必须在下一步之前返回,Claude 仍会将该 Subagent 跑在前台。

可在 agent frontmatter 里用 background 字段固定行为。后台 Subagent 的权限提示会 汇总到主会话,按 Esc 可单独拒绝某次工具调用。

嵌套 Subagent(Nested Subagent)

7 月中下旬的更新进一步放宽嵌套深度:Subagent 默认最多可再 spawn 三层子 agent(总深度 3,此前默认为 1)。可通过环境变量收紧:

export CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH=1

headless / stream-json 场景下,设置 --forward-subagent-textCLAUDE_CODE_FORWARD_SUBAGENT_TEXT=1,可将 depth-2 及更深层的 Subagent 输出转发到主流,便于 CI 或 IDE 插件观测。

并发也有上限:默认最多 20 个 同时运行的 Subagent,可用 CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS 覆盖;单会话 spawn 总数默认上限 200/clear 可重置预算。

/code-review 后台 Code Review

较新的 changelog 条目写明:/code-review 改为以后台 Subagent 运行。代码审查不再占满主对话上下文,且能保留 stacked slash command 指定的审查目标。例如:

> /code-review medium

非交互模式下,/code-review ultra 会启动云端审查而非静默降级为本地单 pass。若只需快速单轮审查,仍可使用 /review

/doctor 自检与修复

/doctor(别名 /checkup)已演进为 完整环境体检:可诊断安装渠道、启动脚本、MCP 连接、settings 冲突、CLAUDE.md 体积等问题,并在部分场景下 直接 propose 修复(如 auto mode 默认值、npm 全局安装无法自更新等)。

遇到 Subagent 嵌套导致 TUI 异常、Remote Control 会话状态不同步、或 Windows 路径 \u 段被误解析时,官方 changelog 也建议先跑一遍:

> /doctor

其他 7 月要点

  • Claude in Chrome GA(v2.1.198):Chrome 集成退出 preview,Claude Code 可驱动浏览器做端到端测试。
  • Claude Sonnet 5 成为 Pro 等席位默认(v2.1.197+):1M 上下文 + 促销定价,与 Opus 5 形成「默认 Sonnet、旗舰 Opus」的分层。
  • 组织默认模型:管理员可在 org console 设置 Default,个人未选模型时在 /model 中显示为「Org default」。

开发者如何上手 Opus 5

1. 确认 Claude Code 版本

claude --version

若低于 2.1.219,执行 claude update。升级后重启终端,避免别名缓存仍指向 Opus 4.8。

2. 选择模型与 Effort

Max / API 用户通常无需改动,Default 已是 Opus 5。Pro 用户可手动切换:

> /model claude-opus-5
> /effort high

长周期 agent 任务可尝试 xhighmax;注意高档位下 thinking 不可关闭,Token 消耗也会显著上升。

3. 按需开启 Fast Mode

对 latency 敏感、又愿意付 2 倍 Token 价的场景:

> /fast on

切换模型后 fast mode 状态会自动跟随模型能力调整(changelog 已修复「切回支持 fast 的模型后 fast 仍关闭」的问题)。

4. 用 Subagent 组织复杂任务

大型重构可拆给 Explore、code-reviewer 等内置 agent,或自定义 .claude/agents/ 下的 markdown 定义。嵌套深度与后台运行让「主会话规划 + 子 agent 并行执行」成为 Claude Code 7 月的默认工作方式;/code-review 后台化则把审查从主对话里剥离出去。

5. API 侧迁移

若项目直接调用 Claude API,模型 ID 从无日期的 claude-opus-5 开始即可。Fast mode 在 API 上通过 speed: "fast" 与对应 beta header 启用;Opus 4.7 的 fast mode 已移除,需迁移到 Opus 5 或 Opus 4.8。

小结

Claude Opus 5 把 100 万上下文、默认 thinking 与 Opus 档定价 绑在一起,并在 Max / API 等账户上成为 Claude Code 的 Default 旗舰选择;Pro 档仍以 Sonnet 5 为默认,但两条产品线都已原生支持 1M 窗口。

配合 7 月 Claude Code 在 Subagent 后台化、三层嵌套、/code-review 后台审查、/doctor 自检 上的迭代,开发者工具链正从「单会话问答」转向「主 agent 编排 + 多 Subagent 并行 + 长上下文推理」的形态。若你已在用 Claude Code,优先检查版本是否 ≥ 2.1.219,再确认 /model 解析是否符合自己的订阅档位——这比追逐模型别名更能避免「以为在用 Opus 5,实际还在 Opus 4.8」的隐性落差。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜