我们建议使用 Claude Opus 5。它在 CursorBench 上得分更高,自主能力更强,价格也相同。
Opus 4.6 是 Anthropic 的上一代旗舰模型。它能在多轮对话中准确把握意图,并在长时间会话中保持连贯推理。它会先规划后行动,提供具体修复方案,并编写风格优良、符合惯例的代码。
优势¶
- 能预先制定方案,并在多轮对话中保持连贯推理。擅长系统设计、复杂重构和代码评审。
- 可处理涉及 CI、Docker 和监控的海量日志及多项目疑难排查。
- 能编写符合惯例的代码,并做出可靠的架构决策。适合代码评审和生产环境关键更改。
- 能在整个对话中持续理解你的意图。在依赖先前上下文时表现最佳。
- 能够完成跨多个组件的具体缺陷修复和功能开发。
局限性¶
- 成本最高的模型,比其他选项更快耗尽用量限额。
- 在长时间会话中可能过度展开或偏离上下文。
- 在上下文有限时,有时会表现得过于自信。
工具¶
在 Cursor 中使用 Opus 4.6 时,可使用所有智能体工具,包括:
定价¶
Cursor 方案包含两个用量池。Opus 4.6 使用第三方其他模型用量池,按以下费率计费。所有价格均按每百万 token 计算。
所有 Opus 4.6 prompt 均按上表所列的基础每 token 费率计费,即使上下文超过 200k 也是如此。Anthropic 不再对 Opus 4.6 采用单独的长上下文倍率。
Opus 4.6 支持用于更深入推理的思考变体。