我们建议使用 Claude Opus 5。它以相同价格取代 Opus 4.8,并提供更强的智能体编程能力和长程推理能力。
Claude Opus 4.8 是 Anthropic 的上一代 Opus 模型,在 CursorBench 上相比 Opus 4.7 有显著提升。它擅长自主完成多步骤任务:能在长时间会话中保持目标一致,遇到阻碍时自我纠正,无需手把手指导即可编写可直接用于生产环境的代码。为获得最佳效果,我们建议使用高思考变体。
优势¶
- 自主性强,能自我驱动。Opus 4.8 能在大型代码库和长对话中持续推进多步骤任务直至完成,不偏离目标。
- 创造性推理。它能从意想不到的角度解决问题,探索替代方案,并生成比前代更具创意的代码。
- 擅长规划。它会在执行前梳理工作,及早发现边界情况,并在多个文件中构建连贯的架构。
- 工具使用可靠。它会有针对性地调用工具,将工具结果衔接到后续操作中,并能在工具输出出乎意料时灵活调整。
局限性¶
- 成本最高的模型,比其他选项更快耗尽用量限额。
- 在更看重简洁而非深度的长会话中,可能会展开得过于详尽。
工具¶
在 Cursor 中使用 Opus 4.8 时,可使用所有智能体工具,包括:
定价¶
Cursor 方案包含两个用量池。Opus 4.8 从第三方其他模型用量池中扣除,按以下费率计费。所有价格均按每百万 token 计算。
提供快速模式层级 (claude-opus-4-8-fast) ,输出速度约快 2.5 倍。在旧版按请求计费的方案中,需要使用 Max Mode。其费率为输入 $10/M、输出 $50/M token,比 Opus 4.7 快速模式低 3 倍。请仅在对时间敏感或关键的工作中酌情使用。
所有 Opus 4.8 提示词均按上表中的基础每 token 费率计费,即使上下文超过 300k 也是如此。Opus 4.8 不设单独的长上下文费率倍增。上下文窗口最高可达 1M token,且费率相同。
Opus 4.8 支持用于深度推理的思考变体。我们建议使用高思考变体,以获得最佳效果。