Gemini 3.8 Flash 是 Google 最新的速度层级模型,兼具出色的智能体编程性能与较低的按 token 计费成本。适合处理需要推理能力和大上下文窗口的高吞吐编程任务。
优势¶
- 每百万输入 token 0.75 美元,每百万输出 token 3.50 美元。
- 缓存输入 token 可享 9 折优惠减免 90% (0.075 美元/百万) 。适合大型代码库等需要重复使用的上下文。
- 100 万 token 上下文窗口,单次请求即可容纳代码仓库的大部分内容。
- 三档 effort:high (默认值) 、medium 和 low。处理较简单的任务时可降至 medium 或 low,以获得更快的响应。
工具¶
在 Cursor 中使用时,Gemini 3.8 Flash 可以使用全部智能体工具,包括:
定价¶
Cursor 方案包含两个用量池。Gemini 3.8 Flash 从第三方其他模型用量池中扣除,按以下费率计费。所有价格均按每百万 token 计算。