前言¶
DeepSeek V4 采用峰谷计价:工作日白天的高峰时段,输出价格是低谷的两倍。对在 DeepSeek Harness(DSH)上跑长会话的智能体开发者来说,同样的任务放在高峰时段执行,输出侧开销直接翻倍;而输出里有相当一部分是客套话、对冲语这类可压缩内容。
DSH 的理念是「一切皆插件」,时段相关的行为正适合交给插件处理。下面介绍的 dsh-peak-cost-mode 做的就是这件事:高峰时段自动让模型切换到超精简输出省 token,并按 DeepSeek 定价把省下的部分折算成 token 数和人民币展示出来。
这是什么¶
dsh-peak-cost-mode 是一个 DSH web 端插件,作者是 moon09300731,许可证为 MIT,package.json 中的当前版本号为 0.4.0。
一句话定位:DeepSeek 峰谷计价省钱插件——高峰时段自动切换 caveman 超精简输出省 token,标题栏徽章 + 切换提醒,并按 DeepSeek 定价计量节省的 token 与人民币。
它解决两个问题:一是高峰时段的成本,通过压缩输出降低 token 消耗;二是「到底省了多少」的可见性——插件会拦截每次流式调用的真实 token 用量做计量,而不只是给一个开关。
核心功能¶
高峰检测¶
插件核对北京时间(UTC+8,无夏令时)与 DeepSeek V4 峰谷计价表:
| 时段(北京时间) | 档位 | 价格 |
|---|---|---|
| 周一至周五 09:00–12:00 | 高峰 | ×2 |
| 周一至周五 12:00–14:00 | 低谷 | ×1 |
| 周一至周五 14:00–18:00 | 高峰 | ×2 |
| 周一至周五 18:00–次日 09:00 | 低谷 | ×1 |
| 周六周日全天 | 低谷 | ×1 |
关于检测周期:客户端 client.js 每 10 秒轮询一次状态接口;host 侧核对北京时间的周期,README 中两处表述不一致(一处写每 30 秒核对,一处写 10 秒计时器),本文不做断言,以源码为准。
高峰时段的 caveman 输出¶
进入高峰窗口后,插件注入一段名为 “Peak Cost Mode” 的提示段(order 60),让模型以超压缩的 caveman 风格回复:丢弃客套、对冲语,但代码、命令、API 名、文件路径、精确错误串、数字等技术内容逐字保留;安全警告与不可逆操作确认永不压缩。
徽章与切换提醒¶
会话头部右侧有一个持久状态徽章:
- 高峰时段:红色「高峰 ×2 · 省流中」
- 主动省流时:绿色「🟢 低谷 · 主动省流中」
- 其余时间:绿色「低谷 ×1」
徽章悬停显示峰谷窗口、倍率、北京时间、下次切换时间,点击打开省钱报告。
每次档位切换会弹出 toast 提醒:
- 低谷 → 高峰:「梁文锋来了,少说话多做事。」
- 高峰 → 低谷:「梁文谷来了,一切正常。」
低谷时段主动省流(0.3.0 起)¶
低谷时段也可以主动省:在省钱报告右下角点「🟢 我要省钱!」,注入同样的 caveman 提示段并继续计量。这类 wave 按 source: voluntary 与官方高峰的 source: peak 分开统计。
该开关跨重启与峰谷持久:进入高峰自动并入高峰计量,离开高峰自动恢复主动省流;随时可在报告中点「✋ 停止省流」停止。
省钱计量与展示¶
计量逻辑(0.3.0 起)分三步:
1、插件拦截每次流式模型调用(llm/stream),记录真实 token 用量——输入 miss / 缓存命中 / 输出,按模型分列。
2、按 saved tokens ≈ actual output tokens × r/(1−r) 估算节省,其中 r 为压缩比,默认 0.6,可配 0–0.9。
3、按 DeepSeek 高峰输出价折算人民币(高峰价 = 低谷 ×2;示例:V4-Flash 输出 ¥9.0/M,V4-Pro 输出 ¥27.0/M)。
注意:只计输出侧。压缩不改变输入 token 与缓存命中(平台的 prompt-reuse 缓存率与插件无关),输入侧 cache delta 仅在 /stats 作参考,不计入省钱。
省白数据出现在四处:头部徽章实时计数、composer 上方(conversation.composer.dock)的环境读数、切换 toast、省钱报告面板。报告面板展示当前 wave / 今日 / 累计的 token 与人民币、按模型分解的反事实输出 → 实际输出 → 节省、高峰/主动拆分,并可通过 POST /api/peak-cost/reset 重置。数据按 wave 持久化到 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/stats.json(v3 格式),跨重启保留。
安装与启用¶
dsh plugin --profile web add dsh-peak-cost-mode
# 或从 GitHub 安装:
dsh plugin --profile web add github:moon09300731/dsh-peak-cost-mode
安装后需要重启 dsh web,并在浏览器中硬刷新页面,徽章与报告才会出现。
顺带说明:下文给出的社区插件目录是独立站点,与 DeepSeek / 幻方没有官方从属关系,不是官方应用商店。
配置¶
可选配置文件位于 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/config.json:
{
"saveRatio": 0.6,
"baseCacheHitRate": 0.5,
"multiplier": 2,
"peakWindows": [
{ "start": 9, "end": 12 },
{ "start": 14, "end": 18 }
],
"weekendValley": true,
"prices": {
"deepseek-v4-flash": { "hit": 0.05, "miss": 1.5, "output": 4.5 },
"deepseek-v4-pro": { "hit": 0.15, "miss": 4.5, "output": 13.5 }
}
}
各字段:
saveRatio:caveman 模式的输出压缩比,默认 0.6,范围 0–0.9baseCacheHitRate:默认 0.5multiplier:高峰倍率,默认 2peakWindows:北京时间高峰窗口,默认[{9,12},{14,18}]weekendValley:默认 true,即周六周日全天按低谷计prices:按模型设置低谷价(¥ / 百万 token),精确模型键覆盖内置 flash/pro 默认价
prices 会过期,使用前需对照 DeepSeek 官方定价页核实;UI 中显示的省钱是估计值,不是账单。
典型用法¶
1、安装插件,重启 dsh web 并硬刷新浏览器页面。
2、低谷时段点击绿色徽章打开省钱报告,在右下角点「🟢 我要省钱!」开启主动省流;不需要时在报告中点「✋ 停止省流」。
3、进入高峰后插件自动切换,无需操作;点击头部徽章随时查看当前 wave / 今日 / 累计的节省。
4、需要清零统计时,通过 POST /api/peak-cost/reset 重置。
接口与开发校验¶
插件在 host 侧暴露以下接口:
GET /api/peak-cost/state
GET /api/peak-cost/stats
POST /api/peak-cost/voluntary?active=true|false # 持久的主动省流开关
POST /api/peak-cost/reset
客户端 client.js 每 10 秒轮询 /api/peak-cost/state,并把快照镜像到 localStorage 键 dsh.peakCost.v1。
开发与校验:
npm test # node --check + 单元测试
node scripts/verify.mjs # 独立复算 /api/peak-cost/stats,全部 PASS 即记账正确
适用场景与注意¶
适合的场景:
- 主要在 DeepSeek V4 上跑长会话、输出 token 占大头的 DSH web 用户
- 工作日白天(高峰时段)使用频繁,愿意用更精简的输出换成本
- 想知道省流到底省了多少 token、折合多少钱,而不只是有个开关
使用前注意:
1、提示段注册在 host 作用域,任何省钱模式对部署的所有会话生效;如需仅单会话压缩,需改用 dynamic-plugin 变体。
2、显示的省钱数字是估算(反事实:未压缩的精确输出不可知),UI 中已明确标注;显示的省钱为估计而非账单。
3、省钱只计输出侧,压缩不改变输入 token 与缓存命中。
4、prices 会过期,需对照 DeepSeek 官方定价页核实。
5、插件以当前 dsh 进程的权限运行,安装前应检查插件源码与许可证(本项目为 MIT)。
小结¶
dsh-peak-cost-mode 把峰谷计价这件事做成了全自动:高峰自动压缩输出、低谷可主动省流,省下的 token 与人民币都摆在报告里,且数据跨重启保留。如果你在 DSH 上跑 DeepSeek,可以装上试一试。
- 目录页:https://www.skillhub.cn/plugins/moon09300731/dsh-peak-cost-mode
- GitHub:https://github.com/moon09300731/dsh-peak-cost-mode