前言¶
DeepSeek V4 採用峯谷計價:工作日白天的高峯時段,輸出價格是低谷的兩倍。對在 DeepSeek Harness(DSH)上跑長會話的智能體開發者來說,同樣的任務放在高峯時段執行,輸出側開銷直接翻倍;而輸出裏有相當一部分是客套話、對沖語這類可壓縮內容。
DSH 的理念是「一切皆插件」,時段相關的行爲正適合交給插件處理。下面介紹的 dsh-peak-cost-mode 做的就是這件事:高峯時段自動讓模型切換到超精簡輸出省 token,並按 DeepSeek 定價把省下的部分折算成 token 數和人民幣展示出來。
這是什麼¶
dsh-peak-cost-mode 是一個 DSH web 端插件,作者是 moon09300731,許可證爲 MIT,package.json 中的當前版本號爲 0.4.0。
一句話定位:DeepSeek 峯谷計價省錢插件——高峯時段自動切換 caveman 超精簡輸出省 token,標題欄徽章 + 切換提醒,並按 DeepSeek 定價計量節省的 token 與人民幣。
它解決兩個問題:一是高峯時段的成本,通過壓縮輸出降低 token 消耗;二是「到底省了多少」的可見性——插件會攔截每次流式調用的真實 token 用量做計量,而不只是給一個開關。
核心功能¶
高峯檢測¶
插件覈對北京時間(UTC+8,無夏令時)與 DeepSeek V4 峯谷計價表:
| 時段(北京時間) | 檔位 | 價格 |
|---|---|---|
| 週一至週五 09:00–12:00 | 高峯 | ×2 |
| 週一至週五 12:00–14:00 | 低谷 | ×1 |
| 週一至週五 14:00–18:00 | 高峯 | ×2 |
| 週一至週五 18:00–次日 09:00 | 低谷 | ×1 |
| 週六週日全天 | 低谷 | ×1 |
關於檢測週期:客戶端 client.js 每 10 秒輪詢一次狀態接口;host 側覈對北京時間的週期,README 中兩處表述不一致(一處寫每 30 秒覈對,一處寫 10 秒計時器),本文不做斷言,以源碼爲準。
高峯時段的 caveman 輸出¶
進入高峯窗口後,插件注入一段名爲 “Peak Cost Mode” 的提示段(order 60),讓模型以超壓縮的 caveman 風格回覆:丟棄客套、對沖語,但代碼、命令、API 名、文件路徑、精確錯誤串、數字等技術內容逐字保留;安全警告與不可逆操作確認永不壓縮。
徽章與切換提醒¶
會話頭部右側有一個持久狀態徽章:
- 高峯時段:紅色「高峯 ×2 · 省流中」
- 主動省流時:綠色「🟢 低谷 · 主動省流中」
- 其餘時間:綠色「低谷 ×1」
徽章懸停顯示峯谷窗口、倍率、北京時間、下次切換時間,點擊打開省錢報告。
每次檔位切換會彈出 toast 提醒:
- 低谷 → 高峯:「梁文鋒來了,少說話多做事。」
- 高峯 → 低谷:「梁文谷來了,一切正常。」
低谷時段主動省流(0.3.0 起)¶
低谷時段也可以主動省:在省錢報告右下角點「🟢 我要省錢!」,注入同樣的 caveman 提示段並繼續計量。這類 wave 按 source: voluntary 與官方高峯的 source: peak 分開統計。
該開關跨重啓與峯谷持久:進入高峯自動併入高峯計量,離開高峯自動恢復主動省流;隨時可在報告中點「✋ 停止省流」停止。
省錢計量與展示¶
計量邏輯(0.3.0 起)分三步:
1、插件攔截每次流式模型調用(llm/stream),記錄真實 token 用量——輸入 miss / 緩存命中 / 輸出,按模型分列。
2、按 saved tokens ≈ actual output tokens × r/(1−r) 估算節省,其中 r 爲壓縮比,默認 0.6,可配 0–0.9。
3、按 DeepSeek 高峯輸出價折算人民幣(高峯價 = 低谷 ×2;示例:V4-Flash 輸出 ¥9.0/M,V4-Pro 輸出 ¥27.0/M)。
注意:只計輸出側。壓縮不改變輸入 token 與緩存命中(平臺的 prompt-reuse 緩存率與插件無關),輸入側 cache delta 僅在 /stats 作參考,不計入省錢。
省白數據出現在四處:頭部徽章即時計數、composer 上方(conversation.composer.dock)的環境讀數、切換 toast、省錢報告面板。報告面板展示當前 wave / 今日 / 累計的 token 與人民幣、按模型分解的反事實輸出 → 實際輸出 → 節省、高峯/主動拆分,並可通過 POST /api/peak-cost/reset 重置。數據按 wave 持久化到 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/stats.json(v3 格式),跨重啓保留。
安裝與啓用¶
dsh plugin --profile web add dsh-peak-cost-mode
# 或從 GitHub 安裝:
dsh plugin --profile web add github:moon09300731/dsh-peak-cost-mode
安裝後需要重啓 dsh web,並在瀏覽器中硬刷新頁面,徽章與報告纔會出現。
順帶說明:下文給出的社區插件目錄是獨立站點,與 DeepSeek / 幻方沒有官方從屬關係,不是官方應用商店。
配置¶
可選配置文件位於 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/config.json:
{
"saveRatio": 0.6,
"baseCacheHitRate": 0.5,
"multiplier": 2,
"peakWindows": [
{ "start": 9, "end": 12 },
{ "start": 14, "end": 18 }
],
"weekendValley": true,
"prices": {
"deepseek-v4-flash": { "hit": 0.05, "miss": 1.5, "output": 4.5 },
"deepseek-v4-pro": { "hit": 0.15, "miss": 4.5, "output": 13.5 }
}
}
各字段:
saveRatio:caveman 模式的輸出壓縮比,默認 0.6,範圍 0–0.9baseCacheHitRate:默認 0.5multiplier:高峯倍率,默認 2peakWindows:北京時間高峯窗口,默認[{9,12},{14,18}]weekendValley:默認 true,即週六週日全天按低谷計prices:按模型設置低谷價(¥ / 百萬 token),精確模型鍵覆蓋內置 flash/pro 默認價
prices 會過期,使用前需對照 DeepSeek 官方定價頁覈實;UI 中顯示的省錢是估計值,不是賬單。
典型用法¶
1、安裝插件,重啓 dsh web 並硬刷新瀏覽器頁面。
2、低谷時段點擊綠色徽章打開省錢報告,在右下角點「🟢 我要省錢!」開啓主動省流;不需要時在報告中點「✋ 停止省流」。
3、進入高峯後插件自動切換,無需操作;點擊頭部徽章隨時查看當前 wave / 今日 / 累計的節省。
4、需要清零統計時,通過 POST /api/peak-cost/reset 重置。
接口與開發校驗¶
插件在 host 側暴露以下接口:
GET /api/peak-cost/state
GET /api/peak-cost/stats
POST /api/peak-cost/voluntary?active=true|false # 持久的主動省流開關
POST /api/peak-cost/reset
客戶端 client.js 每 10 秒輪詢 /api/peak-cost/state,並把快照鏡像到 localStorage 鍵 dsh.peakCost.v1。
開發與校驗:
npm test # node --check + 單元測試
node scripts/verify.mjs # 獨立復算 /api/peak-cost/stats,全部 PASS 即記賬正確
適用場景與注意¶
適合的場景:
- 主要在 DeepSeek V4 上跑長會話、輸出 token 佔大頭的 DSH web 用戶
- 工作日白天(高峯時段)使用頻繁,願意用更精簡的輸出換成本
- 想知道省流到底省了多少 token、摺合多少錢,而不只是有個開關
使用前注意:
1、提示段註冊在 host 作用域,任何省錢模式對部署的所有會話生效;如需僅單會話壓縮,需改用 dynamic-plugin 變體。
2、顯示的省錢數字是估算(反事實:未壓縮的精確輸出不可知),UI 中已明確標註;顯示的省錢爲估計而非賬單。
3、省錢只計輸出側,壓縮不改變輸入 token 與緩存命中。
4、prices 會過期,需對照 DeepSeek 官方定價頁覈實。
5、插件以當前 dsh 進程的權限運行,安裝前應檢查插件源碼與許可證(本項目爲 MIT)。
小結¶
dsh-peak-cost-mode 把峯谷計價這件事做成了全自動:高峯自動壓縮輸出、低谷可主動省流,省下的 token 與人民幣都擺在報告裏,且數據跨重啓保留。如果你在 DSH 上跑 DeepSeek,可以裝上試一試。
- 目錄頁:https://www.skillhub.cn/plugins/moon09300731/dsh-peak-cost-mode
- GitHub:https://github.com/moon09300731/dsh-peak-cost-mode