dsh-anchored-standard:两阶段锚定 Standard 的 DSH 预设

前言

在 DeepSeek Harness(DSH)里跑智能体任务,首轮请求里暴露给模型的工具集和提示词,会直接影响后续推理轨迹。社区评测(xiaobright/modeltest)显示:Standard 预设首轮即暴露 25 个工具,在 Project2 V4.1b 上得分约 91/92;Minimal 预设首轮只有一行提示加 2 个工具,得分约 99/96,但工具面太窄,难以支撑真实工程。若你希望在保留 Minimal 首轮轨迹优势的同时,后续仍能调用完整 Standard 工具目录,下面介绍社区插件 dsh-anchored-standard

这是什么

dsh-anchored-standard 是维护者 Jungod1121 发布的 DSH 工作流类插件(当前版本 v1.2.1,MIT 许可证)。它实现一个两阶段 agent 预设:首轮用与 Minimal 对齐的精简提示和少量工具完成「锚定」,在会话记录第一次持久的 tool/call 或回复之后,自动切换到完整 Standard 工具目录(25 个工具)。

设计思路来自社区项目 xiaobright/dsh-anchored-standard。同一参考评测中,该方案在 Project2 V4.1b 上得分约 98/99(n=2、单一冻结任务,不代表所有场景)。

工作原理

插件的核心是两阶段提升(promotion):

sequenceDiagram
    participant U as User
    participant A as Agent loop
    participant M as DeepSeek V4 Pro

    U->>A: first message (new session)
    A->>M: request #1<br/>task-matched anchor persona<br/>tools: bash + read (± edit/write)
    Note over M: reasoning chain anchors on the task-matched scaffold
    M->>A: first tool/call
    Note over A: promotion signal (durable session event)
    A->>M: request #2<br/>same persona · all 25 Standard tools
    Note over M: full-capability work continues on the anchored trajectory
  1. 会话的第一条用户消息决定锚定类型:
任务类型 锚定角色 首轮工具
spec — 修复 / 维护 / 调试 Minimal 原版提示 bash + read + edit
react — 从零构建 / 创建 动手实践型提示 bash + read + write
weak — 意图不明确 模型自行分类(Pro 用 classify instruction) bash + read

glob / grep 不出现在任何引导阶段工具目录中;edit / write 被视为锚定安全工具。首轮请求中,锚定角色是唯一提示段落,运行时上下文被清空。

  1. 会话产生第一次持久的 tool/call 后,后续每个请求看到完整 Standard 目录;锚定角色保持不变,plan-mode 等其余段落恢复。模式和提升状态写入持久会话事件,刷新或恢复会话后仍有效。

安装与启用

插件通过 DSH 安装器 bundle 分发,推荐命令如下:

dsh plugin --profile web add github:Jungod1121/dsh-anchored-standard

执行后重启 DeepSeek Harness。bundle 会把预设复制到 $DSH_HOME/.agent-presets/anchored-standard/(幂等操作,不会覆盖本地修改)。新建空白会话,选择 Anchored Standard (experimental) 即可使用。

若要将其设为新建会话的默认预设,编辑 $DSH_HOME/settings.yaml

# $DSH_HOME/settings.yaml
agent-presets:
  default: anchored-standard

也可手动复制预设目录:

dsh_home="${DSH_HOME:-$HOME/.dsh}"
mkdir -p "$dsh_home/.agent-presets"
cp -R preset "$dsh_home/.agent-presets/anchored-standard"

卸载:

dsh plugin --profile web remove dsh-anchored-standard
rm -rf "${DSH_HOME:-$HOME/.dsh}/.agent-presets/anchored-standard"

验证两阶段切换

导出会话 JSONL,检查 request/header 事件。首轮 header 只含 bash / read(及可能的 edit / write),提升后 header 包含全部 25 个工具:

seq 18  -> 2 tools  ['bash', 'read']                       # request #1
seq 137 -> 25 tools ['ask_user_question', 'bash', ...]     # request #2 (promoted)

与 Minimal、Standard 的取舍

对比对象 获得 代价
vs Minimal 多 23 个工具(glob / grep / edit / write / web_search / subagents / workflows / skills / goals / todo 等) 引导阶段多一轮推理
vs Standard 任务匹配的轨迹锚定(参考评测 98/99 vs 91/92)+ 更干净的首轮请求 首轮工具目录由关键词分类决定,模糊任务回退到 weak 锚定

适用场景与注意

适合谁

  • 使用 DeepSeek V4 Pro(reasoningEffort: max)在 DSH 中处理工程任务,希望首轮推理轨迹接近 Minimal、后续又能调用完整 Standard 能力。
  • 已在 Harness 0.1.0-rc.6 上验证机制;升级上游前建议复查兼容性。

不适合谁

  • V4 Flash 模型:README 指出 Flash 对 harness 风格变化不敏感,无需此预设。

安装前须知

  • 插件以当前 DSH 进程权限运行,安装前应检查 源码 与 MIT 许可证。
  • 这是社区项目,非 DeepSeek 官方预设,与 DeepSeek / 幻方无从属关系。
  • 98/99 评测分数来自 xiaobright/modeltest Project2 V4.1b,n=2、单一任务,是可复现的参考证据,不是通用保证。

结尾

dsh-anchored-standard 用「首轮锚定 + 后续全量工具」的两阶段策略,在 DSH 里兼顾 Minimal 的推理轨迹与 Standard 的工具广度。若你正在调试 Pro 模型的首轮行为,可以从新建会话选用该预设开始。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜