前言¶
在 DSH 中使用火山方舟的 Agent Plan 与 Coding Plan 时,需要先对齐 provider 路由、协议、兼容开关、凭据顺序和模型上限。dsh-llm-volcengine 把这些内容打包成 DSH 插件,安装后两条 provider 会直接进入模型选择器。
这是什么¶
dsh-llm-volcengine 由 Badakonpro 维护,许可证为 MIT。它为 DeepSeek Harness(DSH)注册 volcengine-plan 与 volcengine-coding 两条 LLM provider 路由,并带有已验证的思考强度兼容性。
插件使用 self-contained pi-ai-backed LlmAdapter,使模型目录和兼容性开关进入 pi-ai,且不依赖 dsh-llm-pi-ai settings compat schema。
核心功能¶
- 注册
volcengine-plan与volcengine-coding两条 LLM provider 路由。 - Agent Plan 路由使用
openai-responses;其中 Kimi K2.6 / K2.7 Code 使用openai-completions。 - Coding Plan 路由使用
openai-completions,并设置supportsDeveloperRole: false、supportsStore: false、supportsStrictMode: false、maxTokensField: "max_tokens"。 - 在端点支持时暴露 thinking levels:
low/medium/high/xhigh/max。 - 支持通过 DSH credential service 或 ambient environment 解析 API key。
- 支持通过
cordis.patch.yml配置agentPlanApiKeyEnv、codingPlanApiKeyEnv、defaultReasoning。
安装与启用¶
在 DSH profile 根目录(例如 ~/.dsh/profiles/web)执行:
dsh plugin --profile web add dsh-llm-volcengine
安装后重启 DSH 或 reload profile,使新的 bundle layer 生效。
启用后,两个 provider 会出现在模型选择器中:
volcengine-plan/<model>volcengine-coding/<model>
典型用法¶
凭据¶
插件通过 DSH credential service 或 ambient environment 解析 API key。默认尝试顺序为:
volcengine-plan:ARK_AGENT_PLAN_API_KEY、VOLCENGINE_ARK_PLAN_API_KEY、ARK_CODE_API_KEYvolcengine-coding:ARK_CODING_PLAN_API_KEY、VOLCENGINE_CODING_API_KEY、HUOSHAN_API_KEY
可以通过 web Models 页面保存 API key(写入 DSH credential store),也可以 export 环境变量。
cordis.patch.yml¶
在 cordis.patch.yml 中可配置以下字段:
agentPlanApiKeyEnv: ARK_AGENT_PLAN_API_KEY
codingPlanApiKeyEnv: ARK_CODING_PLAN_API_KEY
defaultReasoning: high
defaultReasoning 可取 off | minimal | low | medium | high | xhigh | max,默认值为 high。
适用场景与注意¶
适合需要把火山方舟 Agent Plan / Coding Plan 接入 DSH、统一处理 provider 路由、凭据解析和 thinking level 的场景。
需要注意:
- 插件以当前 DSH 进程权限运行;安装前应检查源码和 MIT 许可证。
package.json声明 peerDependencies:@deepseek-ai/dsh-credentials、@deepseek-ai/dsh-launch-environment、@deepseek-ai/dsh-llm、@deepseek-ai/dsh-llm-pi-ai、@earendil-works/pi-ai。- Coding Plan 网关拒绝 developer 角色、store,并要求
max_tokens字段;插件通过 Coding Plan 路由的兼容开关处理这些请求项。 - 部分 Coding Plan 模型没有 thinking control:
minimax-m2.7、minimax-m3、doubao-seed-code。 - 不同模型有各自的
maxTokens上限,README 按模型列出已验证上限;选择模型时应以 README 中对应模型的上限为准。
链接¶
dsh-llm-volcengine 的价值在于把火山方舟两条计划路由的协议、兼容开关、凭据顺序和 thinking level 集中到 DSH 插件中。
GitHub:https://github.com/Badakonpro/dsh-llm-volcengine
目录页线索:https://www.skillhub.cn/plugins/Badakonpro/dsh-llm-volcengine(来自插件线索,未在当前抓取资料中核对)。社区目录是独立站点,不要将其理解为 DeepSeek / 幻方官方应用商店。