前言¶
dsh-model-modes 是一个面向 DeepSeek Harness web composer 的 DSH 插件。它把能力感知的推理选择保留在 DSH 的官方模型选择器里,同时给 composer 增加一个明确的 Fast ON/OFF 开关。
这个插件要解决的是两个具体问题:不同 provider 的 Fast / Priority 请求参数不一致;以及 Fast 不应悄悄改变模型、降低 reasoning,或切换到另一个 DSH provider。
这是什么¶
dsh-model-modes 由 DTSFO 维护,许可证为 MIT,已核实的包版本是 0.1.3,Node 引擎要求是:
^22.19 || >=24
仓库地址:
https://github.com/DTSFO/dsh-model-modes
一句话定位:为 DeepSeek Harness web composer 提供 capability-aware reasoning profiles 和 provider-native Fast mode。
核心功能¶
- 保持 reasoning selection 在 DSH 的官方模型选择器内。
- 将
reasoningProfiles.provider: '*'展开到实际包含 exact model id 的llm-pi-aiprovider,不使用myself硬编码。 - 为
gpt-5.6暴露独立的Max和Ultra选择。 - 在 composer 中增加明确区分的
Fast ON/OFF开关。 - 应用当前 provider 的 native fast/priority request parameter,不降低 reasoning、不改变模型、不改变 DSH provider。
- 跟踪官方 per-session
ModelDirectory;不支持的路由可见地不可用,并被Host拒绝。 - 支持
Max + Fast和Ultra + Fast组合。
Fast 的注入发生在最终 llm-pi-ai 边界:
Models.streamSimple()
该注入使用 AsyncLocalStorage 隔离并发 session。
Fast 的边界¶
Fast 与 reasoning 正交。它不会选择 cheaper reasoning effort,不会选择 flash / turbo sibling model,也不会切换到另一个 DSH provider。
能力判断来自 live llm-pi-ai route 和 selected model 的实际 pi-ai API id。不支持的路由会显示为 N/A,不能启用。
账号权益、区域容量、部署支持、fallback 和 billing 仍然是 provider 决策。
被拒绝的 built-in provider 不能靠分配 generic OpenAI-style 或 custom strategy 启用。未知或 self-hosted compatible gateway 默认不支持,需要 exact verified provider/model/API profile。
azure-openai-responses、google-vertex、amazon-bedrock 是 explicit opt-in only。
vercel-ai-gateway 的 Fast mode 配置为 fast-or-fail:
allowFallbackFromFast: false
它不会静默 fallback 到 Standard。
fireworks 暴露 request-level Priority,使用:
service_tier: priority
这不是 *-fast router/model switch。
内置 Provider 合同¶
已核实的内置 provider 合同覆盖以下 provider:
openai
openai-codex
xai
google
openrouter
minimax / minimax-cn
vercel-ai-gateway
fireworks
azure-openai-responses
google-vertex
amazon-bedrock
这里表示插件为这些 provider 定义了已知请求合同;具体可用性仍受模型、路由、部署和 provider 约束。
配置¶
内置合同默认启用。fastProfiles 是 additive/override 层;later exact provider/model/API matchers win。
如果只想使用显式 profiles,可以关闭默认:
- id: dsh-model-modes
config:
includeDefaultFastProfiles: false
已核实资料中给出的 Vertex 显式 profile 字段如下。Vertex 需要显式配置,因为 matcher 不能检查 endpoint location:
fastProfiles:
- provider: google-vertex
model: gemini-3.7-flash
api: google-vertex
strategy: vertex-priority
可用的 known strategies 是:
openai-fast
openai-codex-fast
service-tier-priority
fireworks-priority
google-priority
vertex-priority
bedrock-priority
openrouter-fast
vercel-gateway-fast
custom
custom 只用于已验证的 gateway-specific contract。下面是一个已核实示例中的 body / headers 结构:
fastProfiles:
- provider: your-gateway
model: your-model
api: openai-responses
strategy: custom
body:
acceleration:
tier: turbo
headers:
X-Gateway-Fast: "1"
your-gateway 和 your-model 是占位名称;配置必须使用 exact provider/model/API。
安装与启用¶
已核实资料未提供官方安装命令,因此这里不拼接安装命令。使用前请通过仓库地址审查源码和 MIT 许可证。
这个插件以当前 dsh 进程权限运行。安装前应确认你接受该插件在最终 llm-pi-ai 边界进行请求参数注入。
运行信息:
name: dsh-model-modes
version: 0.1.3
license: MIT
node: ^22.19 || >=24
repository: https://github.com/DTSFO/dsh-model-modes
结尾¶
dsh-model-modes 的价值在于把 reasoning 选择留在 DSH 的官方模型选择器中,同时用 provider-native Fast / Priority 参数扩展 composer,并且对没有精确合同的路由保持拒绝。
仓库地址:
https://github.com/DTSFO/dsh-model-modes