dsh-model-modes:DeepSeek Harness Web Composer 的推理档位与 Provider 原生 Fast 模式

前言

dsh-model-modes 是一个面向 DeepSeek Harness web composer 的 DSH 插件。它把能力感知的推理选择保留在 DSH 的官方模型选择器里,同时给 composer 增加一个明确的 Fast ON/OFF 开关。

这个插件要解决的是两个具体问题:不同 provider 的 Fast / Priority 请求参数不一致;以及 Fast 不应悄悄改变模型、降低 reasoning,或切换到另一个 DSH provider。

这是什么

dsh-model-modes 由 DTSFO 维护,许可证为 MIT,已核实的包版本是 0.1.3,Node 引擎要求是:

^22.19 || >=24

仓库地址:

https://github.com/DTSFO/dsh-model-modes

一句话定位:为 DeepSeek Harness web composer 提供 capability-aware reasoning profiles 和 provider-native Fast mode。

核心功能

  • 保持 reasoning selection 在 DSH 的官方模型选择器内。
  • reasoningProfiles.provider: '*' 展开到实际包含 exact model id 的 llm-pi-ai provider,不使用 myself 硬编码。
  • gpt-5.6 暴露独立的 MaxUltra 选择。
  • 在 composer 中增加明确区分的 Fast ON/OFF 开关。
  • 应用当前 provider 的 native fast/priority request parameter,不降低 reasoning、不改变模型、不改变 DSH provider。
  • 跟踪官方 per-session ModelDirectory;不支持的路由可见地不可用,并被 Host 拒绝。
  • 支持 Max + FastUltra + Fast 组合。

Fast 的注入发生在最终 llm-pi-ai 边界:

Models.streamSimple()

该注入使用 AsyncLocalStorage 隔离并发 session。

Fast 的边界

Fast 与 reasoning 正交。它不会选择 cheaper reasoning effort,不会选择 flash / turbo sibling model,也不会切换到另一个 DSH provider。

能力判断来自 live llm-pi-ai route 和 selected model 的实际 pi-ai API id。不支持的路由会显示为 N/A,不能启用。

账号权益、区域容量、部署支持、fallback 和 billing 仍然是 provider 决策。

被拒绝的 built-in provider 不能靠分配 generic OpenAI-style 或 custom strategy 启用。未知或 self-hosted compatible gateway 默认不支持,需要 exact verified provider/model/API profile。

azure-openai-responsesgoogle-vertexamazon-bedrock 是 explicit opt-in only。

vercel-ai-gateway 的 Fast mode 配置为 fast-or-fail:

allowFallbackFromFast: false

它不会静默 fallback 到 Standard。

fireworks 暴露 request-level Priority,使用:

service_tier: priority

这不是 *-fast router/model switch。

内置 Provider 合同

已核实的内置 provider 合同覆盖以下 provider:

openai
openai-codex
xai
google
openrouter
minimax / minimax-cn
vercel-ai-gateway
fireworks
azure-openai-responses
google-vertex
amazon-bedrock

这里表示插件为这些 provider 定义了已知请求合同;具体可用性仍受模型、路由、部署和 provider 约束。

配置

内置合同默认启用。fastProfiles 是 additive/override 层;later exact provider/model/API matchers win。

如果只想使用显式 profiles,可以关闭默认:

- id: dsh-model-modes
  config:
    includeDefaultFastProfiles: false

已核实资料中给出的 Vertex 显式 profile 字段如下。Vertex 需要显式配置,因为 matcher 不能检查 endpoint location:

fastProfiles:
  - provider: google-vertex
    model: gemini-3.7-flash
    api: google-vertex
    strategy: vertex-priority

可用的 known strategies 是:

openai-fast
openai-codex-fast
service-tier-priority
fireworks-priority
google-priority
vertex-priority
bedrock-priority
openrouter-fast
vercel-gateway-fast
custom

custom 只用于已验证的 gateway-specific contract。下面是一个已核实示例中的 body / headers 结构:

fastProfiles:
  - provider: your-gateway
    model: your-model
    api: openai-responses
    strategy: custom
    body:
      acceleration:
        tier: turbo
    headers:
      X-Gateway-Fast: "1"

your-gatewayyour-model 是占位名称;配置必须使用 exact provider/model/API。

安装与启用

已核实资料未提供官方安装命令,因此这里不拼接安装命令。使用前请通过仓库地址审查源码和 MIT 许可证。

这个插件以当前 dsh 进程权限运行。安装前应确认你接受该插件在最终 llm-pi-ai 边界进行请求参数注入。

运行信息:

name: dsh-model-modes
version: 0.1.3
license: MIT
node: ^22.19 || >=24
repository: https://github.com/DTSFO/dsh-model-modes

结尾

dsh-model-modes 的价值在于把 reasoning 选择留在 DSH 的官方模型选择器中,同时用 provider-native Fast / Priority 参数扩展 composer,并且对没有精确合同的路由保持拒绝。

仓库地址:

https://github.com/DTSFO/dsh-model-modes
羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

Xiaoye