dsh-vision-helper:DeepSeek Harness 的持久化视觉插件

前言

DSH 的插件生态强调「一切皆插件」,社区目录是独立站点,不是官方应用商店,与 DeepSeek / 幻方无官方从属关系。

对于使用 DSH 智能体的场景,一个具体问题是如何让智能体稳定处理图片任务:它需要调用一个视觉分析工具,工具背后可接可配置的多模态模型,并且配置、注册和调用过程尽量低侵入。

dsh-vision-helper 是为 DeepSeek Harness 打造的持久化视觉插件,由 Yuuz12 维护,许可证为 MIT。它注册 vision_analyze 工具,基于可配置多模态模型分析图片,同时在 Web 应用中提供设置页界面。

下面介绍它的功能、安装、配置、卸载和注意事项。

这是什么

dsh-vision-helper 是一个 DSH 组合包插件,核心价值有三点:

  1. 注册 vision_analyze 工具,接受本地图片路径或 data: URI,返回分析文字。
  2. 支持配置多模态模型提供方与模型;providermodel 留空时自动选择多模态模型。
  3. 在 DSH Web 应用中提供「设置 → 视觉助手」界面,用于配置提供方、模型、温度、最大输出 tokens、最大图片边长。

它面向 DSH Web 部署;设置页仅 Web 端可见,但 vision_analyze 工具本身在挂载了该插件的任何 profile 中均可用。

核心功能

工具调用

vision_analyze 接受本地图片路径或 data: URI,发送给配置的多模态模型,并返回分析文字。

智能体在涉及图片的任务中,可被引导调用该工具。

模型配置

插件不携带任何 API Key。使用者需要在部署的 llm-pi-ai 设置中配置好多模态模型路由,或添加任意 OpenAI 兼容视觉端点。

可配置项包括:

provider
model
temperature
maxTokens
maxEdge
mode

其中:

  • providermodel 留空表示自动选择。
  • maxEdge 限制图片最长边像素,默认 4096px
  • mode 可选 autoforceoff,分别控制自动调用引导的智能、强制和关闭模式。

设置页

在 Web 应用中,可以通过「设置 → 视觉助手」配置:

  • 提供方
  • 模型
  • 温度
  • 最大输出 tokens
  • 最大图片边长

配置每次使用即时读取,无需重启;引导段在保存时自动重新注册。

零依赖与持久化

该插件采用零依赖设计:宿主模块没有任何 import,无需 npm install、无需修改 node_modules 结构、无需软链接。

作为 DSH 组合包,它是持久化且全局可用的:重启不丢失,所有会话可用。

健壮性处理

插件还包含以下处理:

  • 自动剥离粘贴路径中的不可见 Unicode 字符,如 U+202A
  • 按最长边限制图片尺寸。
  • 去重流式文本。
  • 提供友好错误提示。

安装与启用

前提

安装前确认以下事项:

  1. 已有 DSH Web 部署。
  2. 机器上有 pnpm。若使用 Node 自带 corepack,可执行:
corepack enable pnpm
  1. 已在 llm-pi-ai 设置中配置多模态模型路由,或已添加 OpenAI 兼容视觉端点。

npm 安装

推荐从 npm registry 安装:

npx @deepseek-ai/dsh plugin --profile web add dsh-vision-helper

GitHub 安装

也可以从 GitHub 安装:

npx @deepseek-ai/dsh plugin --profile web add github:Yuuz12/dsh-vision-helper

手动安装

备用方式是将 dsh-vision-helper 文件夹复制到 <profile>/node_modules/,并在 <profile>/cordis.patch.yml 添加插件行:

- insert:
    - id: dsh-vision-helper
      name: 'dsh-vision-helper'

安装后验证

执行:

npx @deepseek-ai/dsh --profile web --dump-config

输出中应看到 dsh-vision-helper 层。

然后重启:

dsh web

经过上面的步骤,插件即可在 DSH 中启用。

配置

可通过 Web 设置页配置,也可编辑数据目录下的 dsh-vision-helper.json

配置文件位置随安装方式不同:

  • registry / tarball / GitHub 安装:<profile>/dsh-vision-helper.json
  • 本地 link: 安装:回退到插件源码目录 <repo>/dsh-vision-helper.json

字段示例如下,具体值按你的 llm-pi-ai 路由填写:

{
  "provider": "<provider>",
  "model": "<model>",
  "temperature": "<number>",
  "maxTokens": "<number>",
  "maxEdge": 4096,
  "mode": "auto"
}

mode 说明:

  • auto:默认模式,控制自动调用引导的智能模式。
  • force:强制模式,要求涉及图片的任务使用该工具。
  • off:关闭模式,不注入自动调用引导,但工具仍注册。

典型用法

  1. 安装插件并重启 DSH。
   npx @deepseek-ai/dsh plugin --profile web add dsh-vision-helper
   npx @deepseek-ai/dsh --profile web --dump-config
   dsh web
  1. 在 Web 应用中打开「设置 → 视觉助手」。

  2. 选择提供方、模型、温度、最大输出 tokens、最大图片边长。

  3. 在任务中提供本地图片路径或 data: URI。

  4. 让智能体调用 vision_analyze,由配置的多模态模型返回分析文字。

如果偏好配置文件,也可以直接编辑对应的 dsh-vision-helper.json,然后让智能体再次使用视觉能力。

卸载

标准卸载

npx @deepseek-ai/dsh plugin --profile web remove dsh-vision-helper

该命令移除组合包层后,还需要删除配置文件并重启 DSH。

配置文件位置:

  • registry / tarball / GitHub 安装:<profile>/dsh-vision-helper.json
  • 本地 link: 安装:<repo>/dsh-vision-helper.json

本地 link: 安装时,remove 只删除 node_modules 链接,源码仓库原样保留。

手动卸载

如果之前是手动安装:

  1. <profile>/cordis.patch.yml 移除插件行。
  2. 删除 <profile>/node_modules/dsh-vision-helper
  3. 删除对应配置文件。
  4. 重启 DSH。

适用场景与注意

适合以下使用者:

  • 使用 DSH Web 部署。
  • 希望智能体在图片任务中调用独立的视觉分析工具。
  • 希望在 Web 设置页或配置文件中管理多模态模型参数。
  • 偏好低侵入安装方式,不希望引入额外依赖。

使用前务必注意:

  • 插件以当前 dsh 进程权限运行。安装前应检查源码与许可证。
  • 插件不携带 API Key,需要你自己配置多模态模型路由或 OpenAI 兼容视觉端点。
  • 设置页仅 Web 端提供;工具可在挂载该插件的任何 profile 中使用。
  • 社区目录是独立站点,不是官方应用商店。

结尾

dsh-vision-helper 提供 vision_analyze 工具、可配置多模态模型和 Web 设置页,适合把视觉分析能力接入 DSH 智能体。它的零依赖、持久化和配置即时读取,降低了在 DSH 中集成视觉能力的成本。

GitHub:https://github.com/Yuuz12/dsh-vision-helper

目录页:DSH 社区目录为独立站点;本文资料未提供可核实的目录页 URL,请以 DSH 社区目录发布地址为准。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

Xiaoye