前言¶
DSH 的插件生态强调「一切皆插件」,社区目录是独立站点,不是官方应用商店,与 DeepSeek / 幻方无官方从属关系。
对于使用 DSH 智能体的场景,一个具体问题是如何让智能体稳定处理图片任务:它需要调用一个视觉分析工具,工具背后可接可配置的多模态模型,并且配置、注册和调用过程尽量低侵入。
dsh-vision-helper 是为 DeepSeek Harness 打造的持久化视觉插件,由 Yuuz12 维护,许可证为 MIT。它注册 vision_analyze 工具,基于可配置多模态模型分析图片,同时在 Web 应用中提供设置页界面。
下面介绍它的功能、安装、配置、卸载和注意事项。
这是什么¶
dsh-vision-helper 是一个 DSH 组合包插件,核心价值有三点:
- 注册
vision_analyze工具,接受本地图片路径或data:URI,返回分析文字。 - 支持配置多模态模型提供方与模型;
provider和model留空时自动选择多模态模型。 - 在 DSH Web 应用中提供「设置 → 视觉助手」界面,用于配置提供方、模型、温度、最大输出 tokens、最大图片边长。
它面向 DSH Web 部署;设置页仅 Web 端可见,但 vision_analyze 工具本身在挂载了该插件的任何 profile 中均可用。
核心功能¶
工具调用¶
vision_analyze 接受本地图片路径或 data: URI,发送给配置的多模态模型,并返回分析文字。
智能体在涉及图片的任务中,可被引导调用该工具。
模型配置¶
插件不携带任何 API Key。使用者需要在部署的 llm-pi-ai 设置中配置好多模态模型路由,或添加任意 OpenAI 兼容视觉端点。
可配置项包括:
provider
model
temperature
maxTokens
maxEdge
mode
其中:
provider和model留空表示自动选择。maxEdge限制图片最长边像素,默认4096px。mode可选auto、force、off,分别控制自动调用引导的智能、强制和关闭模式。
设置页¶
在 Web 应用中,可以通过「设置 → 视觉助手」配置:
- 提供方
- 模型
- 温度
- 最大输出 tokens
- 最大图片边长
配置每次使用即时读取,无需重启;引导段在保存时自动重新注册。
零依赖与持久化¶
该插件采用零依赖设计:宿主模块没有任何 import,无需 npm install、无需修改 node_modules 结构、无需软链接。
作为 DSH 组合包,它是持久化且全局可用的:重启不丢失,所有会话可用。
健壮性处理¶
插件还包含以下处理:
- 自动剥离粘贴路径中的不可见 Unicode 字符,如
U+202A。 - 按最长边限制图片尺寸。
- 去重流式文本。
- 提供友好错误提示。
安装与启用¶
前提¶
安装前确认以下事项:
- 已有 DSH Web 部署。
- 机器上有 pnpm。若使用 Node 自带 corepack,可执行:
corepack enable pnpm
- 已在
llm-pi-ai设置中配置多模态模型路由,或已添加 OpenAI 兼容视觉端点。
npm 安装¶
推荐从 npm registry 安装:
npx @deepseek-ai/dsh plugin --profile web add dsh-vision-helper
GitHub 安装¶
也可以从 GitHub 安装:
npx @deepseek-ai/dsh plugin --profile web add github:Yuuz12/dsh-vision-helper
手动安装¶
备用方式是将 dsh-vision-helper 文件夹复制到 <profile>/node_modules/,并在 <profile>/cordis.patch.yml 添加插件行:
- insert:
- id: dsh-vision-helper
name: 'dsh-vision-helper'
安装后验证¶
执行:
npx @deepseek-ai/dsh --profile web --dump-config
输出中应看到 dsh-vision-helper 层。
然后重启:
dsh web
经过上面的步骤,插件即可在 DSH 中启用。
配置¶
可通过 Web 设置页配置,也可编辑数据目录下的 dsh-vision-helper.json。
配置文件位置随安装方式不同:
- registry / tarball / GitHub 安装:
<profile>/dsh-vision-helper.json - 本地
link:安装:回退到插件源码目录<repo>/dsh-vision-helper.json
字段示例如下,具体值按你的 llm-pi-ai 路由填写:
{
"provider": "<provider>",
"model": "<model>",
"temperature": "<number>",
"maxTokens": "<number>",
"maxEdge": 4096,
"mode": "auto"
}
mode 说明:
auto:默认模式,控制自动调用引导的智能模式。force:强制模式,要求涉及图片的任务使用该工具。off:关闭模式,不注入自动调用引导,但工具仍注册。
典型用法¶
- 安装插件并重启 DSH。
npx @deepseek-ai/dsh plugin --profile web add dsh-vision-helper
npx @deepseek-ai/dsh --profile web --dump-config
dsh web
-
在 Web 应用中打开「设置 → 视觉助手」。
-
选择提供方、模型、温度、最大输出 tokens、最大图片边长。
-
在任务中提供本地图片路径或
data:URI。 -
让智能体调用
vision_analyze,由配置的多模态模型返回分析文字。
如果偏好配置文件,也可以直接编辑对应的 dsh-vision-helper.json,然后让智能体再次使用视觉能力。
卸载¶
标准卸载¶
npx @deepseek-ai/dsh plugin --profile web remove dsh-vision-helper
该命令移除组合包层后,还需要删除配置文件并重启 DSH。
配置文件位置:
- registry / tarball / GitHub 安装:
<profile>/dsh-vision-helper.json - 本地
link:安装:<repo>/dsh-vision-helper.json
本地 link: 安装时,remove 只删除 node_modules 链接,源码仓库原样保留。
手动卸载¶
如果之前是手动安装:
- 从
<profile>/cordis.patch.yml移除插件行。 - 删除
<profile>/node_modules/dsh-vision-helper。 - 删除对应配置文件。
- 重启 DSH。
适用场景与注意¶
适合以下使用者:
- 使用 DSH Web 部署。
- 希望智能体在图片任务中调用独立的视觉分析工具。
- 希望在 Web 设置页或配置文件中管理多模态模型参数。
- 偏好低侵入安装方式,不希望引入额外依赖。
使用前务必注意:
- 插件以当前 dsh 进程权限运行。安装前应检查源码与许可证。
- 插件不携带 API Key,需要你自己配置多模态模型路由或 OpenAI 兼容视觉端点。
- 设置页仅 Web 端提供;工具可在挂载该插件的任何 profile 中使用。
- 社区目录是独立站点,不是官方应用商店。
结尾¶
dsh-vision-helper 提供 vision_analyze 工具、可配置多模态模型和 Web 设置页,适合把视觉分析能力接入 DSH 智能体。它的零依赖、持久化和配置即时读取,降低了在 DSH 中集成视觉能力的成本。
GitHub:https://github.com/Yuuz12/dsh-vision-helper
目录页:DSH 社区目录为独立站点;本文资料未提供可核实的目录页 URL,请以 DSH 社区目录发布地址为准。