前言¶
在 DSH 这类「一切皆插件」的插件体系里,常见痛点是:DeepSeek 文本模型能读文件,但不能直接看图片。错误截图、UI 稿、图表如果只能靠人工转述,效率低且容易失真。deepseek-vl-support 的思路是:不要求文本模型原生看图,而是在它尝试读图时,把图片交给一个可选的视觉服务,再把文字描述回传给模型。
这是什么¶
limccn/deepseek-vl-support 是由 limccn 维护的 MIT 许可插件,npm 包名为 @limccn/deepseek-vl-support。它把图片读取请求拦截下来,发送到所选的 OpenAI-compatible vision endpoint,再将结果以文本形式返回给模型。
核心功能¶
- 为 DeepSeek 文本模型提供图片理解路径:当模型读取图片时,插件把图片发往选定的视觉服务。
- 返回给模型的内容为固定格式:
[Vision of screenshot.png]: <description>。 - 支持 OpenAI-compatible vision endpoints,包括 OpenRouter、SiliconFlow、DashScope、Ollama、llama.cpp、VLLM 和 LM Studio。
- 支持多个 agent,包括 Claude Code、Codex、DeepSeek Harness、Cursor、GitHub Copilot、VS Code、OpenCode 和 Trae。
- 提供一次性安装向导、按 agent 安装命令,以及
doctor检查命令。 - 附带
deepseek-visionskill,采用标准 Agent Skills 布局。 - 对 DeepSeek Harness 通过 in-process bundle patch 提供支持。
安装与启用¶
先确认环境:
- Node.js 18 或更新版本。
- 一个视觉服务账号和 API key。安装器会询问一次,只保存在本机。
在项目目录运行安装向导:
cd path/to/your/project
npx @limccn/deepseek-vl-support@latest install
安装完成后,重启会话。可选检查:
npx @limccn/deepseek-vl-support@latest doctor # look for [OK]
按 agent 安装¶
如果只需要给某个 agent 启用,可使用对应命令。
Claude Code:
npx @limccn/deepseek-vl-support@latest install --target claude
Codex:
npx @limccn/deepseek-vl-support@latest install --target codex
DeepSeek Harness:
dsh plugin --profile web add @limccn/deepseek-vl-support@latest
其他安装方式¶
如果只需要 deepseek-vision skill,可以使用 Agent Skills CLI:
npx skills add https://github.com/limccn/deepseek-vl-support
如果 agent 支持 Agent Plugins 标准,也可以在对话里说:
Install the plugin from https://github.com/limccn/deepseek-vl-support and enable it
从 GitHub 安装后,再用一次命令配置视觉 endpoint:
npx @limccn/deepseek-vl-support@latest install --target <your agent>
典型用法¶
安装并重启会话后,让模型读取一张图片即可。工具会把视觉服务返回的描述交给模型,格式如下:
[Vision of screenshot.png]: <description>
模型随后基于这段描述继续回答。
从 0.2.x 迁移到 0.3.0¶
0.3.0 将 npm 包移动到 @limccn/deepseek-vl-support,并发布到 npmjs 和 GitHub Packages。CLI 命令、配置、缓存、skill 文件和标记保持不变;0.2.x 包保持冻结。
已有 0.2.x 时,可运行:
npx @limccn/deepseek-vl-support@latest install --update
然后检查:
npx @limccn/deepseek-vl-support@latest doctor
适用场景与注意¶
适合在 DSH、Claude Code、Codex 等 agent 中使用 DeepSeek 文本模型,并需要理解错误截图、UI 稿、图表等图片内容的场景。一次配置后,不需要额外维护模型设置或配置文件。
使用前建议:
- 确认所选视觉服务可用,API key 只用于本机存储和调用。
- 在 DSH 中启用时,插件以当前 dsh 进程权限运行;安装前检查源码与 MIT 许可证。
- 安装或迁移后重启对应会话,再执行
doctor或实际读图验证。
结尾¶
deepseek-vl-support 的价值在于:保留 DeepSeek 文本模型的工作流,同时通过外部视觉服务补上图片理解。GitHub 仓库地址为 https://github.com/limccn/deepseek-vl-support ;在 DSH 社区目录中可按仓库名 limccn/deepseek-vl-support 检索。