ds-vision-plugin:DeepSeek Harness 的网页图片转文本插件
ds-vision-plugin 是一个为 DeepSeek Harness 设计的开源插件,旨在解决文本型模型无法直接处理图片输入的问题。该插件在 Web 交互界面中自动将粘贴或拖入的图片转换为文本,供 DeepSeek 模型继续推理,无需用户手动切换工具或模型。其核心功能包括支持四模型竞速机制(如 agnes 和 glm 系列),以实现快速、可靠的首次有效响应;提供 Baidu OCR 或本地 Tesseract 的路由支持,并在不可用时回退至视觉语言模型;允许接入自定义 OpenAI 兼容模型或本地运行时(Ollama/LM Studio)。此外,插件具备完善的诊断工具、YAML 热重载
阅读全文dsh-visual-plugin:为 DSH Web UI 补齐图像与视频理解
dsh-visual-plugin 是 jyh20030112 为 DeepSeek Harness Web 端开发的视觉媒体插件。图像走 DSH 原生附件与当前视觉模型路径,右侧面板记录可复制的描述历史;视频经 FFprobe 校验、H.264 规范化与 PySceneDetect 关键帧抽取后交由模型分析。安装命令为 dsh plugin --profile web add dsh-visual-plugin,视频功能需宿主机预装 FFmpeg >= 6.1 与 PySceneDetect 0.7.x。MIT 许可,零运行时 npm 依赖。
阅读全文dsh-media-skills:为 DeepSeek Harness 补齐免费读图与生图
dsh-media-skills 是 MJorgin 维护的 DSH 插件(MIT,v0.3.0),支持 rc.7/rc.8/v0.1.1-rc.x。提供贴图自动转述、vision-review 读图与 media-tools 生图,视觉路由含 GLM-4V-Flash 与 DeepSeek-V4-Flash-Vision-Exp,生图走 SenseNova U1 Fast 与 Kolors。密钥不写进仓库,安装命令为 dsh plugin --profile <name> add github:MJorgin/dsh-media-skills。
阅读全文ModLens:为纯文本模型补上视觉能力
ModLens 是 liustack 维护的 DSH 视觉插件(MIT,v3.25.0)。粘贴图片后由独立视觉引擎生成 OCR、版面与语义的结构化 JSON 证据,供 DeepSeek、GLM 等纯文本模型作答。支持直接粘贴与 (modlens vision) 模型两种路径,内置六种 provider 并可复用本机 CLI 登录态。DSH 安装命令:npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.25.0。
阅读全文用 dsh-vision-router 给纯文本 DeepSeek Harness 智能体装上眼睛
dsh-vision-router 是 ysr666 维护的 DeepSeek Harness 视觉路由插件:视觉模型只当眼睛,DeepSeek 继续推理;内置免密钥 OVH 视觉链路,附带 14 个像素级工具(问答、定位、裁剪、像素对比、OCR 等)。一条命令安装,发图前点「👁 Vision」即可像普通工具轮次一样多步识图。本文基于 SkillHub 目录页与 GitHub README 核实安装命令、工具清单与使用注意。
阅读全文用 dsh-vision-router 给纯文本 DeepSeek Harness 智能体装上眼睛
dsh-vision-router 是 ysr666 维护的 DSH 工具与能力插件(MIT,v1.4.4)。它把视觉模型当眼睛、DeepSeek 当大脑,默认提供免 Key 的 OVH 匿名兜底,并注册问答、定位、裁剪、像素对比、OCR 等 11 个像素级工具。本文按社区目录与 GitHub README 核实安装命令、自动识图模型组用法和权限注意事项。
阅读全文使用 dsh-vision-toolkit 给 DeepSeek Harness 纯文本模型补上视觉能力
dsh-vision-toolkit 是 Anionex 维护的 DeepSeek Harness 界面增强插件,把 agent-vision-toolkit 接到 Web / Headless Profile。纯文本模型粘贴图片后可切到 Vision Toolkit 变体,完成带意图的图片问答、元素定位、长截图 OCR 和带像素对比的 UI 还原。目录安装命令为 dsh plugin add github:Anionex/dsh-vision-toolkit,MIT 许可,当前 npm 版本 0.1.20。
阅读全文用 modlens 给 DeepSeek Harness 的纯文本模型补上视觉
modlens 是 liustack 维护的 DeepSeek Harness 视觉插件(MIT,写作时版本 3.18.1)。纯文本 DeepSeek / GLM 看不见截图时,它注册 modlens_read_image,把粘贴图片转成带 OCR、版面与语义的 JSON。本文按社区目录与 GitHub 核实安装命令、两种贴图路径、引擎配置和输出契约。
阅读全文