dsh-vision-tools:给 DSH 会话增加图片理解能力

dsh-vision-tools 是 DSH 生态中的视觉插件,由 moon09300731 维护(MIT 许可)。它提供全局 `vision_understand` 工具,通过 OpenAI 兼容 API(支持智谱、阿里、硅基流动、OpenAI)理解本地图片,实现画面描述、文字识别及基于图片的回答。图片可通过粘贴、拖拽或按钮选择方式送入,自动保存至指定目录并填入提示词。插件支持限流自动降级、全局及项目级配置实时生效,并在 Web 界面提供“识图”入口。安装命令为 `dsh plugin --profile web add dsh-vision-tools`,需重启 `dsh web`。配置需

阅读全文
dsh-vision-plugin:为 DSH 增加图片理解能力

dsh-vision-plugin 是专为 DeepSeek Harness (DSH) 开发的插件,旨在解决纯文本模型无法直接处理图片的限制。该插件通过调用 OpenRouter 的免费多模态模型(`:free`),在发送前将图片自动转换为文字描述,从而赋予 DeepSeek 等文本模型图片理解能力,且使用过程零 API 成本。 主要功能包括:提供 `describe_image` 工具读取本地图片;通过 `llm/stream` 钩子在模型不支持图片时自动拦截并转换图片;首次启动时自动在配置文件中写入指向 OpenRouter 的 `deepseek-vision` provider。使用

阅读全文
dsh-vision:为 DeepSeek Harness 的纯文本 DeepSeek 增加图片理解

dsh-vision 是由 54xkeee 开发的 DeepSeek Harness 插件,旨在为纯文本模型 DeepSeek 增加图片理解能力。它通过包装适配器将图片转为文本占位,并将识别结果回填供模型处理。该插件默认使用豆包 Web 通道,只需浏览器登录即可,免 API key 且零成本;同时支持反重力 IDE、Gemini API、Cockpit 反代、aicode 直连及任意 IDE CLI 等多种接入方式。核心功能包括视觉证据记忆、内容哈希缓存、档位自动升级及四种任务模式。安装简单,配置灵活,适用于希望低成本为 DSH 增加视觉能力或已有相关 IDE/API 额度的开发者。需注意检查

阅读全文
使用dsh-vision在DeepSeek Harness中实现接近原生的图片理解

dsh-vision 是 oil-oil 维护的 DeepSeek Harness 插件,MIT 开源,当前 0.1.0,面向 dsh 0.1.0-rc.6。主模型能看图时原图直发;纯文本 DeepSeek 则把原图交给 ZenMux、百炼、TokenDance 或 OpenRouter 观察,再以非可信上下文交回原模型作答,并兼容 see-skill 与本地 OCR。本文根据目录页与 GitHub README 核实安装、配置和安全边界。

阅读全文