DSH DeepSeek Vision:为文本 DSH 模型增加图像理解、OCR 与视觉证据

DSH DeepSeek Vision 是由 Argonaut790 维护的 MIT 许可证插件,旨在为仅支持文本的 DeepSeek Harness 模型增加视觉能力。它通过引入独立的视觉路由,提供图像理解、全屏 OCR 及持久视觉证据功能,使文本模型能调用图像分析能力并将结果保留在对话中,实现证据可回溯。核心功能包括支持多种图片选择策略、会话范围视觉分析器、结构化摘要输出,以及全局 Vision 提供商选择器。安装需满足特定 Node.js 及 Harness 版本要求,未发布至 npm,需通过本地构建并添加至 Web profile,配置时需避免与内建视觉工具冲突。该插件适用于需稳定将图

阅读全文
ds-vision-plugin:DeepSeek Harness 的网页图片转文本插件

ds-vision-plugin 是一个为 DeepSeek Harness 设计的开源插件,旨在解决文本型模型无法直接处理图片输入的问题。该插件在 Web 交互界面中自动将粘贴或拖入的图片转换为文本,供 DeepSeek 模型继续推理,无需用户手动切换工具或模型。其核心功能包括支持四模型竞速机制(如 agnes 和 glm 系列),以实现快速、可靠的首次有效响应;提供 Baidu OCR 或本地 Tesseract 的路由支持,并在不可用时回退至视觉语言模型;允许接入自定义 OpenAI 兼容模型或本地运行时(Ollama/LM Studio)。此外,插件具备完善的诊断工具、YAML 热重载

阅读全文