DSH DeepSeek Vision:为文本 DSH 模型增加图像理解、OCR 与视觉证据

DSH DeepSeek Vision 是由 Argonaut790 维护的 MIT 许可证插件,旨在为仅支持文本的 DeepSeek Harness 模型增加视觉能力。它通过引入独立的视觉路由,提供图像理解、全屏 OCR 及持久视觉证据功能,使文本模型能调用图像分析能力并将结果保留在对话中,实现证据可回溯。核心功能包括支持多种图片选择策略、会话范围视觉分析器、结构化摘要输出,以及全局 Vision 提供商选择器。安装需满足特定 Node.js 及 Harness 版本要求,未发布至 npm,需通过本地构建并添加至 Web profile,配置时需避免与内建视觉工具冲突。该插件适用于需稳定将图

阅读全文