DSH DeepSeek Vision:爲文本 DSH 模型增加圖像理解、OCR 與視覺證據
DSH DeepSeek Vision 是由 Argonaut790 維護的 MIT 許可證插件,旨在爲僅支持文本的 DeepSeek Harness 模型增加視覺能力。它通過引入獨立的視覺路由,提供圖像理解、全屏 OCR 及持久視覺證據功能,使文本模型能調用圖像分析能力並將結果保留在對話中,實現證據可回溯。核心功能包括支持多種圖片選擇策略、會話範圍視覺分析器、結構化摘要輸出,以及全局 Vision 提供商選擇器。安裝需滿足特定 Node.js 及 Harness 版本要求,未發佈至 npm,需通過本地構建並添加至 Web profile,配置時需避免與內建視覺工具衝突。該插件適用於需穩定將圖
閱讀全文