dsh-eye-vision:爲 text-only DSH 模型提供圖像理解、OCR 與 UI 分析
dsh-eye-vision 是面向 DeepSeek Harness 的 DSH 插件,旨在解決主模型僅支持文本輸入但需處理圖像任務的痛點。該插件通過調用任意 OpenAI-compatible 多模態 API,實現圖像理解、OCR 及 UI 分析,並將結果以文本形式返回給主模型,無需主模型直接支持圖像輸入。其核心功能包括提供 image_understand 工具、支持大圖像裁剪、配置目錄白名單、免重啓生效以及剝離代理環境變量等。用戶可通過 dsh plugin add 命令快速安裝,支持本地路徑、URL 或 data URI 作爲圖像源,並可通過指定 task_type 來執行自動識別、
閱讀全文dsh-ext-vision-proxy:給 DeepSeek Harness 文本模型接外部視覺 API
dsh-ext-vision-proxy 是一個面向 DeepSeek Harness (DSH) 的外部視覺代理插件,由 jin123-alpha 維護,採用 MIT 許可證。其核心功能是通過接入 OpenAI 兼容的視覺 API,讓 DeepSeek-V3 和 R1 等純文本模型能夠理解並分析圖片、截圖及圖表。插件主要提供 `vision_describe` 工具供模型調用,在聊天輸入欄增加狀態開關和模型選擇器,並在設置頁面提供 Base URL、API Key 配置及連通性測試功能。它支持解析多種圖片格式,並區分多模態與文本模型的不同會話狀態。安裝需執行 `npm install`、`b
閱讀全文DSH DeepSeek Vision:爲文本 DSH 模型增加圖像理解、OCR 與視覺證據
DSH DeepSeek Vision 是由 Argonaut790 維護的 MIT 許可證插件,旨在爲僅支持文本的 DeepSeek Harness 模型增加視覺能力。它通過引入獨立的視覺路由,提供圖像理解、全屏 OCR 及持久視覺證據功能,使文本模型能調用圖像分析能力並將結果保留在對話中,實現證據可回溯。核心功能包括支持多種圖片選擇策略、會話範圍視覺分析器、結構化摘要輸出,以及全局 Vision 提供商選擇器。安裝需滿足特定 Node.js 及 Harness 版本要求,未發佈至 npm,需通過本地構建並添加至 Web profile,配置時需避免與內建視覺工具衝突。該插件適用於需穩定將圖
閱讀全文dsh-vision-bridge:爲 DeepSeek Harness 文字優先模型增加圖像理解
dsh-vision-bridge 是 DeepSeek Harness 的一款 MIT 許可插件,旨在爲文字優先模型提供圖像理解能力。該插件將圖像請求橋接至外部視覺 API(支持 Gemini、OpenAI 及 Anthropic 兼容接口),並僅將分析結果以文本形式返回,避免圖像塊直接轉發給上游模型。其核心優勢在於保留原有模型列表與選擇體驗,通過模型旁的“眼鏡”控件獨立管理視覺橋接偏好,不干擾模型選擇邏輯。插件支持在設置中配置多個隔離的視覺提供者,嚴格限定使用 HTTPS 端點,並將 API 密鑰等敏感信息保留在 Host 端。安裝需兼容 Harness 0.1.x 及 Node.js 2
閱讀全文dsh-vision:爲 DeepSeek Harness 補上近原生的圖像理解
dsh-vision 是 oil-oil 維護的 DeepSeek Harness 插件(MIT,v0.1.2),支持 rc.6/rc.7。主模型能看圖時原圖直傳;純文本模型時由獨立視覺後端觀察圖片並注入不可信上下文,雲端不可用時回退 macOS Vision 或 Tesseract。可通過 Vision Recognition 卡片或 settings.yaml 配置 ZenMux、Model Studio 等後端,兼容 see-skill。安裝:npx @deepseek-ai/dsh plugin --profile web add github:oil-oil/dsh-vision。
閱讀全文