dsh-plugin-mm-vision:給純文本 LLM 增加結構化看圖能力

dsh-plugin-mm-vision 是一款 DeepSeek Harness (DSH) 插件,旨在爲純文本 LLM 提供圖片理解能力。該插件註冊 `mm_vision` 工具,調用外部視覺模型將圖片轉化爲包含精確百分比座標的結構化空間文字描述,使文本模型無需直接處理圖像即可分析空間關係。 核心功能包括“通感編碼”,適用於 K 線圖、UI 截圖及自然照片等;支持像素級座標定位和可選的 40×30 像素色塊網格重建;具備自動模式,能根據圖表或自然圖特徵自適應調整輸出細節。插件支持配置任意 OpenAI 兼容視覺模型,並提供 TTL 緩存機制以提升響應速度。 安裝需 DSH 環境及 Node

閱讀全文
dsh-vision-provider:在 DeepSeek Harness Web UI 中選擇視覺模型組合

dsh-vision-provider 是 DeepSeek Harness (DSH) 的社區插件,旨在實現“視覺模型分析 + DeepSeek 推理回答”的雙模型橋接。它並非原生像素輸入,而是將 Settings 中聲明瞭圖像輸入能力的第三方視覺模型暴露爲可選組合。當用戶發送含圖請求時,由選定的視覺模型處理圖像,結果替換原圖後交由 DeepSeek 負責推理、工具調用及最終回答;純文本請求則直接由 DeepSeek 處理。 該插件支持通過 Web UI 配置第三方視覺模型或直連 OpenAI-compatible 端點。安裝需 Node.js >=22.19.0 及 DSH 兼容版本,使用

閱讀全文
dsh-vision-opencode:爲純文本主模型配置可切換的識圖模型

dsh-vision-opencode 是 DSH Web 端插件,通過可配置的視覺模型將聊天圖片轉爲文字,供 DeepSeek 等純文本主模型繼續推理,無需切換主模型。支持輸入框識圖模型選擇、Vision 設置、vision_read_image 工具與 vision-image-analysis skill,含 60s 超時與失敗重試兜底。安裝:dsh plugin --profile web add -w github:poiuyjie/dsh-vision-opencode。MIT 許可證,維護者 poiuyjie。

閱讀全文
使用dsh-vision給純文本DeepSeek Harness加上view_image識圖能力

william-jin-cmu 維護的 dsh-vision 給純文本 DeepSeek 註冊 view_image 工具,把本地圖片或 URL 轉發給任意 OpenAI 兼容 VLM,答案以文本返回。默認智譜免費檔 glm-4.6v-flash,可換成百鍊、方舟或本機 Ollama。社區目錄安裝命令爲 dsh plugin add github:william-jin-cmu/dsh-vision。插件以當前 dsh 進程權限運行,雲端路徑會把圖片發到第三方端點,裝前需檢查源碼與許可證。

閱讀全文
用 dsh-vision-proxy 讓 DeepSeek Harness 裏的純文本對話也能識圖

dsh-vision-proxy 是 Flyvhidbwo 維護的 DeepSeek Harness 界面增強插件(MIT)。它註冊 deepseek-vision 路由,把 GUI 附加圖片經 OpenAI 兼容 VLM 轉成文字後再交給純文本 DeepSeek 作答,默認百鍊 qwen3.7-flash,無密鑰時可自動探測本地 Ollama。本文按社區目錄頁與 GitHub README / package.json 覈對安裝命令、配置方式和隱私邊界。

閱讀全文